Folien: Bildgenerierung & visuelle KI
← Zurück

← Zurück zu Tag 12 · M1-T12

Folien: Bildgenerierung & visuelle KI

Alle 38 Folien aus AppliedAIProfessional-M1-W3-T12.pptx, maschinell aus dem Deck gespiegelt am 2026-09-23. Diese Seite ist keine redaktionelle Auswertung. Sie zeigt, was im Deck steht, einschließlich Sprechernotizen. Die kuratierte Auswertung steht auf der Tagesseite.

Folie 1

Applied AI Professional TAG 12

AI Transformation Institute

01. September 2026

Thorsten Gluitz | Marc Elsner

Folie 2

UNSER CODE OF KNOWLEDGE TRANSFER

#GernePerDu

#SonstFragenWir

#ImmerFragen✋

Sprechernotiz

MA machen lassen – micht alles Vorbesetimmen, speed I Bei Mitarbeiter Helfen Schulungen, Multiplikatoren , Center of Excellellence Strategische Richtung klar definieren: Vision und Mission deutlich kommunizieren Langfristige Ziele und kurzfristige Meilensteine festlegen Schlüsselindikatoren für Erfolg bestimmen Einbindung und Empowerment der Mitarbeiter: Nutzung von Basis Tools ermöglichen Fortbildungen und klare Regeln zur Nutzung Ermutigung eigene Projekte zu entwerfen Tools und Ressourcen für Tools oder iegene Entwicklungen bereitstellen: Erfolgsmessung und Anpassung: Strategische Leitlinie + Mitarbeiter mitnehmen! -> Angst nehmen + Technologieverständnis + Compliance einhalten -> Schulungen von einzelnen Team für Use Cases

Folie 3

EURE REFERENTEN FÜR HEUTE

Marc Elsner

Diverse KI-Projekte in der Modebranche betreut Kooperation mit Weltmarken Breites Erfahrungsspektrum der Bild- und Videoproduktion als Erfahrungsgrundlage für KI Projekte

Video Design & Art Direction

Tobias Pingel

Gründer aufdenpunkt.ai Programm- und Change-Manager Informatik-Ingenieur und Dozent

KI Enablement & Automatisierung

Folie 3, Bild aus dem Deck (Grafik 12)Folie 3, Bild aus dem Deck (Picture 8)
Sprechernotiz

MA machen lassen – micht alles Vorbesetimmen, speed I Bei Mitarbeiter Helfen Schulungen, Multiplikatoren , Center of Excellellence Strategische Richtung klar definieren: Vision und Mission deutlich kommunizieren Langfristige Ziele und kurzfristige Meilensteine festlegen Schlüsselindikatoren für Erfolg bestimmen Einbindung und Empowerment der Mitarbeiter: Nutzung von Basis Tools ermöglichen Fortbildungen und klare Regeln zur Nutzung Ermutigung eigene Projekte zu entwerfen Tools und Ressourcen für Tools oder iegene Entwicklungen bereitstellen: Erfolgsmessung und Anpassung: Strategische Leitlinie + Mitarbeiter mitnehmen! -> Angst nehmen + Technologieverständnis + Compliance einhalten -> Schulungen von einzelnen Team für Use Cases

Folie 4

Checkpoint & Wiederholung

1

2

3

Wir verstehen das Automatisierungsspektrum – von Assistenten bis zu autonomen Agenten

Wir verstehen was Systemprompts sind, und warum sie mächtiger sind als ein einzelner Prompt

Wir verstehen was Skills sind und wie wir sie erstellen

Folie 5

Checkpoint & Wiederholung

4

5

Wir wissen wie wir erste Quick Wins schnell umsetzen

Wir kennen die Unterschiede zwischen “Projekten”, “Assistenten” und “Agenten” – und wissen was wir wann anwenden

6

Wir haben gelernt wie wir unsere Projekte in einem Satz kommunizieren

Folie 6

Was ist euch neues an KI-News begegnet?

Kurzer Raum für Dinge, die euch aufgefallen sind – aus Medien, Arbeit oder Alltag.

1

Gesehen

Eine Schlagzeile, ein Post oder ein Video, das hängen geblieben ist.

2

Ausprobiert

Ein Tool oder Feature, das ihr diese Woche getestet habt.

3

Beobachtet

Eine Veränderung bei euch, im Team oder im Unternehmen.

Format: kurze Runde im Plenum I max. 1–2 Minuten pro Person I keine Bewertung, nur Teilen

Folie 7

Lernziele für Heute

1

2

3

Kannst du erklären, was Multimodalität bedeutet – und verschiedene Eingabeformen nennen, die KI verarbeiten kann

Kannst du die Bilder mithilfe von KI und dem Tool “Magnific” generieren ohne den Markt mit noch mehr “AI Slop” zu fluten

Hast du einen professionellen Prompt im Gepäck mit welchem du verschiedene Tonalitäten analysieren kannst

Nach diesem Tag…

… ist dein Horizont für KI Anwendungsfälle über das Bearbeiten von Text-zu-Text hinausgewachsen.

Sprechernotiz

MA machen lassen – micht alles Vorbesetimmen, speed I Bei Mitarbeiter Helfen Schulungen, Multiplikatoren , Center of Excellellence Strategische Richtung klar definieren: Vision und Mission deutlich kommunizieren Langfristige Ziele und kurzfristige Meilensteine festlegen Schlüsselindikatoren für Erfolg bestimmen Einbindung und Empowerment der Mitarbeiter: Nutzung von Basis Tools ermöglichen Fortbildungen und klare Regeln zur Nutzung Ermutigung eigene Projekte zu entwerfen Tools und Ressourcen für Tools oder iegene Entwicklungen bereitstellen: Erfolgsmessung und Anpassung: Strategische Leitlinie + Mitarbeiter mitnehmen! -> Angst nehmen + Technologieverständnis + Compliance einhalten -> Schulungen von einzelnen Team für Use Cases

Folie 8

Tag 12 - Unser Plan für heute

Zeit

Phase

Inhalt

09:00 – 09:15

Einstieg

Checkpoint & Wiederholung

09:15 - 10:05

Block 1

Multimodalität – Wiederholung und Vertiefung

10:05 - 12:00

Block 2

Expertenvortrag Teil 1

12:00 - 12:30

Mittagspause

Pause

12:30 - 14:00

Praxis

Bild KI gemeinsam mit Marc erleben

Abschluss

Tagesabschluss & Ausblick Tag 12

15:30 - 16:15

14:00 - 15:30

Praxis

Bild-Promptgenerator

Folie 9

Unsere AGENDA heute

Was ist Multimodalität – und warum funktioniert das mit KI? Expertenvortrag mit Praxis – Herzlich willkommen Marc Elsner Wie spare ich langfristig Tokens? Zwei Quick-Wins

Folie 10

Was ist Multimodalität?

Was ist Multimodalität – und warum funktioniert das mit KI? Expertenvortrag mit Praxis – Herzlich willkommen Marc Elsner Wie spare ich langfristig Tokens? Zwei Quick-Wins

Folie 11

Die Modalitäten-Landkarte

Foundation Model

Input

Output

Text

Text

Bild

Bild

Audio

Audio

Daten/Code

Daten/Code

Moderne Modelle sind multimodal — sie verarbeiten und erzeugen verschiedene Medientypen.

Folie 12

Beispiel - Modellanwendung. Text to Image

Image

Image

Video

Video

Data

Text

Text

Data

->

->

Prompt: foto of a little girl with a dog on a floor…“

Folie 12, Bild aus dem Deck (pablito9797_a_Foto_of_a_little_girl_petting_a_dog_on_a_floor_wi_2d18f882-acf1-4cbb-b3c9-c8d6b31f1e9f.PNG)
Folie 13

Beispiel - Modellanwendung. Image to Text

Virtual influencers

Image

Image

Video

Video

Data

Text

Text

Data

->

->

Auf dem Bild ist eine Person zu sehen, die einen Basketball mit beiden Händen hochhält und betrachtet. Der Basketball ist rot und scheint mehrere Unterschriften zu tragen. Die Person trägt einen dunklen Anzug mit Hemd und Krawatte, sowie eine Armbanduhr am linken Handgelenk. Der Ring an der linken Hand könnte auf einen Ehering hinweisen. Sie trägt keine Brille und scheint mittleren Alters zu sein. Die Person hat kurze Haare und schaut konzentriert, aber entspannt auf den Basketball. Der Hintergrund ist nicht gut zu erkennen….

Folie 13, Bild aus dem Deck (eingesetzter-Film.png)
Folie 14

Beispiel - Modellanwendung. Image to Video

Virtual influencers

Image

Image

Video

Video

Data

Text

Text

Data

->

->

Folie 14, Bild aus dem Deck (pablito9797_a_Foto_of_a_little_girl_petting_a_dog_on_a_floor_wi_2d18f882-acf1-4cbb-b3c9-c8d6b31f1e9f.PNG)

🎬 Eingebettetes Medium im Deck: A_girl_petting_her_dog_slowly_seed7818349270639181.mp4 (nicht extrahiert)

Folie 15

Beispiel - Modellanwendung. Text to Video

Virtual influencers

Image

Image

Video

Video

Data

Text

Text

Data

->

->

Prompt: The camera follows behind a white vinTeile SUV with a black roof rack as it speeds up a steep dirt road surrounded by pine trees on a steep mountain slope, dust kicks up from it’s tires, the sunlight shines on the SUV as it speeds along the dirt road, casting a warm glow over the scene. The dirt road curves gently into the distance, with no other cars or vehicles in sight. The trees on either side of the road are redwoods, with patches of greenery scattered throughout…..

🎬 Eingebettetes Medium im Deck: suv-in-the-dust.mp4 (nicht extrahiert)

Folie 16

Beispiel - Modellanwendung. Image to Image

Virtual influencers

Image

Video

Data

Text

Text

Data

->

->

Video

Image

Folie 16, Bild aus dem Deck (eingesetzter-Film.png)Folie 16, Bild aus dem Deck (eingesetzter-Film.png)
Folie 17

Beispiel - Modellanwendung. Text to Data

Virtual influencers

17

Image

Image

Video

Data

Text

Text

Data

->

->

Video

Prompt: Schreibe ein Javascript-Snippet für meinen Shop, damit ich ein Popup öffnen kann.

Folie 17, Bild aus dem Deck (Bildschirmfoto 2024-02-18 um 16.26.38.png)
Folie 18

Beispiel - Modellanwendung. Data to Text

Image

Image

Video

Data

->

->

Video

Text

Data

Text

Das Maxi Outdoor-Zelt ist ein geräumiges und praktisches Zelt für Campingausflüge. Zwei Türen sorgen für tolle Belüftung und einen einfachen Ein- und Ausstieg. Stundenlanger Camping-Spaß ist garantiert, denn das wasserdichte Zelt ist in Sekunden aufgebaut.

"produktName": „Maxi Outdoor-Zelt", "attributes": { „sub-category": "Wurfzelt", „attribute1": "geräumig", "wasserdicht": true

Folie 18, Bild aus dem Deck (Bild)
Folie 19

KI kann mehr als Text

Multimodalität im Berufsalltag – vier Eingabeformen, vier konkrete Anwendungsfälle

🖼

Bild → Text

📊

Data → Code/Text

🎙

Audio → Text

🎬

Video → Text

Folie 20

Dashboard-Screenshot analysieren

Eingabe: Screenshot eines Dashboards oder einer Auswertung Ausgabe: Zusammenfassung, Interpretation, Handlungsempfehlungen Anwendung: Kein manuelles Ablesen – KI übernimmt die Auswertung in Sekunden

Folie 21

Tabellen auswerten

Eingabe: Excel- oder CSV-Tabelle Ausgabe: KI wandelt die Daten in Code um, führt Berechnungen durch und erklärt die Ergebnisse Anwendung: Datenanalyse ohne Programmierkenntnisse

Folie 22

Sprachnotiz strukturieren

Eingabe: Gesprochene Notiz direkt ins Tool einsprechen Ausgabe: Strukturierter Text, Zusammenfassung, To-Do-Liste Anwendung: Unterwegs diktieren – fertig aufbereitet am Schreibtisch Claude, Langdock und MS Copilot haben diese Funktion standardmäßig eingebaut -> Hier ist Claude u.M.n. erstaunlich schlecht

Folie 23

Video transkribieren

Eingabe: Video-Datei oder Link Ausgabe: Transkript, Zusammenfassung, Kapitelstruktur Anwendung: Meetings, Webinare oder Schulungsvideos schnell erschließen Hinweis: Funktioniert solide – ist aber rechenintensiv und damit vergleichsweise teuer – Youtube Videos lassen sich am günstigsten mit Google Tools transkribieren (Warum wohl? ;) )

Folie 24

Expertenvortrag mit Praxis

Was ist Multimodalität – und warum funktioniert das mit KI? Expertenvortrag mit Praxis – Herzlich willkommen Marc Elsner Wie spare ich langfristig Tokens?

Folie 25

Je höher der Rechenaufwand, desto höher die Kosten

Jede Anfrage an ein KI-Modell verbraucht Token – die Abrechnungseinheit für Rechenleistung Text verbraucht die wenigsten Token – günstig und effizient Bilder, PDFs und Präsentationen werden Seite für Seite in Bilder umgewandelt und einzeln analysiert – jede Seite kostet extra Videos bestehen aus einer Vielzahl von Einzelbildern – der Aufwand multipliziert sich entsprechend Video mit Audiospur = nochmal teurer, weil die Audiospur zusätzlich separat analysiert wird

Folie 26

Stufenmodell: Was kostet wie viel?

Text / Daten (CSV, JSON) / Code

günstig

Bild / einzelne Seite

teurer

PDF / PPT (mehrseitig)

Seiten × Kosten

Video (ohne Audio)

hoch

Video + Audiospur

am teuersten

↑ Token-Kosten

Folie 27

Vorsicht: Reasoning multipliziert den Token-Verbrauch

Reasoning-Modelle denken in mehreren Schritten – jeder Schritt verbraucht zusätzliche Token Bestimmte Denkschritte werden intern wiederholt und überprüft – auch das kostet Bei komplexen Aufgaben kann der Token-Verbrauch im Reasoning-Modus ein Vielfaches einer normalen Anfrage erreichen Faustregel: Reasoning nur einsetzen wenn die Aufgabe es wirklich erfordert

Normale Anfrage 1× Token-Verbrauch

Reasoning-Anfrage n× Token-Verbrauch

Folie 28

Tipp: Einmal aufwändig – dauerhaft Token sparen

1

PDF / PPT einmalig hochladen & analysieren lassen

2

Ergebnis als Markdown-Datei (.md) speichern

3

Künftig nur noch die .md-Datei verwenden

Beispiel: Lebenslauf als PDF einmalig analysieren → als .md speichern → spart bei jeder weiteren Nutzung massiv Token

Warum das funktioniert: Markdown ist reiner Text – kein Bild-Rendering, keine Seitenumwandlung, minimaler Token-Verbrauch

Hinweis: Deshalb empfehlen wir euch, Markdown-Dateien in euer KI-Kompetenzprofil hochzuladen – nicht die ursprüngliche PDF oder PPT.

Folie 29

Wie spare ich langfristig Tokens? Zwei Quick-Wins

Was ist Multimodalität – und warum funktioniert das mit KI? Expertenvortrag mit Praxis – Herzlich willkommen Marc Elsner Wie spare ich langfristig Tokens? Zwei Quick-Wins.

Folie 30

Einen Schreibstil klonen – mit KI

Was kann dieser Prompt?

Analysiert jeden Schreibstil auf 7 Dimensionen: Tonalität, Satzstruktur, Wortwahl, Perspektive, Zielgruppenansprache, Rhetorik und emotionale Wirkung. Liefert danach einen fertigen Leitfaden zur Nachahmung – inklusive Beispieltext.

Mehrwert für euch

Konsistente Kommunikation auf Knopfdruck – einmal analysiert, dauerhaft reproduzierbar. Spart massiv Zeit bei LinkedIn-Posts, E-Mails, Berichten und Pressemitteilungen. Funktioniert für jeden Stil – ob eigene Texte, Unternehmenskommunikation oder externe Vorlagen.

Heute üben wir mit den Pressemitteilungen der Bundesregierung – einem der klarsten und konsistentesten (und wmgl. “trockensten”) Kommunikationsstile im deutschen Sprachraum.

Folie 31

Wie funktioniert dieser Prompt?

1

Rollen- anweisung

KI wird zur Stilexperten

2

Anforde- rungen

7 Analyse- dimensionen

3

3-Schritt- Prozess

Analyse → Belege → Leitfaden

4

Output- Format

Fixes Markdown- Format

5

Beispiel I/O

Input & Output zeigen das Ziel

Warum das funktioniert: Das eingebaute Beispiel zeigt dem Modell exakt das gewünschte Ergebnis. Je präziser das Format vorgegeben wird, desto weniger Interpretationsspielraum bleibt – und desto konsistenter die Ausgabe.

Folie 32

Jetzt seid ihr dran: Stil analysieren

1

Pressemitteilung holen: Geht auf bundesregierung.de → Aktuelles → Pressemitteilungen → öffnet eine aktuelle Meldung und kopiert den vollständigen Text.

2

Prompt starten: Öffnet Claude, fügt den Stilanalyse-Prompt ein und hängt den kopierten Text direkt darunter. Startet die Analyse.

3

Ergebnis auswerten: Lest die 7 Analysedimensionen durch. Macht euch bewusst: Wie könnt ihr diesen Leitfaden nutzen um eigene Texte in diesem Stil zu erstellen?

💡 Bonus: Lasst Claude danach einen neuen kurzen Text im analysierten Stil schreiben – und prüft ob er wirklich wie eine Bundesregierungs-Pressemitteilung klingt.

Folie 33

Professionelle Bildprompts – eine weiterer Quickwin für euch

Was kann dieser Prompt?

Verwandelt einfache deutsche Beschreibungen in präzise, professionelle Bildprompts auf Englisch. Unterstützt Erstellen, Bearbeiten, Stil-Transfer und Komposition – für Nano Banana, Flux und Seedream.

Mehrwert für euch

Englisch erzielt deutlich bessere Ergebnisse bei Bildmodellen – dieser Prompt übersetzt und strukturiert automatisch. Ohne Prompt: vage Beschreibungen, schwache Ergebnisse. Mit Prompt: kinematisch-professionelle Ausgaben. Kein Vorwissen in Bildprompting nötig – die Prompt Pyramid übernimmt die Struktur.

Kompatibel mit den Kurs-Tools: Nano Banana (Langdock), Magnific (ehem. Freepik) sowieso.

Folie 34

Die Prompt Pyramide – 8 Dimensionen

Medium – Foto, Illustration, Gemälde…

Subject – Hauptmotiv mit Details

Activity – Pose, Aktion, Bewegung

Setting – Umgebung & Hintergrund

Wardrobe – Kleidung & Kostüm

Lighting – Lichtart & Schatten

Vibe – Stimmung & Atmosphäre

Stylistic Details – Kamera, Linse, Farbton

Input auf Deutsch – Output immer auf Englisch, im Markdown Code-Block, als ein vollständiger Paragraph-Prompt. 5 Strategie-Templates je nach Aufgabe (Erstellen, Bearbeiten, Stil, Komposition, Detail).

Folie 35

Jetzt seid ihr dran: Bildprompt generieren

1

Idee beschreiben: Überlegt euch ein Bild das ihr gerne erstellen oder bearbeiten würdet. Beschreibt es kurz auf Deutsch – so wie ihr es formulieren würdet.

2

Promptbot aktivieren: Fügt den Bild-KI Promptbot-Prompt bei Langdock ein, gefolgt von eurer deutschen Beschreibung. Lasst den englischen Bildprompt generieren.

3

Ergebnis testen: Kopiert den generierten Prompt und gebt ihn in Nano Banana ein. Vergleicht das Ergebnis mit dem was ihr euch vorgestellt hattet.

💡 Bonus: Versucht danach eine Variante mit einem eigenen Foto – z.B. ein Produktbild oder ein Portrait. Was verändert sich im Prompt?

Folie 36

Tag 12 – Abschluss

Das nehmen wir mit

KI ist multimodal – sie versteht nicht nur Text, sondern auch Bilder, Audio, Video und Daten. Das eröffnet neue Anwendungsmöglichkeiten in deinem Beruf, die weit über das reine Schreiben hinausgehen. KI wird Kunst zumindest nicht kampflos ersetzen. Gute Bilder mithilfe von KI zu generieren kann eine Kunst für sich sein – bzw. Ist zumindest ein wichtigter Skill. Mehr Rechenleistung bedeutet höhere Kosten – hier gibt es Tricks um das langfrstig zu senken. Als KI Manager:in machst du dich sehr beliebt wenn du Kosten reduzieren kannst.

Ihr könnt nun bessere Bild Ergebnisse erzielen als 80% der KI Nutzer. Hebt euch hervor indem Ihr nicht wertlosen AI Slob postet.

Folie 37

Ausblick - Tag 13

Moment mal…. Ist das hier, rechtlich eigentlich alles erlaubt?

Folie 38

Vielen Dank! Tag 12 geschafft!

AI Transformation Institute

01. September 2026

Thorsten Gluitz | Marc Elsner