KI-gestütztes Rendering
& Prompten
Gezieltes Prompten für KI generierts Bildmaterial
Seit 2022 beschäftigen wir uns intensiv mit der KI-gestützten Bildgenerierung und der systematischen Anwendung gezielter Prompting-Strategien.
Dabei sind Seitenweise Notizen entstanden, die unsere Ansätze und Erfahrungen festhalten.
_____________________________________________________________________________________________________________________________________________________
Viele von Anfängern generierte KI-Bilder zeigen Gesichter, die sich stark ähneln.
Diese visuelle Gleichförmigkeit ist das Ergebnis mehrerer ineinandergreifender Faktoren, die sowohl aus technischer Sicht als auch hinsichtlich der Nutzungspraxis erklärbar sind.
Zunächst ist zu berücksichtigen, dass die meisten generativen Modelle wie DALL·E, Midjourney oder Stable Diffusion auf großen Bilddatensätzen trainiert werden, die stark westlich geprägt sind und ein bestimmtes Schönheitsideal dominieren: jung, symmetrisch, hellhäutig, mit klaren Konturen und meist neutralem Gesichtsausdruck. Diese Art von Gesichtern ist im Trainingsmaterial überrepräsentiert, was dazu führt, dass die Modelle solche Darstellungen bevorzugt ausgeben, wenn keine gezielten Anweisungen erfolgen.
Gerade Einsteigerinnen und Einsteiger nutzen häufig sehr allgemeine Prompts wie „a beautiful woman“ oder „portrait of a man“. Solche unspezifischen Eingaben überlassen dem Modell weitgehend die Entscheidung, was es als typische oder „wahrscheinlichste“ Visualisierung versteht. Das Ergebnis sind standardisierte Gesichter, die auf gelernten Mittelwerten und wiederkehrenden Merkmalen basieren – eine Art statistisch erzeugte Normphysiognomie.
Darüber hinaus fehlt es in vielen Fällen an einer bewussten Steuerung der Bildausgabe durch sogenannte Prompt-Engineering-Techniken. Fortgeschrittene Nutzerinnen und Nutzer arbeiten gezielt mit Attributen wie Alter, Ethnizität, Gesichtsausdruck oder Lichtstimmung und setzen Werkzeuge wie „negative prompting“ oder Gewichtungen ein, um das Modell von stereotypischen Ergebnissen abzubringen. Einsteigende hingegen nutzen meist die Basismodelle mit Standardeinstellungen, wodurch die resultierenden Gesichter kaum Varianz aufweisen.
Ein weiterer Aspekt ist der Einsatz von spezialisierten oder feinjustierten Modellen. Während die gängigen Tools eine gewisse stilistische Breite ermöglichen, entstehen wirklich individuelle Ergebnisse oft erst durch gezieltes Fine-Tuning oder den Einsatz modifizierter Submodelle. Diese Optionen bleiben Anfängern meist verborgen oder erscheinen zu komplex, weshalb sie verstärkt auf das zurückgreifen, was direkt verfügbar und einfach zugänglich ist – mit dem Nebeneffekt visuell uniformer Ergebnisse.
Insgesamt ist die Ähnlichkeit vieler KI-generierter Gesichter ein direktes Resultat aus der Kombination von datengestütztem Bias, modelltechnischer Wahrscheinlichkeitslogik und einer zunächst noch eingeschränkten Interaktion mit den kreativen Steuerungsmöglichkeiten der Bild-KI.
Wenn du magst, kann ich dir helfen, mehr Variation zu erzeugen, z. B. durch konkrete Prompt-Formulierungen oder stilistische Feinsteuerung.
Arbeitsvorgehensweise
Die KI wird nicht als eigenständiges Kreativwerkzeug im eigentlichen Sinne eingesetzt, sondern dient lediglich als unterstützendes Instrument innerhalb des Gestaltungsprozesses.
Der aktuelle Schwerpunkt liegt auf der gezielten Kontrolle und Qualitätsprüfung jedes erstellten Avatars.
Im Rahmen bestimmter Projekte wird zunächst eine 3D-Figur in verschiedenen Posen gerendert.
Diese Ausgangsbasis wird mithilfe künstlicher Intelligenz gemäß konkreter Vorgaben und visueller Vorlagen weiterentwickelt. Im Anschluss erfolgt eine detaillierte Nachbearbeitung, in der Regel mit Adobe Photoshop CS5 oder CS6 sowie der NIK Collection.
Durch dieses strukturierte Vorgehen behalten wir zu jeder Zeit die vollständige Kontrolle über Gestik, Pose und Kleiderwahl der Avatare.
Arbeiten aus dem Jahr 2023
Die Fotografie (privat) wird freigestellt und als PNG-Datei exportiert.
Anschließend wird das Billboard in eine vorgefertigte 3D-Szene eingefügt.
Im letzten Schritt wird das Ergebnis durch den Einsatz von KI-Technologien sowie den Bildbearbeitungswerkzeugen Photoshop und NIK Collection optimiert.
Anschließend wird das Billboard in eine vorgefertigte 3D-Szene eingefügt.
Im letzten Schritt wird das Ergebnis durch den Einsatz von KI-Technologien sowie den Bildbearbeitungswerkzeugen Photoshop und NIK Collection optimiert.
Basis / Render Software: https://home.otoy.com/render/octane-render/
&
KI gestützte Bildoptimierung mit
Adobe Sensei KI
Prompt Engineering – Ein Berufsfeld der Zukunft
Mit dem rasanten Fortschritt generativer KI-Systeme wie GPT-4, DALL·E oder Midjourney hat sich ein neues Berufsfeld etabliert: das Prompt Engineering.
Wer heute wirkungsvoll mit KI arbeitet, muss nicht nur technische Grundlagen verstehen, sondern auch in der Lage sein, präzise und zielgerichtete Texteingaben – sogenannte Prompts – zu formulieren.
Prompting ist mehr als nur das Stellen von Fragen. Es erfordert ein tiefes Verständnis der jeweiligen KI-Modelle, ihrer Stärken, Schwächen und typischen Ausgaben.
Gutes Prompt Engineering kombiniert sprachliches Feingefühl mit analytischem Denken, Kreativität und Domänenwissen – sei es in Design, Programmierung, Marketing oder Forschung.
Prompt Engineers entwickeln systematische Strategien, testen Varianten, optimieren Abläufe und dokumentieren wiederverwendbare Muster.
In manchen Teams nehmen sie bereits eine Schlüsselrolle zwischen kreativen und technischen Disziplinen ein – vergleichbar mit UX-Designern oder Data Scientists.
Prompten ist nicht gleich Prompten – KI-generierte Bilder erfordern Übung
Mit dem zunehmenden Einsatz generativer KI-Systeme wird immer deutlicher, dass der reine Zugang zu solchen Technologien nicht automatisch zu hochwertigen Ergebnissen führt.
Besonders im Bereich der Text- und Bildgenerierung ist der Unterschied zwischen oberflächlicher Nutzung und gezieltem, professionellem Einsatz erheblich.
Der Begriff „Prompten“ steht dabei nicht bloß für das einfache Eingeben von Befehlen, sondern bezeichnet eine zunehmend spezialisierte Fähigkeit.
Es geht darum, durch präzise, kontextbewusste und zielgerichtete Sprache die KI so zu lenken, dass sie passende und qualitativ überzeugende Ergebnisse liefert.
Die Qualität des Outputs hängt entscheidend von der Formulierung des Prompts ab – eine vage oder unklare Eingabe führt oft zu generischen oder wenig brauchbaren Resultaten.
Dagegen kann eine durchdachte Formulierung Stil, Inhalt und Tiefe der generierten Inhalte gezielt beeinflussen. Das erfordert nicht nur sprachliches Geschick, sondern auch ein Verständnis dafür, wie das Modell Informationen verarbeitet.
Besonders bei der Bildgenerierung zeigt sich, dass Übung und Erfahrung unerlässlich sind. Wer zum ersten Mal mit Text-zu-Bild-Systemen arbeitet, stellt rasch fest, dass die Ergebnisse stark variieren – abhängig davon, wie konkret, stilistisch ausgefeilt und technisch angepasst der
Prompt formuliert ist. Begriffe wie Lichtstimmung, Perspektive, Bildaufbau oder Detailgenauigkeit müssen bewusst eingesetzt werden, um die gewünschten visuellen Resultate zu erzielen. Dabei ist der Prozess keineswegs linear: Es braucht oft mehrere Versuche, Anpassungen und Vergleiche, um ein brauchbares oder gar überzeugendes Bild zu generieren. Dies ähnelt dem kreativen Schaffensprozess menschlicher Künstler/innen, bei dem Intuition, Erfahrung und iterative Verbesserung eine große Rolle spielen.
Zudem darf der kritische Umgang mit KI-generierten Inhalten nicht außer Acht gelassen werden. Bilder können realistisch wirken, ohne wahr zu sein.
Technische Schwächen wie Bildartefakte oder anatomische Fehler sind ebenso zu berücksichtigen wie ethische Fragen rund um Originalität, Urheberrechte oder kulturelle Sensibilität.
Der bewusste, reflektierte Umgang mit den Möglichkeiten und Grenzen der Technologie ist daher genauso wichtig wie technisches Wissen.
Zusammenfassend lässt sich sagen, dass der effektive Einsatz generativer KI weit über bloßes „Prompten“ hinausgeht.
Es handelt sich um eine Kombination aus analytischer Präzision, kreativer Steuerung und kritischer Medienkompetenz. Nur wer bereit ist, sich intensiv mit der Funktionsweise der Modelle auseinanderzusetzen und durch Übung eigene Erfahrungswerte zu sammeln, kann die Potenziale dieser Werkzeuge wirklich ausschöpfen.
Beispiel für Zielgerichtetes Prompting
Arbeiten aus 2023
Spezielle Befehle beim Prompten – Schlüssel zur gezielten KI-Steuerung
Beim Arbeiten mit generativen KI-Systemen spielt die gezielte Formulierung von Eingaben – sogenannten Prompts – eine zentrale Rolle.
Doch nicht jeder Prompt entfaltet die gleiche Wirkung. Um präzise und hochwertige Ergebnisse zu erzielen, bedienen sich fortgeschrittene Nutzer/innen spezieller sprachlicher Mittel und technischer Steuerungselemente, die im Fachbereich oft unter dem Begriff Prompt Engineering zusammengefasst werden.
Diese gezielt gewählten Wörter oder Phrasen beeinflussen Stil, Inhalt, Perspektive oder Detailtiefe des Outputs. So kann etwa die Ergänzung „in der Ästhetik eines Ölgemäldes“ oder „futuristische Stadt bei Nacht“ bei Bild-KIs zu klar definierten visuellen Ergebnissen führen. Neben solchen beschreibenden Zusätzen nutzen manche Systeme auch konkrete Steuerparameter oder Befehle, um Format, Auflösung oder Versionen zu bestimmen – beispielsweise numerische Angaben oder Code-ähnliche Erweiterungen in Prompt-Syntaxen.
Ebenso wichtig ist der gezielte Einsatz von Schlüsselwörtern, die den inhaltlichen Fokus lenken. Diese sogenannten Ankerbegriffe strukturieren die Informationsverarbeitung der KI, indem sie bestimmte semantische Schwerpunkte setzen. Gerade bei komplexen Aufgaben, etwa der Kombination aus Text- und Bildinhalten, ist die präzise Platzierung solcher Begriffe entscheidend.
Zusammengefasst lässt sich sagen, dass die Wirksamkeit eines Prompts nicht nur von seiner Länge, sondern vor allem von der intelligenten Verwendung dieser speziellen Befehle abhängt.
Wer sich mit der Funktionsweise der KI vertraut macht und die Steuerungsmöglichkeiten gezielt nutzt, kann die Qualität und Passgenauigkeit der Ergebnisse deutlich steigern.
Mit
dem Blick fürs Bild: Fotograf/innen als starke Prompt Engineers
Fotografien / Privat
Visuelle Kompetenz im Prompting – So helfen Fotografen-Kenntnisse bei KI-Bildern.
Der Unterschied zwischen KI-generierten Bildern von Fotograf/innen und solchen von Laien liegt wesentlich in der Bildsprache und der Präzision des Promptings. Fotograf/innen verfügen über fundiertes Wissen zu Lichtführung, Komposition, Perspektive und Stil.
Dieses gestalterische Verständnis übertragen sie gezielt auf die KI-Eingaben, wodurch technisch saubere und ästhetisch durchdachte Ergebnisse entstehen.
Laien hingegen formulieren häufig unspezifische oder visuell unstrukturierte Prompts, was zu überladenen, inkonsistenten oder fehlerhaften Bildern führen kann. Ohne Erfahrung in Bildgestaltung fehlt das nötige Vokabular, um die KI gezielt zu steuern.
KI ist ein neutrales Werkzeug – entscheidend ist, wer sie wie nutzt. Fotograf/innen profitieren von ihrem gestalterischen Know-how und setzen die KI als kreatives Erweiterungsinstrument ein.
Wir fotografieren mit SIGMA, CANON, SONY
Objektive: Überwiegend aus der SIGMA Art Familie
Server I:___ Synology DS1821+
Server II___ Synology DS920+ & DX517 (Erweiterung)
Adobe Photoshop CS5 & CS6
KI gestützte Bildoptimierung mit
Adobe Sensei KI
Viele Grüße,
Jessica, Katja & Heiko