Bilder in einem Whizi-Chat generieren: so geht's

Kurzantwort

Um in einem Whizi-Chat Bilder zu generieren, öffne die Modellauswahl, stelle sie von Text auf Bild & Video um, wähle Whizi Image, Nano Banana, Flux oder Stable Diffusion und beschreibe das Bild. Die Bildgenerierung ist bei Pro (100 pro Monat) und Powerhouse (500) enthalten. Verfeinere im selben Thread und lade das Ergebnis anschließend herunter.

Die kurze Antwort

Öffne die Modellauswahl, stelle den Schalter oben von Text auf Bild & Video um, wähle ein Bildmodell und beschreibe das Bild. Der Hinweistext im Eingabefeld ändert sich zu "Beschreibe das Bild, das du generieren möchtest ...", und das Ergebnis erscheint in derselben Unterhaltung.

ModellWofür es gedacht ist
Whizi ImageFür alle Arten von Bildern; die erste Zeile in der kreativen Auswahl
Nano BananaZum Bearbeiten eines angehängten Fotos
FluxScharfe, fotorealistische Kunst
Stable DiffusionDas Bildmodell von Stability AI

Die Bildgenerierung ist bei Pro mit 100 Bildern pro Monatszeitraum und bei Powerhouse mit 500 enthalten. Free- und Starter-Konten haben ein Bildkontingent von null. Ein Bildprompt kann 1 bis 4.000 Zeichen umfassen, generierte Bilder werden 30 Tage lang aufbewahrt, jedes mit einer eigenen Download-Funktion. Schlägt eine Generierung fehl, statt zu rendern, nennt der Hinweistext die Ursache; siehe Bildgenerierung fehlgeschlagen.

Warum die Generierung im Chat anders ist

Der übliche Bild-Workflow läuft über ein separates Produkt, ein separates Abo und ein separates leeres Feld, das nichts darüber weiß, woran du gerade arbeitest. Die Generierung innerhalb der Unterhaltung verändert zwei praktische Dinge.

Erstens hat das Modell den Kontext bereits. Hast du gerade zwanzig Nachrichten damit verbracht, ein Kampagnenkonzept zu entwickeln, trägt "generiere das Hero-Bild dafür" all das bereits in sich. Du musst das Briefing nicht erneut einem anderen Tool erklären.

Zweitens kannst du ein Textmodell nutzen, um den Bildprompt zu schreiben. Das ist der Trick, den die meisten übersehen: Bitte Claude oder GPT, deine grobe Idee in einen richtig strukturierten Bildprompt zu verwandeln, und führe ihn dann aus. Sprachmodelle sind darin, Bildprompts zu schreiben, deutlich besser als die meisten Menschen, weil das Format bekannt ist und sie sehr viele Beispiele davon gesehen haben.

Prompt: das Textmodell den Bildprompt schreiben lassen

Schreibe einen Bildgenerierungs-Prompt für: [grobe Idee]. Er wird verwendet für [Zweck und Platzierung]. Strukturiere ihn so: Motiv, Handlung oder Zustand, Umgebung, Licht, Komposition und Bildausschnitt, Medium oder Objektiv, Farbbehandlung, Stimmung. Füge eine Negativliste hinzu mit dem, was auf keinen Fall erscheinen soll. Gib mir drei Varianten, die sich in der Komposition statt in den Adjektiven unterscheiden.

Der Prompt-Aufbau, der funktioniert

Fast jeder gute Bildprompt hat dieselben sieben Teile, ungefähr in dieser Reihenfolge. Fehlende Teile werden vom Modell mit seinen Standardwerten aufgefüllt, und genau diese Standardwerte sind der Grund, warum generische Prompts generische Stockbilder erzeugen. Falls du zum ersten Mal einen schreibst, deckt wie man KI-Bilder erstellt denselben Stoff von Grund auf ab.

TeilWas du sagen solltestEffekt, wenn du ihn weglässt
MotivDie konkrete Sache, mit dem Detail, das zähltDu bekommst die generischste Version des Nomens
Handlung oder ZustandWas es tut oder wie es dastehtStatisch, gestellt, leblos
UmgebungWo, und wie viel davon sichtbar istEin leerer oder überladener Standardhintergrund
LichtRichtung, Qualität, TageszeitFlach, gleichmäßig ausgeleuchtet, charakterlos
KompositionBlickwinkel, Distanz, Position des Motivs im BildImmer eine zentrierte Halbtotale
Medium oder ObjektivFotografie und Brennweite, oder IllustrationsstilTendiert zu glatter digitaler Kunst
Farbe und StimmungPalette und GefühlÜbersättigt, hoher Kontrast

Ein durchgerechnetes Beispiel. Schwach: eine Person, die im Büro arbeitet. Stark: Eine Frau in den Fünfzigern betrachtet ausgedruckte Zeichnungen an einem Stehpult, spätnachmittägliches Licht durch ein Fenster links von ihr, aufgenommen leicht von hinten über ihre Schulter auf Augenhöhe, 50mm, gedämpfte Grüntöne und warme Neutraltöne, ruhig und ungehetzt. Negativ: stockfotohaftes Lächeln in die Kamera, überladener Schreibtisch, sichtbare Markenlogos, Text.

Die Negativliste ist wichtiger, als man denkt. Das meiste, was generierte Bilder generiert wirken lässt, ist eine kleine Gruppe wiederkehrender Artefakte, und sie zu benennen entfernt sie: stockfotohaftes Lächeln, übersättigt, Text, Wasserzeichen, zusätzliche Finger, symmetrische Unternehmenskomposition.

Das richtige Modell wählen

  • Whizi Image für alle Arten von Bildern. Es ist der hauseigene Generator und die erste Zeile in der kreativen Auswahl.
  • Nano Banana zum Bearbeiten eines Fotos, das du bereits hast. Hänge das Bild an und beschreibe die Änderung; der Hinweistext im Eingabefeld wechselt von Generieren zu Bearbeiten, sobald ein Bild angehängt ist.
  • Flux für scharfe, fotorealistische Kunst und alles, was neben echter Fotografie bestehen muss.
  • Stable Diffusion, das Modell von Stability AI, als zweite Meinung: Es belohnt konkrete Prompts und erzeugt aus denselben Worten einen anderen Look.

Du kannst innerhalb desselben Chats zwischen ihnen wechseln, was der schnellste Weg ist, die einzige Frage zu beantworten, die zählt: denselben Prompt durch zwei Modelle laufen lassen und sie nebeneinander betrachten. Die Modellqualität schwankt je nach Motiv enorm, und der Gewinner bei Porträts ist oft nicht der Gewinner bei Innenräumen oder bei flachen Illustrationen.

Iterieren, ohne sich im Kreis zu drehen

Der häufigste Fehler ist, denselben Prompt immer wieder neu zu generieren in der Hoffnung auf einen besseren Wurf. Ein Teil davon lässt sich nicht vermeiden, aber die meisten vergeudeten Versuche entstehen dadurch, dass mehrere Dinge gleichzeitig geändert werden und man den Überblick verliert, was geholfen hat.

  • Ändere pro Versuch nur eine Variable. Licht, oder Bildausschnitt, oder Palette. Nicht alle drei.
  • Halte fest, was funktioniert hat, in Worten. Ist ein Bild nah dran, beschreibe im nächsten Prompt, was daran richtig ist, statt anzunehmen, dass sich das Modell daran erinnert.
  • Korrigiere die Komposition vor dem Detail. Zuerst Bildausschnitt und Licht richtig hinzubekommen ist weit effizienter, als ein Motiv zu perfektionieren, das im falschen Teil des Bildes sitzt.
  • Generiere im finalen Seitenverhältnis. Ein Quadrat zu einem breiten Banner zuzuschneiden wirft die Komposition weg, um die du gebeten hast. Frage von vornherein nach dem Verhältnis, das du wirklich brauchst.
  • Speichere die Prompts, die funktioniert haben. Acht verlässliche Hausstil-Prompts, die du wieder einfügen kannst, sind mehr wert als jedes einzelne Bild, und sie wiederzuverwenden lässt eine Reihe von Assets wie ein zusammengehöriges Set wirken.

Um ein bereits vorhandenes Bild zu bearbeiten, lade es hoch und beschreibe die Änderung. Das funktioniert gut bei Anpassungen von Hintergrund, Licht und Palette, weniger gut bei präzisen strukturellen Änderungen, die in einem echten Bildeditor immer noch schneller gehen.

Was Bildmodelle immer noch falsch machen

Text. Gerenderter Text bleibt bei jedem Modell der schwächste Bereich. Kurze Wörter kommen manchmal richtig heraus; eine Überschrift, ein Logo oder ein Label meist nicht. Generiere das Bild sauber und füge Text in deinem Designtool hinzu.

Hände, Anzahlen und kleine, wiederkehrende Details. Finger, Zähne, Stuhlbeine und Fenster in einem Gebäude sind alles Stellen, an denen Modelle das Zählen verlieren. Zoome hinein, bevor du etwas verwendest.

Präzise räumliche Anweisungen. "Genau drei Objekte, das rote links" ist unzuverlässig. Komponiere in deinem Editor, wenn die Anordnung wirklich wichtig ist.

Konsistenz über mehrere Bilder hinweg. Denselben Charakter oder dasselbe Produkt in einer Serie identisch erscheinen zu lassen, ist schwierig. Detaillierte, wiederholte Beschreibungen helfen; identische Ergebnisse sind nicht garantiert.

Zur Nutzung: Prüfe deine Rechte, bevor etwas Generiertes in eine bezahlte Platzierung geht, und sei besonders vorsichtig bei allem, das einer echten Person, einem wiedererkennbaren Ort oder einem unverwechselbaren Stil eines lebenden Künstlers ähnelt. Die Bedingungen der Anbieter unterscheiden sich, und das kommerzielle Risiko trägt, wer das Bild veröffentlicht.

Checkliste
  • Bitte ein Textmodell, den Bildprompt aus deiner groben Idee zu schreiben
  • Beziehe alle sieben Teile ein: Motiv, Handlung, Umgebung, Licht, Komposition, Medium, Stimmung
  • Füge eine Negativliste mit den Artefakten hinzu, die du nie willst
  • Generiere im Seitenverhältnis, das du tatsächlich verwenden wirst
  • Ändere pro Iteration nur eine Variable
  • Führe denselben Prompt durch zwei Modelle und vergleiche
  • Füge Text in deinem Designtool hinzu, nicht im Bildmodell
  • Speichere die Prompts, die funktioniert haben, als wiederverwendbare Vorlagen

Häufige Fragen

Wie viele Bilder kann ich pro Monat generieren?

Pro enthält 100 Bildgenerierungen pro Monatszeitraum, Powerhouse enthält 500. Free- und Starter-Konten haben ein Bildkontingent von null, Pro ist also der niedrigste Plan mit Bildgenerierung. Bei einem wöchentlichen Abrechnungszyklus ist das Kontingent der Monatswert geteilt durch vier, aufgerundet. Da Iteration der Hauptverbrauch von Generierungen ist, senkt ein zuerst geschriebener strukturierter Prompt (idealerweise mit einem Textmodell) spürbar, wie viele Versuche ein brauchbares Bild braucht.

Kann ich ein vorhandenes Bild bearbeiten?

Ja. Hänge im Modus Bild & Video das Foto an und beschreibe die Änderung; der Hinweistext im Eingabefeld wechselt von Generieren zu Bearbeiten, sobald ein Bild angehängt ist, und Nano Banana ist das Modell, das für Fotobearbeitungen gebaut wurde. Das funktioniert gut bei Anpassungen von Hintergrund, Licht, Palette und Stil. Es funktioniert weniger gut bei präzisen strukturellen Änderungen wie dem Verschieben eines Objekts um eine bestimmte Distanz oder dem Ändern von Text, die in einem normalen Bildeditor immer noch schneller gehen.

Welches Bildmodell sollte ich verwenden?

Whizi Image für alle Arten von Bildern, Nano Banana zum Bearbeiten eines angehängten Fotos, Flux für scharfe, fotorealistische Kunst, die neben echter Fotografie besteht, und Stable Diffusion für einen anderen Look aus demselben Prompt. Weil die Modellqualität stark je nach Motiv schwankt, ist der schnellste Weg zur Entscheidung, denselben Prompt in einem Chat durch zwei davon laufen zu lassen und die Ergebnisse zu vergleichen.

Warum kommt der Text in meinem Bild falsch heraus?

Gerenderter Text ist bei jedem Bildmodell immer noch der schwächste Bereich, und kein Prompt behebt das zuverlässig. Kurze Einzelwörter funktionieren manchmal; Überschriften, Logos und Labels meist nicht. Generiere das Bild ohne Text und füge Typografie in deinem Designtool hinzu, das dir zudem die richtige Schrift und echte Kontrolle über die Platzierung gibt.

Brauche ich neben Whizi ein separates Bildabo?

Für die meisten Kampagnen-, Content- und Konzeptarbeiten nein. Die Bildgenerierung ist bei Pro (100 pro Monat) und Powerhouse (500) enthalten, was für typischen Marketing- und Social-Content dasselbe abdeckt wie ein eigenständiges Abo. Ein dediziertes Tool ergibt weiterhin Sinn für Teams mit sehr spezifischen stilistischen Anforderungen oder einer umfangreichen bestehenden Prompt-Bibliothek, die sie nicht neu aufbauen wollen.