Begriffe
Glossar KI-Bild-Generation
Vom Prompt bis zum Sampler, von CFG bis LoRA. Die wichtigsten Begriffe rund um Midjourney, Stable Diffusion, DALL-E und Flux, knapp und mit Beispiel.
- Prompt
- Die Textanweisung, mit der man einer KI sagt, was sie generieren soll. Je präziser und strukturierter, desto kontrollierter das Ergebnis.
- photorealistic portrait of an elderly man, soft window light, 85mm lens
- Negative Prompt
- Zusätzliche Anweisung, was die KI vermeiden soll. In Stable Diffusion und Midjourney (`--no`) verfügbar, bei DALL-E nur eingeschränkt.
- low quality, blurry, watermark, text, distorted hands
- CFG Scale
- Classifier-Free Guidance Scale, regelt in Stable Diffusion, wie strikt die KI dem Prompt folgt. Niedrig (3-5) = freier, hoch (10-15) = strenger, kann überzeichnet wirken.
- CFG 7 ist Standard-Sweet-Spot für SDXL.
- Steps
- Anzahl der Iterationen, die der Diffusion-Process durchläuft. Mehr Steps = oft mehr Detail, ab ~30 nimmt der Zugewinn ab. Schnell-Varianten wie Flux Schnell brauchen nur 4.
- 20-30 Steps bei SDXL, 4 bei Flux Schnell.
- Sampler
- Der Algorithmus, mit dem Rauschen schrittweise zu einem Bild wird. Beliebte: DPM++ 2M Karras, Euler a, DDIM. Unterschiedliche Sampler ergeben bei identischem Seed leicht unterschiedliche Bilder.
- DPM++ 2M Karras für SDXL ist Standard.
- Seed
- Zahl, die das initiale Rauschen festlegt. Gleicher Prompt + gleicher Seed + gleiches Modell = reproduzierbares Bild.
- seed 1337 erzeugt immer dasselbe Ausgangsrauschen.
- LoRA
- Low-Rank Adaptation. Kleine, trainierbare Modell-Anhänge für Stable Diffusion, die einen Stil, Charakter oder Look einbringen, ohne das Hauptmodell zu ersetzen.
- <lora:miyazaki-style:0.8> bringt Ghibli-Look in jedes SDXL-Modell.
- Embedding (Textual Inversion)
- Kleine Vektor-Datei, die einen Begriff lehrt, den die KI nicht von Haus aus kennt. Wird mit einfachem Token-Namen im Prompt aktiviert.
- <easynegative> ist ein verbreitetes Negative-Embedding.
- Token
- Kleinste Texteinheit, die ein Modell versteht. Ein Wort kann mehrere Tokens umfassen. Modelle haben Token-Limits (z. B. SDXL 77 pro Encoder).
- photorealistic = 1 Token, hyperrealistic = 2 Tokens
- Weighting
- Mechanismus in Stable Diffusion, Begriffen mehr oder weniger Bedeutung zu geben. Klammern und Zahlen.
- (masterpiece:1.3) verstärkt, (blurry:0.7) schwächt ab.
- Aspect Ratio
- Seitenverhältnis des Ausgabebildes. 1:1 Quadrat, 16:9 Widescreen, 9:16 Hochformat, 3:2 Foto-Klassik.
- --ar 16:9 in Midjourney für Kino-Look.
- Stylize / --s
- Midjourney-Parameter, wie stark der hauseigene Stil-Filter wirkt. 0 = sehr nah am Prompt, 1000 = sehr stilisiert.
- --stylize 250 ist ein guter Mittelweg für Realismus mit Charakter.
- Chaos / --c
- Midjourney-Parameter, wie unterschiedlich die 4 Varianten ausfallen. 0 = sehr ähnlich, 100 = wild.
- --chaos 25 für leichte Variation pro Run.
- Niji
- Midjourney-Sub-Modell speziell für Anime- und Illustrations-Ästhetik. Aktivierung per --niji.
- --niji 6 für aktuelles Niji-Anime-Modell.
- Guidance Scale
- Flux-Variante des CFG. Werte um 3-5 sind Standard, deutlich niedriger als bei SDXL.
- guidance 3.5 ist Flux-Default.
- BREAK
- Token-Block-Separator in Stable Diffusion. Trennt verschiedene Concept-Gruppen klar, damit sie nicht miteinander vermengt werden.
- red car BREAK city background BREAK rain → drei klar getrennte Konzepte.
- Inpainting
- Technik, in einem bestehenden Bild nur einen ausgewählten Bereich neu generieren zu lassen. Gut für Korrekturen.
- Fehlerhafte Hand maskieren und nur diese Stelle neu rendern.
- Outpainting
- Erweitert ein bestehendes Bild über seinen ursprünglichen Rand hinaus. KI generiert glaubhafte Fortsetzungen.
- Aus einem Quadrat-Bild ein 16:9-Banner machen.
- ControlNet
- Modell-Ergänzung für Stable Diffusion, die Kontrolle über Pose, Tiefe, Edges oder Linework gibt, basierend auf einem Referenzbild.
- Pose aus Strichzeichnung übernehmen, Stil aus Prompt.
- Upscaling
- Nachträgliche Vergrößerung eines generierten Bildes auf höhere Auflösung. Algorithmen wie ESRGAN, SwinIR oder Magnific.
- Aus 1024px-Bild ein 4K-Druck machen.
- Denoising Strength
- Beim img2img: wie stark das Eingangsbild verändert werden darf. 0.3 = nur leichte Anpassung, 0.8 = fast frei generiert.
- Denoising 0.5 für Stil-Transfer mit erhaltener Struktur.
- Hallucination
- Wenn die KI Details erfindet, die der Prompt nicht verlangt, etwa zusätzliche Finger oder unsinnige Text-Strings.
- Sechs Finger an einer Hand sind ein klassischer Hallucination-Fehler.
- Tile
- Midjourney-Parameter --tile, erzeugt nahtlos kachelbare Muster für Texturen oder Wallpaper.
- --tile für Wallpaper-Mosaike oder Game-Asset-Texturen.
- VAE
- Variational Autoencoder, übersetzt zwischen Pixel- und Latent-Space. Verschiedene VAEs bringen leicht andere Farben und Klarheit.
- sdxl-vae-fp16-fix ist ein verbreiteter VAE für SDXL.
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff
Begriff