Stable Diffusion
Offenes Bildmodell — lokal lauffähig, voll anpassbar.
Funktionen von Stable Diffusion
- Stable Diffusion 3.5 & Stable Image Ultra — neueste Basismodelle.
- Komplett Open Weights — lokal, on-premise oder Cloud nach Wahl.
- LoRA-Feintuning für eigene Stile/Charaktere mit wenigen Beispielbildern.
- ControlNet — präzise Komposition via Posen, Tiefenkarten, Skeletten.
- Stability API als managed Option (Credit-Modell).
- Riesiges Ökosystem (ComfyUI, Automatic1111, Civitai, Hugging Face).
- Stable Video Diffusion für kurze Clip-Generierung.
Preise von Stable Diffusion
- Open-Source — Modelle kostenlos unter Stability-Community-License auf Hugging Face.
- Stability API — Credits ab $10 für ~350 Bilder (SD 3.5 Large).
- DreamStudio Web · Pay-per-use, ähnliche Credit-Preise.
- Stability for Enterprise · Preis auf Anfrage — kommerzielle Lizenzen, Support, Self-Hosting.
- Lokaler Betrieb — kostenlos, benötigt NVIDIA-GPU ab 6 GB VRAM (für SD 3.5: 12 GB+).
Stable Diffusion veränderte 2022 die KI-Bildgenerierung grundlegend, indem die Modellgewichte als Open Source veröffentlicht wurden. Was bei Midjourney und DALL·E nur als Cloud-Service zu haben ist, läuft bei Stable Diffusion auch auf der eigenen Grafikkarte — mit allen Konsequenzen für Datenschutz, Anpassbarkeit und Kosten.
Um das Basismodell ist eine außergewöhnliche Community gewachsen: Civitai, Hugging Face und unzählige Discord-Server beherbergen tausende fein-getunte Varianten — von photorealistischen Porträts über Comic-Stile bis zu Architektur-Renderings. LoRA-Feintuning erlaubt es, mit überschaubarem Trainingsaufwand eigene Stile in das Modell einzubringen.
Der Preis dieser Flexibilität ist Komplexität: Setup, Modellverwaltung und Prompt-Engineering haben eine spürbare Lernkurve. Die Standard-Qualität liegt unter Midjourney; mit dem richtigen Modell und Workflow kann sie diese aber übertreffen. Stability AI bietet zusätzlich eine API für Cloud-Nutzung an.
Empfohlen für Teams mit eigener GPU-Infrastruktur, für Projekte mit strengen Datenschutzanforderungen und für alle, die kontrollieren möchten, was ihr Modell kann — und was nicht.
Screenshot
Pro & Contra
- Open Source
- Lokal nutzbar
- Riesige Modell-Community
- LoRA-Feintuning
- Setup anspruchsvoll
- Qualität hängt vom Modell ab
Anwendungsfälle
Verwandte Tools
Image Playground
Apples On-Device-Bildgenerator als Teil von Apple Intelligence — Bilder und Genmoji in kuratierten Stilen direkt auf dem Gerät, ohne Cloud und ohne Training auf den eigenen Fotos.
Playground
Browser-Studio mit FLUX, Stable Diffusion und einem aufgeräumten Layered-Editor — Pixar-bis-Photoreal in einer Oberfläche, ohne lokale Installation.
Lexica
Stable-Diffusion-basierter Generator mit der wahrscheinlich besten Prompt-Suchmaschine — Millionen kuratierte Prompts plus saubere Generation in einem Tool.
