AI Ordbog
Stable Diffusion
Open source AI-billedgenerator der kan køres lokalt og tilpasses frit.
Skrevet og redigeret af Kristian Primdal · Sidst opdateret 3. oktober 2026Indhold
Hvad er Stable Diffusion?
Stable Diffusion er en open source AI-model der genererer billeder fra tekstbeskrivelser. Det der gør den unik er at den er frit tilgængelig: du kan downloade modellen, køre den på din egen computer og tilpasse den til dine behov, uden at betale per billede eller sende data til en cloud-tjeneste.
Stable Diffusion blev lanceret i august 2022 af Stability AI i samarbejde med forskere fra LMU München og Runway. Den var den første højkvalitets billedgenereringsmodel der blev gjort bredt tilgængelig som open source, og den udløste en eksplosion af kreativitet og innovation i AI-billedgenerering.
Hvordan fungerer Stable Diffusion?
Stable Diffusion er baseret på en diffusionsmodel (en type generativ AI der fungerer ved at lære at fjerne støj):
- Forward diffusion. Under træning tilføjes gradvist tilfældig støj til billeder indtil de er ren støj. Modellen lærer denne proces.
- Reverse diffusion. Ved generering starter modellen med tilfældig støj og fjerner gradvist støj i en styret proces (styret af din tekstbeskrivelse) indtil et sammenhængende billede fremkommer.
- Latent space. Stable Diffusion arbejder i et komprimeret “latent space” i stedet for direkte med pixels. Det gør den markant hurtigere og mere hukommelseseffektiv end tidligere diffusionsmodeller.
- Text encoder. Din prompt konverteres til en numerisk repræsentation via CLIP (Contrastive Language-Image Pre-training), der guider diffusionsprocessen.
Stable Diffusion-versioner
- SD 1.4 / 1.5 (2022). De første bredt tilgængelige versioner. 512x512 pixel output. Satte standarden og skabte økosystemet.
- SD 2.0 / 2.1 (november 2022). Forbedret kvalitet, 768x768 pixels. Kontroversiel fordi den filtrerede visse typer indhold fra træningsdata.
- SDXL (juli 2023). Markant kvalitetsspring. 1024x1024 pixels. To-trins arkitektur med base-model og refiner. Konkurrencedygtig med kommercielle alternativer.
- SD 3 / SD 3.5 (2024). Ny arkitektur baseret på “Multimodal Diffusion Transformer” (MMDiT). Bedre tekstgenerering i billeder og forbedret prompt-følgning.
- FLUX (Black Forest Labs, 2024). Skabt af flere af de oprindelige Stable Diffusion-forskere. Teknisk en efterfølger med markant forbedret kvalitet.
Hvorfor er open source vigtigt?
- Privatliv. Dine billeder og prompts forbliver på din computer. Ingen data sendes til eksterne servere.
- Ingen censur. Du bestemmer selv hvad du genererer. Ingen platform der afviser dine prompts. Med dette følger naturligvis et ansvar.
- Tilpasning. Du kan finjustere modellen med dine egne billeder for at generere specifikke stilarter, karakterer eller produkter.
- Gratis. Ingen per-billede omkostning. Når du har hardwaren, kan du generere ubegrænset.
- Innovation. Open source-fællesskabet har skabt tusindvis af udvidelser, interfaces og specialiserede modeller der langt overgår hvad Stability AI alene kunne bygge.
Stable Diffusion i praksis
- Lokalt på egen PC. Med en moderne GPU (8+ GB VRAM) kan du køre Stable Diffusion via brugervenlige interfaces som Automatic1111, ComfyUI eller Forge.
- Community-modeller. Tusindvis af finjusterede modeller på Civitai og Hugging Face: anime-stilarter, fotorealisme, specifikke kunstnerstilarter, produktfoto og meget mere.
- LoRA og embeddings. Letvægts-tilpasninger der lader dig tilføje specifikke stilarter, karakterer eller koncepter til din generering uden at ændre hele modellen.
- ControlNet. Udvidelse der giver præcis kontrol over billedkomposition via skitser, dybdekort, positurer og kanter.
- Inpainting/outpainting. Redigér specifikke dele af et billede eller udvid det ud over sine oprindelige kanter.
- Img2img. Brug et eksisterende billede som udgangspunkt og transformer det baseret på en ny prompt.
Økosystemet
Stable Diffusions open source-natur har skabt et enormt økosystem:
- Automatic1111 (AUTOMATIC1111). Det mest populære web-interface med hundredvis af extensions.
- ComfyUI. Node-baseret workflow-editor der giver fuld kontrol over genereringsprocessen.
- Civitai. Platform med tusindvis af community-modeller, LoRAs og embeddings du kan downloade gratis.
- Hugging Face. Hosting og distribution af modeller og pipelines.
- Cloud-tjenester. RunPod, Vast.ai og andre tilbyder GPU-adgang til at køre Stable Diffusion uden egen hardware.
Stable Diffusion vs. konkurrenter
- SD vs. DALL-E. DALL-E er nemmere at bruge (integreret i ChatGPT) og bedre til tekst i billeder. SD giver fuld kontrol, gratis generering og mulighed for finjustering.
- SD vs. Midjourney. Midjourney producerer konsistent smukke resultater med minimal indsats. SD kræver mere opsætning men giver ubegrænset kontrol og tilpasning.
- SD vs. Imagen (Google). Imagen er lukket og integreret i Google-produkter. SD er åben og kan køres overalt.
Kontrovers og debat
- Copyright. Stable Diffusion er trænet på billeder fra internettet, inklusive kunstneres værker. Det har udløst retssager og debat om ophavsret.
- Deepfakes. Open source betyder at der ingen filter er. Det muliggør misbrug til deepfakes og uønsket indhold.
- Stability AI. Virksomheden bag Stable Diffusion har oplevet turbulens: ledelsesskift, finansielle udfordringer og tab af nøglemedarbejdere. Men open source-modellen lever videre uafhængigt af virksomheden.
Stable Diffusion demokratiserede AI-billedgenerering Før Stable Diffusion var AI-billedgenerering kontrolleret af lukkede virksomheder med ventelister og restriktioner. Stable Diffusion ændrede det fundamentalt: pludselig kunne alle med en GPU generere billeder lokalt, finjustere modellen og bygge kreative værktøjer oven på den. Resultatet er et eksplosivt økosystem af innovation der har drevet hele feltet fremad. Også de kommercielle konkurrenter.
FAQ
Hvad er Stable Diffusion?
Stable Diffusion er en open source AI-model der genererer billeder fra tekstbeskrivelser. Den kan downloades og køres lokalt på din egen computer, finjusteres med dine egne data og bruges gratis uden begrænsninger.
Er Stable Diffusion gratis?
Ja, modellen er open source og gratis at bruge. Du betaler kun for den hardware (GPU) du kører den på, eller for cloud-GPU-tid hvis du ikke har egen hardware.
Kan min computer køre Stable Diffusion?
Du har brug for en GPU med mindst 4-8 GB VRAM (NVIDIA anbefales). En gaming-PC fra de seneste par år kan typisk køre Stable Diffusion. Uden GPU kan du bruge cloud-tjenester.
Hvad er forskellen på Stable Diffusion og Midjourney?
Stable Diffusion er open source, gratis og kan køres lokalt med fuld kontrol og tilpasning. Midjourney er en lukket tjeneste der er nemmere at bruge og producerer konsistent æstetiske resultater. Stable Diffusion kræver mere teknisk viden men giver ubegrænset frihed.