Spring til indhold
AI Ordbog

AI Ordbog

Imagen

Googles tekst-til-billede-modeller til AI-billedgenerering.

Kristian Primdal Skrevet og redigeret af Kristian Primdal · Sidst opdateret 18. marts 2026

Indhold

Hvad er Imagen?

Imagen er Google DeepMinds serie af tekst-til-billede-modeller. Du skriver en prompt (“en kat der sidder på en måne”), og Imagen genererer et billede. Imagen er bygget på diffusion model-arkitekturen og fokuserer på fotorealisme, fine detaljer og præcis tekstgengivelse.

Versioner

  1. Imagen (2022). Den første version, præsenteret som forskningsprojekt. Ikke offentligt tilgængelig.
  2. Imagen 2 (2023). Første kommercielt tilgængelige version via Vertex AI. Forbedret billedkvalitet og sikkerhedsfiltre.
  3. Imagen 3 (2024). Markant spring i kvalitet. Bedre fotorealisme, mere præcis prompt-følgning og forbedret tekstgengivelse i billeder.
  4. Imagen 4 (maj 2025). Lanceret ved Google I/O 2025. Fine detaljer som stoffer, vanddråber og dyrepels. Op til 2K-opløsning. Stærkere tekstgengivelse end Imagen 3.
  5. Imagen 4 Fast. Optimeret til hastighed: 10 gange hurtigere end Imagen 3 med 2,7 sekunders latency. 0,02 dollars per billede.
  6. Imagen 4 Ultra. Den mest kapable variant med højeste kvalitet og detaljering.

Imagen vs. andre billedmodeller

  1. Imagen vs. DALL-E. DALL-E er OpenAIs billedmodel. Imagen har generelt bedre tekstgengivelse og fine detaljer. DALL-E har tættere integration med ChatGPT.
  2. Imagen vs. Midjourney. Midjourney er kendt for kunstnerisk stil. Imagen er stærkere i fotorealisme og præcis prompt-følgning.
  3. Imagen vs. Nano Banana. Nano Banana er billedgenerering integreret i Gemini. Imagen er en standalone billedmodel optimeret specifikt til billedgenerering.
  4. Imagen vs. Stable Diffusion. Stable Diffusion er open source og kan køres lokalt. Imagen er lukket og kører i Googles cloud.

Tilgængelighed

  1. Gemini API / Google AI Studio. Imagen 4 er tilgængelig via Gemini API for udviklere.
  2. Vertex AI. Enterprise-adgang via Google Cloud med sikkerhedsfiltre og compliance.
  3. Google-produkter. Imagen bruges i ImageFX (Googles billedgenereringsværktøj) og i Gemini-appen.

Tekst i billeder er Imagens styrke Mange billedmodeller har svært ved at generere læselig tekst i billeder. Imagen 4 er en af de modeller der klarer det bedst. Det lyder som en detalje, men det er vigtigt for praktiske anvendelser: plakater, slides, produktbilleder og mockups der kræver præcis tekst.


FAQ

Hvad er Imagen?

Imagen er Google DeepMinds serie af tekst-til-billede-modeller. Du beskriver et billede med tekst, og Imagen genererer det. Imagen 4 er den nyeste version, lanceret i maj 2025, med forbedret detaljering og tekstgengivelse.

Hvad er forskellen på Imagen og Nano Banana?

Imagen er en standalone tekst-til-billede-model. Nano Banana er billedgenerering bygget ind i Gemini-modellerne. Imagen er optimeret til ren billedgenerering, mens Nano Banana er integreret i en multimodal samtalemodel.

Kan man bruge Imagen via API?

Ja, Imagen er tilgængelig via Gemini API i Google AI Studio og via Vertex AI i Google Cloud. Imagen 4 Fast koster 0,02 dollars per billede med cirka 2,7 sekunders latency.


Relaterede termer