AI Ordbog
Context window
Mængden af tekst en AI-model kan læse og huske i én samtale.
Skrevet og redigeret af Kristian Primdal · Sidst opdateret 18. marts 2026Indhold
Hvad er et context window?
Et context window er den maksimale mængde tekst en AI-model kan “se” og arbejde med på én gang. Det inkluderer alt: system promptet, hele din samtalehistorik, eventuelle dokumenter du har indsat, og modellens egne svar. Alt dette skal passe inden for context window.
Tænk på det som modellens arbejdshukommelse. Ligesom du kan holde et begrænset antal ting i hovedet på én gang, har en AI-model en fast grænse for hvor meget tekst den kan behandle i en enkelt interaktion.
Context window måles i tokens, ikke ord eller tegn. En token er ca. 0,75 engelske ord eller ca. 0,5-0,7 danske ord. Så et context window på 200.000 tokens svarer til ca. 150.000 engelske ord. Omtrent en hel bog.
Context window-størrelser
Forskellige modeller har vidt forskellige context windows:
- Tidlige modeller (2022). GPT-3 havde et context window på 4.096 tokens (ca. 3.000 ord). Nok til korte samtaler, men hurtigt opbrugt.
- GPT-4 (2023). 8.192 tokens standard, med en 32K-variant på 32.768 tokens.
- Claude 3 (2024). 200.000 tokens (ca. 150.000 ord, en hel bog).
- Gemini 1.5 Pro (2024). Op til 2 millioner tokens. Flere bøger ad gangen.
- Claude 4 / GPT-5 (2025-2026). Op til 1 million tokens som standard hos flere udbydere.
Udviklingen har været eksplosiv: fra 4K tokens i 2022 til 2M tokens i 2024. En 500x forøgelse på to år.
Hvorfor er context window vigtigt?
- Samtalehukommelse. Et større context window betyder at modellen kan huske mere af jeres samtale. Med et lille window “glemmer” modellen tidlige dele af samtalen.
- Dokumentanalyse. Du kan uploade hele dokumenter, rapporter eller kontrakter og bede modellen analysere dem. Men kun hvis de passer i context window.
- Kodning. Kodningsassistenter skal ofte se store dele af en kodebase for at give gode svar. Et stort context window giver bedre kodeforståelse.
- RAG og søgning. Flere søgeresultater kan inkluderes i context window, hvilket giver bedre svar i RAG-systemer.
Context window-begrænsninger
- “Lost in the middle”. Forskning viser at modeller er bedst til at bruge information i starten og slutningen af context window. Information i midten kan blive overset. Et fænomen kaldet “lost in the middle.”
- Omkostning. I API-brug betaler du per token. Et fuldt udnyttet 200K-token context window koster markant mere end et kort prompt.
- Hastighed. Længere context = langsommere svar. Modellen skal behandle al input-tekst før den kan generere et svar.
- Kvalitet vs. kvantitet. At fylde context window med irrelevant information giver ikke bedre svar. Målrettet, relevant kontekst trumfer altid volumen.
Context window i praksis
- Bogreview. Upload en hel bog (200K tokens) til Claude og bed om en analyse, sammenfatning eller oversættelse.
- Kodebase-analyse. Indsæt en hel kodebase i context window og bed modellen om at finde fejl, refaktorere eller dokumentere.
- Mødereferater. Indsæt timers transskription fra et møde og få et struktureret referat med action items.
- Juridisk gennemgang. Upload en kontrakt og bed modellen identificere risici, uklarheder og manglende klausuler.
Context window er ikke hukommelse Et vigtigt punkt: context window er ikke permanent hukommelse. Modellen “husker” kun inden for den aktuelle samtale. Start en ny samtale, og alt er glemt. Det er derfor mange AI-produkter gemmer samtalehistorik eksternt og genindsætter den ved behov. Modellen har ingen vedvarende hukommelse mellem samtaler. Medmindre produktet bygger det med RAG eller lignende teknikker.
FAQ
Hvad er et context window?
Et context window er den maksimale mængde tekst (målt i tokens) en AI-model kan behandle på én gang. Det inkluderer alt: system prompt, samtalehistorik, indsat tekst og modellens egne svar. Større context window = mere information modellen kan arbejde med.
Hvor stort er et typisk context window?
Det varierer enormt. Ældre modeller har 4K-32K tokens. Moderne modeller som Claude har 200K tokens som standard (ca. 150.000 ord) og op til 1 million tokens. Gemini 1.5 Pro nåede op til 2 millioner tokens.
Hvad sker der når context window er fyldt?
Når context window er fyldt, kan modellen ikke modtage mere input. I chatsamtaler begynder de ældste beskeder typisk at falde ud. I API-brug får du en fejlmeddelelse. Du kan starte en ny samtale eller forkorte dit input.