26. april 2026
OpenAI svarer igen
Skrevet af Kristian Primdal · Fra arkivet Ugens AI
Stor uge i AI-verdenen. Opus 4.7 i sidste uge, og i denne uge svarede OpenAI, DeepSeek og Shopify igen på hver deres måde. Her er tre historier der er værd at holde øje med.
Velkommen også til de mange nye læsere der er kommet til efter mit LinkedIn-opslag i sidste uge, hvor jeg indrømmede at jeg havde skrevet 8 nyhedsbreve og kun havde 5 abonnenter. Det blev hurtigt flere. Godt at have jer med.
GPT-5.5 og Codex som en hel superapp
OpenAI lancerede fredag GPT-5.5 som svar på Anthropics Opus 4.7 i sidste uge. På overfladen er det et modelpoint-opdatering, men det virkelige nyhedsværdi sidder i Codex.
Tallene først. Terminal-Bench 2.0: 82,7%. SWE-Bench Pro: 58,6%. GDPval: 84,9%. Artificial Analysis kalder GPT-5.5 den mest intelligente model på markedet lige nu, med et interessant tvist: “GPT-5.5 (medium) rammer det samme niveau som Claude Opus 4.7 (max) til en fjerdedel af prisen.”
Den virkelige nyhed er Codex. OpenAI omdannede i samme launch Codex fra kodeværktøj til en bredere computer-agent. Browser-control, Sheets og Slides, Docs og PDF’er, OS-wide diktering, og en auto-review-mode hvor en “guardian” agent kører ved siden af og reducerer antallet af godkendelser du skal give.
Codex kan nu klikke sig gennem en web-app, tage screenshots, og iterere indtil opgaven er færdig. Det er ikke længere “AI der skriver kode”. Det er “AI der udfører arbejde på din computer på samme måde som du gør.”
Sam Altman beskrev det som at OpenAI i højere grad er en AI-inference-virksomhed nu. Det er et vigtigt semantisk skift. Modellen er ikke produktet. Harnessen er.
Jeg har ærligt talt ikke selv været god til at bruge Codex endnu. Claude Code har været min daglige kompagnon, og jeg har holdt mig der. Men efter denne launch er der ingen tvivl om at jeg snart bliver nødt til at tage mig selv i nakken og komme i gang.
DeepSeek-V4: open source til en pris der flytter markedet
Samme dag som GPT-5.5 blev lanceret, svarede DeepSeek med V4 Preview. 1,6 billioner parametre, 1 million tokens kontekst, MIT-licens. Open source på rigtigt.
Prisen er det vilde. V4-Flash koster $0,14 per million input-tokens og $0,28 per million output-tokens. V4-Pro koster $1,74 og $3,48. Til sammenligning: GPT-5.5 er $5 input og $30 output. Opus 4.7 er $5 og $25.
Hvis V4-Flash leverer tæt på frontier-kvalitet, er det en ordre-af-størrelse billigere end alle alternativer. Og med MIT-licens betyder det at enhver kan køre det selv, uden afhængighed af en amerikansk cloud-leverandør.
Det er den type udvikling vi skal tænke over herhjemme. Vi har en tendens til at betragte Anthropic og OpenAI som de eneste seriøse muligheder. Men hver gang DeepSeek slipper en ny model, skal vi revurdere det regnestykke. Især hvis du bygger noget der skal køre i volumen.
Shopify all-in på AI: hvad sker der når en $200B-virksomhed vælger side
Mikhail Parakhin gav i denne uge et deep dive på Latent Space om hvad der egentlig foregår inde i Shopify. Kort version: en 20 år gammel virksomhed på $200B i markedsværdi har brugt det sidste år på at gå all-in på AI internt.
Læg mærke til hvor flaskehalsen flytter hen. Parakhin fortæller at koden ikke længere er problemet. AI skriver den hurtigere end teamet kan reviewe den. Flaskehalsen er nu review, CI/CD og deployment-stabilitet.
Når koden flyder hurtigere end strukturen omkring den, er det ikke koden der skal løses. Det er strukturen.
Samme uge lancerede Anthropic “Claude Powerups”, en ny måde at give Claude Code adgang til skills og værktøjer uden at skulle bygge hele orkestreringen selv. Og Cat Wu, Head of Product for Claude Code, fortalte Lenny Rachitsky at Anthropics shipping-kadence er gået fra måneder til uger til dage.
Mønsteret er tydeligt. De virksomheder der vælger at gå all-in på AI, kommer hurtigere ud. Og de oplever at flaskehalsen ikke længere er “kan AI lave det”. Den er “kan resten af vores arbejde følge med”.
Underveis
Jeg skriver det her fra Montenegro fredag aften. Vi er på vej til Danmark for et kort besøg, før vi skal tilbage til Spanien igen. Det bliver små tre uger i Danmark, hvor jeg har booket møder med en håndfuld kunder og samarbejdspartnere jeg ser frem til at se ansigt til ansigt.
Onsdag har Ronni fra AP3 og jeg taget en hel dag ud af kalenderen med ét emne: AI. Ikke teori, ikke strategi. Vi bygger én ting sammen, og jeg skal undervise lidt i Claude Code.
Rammen vi bruger, er tre kategorier af AI-agenter. Kategori 1 er deterministisk (du definerer flowet, AI fylder indholdet ind). Kategori 2 er ræsonnerende (AI vælger næste skridt ud fra tilgængelige værktøjer). Kategori 3 er multi-agent (flere specialister der koordinerer).
60 til 70% af den reelle værdi i små og mellemstore virksomheder sidder i Kategori 1. Men de fleste forsøg jeg ser derude, starter med Kategori 2 eller 3, fordi det er det der lyder spændende i et oplæg. Resultatet er tre gange så dyrt og halvdelen så meget værdi. Mere om det efter onsdag.
Fra LinkedIn
Denne uge på LinkedIn: “Min AI ved allerede hvem mine kunder er” ramte noget. Kort version: jeg fodrede min agent med 4 års klienthistorik, og pludselig kunne den svare bedre end jeg selv kan, fordi jeg glemmer. En masse nye læsere kom fra det opslag.
God søndag, Kristian
