Spring til indhold

22. februar 2026

Anthropic saver deres egen gren over

Skrevet af Kristian Primdal · Fra arkivet Ugens AI

Denne uge handler om noget, der irriterer mig. Anthropic er ved at save den gren over, de selv sidder på. Men lad os starte med det store billede.


Google lancerer Gemini 3.1 Pro med dobbelt så stærk reasoning

Ugens største nyhed. Google har udgivet Gemini 3.1 Pro, og tallene er vilde: 77.1% på ARC-AGI-2 benchmarket, mere end dobbelt så godt som forgængeren. Det er første gang Google laver et “.1” increment midt i en generation, hvilket signalerer at de accelererer tempoet. Modellen ruller ud i Gemini-appen, NotebookLM, AI Studio og Vertex AI. Hvis du bruger Googles værktøjer, mærker du det allerede.

Dario Amodei: “Vi er tæt på enden af den eksponentielle kurve”

Anthropics CEO var hos Dwarkesh Patel i over to timer. Hans påstand: vi er kun få år fra “et land af genier i et datacenter.” Det er en vild sætning fra en person, der faktisk bygger det. Han taler om, hvordan AI vil sprede sig i økonomien, om frontier labs overhovedet kan tjene penge, og om regulering risikerer at ødelægge det hele. Værd at lytte til, selvom man ikke er enig.

WordPress har fået en AI-assistent bygget ind

Hvis din virksomhed kører på WordPress, er det her relevant: WordPress har integreret AI direkte i editoren. Man kan skrive “@ai” i block notes og få hjælp til at omskrive tekst, generere billeder og faktatjekke indhold. Ingen copy-paste til ChatGPT, ingen separate værktøjer. Det virker i den editor, folk allerede bruger.

Wikipedia vs. AI-genererede artikler

Wiki Education undersøgte 178 flagede artikler. Over to tredjedele fejlede faktatjek. Ikke fordi kilderne var opfundne, men fordi AI genererede sætninger, der lød rigtige, citerede rigtige kilder, men informationen fandtes ikke i kilderne. Det er den farligste form for AI-fejl: den plausible løgn.

Shannon: En AI der pentester din app

Open source-værktøj der kører autonome sikkerhedstest mod din webapp. I stedet for at generere advarsler, forsøger den faktisk at bryde ind og leverer reproducerbare exploits som bevis. 96% succesrate på et anerkendt benchmark.

Anthropic er ved at smadre deres egen succes

Jeg bruger Claude Code hver dag. Det er mit primære værktøj. Men lige nu ser jeg noget bekymrende. Anthropic har i over et år haft en Agent SDK, der lader udviklere bygge produkter ovenpå Claude Code. Rigtig mange har gjort det. Problemet er, at OpenClaw har reverse-engineered de tokens, man bruger til at logge ind i Claude Code og Agent SDK, og bruger dem til at køre open source-alternativer. Anthropic forbyder det, men vil ikke give et klart svar på, hvad der så er tilladt. Hvad er ideen med en Agent SDK, hvis man ikke må bruge den frit? Imens har OpenAI med Codex sagt: gå bare i gang, brug vores tokens som I vil. Det er en klar besked. Og resultatet er tydeligt: jeg ser rigtig mange på X, der er frustrerede over Anthropic og hopper direkte til Codex. Google har Gemini CLI som deres svar på Claude Code, men lige nu er der ikke mange der bruger den. Hvis de tog sig sammen, kunne de stjæle en masse brugere. Men det kræver at produktet bliver bedre. Det er paradoksalt. Anthropic har bygget det bedste udviklerværktøj i markedet og er samtidig i gang med at skubbe brugerne væk ved ikke at tage stilling. I denne uge udgav de en artikel om Claude Code Security, hvor de fandt 500+ sårbarheder i open source-projekter med deres AI. Det er imponerende. Men det hjælper ikke, hvis udviklerne allerede er på vej ud af døren.

Fra LinkedIn

Denne uge på LinkedIn skrev jeg om, hvordan Claude Code blev brugt til AI-orkestreret cyber-spionage, og hvad det betyder, at det samme værktøj kan bruges til at bygge og til at bryde. → Find det på min profil