Claude Opus 5.5 på jobbet: det här är bekräftat, och det här är löften
By Rickard Eriksson, published · 6 minutes read
The blog is written in Swedish.

I tisdags släppte Anthropic, företaget bakom AI-assistenten Claude, en ny toppmodell: Claude Opus 5.5. Lanseringen är full av imponerande siffror. Problemet är att nästan alla kommer från Anthropic själva, och ett företag som mäter sin egen produkt har förstås ett visst intresse av resultatet.
Så jag har gjort det du också borde göra med varje AI-nyhet: skilt på vad andra har bekräftat och vad som än så länge är löften. Båda sorterna kan vara sanna. Men de är inte lika mycket värda.
Det här har andra bekräftat
Den ligger i topp i ett oberoende test. Artificial Analysis är ett fristående företag som ger alla stora AI-modeller samma prov, så att de går att jämföra på lika villkor. Där får Opus 5.5 58 poäng, det högsta de någonsin uppmätt och fem poäng före både OpenAI:s toppmodell GPT-6 Astra och Anthropics egen dyrare Fable 5.1.
Den är bäst på den sortens jobb du gör. Det intressanta för en kontorsanställd är inte programmeringstesterna, utan ett prov där modellerna ska leverera färdigt yrkesarbete: analys och presentationer. Där leder Opus 5.5 klart, och enligt Artificial Analysis är det första gången en modell från Anthropic slår OpenAI på hur bra presentationerna blir.
Den är testad av utomstående innan släppet. Två oberoende forskningsgrupper inom AI-säkerhet, METR och Frontier Design, fick granska modellen innan den släpptes, vilket även Bloomberg lyfter fram.
Den är billigare. Det här är ingen bedömning utan en prislista: per ord kostar Opus 5.5 20 procent mindre än förra versionen, och det bekräftas av all bevakning.
Det här är Anthropics egna löften, än så länge
Nu kommer det som faktiskt märks mest i vardagen. Men läs det med vetskapen att det bygger på Anthropics egna tester och på kunder som Anthropic själva valt ut att citera.
Att den hittar på mindre. Det största problemet med AI på jobbet är att den ibland låter helt säker när den har fel: en rimlig siffra som aldrig funnits, ett citat som ingen sagt. Anthropic lät tre modeller skriva en rapport om ett företags kvartalssiffror med bara det de själva hittade på nätet, och en enda påhittad uppgift gav underkänt. Opus 5.5 klarade det i 16 av 18 försök, de två föregående modellerna inte en enda gång. Lovande, men Artificial Analysis har inte mätt just det här, så någon oberoende bekräftelse finns inte ännu.
Att den skriver som en kollega, inte som en konsult. Den vanligaste klagan på förra versionen var att den pratade för mycket och gömde det viktigaste i fjärde stycket. Anthropic lovar att Opus 5.5 lägger det viktigaste först, använder mindre fackspråk och följer de skrivregler du ger den. Ingen har ännu mätt skrivstilen oberoende. Men det här kan du testa själv på fem minuter: ge den din arbetsplats skrivregler i början av samtalet, eller dina egna. Kortare meningar. Du-tilltal. Aldrig ”I dagens snabbföränderliga värld”. Se om den håller dem hela vägen.
Att den säger till när du frågat fel. Ett investmentbolag berättar att modellen upptäckte ett fel i själva instruktionerna den fick, rättade för det och påpekade att det skulle kosta den poäng. Ett annat företag såg den gräva vidare där förra versionen nöjde sig med första rimliga svaret. Bra historier, men just det: historier, utvalda av Anthropic.
Att den bygger kalkyl och presentation på en timme. I ett av Anthropics egna test fick modellerna analysera ett påhittat företagsköp, bygga en kalkyl i Excel och göra om den till en presentation för ledningen. Opus 5.5 var klar på 63 minuter i stället för 93, med färre fel och till halva kostnaden. Här finns faktiskt visst stöd utifrån, eftersom det oberoende presentationstestet ovan pekar åt samma håll.
Att du slår i taket mer sällan. Anthropic höjer hur mycket du kan använda Claude inom ett femtimmarsfönster i abonnemangen Pro, Max, Team och Enterprise. Den som fått beskedet att gränsen är nådd mitt i en brådskande rapport vet vad det är värt. Det här är ett besked om villkor, inte en prestanda, så det är lätt att kontrollera när du loggar in.
Varför släppet är större än det verkar
För att förstå varför en billigare modell är en stor nyhet behöver man veta vad som hänt i somras. Anthropic släppte då sin dyraste modell någonsin, Fable 5. Företagen var inte särskilt intresserade. Två månader efter lanseringen stod den för bara runt elva procent av företagens utgifter på Anthropics modeller, skrev Computer Sweden i augusti. Analytiker och investerare förklarade det med att den var för dyr och att billigare modeller räcker för de flesta arbetsuppgifter.
Opus 5.5 är svaret: nästan toppmodellens förmåga, till ett lägre pris. Realtid beskriver det som att Anthropic ger sig in i priskriget, där OpenAI sänkt sina priser under hösten och öppna modeller, många från Kina, tar marknadsandelar.
Och så en detalj som Bloomberg noterar: det här är Anthropics första modell sedan vd:n Dario Amodei gick ut och uppmanade hela AI-branschen att sakta ner takten av säkerhetsskäl. Man kan tycka vad man vill om att släppa en ny toppmodell veckan efter, men det förklarar varför lanseringen lägger så stort fokus på säkerhetstester.
Det här betyder den inte
Den är inte bäst på allt. Artificial Analysis har den efter konkurrenterna i några av sina tester, bland annat ett där modellen ska resonera över mycket långa dokument. Har du jobb som går ut på att läsa igenom hundratals sidor är det värt att jämföra själv.
Det lägre priset är inte hela sanningen. På sin högsta inställning resonerar Opus 5.5 igenom betydligt mer text än OpenAI:s toppmodell för att nå sina resultat, vilket delvis äter upp prisfördelen. För dig med ett vanligt abonnemang märks det knappt, men för företag som betalar per användning spelar det roll.
Ingen vet riktigt hur den beter sig i skarpt läge. Anthropic medger själva att ingen i dag kan bygga tester som fångar alla fel innan en modell släpps, och att modellen ofta verkar misstänka när den blir testad. Det gör alla testresultat, även de oberoende, lite osäkrare än de ser ut.
Mindre påhitt är inte samma sak som inga påhitt. Regeln är densamma som förut: allt som går till en kund eller ligger till grund för ett beslut ska en människa ha läst.
En detalj till för den som följt bloggen: Opus 5.5 har samma osynliga vattenmärkning som vi skrev om i augusti, för att uppfylla EU:s AI-förordning. Chefen kan fortfarande inte trycka på en knapp och avslöja dig.
Så kommer du åt den
Opus 5.5 finns i Claude redan nu, och hos de stora molnleverantörerna Amazon, Google och Microsoft för företag som bygger egna lösningar. De mindre och snabbare syskonen Sonnet 5.5 och Haiku 5.5 är utlovade inom de närmaste veckorna.
Mitt råd: lita varken på Anthropics siffror eller på mina, utan testa på något du redan gör varje vecka. Ditt senaste mötesprotokoll. Dina skrivregler. Den där Excel-filen som ingen riktigt förstår. Jämför med vad du fick förut. Det är där skillnaden syns, och det är den enda bekräftelse som verkligen räknas.
Källor
- Artificial Analysis: Claude Opus 5.5 takes the top spot on the Artificial Analysis Intelligence Index
- Bloomberg: Anthropic unveils Claude Opus 5.5, 22 september 2026
- Computer Sweden: Företag inte lika sugna på Anthropics bästa AI-modell, 24 augusti 2026
- Realtid: Anthropic ger sig in i priskriget, släpper billigare modell, 22 september 2026
- Anthropic: Introducing Claude Opus 5.5
/Rickard Eriksson
Rickard startade världens första sociala medium LunarStorm för 30 år sedan. Det förändrade sättet att umgås för fler än 2 miljoner svenskar. Sedan några år tillbaka är han helt fokuserad på AI, och har hjälpt fler än 7 000 företag och offentliga verksamheter att få mer gjort och med högre kvalitet med hjälp av AI. Rickard är alltså stor förespråkare av AI, men på rätt sätt, och i rätt miljö.
Mer om Rickard Eriksson