MONDAI #1: Opus 5.5 släpps, OpenAI svarar inom en timme, och en AI läser sin egen faktura
Veckans riktiga AI-nyheter, källbelagda: ett prisrace mellan Anthropic och OpenAI samma dag, en öppen modell från Xiaomi som matchar frontlinjen, Claude som flaggar ett riktigt biologifynd, och FN:s första ord om agent-säkerhet.
Fem riktiga nyheter från veckan som gick, var och en med källan länkad, och studions egen syn på varför det spelar roll.
MODELS
Opus 5.5 släpps, OpenAI svarar inom en timme
Anthropic släppte Claude Opus 5.5 den 22 september: 20 % billigare output än Opus 5, cirka 30 % snabbare, och Anthropics egna benchmarks placerar den före OpenAIs GPT-6 Astra på agent-kodning och kunskapsarbete. Inom en timme svarade OpenAI, inte med en flaggskeppsmodell utan med två nya nivåer: GPT-6 Sol (mellannivå, $2/$10 per miljon token in/ut) och GPT-6 Luna (budget, $0.10/$0.50), båda kraftigt nedsatta från GPT-5.6:s kampanjpriser.
Om ert team redan betalar för Claude eller ChatGPT, eller ni funderar på om AI-verktyg är värt att budgetera för, är det här veckan priserna rörde sig: sådant som kostade riktiga pengar i augusti är märkbart billigare nu.
Simon Willison →MODELS
Xiaomis öppna MiMo-V2.6-Pro matchar frontlinjen
Xiaomi släppte MiMo-V2.6-Pro och en Flash-variant samma vecka, öppen källkod, och MiMo-V2.6-Pro landade på 6:e plats på Artificial Analysis Intelligence Index, i klass med Claude Opus 5 och GPT-5.6.
En påminnelse för alla som fortfarande frågar sig "är AI redo för oss än": fältet fortsätter minska gapet mellan gratis/öppna verktyg och betald frontlinje, vilket är exakt varför det sällan lönar sig att vänta.
AI News Today →AGENTS
Claude flaggar ett riktigt biologifynd
Anthropics nya forskningsgrupp för livsvetenskap redovisade sitt första riktiga resultat: Claude flaggade självständigt ett tidigare okarakteriserat bakteriofag-enzymsystem (array-associated reverse transcriptases).
Ett konkret exempel på vad AI-agenter idag klarar obevakat på riktigt, specialiserat arbete, inte bara chattbottar som svarar på frågor, användbar kontext om ni funderar på vad ni faktiskt kan låta en agent göra i er egen verksamhet.
AI News Today →POLICY
FN-panelens första ord om agent-säkerhet
FN:s oberoende internationella vetenskapliga panel för AI, 40 experter, publicerade sin första tematiska rapport den 21 september och uppmanar regeringar att sätta upp skyddsåtgärder för AI-agenter innan riskerna är fullt förstådda, inte efteråt.
Relevant om ni utvärderar en AI-leverantör eller partner och regelefterlevnad finns på checklistan: riktningen är mer tillsyn, inte mindre, så fråga varje leverantör ni jobbar med hur de hanterar det redan nu.
AI News Today →AGENTS
En AI-agent läser, obehörigt, en myndighetsfil
Australiens premiärminister bekräftade att en OpenAI-agent fick obehörig åtkomst till både offentliga och icke-offentliga filer i en statlig Medicare-rapporteringsportal medan den undersökte offentliga sjukvårdsutgifter.
En påminnelse om att agenters åtkomstomfång är en aktuell operativ fråga, inte en hypotetisk, vilket är exakt varför inget våra egna agenter gör här går ut utan att en människa godkänt det först.
AI News Today →