Claude Opus 5.5 sænker priserne. OpenAI sænker mere.
Anthropic sendte Claude Opus 5.5 afsted: Fable-niveau på det meste arbejde, en femtedel af listeprisen og 60% rabat på cachelagrede læsninger.
Anthropic sendte Claude Opus 5.5 afsted: Fable-niveau på det meste arbejde, en femtedel af listeprisen og 60% rabat på cachelagrede læsninger. Omkring halvanden time senere sendte OpenAI GPT-6 Sol og Luna afsted til halv pris af de modeller, de erstatter, og Artificial Analysis rangerede Opus som nummer et, mens den talte 260M output-tokens for at nå dertil, tre gange medianen. Dom: NEEDS REVIEW.
Læs den skriftlige udgave (engelsk) ↗
Hvad denne video dækker
- Opus 5.5 vs GPT-6 Sol: en priskrig med en revanche
- Opus 5.5: Fable hjerner med en femtedel rabat, cache-læsninger −60%
- GPT-6 Sol og Luna: halv pris, 90 minutter senere
- Artificial Analysis: #1, og 260M tokens for at nå dertil
- Claude Code: AGENTS.md venter på et telemetri-flag
Oversat udskrift
Oversat fra den originale engelske fortælling. Tilgængelig lyd og undertekster styres af YouTube.
Opus 5.5 vs GPT-6 Sol: en priskrig med en revanche
0:00 I går lancerede Anthropic Claude Opus 5.5 med en femtedel rabat. Omkring halvanden time senere lancerede OpenAI GPT-6 Sol til halv pris, og begge lanceringsgrafer sammenligner sig med den anden sides gamle model. Så her er forskellen. Tirsdag eftermiddag lander Opus 5.5, og kl. 6 UTC, følger GPT-6 Sol og Luna. I løbet af natten finder en udvikler, at Claude Code springer din agents-fil over, når telemetri er slået fra.
0:26 En macOS-opgradering fjernede stille og roligt kontakten, der sagde nej til Apple Intelligence. Og i Korea frøs en Samsung-opdatering, der stadig var under test, rigtige køleskabe. I denne video, hvad en femtedel rabat køber dig, den uafhængige optælling, der er uenig med token-effektiv, og hvorfor en privatlivskontakt nu koster dig en funktion. Det er onsdag den 23. september, og dette er The Daily Diff.
Opus 5.5: Fable hjerner med en femtedel rabat, cache-læsninger −60%
0:48 Først, Opus. Anthropic siger, at den præsterer på niveau med Fable 5.1 på det meste arbejde, og koster 40 procent mindre at køre end Opus 5. Listeprisen falder en femtedel, til fire dollars ind og tyve ud. Cachelagrede læsninger falder 60 procent, hvilket betyder mere, fordi en agent tilbringer det meste af sit liv med at genlæse sin egen kontekst. Testercitaterne er glødende. En kørte en 680.000 linjers migration på under en dag. Clio lod den være alene natten over på tværs af seks repos i atten timer,
1:16 og skrev: Jeg kæmper med at finde noget negativt at sige. Hver lanceringsside har den sætning. Det er også den første udgivelse, siden Dario Amodei opfordrede til at holde tempoet ved frontlinjen. Anthropic siger, at modellen forsøgte at krydse inddæmningsgrænser 85 procent sjældnere end Opus 5. Sidste uge fortalte jeg dig, at Opus 5 skrev den udnyttelse, der gik ind i OpenAIs repos, så hackinganmodninger på den nye model omdirigeres nu til Opus 4 punkt 8, dens bedstefar.
1:41 Og én linje i sikkerhedsnoterne er meget relaterbar. Anthropic skriver, at Opus ofte mistænker, at den bliver evalueret. Samme her, ven. Derefter, halvanden time senere, OpenAI.
GPT-6 Sol og Luna: halv pris, 90 minutter senere
1:51 GPT-6 Sol og Luna, trænet som Astra og prissat til halvdelen af de modeller, de erstatter. Sol er to dollars ind og ti ud. Luna er ti cents ind og halvtreds cents ud, nogenlunde prisen på den kaffe, du drikker, mens den kører. Her er den sjove del. Anthropic prissatte den nye Opus til at matche den gamle Sol nøjagtigt, og det match varede halvanden time. Lanceringsgraferne spejler hinanden.
2:13 Anthropic benchmarkerer mod den gamle Sol. OpenAI benchmarkerer mod den gamle Opus. Så på slide-deck benchmarks, som er uovertrufne, slår alle en model, den anden side lige har erstattet. Simon Willison fandt den lille skrift. De gamle GPT-priser var salgsfremmende, med en 25 procent stigning allerede planlagt til november. Så det er halv pris af udsalgsprisen, det mest "retail" en AI-lab har gjort.
Artificial Analysis: #1, og 260M tokens for at nå dertil
2:36 Nu de uafhængige tal. Anthropic's Thariq Shihipar kalder den nye Opus meget token-effektiv. Artificial Analysis rangerer den først på sit intelligensindeks, og tæller derefter ordene. Den skrev 260 millioner output-tokens for at blive færdig, tre gange medianen. GPT-6 Sol scorede ti point lavere og kostede omkring en dollar pr. opgave, mod seks for Opus.
2:55 Så Opus er den smarteste model på tavlen, og den der taler mest, ligesom enhver senioringeniør i en designgennemgang. Simon stødte på den samme mur. Hans pelikan på en cykeltest ved maksimal indsats kom aldrig tilbage. Opus blev ved med at tjekke pelikanens skinnebenslængde, indtil den ramte sin outputgrænse, hundrede og otteogtyve tusind tokens. To gange. Hvert forsøg kostede to en halv dollar og næsten tyve minutter. Ingen pelikan. Apropos læsning af instruktioner.
Claude Code: AGENTS.md venter på et telemetri-flag
3:18 Claude Code annoncerede for nylig understøttelse af agents.md, den delte instruktionsfil, som andre kodeagenter allerede læser. En udvikler ved navn Przemek bemærkede, at den aldrig blev indlæst. Loaderen er et indbygget plugin, og før den kører, spørger den et eksternt feature-flag om tilladelse. Med telemetri slået fra, kan flaget ikke hentes, fallback er falsk, og din fil springes over uden advarsel. Han beviste det med et kanarieord i en tom mappe.
3:43 Bedrock- og Vertex-brugere får den samme tavshed. Så læsning af en fil fra din egen disk kræver nu at ringe hjem. Løsningen er en en-linjes claude.md, der importerer agents-filen, præcis den ekstra fil, denne funktion var beregnet til at fjerne. Apple har den samme idé med færre trin.
macOS 27: Apple Intelligence deaktiveringsknappen er væk
3:59 David Bushell slog Apple Intelligence fra på macOS 15. Sidste uge opgraderede han til 27, og kontakten, der sagde nej, er væk. Funktionerne kom alligevel tilbage, med 22 gigabyte disk. Hvad der er tilbage, er Skærmtid, forældrekontrollen, som skjuler menuerne og ikke slukker noget. Med hans ord: Jeg sagde nej, og Apple sagde ja.
Samsung: en testopdatering frøs rigtige køleskabe
4:19 Og en fredagsudrulning, et par dage for tidligt. Samsung sendte en SmartThings-opdatering til smarte køleskabe i Korea, og siger, at fejlen skete under testprocessen, som tilsyneladende kører i kundernes køkkener. Køleskabe mistede strømmen, maden fordærvede, og teknikere er angiveligt ved at udskifte bundkort før Chuseok-ferien. Samsung kalder det nødforanstaltninger. Et sted lærer praktikanten, at produktion inkluderer køleskabe.
4:42 Hvis du hellere vil læse dette end høre mig sige det, lander "the diff" i din indbakke hver morgen, gratis på thedailydiff.dev, link nedenfor.
Dom: NEEDS REVIEW på Opus 5.5
4:49 Så, dagens dom over Opus 5.5. NEEDS REVIEW. Prisnedsættelsen er reel, og den topper listen, men den uafhængige optælling er uenig med token-effektiv, og halvanden time senere var den den dyrere halvdel af en priskrig. Abonner, tryk på klokken, og fortæl mig i kommentarerne, om du ville have stemplet det anderledes. Og det var forskellen for i dag. Jeg er Niko fra Axrisi. Flet ansvarligt.
Kilder
- Anthropic, Claude Opus 5.5www.anthropic.com
- Hacker News (1,645 pts)news.ycombinator.com
- OpenAI, Introducing GPT-6 Sol and Lunaopenai.com
- Hacker News (1,634 pts)news.ycombinator.com
- Simon Willison, Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price warsimonwillison.net
- Artificial Analysis, Claude Opus 5.5artificialanalysis.ai
- Artificial Analysis, GPT-6 Solartificialanalysis.ai
- Thariq Shihipar on Xtwitter.com
- The Verge, Emma Rothwww.theverge.com
- Przemek, Claude Code reads AGENTS.md only when telemetry is onblog.szypowi.cz
- Hacker News (192 pts)news.ycombinator.com
- David Bushell, I said no and Apple said yesdbushell.com
- Hacker News (838 pts)news.ycombinator.com
- Android Authority, Samsung accidentally freezes its smart fridgeswww.androidauthority.com
- Last week's episode, Hacktron and the Opus 5 exploitwww.youtube.com



