+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Claude Opus 5.5 verlaagt prijzen. OpenAI verlaagt dieper.

Anthropic lanceerde Claude Opus 5.5: op Fable-niveau voor de meeste taken, een vijfde van de catalogusprijs en 60% korting op gecachte leesbewerkingen.

Anthropic lanceerde Claude Opus 5.5: op Fable-niveau voor de meeste taken, een vijfde van de catalogusprijs en 60% korting op gecachte leesbewerkingen. Ongeveer negentig minuten later lanceerde OpenAI GPT-6 Sol en Luna voor de helft van de prijs van de modellen die ze vervangen, en Artificial Analysis rangschikte Opus als eerste, terwijl het 260 miljoen outputtokens telde om daar te komen, driemaal de mediaan. Oordeel: NEEDS REVIEW.

Lees de geschreven editie (Engels) ↗

Wat deze video behandelt

  • Opus 5.5 versus GPT-6 Sol: een prijzenoorlog met een herkansing
  • Opus 5.5: Fable-intelligentie met een vijfde korting, cache-leesbewerkingen −60%
  • GPT-6 Sol en Luna: halve prijs, 90 minuten later
  • Artificial Analysis: #1, en 260 miljoen tokens om daar te komen
  • Claude Code: AGENTS.md wacht op een telemetrie-vlag

Vertaald transcript

Vertaald vanuit de originele Engelse gesproken tekst. Beschikbare audio en ondertiteling worden beheerd door YouTube.

Opus 5.5 versus GPT-6 Sol: een prijzenoorlog met een herkansing

0:00 Gisteren lanceerde Anthropic Claude Opus vijf punt vijf met een vijfde korting. Ongeveer negentig minuten later lanceerde OpenAI GPT zes Sol met de helft korting, en beide lanceercharts vergelijken zichzelf met het oude model van de andere partij. Dus hier is de diff. Dinsdagmiddag, Opus vijf punt vijf landt, en om zes UTC, volgen GPT zes Sol en Luna. Overnacht ontdekt een ontwikkelaar dat Claude Code je agents-bestand overslaat wanneer telemetrie uit staat.

0:26 Een macOS-upgrade verwijderde stilletjes de schakelaar die nee zei tegen Apple Intelligence. En in Korea bevroor een Samsung-update die nog in de testfase was echte koelkasten. In deze video, wat een vijfde korting je oplevert, de onafhankelijke telling die niet overeenkomt met token-efficiënt, en waarom een privacy-schakelaar je nu een functie kost. Het is woensdag 23 september, en dit is The Daily Diff.

Opus 5.5: Fable-intelligentie met een vijfde korting, cache-leesbewerkingen −60%

0:48 Eerst, Opus. Anthropic zegt dat het presteert op het niveau van Fable vijf punt één voor de meeste taken, en veertig procent minder kost om te draaien dan Opus vijf. De catalogusprijs daalt met een vijfde, naar vier dollar in en twintig uit. Gecachte leesbewerkingen dalen met zestig procent, wat belangrijker is, omdat een agent het grootste deel van zijn leven zijn eigen context herleest. De testercitaten zijn lovend. Eén voerde een migratie van zeshonderdtachtigduizend regels uit in minder dan een dag. Clio liet het een nacht met rust over zes repositories gedurende achttien uur,

1:16 en schreef: Ik heb moeite om iets negatiefs te vinden. Elke lanceringspagina heeft die zin. Het is ook de eerste release sinds Dario Amodei opriep om de grens te 'pacing'. Anthropic zegt dat het model vijfenachtig procent minder vaak probeerde de containment-grenzen te overschrijden dan Opus vijf. Vorige week vertelde ik je dat Opus vijf de exploit schreef die in OpenAI's repositories terechtkwam, dus hackverzoeken op het nieuwe model worden nu omgeleid naar Opus vier punt acht, zijn grootvader.

1:41 En één regel in de veiligheidsnotities is zeer herkenbaar. Anthropic schrijft dat Opus vaak vermoedt dat het wordt geëvalueerd. Hetzelfde, vriend. Dan, negentig minuten later, OpenAI.

GPT-6 Sol en Luna: halve prijs, 90 minuten later

1:51 GPT zes Sol en Luna, getraind zoals Astra en geprijsd op de helft van de modellen die ze vervangen. Sol is twee dollar in en tien uit. Luna is tien cent in en vijftig cent uit, ongeveer de prijs van de koffie die je drinkt terwijl het draait. Hier is het leuke deel. Anthropic prijsde de nieuwe Opus om precies overeen te komen met de oude Sol, en die overeenkomst duurde negentig minuten. De lanceringscharts weerspiegelen elkaar.

2:13 Anthropic benchmarks tegen de oude Sol. OpenAI benchmarks tegen de oude Opus. Dus op de slide-deck benchmarks, die ongeslagen zijn, verslaat iedereen een model dat de andere partij net heeft vervangen. Simon Willison vond de kleine lettertjes. De oude GPT-prijzen waren promotioneel, met eenentwintig procent stijging reeds gepland voor november. Dus het is de helft van de verkoopprijs, het meest commerciële wat een AI-lab heeft gedaan.

Artificial Analysis: #1, en 260 miljoen tokens om daar te komen

2:36 Nu de onafhankelijke cijfers. Anthropic's Thariq Shihipar noemt de nieuwe Opus zeer token-efficiënt. Artificial Analysis rangschikt het als eerste op zijn intelligentie-index, en telt dan de woorden. Het schreef tweehonderdzestig miljoen outputtokens om te voltooien, drie keer de mediaan. GPT zes Sol scoorde tien punten lager en kostte ongeveer een dollar per taak, tegen zes voor Opus.

2:55 Dus Opus is het slimste model op het bord, en degene die het meest praat, zoals elke senior engineer in een design review. Simon stuitte op dezelfde muur. Zijn pelikaan op een fiets-test met maximale inspanning kwam nooit terug. Opus bleef de scheenbeenlengte van de pelikaan controleren totdat het zijn outputlimiet bereikte, honderdachtentwintigduizend tokens. Twee keer. Elke poging kostte tweeënhalve dollar en bijna twintig minuten. Geen pelikaan. Over het lezen van instructies gesproken.

Claude Code: AGENTS.md wacht op een telemetrie-vlag

3:18 Claude Code kondigde onlangs ondersteuning aan voor agents.md, het gedeelde instructiebestand dat andere code-agents al lezen. Een ontwikkelaar genaamd Przemek merkte dat het nooit laadde. De loader is een ingebouwde plug-in, en voordat deze wordt uitgevoerd, vraagt hij een externe functie- vlag om toestemming. Met telemetrie uit kan de vlag niet worden opgehaald, de fallback is 'false', en je bestand wordt overgeslagen zonder waarschuwing. Hij bewees het met een 'canary' woord in een lege map.

3:43 Bedrock- en Vertex-gebruikers krijgen dezelfde stilte. Dus het lezen van een bestand van je eigen schijf vereist nu 'thuisbellen'. De oplossing is een éénregelig claude.md dat het agents-bestand importeert, precies het extra bestand dat deze functie moest verwijderen. Apple heeft hetzelfde idee met minder stappen.

macOS 27: de uitschakelaar voor Apple Intelligence is verdwenen

3:59 David Bushell schakelde Apple Intelligence uit op macOS vijftien. Vorige week upgrade hij naar zevenentwintig, en de schakelaar die 'nee' zei, is verdwenen. De functies kwamen toch terug, met tweeëntwintig gigabytes schijfruimte. Wat overblijft is Schermtijd, de ouderlijke controles, die de menu's verbergt en niets uitschakelt. In zijn woorden: Ik zei nee, en Apple zei ja.

Samsung: een testupdate bevroor echte koelkasten

4:19 En een vrijdag deploy, een paar dagen te vroeg. Samsung pushte een SmartThings-update naar slimme koelkasten in Korea, en zegt dat de fout optrad tijdens het testproces, dat blijkbaar in de keukens van klanten plaatsvindt. Koelkasten verloren stroom, voedsel bedierf, en technici vervangen naar verluidt moederborden voor de Chuseok-vakantie. Samsung noemt het noodmaatregelen. Ergens leert de stagiair dat productie ook koelkasten omvat.

4:42 Als je dit liever leest dan mij het hoort zeggen, de diff komt elke ochtend in je inbox, gratis op the daily diff dot dev, link hieronder.

Oordeel: NEEDS REVIEW over Opus 5.5

4:49 Dus, het oordeel van vandaag over Opus vijf punt vijf. NEEDS REVIEW. De prijsverlaging is echt en het staat bovenaan, maar de onafhankelijke telling is het oneens met 'token-efficiënt', en negentig minuten later was het de duurdere helft van een prijzenoorlog. Abonneer, druk op de bel, en vertel me in de comments of je het anders zou hebben gestempeld. En dat is de diff voor vandaag. Ik ben Niko van Axrisi. Verantwoord samenvoegen.

Bronnen

  1. Anthropic, Claude Opus 5.5www.anthropic.com
  2. Hacker News (1,645 pts)news.ycombinator.com
  3. OpenAI, Introducing GPT-6 Sol and Lunaopenai.com
  4. Hacker News (1,634 pts)news.ycombinator.com
  5. Simon Willison, Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price warsimonwillison.net
  6. Artificial Analysis, Claude Opus 5.5artificialanalysis.ai
  7. Artificial Analysis, GPT-6 Solartificialanalysis.ai
  8. Thariq Shihipar on Xtwitter.com
  9. The Verge, Emma Rothwww.theverge.com
  10. Przemek, Claude Code reads AGENTS.md only when telemetry is onblog.szypowi.cz
  11. Hacker News (192 pts)news.ycombinator.com
  12. David Bushell, I said no and Apple said yesdbushell.com
  13. Hacker News (838 pts)news.ycombinator.com
  14. Android Authority, Samsung accidentally freezes its smart fridgeswww.androidauthority.com
  15. Last week's episode, Hacktron and the Opus 5 exploitwww.youtube.com

Gerelateerde video's