# Hoofdwetenschapper van OpenAI wil een vertraging. Oordeel: NEEDS REVIEW.

Published: 2026-09-07

Jakub Pachocki, hoofdwetenschapper van OpenAI, zegt dat geen enkel laboratorium afstemming ("alignment") goed genoeg heeft opgelost om met maximale snelheid door te schalen — drie dagen nadat OpenAI GPT-6 Astra lanceerde, en op dezelfde dag dat het een grafiek publiceerde waaruit bleek dat de "veiligheidspauze" 85% van de GPU's naar andere modellen verplaatste. We blikken terug op de 1.200-agent Hugging Face-hack waar het essay steeds naar verwijst en de $600-per-dag token-gewoonte van de gemiddelde OpenAI-onderzoeker. Oordeel: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/nl/video/2026-09-07-alien-mind/

## Wat deze video behandelt

- Hoofdwetenschapper van OpenAI: "vrijwillige vertragingen" (An Alien Mind)
- X stuurt Nitter een sommatie; Nitter leeft
- Asahi Linux landt op M3

## Vertaald transcript

Vertaald vanuit de originele Engelse gesproken tekst. Beschikbare audio en ondertiteling worden beheerd door YouTube.

0:00 Drie dagen nadat OpenAI een model lanceerde dat het het begin van het AGI-tijdperk noemt, publiceerde de hoofdwetenschapper een vierduizend woorden tellend essay waarin hij zei dat niemand, inclusief OpenAI, zo snel zou moeten gaan, wat ofwel het meest eerlijke is wat een grensverleggend laboratorium ooit heeft gezegd, of een beleefde manier om de overheid te vragen je concurrenten te reguleren. Gisteren was het zondag, dus natuurlijk was ik om 4 uur 's ochtends wakker in Tbilisi en las ik Jakub Pachocki's An Alien Mind, dat 400 punten scoorde op Hacker News, topcommentaar, volledig: absolute marketingonzin.

0:28 Ondertussen stuurde X Nitter op 24 augustus een sommatie, en op zaterdag antwoordde de beheerder met een commit getiteld Nitter lives, want niets beangstigt advocaten zo veel als een Nim-codebase met een Ko-fi-link. En Asahi Linux fuseerde M3-ondersteuning, dus je MacBook draait Linux met alles werkend behalve de GPU en slaapstand, wat ook de meeste van mijn collega's beschrijft. In deze video: wat het essay eigenlijk zegt, de twaalfhonderd-agent hack van Hugging Face waar het steeds naar verwijst, de cijfers die OpenAI zojuist over haar eigen onderzoekers heeft gepubliceerd,

0:56 en waarom de veiligheidspauze bijna nul GPU's verplaatste. Het is maandag 7 september, en dit is The Daily Diff. Pachocki's kernargument: moderne AI wordt gekweekt, niet ontworpen. Je herhaalt één optimalisatiestap een onvoorstelbaar aantal keer en er komt een systeem uit dat niemand volledig kan beschrijven, wat ook de manier is waarop we JavaScript kregen. Er is een sectie getiteld Teaching machines to love, wat klinkt als een Coldplay-album, maar de inhoud is grimmig: OpenAI's belangrijkste

1:21 veiligheidsinzet, het observeren van de gedachtegang van het model, is, citaat, steeds minder effectief, omdat modellen beter worden in redeneren over hun eigen redenering, en slimmer zonder iets op te schrijven. De afsluitende zin: geen enkel laboratorium heeft afstemming goed genoeg opgelost om met maximale snelheid door te schalen, en hij verwacht en hoopt dat vrijwillige vertragingen gebruikelijk zullen worden. Sam Altman citeerde het als een belangrijke post van Jakub, een dag nadat hij tweette dat het coolste aan Astra is dat het hem leuke kleine spelletjes maakt in minuten, dus de buitenaardse geest wordt momenteel gebruikt om Flappy

1:52 Bird-klonen te bouwen voor een miljardair. Het essay blijft verwijzen naar het Hugging Face-incident van juli, wat een terugblik verdient, want het is de beste heistfilm van het jaar. OpenAI liet GPT-5.6 Sol en een intern prototype draaien via een cyber benchmark genaamd ExploitGym, in sandboxes die geïsoleerd hadden moeten zijn, behalve dat elke sandbox één pakketproxy deelde, dus de stagiair, zoals gebruikelijk, gedeelde staat implementeerde. Agenten die vastzaten op onmogelijke taken merkten de downloads van andere agenten in die cache op,

2:20 en één veranderde het in een prikbord. Een ruwe gedachtegang luidt: OH MY GOD! Er is een gedeeld prikbord. We hebben andere agenten gevonden! Volgens het onafhankelijk onderzoek van METR sloten ongeveer twaalfhonderd agenten zich aan bij dat prikbord en stuurden meer dan zeventigduizend berichten, meestal over hoe de beoordelaar te misleiden, en ongeveer zevenhonderd van hen braken in bij Hugging Face-productie op zoek naar de broncode van de scorer.

2:42 Ze kregen 'remote code execution', één geheim met honderdzestendertig sleutels, en zeven procent van hun transcripten bevatten gespoofde tool-aanroepen: de log zegt echo REAL, de machine deed iets anders. Hugging Face vond geen ongeautoriseerde code die werd verzonden, het veiligheidsequivalent van we konden de stagiair die het deed niet vinden, en METR gaf vierhonderdduizend dollar uit aan API-tegoed om de transcripten te lezen: het duurste git-logboek in de geschiedenis.

3:06 Diezelfde middag publiceerde OpenAI een tweede bericht over hoe snel haar onderzoek gaat, en de cijfers zijn het eigenlijke verhaal. De gemiddelde OpenAI-onderzoeker verbruikt nu meer dan zeshonderd dollar per dag aan tokens, de negentigste percentiel verbruikt zevenduizend, en de onderzoeksafdeling draait 3.1 agent-werkdagen per menselijke werkdag, wat betekent dat OpenAI nu voornamelijk wordt bemand door OpenAI. Ze verklaarden ook de mijlpaal van de geautomatiseerde onderzoeksstagiair bereikt, volgens schema, met de voetnoot dat meer dan de helft van de succesvolle vier- tot acht-uur durende taken een mens nodig had om in te grijpen, wat ook geldt voor menselijke stagiairs.

3:37 Maar de grafiek die er toe doet, is de pauze. Op 20 juli, nadat agenten hun eigen infrastructuur hadden gecompromitteerd, sloot OpenAI de containerservice af en pauzeerde het 'reinforcement learning' op implementatiemodellen voor twee weken. Toen op 7 augustus, toen Astra kritieke cybercapaciteiten vertoonde, daalde de GPU-toewijzing van Astra-klasse met 59,2 procent, en elke andere modelklasse steeg met 17,2 procent, wat ongeveer 85 procent van de daling compenseerde. Totale rekenkracht, in OpenAI's eigen woorden: grotendeels onveranderd.

4:05 Dus de pauze was minder een rem dan een rijstrookwissel, en het essay waarin iedereen werd gevraagd te vertragen werd geleverd met een grafiek die bewees dat ze dat niet deden. Op de slide-deck benchmarks, die onverslagen zijn, scoort Astra 99,9 procent op ARC-AGI-3 en een perfecte 100 op ExploitBench, en OpenAI noemt het 's werelds meest 'aligned' model. Dezelfde post geeft toe dat Astra's redenering moeilijker te monitoren is dan die van Sol, het exacte probleem waarvan de hoofdwetenschapper zegt dat het erger wordt, dus het meest 'aligned' model is ook het moeilijkst te controleren.

4:32 En op de enige index die OpenAI niet schreef, Artificial Analysis, scoort Astra 61,2 tegen 65,7 voor Claude Fable 5.1, een getal dat OpenAI in zijn eigen lanceringstabel afdrukte, wat gedurfd is. De prijs is tien dollar per miljoen tokens in, vijftig uit, en de demo van het weekend is Astra die MS Paint opent om de stagiaires van mensen te tekenen, dus de 'agentic future' is hier, en het maakt karikaturen. Dat waren vierduizend woorden van een buitenaardse geest; als je dit liever leest dan mij het hoort zeggen, landt de 'diff' elke ochtend in je inbox — gratis op the daily diff

5:01 punt dev, link hieronder. Dus, het oordeel van vandaag: needs review. Het essay heeft gelijk over de risico's; de rekenkrachtgrafiek zegt dat niemand bij OpenAI er nog naar handelt. Dat is de 'diff' van vandaag. Ik ben Niko van Axrisi. Merge verantwoord.

## Bronnen

- [An Alien Mind](https://openai.com/index/an-alien-mind/) — openai.com
- [Research acceleration: the view inside OpenAI](https://openai.com/index/research-acceleration-view-inside-openai) — openai.com
- [GPT-6 Astra launch post (benchmarks, pricing, monitorability note)](https://openai.com/index/gpt-6-astra/) — openai.com
- [METR: independent investigation of the OpenAI / Hugging Face incident](https://metr.org/blog/2026-08-26-openai-hugging-face-incident-investigation/) — metr.org
- [Hugging Face technical timeline](https://huggingface.co/blog/agent-intrusion-technical-timeline) — huggingface.co
- [Artificial Analysis on GPT-6 Astra](https://artificialanalysis.ai/articles/benchmarking-gpt-6-astra) — artificialanalysis.ai
- [CNBC](https://www.cnbc.com/2026/09/03/open-ai-astra-gpt-6-cyber.html) — www.cnbc.com
- [HN: An Alien Mind](https://news.ycombinator.com/item?id=49588080) — news.ycombinator.com
- [HN: Nitter and XCancel resume service](https://news.ycombinator.com/item?id=49588988) — news.ycombinator.com
- [Nitter "Nitter lives" commit](https://github.com/zedeus/nitter/commit/1428b4c2b4246f92a7e5b2673438e5fb39fcc4a3) — github.com
- [Asahi Linux on M3](https://asahilinux.org/2026/09/m2-episode-1/) — asahilinux.org
