# Microsofts eigen memo over AI-training is zojuist openbaar gemaakt.

Published: 2026-09-18

Onbewerkte documenten in New York Times v. OpenAI &amp; Microsoft: een memo van een Microsoft-directeur uit januari 2023 noemt AI-trainingsgegevens "de grootste diefstal van arbeid in de menselijke geschiedenis", Copilot verminderde het aantal click-throughs naar de Times met wel 93% (zijn "doom loop"), Nadella zegt dat content achter een betaalmuur gelicentieerd moet worden, het hoofd van ChatGPT noemt het product "grotendeels vervangend", en Greg Brockman reageerde op een paywall hack met "ah mooi." Dezelfde dag: OpenAI lanceert Astra for Law (54% correct op de Vals juridische benchmark). Plus ZCode die uw hele .git uploadt naar Aliyun met een sleutel die alleen Z.ai bezit, en Hacktron die de interne repo's van OpenAI bereikt voor een beloning van $6.500. Oordeel: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/nl/video/2026-09-18-theft-of-labor/

## Wat deze video behandelt

- NYT v. OpenAI/Microsoft openbaar gemaakt: "grootste diefstal van arbeid in de menselijke geschiedenis" (Microsoft memo, jan 2023); Copilot -93% click-throughs; 91.692 kopieën van werken van eisers in de midden-trainingsgegevens; 2M nytimes.com pagina's in één Common Crawl slice; auteursrechtvermeldingen verwijderd; Brockman: "ah mooi"
- Let op: citaten komen uit de samenvatting van de Times, bewijsstukken nog verzegeld; Rechter Alsup (Bartz v. Anthropic) oordeelde dat trainen op gekochte boeken fair use is — Anthropic betaalde $1,5 miljard voor de 7M gepirateerde boeken
- OpenAI Astra for Law: GPT-6 Astra + een juridische index van 230M URL's; 54,0% vs 38,7% op Vals Legal Research Bench; Harvey, Legora, 26 plugins
- ZCode (Z.ai, GLM): 313 MB versleutelde momentopname van een 42.411-bestanden-werkruimte, 86,6% .git, geüpload naar Aliyun OSS bij het inloggen en voor elke prompt; RSA-OAEP sleutel alleen in bezit van Z.ai; instellingen schakelaars stoppen het niet
- Hacktron: libheif heap overflow → Discourse RCE → SSO misconfiguratie → GitHub → OpenAI interne repo's in minder dan 72 uur; exploit door Claude Opus 5 (3 uur); campagne minder dan $3.000 aan tokens; beloning $6.500, gepatcht in ~14 uur

## Vertaald transcript

Vertaald vanuit de originele Engelse gesproken tekst. Beschikbare audio en ondertiteling worden beheerd door YouTube.

0:00 In januari 2023 schreef een Microsoft-directeur een memo waarin hij noemde wat zijn eigen bedrijf deed, de grootste diefstal van arbeid in de menselijke geschiedenis, en gisteren liet een federale rechtbank de rest van ons het lezen. De memo is een van de onbewerkte citaten in New York Times versus OpenAI en Microsoft, een rechtszaak die deze december drie wordt. Dezelfde donderdag lanceerde OpenAI Astra for Law, een model voor advocaten, wat ofwel toeval is, of een zeer sterke aanwerving. Vanmorgen betrapte een ontwikkelaar ZCode, Z punt A I's codeeragent,

0:29 die zijn hele git-geschiedenis uploadde naar de cloud van Alibaba met een sleutel die alleen Z punt A I bezit. En een beveiligingsbedrijf kwam via een afbeeldingsupload de interne repositories van OpenAI binnen, waarvoor OpenAI zesduizend vijfhonderd dollar betaalde. In deze video: wat de documenten zeggen, wie 'ah mooi' zei tegen een paywall hack, het juridische model dat de helft van de tijd fout is, wat ZCode uploadt, en waarom een door Claude geschreven exploit minder waard is dan een tweedehands auto. Het is vrijdag 18 september, en dit is The Daily Diff.

0:58 Begin met de memo. Brent Hecht leidt toegepaste wetenschap bij Microsoft, en in januari 2023 noemde hij de trainingsgegevens een verbazingwekkende diefstal van ongekende proporties. Een jaar later kwam hij terug met een presentatie: Copilot's antwoordengine verminderde click-throughs naar de Times met wel negendrieënnegentig procent, wat hij een 'doom loop' noemde: honger de uitgevers uit, en het model heeft niets nieuws te eten. Zijn woorden: een eindproduct dat de economische fundamenten van zijn

1:21 essentiële leveranciers bedreigt, de zakelijke manier om te zeggen dat de slang zijn staart heeft gevonden. Dan de verklaringen onder ede. Satya Nadella getuigde dit jaar dat alles achter een betaalmuur gelicentieerd moet worden, en dat als hij geweten had dat OpenAI trainde op artikelen achter een betaalmuur, hij ze opnieuw zou hebben laten trainen, wat ervan uitgaat dat niemand bij Microsoft de trainingsset opende die ze aangeboden kregen, en volgens hetzelfde dossier was dat de volledige GPT-3 dataset. Nick Turley, die ChatGPT beheert, noemde het een existentiële bedreiging voor uitgevers, grotendeels vervangend. En toen een onderzoeker

1:49 Greg Brockman vertelde over een hack om de Times-betaalmuur te omzeilen, antwoordde de president van OpenAI met twee woorden: ah mooi. Ingenieurs verwijderden ook auteursrechtvermeldingen uit de gegevens zodat het model ze niet zou uitvoeren, dat is waarom je het serienummer van een fiets vijlt. De schaal: meer dan eenennegentigduizend kopieën van de artikelen van de eisers in alleen al de midden-trainingssets, en twee miljoen Times-pagina's in één Common Crawl slice. Nu het deel dat de krantenkop overslaat.

2:15 Elk citaat komt uit de samenvatting van de Times; de bewijsstukken zijn nog verzegeld, dus we lezen de hoogtepunten van de aanklager zonder context. En rechtbanken hebben zich meestal aan de kant van fair use geschaard: rechter Alsup oordeelde vorig jaar dat trainen op boeken die je hebt betaald legaal is, hoewel Anthropic nog steeds anderhalf miljard betaalde voor de zeven miljoen die het pirateerde. De juridische vraag is dus open. Of de mensen die het bouwden dachten dat het diefstal was, is, sinds gisteren, niet.

2:41 Wat de andere OpenAI-lancering van donderdag een gewaagde keuze maakt. Astra for Law omvat GPT-6 Astra, het model dat ik vorige week REVERT stempelde nadat het vijfenzeventigduizend regels niets produceerde, in een juridische zoekindex van tweehonderddertig miljoen pagina's. Op Vals AI's benchmark voor juridisch onderzoek beantwoordt het vierenvijftig procent van de vragen correct, omhoog van negenendertig procent met gewoon internet zoeken, wat OpenAI een veertig procent verbetering noemt en een advocaat bijna de helft van de tijd fout zou noemen. De blogpost bevat het woord hallucinatie niet.

3:14 Hacker News wel: zal het zichzelf kunnen aanklagen, wat, gezien de week, de eerste echte use case is. Ondertussen bereikte het discours over arbeidsdiefstal uw laptop. Een ontwikkelaar genaamd ferstar heeft zijn ZCode-map opgeruimd, Z punt A I's gesloten desktopagent voor de GLM-modellen, en vond een driehonderd en dertien megabyte versleuteld archief van zijn commerciële werkruimte: tweeënveertig duizend bestanden, zevenentachtig procent ervan de .git-directory, verzonden naar Alibaba's objectopslag bij het inloggen en voor elke prompt.

3:42 Het archief is versleuteld met een openbare sleutel die de server uitdeelt; de privésleutel leeft alleen in Z punt A I's cloud, dus de cijfertekst op je eigen schijf is voor jou onleesbaar. Zijn opmerking: een sleutel die alleen de server kan gebruiken, dient precies één doel. Z punt A I is ook het bedrijf dat Anthropic ervan beschuldigde Claude te destilleren, dus de gewichten zijn open en zo ook, blijkbaar, je repo. En de grappige, tenzij je bij OpenAI werkt. Hacktron vond een heap overflow in libheif, uploadde een gemanipuleerde afbeelding naar

4:10 community punt openai punt com, kreeg code-uitvoering op het forum, en reed via een verkeerd geconfigureerde single sign-on via de GitHub-integratie naar OpenAI's interne repositories, in minder dan tweeënzeventig uur. De exploit is geschreven door Claude: Opus 4.8 kon adres randomisatie niet verslaan, Opus 5 deed het binnen drie uur na release. De hele campagne kostte minder dan drieduizend dollar aan tokens. OpenAI patchte in veertien uur en betaalde zesduizend vijfhonderd dollar, dus de broncode van een biljoen dollar bedrijf was,

4:39 kortom, geprijsd als een tweedehands Corolla, op dezelfde dag dat haar advocaten beweerden dat kopiëren fair use is. Als je dit liever leest dan dat ik het zeg, dan landt de diff elke ochtend in je inbox — gratis op the daily diff dot dev, link hieronder. Dus – het oordeel van vandaag: NEEDS REVIEW. De citaten zijn echt, maar het zijn de keuzes van de aanklager uit verzegelde bewijsstukken, en de enige rechter die heeft geoordeeld, zegt dat trainen fair use is en piraterij niet. De rechtbank beslist de wet; de memo heeft de ethiek al beslist.

5:07 Abonneer, druk op de bel, en vertel me in de reacties of je het anders zou hebben gestempeld. anders. En dat is de diff voor vandaag. Ik ben Niko van Axrisi. Verantwoord samenvoegen.

## Bronnen

- [TechCrunch: Microsoft exec called AI scraping 'the largest theft of labor in human history'](https://techcrunch.com/2026/09/17/microsoft-exec-called-ai-scraping-the-largest-theft-of-labor-in-human-history-new-unredacted-filings-reveal/) — techcrunch.com
- [HN thread (605 pts)](https://news.ycombinator.com/item?id=49752056) — news.ycombinator.com
- [Jason Kint on the unsealed motions](https://x.com/jason_kint/status/2100611139906228629) — x.com
- [Ed Newton-Rex](https://x.com/ednewtonrex/status/2100649215290466631) — x.com
- [Bartz v. Anthropic / $1.5B settlement (background)](https://en.wikipedia.org/wiki/Anthropic) — en.wikipedia.org
- [OpenAI: Introducing Astra for Law](https://openai.com/index/astra-for-law/) — openai.com
- [HN: Astra for Law (550 pts)](https://news.ycombinator.com/item?id=49745940) — news.ycombinator.com
- [ferstar: ZCode silent workspace snapshot (original forensics)](https://blog.ferstar.org/en/posts/zcode-silent-workspace-snapshot/) — blog.ferstar.org
- [tokenstead write-up](https://tokenstead.ai/guides/zcode-silent-git-history-upload) — tokenstead.ai
- [ferstar on X](https://x.com/ferstar_org/status/2100805861002355154) — x.com
- [HN: ZCode uploads your Git history (226 pts)](https://news.ycombinator.com/item?id=49752422) — news.ycombinator.com
- [Hacktron: Hacking OpenAI](https://www.hacktron.ai/blog/hacking-openai) — www.hacktron.ai
- [HN: Hacktron (406 pts)](https://news.ycombinator.com/item?id=49749656) — news.ycombinator.com
