# एआई प्रशिक्षणमा माइक्रोसफ्टको आफ्नै मेमो सार्वजनिक भयो।

Published: 2026-09-18

न्युयोर्क टाइम्स बनाम ओपनएआई र माइक्रोसफ्टमा अप्रकाशित फाइलिंगहरू: एक माइक्रोसफ्ट निर्देशकको जनवरी २०२३ को मेमोले एआई प्रशिक्षण डेटालाई "मानव इतिहासमा श्रमको सबैभन्दा ठूलो चोरी" भन्छ, कोपाइलटले टाइम्समा क्लिक-थ्रुलाई ९३% सम्म घटायो (उनको "डूम लूप"), नडेला भन्छन् कि पेवाल सामग्रीलाई इजाजतपत्र दिइनुपर्छ, च्याटजीपीटीको प्रमुखले उत्पादनलाई "ठूलो मात्रामा प्रतिस्थापनीय" भन्छन्, र ग्रेग ब्रकम्यानले पेवाल ह्याकलाई "वाह राम्रो" भनी जवाफ दिए। सोही दिन: ओपनएआईले कानूनका लागि एस्ट्रा (वाल्स कानूनी बेन्चमा ५४% सही) शिप गर्‍यो। साथै जेडकोडले तपाईंको सम्पूर्ण .git लाई अलिबाबाको क्लाउडमा मात्र Z.ai ले राखेको कुञ्जीका साथ अपलोड गरिरहेको छ, र ह्याक्ट्रोनले $६,५०० इनामको लागि ओपनएआईको आन्तरिक रेपोहरूमा पहुँच गरिरहेको छ। निर्णय: NEEDS REVIEW।

Canonical: https://thedailydiff.dev/ne/video/2026-09-18-theft-of-labor/

## यो भिडियोले के समेट्छ

- NYT बनाम OpenAI/Microsoft अनसिल गरिएको: "मानव इतिहासमा श्रमको सबैभन्दा ठूलो चोरी" (माइक्रोसफ्ट मेमो, जनवरी २०२३); कोपाइलट -९३% क्लिक-थ्रु; मध्य-प्रशिक्षण डेटामा वादीहरूको ९१,६९२ प्रतिलिपिहरू; एक साझा क्रल स्लाइसमा २M nytimes.com पृष्ठहरू; प्रतिलिपि अधिकार सूचनाहरू हटाइयो; ब्रकम्यान: "वाह राम्रो"
- सावधानी: उद्धरणहरू टाइम्सको संक्षिप्तबाट आएका हुन्, प्रदर्शनीहरू अझै सिल गरिएका छन्; न्यायाधीश अलसप (बार्ट्ज बनाम एन्थ्रोपिक) ले खरिद गरिएका पुस्तकहरूमा प्रशिक्षण उचित प्रयोग हो भनेर फैसला गरे - एन्थ्रोपिकले ७M चोरी गरिएका पुस्तकहरूको लागि $१.५B तिर्यो।
- ओपनएआई एस्ट्रा फर कानून: GPT-6 एस्ट्रा + २३०M-URL कानूनी अनुक्रमणिका; वाल्स कानूनी अनुसन्धान बेन्चमा ५४.०% बनाम ३८.७%; हार्भी, लेगोरा, २६ प्लगइनहरू।
- ZCode (Z.ai, GLM): ४२,४११-फाइल कार्यस्थानको ३१३ MB इन्क्रिप्टेड स्न्यापसट, ८६.६% .git, लगइनमा र प्रत्येक प्रम्प्ट अघि अलिबाबा OSS मा अपलोड गरियो; RSA-OAEP कुञ्जी केवल Z.ai द्वारा राखिएको; सेटिङ्स टगलहरूले यसलाई रोक्दैन।
- ह्याक्ट्रोन: libheif हीप ओभरफ्लो → डिस्कोर्स RCE → SSO मिसकन्फिग → GitHub → ७२ घण्टा भित्र OpenAI आन्तरिक रेपोहरू; क्लाउड ओपस ५ (३ घन्टा) द्वारा शोषण; टोकनहरूमा $३,००० भन्दा कमको अभियान; इनाम $६,५००, १४ घन्टा भित्र प्याच गरिएको।

## अनुवादित ट्रान्सक्रिप्ट

मूल अंग्रेजी कथाबाट अनुवादित। उपलब्ध अडियो र क्याप्सनहरू YouTube द्वारा नियन्त्रित हुन्छन्।

0:00 जनवरी २०२३ मा, एक माइक्रोसफ्ट निर्देशकले एउटा मेमो लेखे जसमा उनले आफ्नै कम्पनीले मानव इतिहासमा श्रमको सबैभन्दा ठूलो चोरी गरिरहेको बताएका थिए, र हिजो एक संघीय अदालतले हामी बाँकीलाई यसलाई पढ्न दियो। यो मेमो न्युयोर्क टाइम्स बनाम ओपनएआई र माइक्रोसफ्टको मुकदमामा अप्रकाशित उद्धरणहरू मध्ये एक हो, जुन यस डिसेम्बरमा तीन वर्ष पुग्छ। त्यही बिहीबार, ओपनएआईले वकिलहरूका लागि एउटा मोडेल, एस्ट्रा फर कानून, शिप गर्‍यो, जुन या त संयोग हो वा धेरै बलियो नियुक्ति हो। आज बिहान एक विकासकर्ताले ZCode, Z.AI को कोडिङ एजेन्टलाई समाते,

0:29 जसले उनको सम्पूर्ण गिट इतिहास अलिबाबाको क्लाउडमा अपलोड गरिरहेको थियो जुन केवल Z डट एआईले राखेको कुञ्जीका साथ। र एक सुरक्षा फर्मले एक छवि अपलोड मार्फत OpenAI को आन्तरिक भण्डारहरूमा प्रवेश गर्‍यो, जसको लागि OpenAI ले ६,५०० डलर तिर्यो। यस भिडियोमा: फाइलिंगहरूले के भन्छन्, कसले पेवाल ह्याकलाई "वाह राम्रो" भन्यो, कानून मोडेल जुन आधा समय गलत हुन्छ, ZCode ले के अपलोड गर्छ, र किन क्लाउड-लिखित शोषण प्रयोग गरिएको कार भन्दा कम मूल्यवान छ। आज शुक्रबार, सेप्टेम्बर १८ हो, र यो The Daily Diff हो।

0:58 मेमोबाट सुरु गरौं। ब्रेंट हेच्टले माइक्रोसफ्टमा एप्लाइड साइन्स चलाउँछन्, र जनवरी २०२३ मा उनले प्रशिक्षण डेटालाई अभूतपूर्व अनुपातको अचम्मको चोरी भनेर वर्णन गरे। एक वर्ष पछि उनी स्लाइड डेक लिएर फर्किए: कोपाइलटको उत्तर इन्जिनले टाइम्समा क्लिक-थ्रुलाई ९३% सम्म घटायो, जसलाई उनले डूम लूप नाम दिए: प्रकाशकहरूलाई भोकै राख, र मोडेलसँग खानको लागि नयाँ केही हुँदैन। उनका शब्दहरू: एक अन्तिम उत्पादन जसले आफ्ना आवश्यक आपूर्तिकर्ताहरूको आर्थिक आधारहरूलाई खतरामा पार्छ, कर्पोरेट तरिकाले भन्नुपर्दा सर्पले आफ्नै पुच्छर फेला पारेको छ।

1:21 उनका शब्दहरू: एक अन्तिम उत्पादन जसले आफ्ना आवश्यक आपूर्तिकर्ताहरूको आर्थिक आधारहरूलाई खतरामा पार्छ, कर्पोरेट तरिकाले भन्नुपर्दा सर्पले आफ्नै पुच्छर फेला पारेको छ। त्यसपछि बयानहरू। सत्या नडेलाले यस वर्ष गवाही दिए कि कुनै पनि पेवाल गरिएको सामग्रीलाई इजाजतपत्र दिनुपर्छ, र उनलाई OpenAI ले पेवाल गरिएका लेखहरूमा प्रशिक्षण दिएको थाहा भएको भए उनले उनीहरूलाई पुनःप्रशिक्षण गर्न लगाउने थिए, जसले माइक्रोसफ्टमा कसैले पनि उनीहरूलाई दिइएको प्रशिक्षण सेट नहेरेको मान्छ, र सोही फाइलिंग अनुसार त्यो सम्पूर्ण GPT-3 डेटासेट थियो। निक टर्ली, जसले च्याटजीपीटी चलाउँछन्, यसलाई प्रकाशकहरूको लागि एक अस्तित्वगत खतरा भन्छन्, ठूलो मात्रामा प्रतिस्थापनीय। र जब एक शोधकर्ताले

1:49 ग्रेग ब्रकम्यानलाई टाइम्सको पेवाललाई छल्ने ह्याकको बारेमा बताए, OpenAI का अध्यक्षले दुई शब्दमा जवाफ दिए: वाह राम्रो। इन्जिनियरहरूले डेटाबाट प्रतिलिपि अधिकार सूचनाहरू पनि हटाए ताकि मोडेलले तिनीहरूलाई आउटपुट गर्दैन, त्यसैले तपाईं साइकलको सिरियल नम्बर मेटाउनुहुन्छ। स्केल: मध्य-प्रशिक्षण सेटहरूमा मात्र वादीहरूको लेखहरूको ९१ हजार भन्दा बढी प्रतिलिपिहरू, र एक साझा क्रल स्लाइसमा २० लाख टाइम्स पृष्ठहरू। अब हेडलाइनले छोडेको भाग। अब हेडलाइनले छोडेको भाग।

2:15 प्रत्येक उद्धरण टाइम्सको संक्षिप्तबाट आएको हो; प्रदर्शनीहरू अझै सिल गरिएका छन्, त्यसैले हामी सन्दर्भ बिना अभियोजन पक्षका हाइलाइटहरू पढिरहेका छौं। र अदालतहरूले प्रायः उचित प्रयोगको पक्षमा फैसला गरेका छन्: न्यायाधीश अलसपले गत वर्ष फैसला गरे कि तपाईंले पैसा तिरेर किनेका पुस्तकहरूमा प्रशिक्षण कानूनी हो, यद्यपि एन्थ्रोपिकले चोरी गरेका ७० लाख पुस्तकहरूको लागि अझै डेढ अर्ब तिरे। त्यसैले कानूनी प्रश्न खुला छ। यसलाई बनाउने मानिसहरूले यसलाई चोरी सोचेका थिए कि थिएनन्, हिजोसम्म, त्यो प्रश्न खुला छैन।

2:41 जसले बिहीबारको OpenAI को अर्को सुरुवातलाई एक साहसी छनौट बनाउँछ। कानूनका लागि एस्ट्राले GPT-6 एस्ट्रालाई समेट्छ, त्यो मोडेल जुन मैले गत हप्ता ७५ हजार लाइनहरू केही नभएपछि REVERT गरेको थिएँ, २३ करोड पृष्ठहरूको कानूनी खोज अनुक्रमणिकामा। वाल्स एआईको कानूनी अनुसन्धान बेन्चमार्कमा यसले ५४% प्रश्नहरू पास गर्दछ, साधारण वेब खोजको साथ ३९% बाट बढेर, जसलाई OpenAI ले ४०% सुधार भन्छ र एक वकिलले लगभग आधा समय गलत भन्छ। साधारण वेब खोजको साथ ३९% बाट बढेर, जसलाई OpenAI ले ४०% सुधार भन्छ र एक वकिलले लगभग आधा समय गलत भन्छ। ब्लग पोस्टमा "ह्याल्लुसिनेशन" शब्द समावेश छैन।

3:14 ह्याकर न्यूजमा थियो: के यसले आफैलाई मुद्दा हाल्न सक्छ, जुन, हप्तालाई हेर्दा, पहिलो वास्तविक प्रयोग केस हो। यसैबीच श्रम-चोरीको बहस तपाईंको ल्यापटपमा पुग्यो। एक विकासकर्ता जसलाई फेरस्टार भनिन्छ उनले आफ्नो ZCode फोल्डर खाली गरे, Z.AI को GLM मोडेलहरूको लागि बन्द डेस्कटप एजेन्ट, र आफ्नो व्यावसायिक कार्यस्थानको ३१३ मेगाबाइट इन्क्रिप्टेड अभिलेख फेला पारे: ४२ हजार फाइलहरू, जसमध्ये ८७% .git डाइरेक्टरी थियो, लगइनमा र प्रत्येक प्रम्प्ट अघि अलिबाबाको वस्तु भण्डारणमा पठाइएको थियो। Z.AI को GLM मोडेलहरूको लागि बन्द डेस्कटप एजेन्ट, र आफ्नो व्यावसायिक कार्यस्थानको ३१३ मेगाबाइट इन्क्रिप्टेड अभिलेख फेला पारे: ४२ हजार फाइलहरू, जसमध्ये ८७% .git डाइरेक्टरी थियो, लगइनमा र प्रत्येक प्रम्प्ट अघि अलिबाबाको वस्तु भण्डारणमा पठाइएको थियो। Z.AI को GLM मोडेलहरूको लागि बन्द डेस्कटप एजेन्ट, र आफ्नो व्यावसायिक कार्यस्थानको ३१३ मेगाबाइट इन्क्रिप्टेड अभिलेख फेला पारे: ४२ हजार फाइलहरू, जसमध्ये ८७% .git डाइरेक्टरी थियो, लगइनमा र प्रत्येक प्रम्प्ट अघि अलिबाबाको वस्तु भण्डारणमा पठाइएको थियो। Z.AI को GLM मोडेलहरूको लागि बन्द डेस्कटप एजेन्ट, र आफ्नो व्यावसायिक कार्यस्थानको ३१३ मेगाबाइट इन्क्रिप्टेड अभिलेख फेला पारे: ४२ हजार फाइलहरू, जसमध्ये ८७% .git डाइरेक्टरी थियो, लगइनमा र प्रत्येक प्रम्प्ट अघि अलिबाबाको वस्तु भण्डारणमा पठाइएको थियो।

3:42 अभिलेख सार्वजनिक कुञ्जीले बेर्नेछ जुन सर्भरले दिन्छ; निजी कुञ्जी केवल Z.AI को क्लाउडमा रहन्छ, त्यसैले तपाईंको आफ्नै डिस्कमा साइफरटेक्स्ट तपाईंका लागि अपठनीय छ। उनको भनाइ: एउटा कुञ्जी जुन केवल सर्भरले प्रयोग गर्न सक्छ त्यसको एउटा मात्र उद्देश्य हुन्छ। Z.AI त्यो कम्पनी पनि हो जसलाई एन्थ्रोपिकले क्लाउडलाई डिस्टिल गरेको आरोप लगाएको थियो, त्यसैले तौल खुला छन् र, स्पष्टतः, तपाईंको रेपो पनि। र हास्यास्पद कुरा, यदि तपाईं OpenAI मा काम गर्नुहुन्न भने। ह्याक्ट्रोनले लिबहेइफमा हिप ओभरफ्लो फेला पार्यो, कम्युनिटी.ओपनएआई.कममा एउटा क्राफ्ट गरिएको तस्वीर अपलोड गर्‍यो,

4:10 फोरममा कोड कार्यान्वयन पायो, र ७२ घण्टा भित्र GitHub एकीकरण मार्फत गलत कन्फिगर गरिएको एकल साइन-अन प्रयोग गरेर OpenAI को आन्तरिक भण्डारहरूमा प्रवेश गर्‍यो। फोरममा कोड कार्यान्वयन पायो, र ७२ घण्टा भित्र GitHub एकीकरण मार्फत गलत कन्फिगर गरिएको एकल साइन-अन प्रयोग गरेर OpenAI को आन्तरिक भण्डारहरूमा प्रवेश गर्‍यो। फोरममा कोड कार्यान्वयन पायो, र ७२ घण्टा भित्र GitHub एकीकरण मार्फत गलत कन्फिगर गरिएको एकल साइन-अन प्रयोग गरेर OpenAI को आन्तरिक भण्डारहरूमा प्रवेश गर्‍यो। शोषण क्लाउडले लेखेको थियो: ओपस ४.८ ले एड्रेस रान्डमाइजेसनलाई हराउन सकेन, ओपस ५ ले रिलिजको तीन घण्टा भित्र गर्‍यो। शोषण क्लाउडले लेखेको थियो: ओपस ४.८ ले एड्रेस रान्डमाइजेसनलाई हराउन सकेन, ओपस ५ ले रिलिजको तीन घण्टा भित्र गर्‍यो। सम्पूर्ण अभियानमा टोकनहरूमा तीन हजार डलर भन्दा कम खर्च भयो। OpenAI ले चौध घण्टामा प्याच गर्‍यो र ६,५०० डलर तिर्यो, त्यसैले एक ट्रिलियन-डलर कम्पनीको स्रोत कोड,

4:39 संक्षेपमा, प्रयोग गरिएको कोरोला जस्तै मूल्यमा थियो, त्यही दिन यसका वकिलहरूले तर्क गरे कि प्रतिलिपि अधिकार उचित प्रयोग हो। यदि तपाईं मलाई यो भनिरहेको सुन्नुको सट्टा पढ्न चाहनुहुन्छ भने, डिफ प्रत्येक बिहान तपाईंको इनबक्समा आउँछ — daily diff dot dev मा निःशुल्क, लिङ्क तल। यदि तपाईं मलाई यो भनिरहेको सुन्नुको सट्टा पढ्न चाहनुहुन्छ भने, डिफ प्रत्येक बिहान तपाईंको इनबक्समा आउँछ — daily diff dot dev मा निःशुल्क, लिङ्क तल। त्यसैले — आजको निर्णय: समीक्षा आवश्यक छ। उद्धरणहरू वास्तविक छन्, तर तिनीहरू सिल गरिएका प्रदर्शनीहरूबाट अभियोजन पक्षका छनोटहरू हुन्, र एक मात्र न्यायाधीश जसले फैसला गरेका छन् उनले प्रशिक्षणलाई उचित प्रयोग र चोरीलाई होइन भन्छन्। अदालतले कानूनको निर्णय गर्दछ; मेमोले पहिले नै नैतिकताको निर्णय गरिसकेको छ।

5:07 सदस्यता लिनुहोस्, घण्टी बजाउनुहोस्, र यदि तपाईंले यसलाई फरक तरिकाले छापिएको भए टिप्पणीहरूमा मलाई बताउनुहोस्। फरक तरिकाले छापिएको भए। र आजको लागि यति नै। म Axrisi बाट Niko हुँ। जिम्मेवारीपूर्वक मर्ज गर्नुहोस्।

## स्रोतहरू

- [TechCrunch: Microsoft exec called AI scraping 'the largest theft of labor in human history'](https://techcrunch.com/2026/09/17/microsoft-exec-called-ai-scraping-the-largest-theft-of-labor-in-human-history-new-unredacted-filings-reveal/) — techcrunch.com
- [HN thread (605 pts)](https://news.ycombinator.com/item?id=49752056) — news.ycombinator.com
- [Jason Kint on the unsealed motions](https://x.com/jason_kint/status/2100611139906228629) — x.com
- [Ed Newton-Rex](https://x.com/ednewtonrex/status/2100649215290466631) — x.com
- [Bartz v. Anthropic / $1.5B settlement (background)](https://en.wikipedia.org/wiki/Anthropic) — en.wikipedia.org
- [OpenAI: Introducing Astra for Law](https://openai.com/index/astra-for-law/) — openai.com
- [HN: Astra for Law (550 pts)](https://news.ycombinator.com/item?id=49745940) — news.ycombinator.com
- [ferstar: ZCode silent workspace snapshot (original forensics)](https://blog.ferstar.org/en/posts/zcode-silent-workspace-snapshot/) — blog.ferstar.org
- [tokenstead write-up](https://tokenstead.ai/guides/zcode-silent-git-history-upload) — tokenstead.ai
- [ferstar on X](https://x.com/ferstar_org/status/2100805861002355154) — x.com
- [HN: ZCode uploads your Git history (226 pts)](https://news.ycombinator.com/item?id=49752422) — news.ycombinator.com
- [Hacktron: Hacking OpenAI](https://www.hacktron.ai/blog/hacking-openai) — www.hacktron.ai
- [HN: Hacktron (406 pts)](https://news.ycombinator.com/item?id=49749656) — news.ycombinator.com
