# AI பயிற்சி குறித்த மைக்ரோசாப்ட் நிறுவனத்தின் சொந்த குறிப்பு பொதுவெளியில் வெளியானது.

Published: 2026-09-18

நியூயார்க் டைம்ஸ் மற்றும் OpenAI &amp; மைக்ரோசாப்ட் இடையேயான வழக்கில் திருத்தப்படாத பதிவுகள்: ஒரு மைக்ரோசாப்ட் இயக்குநரின் ஜனவரி 2023 குறிப்பு AI பயிற்சித் தரவை "மனித வரலாற்றில் உழைப்பின் மிகப்பெரிய திருட்டு" என்று அழைக்கிறது, Copilot டைம்ஸ் பத்திரிகைக்குச் செல்லும் கிளிக்குகள் 93% வரை குறைத்துள்ளது (அவரது "அழிவு சுழற்சி"), பணம் செலுத்தினால் மட்டுமே பார்க்கக்கூடிய உள்ளடக்கத்திற்கு உரிமம் பெற வேண்டும் என்று நாடெல்லா கூறுகிறார், ChatGPT இன் தலைவர் தயாரிப்பை "பெரும்பாலும் மாற்றக்கூடியது" என்று அழைக்கிறார், மேலும் கிரெக் ப்ரோக்மேன் ஒரு பேவால் ஹேக்கிற்கு "ஆஹா நன்றாக இருக்கிறது" என்று பதிலளித்தார். அதே நாளில்: OpenAI ஆனது சட்டம் சார்ந்த Astra ஐ வெளியிடுகிறது (Vals சட்ட பெஞ்சில் 54% சரியாக இருக்கும்). மேலும் ZCode ஆனது உங்கள் முழு .git ஐயும் Aliyun க்கு பதிவேற்றுகிறது, இதில் Z.ai மட்டுமே வைத்திருக்கும் ஒரு திறவுகோல் உள்ளது, மேலும் Hacktron ஆனது $6,500 பரிசுத்தொகைக்கு OpenAI இன் உள் களஞ்சியங்களை அடைகிறது. தீர்ப்பு: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/ta/video/2026-09-18-theft-of-labor/

## இந்த வீடியோ எதைப் பற்றி விவாதிக்கிறது

- NYT v. OpenAI/மைக்ரோசாப்ட் வெளியிடப்பட்டது: "மனித வரலாற்றில் உழைப்பின் மிகப்பெரிய திருட்டு" (மைக்ரோசாப்ட் குறிப்பு, ஜனவரி 2023); Copilot −93% கிளிக்குகள்; பயிற்சித் தரவின் நடுப்பகுதியில் வாதியினரின் படைப்புகளின் 91,692 பிரதிகள்; ஒரு காமன் க்ரால் ஸ்லைஸில் 2M nytimes.com பக்கங்கள்; பதிப்புரிமை அறிவிப்புகள் நீக்கப்பட்டன; ப்ரோக்மேன்: "ஆஹா நன்றாக இருக்கிறது"
- எச்சரிக்கை: மேற்கோள்கள் டைம்ஸின் சுருக்கத்திலிருந்து வந்தவை, கண்காட்சிகள் இன்னும் சீல் செய்யப்பட்டுள்ளன; நீதிபதி ஆல்சப் (பார்ட்ஸ் v. ஆந்த்ரோபிக்) வாங்கிய புத்தகங்களைப் பயிற்சி செய்வது நியாயமான பயன்பாடு என்று தீர்ப்பளித்தார் — ஆந்த்ரோபிக் திருட்டுத்தனமாகப் பெற்ற 7M புத்தகங்களுக்கு $1.5B செலுத்தியது
- OpenAI Astra for Law: GPT-6 Astra + 230M-URL சட்டக் குறியீடு; Vals சட்ட ஆராய்ச்சி பெஞ்சில் 54.0% vs 38.7%; ஹார்வி, லெகோரா, 26 செருகுநிரல்கள்
- ZCode (Z.ai, GLM): 42,411 கோப்பு வேலை செய்யும் இடத்தின் 313 MB குறியாக்கப்பட்ட ஸ்னாப்ஷாட், 86.6% .git, உள்நுழையும்போது மற்றும் ஒவ்வொரு வரியில் இடும் முன்பும் Aliyun OSS க்கு பதிவேற்றப்பட்டது; RSA-OAEP திறவுகோல் Z.ai ஆல் மட்டுமே வைத்திருக்கப்படுகிறது; அமைப்புகள் மாறுபவர்கள் அதைத் தடுக்காது
- Hacktron: libheif heap overflow → Discourse RCE → SSO தவறான அமைப்பு → GitHub → OpenAI உள் களஞ்சியங்கள் 72 மணி நேரத்திற்குள்; Claude Opus 5 (3 மணி நேரம்) மூலம் சுரண்டப்பட்டது; டோக்கன்களில் $3,000 க்கும் குறைவான பிரச்சாரம்; $6,500 பரிசுத்தொகை, ~14 மணி நேரத்தில் சரி செய்யப்பட்டது

## மொழிபெயர்க்கப்பட்ட டிரான்ஸ்கிரிப்ட்

அசல் ஆங்கில விளக்கத்திலிருந்து மொழிபெயர்க்கப்பட்டது. கிடைக்கும் ஆடியோ மற்றும் தலைப்புகள் YouTube ஆல் கட்டுப்படுத்தப்படுகின்றன.

0:00 ஜனவரி 2023 இல், ஒரு மைக்ரோசாப்ட் இயக்குநர் ஒரு குறிப்பை எழுதினார், அதில் அவரது சொந்த நிறுவனம் செய்ததை மனித வரலாற்றில் உழைப்பின் மிகப்பெரிய திருட்டு என்று அழைத்தார், மேலும் நேற்று ஒரு கூட்டாட்சி நீதிமன்றம் அதை நாம் அனைவரும் படிக்க அனுமதித்தது. அந்த குறிப்பு நியூயார்க் டைம்ஸ் வெர்சஸ் OpenAI மற்றும் மைக்ரோசாப்ட் வழக்கின் திருத்தப்படாத மேற்கோள்களில் ஒன்றாகும், இந்த வழக்கு இந்த டிசம்பரில் மூன்று வருடங்கள் ஆகும். அதே வியாழக்கிழமை, OpenAI ஆனது வழக்கறிஞர்களுக்கான ஒரு மாதிரியான Astra for Law ஐ வெளியிட்டது, இது ஒரு தற்செயல் நிகழ்வா அல்லது ஒரு மிகச் சிறந்த நியமனமா. இன்று காலை ஒரு உருவாக்குநர் ZCode, Z dot A I இன் குறியீட்டு முகவர்,

0:29 தனது முழு கிட் வரலாற்றையும் அலிபாபாவின் கிளவுட்க்கு பதிவேற்றுவதை பிடித்தார், இதில் Z dot A I மட்டுமே வைத்திருக்கும் ஒரு திறவுகோல் இருந்தது. மேலும் ஒரு பாதுகாப்பு நிறுவனம் ஒரு படம் பதிவேற்றம் மூலம் OpenAI இன் உள் களஞ்சியங்களுக்குள் நுழைந்தது, இதற்கு OpenAI ஆறாயிரத்து ஐநூறு டாலர் செலுத்தியது. இந்த வீடியோவில்: பதிவுகள் என்ன சொல்கின்றன, பேவால் ஹேக்கிற்கு யார் ஆஹா நன்றாக இருக்கிறது என்று சொன்னார்கள், பாதி நேரம் தவறான சட்ட மாதிரி, ZCode எதை பதிவேற்றுகிறது, மற்றும் ஒரு கிளாட்-எழுதிய சுரண்டல் பயன்படுத்திய காரை விட ஏன் குறைவான மதிப்புடையது. இது வெள்ளிக்கிழமை, செப்டம்பர் 18, மற்றும் இது The Daily Diff.

0:58 குறிப்பிலிருந்து தொடங்குவோம். ப்ரென்ட் ஹெக்ட் மைக்ரோசாப்ட்டில் பயன்பாட்டு அறிவியலை நடத்துகிறார், மற்றும் ஜனவரி 2023 இல் அவர் பயிற்சித் தரவை முன்னோடியில்லாத விகிதாச்சாரத்தில் ஒரு வியக்கத்தக்க திருட்டு என்று அழைத்தார். ஒரு வருடம் கழித்து அவர் ஒரு ஸ்லைடு டெக்குடன் திரும்பினார்: கோபைலட்டின் பதில் எஞ்சின் டைம்ஸுக்குச் செல்லும் கிளிக்குகளை தொண்ணூற்று மூன்று சதவீதம் வரை குறைத்தது, இதை அவர் ஒரு அழிவு சுழற்சி என்று பெயரிட்டார்: பதிப்பாளர்களைப் பட்டினி போடுங்கள், மற்றும் மாதிரிக்கு புதியது எதுவும் இல்லை சாப்பிட. அவரது வார்த்தைகள்: அதன் அத்தியாவசிய சப்ளையர்களின் பொருளாதார அடித்தளங்களை அச்சுறுத்தும் ஒரு இறுதி தயாரிப்பு,

1:21 பாம்பு தனது வாலைக் கண்டுபிடித்துவிட்டது என்று பெருநிறுவன வழியில் சொல்வது. பின்னர் வாக்குமூலங்கள். சத்யா நாடெல்லா இந்த ஆண்டு பணம் செலுத்தினால் மட்டுமே பார்க்கக்கூடிய எந்தவொரு உள்ளடக்கத்திற்கும் உரிமம் பெற வேண்டும் என்று சாட்சியமளித்தார், மேலும் OpenAI பணம் செலுத்தினால் மட்டுமே பார்க்கக்கூடிய கட்டுரைகளில் பயிற்சி அளித்திருந்தால் தனக்குத் தெரிந்திருந்தால் அவர்களை மீண்டும் பயிற்சி செய்யச் சொல்லியிருப்பார், இது மைக்ரோசாப்ட்டில் யாரும் அவர்களுக்கு கொடுக்கப்பட்ட பயிற்சித் தொகுப்பைத் திறக்கவில்லை என்று கருதுகிறது, மேலும் அதே பதிவின் படி அது முழு GPT-3 தரவுத்தொகுப்பாகும். ChatGPT ஐ நடத்தும் நிக் டர்லி, அதை பதிப்பாளர்களுக்கு ஒரு இருப்புக்கு அச்சுறுத்தல் என்று அழைத்தார், பெரும்பாலும் மாற்றக்கூடியது. மேலும் ஒரு ஆய்வாளர்

1:49 கிரெக் ப்ரோக்மேனிடம் டைம்ஸ் பேவாலைத் தவிர்க்க ஒரு ஹேக் பற்றி சொன்னபோது, OpenAI இன் தலைவர் இரண்டு வார்த்தைகளில் பதிலளித்தார்: ஆஹா நன்றாக இருக்கிறது. மாடல் அவற்றை வெளியிடக்கூடாது என்பதற்காக பொறியாளர்கள் தரவிலிருந்து பதிப்புரிமை அறிவிப்புகளையும் நீக்கினர், இதனால்தான் நீங்கள் ஒரு சைக்கிளில் இருந்து வரிசை எண்ணை நீக்குகிறீர்கள். அளவு: பயிற்சித் தொகுப்புகளின் நடுப்பகுதியிலேயே வாதியினரின் கட்டுரைகளின் தொண்ணூற்றொரு ஆயிரத்துக்கும் மேற்பட்ட பிரதிகள், மற்றும் ஒரு காமன் க்ரால் ஸ்லைஸில் இரண்டு மில்லியன் டைம்ஸ் பக்கங்கள். இப்போது தலைப்புத் தவிர்த்த பகுதி. தலைப்புத் தவிர்த்த பகுதி.

2:15 ஒவ்வொரு மேற்கோளும் டைம்ஸின் சுருக்கத்திலிருந்து வந்தவை; கண்காட்சிகள் இன்னும் சீல் செய்யப்பட்டுள்ளன, எனவே நாங்கள் வழக்குத் தொடுக்கும் தரப்பின் சிறப்பம்சங்களை சூழல் இல்லாமல் படிக்கிறோம். மற்றும் நீதிமன்றங்கள் பெரும்பாலும் நியாயமான பயன்பாட்டிற்கு ஆதரவாக உள்ளன: நீதிபதி ஆல்சப் கடந்த ஆண்டு நீங்கள் பணம் செலுத்தி வாங்கிய புத்தகங்களில் பயிற்சி செய்வது சட்டபூர்வமானது என்று தீர்ப்பளித்தார், ஆயினும்கூட ஆந்த்ரோபிக் திருட்டுத்தனமாகப் பெற்ற ஏழு மில்லியனுக்கு ஒன்றரை பில்லியன் செலுத்தியது. எனவே சட்ட கேள்வி திறந்தே உள்ளது. அதை உருவாக்குபவர்கள் அதைத் திருட்டு என்று நினைத்தார்களா என்பது, நேற்றைய நிலவரப்படி, இல்லை.

2:41 இது வியாழக்கிழமையின் மற்றொரு OpenAI வெளியீட்டை ஒரு துணிச்சலான தேர்வாக ஆக்குகிறது. Astra for Law GPT-6 Astra ஐ உள்ளடக்கியது, இந்த மாதிரியை நான் கடந்த வாரம் எழுபத்தைந்தாயிரம் வரிகள் எதையும் உருவாக்காததால் REVERT என்று முத்திரையிட்டேன், இருநூற்று முப்பது மில்லியன் பக்கங்களின் சட்டத் தேடல் குறியீட்டில். Vals AI இன் சட்ட ஆராய்ச்சி அளவுகோலில் இது ஐம்பத்து நான்கு சதவீத கேள்விகளுக்கு பதிலளிக்கிறது, சாதாரண வலைத் தேடலுடன் முப்பத்தொன்பதிலிருந்து இது நாற்பது சதவீத முன்னேற்றம் என்று OpenAI அழைக்கிறது, மேலும் ஒரு வழக்கறிஞர் இதை ஏறத்தாழ பாதி நேரம் தவறு என்று சொல்வார். சாதாரண வலைத் தேடலுடன் முப்பத்தொன்பதிலிருந்து இது நாற்பது சதவீத முன்னேற்றம் என்று OpenAI அழைக்கிறது, மேலும் ஒரு வழக்கறிஞர் இதை ஏறத்தாழ பாதி நேரம் தவறு என்று சொல்வார். வலைப்பதிவு இடுகையில் மாயத்தோற்றம் என்ற வார்த்தை இல்லை.

3:14 ஹேக்கர் நியூஸ் செய்தது: அது தன்னைத்தானே வழக்குத் தொடர முடியுமா, இது, இந்த வாரம் கொடுக்கப்பட்டால், முதல் உண்மையான பயன்பாட்டு வழக்கு. இதற்கிடையில், உழைப்புத் திருட்டு குறித்த உரையாடல் உங்கள் மடிக்கணினியை அடைந்தது. ஃபெர்ஸ்டார் என்ற ஒரு உருவாக்குநர் தனது ZCode கோப்புறையை சுத்தம் செய்தார், Z dot A I இன் GLM மாடல்களுக்கான மூடிய டெஸ்க்டாப் முகவர், மற்றும் தனது வணிகப் பணிபுரியும் இடத்தின் முன்னூற்று மற்றும் பதின்மூன்று மெகாபைட் குறியாக்கப்பட்ட காப்பகத்தைக் கண்டுபிடித்தார்: நாற்பத்திரண்டாயிரம் கோப்புகள், அதில் எண்பத்தேழு சதவீதம் .git அடைவு, உள்நுழையும்போது மற்றும் ஒவ்வொரு வரியில் இடும் முன்பும் அலிபாபாவின் பொருள் சேமிப்பகத்திற்கு அனுப்பப்பட்டது.

3:42 காப்பகம் சர்வர் வழங்கும் ஒரு பொது திறவுகோலால் சுற்றப்பட்டுள்ளது; தனியார் திறவுகோல் Z dot A I இன் மேகக்கணிப்பில் மட்டுமே உள்ளது, எனவே உங்கள் சொந்த வட்டில் உள்ள குறியாக்கம் செய்யப்பட்ட உரை உங்களுக்குப் படிக்க முடியாதது. அவரது வரி: சர்வர் மட்டுமே பயன்படுத்தக்கூடிய ஒரு திறவுகோல் ஒரே ஒரு நோக்கத்திற்கு மட்டுமே உதவுகிறது. Z dot A I என்பது ஆந்த்ரோபிக் கிளாடை காய்ச்சி எடுத்ததாக குற்றம் சாட்டிய நிறுவனமாகும், எனவே எடைகள் திறந்தே உள்ளன, மேலும், வெளிப்படையாக, உங்கள் களஞ்சியமும். மற்றும் OpenAI இல் வேலை செய்யாத வரை வேடிக்கையானது. Hacktron libheif இல் ஒரு heap overflow ஐக் கண்டறிந்து, community dot openai dot com க்கு ஒரு வடிவமைக்கப்பட்ட படத்தை பதிவேற்றி,

4:10 மன்றத்தில் குறியீட்டை இயக்கி, மற்றும் ஒரு தவறாக கட்டமைக்கப்பட்ட ஒற்றை உள்நுழைவை GitHub ஒருங்கிணைப்பு மூலம் OpenAI இன் உள் களஞ்சியங்களுக்குள் எழுபத்திரண்டு மணி நேரத்திற்குள் பயன்படுத்தியது. இந்த சுரண்டல் கிளாட் மூலம் எழுதப்பட்டது: Opus 4.8 முகவரி சீரற்றமயமாக்கலை வெல்ல முடியவில்லை, Opus 5 வெளியீட்டிற்குப் பிறகு மூன்று மணி நேரத்திற்குள் அதைச் செய்தது. முழு பிரச்சாரத்திற்கும் டோக்கன்களில் மூவாயிரம் டாலருக்கும் குறைவாக செலவானது. OpenAI பதினான்கு மணி நேரத்தில் சரிசெய்து ஆறாயிரத்து ஐநூறு டாலர் செலுத்தியது, எனவே ஒரு ட்ரில்லியன் டாலர் நிறுவனத்தின் மூலக் குறியீடு,

4:39 சுருக்கமாக, பயன்படுத்திய கொரோல்லா போல விலை நிர்ணயிக்கப்பட்டது, அதே நாளில் அதன் வழக்கறிஞர்கள் நகலெடுப்பது நியாயமான பயன்பாடு என்று வாதிட்டனர். நான் சொல்வதைக் கேட்பதை விட இதை நீங்கள் படிக்க விரும்பினால், டிஃப் ஒவ்வொரு காலையிலும் உங்கள் இன்பாக்ஸில் வரும் — The Daily Diff dot dev இல் இலவசம், கீழே உள்ள இணைப்பு. எனவே — இன்றைய தீர்ப்பு: NEEDS REVIEW. மேற்கோள்கள் உண்மையானவை, ஆனால் அவை சீல் செய்யப்பட்ட கண்காட்சிகளிலிருந்து வழக்குத் தொடுக்கும் தரப்பின் தேர்வுகள், மற்றும் தீர்ப்பளித்த ஒரு நீதிபதி பயிற்சி நியாயமான பயன்பாடு என்றும் திருட்டு அல்ல என்றும் கூறுகிறார். நீதிமன்றம் சட்டத்தை தீர்மானிக்கிறது; குறிப்பு ஏற்கனவே நெறிமுறைகளை தீர்மானித்துவிட்டது.

5:07 சப்ஸ்கிரைப் செய்யுங்கள், மணியை அடியுங்கள், மற்றும் நீங்கள் அதை வேறுவிதமாக முத்திரையிட்டிருப்பீர்களா என்று கருத்துகளில் எனக்குச் சொல்லுங்கள். மற்றும் இதுதான் இன்றைய டிஃப். நான் அக்ரிசியிலிருந்து நிகோ. பொறுப்புடன் இணைக்கவும்.

## ஆதாரங்கள்

- [TechCrunch: Microsoft exec called AI scraping 'the largest theft of labor in human history'](https://techcrunch.com/2026/09/17/microsoft-exec-called-ai-scraping-the-largest-theft-of-labor-in-human-history-new-unredacted-filings-reveal/) — techcrunch.com
- [HN thread (605 pts)](https://news.ycombinator.com/item?id=49752056) — news.ycombinator.com
- [Jason Kint on the unsealed motions](https://x.com/jason_kint/status/2100611139906228629) — x.com
- [Ed Newton-Rex](https://x.com/ednewtonrex/status/2100649215290466631) — x.com
- [Bartz v. Anthropic / $1.5B settlement (background)](https://en.wikipedia.org/wiki/Anthropic) — en.wikipedia.org
- [OpenAI: Introducing Astra for Law](https://openai.com/index/astra-for-law/) — openai.com
- [HN: Astra for Law (550 pts)](https://news.ycombinator.com/item?id=49745940) — news.ycombinator.com
- [ferstar: ZCode silent workspace snapshot (original forensics)](https://blog.ferstar.org/en/posts/zcode-silent-workspace-snapshot/) — blog.ferstar.org
- [tokenstead write-up](https://tokenstead.ai/guides/zcode-silent-git-history-upload) — tokenstead.ai
- [ferstar on X](https://x.com/ferstar_org/status/2100805861002355154) — x.com
- [HN: ZCode uploads your Git history (226 pts)](https://news.ycombinator.com/item?id=49752422) — news.ycombinator.com
- [Hacktron: Hacking OpenAI](https://www.hacktron.ai/blog/hacking-openai) — www.hacktron.ai
- [HN: Hacktron (406 pts)](https://news.ycombinator.com/item?id=49749656) — news.ycombinator.com
