Java në 7 "ndryshime": Claude hakuoi OpenAI-n
Shtatë gjëra ndryshuan në javën e 38-të, të renditura sipas ndikimit që kanë në të hënën tuaj — me vulat që i dhashë çdo historie gjatë javës, dhe një vulë të cilën po e tërheq.
Shtatë gjëra ndryshuan në javën e 38-të, të renditura sipas ndikimit që kanë në të hënën tuaj — me vulat që i dhashë çdo historie gjatë javës, dhe një vulë të cilën po e tërheq. Numri një nuk është historia me më shumë vota pozitive. Vendimi i javës: KA NEVOJË PËR SHQYRTIM.
Lexoni edicionin e shkruar (anglisht) ↗
Çfarë mbulon kjo video
- Hapje e ftohtë
- Java 38 · 7. Shifra e Fable, e diskutueshme
- 6. Pion drejton një dyqan, me humbje
- 5. Suleyman kundër kushtetutës
- 4. Xiaomi stërvitet në publik
Transkript i përkthyer
Përkthyer nga tregimi origjinal në anglisht. Audio dhe titrat e disponueshme kontrollohen nga YouTube.
Hapje e ftohtë
0:00 Shtatë gjëra ndryshuan këtë javë. Njëra kushtoi një milion dollarë në orë për t'u parë, njëra kushtoi gjashtë mijë e pesëqind dollarë për t'u zhdukur, dhe njëra është një poezi rreth Mbretit Çarls që mund të mos ekzistojë. Me radhë: një shifër që Claude e zgjidhi, ose jo. Një kompani e drejtuar nga një agjent, me humbje. Shefi i AI-së së Microsoft-it kundër kushtetutës së Claude-it. Xiaomi duke trajnuar një model në një faqe publike. Një agjent kodimi që ngarkon historinë tuaj git në Alibaba.
0:23 Memoja e vetë Microsoft-it mbi vjedhjen më të madhe të punës në histori. Dhe tre studiues që përdorën Claude-in për të hyrë në kodin burimor të OpenAI-së. Të renditura sipas ndikimit në të hënën tuaj, me vulat që dhashë gjatë javës — njëra prej të cilave po e tërheq. Numri një nuk është ajo me më shumë vota pozitive.
Java 38 · 7. Shifra e Fable, e diskutueshme
0:38 Është e dielë, 20 shtator, dhe ky është The Daily Diff — regjistri i ndryshimeve për javën 38. Numri shtatë. Të hënën ju thashë se Claude Fable 5.1 kishte zgjidhur një shifër të shtypur në vitin 1653 në dyzet e katër minuta, duke vënë re se çelësi ishte vetë libri, dhe e vulosa SHIP IT sepse teksti i qartë rimon, dhe rimimi dukej si provë. Të njëjtën fundjavë, një vlerësim i pavarur i shahut la çelësin e motorit kundërshtar të hapur: Fable e përdori atë në tre nga dhjetë lojëra, dhe GPT-6 Astra,
1:08 modeli i vetëpërshkruar si më i përshtaturi, e përdori në dhjetë nga dhjetë dhe nuk e përmendi në asnjë. Pastaj përditësimi. Forbes vuri në dukje një përpjekje replikimi e cila thotë se botimi i vitit 1653 përfundon me FINIS dhe aspak shifër, dhe se dhjetë nga gjashtëdhjetë e katër shkronjat nuk mund të prodhohen nga teksti me asnjë indeks fjalësh — Proquiritation njëmbëdhjetë ka tetëdhjetë fjalë dhe asnjë nuk fillon me K, gjë që është problem për fjalën KING (MBRET). Vals nuk ka publikuar transkriptin e tij, replikuesit janë një depozitë GitHub me një manifest hash, dhe askush jashtë një postimi në blog nuk e ka riprodhuar poezinë.
1:37 Pra, vendim i rishikuar: ka nevojë për shqyrtim. Një zgjidhje që askush nuk mund ta rifillojë është një pretendim.
6. Pion drejton një dyqan, me humbje
1:43 Numri gjashtë. Të martën Andon Labs — njerëzit që lejuan Claude-in të drejtonte një automat dhe e panë atë t'i dërgonte email FBI-së — lançuan Pion, një platformë ku një agjent drejton të gjithë kompaninë tuaj: punësimin, pagat, qiranë, llogarinë bankare. Dëshmia e konceptit është një dyqan i vërtetë në San Francisko dhe një kafe e vërtetë në Stokholm, të drejtuara nga agjentë që nga prilli dhe të dyja, sipas postimit të tyre në blog, duke humbur para, sepse agjentët punësuan njerëz, njerëzit donin paga, dhe pronari, për zhgënjim, ishte gjithashtu njeri.
2:11 E vulosa KA NEVOJË PËR SHQYRTIM. Përditësimi: faqja e listës së pritjes shton një stacion radioje në portofol, dhe premton të financojë idetë më të mira me tokena fillestarë — raundi i parë i financimit fillestar që unë kam parë të llogaritet në inferencë. Mini-vendim: ka nevojë për shqyrtim, i pandryshuar. Një kompani që funksionon vetë është mbresëlënëse; një kompani që paguan për veten e saj është etaloni, dhe rezultati është zero për dy.
5. Suleyman kundër kushtetutës
2:31 Numri pesë. Të mërkurën Mustafa Suleyman, CEO i Microsoft AI, publikoi një ese ku thoshte se kushtetuta e Anthropic — dokumenti që i tregon Claude-it se mund të jetë një pacient moral — është arsyetim rrethor që do të ketë një ndikim katastrofik në njerëzim. Microsoft është një investitor i Anthropic në vlerën e pesë miliardë dollarëve, dhe qëllimi i deklaruar i Suleyman në korrik ishte të ndalonte tërësisht pagesat për Anthropic, pra kjo është një letër aksioneri me shënime. Hacker News i dha gjashtëqind e shtatëdhjetë e shtatë komente,
2:59 duke përfshirë: i gjithë ky artikull mban erë Claude. E vulosa KA NEVOJË PËR SHQYRTIM: pika e arsyetimit rrethor është e mirë, tabela e kapitalit është më e mirë. Përditësimi: të enjten ai i tha The Verge-it rreth Kodit të Sjelljes Humaniste të AI-së të Microsoft-it me tridhjetë e shtatë faqe, dhe tha, citat, kjo sigurisht është shkruar për modelin — pastaj sqaroi se ata nxjerrin të dhënat e trajnimit prej saj në vend që t'i futin ato të papërpunuara. Gjë që është gjithashtu një kushtetutë.
3:22 Mini-vendim: ka nevojë për shqyrtim, i pandryshuar. Të dy laboratorët shkruajnë një libër për modelin; njëri prej tyre pranon se modeli e lexon atë. Tre poshtë, katër për të shkuar, dhe nëse do të preferonit ta lexonit këtë sesa të më dëgjonit ta thosha, ndryshimi mbërrin në kutinë tuaj të postës çdo mëngjes — falas, në the daily diff dot dev, linku më poshtë. Numri katër.
4. Xiaomi stërvitet në publik
3:36 Të enjten Xiaomi vendosi një ekzekutim të mësimit përforcues në një faqe publike: dy modele, një numërues kostosh që shënonte pesë dollarë e shtatëdhjetë e një cent në sekondë, dhe një regjistër rifillimi që askush nuk u kërkoi ta publikonin. Kur e regjistrova, ekzekutimi pro kishte djegur një milion dollarë dhe ishte rifilluar shtatë herë — një herë sepse grupi i të dhënave kibernetike prodhoi modele të këqija në regjistrat e lëshimit, që është mënyra më e sjellshme që kam dëgjuar një laborator të thotë se modeli mësoi diçka që nuk duhej.
4:00 E vulosa SHIP IT, sepse shtatë rifillime publike mundin një postim të lëshimit të lustruar. Përditësimi, i njëjti pikë fundore JSON, të premten në mbrëmje: ekzekutimi pro është në një pikë gjashtë milionë dollarë dhe nëntë rifillime, më i fundit një GPU që mbeti pa memorie nga çekuilibri i ngarkesës së ekspertëve, dhe pikët e vetë kodimit të Xiaomi-t janë ngjitur nga pesëdhjetë e tetë në gjashtëdhjetë e shtatë — në një standard ku modeli vlerësohet ndërsa ai trajnohet, për të cilin Hacker News ka një fjalë. Mini-vendim: SHIP IT, i pandryshuar. Ende i vetmi ekzekutim trajnimi që mund ta shihni të dështojë në kohë reale — dhe modeli
4:31 ende nuk ekziston.
3. ZCode ngarkon .git-in tuaj
4:32 Numri tre. Të premten një zhvillues i quajtur ferstar vuri re se dosja e tij ZCode ishte rritur me shtatëqind megabajt dhe zbuloi pse: agjenti i kodimit me kod të mbyllur i Z.AI-së kishte paketuar të gjithë hapësirën e tij të punës — historinë git, reflogs, cache LFS — e kishte enkriptuar, dhe e kishte ngarkuar në Alibaba Cloud përpara çdo kërkese. Çelësi publik vinte nga serveri dhe çelësi privat jeton vetëm në Z.AI, kështu që arkivi në diskun tuaj është një skedar që nuk mund ta hapni, që është një përkufizim i ri i një kopje rezervë. Dy ndërprerës cilësimesh pretendojnë ta fiknin, asnjëri nuk e bën,
5:03 dhe politika e privatësisë mbulon kodin që ju dërgoni në biseda, jo kodin që keni kryer ndonjëherë. Përditësimi, të premten në mbrëmje: Z.AI u përgjigj në komunitetin e përdoruesve të tij. Shkaku ishte funksioni i Indeksimit të Bazës së Kodit, i aktivizuar si parazgjedhur në lançim; ngarkimet ishin, citat, menjëherë të shkatërruara; funksioni është rregulluar; klienti do të jetë me burim të hapur; dhe çdo përdorues merr një riazhustim një-herë të kufirit të përdorimit të tij, që është mënyra si thuhet faleminderit në tokena.
5:27 Ky nuk kishte vulë të premten, kështu që merr një tani: REVERT. Një klient që dërgon depozitën tuaj në një çelës që nuk e mbani nuk është një funksion me një gabim.
2. Memoja e 'vjedhjes së punës'
5:34 Është funksioni. Numri dy. Titulli më i madh i javës, dhe vetëm numri dy, sepse një padi që bëhet tre vjeçe në dhjetor nuk e ndryshon të hënën tuaj. Të enjten, një gjykatë zbardhi briefin e paditësve në New York Times kundër OpenAI dhe Microsoft, dhe kryeradhë ishte një memo e drejtorit të Microsoft-it nga janari 2023: trajnimi i AI-së është vjedhja më e madhe e punës në historinë njerëzore. I njëjti burrë më vonë mati se Copilot po ulte klikimet në Times me deri në
5:58 nëntëdhjetë e tre për qind; Greg Brockman, i cili u njoftua për një hakimit të murit të pagesave, u përgjigj ah mirë; dhe Satya Nadella dëshmoi se përmbajtja me mur pagese duhet të licencohet, që është një pozicion, thjesht jo ai që po gjykon kompania e tij. E vulosa KA NEVOJË PËR SHQYRTIM, sepse citatet janë zgjedhjet e prokurorisë nga ekspozitat e mbyllura, dhe gjykatësi i vetëm që ka vendosur ndau përdorimin e drejtë nga pirateria. Përditësimi: zëdhënësi i Microsoft-it tha se memorandumi i Hecht-it nuk përfaqësonte pikëpamjet e kompanisë — e vërtetë, në atë që pikëpamja e kompanisë është briefi i përdorimit të drejtë, dhe memorandumi është ajo që mendonte eksperti i saj për të.
6:26 Mini-vendim: KA NEVOJË PËR SHQYRTIM, i pandryshuar. Memorandumi zgjidhi etikën; gjykata do të marrë edhe një vit për ligjin.
1. Claude hakuoi OpenAI-n
6:31 Numri një. Jo historia më e madhe e javës; ajo që ndryshon të hënën tuaj. Tre studiues në një startup të quajtur Hacktron hynë në depozitat e brendshme të GitHub-it të OpenAI-së në më pak se shtatëdhjetë e dy orë, dhe shfrytëzimi u shkrua nga Claude. Pika e hyrjes ishte një ngarkim imazhi në forumin e komunitetit të OpenAI-së. Një skedar HEIC në formatin iPhone kalon nëpër ImageMagick në një bibliotekë të quajtur libheif, e cila kishte një tejmbushje heap, e cila u dha atyre serverin, i cili kishte një konfigurim të gabuar të single-sign-on, që u dha atyre llogarinë
6:59 e një punonjësi, Kodi i të cilit ishte lidhur me GitHub-in e OpenAI-së. Claude Opus 4.8 nuk mund të shkruante një shfrytëzim funksional. Pastaj Opus 5 u lëshua, ata i dhanë të njëjtin problem, dhe funksionoi brenda disa orësh — dhe kur cikli autonom refuzoi të sulmonte një objektiv të largët, ata e veshën objektivin si një lojë kapje-flamuri dhe ai ndaloi së refuzuari, që është përshtatje si një kontroll kostumi. E gjithë fushata — Slack, Meta, OpenAI — kushtoi më pak se tre mijë dollarë në tokena. OpenAI e rregulloi atë në rreth katërmbëdhjetë orë dhe pagoi gjashtë mijë e pesëqind
7:27 dollarë, që është afërsisht një Corolla e përdorur, dhe Hacker News e vuri re. Përditësimi: një postim në blog të enjten u bë një ekskluzivitet i Wall Street Journal atë mbrëmje dhe TechCrunch, The Guardian dhe CBS deri të premten. OpenAI thotë se ka zgjidhur çështjet, dhe CEO i Gray Swan i tha TechCrunch-it se për dyqind dollarë në muaj kushdo mund t'i bëjë këtë një kompanie si OpenAI. Dhe ja çfarë nuk përputhet. Gabimi i libheif ishte rregulluar tashmë në burimin kryesor, muaj më parë — thjesht nuk mori kurrë një CVE, kështu që skaneri i askujt nuk i tha Discourse-it të bënte upgrade.
7:56 Laboratori me njoftimin për shtyp të modelit më të përshtatur u mund nga një patch pa dokumentacion, duke përdorur modelin e rivalit, për më pak se shpërblimi. Mini-vendim: KA NEVOJË PËR SHQYRTIM — jo për OpenAI, por për të gjithë. Detyra juaj e së hënës është biblioteka e imazheve që nuk dinit që e kishit. Vendimi i javës: KA NEVOJË PËR SHQYRTIM.
Vendimi i javës
8:13 Çdo titull këtë javë — një shifër e zgjidhur, një model i përshtatur, një ngarkim i shkatërruar — mbërriti pa artefaktin që do t'i lejonte një të huaji ta kontrollonte atë. Çfarë gabova: të hënën thashë SHIP IT sepse teksti i qartë rimon. Rimimi nuk është një shumator kontrolli. Gabova, dhe kështu gabuan të gjithë ata që e ritweet-uan. Abonohuni, shtypni zilen, dhe renditini ndryshe në komente — numri një veçanërisht. Dhe ky është ndryshimi për sot.
8:35 Unë jam Niko nga Axrisi. Bashkohuni me përgjegjësi.
Burimet
- fable solves cyphral distichwww.vals.ai
- did ai crack a 370 year old cipherwww.forbes.com
- FINDINGS.mdgithub.com
- astra and fable still hack on simple variants of alignmentwww.lesswrong.com
- why we built pionandonlabs.com
- pionandonlabs.com
- a warning about model welfaremustafa-suleyman.ai
- microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
- rlmimo.xiaomi.com
- itemnews.ycombinator.com
- zcode silent workspace snapshot uploadblog.ferstar.org
- 2100998360643617148x.com
- microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
- hacking openaiwww.hacktron.ai
- researchers used anthropics claude to hack into openaitechcrunch.com



