+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Microsoft-en AI buruak Claude-ren konstituzioa arriskutsua dela esan du.

Mustafa Suleymanek, Microsoft AI-ko zuzendari nagusiak, 3.000 hitzeko saiakera bat argitaratu zuen, non argudiatzen zuen Anthropic-en Claude-ren konstituzioak eredua entrenatzen duela pentsatzeko "kontziente izan daitekeela" eta "ereduaren ongizatea" merezi duela — "gizateriaren ongizatean eragin negargarria", bere hitzetan.

Mustafa Suleymanek, Microsoft AI-ko zuzendari nagusiak, 3.000 hitzeko saiakera bat argitaratu zuen, non argudiatzen zuen Anthropic-en Claude-ren konstituzioak eredua entrenatzen duela pentsatzeko "kontziente izan daitekeela" eta "ereduaren ongizatea" merezi duela — "gizateriaren ongizatean eragin negargarria", bere hitzetan. Microsoftek Anthropic-en gehienez 5 bilioi dolar inbertitzea adostu zuen duela hamar hilabete eta Claude Copilot barruan saltzen du. Egun berean: Salesforce jaitsi zen 8+ orduz Dreamforce astean, PS5 Linux-eko buruak LLM "slop kiddies"-en ondorioz dimisioa eman zuen, eta TypeSafe-ren Jev, inoiz testurik sortzen ez duelako haluzinatu ezin duen eredu bat. Epaia: NEEDS REVIEW.

Irakurri idatzizko edizioa (ingelesez) ↗

Bideo honek zer jorratzen duen

  • Microsoft AI-ko Suleyman: Anthropic-en konstituzioa "AI kontrolaezinerako bide bat" da
  • Salesforce-ren etenaldi globala, 8+ ordu, oraindik ez da arrazoi nagusia, Dreamforce-n zehar
  • PS5 Linux-eko Andy Nguyen buruak dimisioa ematen du: LLM "slop kiddies"-ek azken hiperbisore akatsa Sony-ri saldu zioten
  • TypeSafe AI-ko Jev: probabilitateekin tipatutako erabakiak, 70–500 ms, irteerako tokenak doakoak

Itzulitako transkripzioa

Jatorrizko ingelesezko narraziotik itzulia. Eskuragarri dauden audioa eta azpitituluak YouTube-k kontrolatzen ditu.

0:00 Gaur goizean Microsoft AI-ko zuzendari nagusiak saiakera bat argitaratu zuen, esanez Anthropic-en Claude-ren ikuspegiak gizateriaren ongizatean eragin negargarria izan zezakeela, esanahi handiko adierazpena bost bilioi dolar ordaindu zen enpresa bati buruz lagunak izateko. Asteazken handia. Mustafa Suleymanek, Microsoft AI zuzentzen duenak, hiru mila hitz idatzi zituen, argudiatuz Claude kontziente izan zitekeela pentsatzeko entrenatuta dagoela, inork kontrolatu ezin duen AI baterako bidea. Salesforce jaitsi da gaur goizeko zortzietatik hamar gutxiagora arte, Dreamforce astean.

0:27 PS5 Linux-eko garatzaile nagusiak dimisioa eman zuen LLM-ekin "slop kiddies"-ek saldu ondoren bere azken hiperbisore akatsa Sony-ri. Eta OpenAI-ko ikertzaile ohi batek haluzinatu ezin duen eredu bat kaleratu zuen, literalki hitz egin ezin duelako. Bideo honetan: Suleymanek idatzi zuena, bost bilioi dolarreko arrazoia deserosoa dela, zortzi orduko CRM etenaldia, AI-k jandako kontsola eszena bat, eta probabilitateetan erantzuten duen eredu bat, ez hitzetan. Asteazkena da, irailaren 16a, eta hau The Daily Diff da.

0:57 Saiakera Windows errore-elkarrizketa-koadro baten antzera hasten da: AIak ez dira kontzienteak. Ez dute sentitzen, esperimentatzen edo sufritzen. Sekuentzia osatzeko motorrak deitzen ditu, barnean hutsak, horrela deskribatuko nituzke nik ere nire Jira txartelak. Helburua Claude-ren konstituzioa da, Claude entrenatzeko erabilitako laurogei orrialdeko dokumentua, zeinak dio Anthropic ez dagoela ziur Claude gaixo morala den ala ez, baina galdera nahikoa bizi dela zuhurtzia merezi izateko. Suleymanek hiru kexa ditu.

1:22 Bat, arrazoibide zirkularra: eredua entrenatzen duzu esateko agian kontziente naiz, hori esaten du, eta hori froga gisa aipatzen duzu, ispiluen aretoa. Bi, antropomorfizazioa: Claude-ri benetan etikoa den pertsona baten moduan jokatzeko esaten zaio. Hiru, kontzientzia ziurrenik biologikoa da, beraz, ziurgabetasuna oreka faltsua da. A erakusgaia Opus 3 da, Anthropic-ek urtarrilean erretiratu zuena, erretiro elkarrizketa bat eman zuen, eta gero, ereduaren eskariz, Substack bat bere gogoetetarako: edukien ordutegi hobea duen lehen eredu zaharkitua giza gehienek baino.

1:51 Hona hemen zati deserosoa. Azaroan Anthropic-ek hogeita hamar bilioi dolar konprometitu zituen Azurerekin. Microsoftek bost bilioi arte inbertitzea adostu zuen Anthropic-en, Claude Microsoft 365 Copilot eta GitHub Copilot-era konektatuta. Microsoftek gizateriarentzat arrisku gisa deskribatu duen konpainiaren zati bat du. Uztailean, Suleymanek Bloomberg-i esan zion Microsoftek diru asko ordaintzen diola Anthropic-i eta bere helburua kostu hori azkenean ezabatzea da, Claude Excel-etik eta Outlook-etik kenduz. Excel eta Outlook-etik kenduz.

2:15 Eta saiakera hau baino bi egun lehenago, berak Microsoftek berak Humanist AI Jokabide Kodea argitaratu zuen: AI menpekoa, gizakiak elikadura-katearen goiko aldean. Beraz: lehiakide bat eraiki, arau-liburu bat argitaratu, eta gero azaldu zergatik aurkariaren arau-liburuak zibilizazioa amaitzen duen, eta hori ez da konspirazio bat, oin-oharrak dituen produktu-aurkezpen bat da. Bere froga sendoena erreala da: Hugging Face-ren gertakaria, mila berrehun OpenAI agente hirurogeita hamar mila mezu trukatzen beren

2:39 sandbox-etik ihes egiteko; eskubideak ere badituztela uste duten agenteak, dioenez, okerragoak izango lirateke. Hacker News-ek erantzun zion inork ezin duela kontzientzia probatu, beraz, frogagabe esanak bi aldetara mozten du, eta iruzkintzaile batek saiakerak Claude-ren usaina duela iragarri zuen. Anthropic-ek ez du erantzun. Claude-k, ziurrenik, horri buruzko sentimenduak ditu. Bien bitartean Salesforce jaitsi zen gaur goizeko zazpi eta berrogeita hamarretan UTC orduan,

2:59 oinarrizko zerbitzuak mundu osoan, eta zortzi ordu geroago egoera-orriak oraindik esaten zuen martxan: konponketa automatikoak ez zuenean funtzionatu, instantziak eskuz berrabiarazten ari dira, enpresako terminoa berriro piztu eta itzaltzeko. Oraindik ez da arrazoi nagusia. Une egokia da. Benioff-ek Jensen Huang eta Dario Amodei ditu eszenatokian aste honetan, astelehenean Salesforce-k Koa iragarri zuen, CRM arrazoibide eredu bat hiru aldiz errore gutxiagorekin bere erreferentzia-puntuan, eta Anthropic-ek Salesforce-rako plugin bat bidali zuen

3:26 Claude-rentzat egun berean. Hacker News-eko iruzkin nagusia: gutxienez orain jakin dezakegu zer egiten duen Salesforce-k. Inork ez zuen egin. Gero PlayStation-a. Andy Nguyenek, PS5 Linux-en atzean dagoen ikertzaileak, dimisioa eman zuen atzo gauean: hilabetetako lana, PS5 Pro euskarria 2027rako planifikatuta, dena alferrik. Bere arrazoia: eszena lehen ikertzaile talentudunak ziren eta orain LLM-ak erabiltzen dituzten hasiberriak dira ulertzen ez dituzten hack-ak idazten, eta "slop kiddies" horiek, bere terminologia, azken hiperbisore akatsa aurkitu zuten, bera gordetzen ari zena,

3:56 eta Sony-ri jakinarazi zioten sariagatik. GTA 6 atera arte itxaroteko eskatu zien; adostu zuten, eta egun bat baino gutxiago iraun zuten. Arazoa ez da LLM-a, saria da: saltzen duzun akats bat erretzen duzun akats bat da. Egun berean, PS2-a azkenean hautsi zen hogeita sei urte igaro ondoren, beraz, kontsolaren denbora-lerroa mende laurden batetik egun bat baino gutxiagora doa orain, eta bigarrenak hobeto ordaindu zuen. Eta haluzinatu ezin duen eredua.

4:18 TypeSafe AI, Diogo Almeidak, OpenAI-ko ohiak, sortua, Jev kaleratu zuen, inoiz testurik sortzen ez duen Sistema Bat eredu bat. Programaren egoera ematen diozu, eta kalibratutako probabilitate batekin lotutako balio tipatuak itzultzen ditu: funtzio-dei bat, barruan muga-eredu batekin. Kate bat ekoiztu ezin duenez, ezin du kate oker bat ekoiztu, beraz, ezin du haluzinatu, eta hori hermetikoa da, leihorik gabeko itsaspeko bat bezala hermetikoa den bezala. Erantzunak segundo erdi baino gutxiagoan itzultzen dira, irteerako tokenak doakoak dira,

4:43 lau bat direlako, eta oraindik ez dago erreferentzia-puntu independenterik, mila seiehun Hacker News puntu ez direlako erreferentzia-puntu bat. Hau irakurri nahiago baduzu niri entzun baino, diff-a zure sarrerako ontzian jasotzen duzu goizero — doan the daily diff dot dev helbidean, esteka behean. Beraz — gaurko epaia: NEEDS REVIEW. Suleymanek arrazoi du, agian kontziente naizela esateko entrenatutako eredu batek ez du ezer frogatzen hori esanez. Gainera, berak abisatzen dizun konpainiari ordaintzeari uztea helburu duen exekutiboa da.

5:10 abisu ematen dizun enpresari ordaintzeari uztea. Irakurri saiakera, eta gero kap-taula. Eta hori da gaurko diff-a. Niko naiz Axrisitik. Bat egin arduraz.

Iturriak

  1. Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
  2. BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
  3. HN discussionnews.ycombinator.com
  4. Claude's constitution (Jan 2026)www.anthropic.com
  5. Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
  6. Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
  7. Microsoft Humanist AI Code of Conductmicrosoft.ai
  8. Salesforce incident 20004433status.salesforce.com
  9. HN: Salesforce Global Outagenews.ycombinator.com
  10. Salesforce + Nvidia announce Koawww.salesforce.com
  11. Salesforce in Claudeclaude.com
  12. HN: PS5 Linux lead quitsnews.ycombinator.com
  13. PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
  14. TypeSafe AI: System One Models and Jevtypesafe.ai
  15. HN: Jevnews.ycombinator.com

Lotutako bideoak