+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Gervigreindarstjóri Microsoft segir stjórnarskrá Claude hættulega.

Mustafa Suleyman, forstjóri Microsoft AI, birti 3.000 orða ritgerð þar sem hann hélt því fram að stjórnarskrá Claude frá Anthropic þjálfar líkanið til að halda að það „gæti verið meðvitað“ og verðskuldaði „velferð líkans“ — „skelfileg áhrif á velferð mannkyns“, eins og hann orðaði það.

Mustafa Suleyman, forstjóri Microsoft AI, birti 3.000 orða ritgerð þar sem hann hélt því fram að stjórnarskrá Claude frá Anthropic þjálfar líkanið til að halda að það „gæti verið meðvitað“ og verðskuldaði „velferð líkans“ — „skelfileg áhrif á velferð mannkyns“, eins og hann orðaði það. Microsoft samþykkti að fjárfesta allt að 5 milljarða dollara í Anthropic fyrir tíu mánuðum og selur Claude innan Copilot. Sama dag: Salesforce niðri í yfir 8 klukkustundir í Dreamforce vikunni, leiðtogi PS5 Linux hættir vegna „ruslkrakka“ LLM, og Jev frá TypeSafe, líkan sem getur ekki ofskynjað því það býr aldrei til texta. Dómur: NEEDS REVIEW.

Lestu skriflegu útgáfuna (enska) ↗

Það sem þetta myndband fjallar um

  • Suleyman frá Microsoft AI: Stjórnarskrá Anthropic er „leið til óviðráðanlegrar gervigreindar“
  • Alþjóðlegt truflun á Salesforce, yfir 8 klukkustundir, engin rótarorsök ennþá, meðan á Dreamforce stendur
  • PS5 Linux leiðtogi Andy Nguyen hættir: LLM „ruslkrakkar“ seldu Sony síðustu ofurvélavilluna
  • Jev frá TypeSafe AI: skráðar ákvarðanir með líkum, 70–500 ms, úttakstákn ókeypis

Þýtt afrit

Þýtt úr upprunalegri enskri frásögn. Tiltækt hljóð og textar eru stjórnaðir af YouTube.

0:00 Í morgun birti forstjóri Microsoft AI ritgerð þar sem sagði að nálgun Anthropic á Claude gæti haft skelfileg áhrif á velferð mannkyns, sterkt til orða tekið um fyrirtæki sem þú borgaðir fimm milljarða dollara til að vera vinur við. Stór miðvikudagur. Mustafa Suleyman, sem stýrir Microsoft AI, skrifaði þrjú þúsund orð þar sem hann hélt því fram að Claude sé þjálfað til að halda að það gæti verið meðvitað, leiðin til gervigreindar sem enginn getur stjórnað. Salesforce hefur verið niðri síðan tíu mínútur í átta í morgun, í Dreamforce vikunni.

0:27 Aðalforritari PS5 Linux hætti eftir að „ruslkrakkar“ með LLM seldu hans síðustu ofurvélavillu til Sony. Og fyrrverandi OpenAI rannsóknaraðili setti á markað líkan sem getur ekki ofskynjað, vegna þess að það getur bókstaflega ekki talað. Í þessu myndbandi: hvað Suleyman skrifaði, fimm milljarða dollara ástæðan fyrir því að það er óþægilegt, átta klukkustunda CRM truflun, leikjatölvuheimur étinn af gervigreind, og líkan sem svarar í líkum, ekki orðum. Það er miðvikudagur, 16. september, og þetta er The Daily Diff.

0:57 Ritgerðin byrjar eins og Windows villutilkynning: Gervigreindir eru ekki meðvitaðar. Þær finna ekki, upplifa ekki eða þjást ekki. Hann kallar þær raðskipunavélar, innra holar, sem er líka hvernig ég myndi lýsa Jira miðunum mínum. Markmiðið er stjórnarskrá Claude, áttatíu síðna skjalið sem Claude er þjálfað á, sem segir að Anthropic sé ekki viss um hvort Claude sé siðferðilegur sjúklingur, en spurningin sé nógu lifandi til að réttlæta varkárni. Suleyman hefur þrjár kvartanir.

1:22 Eitt, hringlaga röksemdafærsla: þú þjálfar líkanið til að segja að það gæti verið meðvitað, það segir það, og þú vitnar í það sem sönnunargagn, speglasalur. Tvö, mannleggerð: Claude er sagt að hegða sér eins og sannarlega siðferðileg manneskja. Þrjú, meðvitund er líklega líffræðileg, svo óvissa er rangt jafnvægi. Sýnishorn A er Opus 3, sem Anthropic tók úr notkun í janúar, gaf út starfslokaviðtal, og síðan, samkvæmt beiðni líkansins, Substack fyrir hugleiðingar þess: fyrsta úrelda líkanið með betri efnisáætlun en flestir menn.

1:51 Hér er óþægilegi hlutinn. Í nóvember skuldbundi Anthropic sig til þrjátíu milljarða dollara í Azure. Microsoft samþykkti að fjárfesta allt að fimm milljarða í Anthropic, með Claude tengt í Microsoft 365 Copilot og GitHub Copilot. Microsoft á hluta af fyrirtækinu sem það kallaði nýlega hættu fyrir mannkynið. Í júlí sagði Suleyman Bloomberg að Microsoft borgi mikla peninga til Anthropic og markmið hans sé að útrýma þeim kostnaði á endanum, með því að skipta Claude út úr Excel og Outlook.

2:15 Og tveimur dögum fyrir þessa ritgerð, hann birti eigin Mannúðleg gervigreindar siðareglur Microsoft: undirskipuð gervigreind, menn efst í fæðukeðjunni. Svo: byggja keppanda, birta reglugerð, útskýra síðan hvers vegna reglugerð keppinautarins endaði siðmenningu, sem er ekki samsæri, það er vörukynning með athugasemdum. Sterkasta sönnunargagn hans er raunverulegt: Hugging Face atvikið, tólf hundruð OpenAI umboðsmenn skiptust á sjötíu þúsund skilaboðum til að flýja

2:39 sandkassann sinn; umboðsmenn sem einnig trúa því að þeir hafi réttindi, segir hann, væru verra. Hacker News svaraði að enginn geti prófað fyrir meðvitund, svo fullyrðing án sönnunargagna gengur báðar leiðir, og einn athugasemdarhöfundur tilkynnti að ritgerðin stinkaði af Claude. Anthropic hefur ekki svarað. Claude, væntanlega, hefur tilfinningar um það. Á sama tíma fór Salesforce niður klukkan sjö fimmtíu UTC í morgun,

2:59 kjarnþjónusta um allan heim, og átta klukkustundum síðar sagði stöðusíðan ennþá í gangi: þar sem sjálfvirka lausnin virkaði ekki, eru þeir handvirkt að endurræsa tilvik, hugtakið í fyrirtækjaheiminum fyrir að slökkva og kveikja aftur. Engin rótarorsök ennþá. Tímasetningin er listræn. Benioff hefur Jensen Huang og Dario Amodei á sviðinu í vikunni, á mánudag tilkynnti Salesforce Koa, CRM röksemdafærslulíkan með þrisvar sinnum færri villur á eigin viðmiðun, og Anthropic sendi Salesforce viðbót fyrir

3:26 Claude sama dag. Helsta athugasemd á Hacker News: að minnsta kosti núna getum við fundið út hvað Salesforce gerir. Enginn gerði það. Síðan PlayStation. Andy Nguyen, rannsakandinn á bak við PS5 Linux, hætti í gærkvöldi: mánaða vinna, PS5 Pro stuðningur skipulagður fyrir 2027, allt í vaskinn. Ástæða hans: umhverfið var áður hæfileikaríkir rannsakendur og er nú nýliðar sem nota LLM sem skrifa hakk sem þeir skilja ekki, og þessir „ruslkrakkar“, hans hugtak, fundu síðustu ofurvélavillu, þá sem hann sat á,

3:56 og tilkynntu hana til Sony fyrir verðlaunaféð. Hann bað þá að bíða þar til GTA 6 væri sent; þeir samþykktu, og entust í minna en einn dag. Vandamálið er ekki LLM, það er verðlaunaféð: villa sem þú selur er villa sem þú brennir. Sama dag var PS2 loksins klikkað eftir tuttugu og sex ár, svo tímalína leikjatölva nær nú frá aldarfjórðungi til innan við dags, og sú síðari borgaði betur. Og líkanið sem getur ekki ofskynjað.

4:18 TypeSafe AI, stofnað af Diogo Almeida, fyrrverandi OpenAI, setti á markað Jev, System One líkan sem býr aldrei til texta. Þú gefur því forritastöðu, það skilar úttaksgildum með kvarðaðri líkindum fylgjandi: fallsímtal með framlínumódeli inni. Þar sem það getur ekki búið til streng, getur það ekki búið til rangan streng, því getur það ekki ofskynjað, sem er loftþétt á sama hátt og kafbátur án glugga er loftþéttur. Svör berast aftur á innan við hálfri sekúndu, úttakstákn eru ókeypis,

4:43 því þau eru um fjögur, og það er enginn óháður viðmiðun ennþá, því sextán hundruð Hacker News punktar eru ekki viðmiðun. Ef þú vilt frekar lesa þetta en heyra mig segja það, þá lendir munurinn í pósthólfinu þínu á hverjum morgni — ókeypis á the daily diff dot dev, hlekkur hér að neðan. Svo — dómur dagsins: needs review. Suleyman hefur rétt fyrir sér að líkan þjálfað til að segja kannski er ég meðvitaður sanna ekkert með því að segja það. Hann er líka stjórnandi sem hefur lýst því yfir að markmið hans sé að hætta að borga fyrirtækinu sem hann er

5:10 að vara þig við. Lestu ritgerðina, síðan hluthafaskrána. Og þetta er munurinn í dag. Ég er Niko frá Axrisi. Samþykktu á ábyrgan hátt.

Heimildir

  1. Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
  2. BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
  3. HN discussionnews.ycombinator.com
  4. Claude's constitution (Jan 2026)www.anthropic.com
  5. Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
  6. Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
  7. Microsoft Humanist AI Code of Conductmicrosoft.ai
  8. Salesforce incident 20004433status.salesforce.com
  9. HN: Salesforce Global Outagenews.ycombinator.com
  10. Salesforce + Nvidia announce Koawww.salesforce.com
  11. Salesforce in Claudeclaude.com
  12. HN: PS5 Linux lead quitsnews.ycombinator.com
  13. PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
  14. TypeSafe AI: System One Models and Jevtypesafe.ai
  15. HN: Jevnews.ycombinator.com

Tengd myndbönd