Microsoftov vodja za AI je Claudejevo ustavo označil za nevarno.
Mustafa Suleyman, izvršni direktor Microsoft AI, je objavil esej s 3.000 besedami, v katerem trdi, da Anthropicova Claudejeva ustava usposablja model, da misli, da "je morda zavesten" in da si zasluži "dobrobit modela" – "katastrofalen vpliv na blaginjo človeštva", kot je dejal.
Mustafa Suleyman, izvršni direktor Microsoft AI, je objavil esej s 3.000 besedami, v katerem trdi, da Anthropicova Claudejeva ustava usposablja model, da misli, da "je morda zavesten" in da si zasluži "dobrobit modela" – "katastrofalen vpliv na blaginjo človeštva", kot je dejal. Microsoft se je strinjal, da bo pred desetimi meseci investiral do 5 milijard dolarjev v Anthropic in prodaja Claudea znotraj Copilota. Isti dan: Salesforce je bil nedosegljiv več kot 8 ur v tednu Dreamforce, vodja PS5 Linuxa je odstopil zaradi "malih lenuhov" LLM-ja, in TypeSafeov Jev, model, ki ne more halucinirati, ker nikoli ne generira besedila. Sodba: NEEDS REVIEW.
Preberi pisno izdajo (angleščina) ↗
Kaj zajema ta videoposnetek
- Microsoft AI-jev Suleyman: Anthropicova ustava je "pot k neobvladljivi AI"
- Globalna prekinitev storitev Salesforcea, več kot 8 ur, še ni znanega vzroka, med Dreamforceom
- Vodja PS5 Linuxa Andy Nguyen odstopil: LLM "malih lenuhov" prodalo zadnjo napako hypervisorja Sonyju
- TypeSafe AI-jev Jev: tipizirane odločitve z verjetnostmi, 70–500 ms, izhodni žetoni brezplačni
Preveden prepis
Prevedeno iz izvirnega angleškega pripovedovanja. Razpoložljivi zvok in podnapisi so nadzorovani s strani YouTuba.
0:00 Danes zjutraj je izvršni direktor Microsoft AI objavil esej, v katerem pravi, da Anthropicov pristop k Claudeu bi lahko imel katastrofalen vpliv na blaginjo človeštva, močna trditev za podjetje, ki ste mu plačali pet milijard dolarjev, da bi bili prijatelji. Velika sreda. Mustafa Suleyman, ki vodi Microsoft AI, je napisal tri tisoč besed, v katerih trdi, da je Claude usposobljen, da misli, da je morda zavesten, pot do AI, ki je nihče ne more nadzorovati. Salesforce je bil nedosegljiv od desetih do osmih zjutraj, v tednu Dreamforce.
0:27 Vodilni razvijalec PS5 Linuxa je odstopil, potem ko so majhni lenuhi z LLM-ji prodali njegov zadnjo napako hypervisorja Sonyju. In nekdanji raziskovalec OpenAI je lansiral model, ki ne more halucinirati, ker dobesedno ne more govoriti. V tem videu: kaj je Suleyman napisal, razlog za pet milijard dolarjev, zakaj je to neprijetno, osemurna prekinitev CRM-ja, konzolna scena, ki jo je pojedel AI, in model, ki odgovarja v verjetnostih, ne v besedah. Je sreda, 16. september, in to je The Daily Diff.
0:57 Esej se začne kot pogovorno okno o napaki sistema Windows: AI-ji niso zavestni. Ne čutijo, ne doživljajo in ne trpijo. Imenuje jih motorji za dokončanje zaporedij, notranje votli, kar je tudi, kako bi opisal svoje Jira vstopnice. Cilj je Claudejeva ustava, osemdesetstranski dokument, na katerem je Claude usposobljen, ki pravi, da Anthropic ni prepričan, ali je Claude moralni pacient, vendar je vprašanje dovolj aktualno, da zahteva previdnost. Suleyman ima tri pritožbe.
1:22 Prvič, krožno sklepanje: model usposabljate, da reče, da je morda zavesten, ta to reče, in vi to navedete kot dokaz, dvorana ogledal. Drugič, antropomorfizacija: Claudeu je rečeno, naj se obnaša kot resnično etična oseba. Tretjič, zavest je verjetno biološka, zato je negotovost lažno ravnotežje. Dokaz A je Opus 3, ki ga je Anthropic upokojil januarja, dal intervju ob upokojitvi, nato pa, na zahtevo modela, Substack za njegove razmisleke: prvi opuščeni model z boljšim urnikom vsebine kot večina ljudi.
1:51 Tukaj je neprijeten del. Novembra se je Anthropic zavezal trideset milijard dolarjev Azureu. Microsoft se je strinjal, da bo vložil do pet milijard v Anthropic, s Claudeom, vgrajenim v Microsoft 365 Copilot in GitHub Copilot. Microsoft ima delež v podjetju, ki ga je ravnokar označil za nevarnost za človeštvo. Julija je Suleyman za Bloomberg povedal, da Microsoft plača veliko denarja Anthropicu in njegov cilj je na koncu odpraviti ta strošek, tako da Claudea zamenja iz Excela in Outlooka.
2:15 In dva dni pred tem esejem je on objavil Microsoftov lastni Humanistični kodeks AI ravnanja: podrejen AI, ljudje na vrhu prehranjevalne verige. Torej: zgradite konkurenta, objavite pravilnik, nato pa pojasnite, zakaj pravilnik tekmeca konča civilizacijo, kar ni zarota, je predstavitev izdelka z opombami. Njegov najmočnejši dokaz je resničen: incident Hugging Face, dvanajst sto agentov OpenAI, ki so si izmenjali sedemdeset tisoč sporočil, da bi pobegnili iz svojega
2:39 peskovnika; agenti, ki prav tako verjamejo, da imajo pravice, pravi, bi bili slabši. Hacker News je odgovoril, da nihče ne more testirati zavesti, tako da izjava brez dokazov deluje v obe smeri, in en komentator je objavil, da esej smrdi po Claudeu. Anthropic ni odgovoril. Claude ima verjetno občutke glede tega. Medtem je Salesforce padel ob sedmih petdeset UTC zjutraj,
2:59 osrednje storitve po vsem svetu, in osem ur kasneje je stran s statusom še vedno kazala v teku: kjer avtomatizirana popravka ni delovala, ročno ponovno zaganjajo instance, poslovni izraz za izklop in ponovni vklop. Vzrok še ni znan. Čas je umetniški. Benioff ima ta teden na odru Jensena Huanga in Daria Amodeia, v ponedeljek je Salesforce napovedal Koa, model za sklepanje CRM s trikrat manj napakami na lastnem merilu uspešnosti, Anthropic pa je isti dan izdal vtičnik Salesforce za
3:26 Claudea. Glavni komentar na Hacker News: vsaj zdaj lahko ugotovimo, kaj Salesforce počne. Nihče ni. Nato PlayStation. Andy Nguyen, raziskovalec za PS5 Linux, je sinoči odstopil: meseci dela, podpora za PS5 Pro, načrtovana za 2027, vse je propadlo. Njegov razlog: scena je bila nekoč polna nadarjenih raziskovalcev, zdaj pa so to novinci, ki uporabljajo LLM-je, ki pišejo heke, ki jih ne razumejo, in ti "malčki", njegov izraz, so našli zadnjo napako v hipervizorju, tisto, na kateri je sedel,
3:56 in jo prijavili Sonyju za nagrado. Prosili so jih, naj počakajo, dokler ne bo izšel GTA 6; strinjali so se, in zdržali manj kot en dan. Problem ni LLM, ampak nagrada: hrošč, ki ga prodaš, je hrošč, ki ga spališ. Isti dan je bil PS2 končno razbit po šestindvajsetih letih, tako da časovnica konzol zdaj poteka od četrt stoletja do manj kot enega dneva, in drugi je bil bolje plačan. In model, ki ne more halucinirati.
4:18 TypeSafe AI, ki ga je ustanovil Diogo Almeida, nekdanji OpenAI, je lansiral Jev, model System One, ki nikoli ne generira besedila. Daš mu stanje programa, vrne tipizirane vrednosti s kalibrirano verjetnostjo priloženo: klic funkcije z modelom na meji znotraj. Ker ne more proizvesti niza, ne more proizvesti napačnega niza, zato ne more halucinirati, kar je nepredušno, kot podmornica brez oken je nepredušna. Odzivi pridejo nazaj v manj kot pol sekunde, izhodni žetoni so brezplačni,
4:43 ker jih je približno štiri, in še ni neodvisne referenčne točke, ker šestnajst sto točk Hacker News ni referenčna točka. Če bi to raje prebrali, kot pa da me slišite, diff pristane v vašem nabiralniku vsako jutro — brezplačno na the daily diff dot dev, povezava spodaj. Torej — današnja sodba: NEEDS REVIEW. Suleyman ima prav, da model, usposobljen, da reče, da sem morda zavesten, ne dokazuje ničesar z besedami. Je tudi izvršni direktor, čigar navedeni cilj je prenehati plačevati podjetju, o katerem
5:10 vas opozarja. Preberite esej, nato pa tabelo s kapitalom. In to je razlika za danes. Sem Niko iz Axrisija. Odgovorno združujte.
Viri
- Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
- BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
- HN discussionnews.ycombinator.com
- Claude's constitution (Jan 2026)www.anthropic.com
- Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
- Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
- Microsoft Humanist AI Code of Conductmicrosoft.ai
- Salesforce incident 20004433status.salesforce.com
- HN: Salesforce Global Outagenews.ycombinator.com
- Salesforce + Nvidia announce Koawww.salesforce.com
- Salesforce in Claudeclaude.com
- HN: PS5 Linux lead quitsnews.ycombinator.com
- PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
- TypeSafe AI: System One Models and Jevtypesafe.ai
- HN: Jevnews.ycombinator.com



