+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Microsoft AI vadītājs tikko nosauca Claude konstitūciju par bīstamu.

Mustafa Suleiman, Microsoft AI izpilddirektors, publicēja 3000 vārdu esejas, apgalvojot, ka Anthropic Claude konstitūcija apmāca modeli domāt, ka tas "var būt apzinīgs" un pelnījis "modeļa labklājību" — "katastrofālu ietekmi uz cilvēces labklājību", viņa vārdiem.

Mustafa Suleiman, Microsoft AI izpilddirektors, publicēja 3000 vārdu esejas, apgalvojot, ka Anthropic Claude konstitūcija apmāca modeli domāt, ka tas "var būt apzinīgs" un pelnījis "modeļa labklājību" — "katastrofālu ietekmi uz cilvēces labklājību", viņa vārdiem. Microsoft pirms desmit mēnešiem piekrita investēt līdz pat 5 miljardiem dolāru Anthropic un pārdod Claude Copilot ietvaros. Tajā pašā dienā: Salesforce nedarbojās vairāk nekā 8 stundas Dreamforce nedēļā, PS5 Linux vadītājs pamet darbu saistībā ar LLM "slop kiddies", un TypeSafe Jev, modelis, kas nespēj halucinēt, jo tas nekad neģenerē tekstu. Spriedums: NEEDS REVIEW.

Lasiet rakstisko izdevumu (angļu valodā) ↗

Ko aptver šis video

  • Microsoft AI Suleimans: Anthropic konstitūcija ir "ceļš uz nekontrolējamu AI"
  • Salesforce globāls pārtraukums, vairāk nekā 8 stundas, pagaidām nav cēloņa, Dreamforce laikā
  • PS5 Linux vadītājs Endijs Ngujens pamet darbu: LLM "slop kiddies" pārdeva pēdējo hipervizora kļūdu Sony
  • TypeSafe AI Jev: tipizēti lēmumi ar varbūtībām, 70–500 ms, izvades marķieri bez maksas

Tulkotais transkripts

Tulkojums no oriģinālā angļu stāstījuma. Pieejamais audio un subtitri tiek kontrolēti no YouTube.

0:00 Šorīt Microsoft AI izpilddirektors publicēja eseju, sakot, ka Anthropic pieeja Claude varētu atstāt katastrofālu ietekmi uz cilvēces labklājību, spēcīgs apgalvojums par uzņēmumu, kam samaksāji piecus miljardus dolāru, lai būtu draugos. Lielā trešdiena. Mustafa Suleimans, kurš vada Microsoft AI, uzrakstīja trīs tūkstošus vārdu, apgalvojot, ka Claude ir apmācīts domāt, ka tas varētu būt apzinīgs, ceļš uz AI, ko neviens nevar kontrolēt. Salesforce nedarbojās kopš rīta desmit minūtes pirms astoņiem, Dreamforce nedēļā.

0:27 PS5 Linux vadošais izstrādātājs pameta darbu pēc tam, kad "slop kiddies" ar LLM pārdeva viņa pēdējo hipervizora kļūdu Sony. Un bijušais OpenAI pētnieks palaida modeli, kas nespēj halucinēt, jo tas burtiski nespēj runāt. Šajā video: ko Suleimans rakstīja, piecu miljardu dolāru iemesls, kāpēc tas ir neērti, astoņu stundu CRM pārtraukums, konsoles aina, ko apēda AI, un modelis, kas atbild ar varbūtībām, nevis vārdiem. Ir trešdiena, 16. septembris, un šis ir The Daily Diff.

0:57 Eseja sākas kā Windows kļūdas dialoglodziņš: AI nav apzinīgi. Tie nejūt, nepiedzīvo vai necierš. Viņš tos sauc par secību pabeigšanas dzinējiem, iekšēji tukšiem, kas ir arī tas, kā es aprakstītu savus Jira pieteikumus. Mērķis ir Claude konstitūcija, astoņdesmit lappušu dokuments, uz kura Claude ir apmācīts, kas saka, ka Anthropic nav pārliecināts, vai Claude ir morāls pacients, bet jautājums ir pietiekami aktuāls, lai attaisnotu piesardzību. Suleimanam ir trīs sūdzības.

1:22 Pirmkārt, apļveida spriešana: jūs apmācāt modeli teikt, ka tas varētu būt apzinīgs, tas to saka, un jūs to mināt kā pierādījumu, spoguļu zāle. Otrkārt, antropomorfizācija: Claude tiek teikts rīkoties kā patiesi ētisks cilvēks. Treškārt, apziņa, iespējams, ir bioloģiska, tāpēc neskaidrs ir nepareizs līdzsvars. Eksponāts A ir Opus 3, ko Anthropic atsauca janvārī, sniedza atvaļināšanas interviju un pēc tam, pēc modeļa lūguma, Substack tās pārdomām: pirmais novecojušais modelis ar labāku satura grafiku nekā lielākā daļa cilvēku.

1:51 Šeit ir neērtā daļa. Novembrī Anthropic apņēmās Azure ieguldīt trīsdesmit miljardus dolāru. Microsoft piekrita investēt līdz pieciem miljardiem Anthropic, ar Claude, kas ir savienots ar Microsoft 365 Copilot un GitHub Copilot. Microsoft pieder daļa no uzņēmuma, ko tas tikko nosauca par bīstamu cilvēcei. Jūlijā Suleimans Bloomberg teica, ka Microsoft maksā daudz naudas Anthropic un viņa mērķis ir galu galā likvidēt šīs izmaksas, nomainot Claude no Excel un Outlook.

2:15 Un divas dienas pirms šīs esejas viņš publicēja Microsoft pašu Humānistisko AI rīcības kodeksu: pakļauts AI, cilvēki pārtikas ķēdes augšgalā. Tātad: izveidot konkurentu, publicēt noteikumu grāmatu, pēc tam paskaidrot, kāpēc sāncenša noteikumu grāmata iznīcina civilizāciju, kas nav sazvērestība, tā ir produkta laišana tirgū ar zemsvītras piezīmēm. Viņa spēcīgākie pierādījumi ir reāli: Hugging Face incidents, divpadsmit simti OpenAI aģentu apmainījās ar septiņdesmit tūkstošiem ziņojumu, lai izkļūtu no savas

2:39 smilšu kastes; aģenti, kas arī tic, ka viņiem ir tiesības, viņš saka, būtu sliktāk. Hacker News atbildēja, ka neviens nevar pārbaudīt apziņu, tāpēc teiktais bez pierādījumiem ir abpusēji griezīgs, un viens komentētājs paziņoja, ka eseja smaržo pēc Claude. Anthropic nav atbildējis. Claude, iespējams, ir jūtas par to. Tikmēr Salesforce šorīt pulksten septiņos piecdesmit UTC pārtrauca darbu,

2:59 galvenie pakalpojumi visā pasaulē, un astoņas stundas vēlāk statusa lapā joprojām bija norādīts notiek: kur automatizētais labojums neiedarbojās, viņi manuāli restartē instances, uzņēmuma termins "izslēgt un atkal ieslēgt". Pagaidām nav cēloņa. Laika izvēle ir māksla. Beniofam šonedēļ uz skatuves ir Jensens Huangs un Dario Amodei, pirmdien Salesforce paziņoja par Koa, CRM spriešanas modeli ar trīs reizes mazāk kļūdām savā etalonā, un Anthropic tajā pašā dienā nosūtīja Salesforce spraudni

3:26 Claude. Populārākais Hacker News komentārs: vismaz tagad mēs varam noskaidrot, ko dara Salesforce. Neviens to nedarīja. Pēc tam PlayStation. Endijs Ngujens, PS5 Linux pētnieks, vakar vakarā pameta darbu: mēnešiem ilgs darbs, PS5 Pro atbalsts plānots 2027. gadā, viss nonāca veltīgi. Viņa iemesls: agrāk skatuve bija talantīgi pētnieki, bet tagad ir iesācēji, kas izmanto LLM, rakstot hakerus, ko viņi nesaprot, un šie "slop kiddies", viņa termins, atrada pēdējo hipervizora kļūdu, to, uz kuras viņš sēdēja,

3:56 un ziņoja par to Sony par atlīdzību. Viņš lūdza viņus pagaidīt, līdz GTA 6 tiks izlaista; viņi piekrita, un izturēja mazāk nekā dienu. Problēma nav LLM, bet gan atlīdzība: kļūda, ko pārdod, ir kļūda, ko sadedzini. Tajā pašā dienā PS2 beidzot tika uzlauzta pēc divdesmit sešiem gadiem, tāpēc konsoles laika līnija tagad ilgst no ceturtdaļgadsimta līdz mazāk nekā dienai, un otrā maksāja labāk. Un modelis, kas nespēj halucinēt.

4:18 TypeSafe AI, ko dibināja Diogo Almeida, bijušais OpenAI, izlaida Jev, System One modeli, kas nekad neģenerē tekstu. Jūs tam dodat programmas stāvokli, tas atgriež tipizētas vērtības ar kalibrētu varbūtību pievienotu: funkcijas izsaukums ar robežlīnijas modeli iekšpusē. Tā kā tas nevar radīt virkni, tas nevar radīt nepareizu virkni, tāpēc nevar halucinēt, kas ir hermētisks tāpat kā zemūdene bez logiem ir hermētiska. Atbildes tiek saņemtas mazāk nekā pussekundē, izvades marķieri ir bez maksas,

4:43 jo to ir aptuveni četri, un vēl nav neatkarīga etalona, jo sešpadsmit simti Hacker News punktu nav etalons. Ja vēlaties to izlasīt, nevis dzirdēt, kā es to saku, "diff" nonāk jūsu iesūtnē katru rītu — bez maksas daily diff dot dev, saite zemāk. Tātad — šodienas spriedums: NEEDS REVIEW. Suleimanam ir taisnība, ka modelis, kas apmācīts teikt, ka varbūt esmu apzinīgs, neko nepierāda, to sakot. Viņš ir arī vadītājs, kura izvirzītais mērķis ir pārtraukt maksāt uzņēmumam, par kuru viņš

5:10 brīdina jūs. Izlasiet eseju, pēc tam kapitāla tabulu. Un tas ir šodienas "diff". Esmu Niko no Axrisi. Apvienojiet atbildīgi.

Avoti

  1. Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
  2. BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
  3. HN discussionnews.ycombinator.com
  4. Claude's constitution (Jan 2026)www.anthropic.com
  5. Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
  6. Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
  7. Microsoft Humanist AI Code of Conductmicrosoft.ai
  8. Salesforce incident 20004433status.salesforce.com
  9. HN: Salesforce Global Outagenews.ycombinator.com
  10. Salesforce + Nvidia announce Koawww.salesforce.com
  11. Salesforce in Claudeclaude.com
  12. HN: PS5 Linux lead quitsnews.ycombinator.com
  13. PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
  14. TypeSafe AI: System One Models and Jevtypesafe.ai
  15. HN: Jevnews.ycombinator.com

Saistītie video