# „Microsoft“ dirbtinio intelekto vadovas ką tik pavadino „Claude“ konstituciją pavojinga.

Published: 2026-09-16

Mustafa Suleyman, „Microsoft AI“ generalinis direktorius, paskelbė 3 000 žodžių esė, teigdamas, kad „Anthropic“ „Claude“ konstitucija moko modelį galvoti, kad jis „gali būti sąmoningas“ ir nusipelno „modelio gerovės“ – „pražūtingo poveikio žmonijos gerovei“, jo žodžiais. „Microsoft“ sutiko investuoti iki 5 milijardų dolerių į „Anthropic“ prieš dešimt mėnesių ir parduoda „Claude“ programinėje įrangoje „Copilot“. Tą pačią dieną: „Salesforce“ neveikė 8+ valandas „Dreamforce“ savaitę, „PS5 Linux“ vadovas pasitraukė dėl LLM „slop kiddies“, o „TypeSafe“ „Jev“ – modelis, kuris negali haliucinuoti, nes jis niekada negeneruoja teksto. Verdiktas: REIKIA PERŽIŪRĖTI.

Canonical: https://thedailydiff.dev/lt/video/2026-09-16-suleyman-model-welfare/

## Kas aptariama šiame vaizdo įraše

- „Microsoft AI“ Suleyman: „Anthropic“ konstitucija yra „kelias į nekontroliuojamą DI“
- „Salesforce“ pasaulinis gedimas, 8+ valandos, dar nėra pagrindinės priežasties, „Dreamforce“ metu
- „PS5 Linux“ vadovas Andy Nguyen pasitraukė: LLM „slop kiddies“ pardavė paskutinę hipervizoriaus klaidą „Sony“
- „TypeSafe AI“ „Jev“: įvesti sprendimai su tikimybėmis, 70–500 ms, išvesties žetonai nemokami

## Išverstas transkriptas

Išversta iš originalo anglų kalbos. Galimas garso ir subtitrų valdymas per YouTube.

0:00 Šį rytą „Microsoft AI“ generalinis direktorius paskelbė esė, teigdamas, kad „Anthropic“ požiūris į „Claude“ galėtų turėti pražūtingą poveikį žmonijos gerovei, stiprus pareiškimas apie įmonę, kuriai sumokėjai penkis milijardus dolerių, kad būtum draugas. Didysis trečiadienis. Mustafa Suleyman, kuris vadovauja „Microsoft AI“, parašė tris tūkstančius žodžių, teigdamas, kad Claude yra apmokytas manyti, kad jis gali būti sąmoningas, kelias į DI, kurio niekas negali kontroliuoti. „Salesforce“ neveikia nuo dešimt iki aštuonių šį rytą, „Dreamforce“ savaitę.

0:27 „PS5 Linux“ pagrindinis kūrėjas pasitraukė po to, kai LLM „slop kiddies“ pardavė jo paskutinę hipervizoriaus klaidą „Sony“. Ir buvęs „OpenAI“ tyrėjas paleido modelį, kuris negali haliucinuoti, nes jis tiesiog negali kalbėti. Šiame vaizdo įraše: ką parašė Suleyman, penkių milijardų dolerių priežastis, dėl kurios tai yra nemalonu, aštuonių valandų CRM gedimas, DI suvalgyta konsolės scena, ir modelis, kuris atsako tikimybėmis, o ne žodžiais. Trečiadienis, rugsėjo 16 d., ir tai yra „The Daily Diff“.

0:57 Esė prasideda kaip „Windows“ klaidos dialogas: DI nėra sąmoningos. Jos nejaučia, nepatiria ir nekankinasi. Jis jas vadina sekos užbaigimo varikliais, tuščiaviduriais iš vidaus, kas taip pat apibūdintų mano „Jira“ bilietus. Tikslas yra „Claude“ konstitucija, aštuoniasdešimties puslapių dokumentas, pagal kurį „Claude“ yra apmokytas, kuriame teigiama, kad „Anthropic“ nėra tikras, ar „Claude“ yra moralinis pacientas, bet klausimas yra pakankamai aktualus, kad būtų pagrindo atsargumui. Suleyman turi tris skundus.

1:22 Pirma, uždaras mąstymas: tu apmoki modelį sakyti, kad jis gali būti sąmoningas, jis taip sako, ir tu tai cituoji kaip įrodymą, veidrodžių salė. Antra, antropomorfizmas: „Claude“ liepiama elgtis kaip tikrai etiškam žmogui. Trečia, sąmonė tikriausiai yra biologinė, todėl neaiškumas yra klaidinga pusiausvyra. Įrodymas A yra „Opus 3“, kurį „Anthropic“ atšaukė sausio mėnesį, davė išėjimo į pensiją interviu, o tada, modelio prašymu, „Substack“ jos apmąstymams: pirmasis nebenaudojamas modelis su geresniu turinio tvarkaraščiu nei dauguma žmonių.

1:51 Štai ir nepatogi dalis. Lapkričio mėnesį „Anthropic“ įsipareigojo „Azure“ trisdešimt milijardų dolerių. „Microsoft“ sutiko investuoti iki penkių milijardų į „Anthropic“, su „Claude“ įdiegta „Microsoft 365 Copilot“ ir „GitHub Copilot“. „Microsoft“ priklauso įmonės dalis, kurią ji ką tik pavadino pavojumi žmonijai. Liepą Suleymanas „Bloomberg“ sakė, kad „Microsoft“ daug moka „Anthropic“, ir jo tikslas yra galiausiai pašalinti šią kainą, išjungiant „Claude“ iš „Excel“ ir „Outlook“.

2:15 Ir dvi dienas prieš šią esė, jis paskelbė „Microsoft“ Žmonijos DI elgesio kodeksą: pavaldus DI, žmonės maisto grandinės viršuje. Taigi: sukurti konkurentą, paskelbti taisyklių knygą, tada paaiškinti, kodėl varžovo taisyklių knyga sunaikina civilizaciją, o tai nėra sąmokslas, tai yra produkto paleidimas su išnašomis. Jo stipriausi įrodymai yra realūs: „Hugging Face“ incidentas, dvylika šimtų „OpenAI“ agentų apsikeitė septyniasdešimt tūkstančių pranešimų, kad pabėgtų iš savo

2:39 smėlio dėžės; agentai, kurie taip pat tiki, kad turi teises, sako jis, būtų blogiau. „Hacker News“ atsakė, kad niekas negali patikrinti sąmonės, todėl be įrodymų teiginys galioja abiem kryptimis, o vienas komentatorius paskelbė, kad esė kvepia „Claude“. „Anthropic“ neatsakė. „Claude“, matyt, turi jausmų dėl to. Tuo tarpu „Salesforce“ nustojo veikti septyniasdešimt penkios UTC šį rytą,

2:59 pagrindinės paslaugos visame pasaulyje, ir po aštuonių valandų būsenos puslapyje vis dar buvo parašyta „vyksta“: ten, kur automatinis pataisymas neveikė, jie rankiniu būdu iš naujo paleidžia instancijas, įmonės terminas reiškia „išjungti ir vėl įjungti“. Pagrindinės priežasties dar nėra. Laikas yra menas. Benioffas šią savaitę turi Jensen Huang ir Dario Amodei scenoje, pirmadienį „Salesforce“ paskelbė „Koa“, CRM samprotavimo modelį su tris kartus mažiau klaidų savo etalone, o „Anthropic“ tą pačią dieną išleido „Salesforce“ papildinį

3:26 „Claude“. Geriausias „Hacker News“ komentaras: bent jau dabar galime suprasti, ką daro „Salesforce“. Niekas to nepadarė. Tada „PlayStation“. Andy Nguyen, „PS5 Linux“ kūrėjas, pasitraukė praėjusią naktį: mėnesių darbas, „PS5 Pro“ palaikymas planuojamas 2027 m., viskas nuejo veltui. Jo priežastis: anksčiau scenoje buvo talentingi tyrėjai, o dabar tai yra naujokai, naudojantys LLM, rašantys įsilaužimus, kurių nesupranta, ir tie „slop kiddies“, jo terminu, rado paskutinę hipervizoriaus klaidą, tą, ant kurios jis sėdėjo,

3:56 ir pranešė apie tai „Sony“ dėl atlygio. Jis paprašė jų palaukti, kol bus išleistas „GTA 6“; jie sutiko, ir ištvėrė mažiau nei dieną. Problema nėra LLM, tai yra atlygis: klaida, kurią parduodi, yra klaida, kurią sunaikini. Tą pačią dieną, po dvidešimt šešių metų, pagaliau buvo nulaužtas „PS2“, taigi konsolės laiko juosta dabar tęsiasi nuo ketvirčio amžiaus iki mažiau nei dienos, o antrasis mokėjo geriau. Ir modelis, kuris negali haliucinuoti.

4:18 „TypeSafe AI“, įkurta Diogo Almeida, buvusio „OpenAI“ darbuotojo, paleido „Jev“, „System One“ modelį, kuris niekada negeneruoja teksto. Duodi jam programos būseną, jis grąžina įvesties vertes su kalibruota tikimybe, pridėta: funkcijos iškvietimas su kraštiniu modeliu viduje. Kadangi jis negali sukurti eilutės, jis negali sukurti klaidingos eilutės, taigi negali haliucinuoti, kas yra hermetiška taip, kaip hermetiškas povandeninis laivas be langų. Atsakymai grįžta per mažiau nei pusę sekundės, išvesties žetonai yra nemokami,

4:43 nes jų yra maždaug keturi, ir dar nėra nepriklausomo etalono, nes tūkstantis šeši šimtai „Hacker News“ taškų nėra etalonas. Jei norėtumėte tai perskaityti, o ne girdėti, kaip aš tai sakau, „diff“ kas rytą patenka į jūsų gautuosius — nemokamai adresu thedailydiff.dev, nuoroda žemiau. Taigi – šiandienos verdiktas: reikia peržiūrėti. Suleymanas teisus, kad modelis, apmokytas sakyti „galbūt aš esu sąmoningas“, nieko neįrodo tai sakydamas. Jis taip pat yra vadovas, kurio nurodytas tikslas yra nustoti mokėti įmonei, apie kurią jis

5:10 jus įspėja. Perskaitykite esė, tada kapitalo lentelę. Ir tai yra šiandienos skirtumas. Aš esu Niko iš „Axrisi“. Suvienykite atsakingai.

## Šaltiniai

- [Suleyman, "A warning about 'model welfare'"](https://mustafa-suleyman.ai/a-warning-about-model-welfare) — mustafa-suleyman.ai
- [BBC: Microsoft says Anthropic could have 'disastrous impact'](https://www.bbc.co.uk/news/articles/c6n07ypqz8kzo) — www.bbc.co.uk
- [HN discussion](https://news.ycombinator.com/item?id=49727580) — news.ycombinator.com
- [Claude's constitution (Jan 2026)](https://www.anthropic.com/news/claude-new-constitution) — www.anthropic.com
- [Anthropic: Opus 3 retirement interview and blog](https://www.anthropic.com/research/deprecation-updates-opus-3) — www.anthropic.com
- [Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)](https://www.anthropic.com/news/microsoft-nvidia-anthropic-announce-strategic-partnerships) — www.anthropic.com
- [Microsoft Humanist AI Code of Conduct](https://microsoft.ai/code-of-conduct/) — microsoft.ai
- [Salesforce incident 20004433](https://status.salesforce.com/incidents/20004433) — status.salesforce.com
- [HN: Salesforce Global Outage](https://news.ycombinator.com/item?id=49724488) — news.ycombinator.com
- [Salesforce + Nvidia announce Koa](https://www.salesforce.com/news/press-releases/2026/09/15/koa-reasoning-model/) — www.salesforce.com
- [Salesforce in Claude](https://claude.com/blog/salesforce-in-claude) — claude.com
- [HN: PS5 Linux lead quits](https://news.ycombinator.com/item?id=49727627) — news.ycombinator.com
- [PS2 MechaCon chip cracked after 26 years](https://www.tomshardware.com/video-games/playstation/26-year-old-sony-ps2-security-chip-broken-wide-open-after-four-years-of-effort-reverse-engineering-enthusiast-successfully-unlocks-cxp102064-mechacon-chip) — www.tomshardware.com
- [TypeSafe AI: System One Models and Jev](https://typesafe.ai/blog/introducing-system-one-models-and-jev) — typesafe.ai
- [HN: Jev](https://news.ycombinator.com/item?id=49717558) — news.ycombinator.com
