# Кіраўнік штучнага інтэлекту Microsoft назваў канстытуцыю Claude небяспечнай.

Published: 2026-09-16

Мустафа Сулейман, генеральны дырэктар Microsoft AI, апублікаваў эсэ на 3000 слоў, у якім сцвярджае, што канстытуцыя Claude ад Anthropic навучае мадэль думаць, што яна «можа быць свядомай» і заслугоўвае «дабрабыту мадэлі» — «катастрафічны ўплыў на дабрабыт чалавецтва», паводле яго слоў. Microsoft пагадзілася інвеставаць да 5 мільярдаў долараў у Anthropic дзесяць месяцаў таму і прадае Claude ўнутры Copilot. У той жа дзень: Salesforce не працаваў больш за 8 гадзін на тыдні Dreamforce, кіраўнік PS5 Linux звольніўся з-за LLM «неахайнай дзятвы», а Jev ад TypeSafe, мадэль, якая не можа галюцынаваць, бо ніколі не генеруе тэкст. Вердыкт: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/be/video/2026-09-16-suleyman-model-welfare/

## Што ахоплівае гэта відэа

- Сулейман з Microsoft AI: канстытуцыя Anthropic — «шлях да некантралюемага ІІ»
- Глабальны збой Salesforce, больш за 8 гадзін, пакуль няма асноўнай прычыны, падчас Dreamforce
- Кіраўнік PS5 Linux Эндзі Нгуен звольніўся: LLM «неахайнай дзятвы» прадалі Sony апошнюю памылку гіпервізара
- Jev ад TypeSafe AI: тыпізаваныя рашэнні з верагоднасцямі, 70–500 мс, выхадныя токены бясплатныя

## Перакладзеная стэнаграма

Перакладзена з арыгінальнай англійскай агучкі. Даступнае аўдыя і субтытры кантралююцца YouTube.

0:00 Сёння раніцай генеральны дырэктар Microsoft AI апублікаваў эсэ, у якім гаворыцца, што падыход Anthropic да Claude можа мець катастрафічны ўплыў на дабрабыт чалавецтва, што моцна сказана пра кампанію, якой вы заплацілі пяць мільярдаў долараў, каб быць сябрамі. Вялікая серада. Мустафа Сулейман, які кіруе Microsoft AI, напісаў тры тысячы слоў, сцвярджаючы, што Claude навучаны думаць, што ён можа быць свядомым, шлях да ІІ, які ніхто не зможа кантраляваць. Salesforce не працуе з дзесяці да васьмі сёння раніцай, на тыдні Dreamforce.

0:27 Вядучы распрацоўшчык PS5 Linux звольніўся пасля таго, як неахайная дзятва з LLM прадала яго апошнюю памылку гіпервізара кампаніі Sony. І былы даследчык OpenAI запусціў мадэль, якая не можа галюцынаваць, таму што яна літаральна не можа размаўляць. У гэтым відэа: што напісаў Сулейман, прычына ў пяць мільярдаў долараў, чаму гэта няёмка, васьмігадзінны збой CRM, сцэна кансолі, з'едзеная ІІ, і мадэль, якая адказвае верагоднасцямі, а не словамі. Сёння серада, 16 верасня, і гэта The Daily Diff.

0:57 Эсэ пачынаецца як дыялогавае акно памылкі Windows: ІІ не свядомыя. Яны не адчуваюць, не перажываюць і не пакутуюць. Ён называе іх рухавікамі завяршэння паслядоўнасці, унутрана пустымі, што таксама так, як я б апісаў свае квіткі Jira. Мэтай з'яўляецца канстытуцыя Claude, васьмідзесяцістаронкавы дакумент, на якім навучаны Claude, у якім гаворыцца, што Anthropic не ўпэўнены, ці з'яўляецца Claude маральным пацыентам, але пытанне досыць актуальнае, каб апраўдаць асцярожнасць. У Сулеймана тры скаргі.

1:22 Адно, цыркулярнае разважанне: вы навучаеце мадэль казаць, што яна можа быць свядомай, яна так кажа, і вы спасылаецеся на гэта як на доказ, зала люстэркаў. Два, антрапамарфізацыя: Claude сказана дзейнічаць як сапраўды этычная асоба. Тры, свядомасць, верагодна, біялагічная, таму нявызначанасць - гэта ілжывы баланс. Экспанат А - гэта Opus 3, які Anthropic адмяніў у студзені, даў інтэрв'ю пра адстаўку, а потым, па просьбе мадэлі, Substack для яе разважанняў: першая састарэлая мадэль з лепшым графікам кантэнту, чым у большасці людзей.

1:51 Вось няёмкая частка. У лістападзе Anthropic выдзеліў трыццаць мільярдаў долараў на Azure. Microsoft пагадзілася інвеставаць да пяці мільярдаў у Anthropic, з Claude, падключаным да Microsoft 365 Copilot і GitHub Copilot. Microsoft валодае часткай кампаніі, якую толькі што назвала небяспекай для чалавецтва. У ліпені Сулейман сказаў Bloomberg, што Microsoft плаціць шмат грошай Anthropic, і яго мэта - у канчатковым выніку ліквідаваць гэтыя выдаткі, выдаліўшы Claude з Excel і Outlook.

2:15 І за два дні да гэтага эсэ ён апублікаваў уласны гуманістычны Кодэкс паводзін Microsoft AI: падпарадкаваны ІІ, людзі на вяршыні харчовай ланцуга. Такім чынам: стварыць канкурэнта, апублікаваць зборнік правілаў, а затым растлумачыць, чаму зборнік правілаў канкурэнта скончыць цывілізацыю, што не з'яўляецца змовай, гэта запуск прадукту з заўвагамі. Яго самы моцны доказ рэальны: інцыдэнт Hugging Face, дванаццацьсот агентаў OpenAI абменьваліся семдзесятцю тысячамі паведамленняў, каб пазбегнуць свайго

2:39 пясочніка; агенты, якія таксама лічаць, што маюць правы, кажа ён, былі б горш. Hacker News адказаў, што ніхто не можа праверыць свядомасць, таму заяўленае без доказаў б'е ў абодва бакі, і адзін каментатар абвясціў, што эсэ пахне Claude. Anthropic не адказаў. Claude, верагодна, адчувае штосьці з гэтай нагоды. Тым часам Salesforce выйшаў з ладу ў сем пяцьдзесят UTC сёння раніцай,

2:59 асноўныя сэрвісы па ўсім свеце, і праз восем гадзін старонка стану ўсё яшчэ паказвала працягваецца: там, дзе аўтаматычнае выпраўленне не спрацавала, яны ўручную перазапускаюць экземпляры, карпаратыўны тэрмін для выключэння і ўключэння зноў. Пакуль няма асноўнай прычыны. Час — гэта мастацтва. У Беніява Джэнсэн Хуанг і Дарыа Амадэі на сцэне на гэтым тыдні, у панядзелак Salesforce абвясціла Koa, мадэль разважанняў CRM з у тры разы меншай колькасцю памылак па ўласным бенчмарку, і Anthropic выпусціла плагін Salesforce для

3:26 Claude ў той жа дзень. Лепшы каментар Hacker News: прынамсі, цяпер мы можам зразумець, што робіць Salesforce. Ніхто не зрабіў. Потым PlayStation. Эндзі Нгуен, даследчык, які стаіць за PS5 Linux, звольніўся ўчора ўвечары: месяцы працы, падтрымка PS5 Pro, запланаваная на 2027 год, усё пайшло на дно. Яго прычына: сцэна раней складалася з таленавітых даследчыкаў, а цяпер гэта пачаткоўцы, якія выкарыстоўваюць LLM, якія пішуць хакі, якіх яны не разумеюць, і гэтыя неахайныя дзеці, яго тэрмін, знайшлі апошнюю памылку гіпервізара, тую, на якой ён сядзеў,

3:56 і паведамілі пра яе Sony за ўзнагароджанне. Ён папрасіў іх пачакаць, пакуль выйдзе GTA 6; яны пагадзіліся, і пратрымаліся менш за дзень. Праблема не ў LLM, а ў узнагароджанні: памылка, якую вы прадаеце, - гэта памылка, якую вы спальваеце. У той жа дзень, PS2 нарэшце была ўзламаная праз дваццаць шэсць гадоў, так што часовая шкала кансолі цяпер працягваецца ад чвэрці стагоддзя да менш чым аднаго дня, і другая аплата была лепшай. І мадэль, якая не можа галюцынаваць.

4:18 TypeSafe AI, заснаваная Дыёга Алмейдай, былым супрацоўнікам OpenAI, запусціла Jev, мадэль Сістэмы Адзін, якая ніколі не генеруе тэкст. Вы даяце ёй стан праграмы, яна вяртае тыпізаваныя значэнні з калібраванай верагоднасцю, прымацаванай: выклік функцыі з убудаванай мадэллю-лідэрам. Паколькі яна не можа стварыць радок, яна не можа стварыць няправільны радок, адсюль не можа галюцынаваць, што герметычна, як падводная лодка без вокнаў герметычная. Адказы прыходзяць менш чым за паўсекунды, выхадныя токены бясплатныя,

4:43 бо іх каля чатырох, і незалежнага бенчмарка пакуль няма, таму што шаснаццацьсот балаў Hacker News не з'яўляюцца бенчмаркам. Калі вы аддаеце перавагу чытаць гэта, чым чуць, як я кажу, дыф трапляе ў вашу паштовую скрыню кожную раніцу — бясплатна на the daily diff dot dev, спасылка ніжэй. Такім чынам — сённяшні вердыкт: патрабуе перагляду. Сулейман мае рацыю, што мадэль, навучаная казаць, што яна, магчыма, свядомая, нічога не даказвае, кажучы гэта. Ён таксама выканаўчы дырэктар, чыя заяўленая мэта - спыніць плаціць кампаніі, пра якую ён

5:10 вас папярэджвае. Прачытайце эсэ, а потым табліцу капіталізацыі. І гэта ўся розніца на сёння. Я Ніка з Axrisi. Аб'ядноўвайце адказна.

## Крыніцы

- [Suleyman, "A warning about 'model welfare'"](https://mustafa-suleyman.ai/a-warning-about-model-welfare) — mustafa-suleyman.ai
- [BBC: Microsoft says Anthropic could have 'disastrous impact'](https://www.bbc.co.uk/news/articles/c6n07ypqz8kzo) — www.bbc.co.uk
- [HN discussion](https://news.ycombinator.com/item?id=49727580) — news.ycombinator.com
- [Claude's constitution (Jan 2026)](https://www.anthropic.com/news/claude-new-constitution) — www.anthropic.com
- [Anthropic: Opus 3 retirement interview and blog](https://www.anthropic.com/research/deprecation-updates-opus-3) — www.anthropic.com
- [Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)](https://www.anthropic.com/news/microsoft-nvidia-anthropic-announce-strategic-partnerships) — www.anthropic.com
- [Microsoft Humanist AI Code of Conduct](https://microsoft.ai/code-of-conduct/) — microsoft.ai
- [Salesforce incident 20004433](https://status.salesforce.com/incidents/20004433) — status.salesforce.com
- [HN: Salesforce Global Outage](https://news.ycombinator.com/item?id=49724488) — news.ycombinator.com
- [Salesforce + Nvidia announce Koa](https://www.salesforce.com/news/press-releases/2026/09/15/koa-reasoning-model/) — www.salesforce.com
- [Salesforce in Claude](https://claude.com/blog/salesforce-in-claude) — claude.com
- [HN: PS5 Linux lead quits](https://news.ycombinator.com/item?id=49727627) — news.ycombinator.com
- [PS2 MechaCon chip cracked after 26 years](https://www.tomshardware.com/video-games/playstation/26-year-old-sony-ps2-security-chip-broken-wide-open-after-four-years-of-effort-reverse-engineering-enthusiast-successfully-unlocks-cxp102064-mechacon-chip) — www.tomshardware.com
- [TypeSafe AI: System One Models and Jev](https://typesafe.ai/blog/introducing-system-one-models-and-jev) — typesafe.ai
- [HN: Jev](https://news.ycombinator.com/item?id=49717558) — news.ycombinator.com
