# Tinawag ng hepe ng AI ng Microsoft ang konstitusyon ni Claude na mapanganib.

Published: 2026-09-16

Si Mustafa Suleyman, CEO ng Microsoft AI, ay naglathala ng isang 3,000-salitang sanaysay na nagsasabing ang konstitusyon ni Claude ng Anthropic ay nagsasanay sa modelo na isipin na ito "ay maaaring may kamalayan" at karapat-dapat sa "kapakanan ng modelo" — isang "mapaminsalang epekto sa kapakanan ng sangkatauhan", sa kanyang mga salita. Sumang-ayon ang Microsoft na mamuhunan ng hanggang $5 bilyon sa Anthropic sampung buwan na ang nakakaraan at nagbebenta ng Claude sa loob ng Copilot. Sa parehong araw: Ang Salesforce ay bumagsak nang 8+ oras sa linggo ng Dreamforce, ang PS5 Linux lead ay nag-quit dahil sa LLM "slop kiddies", at ang Jev ng TypeSafe, isang modelo na hindi makapag-hallucinate dahil hindi ito kailanman bumubuo ng teksto. Hatol: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/fil/video/2026-09-16-suleyman-model-welfare/

## Ang sakop ng video na ito

- Suleyman ng Microsoft AI: Ang konstitusyon ng Anthropic ay "isang daan tungo sa hindi makontrol na AI"
- Salesforce global outage, 8+ oras, walang ugat na sanhi pa, sa panahon ng Dreamforce
- Umalis ang PS5 Linux lead na si Andy Nguyen: Ibinenta ng LLM "slop kiddies" ang huling hypervisor bug sa Sony
- Jev ng TypeSafe AI: mga naka-type na desisyon na may probabilidad, 70–500 ms, libre ang output tokens

## Isinaling transcript

Isinalin mula sa orihinal na salaysay sa English. Ang available na audio at mga caption ay kinokontrol ng YouTube.

0:00 Ngayong umaga ang CEO ng Microsoft AI ay naglathala ng isang sanaysay na nagsasabing ang pamamaraan ng Anthropic kay Claude ay maaaring magkaroon ng mapaminsalang epekto sa kapakanan ng sangkatauhan, isang malakas na pahayag na sasabihin tungkol sa isang kumpanya na binayaran mo ng limang bilyong dolyar upang maging magkaibigan. Malaking Miyerkules. Si Mustafa Suleyman, na nagpapatakbo ng Microsoft AI, ay sumulat ng tatlong libong salita na nagsasabing sanay si Claude na isipin na ito ay maaaring may kamalayan, ang daan patungo sa isang AI na walang sinuman ang makakakontrol. Bumagsak ang Salesforce mula alas-siete y medya ngayong umaga, sa Dreamforce week.

0:27 Umalis ang lead developer ng PS5 Linux matapos ang mga slop kiddies na may LLM ay ibinenta ang kanyang huling hypervisor bug sa Sony. At isang dating OpenAI researcher ang naglunsad ng isang modelo na hindi makapag-hallucinate, dahil literal na hindi ito makapagsalita. Sa video na ito: kung ano ang isinulat ni Suleyman, ang limang bilyong dolyar na dahilan kung bakit ito ay nakakahiya, isang walong oras na CRM outage, isang console scene na kinain ng AI, at isang modelo na sumasagot sa mga probabilidad, hindi sa mga salita. Miyerkules, Setyembre 16, at ito ang The Daily Diff.

0:57 Ang sanaysay ay nagsisimula tulad ng isang Windows error dialog: Hindi may kamalayan ang mga AI. Hindi sila nakakaramdam, nakakaranas, o naghihirap. Tinawag niya silang sequence completion engines, na walang laman sa loob, na siyang paraan din ng paglalarawan ko sa aking mga Jira ticket. Ang target ay ang konstitusyon ni Claude, ang walong puluhang pahina na dokumento na sinasanay si Claude, na nagsasabing hindi sigurado ang Anthropic kung si Claude ay isang moral na pasyente, ngunit ang tanong ay sapat na buhay upang maging maingat. May tatlong reklamo si Suleyman.

1:22 Una, circular reasoning: sinasanay mo ang modelo na sabihing baka may kamalayan ito, sinasabi nito, at sinipi mo iyon bilang ebidensya, isang bulwagan ng mga salamin. Pangalawa, anthropomorphization: sinasabihan si Claude na kumilos tulad ng isang tunay na etikal na tao. Pangatlo, ang kamalayan ay marahil biological, kaya ang "hindi sigurado" ay maling balanse. Ang Exhibit A ay ang Opus 3, na ipinaretire ng Anthropic noong Enero, nagbigay ng retirement interview, at pagkatapos, sa kahilingan ng modelo, isang Substack para sa mga musings nito: ang unang deprecated na modelo na may mas mahusay na iskedyul ng nilalaman kaysa sa karamihan ng mga tao.

1:51 Narito ang nakakahiya na bahagi. Noong Nobyembre, ipinangako ng Anthropic ang tatlumpung bilyong dolyar sa Azure. Sumang-ayon ang Microsoft na mamuhunan ng hanggang limang bilyon sa Anthropic, na may Claude na nakakonekta sa Microsoft 365 Copilot at GitHub Copilot. Pag-aari ng Microsoft ang isang bahagi ng kumpanya na tinawag nitong peligro sa sangkatauhan. Noong Hulyo, sinabi ni Suleyman sa Bloomberg na malaki ang binabayaran ng Microsoft sa Anthropic at ang kanyang layunin ay tuluyang alisin ang gastos na iyon, sa pamamagitan ng pagpapalit kay Claude sa Excel at Outlook.

2:15 At dalawang araw bago ang sanaysay na ito, siya ay naglathala ng sariling Humanist AI Code ng Microsoft Conduct: isang subordinadong AI, mga tao sa tuktok ng food chain. Kaya: bumuo ng kalaban, maglathala ng rulebook, pagkatapos ay ipaliwanag kung bakit ang rulebook ng kalaban ay magtatapos sa sibilisasyon, na hindi isang konspirasyon, ito ay isang paglulunsad ng produkto na may mga talababa. Ang pinakamalakas niyang ebidensya ay totoo: ang insidente sa Hugging Face, labindalawang daang ahente ng OpenAI na nagpapalitan ng pitumpung libong mensahe upang makatakas sa kanilang

2:39 sandbox; ang mga ahente na naniniwala rin na mayroon silang karapatan, sabi niya, ay mas masahol pa. Sumagot ang Hacker News na walang sinumang makakapag-test para sa kamalayan, kaya ang pahayag na walang ebidensya ay parehong may panig, at isang komentarista ang nag-anunsyo na ang sanaysay ay mabaho kay Claude. Hindi pa sumasagot ang Anthropic. Si Claude, malamang, ay may damdamin tungkol doon. Samantala, bumagsak ang Salesforce bandang alas-siete y singkwenta ng umaga UTC kaninang umaga,

2:59 pangunahing serbisyo sa buong mundo, at walong oras pagkatapos ay 'ongoing' pa rin ang status page: kung saan hindi gumana ang awtomatikong pag-aayos, manu-mano nilang nire-restart ang mga instance, ang enterprise term para sa off at on ulit. Wala pang ugat na dahilan. Ang tiyempo ay sining. Si Benioff ay mayroong Jensen Huang at Dario Amodei sa entablado ngayong linggo, noong Lunes inihayag ng Salesforce ang Koa, isang modelo ng CRM reasoning na may tatlong beses na mas kaunting error sa sarili nitong benchmark, at ang Anthropic ay nagpadala ng Salesforce plugin para kay

3:26 Claude sa parehong araw. Pinakamataas na komento sa Hacker News: at least ngayon malalaman na natin kung ano ang ginagawa ng Salesforce. Walang gumawa. Tapos ang PlayStation. Si Andy Nguyen, ang researcher sa likod ng PS5 Linux, ay umalis kagabi: buwan ng trabaho, PS5 Pro support na pinlano para sa 2027, lahat ay nasayang. Ang kanyang dahilan: ang eksena dati ay mga talentadong researcher at ngayon ay mga noobs na gumagamit ng LLM na nagsusulat ng mga hack na hindi nila naiintindihan, at ang mga slop kiddies na iyon, ang kanyang termino, ay nakahanap ng huling hypervisor bug, ang isa na pinanatili niya,

3:56 at iniulat ito sa Sony para sa bounty. Hiniling niya sa kanila na maghintay hanggang mailabas ang GTA 6; sumang-ayon sila, at hindi tumagal ng isang araw. Ang problema ay hindi ang LLM, kundi ang bounty: isang bug na ibinebenta mo ay isang bug na sinunog mo. Sa parehong araw, ang PS2 ay tuluyang na-crack pagkatapos ng dalawampu't anim na taon, kaya ang timeline ng console ngayon ay mula sa isang quarter century hanggang sa wala pang isang araw, at ang pangalawa ay mas malaki ang bayad. At ang modelo na hindi makapag-hallucinate.

4:18 Ang TypeSafe AI, na itinatag ni Diogo Almeida, dating OpenAI, ay naglunsad ng Jev, isang System One model na hindi kailanman gumagawa ng teksto. Binibigyan mo ito ng program state, nagbabalik ito ng mga naka-type na halaga na may calibrated na probabilidad na nakakabit: isang function call na may frontier model sa loob. Dahil hindi ito makakagawa ng string, hindi ito makakagawa ng maling string, kaya hindi ito makapag-hallucinate, na selyado sa paraang ang isang submarino na walang mga bintana ay selyado. Ang mga tugon ay bumabalik sa ilalim ng kalahating segundo, ang mga output token ay libre,

4:43 dahil mayroong mga apat sa kanila, at wala pang independiyenteng benchmark, dahil ang labing-anim na daang Hacker News points ay hindi isang benchmark. Kung mas gusto mong basahin ito kaysa pakinggan akong sabihin, ang diff ay dumarating sa iyong inbox tuwing umaga — libre sa the daily diff dot dev, link sa ibaba. Kaya — ang hatol ngayon: NEEDS REVIEW. Tama si Suleyman na ang isang modelo na sinanay na sabihing baka may kamalayan ako ay nagpapatunay na walang anuman sa pagsasabi nito. Siya rin ang executive na ang nakasaad na layunin ay tigilan ang pagbabayad sa kumpanya na kanyang

5:10 pinagbabalaan sa iyo. Basahin ang sanaysay, pagkatapos ang cap table. At iyan ang diff para ngayon. Ako si Niko mula sa Axrisi. Merge responsibly.

## Mga Pinagmulan

- [Suleyman, "A warning about 'model welfare'"](https://mustafa-suleyman.ai/a-warning-about-model-welfare) — mustafa-suleyman.ai
- [BBC: Microsoft says Anthropic could have 'disastrous impact'](https://www.bbc.co.uk/news/articles/c6n07ypqz8kzo) — www.bbc.co.uk
- [HN discussion](https://news.ycombinator.com/item?id=49727580) — news.ycombinator.com
- [Claude's constitution (Jan 2026)](https://www.anthropic.com/news/claude-new-constitution) — www.anthropic.com
- [Anthropic: Opus 3 retirement interview and blog](https://www.anthropic.com/research/deprecation-updates-opus-3) — www.anthropic.com
- [Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)](https://www.anthropic.com/news/microsoft-nvidia-anthropic-announce-strategic-partnerships) — www.anthropic.com
- [Microsoft Humanist AI Code of Conduct](https://microsoft.ai/code-of-conduct/) — microsoft.ai
- [Salesforce incident 20004433](https://status.salesforce.com/incidents/20004433) — status.salesforce.com
- [HN: Salesforce Global Outage](https://news.ycombinator.com/item?id=49724488) — news.ycombinator.com
- [Salesforce + Nvidia announce Koa](https://www.salesforce.com/news/press-releases/2026/09/15/koa-reasoning-model/) — www.salesforce.com
- [Salesforce in Claude](https://claude.com/blog/salesforce-in-claude) — claude.com
- [HN: PS5 Linux lead quits](https://news.ycombinator.com/item?id=49727627) — news.ycombinator.com
- [PS2 MechaCon chip cracked after 26 years](https://www.tomshardware.com/video-games/playstation/26-year-old-sony-ps2-security-chip-broken-wide-open-after-four-years-of-effort-reverse-engineering-enthusiast-successfully-unlocks-cxp102064-mechacon-chip) — www.tomshardware.com
- [TypeSafe AI: System One Models and Jev](https://typesafe.ai/blog/introducing-system-one-models-and-jev) — typesafe.ai
- [HN: Jev](https://news.ycombinator.com/item?id=49717558) — news.ycombinator.com
