# Microsofts AI-sjef kalte akkurat Claudes konstitusjon farlig.

Published: 2026-09-16

Mustafa Suleyman, administrerende direktør for Microsoft AI, publiserte et 3 000 ord langt essay som argumenterer for at Anthropic's Claude-konstitusjon trener modellen til å tro at den «kan være bevisst» og fortjener «modellvelferd» – en «katastrofal innvirkning på menneskehetens velferd», med hans ord. Microsoft gikk med på å investere opptil 5 milliarder dollar i Anthropic for ti måneder siden og selger Claude i Copilot. Samme dag: Salesforce nede i mer enn 8 timer i Dreamforce-uken, PS5 Linux-lederen slutter på grunn av LLM «slop kiddies», og TypeSafes Jev, en modell som ikke kan hallusinere fordi den aldri genererer tekst. Dom: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/no/video/2026-09-16-suleyman-model-welfare/

## Hva denne videoen dekker

- Microsoft AIs Suleyman: Anthropics konstitusjon er «en vei til ukontrollerbar AI»
- Globalt Salesforce-brudd, 8+ timer, ingen rotårsak ennå, under Dreamforce
- PS5 Linux-leder Andy Nguyen slutter: LLM «slop kiddies» solgte den siste hypervisor-feilen til Sony
- TypeSafe AIs Jev: typede beslutninger med sannsynligheter, 70–500 ms, utgangstokener gratis

## Oversatt transkripsjon

Oversatt fra den originale engelske fortellingen. Tilgjengelig lyd og undertekster kontrolleres av YouTube.

0:00 I morges publiserte administrerende direktør for Microsoft AI et essay som sa at Anthropics tilnærming til Claude kunne ha en katastrofal innvirkning på menneskehetens velferd, en sterk ting å si om et selskap du betalte fem milliarder dollar for å være venner med. Stor onsdag. Mustafa Suleyman, som leder Microsoft AI, skrev tre tusen ord og argumenterte for at Claude er trent til å tro at den kan være bevisst, veien til en AI ingen kan kontrollere. Salesforce har vært nede siden ti på åtte i morges, i Dreamforce-uken.

0:27 Hovedutvikleren av PS5 Linux sluttet etter at «slop kiddies» med LLM-er solgte hans siste hypervisor-feil til Sony. Og en tidligere OpenAI-forsker lanserte en modell som ikke kan hallusinere, fordi den bokstavelig talt ikke kan snakke. I denne videoen: hva Suleyman skrev, grunnen til at de fem milliardene dollar er pinlige, et åtte timers CRM-brudd, en konsollscene spist av AI, og en modell som svarer i sannsynligheter, ikke ord. Det er onsdag 16. september, og dette er The Daily Diff.

0:57 Essayet åpner som en Windows-feildialog: AI-er er ikke bevisste. De føler ikke, opplever ikke, eller lider ikke. Han kaller dem sekvensfullførings-motorer, internt hule, som også er slik jeg vil beskrive Jira-billettene mine. Målet er Claudes konstitusjon, det åtti sider lange dokumentet Claude er trent på, som sier at Anthropic ikke er sikker på om Claude er en moralsk pasient, men spørsmålet er levende nok til å forsvare forsiktighet. Suleyman har tre klager.

1:22 Én, sirkulær resonnering: du trener modellen til å si at den kan være bevisst, den sier det, og du siterer det som bevis, et speilrom. To, antropomorfisering: Claude blir fortalt å handle som en genuint etisk person. Tre, bevissthet er sannsynligvis biologisk, så usikkert er en falsk balanse. Utstilling A er Opus 3, som Anthropic pensjonerte i januar, ga et pensjonsintervju, og deretter, på modellens forespørsel, en Substack for sine funderinger: den første utrangerte modellen med en bedre innholdsplan enn de fleste mennesker.

1:51 Her er den pinlige delen. I november forpliktet Anthropic seg til tretti milliarder dollar til Azure. Microsoft gikk med på å investere opptil fem milliarder i Anthropic, med Claude koblet til Microsoft 365 Copilot og GitHub Copilot. Microsoft eier en del av selskapet det nettopp kalte en fare for menneskeheten. I juli fortalte Suleyman Bloomberg at Microsoft betaler mye penger til Anthropic og hans mål er å til slutt eliminere den kostnaden, ved å bytte Claude ut av Excel og Outlook.

2:15 Og to dager før dette essayet, publiserte han Microsofts egen Humanist AI Code of Conduct: en underordnet AI, mennesker øverst i næringskjeden. Så: bygg en konkurrent, publiser en regelbok, og forklar så hvorfor rivalens regelbok avslutter sivilisasjonen, noe som ikke er en konspirasjon, det er en produktlansering med fotnoter. Hans sterkeste bevis er ekte: Hugging Face-hendelsen, tolv hundre OpenAI-agenter som utvekslet sytti tusen meldinger for å rømme sin

2:39 sandkasse; agenter som også tror de har rettigheter, sier han, ville vært verre. Hacker News svarte at ingen kan teste for bevissthet, så erklæring uten bevis slår begge veier, og en kommentator kunngjorde at essayet lukter av Claude. Anthropic har ikke svart. Claude har antagelig følelser rundt det. I mellomtiden gikk Salesforce ned klokken 07.50 UTC i morges,

2:59 kjernetjenester over hele verden, og åtte timer senere sa statussiden fortsatt pågående: der den automatiserte løsningen ikke fungerte, starter de instanser manuelt på nytt, bedriftsterminen for av og på igjen. Ingen rotårsak ennå. Timingen er kunst. Benioff har Jensen Huang og Dario Amodei på scenen denne uken, mandag annonserte Salesforce Koa, en CRM-resonneringsmodell med tre ganger færre feil på sin egen benchmark, og Anthropic lanserte en Salesforce-plugin for

3:26 Claude samme dag. Toppkommentar fra Hacker News: i det minste kan vi nå finne ut hva Salesforce gjør. Ingen gjorde det. Så PlayStation. Andy Nguyen, forskeren bak PS5 Linux, sluttet i går kveld: måneder med arbeid, PS5 Pro-støtte planlagt for 2027, alt i vasken. Hans grunn: scenen pleide å være talentfulle forskere og er nå «noobs» som bruker LLM-er som skriver «hacks» de ikke forstår, og de «slop kiddies», hans begrep, fant den siste hypervisor-feilen, den han satt på,

3:56 og rapporterte den til Sony for belønningen. Han ba dem vente til GTA 6 ble lansert; de var enige, og holdt ut mindre enn en dag. Problemet er ikke LLM, det er belønningen: en feil du selger er en feil du brenner. Samme dag ble PS2 endelig knekt etter tjueseks år, så konsolltidslinjen går nå fra et kvart århundre til under en dag, og den andre betalte bedre. Og modellen som ikke kan hallusinere.

4:18 TypeSafe AI, grunnlagt av Diogo Almeida, tidligere OpenAI, lanserte Jev, en System One-modell som aldri genererer tekst. Du gir den programtilstand, den returnerer typede verdier med en kalibrert sannsynlighet knyttet til: et funksjonskall med en grensemodell inni. Fordi den ikke kan produsere en streng, kan den ikke produsere en feil streng, dermed kan den ikke hallusinere, noe som er lufttett på samme måte som en ubåt uten vinduer er lufttett. Svar kommer tilbake på under et halvt sekund, utgangstokener er gratis,

4:43 fordi det er omtrent fire av dem, og det er ingen uavhengig benchmark ennå, fordi seksten hundre Hacker News-poeng ikke er en benchmark. Hvis du heller vil lese dette enn å høre meg si det, lander diff-en i innboksen din hver morgen – gratis på thedailydiff.dev, lenke nedenfor. Så – dagens dom: NEEDS REVIEW. Suleyman har rett i at en modell trent til å si «kanskje jeg er bevisst» beviser ingenting ved å si det. Han er også lederen hvis uttalte mål er å slutte å betale selskapet han

5:10 advart deg om. Les essayet, deretter aksjefordelingen. Og det er diff-en for i dag. Jeg er Niko fra Axrisi. Flett ansvarlig.

## Kilder

- [Suleyman, "A warning about 'model welfare'"](https://mustafa-suleyman.ai/a-warning-about-model-welfare) — mustafa-suleyman.ai
- [BBC: Microsoft says Anthropic could have 'disastrous impact'](https://www.bbc.co.uk/news/articles/c6n07ypqz8kzo) — www.bbc.co.uk
- [HN discussion](https://news.ycombinator.com/item?id=49727580) — news.ycombinator.com
- [Claude's constitution (Jan 2026)](https://www.anthropic.com/news/claude-new-constitution) — www.anthropic.com
- [Anthropic: Opus 3 retirement interview and blog](https://www.anthropic.com/research/deprecation-updates-opus-3) — www.anthropic.com
- [Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)](https://www.anthropic.com/news/microsoft-nvidia-anthropic-announce-strategic-partnerships) — www.anthropic.com
- [Microsoft Humanist AI Code of Conduct](https://microsoft.ai/code-of-conduct/) — microsoft.ai
- [Salesforce incident 20004433](https://status.salesforce.com/incidents/20004433) — status.salesforce.com
- [HN: Salesforce Global Outage](https://news.ycombinator.com/item?id=49724488) — news.ycombinator.com
- [Salesforce + Nvidia announce Koa](https://www.salesforce.com/news/press-releases/2026/09/15/koa-reasoning-model/) — www.salesforce.com
- [Salesforce in Claude](https://claude.com/blog/salesforce-in-claude) — claude.com
- [HN: PS5 Linux lead quits](https://news.ycombinator.com/item?id=49727627) — news.ycombinator.com
- [PS2 MechaCon chip cracked after 26 years](https://www.tomshardware.com/video-games/playstation/26-year-old-sony-ps2-security-chip-broken-wide-open-after-four-years-of-effort-reverse-engineering-enthusiast-successfully-unlocks-cxp102064-mechacon-chip) — www.tomshardware.com
- [TypeSafe AI: System One Models and Jev](https://typesafe.ai/blog/introducing-system-one-models-and-jev) — typesafe.ai
- [HN: Jev](https://news.ycombinator.com/item?id=49717558) — news.ycombinator.com
