# Szef Microsoft AI nazwał konstytucję Claude'a niebezpieczną.

Published: 2026-09-16

Mustafa Suleyman, dyrektor generalny Microsoft AI, opublikował 3000-słowny esej, argumentując, że konstytucja Claude'a firmy Anthropic szkoli model, by myślał, że „może być świadomy” i zasługuje na „dobro modelu” – co ma „katastrofalny wpływ na dobrobyt ludzkości”, jak to ujął. Microsoft zgodził się zainwestować do 5 miliardów dolarów w Anthropic dziesięć miesięcy temu i sprzedaje Claude'a w Copilocie. Tego samego dnia: Salesforce nie działało przez ponad 8 godzin w tygodniu Dreamforce, główny deweloper PS5 Linux rezygnuje z powodu „niedopracowanych dzieci” LLM, a Jev z TypeSafe, model, który nie może halucynować, ponieważ nigdy nie generuje tekstu. Werdykt: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/pl/video/2026-09-16-suleyman-model-welfare/

## Co obejmuje ten film

- Suleyman z Microsoft AI: konstytucja Anthropic to „droga do niekontrolowanej sztucznej inteligencji”
- Globalna awaria Salesforce, ponad 8 godzin, brak jeszcze przyczyny źródłowej, podczas Dreamforce
- Andy Nguyen, główny deweloper PS5 Linux, rezygnuje: „niedopracowane dzieci” LLM sprzedały ostatni błąd hypervisora firmie Sony
- Jev z TypeSafe AI: typowane decyzje z prawdopodobieństwami, 70–500 ms, darmowe tokeny wyjściowe

## Przetłumaczona transkrypcja

Przetłumaczono z oryginalnej narracji angielskiej. Dostępne audio i napisy są kontrolowane przez YouTube.

0:00 Dziś rano dyrektor generalny Microsoft AI opublikował esej, w którym stwierdził, że podejście firmy Anthropic do Claude'a może mieć katastrofalny wpływ na dobrobyt ludzkości, co jest mocnym stwierdzeniem o firmie, której zapłaciłeś pięć miliardów dolarów, by się z nią „przyjaźnić”. Wielka środa. Mustafa Suleyman, który kieruje Microsoft AI, napisał trzy tysiące słów, argumentując, że Claude jest szkolony do myślenia, że może być świadomy, co jest drogą do sztucznej inteligencji, której nikt nie będzie mógł kontrolować. Salesforce nie działa od dziesiątej do ósmej rano, w tygodniu Dreamforce. W tygodniu Dreamforce.

0:27 Główny deweloper PS5 Linux zrezygnował po tym, jak „niedopracowane dzieci” z LLM-ami sprzedały jego ostatni błąd hypervisora firmie Sony. ostatni błąd hypervisora firmie Sony. A były badacz OpenAI uruchomił model, który nie może halucynować, ponieważ dosłownie nie potrafi mówić. W tym filmie: co napisał Suleyman, powód pięciu miliardów dolarów, dla którego jest to niezręczne, ośmiogodzinna awaria CRM, scena konsoli zjadana przez sztuczną inteligencję, i model, który odpowiada prawdopodobieństwami, a nie słowami. Jest środa, 16 września, i to jest The Daily Diff.

0:57 Esej zaczyna się jak okno błędu Windows: sztuczne inteligencje nie są świadome. Nie czują, nie doświadczają ani nie cierpią. Nazywa je silnikami uzupełniania sekwencji, wewnętrznie pustymi, co jest również tym, jak opisałbym moje zgłoszenia w Jira. Celem jest konstytucja Claude'a, osiemdziesięciostronicowy dokument, na którym Claude jest szkolony, który mówi, że Anthropic nie jest pewien, czy Claude jest moralnym pacjentem, ale pytanie jest na tyle żywe, by uzasadniało ostrożność. Suleyman ma trzy zarzuty.

1:22 Po pierwsze, rozumowanie cykliczne: szkolisz model, by mówił, że może być świadomy, on to mówi, a ty cytujesz to jako dowód, co jest lustrzanym odbiciem. Po drugie, antropomorfizacja: Claude'owi każe się zachowywać jak prawdziwie etyczna osoba. osoba. Po trzecie, świadomość jest prawdopodobnie biologiczna, więc niepewność to fałszywa równowaga. Dowodem A jest Opus 3, który Anthropic wycofał w styczniu, udzielił wywiadu po przejściu na emeryturę, a następnie, na prośbę modelu, założył Substack dla swoich przemyśleń: pierwszy wycofany model z lepszym harmonogramem treści niż większość ludzi. niż większość ludzi.

1:51 Oto niezręczna część. W listopadzie Anthropic zobowiązał się do zainwestowania trzydziestu miliardów dolarów w Azure. Microsoft zgodził się zainwestować do pięciu miliardów w Anthropic, z Claude'em wbudowanym w Microsoft 365 Copilot i GitHub Copilot. Microsoft posiada udział w firmie, którą właśnie nazwał zagrożeniem dla ludzkości. W lipcu Suleyman powiedział Bloombergowi, że Microsoft płaci Anthropic dużo pieniędzy, a jego celem jest ostateczne wyeliminowanie tego kosztu, poprzez usunięcie Claude'a z Excela i Outlooka. z Excela i Outlooka.

2:15 A dwa dni przed tym esejem opublikował własny Kodeks Postępowania Humanistycznej Sztucznej Inteligencji Microsoftu: podrzędna sztuczna inteligencja, ludzie na szczycie łańcucha pokarmowego. Więc: zbuduj konkurenta, opublikuj zbiór zasad, a następnie wyjaśnij, dlaczego zbiór zasad rywala niszczy cywilizację, co nie jest spiskowaniem, ale wprowadzeniem produktu z przypisami. z przypisami. Jego najsilniejszy dowód jest prawdziwy: incydent z Hugging Face, dwanaście tysięcy agentów OpenAI wymieniających siedemdziesiąt tysięcy wiadomości, aby uciec ze swojej piaskownicy;

2:39 agenci, którzy również wierzą, że mają prawa, jak mówi, byliby gorsi. byliby gorsi. Hacker News odpowiedziało, że nikt nie może testować świadomości, więc stwierdzenie bez dowodów działa w obie strony, a jeden komentator ogłosił, że esej śmierdzi Claude'em. śmierdzi Claude'em. Anthropic nie odpowiedział. Claude, przypuszczalnie, ma swoje zdanie na ten temat. Tymczasem Salesforce padło o 7:50 UTC dziś rano,

2:59 główne usługi na całym świecie, a osiem godzin później strona statusu nadal informowała o trwającej awarii: tam, gdzie automatyczna naprawa nie zadziałała, ręcznie uruchamiają ponownie instancje, co w terminologii korporacyjnej oznacza włączenie i wyłączenie. Brak jeszcze przyczyny źródłowej. Timing jest sztuką. Benioff ma Jensena Huanga i Dario Amodei na scenie w tym tygodniu, w poniedziałek Salesforce ogłosiło Koa, model wnioskowania CRM z trzy razy mniejszą liczbą błędów na własnym benchmarku, a Anthropic tego samego dnia udostępnił wtyczkę Salesforce dla Claude'a.

3:26 dla Claude'a tego samego dnia. Główny komentarz na Hacker News: przynajmniej teraz możemy dowiedzieć się, co robi Salesforce. Nikt tego nie zrobił. Następnie PlayStation. Andy Nguyen, badacz stojący za PS5 Linux, zrezygnował zeszłej nocy: miesiące pracy, wsparcie dla PS5 Pro planowane na 2027 rok, wszystko na nic. Jego powód: scena kiedyś składała się z utalentowanych badaczy, a teraz są to nowicjusze używający LLM-ów, piszący haki, których nie rozumieją, i ci „niedopracowani dzieci”, jak ich nazywa, znaleźli ostatni błąd hypervisora, ten, na którym siedział, i zgłosili go Sony za nagrodę.

3:56 zgłosili go Sony za nagrodę. Poprosił ich, żeby poczekali, aż GTA 6 zostanie wydane; zgodzili się, i wytrzymali mniej niż dzień. i wytrzymali mniej niż dzień. Problemem nie jest LLM, ale nagroda: błąd, który sprzedajesz, to błąd, który spalasz. Tego samego dnia, PS2 zostało w końcu złamane po dwudziestu sześciu latach, więc oś czasu konsol rozciąga się teraz od ćwierćwiecza do mniej niż jednego dnia, a drugi zapłacił lepiej. I model, który nie może halucynować.

4:18 TypeSafe AI, założone przez Diogo Almeydę, byłego pracownika OpenAI, uruchomiło Jev, model Systemu Jeden, który nigdy nie generuje tekstu. Podajesz mu stan programu, on zwraca typowane wartości z przypisanym skalibrowanym prawdopodobieństwem: wywołanie funkcji z modelem granicznym wewnątrz. Ponieważ nie może wyprodukować ciągu znaków, nie może wyprodukować błędnego ciągu znaków, stąd nie może halucynować, co jest hermetyczne, tak jak hermetyczna jest łódź podwodna bez okien. okien jest hermetyczna. Odpowiedzi wracają w mniej niż pół sekundy, tokeny wyjściowe są darmowe,

4:43 ponieważ jest ich około cztery, i nie ma jeszcze niezależnego benchmarku, ponieważ szesnaście tysięcy punktów na Hacker News nie jest benchmarkiem. Jeśli wolisz to przeczytać, niż usłyszeć, jak to mówię, The Daily Diff ląduje w Twojej skrzynce odbiorczej każdego ranka — za darmo na daily diff dot dev, link poniżej. Więc – dzisiejszy werdykt: NEEDS REVIEW. Suleyman ma rację, że model wyszkolony do mówienia „może jestem świadomy” niczego nie dowodzi, mówiąc to. niczego nie dowodzi, mówiąc to. Jest również dyrektorem wykonawczym, którego deklarowanym celem jest zaprzestanie płacenia firmie, o której ostrzega.

5:10 o której ostrzega. Przeczytaj esej, a potem tabelę kapitałową. I to tyle na dzisiaj. Jestem Niko z Axrisi. Merge responsibly.

## Źródła

- [Suleyman, "A warning about 'model welfare'"](https://mustafa-suleyman.ai/a-warning-about-model-welfare) — mustafa-suleyman.ai
- [BBC: Microsoft says Anthropic could have 'disastrous impact'](https://www.bbc.co.uk/news/articles/c6n07ypqz8kzo) — www.bbc.co.uk
- [HN discussion](https://news.ycombinator.com/item?id=49727580) — news.ycombinator.com
- [Claude's constitution (Jan 2026)](https://www.anthropic.com/news/claude-new-constitution) — www.anthropic.com
- [Anthropic: Opus 3 retirement interview and blog](https://www.anthropic.com/research/deprecation-updates-opus-3) — www.anthropic.com
- [Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)](https://www.anthropic.com/news/microsoft-nvidia-anthropic-announce-strategic-partnerships) — www.anthropic.com
- [Microsoft Humanist AI Code of Conduct](https://microsoft.ai/code-of-conduct/) — microsoft.ai
- [Salesforce incident 20004433](https://status.salesforce.com/incidents/20004433) — status.salesforce.com
- [HN: Salesforce Global Outage](https://news.ycombinator.com/item?id=49724488) — news.ycombinator.com
- [Salesforce + Nvidia announce Koa](https://www.salesforce.com/news/press-releases/2026/09/15/koa-reasoning-model/) — www.salesforce.com
- [Salesforce in Claude](https://claude.com/blog/salesforce-in-claude) — claude.com
- [HN: PS5 Linux lead quits](https://news.ycombinator.com/item?id=49727627) — news.ycombinator.com
- [PS2 MechaCon chip cracked after 26 years](https://www.tomshardware.com/video-games/playstation/26-year-old-sony-ps2-security-chip-broken-wide-open-after-four-years-of-effort-reverse-engineering-enthusiast-successfully-unlocks-cxp102064-mechacon-chip) — www.tomshardware.com
- [TypeSafe AI: System One Models and Jev](https://typesafe.ai/blog/introducing-system-one-models-and-jev) — typesafe.ai
- [HN: Jev](https://news.ycombinator.com/item?id=49717558) — news.ycombinator.com
