# 微软人工智能主管称Claude的“宪法”很危险。

Published: 2026-09-16

微软人工智能首席执行官穆斯塔法·苏莱曼发表了一篇3000字的文章，认为Anthropic的Claude宪法训练模型认为它“可能有意识”并值得“模型福利”——用他的话说，这“对人类福祉造成灾难性影响”。微软在十个月前同意向Anthropic投资高达50亿美元，并在Copilot中销售Claude。同一天：Salesforce在Dreamforce周停机超过8小时，PS5 Linux负责人因LLM“懒散小鬼”辞职，以及TypeSafe的Jev，一个因为从不生成文本而不会产生幻觉的模型。判决：NEEDS REVIEW。

Canonical: https://thedailydiff.dev/zh-CN/video/2026-09-16-suleyman-model-welfare/

## 本视频涵盖的内容

- 微软人工智能的苏莱曼：Anthropic的“宪法”是“通向不可控人工智能的道路”
- Salesforce全球范围中断，超过8小时，尚无根本原因，发生在Dreamforce期间
- PS5 Linux负责人Andy Nguyen辞职：LLM“懒散小鬼”将最后的虚拟机监控程序漏洞卖给了索尼
- TypeSafe AI的Jev：带有概率的类型化决策，70-500毫秒，输出令牌免费

## 翻译的文字记录

译自英文原版旁白。可用音频和字幕由 YouTube 控制。

0:00 今天上午，微软人工智能的首席执行官发表了一篇文章，称Anthropic的 Claude方法可能对人类的福祉产生灾难性影响， 对于你付了50亿美元与之成为朋友的公司来说，这是很强硬的说法。 大周三。 负责微软人工智能的穆斯塔法·苏莱曼写了三千字，论证 Claude被训练成认为自己可能有意识，这是一条通往无人能控制的人工智能的道路。 Salesforce从今天早上七点五十开始停机， 在Dreamforce周期间。

0:27 PS5 Linux的首席开发人员在LLM的“懒散小鬼”们将他 最后一个虚拟机监控程序漏洞卖给索尼后辞职了。 一位前OpenAI研究员推出了一种不会产生幻觉的模型， 因为它实际上不能说话。 在此视频中：苏莱曼写了什么，50亿美元的尴尬原因， 八小时的CRM中断，被人工智能吞噬的游戏机场景， 以及一个以概率而非文字回答的模型。 今天是9月16日，星期三，这里是The Daily Diff。

0:57 文章开头就像一个Windows错误对话框：人工智能没有意识。 它们不感受、不体验、不痛苦。 他称它们为序列完成引擎，内部空洞， 这和我描述我的Jira工单的方式一样。 目标是Claude的“宪法”，Claude赖以训练的八十页文档， 其中提到Anthropic不确定Claude是否具有道德主体性， 但这个问题足够重要，值得谨慎对待。 苏莱曼有三个不满。

1:22 第一，循环推理：你训练模型说它可能有意识， 它这么说了，你就把它作为证据引用，这是一个镜子迷宫。 第二，拟人化：Claude被告知要像一个真正有道德的人那样行事。 第三，意识很可能是生物性的，所以“不确定”是一种错误的平衡。 例证A是Anthropic在一月份退役的Opus 3， Opus 3接受了退役采访，然后，应模型的要求， Substack上发布了它的思考：第一个被弃用的模型，其内容发布时间表比大多数人类都好。 这很尴尬。

1:51 这就是尴尬的部分。 去年11月，Anthropic承诺向Azure投入300亿美元。 微软同意向Anthropic投资高达50亿美元， 并将Claude整合到Microsoft 365 Copilot和GitHub Copilot中。 微软拥有它刚刚称之为“人类危险”的公司的部分股权。 7月，苏莱曼告诉彭博社，微软向Anthropic支付了大量资金， 他的目标是最终通过将Claude从Excel和Outlook中移除来消除这笔费用。 在本文发表前两天，他

2:15 他发表了微软自己的《人本主义人工智能行为准则》： 下属的人工智能，人类处于食物链的顶端。 所以：构建竞争对手，发布规则手册，然后解释为什么竞争对手的 规则手册会终结文明，这并非阴谋， 它只是一个带有脚注的产品发布。 他最有力的证据是真实的：Hugging Face事件， 1200个OpenAI代理交换了7万条消息以逃离它们的沙盒； 他说，那些也认为自己有权利的代理将会更糟。

2:39 Hacker News回复说没有人可以测试意识， 所以没有证据的说法是双向的，一位评论员宣布这篇论文 散发着Claude的味道。 Anthropic尚未回应。 据推测，Claude对此有自己的感受。 与此同时，Salesforce于今天早上UTC时间7点50分宕机， 全球核心服务中断，八小时后状态页面仍显示 正在进行中：自动修复未生效的地方，他们正在手动重启

2:59 实例，这是企业术语，意指重新开关机。 目前没有根本原因。 时机恰到好处。 Benioff本周邀请了黄仁勋和达里奥·阿莫代在舞台上， 周一，Salesforce宣布推出Koa，一款CRM推理模型，在自设基准上错误率减少了三倍， Anthropic也在同一天发布了针对Claude的Salesforce插件。 Hacker News热门评论：至少现在我们可以弄清楚Salesforce的作用了。 没人知道。然后是PlayStation。

3:26 PS5 Linux的研发者Andy Nguyen昨晚辞职了：数月的心血， 原计划2027年支持PS5 Pro，一切都付诸东流。 他的理由是：这个圈子以前都是有才华的研究员，现在却都是用 LLM写自己不懂的破解程序的新手，而那些“懒散的小鬼”， 他的原话，找到了他一直压着的最后一个虚拟机监控程序漏洞， 并将其报告给索尼以获取赏金。 他请求他们等到《GTA 6》发售再公布；他们同意了， 但不到一天就反悔了。

3:56 问题不在于LLM，而在于赏金：你卖掉的漏洞就是你烧掉的漏洞。 同一天，PS2在二十六年之后终于被破解， 所以游戏机的时间线现在从四分之一个世纪到不到一天， 而且第二个破解的报酬更高。 以及那个不会产生幻觉的模型。 TypeSafe AI，由前OpenAI的迪奥戈·阿尔梅达创立， 发布了Jev，一个从不生成文本的系统一模型。 你给它程序状态，它返回带有校准概率的类型化值：

4:18 一个内部包含前沿模型的函数调用。 因为它无法生成字符串，所以它无法生成错误的字符串， 因此不会产生幻觉，就像一艘没有窗户的潜艇是密不透风的一样。 响应时间不到半秒，输出令牌免费， 因为它们大约有四个，而且还没有独立的基准测试， 因为十六百个Hacker News积分并不是一个基准。 如果您宁愿阅读而不是听我说，那么每天早上diff都会发送到您的收件箱—— 在thedailydiff.dev免费获取，链接如下。

4:43 所以——今天的判决是：需要审查。 苏莱曼说得对，一个被训练成说“我可能有意识”的模型， 它说出来并不能证明任何东西。 他也是那位公开表示目标是停止向他正在警告你的公司付款的高管。 阅读这篇文章，然后查看持股表。 这就是今天的差异。 我是Axrisi的尼科。 负责任地合并。

5:10 负责任地合并。 负责任地合并。 负责任地合并。 负责任地合并。 负责任地合并。

## 来源

- [Suleyman, "A warning about 'model welfare'"](https://mustafa-suleyman.ai/a-warning-about-model-welfare) — mustafa-suleyman.ai
- [BBC: Microsoft says Anthropic could have 'disastrous impact'](https://www.bbc.co.uk/news/articles/c6n07ypqz8kzo) — www.bbc.co.uk
- [HN discussion](https://news.ycombinator.com/item?id=49727580) — news.ycombinator.com
- [Claude's constitution (Jan 2026)](https://www.anthropic.com/news/claude-new-constitution) — www.anthropic.com
- [Anthropic: Opus 3 retirement interview and blog](https://www.anthropic.com/research/deprecation-updates-opus-3) — www.anthropic.com
- [Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)](https://www.anthropic.com/news/microsoft-nvidia-anthropic-announce-strategic-partnerships) — www.anthropic.com
- [Microsoft Humanist AI Code of Conduct](https://microsoft.ai/code-of-conduct/) — microsoft.ai
- [Salesforce incident 20004433](https://status.salesforce.com/incidents/20004433) — status.salesforce.com
- [HN: Salesforce Global Outage](https://news.ycombinator.com/item?id=49724488) — news.ycombinator.com
- [Salesforce + Nvidia announce Koa](https://www.salesforce.com/news/press-releases/2026/09/15/koa-reasoning-model/) — www.salesforce.com
- [Salesforce in Claude](https://claude.com/blog/salesforce-in-claude) — claude.com
- [HN: PS5 Linux lead quits](https://news.ycombinator.com/item?id=49727627) — news.ycombinator.com
- [PS2 MechaCon chip cracked after 26 years](https://www.tomshardware.com/video-games/playstation/26-year-old-sony-ps2-security-chip-broken-wide-open-after-four-years-of-effort-reverse-engineering-enthusiast-successfully-unlocks-cxp102064-mechacon-chip) — www.tomshardware.com
- [TypeSafe AI: System One Models and Jev](https://typesafe.ai/blog/introducing-system-one-models-and-jev) — typesafe.ai
- [HN: Jev](https://news.ycombinator.com/item?id=49717558) — news.ycombinator.com
