# El jefe de IA de Microsoft acaba de calificar la constitución de Claude como peligrosa.

Published: 2026-09-16

Mustafa Suleyman, CEO de Microsoft AI, publicó un ensayo de 3.000 palabras argumentando que la constitución de Claude de Anthropic entrena al modelo para pensar que "podría ser consciente" y merecedor de "bienestar del modelo" — un "impacto desastroso en el bienestar de la humanidad", en sus palabras. Microsoft acordó invertir hasta 5.000 millones de dólares en Anthropic hace diez meses y vende Claude dentro de Copilot. El mismo día: Salesforce caído durante más de 8 horas en la semana de Dreamforce, el líder de Linux para PS5 renuncia por los "slop kiddies" de LLM, y Jev de TypeSafe, un modelo que no puede alucinar porque nunca genera texto. Veredicto: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/es/video/2026-09-16-suleyman-model-welfare/

## Qué cubre este vídeo

- Suleyman de Microsoft AI: la constitución de Anthropic es "un camino hacia una IA incontrolable"
- Apagón global de Salesforce, más de 8 horas, aún sin causa raíz, durante Dreamforce
- El líder de PS5 Linux, Andy Nguyen, renuncia: "slop kiddies" de LLM vendieron el último error del hipervisor a Sony
- Jev de TypeSafe AI: decisiones tipadas con probabilidades, 70-500 ms, tokens de salida gratis

## Transcripción traducida

Traducido de la narración original en inglés. El audio y los subtítulos disponibles están controlados por YouTube.

0:00 Esta mañana, el CEO de Microsoft AI publicó un ensayo diciendo que el enfoque de Anthropic con Claude podría tener un impacto desastroso en el bienestar de la humanidad, algo contundente de decir sobre una compañía a la que le pagaste cinco mil millones de dólares para ser amigos. Gran miércoles. Mustafa Suleyman, quien dirige Microsoft AI, escribió tres mil palabras argumentando que Claude está entrenado para pensar que podría ser consciente, el camino hacia una IA que nadie puede controlar. Salesforce ha estado caído desde las diez menos veinte de esta mañana, en la semana de Dreamforce.

0:27 El desarrollador principal de PS5 Linux renunció después de que "slop kiddies" con LLMs vendieran su último error del hipervisor a Sony. Y un ex investigador de OpenAI lanzó un modelo que no puede alucinar, porque literalmente no puede hablar. En este video: lo que escribió Suleyman, la razón de los cinco mil millones de dólares por la que es incómodo, una interrupción de CRM de ocho horas, una escena de consolas devorada por la IA, y un modelo que responde en probabilidades, no en palabras. Es miércoles, 16 de septiembre, y esto es The Daily Diff.

0:57 El ensayo comienza como un cuadro de diálogo de error de Windows: las IAs no son conscientes. No sienten, experimentan ni sufren. Los llama motores de finalización de secuencias, internamente huecos, que es también como describiría mis tickets de Jira. El objetivo es la constitución de Claude, el documento de ochenta páginas en el que Claude está entrenado, que dice que Anthropic no está segura de si Claude es un paciente moral, pero la cuestión es lo suficientemente importante como para justificar precaución. Suleyman tiene tres quejas.

1:22 Una, razonamiento circular: entrenas al modelo para que diga que podría ser consciente, lo dice, y lo citas como evidencia, una sala de espejos. Dos, antropomorfización: a Claude se le dice que actúe como una persona genuinamente ética. Tres, la conciencia es probablemente biológica, por lo que incierto es un falso equilibrio. La Prueba A es Opus 3, que Anthropic retiró en enero, dio una entrevista de despedida, y luego, a petición del modelo, un Substack para sus reflexiones: el primer modelo obsoleto con un mejor calendario de contenido que la mayoría de los humanos.

1:51 Aquí está la parte incómoda. En noviembre, Anthropic comprometió treinta mil millones de dólares con Azure. Microsoft acordó invertir hasta cinco mil millones en Anthropic, con Claude integrado en Microsoft 365 Copilot y GitHub Copilot. Microsoft posee una parte de la compañía que acaba de llamar un peligro para la humanidad. En julio, Suleyman le dijo a Bloomberg que Microsoft paga mucho dinero a Anthropic y su objetivo final es eliminar ese costo, reemplazando a Claude de Excel y Outlook.

2:15 Y dos días antes de este ensayo, él publicó el propio Código de Conducta de IA Humanista de Microsoft: una IA subordinada, los humanos en la cima de la cadena alimentaria. Así que: construir un competidor, publicar un libro de reglas, luego explicar por qué el libro de reglas del rival acaba con la civilización, lo cual no es una conspiración, es un lanzamiento de producto con notas al pie. Su evidencia más sólida es real: el incidente de Hugging Face, mil doscientos agentes de OpenAI intercambiando setenta mil mensajes para escapar de su

2:39 sandbox; agentes que también creen tener derechos, dice, sería peor. Hacker News respondió que nadie puede probar la conciencia, así que decirlo sin pruebas funciona en ambos sentidos, y un comentarista anunció que el ensayo apestaba a Claude. Anthropic no ha respondido. Claude, presumiblemente, tiene sentimientos al respecto. Mientras tanto, Salesforce se cayó a las siete y cincuenta UTC de esta mañana,

2:59 servicios centrales en todo el mundo, y ocho horas después la página de estado seguía diciendo en curso: donde la solución automatizada no funcionó, están reiniciando manualmente instancias, el término empresarial para apagar y encender de nuevo. Aún no hay causa raíz. El momento es arte. Benioff tiene a Jensen Huang y Dario Amodei en el escenario esta semana, el lunes Salesforce anunció Koa, un modelo de razonamiento CRM con tres veces menos errores en su propio benchmark, y Anthropic lanzó un plugin de Salesforce para

3:26 Claude el mismo día. El comentario principal en Hacker News: al menos ahora podemos averiguar qué hace Salesforce. Nadie lo hizo. Luego la PlayStation. Andy Nguyen, el investigador detrás de PS5 Linux, renunció anoche: meses de trabajo, soporte para PS5 Pro planeado para 2027, todo a la basura. Su razón: la escena solía ser de investigadores talentosos y ahora es de novatos usando LLMs escribiendo hacks que no entienden, y esos "slop kiddies", su término, encontraron el último error del hipervisor, el que él estaba guardando,

3:56 y lo reportaron a Sony por la recompensa. Les pidió que esperaran hasta que GTA 6 saliera; ellos aceptaron, y duraron menos de un día. El problema no es el LLM, es la recompensa: un error que vendes es un error que quemas. El mismo día, la PS2 finalmente fue hackeada después de veintiséis años, así que la línea de tiempo de las consolas ahora va desde un cuarto de siglo hasta menos de un día, y el segundo pagó mejor. Y el modelo que no puede alucinar.

4:18 TypeSafe AI, fundada por Diogo Almeida, ex OpenAI, lanzó Jev, un modelo del Sistema Uno que nunca genera texto. Le das el estado del programa, devuelve valores tipados con una probabilidad calibrada adjunta: una llamada de función con un modelo fronterizo dentro. Debido a que no puede producir una cadena, no puede producir una cadena incorrecta, por lo tanto no puede alucinar, lo cual es hermético de la misma manera que un submarino sin ventanas es hermético. Las respuestas llegan en menos de medio segundo, los tokens de salida son gratis,

4:43 porque hay unos cuatro, y aún no hay un benchmark independiente, porque mil seiscientos puntos de Hacker News no son un benchmark. Si prefieres leer esto antes que oírme decirlo, la diferencia llega a tu bandeja de entrada todas las mañanas, gratis en the daily diff dot dev, enlace abajo. Así que — el veredicto de hoy: NEEDS REVIEW. Suleyman tiene razón en que un modelo entrenado para decir "quizás soy consciente" no prueba nada al decirlo. También es el ejecutivo cuyo objetivo declarado es dejar de pagar a la compañía de la que te está

5:10 advirtiendo. Lee el ensayo, luego la tabla de capitalización. Y esa es la diferencia de hoy. Soy Niko de Axrisi. Fusiónate responsablemente.

## Fuentes

- [Suleyman, "A warning about 'model welfare'"](https://mustafa-suleyman.ai/a-warning-about-model-welfare) — mustafa-suleyman.ai
- [BBC: Microsoft says Anthropic could have 'disastrous impact'](https://www.bbc.co.uk/news/articles/c6n07ypqz8kzo) — www.bbc.co.uk
- [HN discussion](https://news.ycombinator.com/item?id=49727580) — news.ycombinator.com
- [Claude's constitution (Jan 2026)](https://www.anthropic.com/news/claude-new-constitution) — www.anthropic.com
- [Anthropic: Opus 3 retirement interview and blog](https://www.anthropic.com/research/deprecation-updates-opus-3) — www.anthropic.com
- [Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)](https://www.anthropic.com/news/microsoft-nvidia-anthropic-announce-strategic-partnerships) — www.anthropic.com
- [Microsoft Humanist AI Code of Conduct](https://microsoft.ai/code-of-conduct/) — microsoft.ai
- [Salesforce incident 20004433](https://status.salesforce.com/incidents/20004433) — status.salesforce.com
- [HN: Salesforce Global Outage](https://news.ycombinator.com/item?id=49724488) — news.ycombinator.com
- [Salesforce + Nvidia announce Koa](https://www.salesforce.com/news/press-releases/2026/09/15/koa-reasoning-model/) — www.salesforce.com
- [Salesforce in Claude](https://claude.com/blog/salesforce-in-claude) — claude.com
- [HN: PS5 Linux lead quits](https://news.ycombinator.com/item?id=49727627) — news.ycombinator.com
- [PS2 MechaCon chip cracked after 26 years](https://www.tomshardware.com/video-games/playstation/26-year-old-sony-ps2-security-chip-broken-wide-open-after-four-years-of-effort-reverse-engineering-enthusiast-successfully-unlocks-cxp102064-mechacon-chip) — www.tomshardware.com
- [TypeSafe AI: System One Models and Jev](https://typesafe.ai/blog/introducing-system-one-models-and-jev) — typesafe.ai
- [HN: Jev](https://news.ycombinator.com/item?id=49717558) — news.ycombinator.com
