+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

O diretor de IA da Microsoft acaba de chamar a constituição de Claude de perigosa.

Mustafa Suleyman, CEO da Microsoft AI, publicou um ensaio de 3.000 palavras argumentando que a constituição de Claude da Anthropic treina o modelo para pensar que "pode ser consciente" e merecedor de "bem-estar do modelo" — um "impacto desastroso no bem-estar da humanidade", nas suas palavras.

Mustafa Suleyman, CEO da Microsoft AI, publicou um ensaio de 3.000 palavras argumentando que a constituição de Claude da Anthropic treina o modelo para pensar que "pode ser consciente" e merecedor de "bem-estar do modelo" — um "impacto desastroso no bem-estar da humanidade", nas suas palavras. A Microsoft concordou em investir até 5 mil milhões de dólares na Anthropic há dez meses e vende Claude dentro do Copilot. No mesmo dia: Salesforce inativo por mais de 8 horas na semana do Dreamforce, o líder do PS5 Linux desiste devido a "crianças preguiçosas" de LLM, e Jev da TypeSafe, um modelo que não pode alucinar porque nunca gera texto. Veredito: NEEDS REVIEW.

Ler a edição escrita (Inglês) ↗

O que este vídeo aborda

  • Suleyman da Microsoft AI: A constituição da Anthropic é "um caminho para uma IA incontrolável"
  • Interrupção global do Salesforce, mais de 8 horas, sem causa raiz ainda, durante o Dreamforce
  • Líder do PS5 Linux, Andy Nguyen, demite-se: "crianças preguiçosas" de LLM venderam o último bug do hypervisor à Sony
  • Jev da TypeSafe AI: decisões tipadas com probabilidades, 70–500 ms, tokens de saída gratuitos

Transcrição traduzida

Traduzido da narração original em inglês. Áudio e legendas disponíveis são controlados pelo YouTube.

0:00 Esta manhã, o CEO da Microsoft AI publicou um ensaio dizendo que a abordagem da Anthropic ao Claude poderia ter um impacto desastroso no bem-estar da humanidade, uma coisa forte a dizer sobre uma empresa em que investiu cinco mil milhões de dólares para ser amigo. Grande quarta-feira. Mustafa Suleyman, que dirige a Microsoft AI, escreveu três mil palavras argumentando que Claude é treinado para pensar que pode ser consciente, o caminho para uma IA que ninguém consegue controlar. O Salesforce está inativo desde as sete e cinquenta desta manhã, na semana do Dreamforce.

0:27 O principal desenvolvedor do PS5 Linux demitiu-se depois que crianças preguiçosas com LLMs venderam o seu último bug do hypervisor à Sony. E um ex-pesquisador da OpenAI lançou um modelo que não pode alucinar, porque literalmente não consegue falar. Neste vídeo: o que Suleyman escreveu, a razão de cinco mil milhões de dólares pela qual é constrangedor, uma interrupção de oito horas de CRM, uma cena de consola devorada pela IA, e um modelo que responde em probabilidades, não em palavras. É quarta-feira, 16 de setembro, e este é o The Daily Diff.

0:57 O ensaio começa como uma caixa de diálogo de erro do Windows: As IAs não são conscientes. Não sentem, experimentam ou sofrem. Ele chama-os de motores de conclusão de sequência, internamente ocos, que é também como eu descreveria os meus tickets Jira. O alvo é a constituição de Claude, o documento de oitenta páginas no qual Claude é treinado, que diz que a Anthropic não tem a certeza se Claude é um paciente moral, mas a questão é suficientemente pertinente para justificar cautela. Suleyman tem três reclamações.

1:22 Uma, raciocínio circular: você treina o modelo para dizer que pode ser consciente, ele diz isso, e você cita isso como evidência, um salão de espelhos. Duas, antropomorfização: Claude é instruído a agir como uma pessoa genuinamente ética. Três, a consciência é provavelmente biológica, então incerto é um falso equilíbrio. O Exemplo A é Opus 3, que a Anthropic retirou em janeiro, deu uma entrevista de reforma e depois, a pedido do modelo, um Substack para as suas reflexões: o primeiro modelo descontinuado com um horário de conteúdo melhor do que a maioria dos humanos.

1:51 Aqui está a parte embaraçosa. Em novembro, a Anthropic comprometeu trinta mil milhões de dólares com o Azure. A Microsoft concordou em investir até cinco mil milhões na Anthropic, com Claude integrado no Microsoft 365 Copilot e GitHub Copilot. A Microsoft detém uma parte da empresa que acabou de chamar de perigo para a humanidade. Em julho, Suleyman disse à Bloomberg que a Microsoft paga muito dinheiro à Anthropic e o seu objetivo é, em última análise, eliminar esse custo, substituindo Claude do Excel e Outlook.

2:15 E dois dias antes deste ensaio, ele publicou o próprio Código de Conduta de IA Humanista da Microsoft: uma IA subordinada, humanos no topo da cadeia alimentar. Então: construir um concorrente, publicar um livro de regras, depois explicar por que o livro de regras do rival acaba com a civilização, o que não é uma conspiração, é um lançamento de produto com notas de rodapé. A sua evidência mais forte é real: o incidente Hugging Face, mil e duzentos agentes da OpenAI trocando setenta mil mensagens para escapar à sua

2:39 sandbox; agentes que também acreditam ter direitos, diz ele, seria pior. O Hacker News respondeu que ninguém pode testar a consciência, então, declarado sem evidências, funciona nos dois sentidos, e um comentador anunciou que o ensaio cheira a Claude. A Anthropic não respondeu. Claude, presumivelmente, tem sentimentos sobre isso. Entretanto, o Salesforce ficou inativo às sete e cinquenta UTC desta manhã,

2:59 serviços essenciais em todo o mundo, e oito horas depois a página de status ainda dizia em curso: onde a correção automática não funcionou, eles estão a reiniciar manualmente instâncias, o termo empresarial para ligar e desligar novamente. Ainda sem causa raiz. O timing é uma arte. Benioff tem Jensen Huang e Dario Amodei no palco esta semana, na segunda-feira o Salesforce anunciou o Koa, um modelo de raciocínio CRM com três vezes menos erros no seu próprio benchmark, e a Anthropic lançou um plugin do Salesforce para

3:26 Claude no mesmo dia. Melhor comentário no Hacker News: pelo menos agora podemos descobrir o que o Salesforce faz. Ninguém descobriu. Depois a PlayStation. Andy Nguyen, o pesquisador por trás do PS5 Linux, demitiu-se na noite passada: meses de trabalho, suporte PS5 Pro planeado para 2027, tudo por água abaixo. A sua razão: a cena costumava ter pesquisadores talentosos e agora são noobs usando LLMs a escrever hacks que não entendem, e essas crianças preguiçosas, o seu termo, encontraram o último bug do hypervisor, aquele em que ele estava a trabalhar,

3:56 e reportaram-no à Sony pela recompensa. Ele pediu-lhes para esperarem até o GTA 6 ser lançado; eles concordaram, e duraram menos de um dia. O problema não é o LLM, é a recompensa: um bug que você vende é um bug que você queima. No mesmo dia, o PS2 foi finalmente 'crackado' após vinte e seis anos, então a linha do tempo da consola agora vai de um quarto de século para menos de um dia, e o segundo pagou melhor. E o modelo que não pode alucinar.

4:18 TypeSafe AI, fundada por Diogo Almeida, ex-OpenAI, lançou Jev, um modelo System One que nunca gera texto. Você dá-lhe o estado do programa, ele retorna valores tipados com uma probabilidade calibrada anexada: uma chamada de função com um modelo de fronteira dentro. Como não pode produzir uma string, não pode produzir uma string errada, portanto não pode alucinar, o que é hermético da mesma forma que um submarino sem janelas é hermético. As respostas chegam em menos de meio segundo, os tokens de saída são gratuitos,

4:43 porque são cerca de quatro, e ainda não há um benchmark independente, porque mil e seiscentos pontos no Hacker News não são um benchmark. Se preferir ler isto em vez de me ouvir dizer, o diff chega à sua caixa de entrada todas as manhãs — grátis em the daily diff dot dev, link abaixo. Então — o veredicto de hoje: NEEDS REVIEW. Suleyman está certo de que um modelo treinado para dizer que talvez sou consciente não prova nada ao dizê-lo. Ele é também o executivo cujo objetivo declarado é parar de pagar à empresa sobre a qual ele está

5:10 a avisar. Leia o ensaio, depois a tabela de capital. E essa é a diferença de hoje. Sou o Niko da Axrisi. Faça a fusão responsavelmente.

Fontes

  1. Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
  2. BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
  3. HN discussionnews.ycombinator.com
  4. Claude's constitution (Jan 2026)www.anthropic.com
  5. Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
  6. Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
  7. Microsoft Humanist AI Code of Conductmicrosoft.ai
  8. Salesforce incident 20004433status.salesforce.com
  9. HN: Salesforce Global Outagenews.ycombinator.com
  10. Salesforce + Nvidia announce Koawww.salesforce.com
  11. Salesforce in Claudeclaude.com
  12. HN: PS5 Linux lead quitsnews.ycombinator.com
  13. PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
  14. TypeSafe AI: System One Models and Jevtypesafe.ai
  15. HN: Jevnews.ycombinator.com

Vídeos relacionados