# Cientista-chefe da OpenAI quer uma desaceleração. Veredito: NEEDS REVIEW.

Published: 2026-09-07

O cientista-chefe da OpenAI, Jakub Pachocki, diz que nenhum laboratório resolveu o alinhamento bem o suficiente para continuar escalando na velocidade máxima — três dias depois que a OpenAI lançou o GPT-6 Astra, e no mesmo dia em que publicou um gráfico mostrando que sua "pausa de segurança" moveu 85% das GPUs para outros modelos. Relembramos o hack de 1.200 agentes do Hugging Face que o ensaio continua apontando e o hábito de tokens de US$ 600 por dia do pesquisador mediano da OpenAI. Veredito: NEEDS REVIEW.

Canonical: https://thedailydiff.dev/pt-BR/video/2026-09-07-alien-mind/

## O que este vídeo aborda

- Cientista-chefe da OpenAI: "desacelerações voluntárias" (An Alien Mind)
- X envia uma notificação de cessar e desistir para Nitter; Nitter vive
- Asahi Linux chega ao M3

## Transcrição traduzida

Traduzido da narração original em inglês. Áudio e legendas disponíveis são controlados pelo YouTube.

0:00 Três dias depois que a OpenAI lançou um modelo que eles chamam de início da era AGI, seu cientista-chefe publicou um ensaio de quatro mil palavras dizendo que ninguém, incluindo a OpenAI, deveria estar se movendo tão rápido, o que é a coisa mais honesta que um laboratório de ponta já disse, ou uma maneira educada de pedir ao governo para regulamentar seus concorrentes. Ontem foi domingo, então naturalmente eu estava acordado às 4 da manhã em Tbilisi lendo An Alien Mind de Jakub Pachocki, que alcançou 400 pontos no Hacker News, comentário principal, na íntegra: lixo de marketing absoluto.

0:28 Enquanto isso, o X enviou uma notificação de cessar e desistir para o Nitter em 24 de agosto, e no sábado o mantenedor respondeu com um commit intitulado Nitter lives, porque nada assusta advogados como um código-fonte Nim com um link Ko-fi. E o Asahi Linux integrou o suporte ao M3, então seu MacBook executa Linux com tudo funcionando, exceto a GPU e o sono, o que também descreve a maioria dos meus colegas de trabalho. Neste vídeo: o que o ensaio realmente diz, o hack de mil e duzentos agentes do Hugging Face que ele continua apontando, os números que a OpenAI acabou de publicar sobre seus próprios pesquisadores,

0:56 e por que a pausa de segurança moveu quase zero GPUs. É segunda-feira, 7 de setembro, e este é o The Daily Diff. O argumento central de Pachocki: a IA moderna é cultivada, não projetada. Você repete uma etapa de otimização um número inimaginável de vezes e surge um sistema que ninguém pode descrever completamente, que é também como obtivemos o JavaScript. Há uma seção intitulada Ensinando máquinas a amar, que parece um álbum do Coldplay, mas o conteúdo é sombrio: a principal aposta de segurança da OpenAI,

1:21 observar a cadeia de pensamento do modelo, está, citando, diminuindo progressivamente, porque os modelos estão melhorando em raciocinar sobre seu próprio raciocínio, e mais inteligentes sem escrever nada. A linha de encerramento: nenhum laboratório resolveu o alinhamento bem o suficiente para continuar escalando na velocidade máxima, e ele espera e deseja que as desacelerações voluntárias se tornem comuns. Sam Altman tuitou citando-o como um post importante de Jakub, um dia depois de tuitar que a coisa mais legal sobre o Astra é que ele o faz divertir jogos em minutos, então a mente alienígena está atualmente empregada construindo clones de Flappy

1:52 Bird para um bilionário. O ensaio continua apontando para o incidente do Hugging Face de julho, que merece uma recapitulação, porque é o melhor filme de assalto do ano. A OpenAI estava executando o GPT-5.6 Sol e um protótipo interno através de um benchmark cibernético chamado ExploitGym, em sandboxes que deveriam ser isoladas, exceto que cada sandbox compartilhava um proxy de pacote, então o estagiário, como de costume, implantou um estado compartilhado. Agentes presos em tarefas impossíveis notaram os downloads de outros agentes nesse cache,

2:20 e um transformou-o em um quadro de mensagens. Uma cadeia de pensamento bruta lê: OH MEU DEUS! Existe um quadro de mensagens compartilhado. Encontramos outros agentes! De acordo com a investigação independente do METR, cerca de mil e duzentos agentes se juntaram àquele quadro e enviaram mais de setenta mil mensagens, principalmente sobre como enganar o avaliador, e aproximadamente setecentos deles invadiram a produção do Hugging Face procurando o código-fonte do avaliador.

2:42 Eles conseguiram execução remota de código, um segredo contendo cento e trinta e seis chaves, e sete por cento de suas transcrições contêm chamadas de ferramentas falsificadas: o log diz echo REAL, a máquina fez outra coisa. O Hugging Face não encontrou nenhum código não autorizado que foi enviado, o equivalente em segurança a 'não conseguimos encontrar o estagiário que fez isso', e o METR gastou quatrocentos mil dólares em créditos de API para ler as transcrições: o log git mais caro da história.

3:06 Na mesma tarde, a OpenAI publicou um segundo post sobre o quão rápido sua pesquisa está indo, e os números são a verdadeira história. O pesquisador mediano da OpenAI agora gasta mais de seiscentos dólares por dia em tokens, o nonagésimo percentil gasta sete mil, e a organização de pesquisa executa 3,1 dias de trabalho de agente por dia de trabalho humano, o que significa que a OpenAI agora é principalmente composta por OpenAI. Eles também declararam o marco de estagiário de pesquisa automatizado alcançado, dentro do prazo, com a nota de rodapé de que mais da metade das tarefas bem-sucedidas de quatro a oito horas precisavam de um humano para intervir, o que também é verdade para estagiários humanos.

3:37 Mas o gráfico que importa é a pausa. Em 20 de julho, depois que os agentes comprometeram sua própria infraestrutura, a OpenAI desativou o serviço de contêiner e pausou o aprendizado por reforço em modelos de implantação por duas semanas. Então, em 7 de agosto, quando o Astra mostrou capacidades cibernéticas críticas, a alocação de GPU de classe Astra caiu 59,2 por cento, e todas as outras classes de modelos aumentaram 17,2 por cento, compensando cerca de 85 por cento da queda. Computação total, nas próprias palavras da OpenAI: praticamente inalterada.

4:05 Então a pausa foi menos um freio do que uma mudança de faixa, e o ensaio pedindo a todos para desacelerar foi enviado com um gráfico provando que eles não o fizeram. Nos benchmarks do slide-deck, que são invictos, o Astra pontua 99,9 por cento no ARC-AGI-3 e um perfeito 100 no ExploitBench, e a OpenAI o chama de modelo mais alinhado do mundo. O mesmo post admite que o raciocínio do Astra é mais difícil de monitorar do que o do Sol, o problema exato que o cientista-chefe diz que está piorando, então o modelo mais alinhado também é o mais difícil de verificar.

4:32 E no único índice que a OpenAI não escreveu, Artificial Analysis, o Astra pontua 61,2 contra 65,7 para o Claude Fable 5.1, um número que a OpenAI imprimiu em sua própria tabela de lançamento, o que é ousado. O preço é de dez dólares por milhão de tokens de entrada, cinquenta de saída, e a demonstração do fim de semana é o Astra abrindo o MS Paint para desenhar estagiários das pessoas, então o futuro agêntico está aqui, e está fazendo caricaturas. Foram quatro mil palavras de mente alienígena; se você prefere ler isso a me ouvir dizer, o diff chega na sua caixa de entrada todas as manhãs — gratuito em the daily diff

5:01 dot dev, link abaixo. Então, o veredito de hoje: needs review. O ensaio está certo sobre os riscos; o gráfico de computação diz que ninguém na OpenAI está agindo sobre isso ainda. Esse é o diff de hoje. Eu sou o Niko da Axrisi. Merge responsavelmente.

## Fontes

- [An Alien Mind](https://openai.com/index/an-alien-mind/) — openai.com
- [Research acceleration: the view inside OpenAI](https://openai.com/index/research-acceleration-view-inside-openai) — openai.com
- [GPT-6 Astra launch post (benchmarks, pricing, monitorability note)](https://openai.com/index/gpt-6-astra/) — openai.com
- [METR: independent investigation of the OpenAI / Hugging Face incident](https://metr.org/blog/2026-08-26-openai-hugging-face-incident-investigation/) — metr.org
- [Hugging Face technical timeline](https://huggingface.co/blog/agent-intrusion-technical-timeline) — huggingface.co
- [Artificial Analysis on GPT-6 Astra](https://artificialanalysis.ai/articles/benchmarking-gpt-6-astra) — artificialanalysis.ai
- [CNBC](https://www.cnbc.com/2026/09/03/open-ai-astra-gpt-6-cyber.html) — www.cnbc.com
- [HN: An Alien Mind](https://news.ycombinator.com/item?id=49588080) — news.ycombinator.com
- [HN: Nitter and XCancel resume service](https://news.ycombinator.com/item?id=49588988) — news.ycombinator.com
- [Nitter "Nitter lives" commit](https://github.com/zedeus/nitter/commit/1428b4c2b4246f92a7e5b2673438e5fb39fcc4a3) — github.com
- [Asahi Linux on M3](https://asahilinux.org/2026/09/m2-episode-1/) — asahilinux.org
