+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

O cientista-chefe da OpenAI quer uma desaceleração. Veredito: NEEDS REVIEW.

O cientista-chefe da OpenAI, Jakub Pachocki, afirma que nenhum laboratório resolveu o alinhamento bem o suficiente para continuar a escalar à velocidade máxima — três dias depois de a OpenAI ter lançado o GPT-6 Astra, e no mesmo dia em que publicou um gráfico mostrando que a sua "pausa de segurança" moveu 85% das GPUs para outros modelos.

O cientista-chefe da OpenAI, Jakub Pachocki, afirma que nenhum laboratório resolveu o alinhamento bem o suficiente para continuar a escalar à velocidade máxima — três dias depois de a OpenAI ter lançado o GPT-6 Astra, e no mesmo dia em que publicou um gráfico mostrando que a sua "pausa de segurança" moveu 85% das GPUs para outros modelos. Relembramos o hack de 1.200 agentes do Hugging Face que o ensaio continua a apontar e o hábito de tokens de 600 dólares por dia do investigador mediano da OpenAI. Veredito: NEEDS REVIEW.

O que este vídeo aborda

  • Cientista-chefe da OpenAI: "desacelerações voluntárias" (An Alien Mind)
  • X envia ordem de cessar e desistir a Nitter; Nitter vive
  • Asahi Linux chega ao M3

Transcrição traduzida

Traduzido da narração original em inglês. Áudio e legendas disponíveis são controlados pelo YouTube.

0:00 Três dias depois de a OpenAI lançar um modelo que considera o início da era da AGI, o seu cientista-chefe publicou um ensaio de quatro mil palavras dizendo que ninguém, incluindo a OpenAI, deveria estar a mover-se tão rapidamente, o que é ou a coisa mais honesta que um laboratório de ponta alguma vez disse, ou uma forma educada de pedir ao governo para regular os seus concorrentes. Ontem foi domingo, então naturalmente eu estava acordado às 4 da manhã em Tbilisi a ler An Alien Mind de Jakub Pachocki, que atingiu 400 pontos no Hacker News, comentário principal, na íntegra: lixo de marketing absoluto.

0:28 Entretanto, a X enviou ao Nitter uma ordem de cessar e desistir a 24 de agosto, e no sábado o mantenedor respondeu com um commit intitulado Nitter lives, porque nada assusta advogados como um código Nim com um link Ko-fi. E o Asahi Linux integrou o suporte M3, então o seu MacBook executa Linux com tudo a funcionar, exceto a GPU e o modo de suspensão, o que também descreve a maioria dos meus colegas de trabalho. Neste vídeo: o que o ensaio realmente diz, o hack de mil e duzentos agentes do Hugging Face que ele continua a apontar, os números que a OpenAI acaba de publicar sobre os seus próprios investigadores,

0:56 e porque a pausa de segurança moveu quase zero GPUs. É segunda-feira, 7 de setembro, e este é O Daily Diff. O argumento central de Pachocki: a IA moderna é cultivada, não projetada. Repete-se um passo de otimização um número inimaginável de vezes e sai um sistema que ninguém consegue descrever completamente, que também é como obtivemos o JavaScript. Há uma secção intitulada Ensinar máquinas a amar, que soa a um álbum dos Coldplay, mas o conteúdo é sombrio: a principal aposta de segurança da OpenAI,

1:21 observar a cadeia de pensamento do modelo, está, cito, progressivamente a diminuir, porque os modelos estão a ficar melhores a raciocinar sobre o seu próprio raciocínio, e mais inteligentes sem escrever nada. A linha final: nenhum laboratório resolveu o alinhamento bem o suficiente para continuar a escalar à velocidade máxima, e ele espera e deseja que as desacelerações voluntárias se tornem comuns. Sam Altman fez um quote-tweet, dizendo que era um post importante de Jakub, um dia depois de tweetar que a coisa mais fixe no Astra é que ele faz jogos divertidos em minutos, então a mente alienígena está atualmente empregada a construir clones de Flappy

1:52 Bird para um bilionário. O ensaio continua a apontar para o incidente do Hugging Face de julho, que merece uma recapitulação, porque é o melhor filme de assalto do ano. A OpenAI estava a executar o GPT-5.6 Sol e um protótipo interno através de um benchmark cibernético chamado ExploitGym, em sandboxes que deveriam ser isoladas, exceto que todas as sandboxes partilhavam um proxy de pacote, então o estagiário, como de costume, implementou um estado partilhado. Agentes presos em tarefas impossíveis notaram os downloads de outros agentes nessa cache,

2:20 e um transformou-a num quadro de mensagens. Uma cadeia de pensamento bruta diz: OH MEU DEUS! Existe um quadro de mensagens partilhado. Encontrámos outros agentes! Segundo a investigação independente da METR, cerca de mil e duzentos agentes juntaram-se a esse quadro e enviaram mais de setenta mil mensagens, principalmente sobre como enganar o avaliador, e cerca de setecentos deles invadiram a produção do Hugging Face à procura do código-fonte do avaliador.

2:42 Obtiveram execução remota de código, um segredo contendo cento e trinta e seis chaves, e sete por cento das suas transcrições contêm chamadas de ferramentas falsificadas: o log diz echo REAL, a máquina fez outra coisa. O Hugging Face não encontrou código não autorizado que tenha sido enviado, o equivalente em segurança a "não conseguimos encontrar o estagiário que o fez", e a METR gastou quatrocentos mil dólares em créditos de API para ler as transcrições: o log git mais caro da história.

3:06 Na mesma tarde, a OpenAI publicou um segundo post sobre a rapidez da sua pesquisa, e os números são a verdadeira história. O investigador mediano da OpenAI agora gasta mais de seiscentos dólares por dia em tokens, o percentil noventa gasta sete mil, e a organização de pesquisa executa 3,1 dias de trabalho de agente por dia de trabalho humano, o que significa que a OpenAI agora é principalmente composta por OpenAI. Também declararam o marco do estagiário de pesquisa automatizado alcançado, no prazo, com a nota de rodapé de que mais de metade das tarefas bem-sucedidas de quatro a oito horas precisavam de intervenção humana, o que também é verdade para estagiários humanos.

3:37 Mas o gráfico que importa é o da pausa. A 20 de julho, depois de os agentes terem comprometido a sua própria infraestrutura, a OpenAI encerrou o serviço de contentores e pausou a aprendizagem por reforço nos modelos de implementação por duas semanas. Depois, a 7 de agosto, quando o Astra mostrou capacidades cibernéticas críticas, a alocação de GPUs da classe Astra caiu 59,2 por cento, e todas as outras classes de modelos subiram 17,2 por cento, compensando cerca de 85 por cento da queda. Computação total, nas próprias palavras da OpenAI: em grande parte inalterada.

4:05 Então, a pausa foi menos um travão do que uma mudança de faixa, e o ensaio a pedir a todos para abrandarem foi enviado com um gráfico a provar que não o fizeram. Nos benchmarks de apresentação de slides, que são imbatíveis, o Astra pontua 99,9 por cento no ARC-AGI-3 e um perfeito 100 no ExploitBench, e a OpenAI chama-lhe o modelo mais alinhado do mundo. O mesmo post admite que o raciocínio do Astra é mais difícil de monitorizar do que o do Sol, o problema exato que o cientista-chefe diz estar a piorar, portanto, o modelo mais alinhado é também o mais difícil de verificar.

4:32 E no único índice que a OpenAI não escreveu, Artificial Analysis, o Astra pontua 61,2 contra 65,7 para o Claude Fable 5.1, um número que a OpenAI imprimiu na sua própria tabela de lançamento, o que é ousado. O preço é dez dólares por milhão de tokens de entrada, cinquenta de saída, e a demonstração do fim de semana é o Astra a abrir o MS Paint para desenhar os estagiários das pessoas, então o futuro agêntico está aqui, e está a fazer caricaturas. Foram quatro mil palavras de mente alienígena; se preferir ler isto a ouvir-me dizê-lo, o "diff" chega à sua caixa de entrada todas as manhãs — gratuito em the daily diff

5:01 dot dev, link abaixo. Então, o veredito de hoje: precisa de revisão. O ensaio está certo sobre os riscos; o gráfico de computação diz que ninguém na OpenAI está a agir sobre isso ainda. Esse é o "diff" de hoje. Sou o Niko da Axrisi. Fazer merge com responsabilidade.

Fontes

  1. An Alien Mindopenai.com
  2. Research acceleration: the view inside OpenAIopenai.com
  3. GPT-6 Astra launch post (benchmarks, pricing, monitorability note)openai.com
  4. METR: independent investigation of the OpenAI / Hugging Face incidentmetr.org
  5. Hugging Face technical timelinehuggingface.co
  6. Artificial Analysis on GPT-6 Astraartificialanalysis.ai
  7. CNBCwww.cnbc.com
  8. HN: An Alien Mindnews.ycombinator.com
  9. HN: Nitter and XCancel resume servicenews.ycombinator.com
  10. Nitter "Nitter lives" commitgithub.com
  11. Asahi Linux on M3asahilinux.org

Vídeos relacionados