OpenAI diz que resolveu Navier–Stokes. Veredito: NEEDS REVIEW.
OpenAI afirma que um modelo interno, executado como cerca de 10.000 agentes concorrentes por 88 horas, produziu uma prova verificada em Lean de que as equações de Navier–Stokes explodem em tempo finito — um problema do Prêmio Millennium em aberto desde 1934.
OpenAI afirma que um modelo interno, executado como cerca de 10.000 agentes concorrentes por 88 horas, produziu uma prova verificada em Lean de que as equações de Navier–Stokes explodem em tempo finito — um problema do Prêmio Millennium em aberto desde 1934. Doze horas antes, Tristan Buckmaster, da NYU, publicou um comunicado de quatro páginas sobre como foi a ligação de domingo com a OpenAI ("Por que você arruinaria sua carreira?"), Terence Tao escreveu que problemas em aberto estão agora sendo explorados como um recurso não renovável, e um pesquisador de pré-treinamento da Anthropic renunciou por causa da corrida. Além disso: Meta lança Muse, um agente pessoal com sua própria VM. Veredito: NEEDS REVIEW.
Leia a edição escrita (Inglês) ↗
O que este vídeo aborda
- OpenAI: explosão de Navier–Stokes, ~10.000 agentes, 88 horas, 130B de tokens de saída, verificado em Lean
- Buckmaster e Alpöge: um ano na mesma abordagem, um rumor e uma ligação de domingo com duas ofertas
- Terence Tao: "mesmo o rumor de alguém trabalhando em um problema pode desencadear uma enorme quantidade de esforço impulsionado por IA para resolvê-lo rapidamente"
- Jacob Coxon renuncia à Anthropic: ambos os laboratórios estão "correndo direto para a superinteligência autoaperfeiçoável"
- Meta lança Muse: um agente pessoal em sua própria VM de nuvem, no WhatsApp, apenas nos EUA
Transcrição traduzida
Traduzido da narração original em inglês. Áudio e legendas disponíveis são controlados pelo YouTube.
0:00 Ontem, a OpenAI anunciou que sua IA resolveu um problema do Prêmio Millennium, noventa anos em aberto, um milhão de dólares, em oitenta e oito horas, e os dois matemáticos que passaram um ano no mesmo problema souberam disso em uma ligação de domingo que, segundo um deles, incluiu: por que você arruinaria sua carreira? Foi uma segunda-feira longa. Ao amanhecer, um professor da NYU postou uma declaração de quatro páginas; mil e seiscentos pontos no Hacker News. À tarde, a OpenAI postou a prova.
0:26 À noite, Terence Tao disse que os problemas em aberto agora são explorados como um recurso não renovável, e durante a noite um pesquisador da Anthropic renunciou no X, quarenta e quatro milhões de visualizações, porque ambos os laboratórios estão, cito, apostando com nossas vidas. Além disso, a Meta lançou um agente pessoal que vive no WhatsApp e tem seu próprio computador. Neste vídeo: a prova, a ligação, a nota de rodapé, e a frase que Terence Tao quer que os laboratórios ouçam.
0:49 É quarta-feira, 9 de setembro, e este é The Daily Diff. Primeiro a matemática. Navier–Stokes descreve como os fluidos se movem, e desde 1934 ninguém sabia se um fluido 3D suave pode atingir uma singularidade: velocidade infinita em tempo finito. O sistema da OpenAI diz que sim. Comece em repouso, aplique uma força suave, mantenha a energia finita, e um vórtice espirala para dentro como espaguete até a velocidade explodir. Declarações C e D da formulação de Clay, em Lean,
1:16 dezessete horas de Astra para verificar. Então os fluidos podem explodir, o que qualquer um que derrubou café em um MacBook sabia, mas agora está em Lean. Como: a OpenAI tem um novo modelo interno que considera significativamente mais capaz que Astra, e em 1º de setembro eles ouviram um rumor de que dois problemas do Millennium haviam sido resolvidos, então eles o apontaram para todos os problemas em aberto. O grupo Navier–Stokes: cerca de dez mil agentes concorrentes, cento e trinta bilhões de tokens de saída; trezentos bilhões em todos os
1:42 problemas. Pelos preços de tabela da Astra, quinze milhões de dólares em tokens para um prêmio de um milhão de dólares que a OpenAI diz que não vai reivindicar, e com essa margem, quem o faria. O outro lado. Tristan Buckmaster na NYU e Levent Alpöge, que trabalha na Anthropic, passaram um ano impulsionando uma abordagem de Córdoba e Martínez-Zoroa com Claude e Codex, pagando a OpenAI com os próprios fundos de pesquisa de Buckmaster. Em 15 de agosto eles conseguiram a explosão para as equações de Euler; Buckmaster chama a primeira prova de LLM a mais horrenda que já leu,
2:10 e foi verificada em Lean em 22 de agosto. Então um rumor se espalhou, e em 3 de setembro ele enviou um e-mail para a OpenAI: somos nós, é pessoal, publicaremos em breve. No domingo, às 12:45, a OpenAI pediu para se encontrar a qualquer momento hoje, e Sébastien Bubeck se juntou. Buckmaster foi informado que o modelo havia provado Navier–Stokes forçado com muito pouca entrada humana, o que durante a ligação se tornou uma equipe inteira, problemas mais fáceis primeiro, um prompt escrito pelo Codex, e uma quantidade insana de
2:36 computação. Ele perguntou quando o primeiro prompt foi enviado. Eventualmente: nos últimos dias, depois que informações sobre nosso trabalho chegaram à OpenAI. Duas ofertas se seguiram. Uma: você publica Euler, nós publicamos Navier–Stokes no dia seguinte. Duas: Buckmaster sozinho redige a prova da OpenAI, e, ele diz, Bubeck duas vezes quis Alpöge fora do artigo porque ele trabalha na Anthropic. Ele recusou e disse que tornaria público. A resposta, conforme a declaração: por que você arruinaria sua carreira,
3:00 depois: se você não quer que eu seja legal, eu não preciso ser legal. Normalmente a frase antes da cabeça de um cavalo aparecer em uma cama. Versão da OpenAI: ninguém viu o trabalho deles, nenhum dado de usuário foi acessado, e, nota de rodapé, eles não podem descartar que dados desidentificados do uso dos produtos dos professores ajudaram a melhorar o modelo. Avaliação de Alpöge: parabéns a eles por serem diretos. Sam Altman diz que todos agiram com integridade e generosidade e a outra equipe
3:25 ameaçou acusações infundadas de plágio, escrito com um i. Então a posição oficial: não copiamos sua lição de casa, ouvimos dizer que você estava fazendo a lição de casa. Terence Tao chamou o resultado dos professores de notável e observou que Buckmaster explicou-lhe por telefone, uma mudança refrescante das modalidades de comunicação baseadas em IA. Então, quatro posts: bons problemas em aberto agora são explorados como um recurso não renovável, mesmo um rumor de alguém trabalhando em um desencadeia um esforço massivo de IA para resolvê-lo rapidamente, então o incentivo é parar de compartilhar direções de pesquisa,
3:55 invertendo séculos de ciência aberta. Três grupos postaram explosão de fluidos em um fim de semana; o próximo artigo pode ser um NDA. Esse é o clima em que Jacob Coxon renunciou: três anos de pré-treinamento na OpenAI, depois Anthropic; nenhuma das empresas está agindo com responsabilidade, ele diz, ambas estão correndo para a superinteligência autoaperfeiçoável, e o jogo final não deveria ser lançado do Slack de uma empresa privada. Quarenta e quatro milhões de visualizações, no dia em que um laboratório colocou dez mil agentes em um rumor,
4:21 então o thread foi lançado com uma demonstração ao vivo. Enquanto isso, a Meta lançou o Muse: um agente pessoal em sua própria VM de nuvem com seu próprio navegador, e você fala com ele no WhatsApp. Apenas nos EUA, grátis para a maioria das coisas. A Meta promete uma versão que nem a Meta pode ler, ainda este ano, uma maneira muito específica de descrever este ano. Comentário principal do Hacker News: Não quero compartilhar minha vida com a Meta assim. Segundo: ele continua tentando me vender um carrinho de bebê.
4:45 Se você preferir ler isso a me ouvir dizer, o diff chega à sua caixa de entrada todas as manhãs — grátis em the daily diff dot dev, link abaixo. Então — o veredito de hoje: precisa de revisão. A prova compila; a história não. Dez mil agentes fechando um problema de noventa anos em um fim de semana é o resultado de capacidade do ano; anunciá-lo com uma ligação de domingo para as duas pessoas de quem você ouviu falar não é.
5:07 E essa é a diferença de hoje. Sou Niko da Axrisi. Faça a fusão com responsabilidade.
Fontes
- OpenAI: On the Navier–Stokes Millennium Prize Problemopenai.com
- OpenAI Lean formalizationgithub.com
- Tristan Buckmaster, statement (PDF)cims.nyu.edu
- HN: Buckmaster statementnews.ycombinator.com
- HN: OpenAI postnews.ycombinator.com
- Terence Tao on the Alpöge–Buckmaster resultmathstodon.xyz
- Terence Tao: open problems mined non-renewablymathstodon.xyz
- HN: Tao threadnews.ycombinator.com
- Clay Mathematics Institute: Navier–Stokes problem statementwww.claymath.org
- GPT-6 Astra pricing (used for the token-bill arithmetic)openai.com
- Jacob Coxon's resignation threadx.com
- HN: I resigned from Anthropic todaynews.ycombinator.com
- Meta: Introducing Museabout.fb.com
- Museai.meta.com
- HN: Musenews.ycombinator.com



