OpenAI affirme avoir résolu Navier–Stokes. Verdict : NÉCESSITE UN EXAMEN.
OpenAI affirme qu'un modèle interne, exécuté sous la forme d'environ 10 000 agents concurrents pendant 88 heures, a produit une preuve vérifiée par Lean que les équations de Navier–Stokes explosent en temps fini – un problème du Prix du Millénaire ouvert depuis 1934.
OpenAI affirme qu'un modèle interne, exécuté sous la forme d'environ 10 000 agents concurrents pendant 88 heures, a produit une preuve vérifiée par Lean que les équations de Navier–Stokes explosent en temps fini – un problème du Prix du Millénaire ouvert depuis 1934. Douze heures plus tôt, Tristan Buckmaster de NYU a publié une déclaration de quatre pages sur le déroulement de l'appel téléphonique du dimanche avec OpenAI (« Pourquoi ruinerais-tu ta carrière ? »), Terence Tao a écrit que les problèmes ouverts sont maintenant exploités comme une ressource non renouvelable, et un chercheur en pré-entraînement d'Anthropic a démissionné en raison de cette course. Aussi : Meta lance Muse, un agent personnel avec sa propre VM. Verdict : NÉCESSITE UN EXAMEN.
Lire l'édition écrite (anglais) ↗
Ce que couvre cette vidéo
- OpenAI : Explosion de Navier–Stokes, ~10 000 agents, 88 heures, 130 milliards de tokens en sortie, vérifié par Lean
- Buckmaster et Alpöge : un an sur la même approche, une rumeur et un appel du dimanche avec deux offres
- Terence Tao : "même la rumeur que quelqu'un travaille sur un problème peut déclencher un effort massif alimenté par l'IA pour le résoudre"
- Jacob Coxon démissionne d'Anthropic : les deux laboratoires "foncent tout droit vers une superintelligence auto-améliorante"
- Meta lance Muse : un agent personnel sur sa propre VM cloud, dans WhatsApp, US uniquement
Transcription traduite
Traduit de la narration originale en anglais. L'audio et les sous-titres disponibles sont gérés par YouTube.
0:00 Hier, OpenAI a annoncé que son IA avait résolu un problème du Prix du Millénaire, ouvert depuis quatre-vingt-dix ans, un million de dollars, en quatre-vingt-huit heures, et les deux mathématiciens qui ont passé un an sur le même problème l'ont appris lors d'un appel téléphonique le dimanche qui, selon l'un d'eux, incluait : pourquoi ruinerais-tu ta carrière ? Ce fut un long lundi. À l'aube, un professeur de NYU a posté une déclaration de quatre pages ; seize cents points sur Hacker News. Dans l'après-midi, OpenAI a publié la preuve.
0:26 Le soir, Terence Tao a déclaré que les problèmes ouverts sont maintenant exploités comme une ressource non renouvelable, et pendant la nuit, un chercheur d'Anthropic a démissionné sur X, quarante-quatre millions de vues, parce que les deux laboratoires sont, je cite, en train de jouer avec nos vies. De plus, Meta a lancé un agent personnel qui vit dans WhatsApp et a son propre ordinateur. Dans cette vidéo : la preuve, l'appel téléphonique, la note de bas de page, et la phrase que Terence Tao veut que les laboratoires entendent.
0:49 Nous sommes le mercredi 9 septembre, et c'est The Daily Diff. Les mathématiques d'abord. Navier–Stokes décrit comment les fluides se déplacent, et depuis 1934, personne ne savait si un fluide 3D lisse pouvait atteindre une singularité : la vitesse devenant infinie en temps fini. Le système d'OpenAI dit oui. Commencez au repos, appliquez une force lisse, maintenez l'énergie finie, et un vortex s'enroule vers l'intérieur comme des spaghettis jusqu'à ce que la vitesse explose. Les énoncés C et D de la formulation de Clay, en Lean,
1:16 dix-sept heures d'Astra pour vérifier. Donc les fluides peuvent exploser, ce que quiconque a renversé du café sur un MacBook savait, mais maintenant c'est en Lean. Comment : OpenAI dispose d'un nouveau modèle interne qu'elle qualifie de significativement plus capable que Astra, et le 1er septembre, ils ont entendu une rumeur selon laquelle deux problèmes du Millénaire avaient été résolus, alors ils l'ont pointé vers tous les problèmes ouverts. Le groupe Navier–Stokes : environ dix mille agents concurrents, cent trente milliards de tokens en sortie ; trois cents milliards pour tous les
1:42 problèmes. Aux prix catalogue d'Astra, quinze millions de dollars de tokens pour un prix d'un million de dollars qu'OpenAI dit ne pas réclamer, et à cette marge, qui le ferait. L'autre côté. Tristan Buckmaster à NYU et Levent Alpöge, qui travaille chez Anthropic, ont passé un an à pousser une approche de Córdoba et Martínez-Zoroa avec Claude et Codex, payant OpenAI avec les propres fonds de recherche de Buckmaster. Le 15 août, ils ont obtenu une explosion pour les équations d'Euler ; Buckmaster qualifie la première preuve de LLM la plus horrible qu'il ait jamais lue,
2:10 et elle a été vérifiée en Lean le 22 août. Puis une rumeur s'est répandue, et le 3 septembre, il a envoyé un courriel à OpenAI : c'est nous, c'est personnel, nous publierons bientôt. Dimanche à 12h45, OpenAI a demandé à se rencontrer à tout moment aujourd'hui, et Sébastien Bubeck s'est joint à la conversation. Buckmaster s'est vu dire que le modèle avait prouvé les Navier–Stokes forcées avec très peu d'intervention humaine, ce qui au cours de l'appel est devenu une équipe entière, des problèmes plus faciles d'abord, une invite écrite par Codex, et une quantité folle de
2:36 calcul. Il a demandé quand la première invite avait été envoyée. Finalement : ces derniers jours, après que des informations sur notre travail aient atteint OpenAI. Deux offres ont suivi. Une : vous postez Euler, nous postons Navier–Stokes le lendemain. Deux : Buckmaster seul rédige la preuve d'OpenAI, et, dit-il, Bubeck a deux fois voulu qu'Alpöge ne figure pas sur le papier parce qu'il travaille chez Anthropic. Il a refusé et a dit qu'il rendrait l'affaire publique. La réponse, selon la déclaration : pourquoi ruinerais-tu ta carrière,
3:00 puis : si tu ne veux pas que je sois gentil, je n'ai pas à l'être. Normalement, la ligne juste avant qu'une tête de cheval n'apparaisse dans un lit. La version d'OpenAI : personne n'a vu leur travail, aucune donnée utilisateur n'a été consultée, et, note de bas de page, ils ne peuvent exclure que des données dé-identifiées provenant de l'utilisation de leurs produits par les professeurs aient contribué à améliorer le modèle. L'avis d'Alpöge : bravo à eux d'avoir été honnêtes. Sam Altman dit que tout le monde a agi avec intégrité et générosité et que l'autre équipe
3:25 a menacé d'accusations de plagiat sans fondement, orthographié avec un seul i. Donc la position officielle : nous n'avons pas copié vos devoirs, nous avons entendu dire que vous faisiez vos devoirs. Terence Tao a qualifié le résultat des professeurs de remarquable et a noté que Buckmaster le lui avait expliqué par téléphone, un changement rafraîchissant par rapport aux modalités de communication basées sur l'IA. Ensuite, quatre posts : les bons problèmes ouverts sont maintenant exploités comme une ressource non renouvelable, même une rumeur que quelqu'un travaille sur l'un d'eux déclenche un effort massif d'IA pour le résoudre, donc l'incitation est d'arrêter de partager les directions de recherche,
3:55 inversant des siècles de science ouverte. Trois groupes ont publié une explosion de fluide en un week-end ; le prochain papier pourrait être un NDA. C'est l'ambiance dans laquelle Jacob Coxon a démissionné : trois ans de pré-entraînement chez OpenAI, puis Anthropic ; aucune des deux entreprises n'agit de manière responsable, dit-il, les deux se précipitent vers une superintelligence auto-améliorante, et l'objectif final ne devrait pas être lancé depuis le Slack d'une entreprise privée. Quarante-quatre millions de vues, le jour où un laboratoire a mis dix mille agents sur une rumeur,
4:21 donc le fil a été livré avec une démo en direct. Pendant ce temps, Meta a lancé Muse : un agent personnel sur sa propre VM cloud avec son propre navigateur, et vous lui parlez dans WhatsApp. US uniquement, gratuit pour la plupart des choses. Meta promet une version que même Meta ne pourra pas lire, plus tard cette année, une façon très spécifique de décrire cette année. Premier commentaire de Hacker News : je ne veux pas partager ma vie avec Meta comme ça. Deuxième : il n'arrête pas d'essayer de me vendre une poussette.
4:45 Si vous préférez lire ceci plutôt que de m'entendre le dire, la différence arrive dans votre boîte de réception chaque matin — gratuit sur the daily diff dot dev, lien ci-dessous. Donc — le verdict d'aujourd'hui : NEEDS REVIEW. La preuve compile ; l'histoire non. Dix mille agents résolvant un problème vieux de quatre-vingt-dix ans en un week-end est le résultat de capacité de l'année ; l'annoncer par un appel téléphonique le dimanche aux deux personnes de qui vous l'avez appris ne l'est pas.
5:07 Et c'est la différence pour aujourd'hui. Je suis Niko d'Axrisi. Fusionnez de manière responsable.
Sources
- OpenAI: On the Navier–Stokes Millennium Prize Problemopenai.com
- OpenAI Lean formalizationgithub.com
- Tristan Buckmaster, statement (PDF)cims.nyu.edu
- HN: Buckmaster statementnews.ycombinator.com
- HN: OpenAI postnews.ycombinator.com
- Terence Tao on the Alpöge–Buckmaster resultmathstodon.xyz
- Terence Tao: open problems mined non-renewablymathstodon.xyz
- HN: Tao threadnews.ycombinator.com
- Clay Mathematics Institute: Navier–Stokes problem statementwww.claymath.org
- GPT-6 Astra pricing (used for the token-bill arithmetic)openai.com
- Jacob Coxon's resignation threadx.com
- HN: I resigned from Anthropic todaynews.ycombinator.com
- Meta: Introducing Museabout.fb.com
- Museai.meta.com
- HN: Musenews.ycombinator.com



