OpenAI affirme avoir résolu Navier–Stokes. Verdict : NEEDS REVIEW.
OpenAI affirme qu'un modèle interne, exécuté par environ 10 000 agents simultanés pendant 88 heures, a produit une preuve vérifiée par Lean que les équations de Navier–Stokes explosent en temps fini – un problème du Prix du Millénaire ouvert depuis 1934.
OpenAI affirme qu'un modèle interne, exécuté par environ 10 000 agents simultanés pendant 88 heures, a produit une preuve vérifiée par Lean que les équations de Navier–Stokes explosent en temps fini – un problème du Prix du Millénaire ouvert depuis 1934. Douze heures plus tôt, Tristan Buckmaster de NYU a publié une déclaration de quatre pages sur le déroulement de l'appel téléphonique du dimanche avec OpenAI ("Pourquoi ruinerais-tu ta carrière ?"), Terence Tao a écrit que les problèmes ouverts sont maintenant exploités comme une ressource non renouvelable, et un chercheur en pré-entraînement chez Anthropic a démissionné en raison de la course. Aussi : Meta lance Muse, un agent personnel avec sa propre VM. Verdict : NEEDS REVIEW.
Lire l'édition écrite (anglais) ↗
Ce que cette vidéo couvre
- OpenAI : explosion de Navier–Stokes, ~10 000 agents, 88 heures, 130 milliards de jetons de sortie, vérifié par Lean
- Buckmaster et Alpöge : un an sur la même approche, une rumeur et un appel du dimanche avec deux offres
- Terence Tao : « même la rumeur de quelqu'un travaillant sur un problème peut déclencher une quantité massive d'efforts alimentés par l'IA pour le résoudre »
- Jacob Coxon démissionne d'Anthropic : les deux laboratoires « courent directement vers la superintelligence auto-améliorante »
- Meta lance Muse : un agent personnel sur sa propre VM cloud, dans WhatsApp, aux États-Unis seulement
Transcription traduite
Traduit de la narration originale en anglais. L'audio et les sous-titres disponibles sont contrôlés par YouTube.
0:00 Hier, OpenAI a annoncé que son IA avait résolu un problème du Prix du Millénaire, ouvert depuis quatre-vingt-dix ans, un million de dollars, en quatre-vingt-huit heures, et les deux mathématiciens qui ont passé un an sur le même problème l'ont appris lors d'un appel téléphonique le dimanche qui, selon l'un d'eux, incluait : pourquoi ruinerais-tu ta carrière ? Ce fut un long lundi. À l'aube, un professeur de NYU a posté une déclaration de quatre pages ; seize cents points sur Hacker News. Dans l'après-midi, OpenAI a publié la preuve.
0:26 Le soir, Terence Tao a dit que les problèmes ouverts sont maintenant exploités comme une ressource non renouvelable, et pendant la nuit, un chercheur d'Anthropic a démissionné sur X, quarante-quatre millions de vues, parce que les deux laboratoires sont, je cite, en train de jouer avec nos vies. Aussi, Meta a lancé un agent personnel qui vit dans WhatsApp et a son propre ordinateur. Dans cette vidéo : la preuve, l'appel téléphonique, la note de bas de page, et la phrase que Terence Tao veut que les laboratoires entendent.
0:49 Nous sommes mercredi 9 septembre, et ceci est The Daily Diff. Les maths d'abord. Navier–Stokes décrit le mouvement des fluides, et depuis 1934, personne ne savait si un fluide 3D lisse pouvait atteindre une singularité : vitesse devenant infinie en temps fini. Le système d'OpenAI dit oui. Commencez au repos, appliquez une force douce, maintenez l'énergie finie, et un vortex s'enroule vers l'intérieur comme des spaghettis jusqu'à ce que la vitesse explose. Les énoncés C et D de la formulation de Clay, en Lean,
1:16 dix-sept heures d'Astra pour vérifier. Donc les fluides peuvent exploser, ce que quiconque a renversé du café sur un MacBook savait, mais maintenant c'est en Lean. Comment : OpenAI a un nouveau modèle interne qu'elle qualifie de significativement plus capable qu'Astra, et le 1er septembre, ils ont entendu une rumeur selon laquelle deux problèmes du Millénaire avaient été résolus, alors ils l'ont pointé vers tous les problèmes ouverts. Le groupe Navier–Stokes : environ dix mille agents simultanés, cent trente milliards de jetons de sortie ; trois cents milliards sur tous les
1:42 problèmes. Aux prix catalogue d'Astra, quinze millions de dollars de jetons pour un prix d'un million de dollars qu'OpenAI dit ne pas réclamer, et à cette marge, qui le ferait. L'autre côté. Tristan Buckmaster de NYU et Levent Alpöge, qui travaille chez Anthropic, ont passé un an à pousser une approche de Córdoba et Martínez-Zoroa avec Claude et Codex, payant OpenAI avec les propres fonds de recherche de Buckmaster. Le 15 août, ils ont obtenu une explosion pour les équations d'Euler ; Buckmaster qualifie la première preuve LLM la plus horrible qu'il ait jamais lue,
2:10 et elle a été vérifiée en Lean le 22 août. Puis une rumeur s'est répandue, et le 3 septembre, il a envoyé un courriel à OpenAI : c'est nous, c'est personnel, nous publierons bientôt. Le dimanche à 12h45, OpenAI a demandé à se rencontrer à tout moment aujourd'hui, et Sébastien Bubeck s'est joint. Buckmaster a été informé que le modèle avait prouvé Navier–Stokes forcé avec très peu d'intervention humaine, ce qui au cours de l'appel est devenu toute une équipe, des problèmes plus faciles d'abord, une invite écrite par Codex, et une quantité folle de
2:36 calcul. Il a demandé quand la première invite avait été envoyée. Finalement : ces derniers jours, après que des informations sur notre travail aient atteint OpenAI. Deux offres ont suivi. Une : vous publiez Euler, nous publions Navier–Stokes le lendemain. Deux : Buckmaster seul rédige la preuve d'OpenAI, et, dit-il, Bubeck a voulu deux fois qu'Alpöge soit retiré de l'article parce qu'il travaille chez Anthropic. Il a refusé et a dit qu'il rendrait l'affaire publique. La réponse, selon la déclaration : pourquoi ruinerais-tu ta carrière,
3:00 puis : si tu ne veux pas que je sois gentil, je n'ai pas à l'être. Normalement, la phrase juste avant qu'une tête de cheval n'apparaisse dans un lit. La version d'OpenAI : personne n'a vu leur travail, aucune donnée utilisateur n'a été consultée, et, note de bas de page, ils ne peuvent pas exclure que des données dé-identifiées de l'utilisation de leurs produits par les professeurs aient aidé à améliorer le modèle. L'avis d'Alpöge : bravo à eux pour leur honnêteté. Sam Altman dit que tout le monde a agi avec intégrité et générosité et que l'autre équipe
3:25 a menacé d'accusations de plagiat infondées, écrit avec un seul i. Donc la position officielle : nous n'avons pas copié vos devoirs, nous avons entendu dire que vous faisiez vos devoirs. Terence Tao a qualifié le résultat des professeurs de remarquable et a noté que Buckmaster le lui avait expliqué au téléphone, un changement rafraîchissant par rapport aux modalités de communication basées sur l'IA. Puis, quatre messages : les bons problèmes ouverts sont maintenant exploités comme une ressource non renouvelable, même une rumeur que quelqu'un travaille sur l'un d'eux déclenche un effort massif d'IA pour le résoudre, donc l'incitation est de cesser de partager les directions de recherche,
3:55 inversant des siècles de science ouverte. Trois groupes ont publié une explosion de fluide en un week-end ; le prochain article pourrait être un NDA. C'est l'ambiance dans laquelle Jacob Coxon a démissionné : trois ans de pré-entraînement chez OpenAI, puis Anthropic ; aucune des deux entreprises n'agit de manière responsable, dit-il, les deux se précipitent vers la superintelligence auto-améliorante, et le résultat final ne devrait pas être lancé depuis le Slack d'une entreprise privée. Quarante-quatre millions de vues, le jour où un laboratoire a mis dix mille agents sur une rumeur,
4:21 donc le fil a été livré avec une démo en direct. Pendant ce temps, Meta a lancé Muse : un agent personnel sur sa propre VM cloud avec son propre navigateur, et vous lui parlez dans WhatsApp. Aux États-Unis seulement, gratuit pour la plupart des choses. Meta promet une version que même Meta ne pourra pas lire, plus tard cette année, une façon très spécifique de décrire cette année. Meilleur commentaire sur Hacker News : je ne veux pas partager ma vie avec Meta comme ça. Deuxième : il n'arrête pas d'essayer de me vendre une poussette.
4:45 Si vous préférez lire ceci plutôt que de m'entendre le dire, le "diff" arrive dans votre boîte de réception chaque matin — gratuit sur the daily diff dot dev, lien ci-dessous. Donc — le verdict d'aujourd'hui : NEEDS REVIEW. La preuve se compile ; l'histoire ne se tient pas. Dix mille agents résolvant un problème vieux de quatre-vingt-dix ans en un week-end est le résultat de capacité de l'année ; l'annoncer par un appel téléphonique le dimanche aux deux personnes de qui vous l'avez appris ne l'est pas.
5:07 Et c'est tout pour le "diff" d'aujourd'hui. Je suis Niko d'Axrisi. Fusionnez de manière responsable.
Sources
- OpenAI: On the Navier–Stokes Millennium Prize Problemopenai.com
- OpenAI Lean formalizationgithub.com
- Tristan Buckmaster, statement (PDF)cims.nyu.edu
- HN: Buckmaster statementnews.ycombinator.com
- HN: OpenAI postnews.ycombinator.com
- Terence Tao on the Alpöge–Buckmaster resultmathstodon.xyz
- Terence Tao: open problems mined non-renewablymathstodon.xyz
- HN: Tao threadnews.ycombinator.com
- Clay Mathematics Institute: Navier–Stokes problem statementwww.claymath.org
- GPT-6 Astra pricing (used for the token-bill arithmetic)openai.com
- Jacob Coxon's resignation threadx.com
- HN: I resigned from Anthropic todaynews.ycombinator.com
- Meta: Introducing Museabout.fb.com
- Museai.meta.com
- HN: Musenews.ycombinator.com



