+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

OpenAI diu que va resoldre Navier–Stokes. Veredicte: CAL REVISAR-HO.

OpenAI diu que un model intern, executat com a uns 10.000 agents concurrents durant 88 hores, va produir una prova verificada per Lean que les equacions de Navier–Stokes esclaten en temps finit —un problema del Premi del Mil·lenni obert des de 1934.

OpenAI diu que un model intern, executat com a uns 10.000 agents concurrents durant 88 hores, va produir una prova verificada per Lean que les equacions de Navier–Stokes esclaten en temps finit —un problema del Premi del Mil·lenni obert des de 1934. Dotze hores abans, Tristan Buckmaster de la NYU va publicar una declaració de quatre pàgines sobre com va anar la trucada telefònica de diumenge amb OpenAI ("Per què arruïnaries la teva carrera?"), Terence Tao va escriure que els problemes oberts ara s'estan explotant com un recurs no renovable, i un investigador de preentrenament d'Anthropic va dimitir per la cursa. També: Meta ENVIA Muse, un agent personal amb la seva pròpia màquina virtual. Veredicte: CAL REVISAR-HO.

Llegeix l'edició escrita (anglès) ↗

Què cobreix aquest vídeo

  • OpenAI: explosió de Navier–Stokes, ~10.000 agents, 88 hores, 130B tokens de sortida, verificat per Lean
  • Buckmaster i Alpöge: un any amb la mateixa aproximació, un rumor i una trucada de diumenge amb dues ofertes
  • Terence Tao: "fins i tot el rumor d'algú treballant en un problema pot desencadenar una quantitat massiva d'esforç impulsat per IA per aplanar-lo"
  • Jacob Coxon dimiteix d'Anthropic: ambdós laboratoris estan "corrent directament cap a la superintel·ligència auto-millorable"
  • Meta ENVIA Muse: un agent personal en la seva pròpia màquina virtual al núvol, a WhatsApp, només als EUA

Transcripció traduïda

Traduït de la narració original en anglès. L'àudio i els subtítols disponibles estan controlats per YouTube.

0:00 Ahir, OpenAI va anunciar que la seva IA va resoldre un problema del Premi del Mil·lenni, obert durant noranta anys, un milió de dòlars, en vuitanta-vuit hores, i els dos matemàtics que van passar un any amb el mateix problema se'n van assabentar en una trucada telefònica de diumenge que, segons un d'ells, incloïa: per què arruïnaries la teva carrera? Va ser un dilluns llarg. A l'alba, un professor de la NYU va publicar una declaració de quatre pàgines; mil sis-cents punts a Hacker News. A la tarda, OpenAI va publicar la prova.

0:26 Al vespre, Terence Tao va dir que els problemes oberts ara s'extreuen com un recurs no renovable, i durant la nit un investigador d'Anthropic va dimitir a X, quaranta-quatre milions de visualitzacions, perquè ambdós laboratoris estan, cito, jugant amb les nostres vides. A més, Meta va ENVIAR un agent personal que viu a WhatsApp i té el seu propi ordinador. En aquest vídeo: la prova, la trucada, la nota a peu de pàgina, i la frase que Terence Tao vol que els laboratoris escoltin.

0:49 És dimecres, 9 de setembre, i això és The Daily Diff. Primer les matemàtiques. Navier–Stokes descriu com es mouen els fluids, i des de 1934 ningú sabia si un fluid 3D suau pot arribar a una singularitat: la velocitat es fa infinita en temps finit. El sistema d'OpenAI diu que sí. Comença en repòs, aplica una força suau, mantén l'energia finita, i un vòrtex s'espirala cap a dins com espaguetis fins que la velocitat es dispara. Declaracions C i D de la formulació de Clay, a Lean,

1:16 disset hores d'Astra per verificar. Així que els fluids poden explotar, cosa que qualsevol que hagués vessat cafè en un MacBook ja sabia, però ara està en Lean. Com: OpenAI té un nou model intern que anomena significativament més capaç que Astra, i l'1 de setembre van sentir un rumor que s'havien resolt dos problemes del Mil·lenni, així que el van dirigir a tots els que estaven oberts. El grup de Navier–Stokes: uns deu mil agents concurrents, cent trenta mil milions de tokens de sortida; tres-cents mil milions en tots els

1:42 problemes. Als preus de llista d'Astra, quinze milions de dòlars en tokens per a un premi d'un milió de dòlars que OpenAI diu que no reclamarà, i amb aquest marge, qui ho faria. L'altra banda. Tristan Buckmaster de la NYU i Levent Alpöge, que treballa a Anthropic, van passar un any impulsant una aproximació de Córdoba i Martínez-Zoroa amb Claude i Codex, pagant a OpenAI amb els fons de recerca del propi Buckmaster. El 15 d'agost van obtenir una explosió per a les equacions d'Euler; Buckmaster qualifica la primera prova de LLM com la més horrible que ha llegit mai,

2:10 i es va verificar a Lean el 22 d'agost. Llavors es va estendre un rumor, i el 3 de setembre va enviar un correu electrònic a OpenAI: som nosaltres, és personal, ho publicarem aviat. Diumenge a les 12:45 OpenAI va demanar de reunir-se en qualsevol moment del dia, i Sébastien Bubeck s'hi va unir. A Buckmaster li van dir que el model havia demostrat Navier–Stokes forçat amb molt poca intervenció humana, cosa que durant la trucada es va convertir en tot un equip, problemes més fàcils primer, un prompt escrit per Codex, i una quantitat boja de

2:36 càlcul. Va preguntar quan es va enviar el primer prompt. Finalment: en els darrers dies, després que la informació sobre el nostre treball hagués arribat a OpenAI. Van seguir dues ofertes. Una: tu publiques Euler, nosaltres publiquem Navier–Stokes l'endemà. Dos: Buckmaster sol redacta la prova d'OpenAI, i, diu, Bubeck va voler dues vegades que Alpöge no participés en l'article perquè treballa a Anthropic. Va declinar i va dir que ho faria públic. La resposta, segons la declaració: per què arruïnaries la teva carrera,

3:00 després: si no vols que sigui amable, no he de ser amable. Normalment la línia just abans que el cap d'un cavall aparegui en un llit. Versió d'OpenAI: ningú va veure el seu treball, no es va accedir a dades d'usuari, i, nota a peu de pàgina, no poden descartar que dades desidentificades de l'ús dels seus productes pels professors ajudessin a millorar el model. Revisió d'Alpöge: els felicito per haver-ho confessat directament. Sam Altman diu que tothom va actuar amb integritat i generositat i l'altre equip

3:25 va amenaçar amb acusacions infundades de plagi, escrit amb una sola 'i'. Així que la posició oficial: no vam copiar els teus deures, vam sentir que estaves fent deures. Terence Tao va qualificar el resultat dels professors de notable i va assenyalar que Buckmaster li ho va explicar per telèfon, un canvi refrescant respecte a les modalitats de comunicació basades en IA. Després, quatre publicacions: els bons problemes oberts ara s'extreuen com un recurs no renovable, fins i tot un rumor d'algú treballant en un desencadena un esforç massiu d'IA per aplanar-lo, de manera que l'incentiu és deixar de compartir direccions de recerca,

3:55 invertint segles de ciència oberta. Tres grups van publicar l'explosió de fluids en un cap de setmana; el proper article podria ser un acord de confidencialitat. Aquest és l'estat d'ànim en què Jacob Coxon va dimitir: tres anys de preentrenament a OpenAI, després Anthropic; cap de les dues empreses actua de manera responsable, diu, ambdues estan corrent cap a la superintel·ligència auto-millorable, i el desenllaç no s'hauria de llançar des del Slack d'una empresa privada. Quaranta-quatre milions de visualitzacions, el dia que un laboratori va posar deu mil agents en un rumor,

4:21 així que el fil es va ENVIAR amb una demo en viu. Mentrestant, Meta va ENVIAR Muse: un agent personal en la seva pròpia màquina virtual al núvol amb el seu propi navegador, i li parles a WhatsApp. Només als EUA, gratuït per a la majoria de coses. Meta promet una versió que ni tan sols Meta podrà llegir, a finals d'aquest any, una manera molt específica de descriure aquest any. Comentari principal de Hacker News: No vull compartir la meva vida amb Meta així. Segon: em segueix intentant vendre un cotxet.

4:45 Si prefereixes llegir-ho que sentir-me dir-ho, The Daily Diff arriba a la teva safata d'entrada cada matí — gratuït a the daily diff dot dev, enllaç a continuació. Així que — el veredicte d'avui: cal revisar-ho. La prova compila; la història no. Deu mil agents tancant un problema de noranta anys en un cap de setmana és el resultat de capacitat de l'any; anunciar-ho amb una trucada telefònica de diumenge a les dues persones de qui ho vas sentir no ho és.

5:07 I aquesta és la diferència d'avui. Sóc Niko d'Axrisi. Fusiona amb responsabilitat.

Fonts

  1. OpenAI: On the Navier–Stokes Millennium Prize Problemopenai.com
  2. OpenAI Lean formalizationgithub.com
  3. Tristan Buckmaster, statement (PDF)cims.nyu.edu
  4. HN: Buckmaster statementnews.ycombinator.com
  5. HN: OpenAI postnews.ycombinator.com
  6. Terence Tao on the Alpöge–Buckmaster resultmathstodon.xyz
  7. Terence Tao: open problems mined non-renewablymathstodon.xyz
  8. HN: Tao threadnews.ycombinator.com
  9. Clay Mathematics Institute: Navier–Stokes problem statementwww.claymath.org
  10. GPT-6 Astra pricing (used for the token-bill arithmetic)openai.com
  11. Jacob Coxon's resignation threadx.com
  12. HN: I resigned from Anthropic todaynews.ycombinator.com
  13. Meta: Introducing Museabout.fb.com
  14. Museai.meta.com
  15. HN: Musenews.ycombinator.com

Vídeos relacionats