+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

OpenAI dice haber resuelto Navier-Stokes. Veredicto: NEEDS REVIEW.

OpenAI afirma que un modelo interno, ejecutado como aproximadamente 10.000 agentes concurrentes durante 88 horas, produjo una prueba verificada por Lean de que las ecuaciones de Navier-Stokes explotan en tiempo finito, un problema del Premio del Milenio abierto desde 1934.

OpenAI afirma que un modelo interno, ejecutado como aproximadamente 10.000 agentes concurrentes durante 88 horas, produjo una prueba verificada por Lean de que las ecuaciones de Navier-Stokes explotan en tiempo finito, un problema del Premio del Milenio abierto desde 1934. Doce horas antes, Tristan Buckmaster de NYU publicó un comunicado de cuatro páginas sobre cómo fue la llamada telefónica del domingo con OpenAI ("¿Por qué arruinarías tu carrera?"), Terence Tao escribió que los problemas abiertos ahora están siendo explotados como un recurso no renovable, y un investigador de preentrenamiento de Anthropic renunció debido a la carrera. Además: Meta lanza Muse, un agente personal con su propia VM. Veredicto: NEEDS REVIEW.

Leer la edición escrita (inglés) ↗

Qué cubre este vídeo

  • OpenAI: explosión de Navier-Stokes, ~10.000 agentes, 88 horas, 130.000 millones de tokens de salida, verificado por Lean
  • Buckmaster y Alpöge: un año con el mismo enfoque, un rumor y una llamada dominical con dos ofertas
  • Terence Tao: "incluso el rumor de alguien trabajando en un problema puede desencadenar una cantidad masiva de esfuerzo impulsado por IA para resolverlo"
  • Jacob Coxon renuncia a Anthropic: ambos laboratorios están "corriendo directamente hacia la superinteligencia auto-mejorable"
  • Meta lanza Muse: un agente personal en su propia VM en la nube, en WhatsApp, solo en EE. UU.

Transcripción traducida

Traducido de la narración original en inglés. El audio y los subtítulos disponibles están controlados por YouTube.

0:00 Ayer, OpenAI anunció que su IA resolvió un problema del Premio del Milenio, noventa años abierto, un millón de dólares, en ochenta y ocho horas, y los dos matemáticos que pasaron un año en el mismo problema se enteraron en una llamada telefónica dominical que, según uno de ellos, incluía: ¿por qué arruinarías tu carrera? Fue un lunes largo. Al amanecer, un profesor de NYU publicó un comunicado de cuatro páginas; mil seiscientos puntos en Hacker News. Por la tarde, OpenAI publicó la prueba.

0:26 Por la noche, Terence Tao dijo que los problemas abiertos ahora se explotan como un recurso no renovable, y durante la noche un investigador de Anthropic renunció en X, cuarenta y cuatro millones de visitas, porque ambos laboratorios están, cito, jugándose nuestras vidas. Además, Meta lanzó un agente personal que vive en WhatsApp y tiene su propio ordenador. En este video: la prueba, la llamada telefónica, la nota a pie de página, y la frase que Terence Tao quiere que escuchen los laboratorios.

0:49 Es miércoles, 9 de septiembre, y esto es The Daily Diff. Las matemáticas primero. Navier-Stokes describe cómo se mueven los fluidos, y desde 1934 nadie sabía si un fluido 3D suave puede alcanzar una singularidad: velocidad infinita en tiempo finito. El sistema de OpenAI dice que sí. Comience en reposo, aplique una fuerza suave, mantenga la energía finita, y un vórtice se enrosca hacia adentro como espagueti hasta que la velocidad explota. Declaraciones C y D de la formulación de Clay, en Lean,

1:16 diecisiete horas de Astra para verificar. Así que los fluidos pueden explotar, lo que cualquiera que derramó café en un MacBook sabía, pero ahora está en Lean. Cómo: OpenAI tiene un nuevo modelo interno que llama significativamente más capaz que Astra, y el 1 de septiembre escucharon el rumor de que se habían resuelto dos problemas del Milenio, así que lo apuntaron a cada uno de los problemas abiertos. El grupo de Navier-Stokes: unos diez mil agentes concurrentes, ciento treinta mil millones de tokens de salida; trescientos mil millones en todos los

1:42 problemas. A precios de lista de Astra, quince millones de dólares en tokens para un premio de un millón de dólares que OpenAI dice que no reclamará, y con ese margen, quién lo haría. El otro lado. Tristan Buckmaster de NYU y Levent Alpöge, que trabaja en Anthropic, pasaron un año impulsando un enfoque de Córdoba y Martínez-Zoroa con Claude y Codex, pagando a OpenAI con los propios fondos de investigación de Buckmaster. El 15 de agosto obtuvieron la explosión para las ecuaciones de Euler; Buckmaster califica la primera prueba de LLM como la más horrenda que jamás ha leído,

2:10 y se verificó en Lean el 22 de agosto. Luego se corrió un rumor, y el 3 de septiembre le envió un correo electrónico a OpenAI: somos nosotros, es personal, lo publicaremos pronto. El domingo a las 12:45 OpenAI pidió reunirse en cualquier momento hoy, y Sébastien Bubeck se unió. A Buckmaster se le dijo que el modelo había probado Navier-Stokes forzado con muy poca intervención humana, lo que durante la llamada se convirtió en un equipo completo, problemas más fáciles primero, un "prompt" escrito por Codex, y una cantidad insana de

2:36 computación. Preguntó cuándo se envió el primer "prompt". Eventualmente: en los últimos días, después de que la información sobre nuestro trabajo hubiera llegado a OpenAI. Siguieron dos ofertas. Una: ustedes publican Euler, nosotros publicamos Navier-Stokes al día siguiente. Dos: Buckmaster solo redacta la prueba de OpenAI, y, dice, Bubeck quiso dos veces que Alpöge no participara en el artículo porque trabaja en Anthropic. Él se negó y dijo que lo haría público. La respuesta, según el comunicado: ¿por qué arruinarías tu carrera?

3:00 luego: si no quieres que sea amable, no tengo por qué ser amable. Normalmente la frase justo antes de que una cabeza de caballo aparezca en una cama. La versión de OpenAI: nadie vio su trabajo, no se accedió a datos de usuario, y, nota a pie de página, no pueden descartar que datos anonimizados del uso de los profesores de sus productos ayudaron a mejorar el modelo. La reseña de Alpöge: les doy mi enhorabuena por ser tan directos. Sam Altman dice que todos actuaron con integridad y generosidad y el otro equipo

3:25 amenazó con acusaciones infundadas de plagio, deletreado con una sola i. Así que la posición oficial: no copiamos su tarea, escuchamos que estaban haciendo la tarea. Terence Tao calificó el resultado de los profesores como notable y señaló que Buckmaster se lo explicó por teléfono, un cambio refrescante de las modalidades de comunicación basadas en IA. Luego, cuatro publicaciones: los buenos problemas abiertos ahora se explotan como un recurso no renovable, incluso un rumor de alguien trabajando en uno desencadena un esfuerzo masivo de IA para resolverlo, por lo que el incentivo es dejar de compartir las direcciones de investigación,

3:55 revirtiendo siglos de ciencia abierta. Tres grupos publicaron la explosión de fluidos en un fin de semana; el próximo artículo puede ser un NDA. Ese es el ambiente en el que Jacob Coxon renunció: tres años de preentrenamiento en OpenAI, luego Anthropic; ninguna de las compañías está actuando de manera responsable, dice, ambas están corriendo hacia la superinteligencia auto-mejorable, y el juego final no debería lanzarse desde el Slack de una empresa privada. Cuarenta y cuatro millones de visitas, el día que un laboratorio puso diez mil agentes a trabajar en un rumor,

4:21 así que el hilo se lanzó con una demostración en vivo. Mientras tanto, Meta lanzó Muse: un agente personal en su propia VM en la nube con su propio navegador, y hablas con él en WhatsApp. Solo en EE. UU., gratis para la mayoría de las cosas. Meta promete una versión que ni siquiera Meta podrá leer, a finales de este año, una forma muy específica de describir este año. Comentario principal de Hacker News: No quiero compartir mi vida con Meta de esta manera. Segundo: sigue intentando venderme un cochecito.

4:45 Si prefieres leer esto antes que oírme decirlo, la diferencia llega a tu bandeja de entrada cada mañana — gratis en the daily diff dot dev, enlace a continuación. Así que — el veredicto de hoy: necesita revisión. La prueba se compila; la historia no. Diez mil agentes resolviendo un problema de noventa años en un fin de semana es el resultado de capacidad del año; anunciarlo con una llamada telefónica de domingo a las dos personas de quienes te enteraste no lo es.

5:07 Y esa es la diferencia de hoy. Soy Niko de Axrisi. Fusionar responsablemente.

Fuentes

  1. OpenAI: On the Navier–Stokes Millennium Prize Problemopenai.com
  2. OpenAI Lean formalizationgithub.com
  3. Tristan Buckmaster, statement (PDF)cims.nyu.edu
  4. HN: Buckmaster statementnews.ycombinator.com
  5. HN: OpenAI postnews.ycombinator.com
  6. Terence Tao on the Alpöge–Buckmaster resultmathstodon.xyz
  7. Terence Tao: open problems mined non-renewablymathstodon.xyz
  8. HN: Tao threadnews.ycombinator.com
  9. Clay Mathematics Institute: Navier–Stokes problem statementwww.claymath.org
  10. GPT-6 Astra pricing (used for the token-bill arithmetic)openai.com
  11. Jacob Coxon's resignation threadx.com
  12. HN: I resigned from Anthropic todaynews.ycombinator.com
  13. Meta: Introducing Museabout.fb.com
  14. Museai.meta.com
  15. HN: Musenews.ycombinator.com

Vídeos relacionados