+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

OpenAI заяўляе, што вырашыла Наўе–Стокса. Вынік: ПАТРАБУЕ ПЕРАГЛЯДУ.

OpenAI заяўляе, што ўнутраная мадэль, якая працавала як каля 10 000 адначасовых агентаў на працягу 88 гадзін, выдала праверанае Lean доказ таго, што ўраўненні Наўе–Стокса "выбухаюць" за канечны час — праблема Millennium Prize, адкрытая з 1934 года.

OpenAI заяўляе, што ўнутраная мадэль, якая працавала як каля 10 000 адначасовых агентаў на працягу 88 гадзін, выдала праверанае Lean доказ таго, што ўраўненні Наўе–Стокса "выбухаюць" за канечны час — праблема Millennium Prize, адкрытая з 1934 года. Дванаццаць гадзін таму Трыстан Бакмастэр з Нью-Йоркскага ўніверсітэта апублікаваў чатырохстаронкавую заяву пра тое, як прайшла нядзельная тэлефонная размова з OpenAI ("Навошта вам руйнаваць сваю кар'еру?"), Тэрэнс Тао напісаў, што адкрытыя праблемы цяпер здабываюцца як неўзнаўляльны рэсурс, а даследчык па перадтрэніроўцы з Anthropic звольніўся з-за гонкі. Таксама: Meta выпускае Muse, персанальнага агента з уласнай VM. Вынік: ПАТРАБУЕ ПЕРАГЛЯДУ.

Чытаць пісьмовае выданне (англійская) ↗

Што ахоплівае гэта відэа

  • OpenAI: выбух Наўе–Стокса, ~10 000 агентаў, 88 гадзін, 130 мільярдаў выходных токенаў, праверана Lean
  • Бакмастэр і Алпёгэ: год на адным падыходзе, чутка і нядзельны званок з дзвюма прапановамі
  • Тэрэнс Тао: "нават чутка пра тое, што хтосьці працуе над праблемай, можа выклікаць масіўныя намаганні штучнага інтэлекту, каб яе вырашыць"
  • Джэйкаб Коксан звольніўся з Anthropic: абедзве лабараторыі "імчацца прама да самаўдасканальваючага суперінтэлекту"
  • Meta выпускае Muse: персанальны агент на ўласнай воблачнай віртуальнай машыне, у WhatsApp, толькі для ЗША

Перакладзеная стэнаграма

Перакладзена з арыгінальнай англійскай агучкі. Даступнае аўдыя і субтытры кантралююцца YouTube.

0:00 Учора OpenAI абвясціла, што яе штучны інтэлект вырашыў праблему Millennium Prize, адкрытую дзевяноста гадоў, адзін мільён долараў, за восемдзесят восем гадзін, і два матэматыкі, якія год працавалі над той жа праблемай, даведаліся пра гэта падчас нядзельнага тэлефоннага званка, які, па словах аднаго з іх, уключаў: навошта вам руйнаваць вашу кар'еру? Гэта быў доўгі панядзелак. На світанку прафесар Нью-Йоркскага ўніверсітэта апублікаваў чатырохстаронкавую заяву; шаснаццацьсот балаў на Hacker News. Удзень OpenAI апублікавала доказ.

0:26 Увечары Тэрэнс Тао сказаў, што адкрытыя праблемы цяпер здабываюцца як неўзнаўляльны рэсурс, і за ноч даследчык Anthropic звольніўся на X, сорак чатыры мільёны праглядаў, таму што абедзве лабараторыі, цытую, гуляюць нашымі жыццямі ў азартныя гульні. Таксама Meta выпусціла персанальнага агента, які жыве ў WhatsApp і мае свой уласны кампутар. У гэтым відэа: доказ, тэлефонны званок, зноска, і сказ, які Тэрэнс Тао хоча, каб лабараторыі пачулі.

0:49 Сёння серада, 9 верасня, і гэта The Daily Diff. Спачатку матэматыка. Наўе–Стокса апісвае, як рухаюцца вадкасці, і з 1934 года ніхто не ведаў, ці можа гладкая 3D-вадкасць дасягнуць асаблівасці: хуткасць становіцца бясконцай за канечны час. Сістэма OpenAI кажа так. Пачніце ў стане спакою, прыкладзіце гладкую сілу, падтрымлівайце энергію канечнай, і віхор спіральна скручваецца ўнутр, як спагеці, пакуль хуткасць не "выбухне". Заявы C і D формулы Клэя, у Lean,

1:16 семнаццаць гадзін Astra для праверкі. Такім чынам, вадкасці могуць выбухаць, пра што ведаў кожны, хто праліў каву на MacBook, але цяпер гэта ў Lean. Як: OpenAI мае новую ўнутраную мадэль, якую яна называе значна больш здольнай, чым Astra, і 1 верасня яны пачулі чутку, што дзве праблемы Millennium былі вырашаны, таму яны накіравалі яе на кожную адкрытую праблему. Група Наўе–Стокса: каля дзесяці тысяч адначасовых агентаў, сто трыццаць мільярдаў выходных токенаў; трыста мільярдаў па ўсіх

1:42 праблемах. Па прэйскурантных цэнах Astra, пятнаццаць мільёнаў долараў токенаў за прыз у адзін мільён долараў, які OpenAI заяўляе, што не будзе прэтэндаваць, і з такой маржой, хто б стаў. Другі бок. Трыстан Бакмастэр з Нью-Йоркскага ўніверсітэта і Левент Алпёгэ, які працуе ў Anthropic, год працавалі над падыходам Кардовы і Марцінеса-Зароа з Claude і Codex, плацячы OpenAI з уласных даследчых фондаў Бакмастэра. 15 жніўня яны атрымалі "выбух" для ўраўненняў Эйлера; Бакмастэр называе першы доказ LLM самым жахлівым, які ён калі-небудзь чытаў,

2:10 і ён быў правераны ў Lean 22 жніўня. Потым распаўсюдзілася чутка, і 3 верасня ён напісаў ліст у OpenAI: гэта мы, гэта асабіста, мы хутка апублікуем. У нядзелю ў 12:45 OpenAI папрасіла сустрэцца ў любы час сёння, і далучыўся Себасцьян Бюбек. Бакмастэру сказалі, што мадэль даказала вымушаныя Наўе–Стокса з вельмі малым удзелам чалавека, што падчас званка ператварылася ў цэлую каманду, спачатку прасцейшыя задачы, падказка, напісаная Codex, і шалёная колькасць

2:36 вылічальнай магутнасці. Ён спытаў, калі была адпраўлена першая падказка. У рэшце рэшт: у апошнія некалькі дзён, пасля таго, як інфармацыя пра нашу працу дайшла да OpenAI. Паслядоўвалі дзве прапановы. Адна: вы публікуеце Эйлера, мы публікуем Наўе–Стокса на наступны дзень. Дзве: Бакмастэр адзін апісвае доказ OpenAI, і, ён кажа, Бюбек двойчы хацеў, каб Алпёгэ не быў у артыкуле, таму што ён працуе ў Anthropic. Ён адмовіўся і сказаў, што апублікуе гэта. Адказ, згодна з заявай: навошта вам руйнаваць сваю кар'еру,

3:00 потым: калі вы не хочаце, каб я быў добрым, я не павінен быць добрым. Звычайна радок перад галавой каня аказваецца ў ложку. Версія OpenAI: ніхто не бачыў іх працы, доступ да дадзеных карыстальнікаў не быў атрыманы, і, зноска, яны не могуць выключыць, што дэідэнтыфікаваныя дадзеныя з выкарыстання прадуктаў прафесарамі дапамаглі палепшыць мадэль. Водгук Алпёгэ: хвала ім за тое, што яны адразу ўсё растлумачылі. Сэм Альтман кажа, што ўсе дзейнічалі з сумленнасцю і велікадушнасцю, а другая каманда

3:25 пагражала беспадстаўнымі абвінавачваннямі ў плагіяце, напісанымі з адной "і". Такім чынам, афіцыйная пазіцыя: мы не спісвалі ваша хатняе заданне, мы чулі, што вы рабілі хатняе заданне. Тэрэнс Тао назваў вынік прафесараў выдатным і адзначыў, што Бакмастэр растлумачыў яму гэта па тэлефоне, што стала асвяжальнай зменай у параўнанні з метадамі камунікацыі на аснове штучнага інтэлекту. Потым, чатыры паведамленні: добрыя адкрытыя праблемы цяпер здабываюцца як неўзнаўляльны рэсурс, нават чутка пра тое, што хтосьці працуе над адной, выклікае масіўныя намаганні штучнага інтэлекту, каб яе вырашыць, таму стымул - спыніць абмен напрамкамі даследаванняў,

3:55 адмяняючы стагоддзі адкрытай навукі. Тры групы апублікавалі "выбух" вадкасці за адзін уік-энд; наступная праца можа быць NDA. Гэта настрой, у якім Джэйкаб Коксан звольніўся: тры гады перадтрэніроўкі ў OpenAI, потым Anthropic; ніводная кампанія не дзейнічае адказна, ён кажа, абедзве імчацца да самаўдасканальваючага суперінтэлекту, і фінал не павінен быць запушчаны са Slack прыватнай кампаніі. Сорак чатыры мільёны праглядаў, у дзень, калі адна лабараторыя накіравала дзесяць тысяч агентаў на чутку,

4:21 таму тэма была выпушчана з жывой дэманстрацыяй. Тым часам Meta выпусціла Muse: персанальнага агента на ўласнай воблачнай віртуальнай машыне са сваім уласным браўзерам, і вы размаўляеце з ім у WhatsApp. Толькі для ЗША, бясплатна для большасці рэчаў. Meta абяцае версію, якую нават Meta не зможа прачытаць, пазней у гэтым годзе, вельмі спецыфічны спосаб апісання гэтага года. Верхні каментар Hacker News: Я не хачу так дзяліцца сваім жыццём з Meta. Другі: ён увесь час спрабуе прадаць мне калыску.

4:45 Калі вы аддаеце перавагу прачытаць гэта, чым пачуць ад мяне, diff трапляе ў вашу паштовую скрыню кожную раніцу — бясплатна на the daily diff dot dev, спасылка ніжэй. Такім чынам — сённяшні вердыкт: патрабуе перагляду. Доказ кампілюецца; гісторыя не. Дзесяць тысяч агентаў, якія вырашаюць дзевяностагадовую праблему за ўік-энд — гэта вынік магчымасцяў года; аб'яўленне пра гэта нядзельным тэлефонным званком двум людзям, ад якіх вы пра гэта даведаліся, не з'яўляецца такім.

5:07 І гэта ўсё на сёння. Я Ніка з Axrisi. Аб'ядноўвайцеся адказна.

Крыніцы

  1. OpenAI: On the Navier–Stokes Millennium Prize Problemopenai.com
  2. OpenAI Lean formalizationgithub.com
  3. Tristan Buckmaster, statement (PDF)cims.nyu.edu
  4. HN: Buckmaster statementnews.ycombinator.com
  5. HN: OpenAI postnews.ycombinator.com
  6. Terence Tao on the Alpöge–Buckmaster resultmathstodon.xyz
  7. Terence Tao: open problems mined non-renewablymathstodon.xyz
  8. HN: Tao threadnews.ycombinator.com
  9. Clay Mathematics Institute: Navier–Stokes problem statementwww.claymath.org
  10. GPT-6 Astra pricing (used for the token-bill arithmetic)openai.com
  11. Jacob Coxon's resignation threadx.com
  12. HN: I resigned from Anthropic todaynews.ycombinator.com
  13. Meta: Introducing Museabout.fb.com
  14. Museai.meta.com
  15. HN: Musenews.ycombinator.com

Звязаныя відэа