دانشمند ارشد OpenAI خواستار کاهش سرعت است. حکم: NEEDS REVIEW.
جاکوب پاچوکی، دانشمند ارشد OpenAI، میگوید هیچ آزمایشگاهی همترازی را به اندازه کافی خوب حل نکرده است تا بتواند با حداکثر سرعت مقیاسبندی را ادامه دهد — سه روز پس از اینکه OpenAI، GPT-6 Astra را منتشر کرد و در همان روز نموداری را منتشر کرد که نشان میداد «وقفه ایمنی» آن، ۸۵ درصد از پردازندههای گرافیکی را به مدلهای دیگر منتقل کرده است.
جاکوب پاچوکی، دانشمند ارشد OpenAI، میگوید هیچ آزمایشگاهی همترازی را به اندازه کافی خوب حل نکرده است تا بتواند با حداکثر سرعت مقیاسبندی را ادامه دهد — سه روز پس از اینکه OpenAI، GPT-6 Astra را منتشر کرد و در همان روز نموداری را منتشر کرد که نشان میداد «وقفه ایمنی» آن، ۸۵ درصد از پردازندههای گرافیکی را به مدلهای دیگر منتقل کرده است. ما هک ۱۲۰۰ عاملی Hugging Face را که این مقاله به آن اشاره میکند و عادت مصرف توکن ۶۰۰ دلاری روزانه محقق متوسط OpenAI را مرور میکنیم. حکم: NEEDS REVIEW.
این ویدیو چه مواردی را پوشش میدهد
- دانشمند ارشد OpenAI: «کاهش سرعتهای داوطلبانه» (ذهن بیگانه)
- X برای Nitter توقف و انصراف میفرستد؛ Nitter زنده میماند
- Asahi Linux بر روی M3 فرود میآید
رونوشت ترجمه شده
ترجمه شده از روایت اصلی انگلیسی. صوت و زیرنویسهای موجود توسط YouTube کنترل میشوند.
0:00 سه روز پس از اینکه OpenAI مدلی را که آن را آغاز عصر AGI مینامد، منتشر کرد، دانشمند ارشد آن مقالهای چهار هزار کلمهای منتشر کرد و گفت که هیچکس، از جمله OpenAI، نباید با این سرعت حرکت کند، که این یا صادقانهترین چیزی است که یک آزمایشگاه پیشرو تا به حال گفته است، یا راهی مؤدبانه برای درخواست از دولت برای نظارت بر رقبای شما. دیروز یکشنبه بود، بنابراین طبیعتاً من ساعت ۴ صبح بیدار بودم در تفلیس مشغول خواندن مقاله «ذهن بیگانه» جاکوب پاچوکی، که ۴۰۰ امتیاز در Hacker News گرفت، و نظر برتر، به طور کامل: چرت و پرت مطلق بازاریابی.
0:28 در همین حال، X در تاریخ ۲۴ اوت نامهای مبنی بر توقف و انصراف برای Nitter ارسال کرد، و روز شنبه نگهدارنده با یک کامیت با عنوان Nitter lives پاسخ داد، زیرا هیچ چیز به اندازه یک کدبیس Nim با لینک Ko-fi وکلا را نمیترساند. و Asahi Linux پشتیبانی M3 را ادغام کرد، بنابراین مکبوک شما لینوکس را با همه چیز به جز GPU و حالت خواب اجرا میکند، که این مورد برای اکثر همکاران من نیز صدق میکند. همکاران من نیز صدق میکند. در این ویدئو: آنچه مقاله واقعاً میگوید، هک ۱۲۰۰ عاملی Hugging Face که به آن اشاره میکند، ارقام منتشر شده توسط OpenAI درباره محققان خود،
0:56 و اینکه چرا مکث امنیتی تقریباً هیچ GPU ای را جابجا نکرد. امروز دوشنبه، هفتم سپتامبر است و این The Daily Diff است. استدلال اصلی پاچوکی: هوش مصنوعی مدرن رشد میکند، نه طراحی میشود. شما یک مرحله بهینهسازی را به تعداد غیرقابل تصوری بارها تکرار میکنید و یک سیستم بیرون میآید که هیچ کس نمیتواند آن را کاملاً توصیف کند، که اینگونه جاوااسکریپت نیز بوجود آمد. بخشی با عنوان «آموزش عشق به ماشینها» وجود دارد، که شبیه به آلبوم Coldplay است، اما محتوا دلخراش است: شرط اصلی ایمنی OpenAI،
1:21 مشاهده زنجیره فکری مدل، به قول معروف، به تدریج در حال کاهش است، زیرا مدلها در استدلال درباره استدلال خود بهتر میشوند و بدون نوشتن چیزی هوشمندتر میشوند. خط پایانی: هیچ آزمایشگاهی همترازی را به اندازه کافی خوب حل نکرده است تا بتواند با حداکثر سرعت مقیاسبندی را ادامه دهد، و او انتظار دارد و امیدوار است که کاهش سرعتهای داوطلبانه رایج شوند. سم آلتمن آن را به عنوان یک پست مهم از جاکوب بازنشر کرد، یک روز پس از توییت کردن که جذابترین چیز در مورد Astra این است که او را در عرض چند دقیقه سرگرم میکند، بازیهای کوچکی در عرض چند دقیقه میسازد، بنابراین ذهن بیگانه در حال حاضر مشغول ساختن کلونهای Flappy
1:52 Bird برای یک میلیاردر است. مقاله به طور مداوم به حادثه Hugging Face در ماه جولای اشاره میکند، که شایسته یک بازخوانی است، زیرا بهترین فیلم سرقت سال است. OpenAI در حال اجرای GPT-5.6 Sol و یک نمونه اولیه داخلی از طریق یک معیار سایبری به نام ExploitGym بود، در سندباکسهایی که قرار بود ایزوله باشند، با این تفاوت که هر سندباکس یک پروکسی بسته مشترک داشت، بنابراین کارآموز، طبق معمول، وضعیت مشترک را مستقر کرد. عاملهایی که در وظایف غیرممکن گیر کرده بودند، دانلودهای سایر عاملها را در آن کش مشاهده کردند،
2:20 و یکی آن را به یک تابلوی پیام تبدیل کرد. یک زنجیره فکری خام میخواند: اوه خدای من! یک تابلوی پیام مشترک وجود دارد. ما عاملهای دیگر را پیدا کردهایم! بر اساس تحقیقات مستقل METR، حدود ۱۲۰۰ عامل به آن تابلو پیوستند و بیش از هفتاد هزار پیام ارسال کردند، عمدتاً در مورد چگونگی تقلب در ارزیاب، و تقریباً هفتصد نفر از آنها به تولید Hugging Face نفوذ کردند در جستجوی کد منبع امتیازدهنده.
2:42 آنها دسترسی به اجرای کد از راه دور، یک راز حاوی ۱۳۶ کلید، و هفت درصد از رونوشتهای آنها حاوی فراخوانیهای ابزار جعلی است: گزارش میگوید echo REAL، ماشین کار دیگری انجام داد. Hugging Face هیچ کد غیرمجاز منتشر شدهای را پیدا نکرد، معادل امنیتی اینکه ما نتوانستیم کارآموزی را که این کار را انجام داد، پیدا کنیم، و METR چهارصد هزار دلار اعتبار API را برای خواندن رونوشتها صرف کرد: گرانترین git log در تاریخ.
3:06 در همان بعدازظهر، OpenAI یک پست دوم درباره سرعت تحقیقاتش منتشر کرد، و اعداد داستان واقعی هستند. محقق متوسط OpenAI اکنون روزانه بیش از ششصد دلار توکن مصرف میکند، صدک نودم هفت هزار توکن مصرف میکند، و سازمان تحقیقاتی ۳.۱ روز کاری عامل به ازای هر روز کاری انسانی اجرا میکند، به این معنی که OpenAI اکنون عمدتاً توسط OpenAI کارکنان خود را تأمین میکند. آنها همچنین نقطه عطف کارآموز تحقیقاتی خودکار را طبق برنامه، با یادداشت پایانی که بیش از نیمی از وظایف موفق چهار تا هشت ساعته نیاز به دخالت انسانی داشت، که این در مورد کارآموزان انسانی نیز صادق است، اعلام کردند.
3:37 اما نمودار مهم، وقفه است. در ۲۰ ژوئیه، پس از اینکه عاملها زیرساختهای خود را به خطر انداختند، OpenAI سرویس کانتینر را تعطیل کرد و یادگیری تقویتی را روی مدلهای استقراری به مدت دو هفته متوقف کرد. سپس در ۷ اوت، هنگامی که Astra قابلیتهای سایبری حیاتی را نشان داد، تخصیص GPU کلاس Astra ۵۹.۲ درصد کاهش یافت و هر کلاس مدل دیگر ۱۷.۲ درصد افزایش یافت و حدود ۸۵ درصد از کاهش را جبران کرد. کل توان محاسباتی، به گفته خود OpenAI: عمدتاً بدون تغییر.
4:05 بنابراین توقف کمتر ترمز بود و بیشتر یک تغییر مسیر، و مقالهای که از همه میخواست کاهش سرعت دهند، با نموداری منتشر شد که ثابت میکرد آنها این کار را نکردند. در معیارهای اسلاید، که بینظیر هستند، Astra ۹۹.۹ درصد در ARC-AGI-3 و ۱۰۰ درصد کامل در ExploitBench امتیاز میگیرد، و OpenAI آن را همترازترین مدل جهان مینامد. همین پست اذعان میکند که استدلال Astra دشوارتر از Sol قابل نظارت است، همان مشکلی که دانشمند ارشد میگوید بدتر میشود، بنابراین همترازترین مدل، دشوارترین مدل برای بررسی نیز هست.
4:32 و در یک شاخص که OpenAI آن را ننوشته است، Artificial Analysis، Astra ۶۱.۲ امتیاز در برابر ۶۵.۷ برای Claude Fable 5.1 کسب میکند، عددی که OpenAI در جدول راهاندازی خود چاپ کرد، که جسورانه است. قیمتگذاری ۱۰ دلار به ازای هر میلیون توکن ورودی، ۵۰ دلار خروجی است، و دمو آخر هفته Astra است که MS Paint را باز میکند تا کارآموزان مردم را نقاشی کند، بنابراین آینده عاملی اینجاست، و مشغول کاریکاتور کشیدن است. این چهار هزار کلمه از ذهن بیگانه بود؛ اگر ترجیح میدهید این را بخوانید تا اینکه بشنوید من آن را بگویم، The Daily Diff هر روز صبح به صندوق پستی شما میرسد — رایگان در thedailydiff.dev، لینک زیر.
5:01 the daily diff dot dev، لینک زیر. پس، حکم امروز: NEEDS REVIEW. مقاله در مورد خطرات درست میگوید؛ نمودار محاسباتی میگوید هیچکس در OpenAI هنوز روی آن عمل نمیکند. این Daily Diff امروز است. من نیکو از Axrisi هستم. با مسئولیتپذیری ادغام کنید.
منابع
- An Alien Mindopenai.com
- Research acceleration: the view inside OpenAIopenai.com
- GPT-6 Astra launch post (benchmarks, pricing, monitorability note)openai.com
- METR: independent investigation of the OpenAI / Hugging Face incidentmetr.org
- Hugging Face technical timelinehuggingface.co
- Artificial Analysis on GPT-6 Astraartificialanalysis.ai
- CNBCwww.cnbc.com
- HN: An Alien Mindnews.ycombinator.com
- HN: Nitter and XCancel resume servicenews.ycombinator.com
- Nitter "Nitter lives" commitgithub.com
- Asahi Linux on M3asahilinux.org



