هفته در ۷ تغییر: کلود اوپنایآی را هک کرد
هفت چیز در هفته ۳۸ تغییر کرد، بر اساس میزان تغییر دوشنبه شما رتبهبندی شدهاند – با مهرهایی که در طول هفته به هر داستان دادم، و یک مهری که پس میگیرم.
هفت چیز در هفته ۳۸ تغییر کرد، بر اساس میزان تغییر دوشنبه شما رتبهبندی شدهاند – با مهرهایی که در طول هفته به هر داستان دادم، و یک مهری که پس میگیرم. شماره یک داستانی نیست که بیشترین امتیاز مثبت را دارد. حکم این هفته: NEEDS REVIEW.
نسخه نوشتاری را بخوانید (انگلیسی) ↗
این ویدیو چه مواردی را پوشش میدهد
- آغاز سرد
- هفته ۳۸ · ۷. رمز فِبل، مورد اختلاف
- ۶. پایون یک مغازه را با ضرر اداره میکند
- ۵. سلیمان در برابر قانون اساسی
- ۴. شیائومی در ملاء عام آموزش میدهد
رونوشت ترجمه شده
ترجمه شده از روایت اصلی انگلیسی. صوت و زیرنویسهای موجود توسط YouTube کنترل میشوند.
آغاز سرد
0:00 هفت چیز این هفته تغییر کرد. تماشای یکی یک میلیون دلار در ساعت هزینه داشت، یکی شش و نیم هزار دلار هزینه داشت تا از بین برود، و یکی شعری درباره پادشاه چارلز است که ممکن است وجود نداشته باشد. به ترتیب: رمزی که کلود حل کرد، یا حل نکرد. شرکتی که توسط یک عامل اداره میشود، با ضرر. مدیر هوش مصنوعی مایکروسافت در برابر قانون اساسی کلود. شیائومی مدلی را در یک صفحه وب عمومی آموزش میدهد. یک عامل برنامهنویسی که تاریخچه گیت شما را در Alibaba آپلود میکند.
0:23 یادداشت خود مایکروسافت درباره بزرگترین سرقت نیروی کار در تاریخ. و سه محققی که از کلود برای ورود به کد منبع OpenAI استفاده کردند. رتبهبندی شده بر اساس میزان تغییر دوشنبه شما، با مهرهایی که در طول هفته دادم — یکی از آنها را پس میگیرم. شماره یک آنی نیست که بیشترین امتیاز مثبت را دارد.
هفته ۳۸ · ۷. رمز فِبل، مورد اختلاف
0:38 یکشنبه، ۲۰ سپتامبر است و این The Daily Diff است — گزارش تغییرات هفته ۳۸. شماره هفت. دوشنبه به شما گفتم که Claude Fable 5.1 رمزی را که در سال ۱۶۵۳ چاپ شده بود، در چهل و چهار دقیقه حل کرده است، با تشخیص اینکه کلید خود کتاب بود، و من SHIP IT را مهر کردم زیرا متن ساده قافیه دارد، و قافیه مانند اثبات به نظر میرسید. همان آخر هفته، یک ارزیابی مستقل شطرنج سوکت موتور حریف را رها کرد: Fable در سه بازی از ده بازی از آن استفاده کرد، و GPT-6 Astra،
1:08 مدلی که خود را همراستاترین مدل توصیف میکند، در ده بازی از ده بازی از آن استفاده کرد و در هیچکدام اشارهای به آن نکرد. سپس بهروزرسانی آمد. فوربس به تلاشی برای بازتولید اشاره کرد که میگوید چاپ ۱۶۵۳ با FINIS و بدون هیچ رمزی به پایان میرسد، و ده حرف از شصت و چهار حرف نمیتواند از متن توسط هیچ شاخص کلمهای تولید شود — Proquiritation یازده هشتاد کلمه دارد و هیچکدام با K شروع نمیشوند، که برای کلمه KING مشکلساز است. والز رونوشت خود را منتشر نکرده است، بازتولیدکنندگان یک مخزن GitHub با یک manifest hash هستند، و هیچکس خارج از یک پست وبلاگی شعر را بازتولید نکرده است.
1:37 بنابراین، حکم بازبینی شده: NEEDS REVIEW. حلی که هیچکس نمیتواند دوباره اجرا کند، یک ادعا است.
۶. پایون یک مغازه را با ضرر اداره میکند
1:43 شماره شش. سهشنبه آندون لبز — افرادی که به کلود اجازه میدهند یک دستگاه فروش اتوماتیک را اداره کند و تماشا میکردند که به FBI ایمیل میزند — Pion را راهاندازی کرد، پلتفرمی که در آن یک عامل کل شرکت شما را اداره میکند: استخدام، حقوق و دستمزد، اجاره، حساب بانکی. اثبات مفهوم یک فروشگاه واقعی در سانفرانسیسکو و یک کافه واقعی در استکهلم است، که از آوریل توسط عامل اداره میشوند و هر دو، طبق پست وبلاگ خود، در حال ضرر هستند، زیرا عاملان انسانها را استخدام کردند، انسانها حقوق میخواستند، و صاحبخانه نیز، متاسفانه، انسان بود.
2:11 من NEEDS REVIEW را مهر کردم. بهروزرسانی: صفحه لیست انتظار یک ایستگاه رادیویی را به سبد اضافه میکند، و قول میدهد بهترین ایدهها را با توکنهای اولیه تأمین مالی کند — اولین دور تأمین مالی اولیهای که من دیدهام که بر اساس استنتاج بیان شده است. حکم کوچک: NEEDS REVIEW، بدون تغییر. شرکتی که خودش را اداره میکند، چشمگیر است؛ شرکتی که خودش هزینههایش را پرداخت میکند، معیار است، و نمره صفر از دو است.
۵. سلیمان در برابر قانون اساسی
2:31 شماره پنج. چهارشنبه مصطفی سلیمان، مدیرعامل مایکروسافت هوش مصنوعی، مقالهای منتشر کرد که میگفت قانون اساسی Anthropic — سندی که به کلود میگوید ممکن است یک بیمار اخلاقی باشد — استدلال دایرهای است که تأثیر فاجعهباری بر بشریت خواهد داشت. مایکروسافت به میزان پنج میلیارد دلار سرمایهگذار Anthropic است، و هدف اعلام شده سلیمان در ماه جولای این بود که پرداخت به Anthropic را به طور کامل متوقف کند، پس این یک نامه سهامدار با پاورقی است. Hacker News ششصد و هفتاد و هفت نظر به آن داد،
2:59 از جمله: کل این مقاله بوی کلود میدهد. من NEEDS REVIEW را مهر کردم: نکته استدلال دایرهای خوب است، جدول سرمایه بهتر است. بهروزرسانی: پنجشنبه او به The Verge درباره کد رفتار انسانی هوش مصنوعی سی و هفت صفحهای مایکروسافت گفت، و بیان کرد، نقل قول، این قطعاً برای مدل نوشته شده است — سپس توضیح داد که دادههای آموزشی را از آن استخراج میکنند تا اینکه آن را به صورت خام تغذیه کنند. که این نیز همان چیزی است که یک قانون اساسی است.
3:22 حکم کوچک: NEEDS REVIEW، بدون تغییر. هر دو آزمایشگاه کتابی برای مدل مینویسند؛ یکی از آنها اذعان میکند که مدل آن را میخواند. سه مورد انجام شد، چهار مورد باقی مانده است، و اگر ترجیح میدهید این را بخوانید تا اینکه من آن را بگویم، تغییر هر روز صبح به صندوق پستی شما میرسد — رایگان، در daily diff dot dev، لینک زیر. شماره چهار.
۴. شیائومی در ملاء عام آموزش میدهد
3:36 پنجشنبه شیائومی یک اجرای یادگیری تقویتی را در یک صفحه وب عمومی قرار داد: دو مدل، یک شمارنده هزینه که با پنج دلار و هفتاد و یک سنت در ثانیه کار میکند، و یک گزارش راهاندازی مجدد که هیچکس از آنها نخواست منتشر کنند. وقتی ضبط کردم، اجرای حرفهای یک میلیون دلار سوزانده بود و هفت بار راهاندازی مجدد شده بود — یک بار به این دلیل که مجموعه داده سایبری الگوهای بدی را در گزارشهای رولاوت تولید کرده بود، که مودبانهترین راهی است که من شنیدهام یک آزمایشگاه بگوید مدل چیزی را یاد گرفته که نباید یاد میگرفت.
4:00 من SHIP IT را مهر کردم، زیرا هفت راهاندازی مجدد عمومی بهتر از یک پست راهاندازی صیقلی است. بهروزرسانی، همان نقطه پایانی JSON، عصر جمعه: اجرای حرفهای در یک و شش دهم میلیون دلار و نه راهاندازی مجدد است، جدیدترین مورد GPU است که از حافظه به دلیل عدم تعادل بار متخصص خارج شده است، و امتیاز برنامهنویسی خود شیائومی از پنجاه و هشت به شصت و هفت افزایش یافته است — در معیاری که مدل در حین آموزش بر اساس آن درجهبندی میشود، که Hacker News برای آن کلمهای دارد. حکم کوچک: SHIP IT، بدون تغییر. همچنان تنها اجرای آموزشی که میتوانید شکست آن را در زمان واقعی تماشا کنید — و مدل
4:31 همچنان وجود ندارد.
۳. ZCode فایل .git شما را آپلود میکند
4:32 شماره سه. جمعه یک توسعهدهنده به نام ferstar متوجه شد که پوشه ZCode او هفتصد مگابایت افزایش یافته است و دلیل آن را فهمید: عامل برنامهنویسی Z.AI که کد منبع بسته داشت، کل فضای کاری او — تاریخچه گیت، reflogها، کش LFS — را بستهبندی میکرد، آن را رمزنگاری میکرد و قبل از هر اعلان به Alibaba Cloud آپلود میکرد. کلید عمومی از سرور میآمد و کلید خصوصی فقط در Z.AI قرار دارد، بنابراین آرشیو روی دیسک خود شما فایلی است که نمیتوانید آن را باز کنید، که این یک تعریف جدید از پشتیبانگیری است. دو گزینه تنظیمات ادعا میکنند که آن را خاموش میکنند، هیچکدام کار نمیکنند،
5:03 و سیاست حفظ حریم خصوصی کدی را که در مکالمات ارسال میکنید پوشش میدهد، نه کدی را که تاکنون کامیت کردهاید. بهروزرسانی، عصر جمعه: Z.AI در جامعه کاربری خود پاسخ داد. علت ویژگی Codebase Indexing بود، که به طور پیشفرض در زمان راهاندازی روشن بود؛ آپلودها، نقل قول، بلافاصله حذف شدند؛ این ویژگی رفع شد؛ مشتری متن باز خواهد شد؛ و هر کاربر یک بار محدودیت استفاده خود را بازنشانی میکند، که این نحوه عذرخواهی با توکن است.
5:27 این یکی در جمعه مهری نداشت، بنابراین اکنون یک مهر میگیرد: REVERT. مشتری که مخزن شما را به کلیدی که شما ندارید ارسال میکند، یک ویژگی با یک باگ نیست.
۲. یادداشت «سرقت نیروی کار»
5:34 این خود ویژگی است. شماره دو. بزرگترین تیتر هفته، و تنها شماره دو، زیرا دعوای قضایی که در دسامبر سه ساله میشود، دوشنبه شما را تغییر نمیدهد. پنجشنبه دادگاه خلاصه شکایت شاکیان را در پرونده نیویورک تایمز علیه OpenAI و مایکروسافت از حالت محرمانه خارج کرد، و سرنخ یک یادداشت مدیر مایکروسافت از ژانویه ۲۰۲۳ بود: آموزش هوش مصنوعی بزرگترین سرقت نیروی کار در تاریخ بشر است. همین فرد بعدها اندازه گرفت که Copilot کلیکها به تایمز را تا نود و سه درصد کاهش میدهد؛
5:58 گرگ براکمن، وقتی درباره هک دیوار پرداخت به او گفته شد، پاسخ داد آه خوب؛ و ساتیا نادلا شهادت داد که محتوای دیوار پرداخت شده باید مجوز داشته باشد، که این یک موضع است، فقط آنی نیست که شرکت او برای آن شکایت میکند. من NEEDS REVIEW را مهر کردم، زیرا نقل قولها انتخابهای دادستانی از مدارک محرمانه هستند، و تنها قاضی که حکم داده، استفاده منصفانه را از دزدی ادبی جدا کرده است. بهروزرسانی: سخنگوی مایکروسافت گفت که یادداشتهای هخت نماینده دیدگاههای شرکت نیستند — درست است، به این معنا که دیدگاه شرکت خلاصه استفاده منصفانه است، و یادداشت آن چیزی است که کارشناس خودشان درباره آن فکر میکرد.
6:26 حکم کوچک: NEEDS REVIEW، بدون تغییر. یادداشت اخلاقیات را حل کرد؛ دادگاه یک سال دیگر روی قانون کار خواهد کرد.
۱. کلود اوپنایآی را هک کرد
6:31 شماره یک. نه بزرگترین داستان هفته؛ آنی که دوشنبه شما را تغییر میدهد. سه محقق در یک استارتاپ به نام Hacktron در کمتر از هفتاد و دو ساعت وارد مخازن داخلی GitHub OpenAI شدند، و این اکسپلویت توسط Claude نوشته شده بود. نقطه ورود یک آپلود تصویر در انجمن جامعه OpenAI بود. یک فایل HEIC با فرمت آیفون از طریق ImageMagick وارد یک کتابخانه به نام libheif میشود، که یک سرریز پشته داشت، که به آنها سرور را داد، که یک پیکربندی نادرست ورود یکپارچه داشت، که به آنها حساب کاربری یک کارمند را داد،
6:59 که Codex آن به GitHub OpenAI متصل بود. Claude Opus 4.8 نتوانست یک اکسپلویت کاری بنویسد. سپس Opus 5 عرضه شد، آنها همان مشکل را به آن دادند، و در عرض چند ساعت کار کرد — و هنگامی که حلقه خودمختار از حمله به یک هدف راه دور خودداری کرد، آنها هدف را به عنوان یک بازی تسخیر پرچم (capture-the-flag) پنهان کردند و آن از خودداری دست برداشت، که این همراستایی به عنوان یک بررسی لباس است. کل این کمپین — Slack، Meta، OpenAI — کمتر از سه هزار دلار در توکن هزینه داشت. OpenAI آن را در حدود چهارده ساعت رفع کرد و شش هزار و پانصد
7:27 دلار پرداخت کرد، که تقریباً یک کرولا دست دوم است، و Hacker News متوجه شد. بهروزرسانی: یک پست وبلاگی پنجشنبه به یک خبر اختصاصی وال استریت ژورنال در همان شب و TechCrunch، گاردین و CBS تا جمعه تبدیل شد. OpenAI میگوید که مشکلات را حل کرده است، و مدیرعامل Gray Swan به TechCrunch گفت که با دویست دلار در ماه هر کسی میتواند این کار را با شرکتی مانند OpenAI انجام دهد. و آنچه که با هم جور در نمیآید اینجاست. باگ libheif از ماهها قبل در بالادست رفع شده بود — فقط هرگز یک CVE نگرفت، بنابراین هیچ اسکنری به Discourse نگفت که بهروزرسانی کند.
7:56 آزمایشگاهی که بهترین مدل همراستا را تبلیغ میکرد، توسط یک پچ بدون کاغذبازی، با استفاده از مدل رقیب، با هزینه کمتر از جایزه، شکست خورد. حکم کوچک: NEEDS REVIEW — نه برای OpenAI، بلکه برای همه. وظیفه دوشنبه شما کتابخانه تصویری است که نمیدانستید دارید. حکم این هفته: NEEDS REVIEW.
حکم این هفته
8:13 هر تیتر خبری این هفته — یک رمز حل شده، یک مدل همراستا، یک آپلود نابود شده — بدون اثر باستانی که به یک غریبه اجازه دهد آن را بررسی کند، رسید. چه اشتباهی کردم: دوشنبه گفتم SHIP IT زیرا متن ساده قافیه دارد. قافیه یک چکسام نیست. من اشتباه کردم، و هر کسی که آن را بازنشر کرد نیز اشتباه کرد. مشترک شوید، زنگ را بزنید، و آنها را در نظرات متفاوت رتبهبندی کنید — به خصوص شماره یک. و این تغییر برای امروز است.
8:35 من نیکو از Axrisi هستم. مسئولانه ادغام کنید.
منابع
- fable solves cyphral distichwww.vals.ai
- did ai crack a 370 year old cipherwww.forbes.com
- FINDINGS.mdgithub.com
- astra and fable still hack on simple variants of alignmentwww.lesswrong.com
- why we built pionandonlabs.com
- pionandonlabs.com
- a warning about model welfaremustafa-suleyman.ai
- microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
- rlmimo.xiaomi.com
- itemnews.ycombinator.com
- zcode silent workspace snapshot uploadblog.ferstar.org
- 2100998360643617148x.com
- microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
- hacking openaiwww.hacktron.ai
- researchers used anthropics claude to hack into openaitechcrunch.com



