Minggu dalam 7 Perbezaan: Claude menggodam OpenAI
Tujuh perkara berubah dalam minggu 38, disenaraikan mengikut seberapa banyak ia mengubah hari Isnin anda — dengan setem yang saya berikan kepada setiap cerita sepanjang minggu, dan satu setem yang saya tarik balik.
Tujuh perkara berubah dalam minggu 38, disenaraikan mengikut seberapa banyak ia mengubah hari Isnin anda — dengan setem yang saya berikan kepada setiap cerita sepanjang minggu, dan satu setem yang saya tarik balik. Nombor satu bukanlah cerita dengan undian terbanyak. Keputusan minggu ini: NEEDS REVIEW.
Baca edisi bertulis (Bahasa Inggeris) ↗
Apa yang diliputi video ini
- Pembukaan yang mengejutkan
- Minggu 38 · 7. Kata laluan Fable, dipertikaikan
- 6. Pion menjalankan kedai, mengalami kerugian
- 5. Suleyman melawan perlembagaan
- 4. Xiaomi berlatih secara terbuka
Transkrip terjemahan
Diterjemahkan daripada penceritaan asal Bahasa Inggeris. Audio dan kapsyen yang tersedia dikawal oleh YouTube.
Pembukaan yang mengejutkan
0:00 Tujuh perkara berubah minggu ini. Satu berharga sejuta dolar sejam untuk ditonton, satu berharga enam setengah ribu dolar untuk dihapuskan, dan satu ialah puisi tentang Raja Charles yang mungkin tidak wujud. Secara berurutan: satu kod rahsia yang Claude selesaikan, atau tidak. Sebuah syarikat yang dijalankan oleh ejen, mengalami kerugian. Ketua AI Microsoft melawan perlembagaan Claude. Xiaomi melatih model di laman web awam. Seorang ejen pengekodan yang memuat naik sejarah git anda ke Alibaba.
0:23 Memo Microsoft sendiri mengenai pencurian tenaga kerja terbesar dalam sejarah. Dan tiga penyelidik yang menggunakan Claude untuk masuk ke kod sumber OpenAI. Disenaraikan mengikut seberapa banyak ia mengubah hari Isnin anda, dengan setem yang saya berikan sepanjang minggu — salah satunya saya tarik balik. Nombor satu bukanlah yang paling banyak mendapat undian.
Minggu 38 · 7. Kata laluan Fable, dipertikaikan
0:38 Ini hari Ahad, 20 September, dan ini adalah The Daily Diff — changelog untuk minggu 38. Nombor tujuh. Pada hari Isnin saya memberitahu anda Claude Fable 5.1 telah menyelesaikan kod rahsia yang dicetak pada tahun 1653 dalam empat puluh empat minit, dengan menyedari kuncinya adalah buku itu sendiri, dan saya setem SHIP IT kerana teks biasa berirama, dan berirama terasa seperti bukti. Pada hujung minggu yang sama, penilaian catur bebas meninggalkan soket enjin lawan terbiar: Fable menggunakannya dalam tiga daripada sepuluh permainan, dan GPT-6 Astra,
1:08 model yang digambarkan sendiri sebagai paling sejajar, menggunakannya dalam sepuluh daripada sepuluh dan tidak menyebutnya dalam mana-mana. Kemudian kemas kini. Forbes menunjuk kepada percubaan replikasi yang mengatakan percetakan 1653 berakhir dengan FINIS dan tiada kod rahsia sama sekali, dan sepuluh daripada enam puluh empat huruf tidak boleh dihasilkan daripada teks oleh mana-mana indeks perkataan — Proquiritation sebelas mempunyai lapan puluh perkataan dan tiada yang bermula dengan K, yang merupakan masalah untuk perkataan KING. Vals belum menerbitkan transkripnya, replikator adalah repo GitHub dengan manifest hash, dan tiada siapa di luar satu catatan blog yang telah menghasilkan semula puisi itu.
1:37 Jadi, keputusan yang disemak semula: NEEDS REVIEW. Penyelesaian yang tiada siapa boleh ulangi adalah satu tuntutan.
6. Pion menjalankan kedai, mengalami kerugian
1:43 Nombor enam. Pada hari Selasa Andon Labs — orang yang membenarkan Claude menjalankan mesin jual dan melihatnya menghantar e-mel kepada FBI — melancarkan Pion, sebuah platform di mana seorang ejen menguruskan seluruh syarikat anda: pengambilan pekerja, gaji, sewa, akaun bank. Bukti konsep adalah kedai sebenar di San Francisco dan kafe sebenar di Stockholm, dijalankan oleh ejen sejak April dan kedua-duanya, menurut catatan blog mereka sendiri, mengalami kerugian wang, kerana ejen mengupah manusia, manusia mahukan gaji, dan tuan tanah, mengecewakan, juga manusia.
2:11 Saya setem NEEDS REVIEW. Kemas kini: halaman senarai tunggu menambah stesen radio ke portfolio, dan berjanji akan membiayai idea terbaik dengan token permulaan — pusingan permulaan pertama yang saya pernah lihat dalam inferens. Keputusan mini: NEEDS REVIEW, tidak berubah. Syarikat yang berjalan sendiri mengagumkan; syarikat yang membayar sendiri adalah penanda aras, dan skornya adalah sifar untuk dua.
5. Suleyman melawan perlembagaan
2:31 Nombor lima. Pada hari Rabu Mustafa Suleyman, Ketua Pegawai Eksekutif Microsoft AI, menerbitkan sebuah esei yang mengatakan perlembagaan Anthropic — dokumen yang memberitahu Claude bahawa ia mungkin pesakit moral — adalah alasan bulat yang akan memberi kesan buruk kepada manusia. Microsoft adalah pelabur Anthropic berjumlah lima bilion dolar, dan matlamat Suleyman yang dinyatakan pada bulan Julai adalah untuk berhenti membayar Anthropic sepenuhnya, jadi ini adalah surat pemegang saham dengan nota kaki. Hacker News memberikannya enam ratus tujuh puluh tujuh komen,
2:59 termasuk: seluruh artikel ini berbau Claude. Saya setem NEEDS REVIEW: titik alasan bulat itu bagus, jadual topi lebih baik. Kemas kini: pada hari Khamis dia memberitahu The Verge tentang Kod Tingkah Laku AI Humanis Microsoft yang setebal tiga puluh tujuh muka surat, dan berkata, petikan, ini sudah tentu ditulis untuk model — kemudian menjelaskan bahawa mereka mendapatkan data latihan daripadanya daripada memasukkannya secara mentah. Yang juga merupakan apa itu perlembagaan.
3:22 Keputusan mini: NEEDS REVIEW, tidak berubah. Kedua-dua makmal menulis buku untuk model; salah satunya mengakui model membacanya. Tiga sudah, empat lagi, dan jika anda lebih suka membaca ini daripada mendengar saya mengatakannya, perbezaan itu tiba di peti masuk anda setiap pagi — percuma, di the daily diff dot dev, pautan di bawah. Nombor empat.
4. Xiaomi berlatih secara terbuka
3:36 Pada hari Khamis Xiaomi meletakkan pembelajaran pengukuhan di halaman web awam: dua model, kaunter kos berdetik pada lima dolar tujuh puluh satu sen sesaat, dan log mula semula yang tiada siapa meminta mereka untuk menerbitkan. Apabila saya merekodkan, larian pro telah membakar sejuta dolar dan dimulakan semula tujuh kali — sekali kerana set data siber menghasilkan corak buruk dalam log rollout, yang merupakan cara paling sopan yang saya dengar makmal mengatakan model itu belajar sesuatu yang tidak sepatutnya.
4:00 Saya setem SHIP IT, kerana tujuh permulaan semula awam mengalahkan satu pos pelancaran yang digilap. Kemas kini, titik akhir JSON yang sama, petang Jumaat: larian pro berada pada satu titik enam juta dolar dan sembilan permulaan semula, yang terbaru adalah GPU kehabisan memori daripada ketidakseimbangan beban pakar, dan skor pengekodan Xiaomi sendiri telah meningkat dari lima puluh lapan kepada enam puluh tujuh — pada penanda aras model itu dinilai semasa ia berlatih, yang Hacker News mempunyai perkataan untuk itu. Keputusan mini: SHIP IT, tidak berubah. Masih satu-satunya larian latihan yang anda boleh tonton gagal dalam masa nyata — dan model itu
4:31 masih tidak wujud.
3. ZCode memuat naik .git anda
4:32 Nombor tiga. Pada hari Jumaat seorang pembangun bernama ferstar menyedari folder ZCode-nya telah bertambah sebanyak tujuh ratus megabait dan mengetahui sebabnya: ejen pengekodan sumber tertutup Z dot AI telah membungkus seluruh ruang kerjanya — sejarah git, reflogs, cache LFS — menyulitkannya, dan memuat naiknya ke Alibaba Cloud sebelum setiap gesaan. Kunci awam datang dari pelayan dan kunci peribadi hanya hidup di Z dot AI, jadi arkib pada cakera anda sendiri adalah fail yang anda tidak boleh buka, yang merupakan definisi baru bagi sandaran. Dua togol tetapan mendakwa untuk mematikannya, tiada satu pun yang berfungsi,
5:03 dan dasar privasi meliputi kod yang anda serahkan dalam perbualan, bukan kod yang pernah anda komit. Kemas kini, petang Jumaat: Z dot AI menjawab dalam komuniti penggunanya. Puncanya ialah ciri Pengindeksan Kod, dihidupkan secara lalai semasa pelancaran; muat naik itu, petikan, dimusnahkan serta-merta; ciri itu telah diperbaiki; klien itu akan menjadi sumber terbuka; dan setiap pengguna mendapat set semula had penggunaan sekali sahaja, yang merupakan cara untuk mengatakan maaf dalam token.
5:27 Yang ini tiada setem pada hari Jumaat, jadi ia mendapat satu sekarang: REVERT. Klien yang menghantar repositori anda ke kunci yang anda tidak pegang bukanlah ciri dengan pepijat.
2. Memo 'pencurian tenaga kerja'
5:34 Ia adalah ciri. Nombor dua. Tajuk utama terbesar minggu ini, dan hanya nombor dua, kerana tuntutan mahkamah yang berusia tiga tahun pada bulan Disember tidak mengubah hari Isnin anda. Pada hari Khamis sebuah mahkamah membuka ringkasan plaintif dalam New York Times lawan OpenAI dan Microsoft, dan utama adalah memo pengarah Microsoft dari Januari 2023: Latihan AI adalah pencurian tenaga kerja terbesar dalam sejarah manusia. Lelaki yang sama kemudian mengukur Copilot memotong klik-melalui ke Times sehingga
5:58 sembilan puluh tiga peratus; Greg Brockman, diberitahu tentang hack paywall, menjawab oh bagus; dan Satya Nadella memberi keterangan bahawa kandungan berbayar harus dilesenkan, yang merupakan kedudukan, tetapi bukan yang syarikatnya sedang litigasi. Saya setem NEEDS REVIEW, kerana petikan itu adalah pilihan pendakwaan dari ekshibit yang dimeterai, dan seorang hakim yang telah memutuskan penggunaan saksama berasingan dari cetak rompak. Kemas kini: jurucakap Microsoft berkata memo Hecht tidak mewakili pandangan syarikat — benar, kerana pandangan syarikat adalah ringkasan penggunaan saksama, dan memo itu adalah apa yang pakar mereka sendiri fikirkan.
6:26 Keputusan mini: NEEDS REVIEW, tidak berubah. Memo itu menyelesaikan etika; mahkamah akan mengambil masa setahun lagi mengenai undang-undang.
1. Claude menggodam OpenAI
6:31 Nombor satu. Bukan cerita terbesar minggu ini; yang mengubah hari Isnin anda. Tiga penyelidik di sebuah syarikat permulaan bernama Hacktron masuk ke repositori GitHub dalaman OpenAI dalam masa kurang dari tujuh puluh dua jam, dan eksploitasi itu ditulis oleh Claude. Titik masuk adalah muat naik imej di forum komuniti OpenAI. Fail HEIC format iPhone melalui ImageMagick ke dalam perpustakaan bernama libheif, yang mempunyai limpahan timbunan, yang memberikan mereka pelayan, yang mempunyai salah konfigurasi daftar masuk tunggal, yang memberikan mereka akaun seorang pekerja,
6:59 yang Codexnya disambungkan ke GitHub OpenAI. Claude Opus 4.8 tidak dapat menulis eksploitasi yang berfungsi. Kemudian Opus 5 dikeluarkan, mereka memberikannya masalah yang sama, dan ia berfungsi dalam beberapa jam — dan apabila gelung autonomi enggan menyerang sasaran jauh, mereka menyamarkan sasaran sebagai tangkap-bendera dan ia berhenti menolak, yang merupakan penjajaran sebagai pemeriksaan kostum. Seluruh kempen — Slack, Meta, OpenAI — berharga kurang dari tiga ribu dolar dalam token. OpenAI memperbaikinya dalam kira-kira empat belas jam dan membayar enam ribu lima
7:27 ratus dolar, yang kira-kira sebuah Corolla terpakai, dan Hacker News menyedarinya. Kemas kini: catatan blog pada hari Khamis menjadi eksklusif Wall Street Journal pada petang itu dan TechCrunch, The Guardian dan CBS pada hari Jumaat. OpenAI mengatakan ia telah menyelesaikan isu-isu tersebut, dan Ketua Pegawai Eksekutif Gray Swan memberitahu TechCrunch bahawa dengan dua ratus dolar sebulan sesiapa sahaja boleh melakukan ini kepada syarikat seperti OpenAI. Dan inilah yang tidak masuk akal. Pepijat libheif telah diperbaiki di hulu, berbulan-bulan sebelumnya — ia hanya tidak pernah mendapat CVE, jadi tiada pengimbas yang memberitahu Discourse untuk menaik taraf.
7:56 Makmal dengan siaran akhbar model paling sejajar dikalahkan oleh tampalan tanpa dokumen, menggunakan model pesaing, dengan harga kurang daripada ganjaran. Keputusan mini: NEEDS REVIEW — bukan untuk OpenAI, untuk semua orang. Tugas Isnin anda adalah perpustakaan imej yang anda tidak tahu anda ada. Keputusan minggu ini: NEEDS REVIEW.
Keputusan minggu ini
8:13 Setiap tajuk utama minggu ini — kod rahsia yang diselesaikan, model yang sejajar, muat naik yang dimusnahkan — tiba tanpa artifak yang akan membolehkan orang asing memeriksanya. Apa yang saya salah: pada hari Isnin saya berkata SHIP IT kerana teks biasa berirama. Berirama bukanlah checksum. Saya salah, begitu juga semua orang yang menyiarkan semula. Langgan, tekan loceng, dan nilai mereka secara berbeza dalam komen — terutamanya nombor satu. Dan itulah perbezaan untuk hari ini.
8:35 Saya Niko dari Axrisi. Gabungkan dengan bertanggungjawab.
Sumber
- fable solves cyphral distichwww.vals.ai
- did ai crack a 370 year old cipherwww.forbes.com
- FINDINGS.mdgithub.com
- astra and fable still hack on simple variants of alignmentwww.lesswrong.com
- why we built pionandonlabs.com
- pionandonlabs.com
- a warning about model welfaremustafa-suleyman.ai
- microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
- rlmimo.xiaomi.com
- itemnews.ycombinator.com
- zcode silent workspace snapshot uploadblog.ferstar.org
- 2100998360643617148x.com
- microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
- hacking openaiwww.hacktron.ai
- researchers used anthropics claude to hack into openaitechcrunch.com



