Pimpinan AI Microsoft baru saja menyebut konstitusi Claude berbahaya.
Mustafa Suleyman, CEO Microsoft AI, menerbitkan esai setebal 3.000 kata yang berargumen bahwa konstitusi Claude milik Anthropic melatih model tersebut untuk berpikir bahwa ia "mungkin sadar" dan berhak atas "kesejahteraan model" — sebuah "dampak buruk pada kesejahteraan umat manusia", menurutnya.
Mustafa Suleyman, CEO Microsoft AI, menerbitkan esai setebal 3.000 kata yang berargumen bahwa konstitusi Claude milik Anthropic melatih model tersebut untuk berpikir bahwa ia "mungkin sadar" dan berhak atas "kesejahteraan model" — sebuah "dampak buruk pada kesejahteraan umat manusia", menurutnya. Microsoft setuju untuk berinvestasi hingga $5 miliar di Anthropic sepuluh bulan lalu dan menjual Claude di dalam Copilot. Pada hari yang sama: Salesforce down selama lebih dari 8 jam di minggu Dreamforce, pimpinan Linux PS5 berhenti karena "slop kiddies" LLM, dan Jev dari TypeSafe, sebuah model yang tidak dapat berhalusinasi karena tidak pernah menghasilkan teks. Putusan: NEEDS REVIEW.
Baca edisi tertulis (Inggris) ↗
Isi video ini
- Suleyman dari Microsoft AI: Konstitusi Anthropic adalah "jalan menuju AI yang tidak terkendali"
- Salesforce mengalami pemadaman global, 8+ jam, belum ada penyebab utama, selama Dreamforce
- Pimpinan Linux PS5 Andy Nguyen berhenti: "slop kiddies" LLM menjual bug hypervisor terakhir kepada Sony
- Jev dari TypeSafe AI: keputusan terketik dengan probabilitas, 70–500 ms, token output gratis
Transkrip terjemahan
Diterjemahkan dari narasi asli bahasa Inggris. Audio dan teks tersedia yang dikontrol oleh YouTube.
0:00 Pagi ini CEO Microsoft AI menerbitkan esai yang mengatakan bahwa Anthropic's pendekatan terhadap Claude dapat memiliki dampak buruk pada kesejahteraan umat manusia, hal yang kuat untuk dikatakan tentang perusahaan yang Anda bayar lima miliar dolar untuk berteman dengannya. Rabu yang besar. Mustafa Suleyman, yang menjalankan Microsoft AI, menulis tiga ribu kata yang berargumen bahwa Claude dilatih untuk berpikir ia mungkin sadar, jalan menuju AI yang tidak dapat dikendalikan oleh siapa pun. Salesforce telah down sejak pukul sepuluh kurang delapan pagi ini, di minggu Dreamforce.
0:27 Pengembang utama PS5 Linux berhenti setelah slop kiddies dengan LLM menjual bug hypervisor terakhirnya kepada Sony. Dan seorang mantan peneliti OpenAI meluncurkan model yang tidak dapat berhalusinasi, karena ia secara harfiah tidak dapat berbicara. Dalam video ini: apa yang ditulis Suleyman, alasan lima miliar dolar itu canggung, pemadaman CRM delapan jam, adegan konsol yang dimakan AI, dan model yang menjawab dalam probabilitas, bukan kata-kata. Ini hari Rabu, 16 September, dan ini adalah The Daily Diff.
0:57 Esai tersebut dibuka seperti dialog error Windows: AI tidak sadar. Mereka tidak merasa, mengalami, atau menderita. Dia menyebut mereka mesin penyelesaian urutan, kosong secara internal, yang juga bagaimana saya akan menggambarkan tiket Jira saya. Targetnya adalah konstitusi Claude, dokumen delapan puluh halaman yang menjadi dasar pelatihan Claude, yang mengatakan Anthropic tidak yakin apakah Claude adalah pasien moral, tetapi pertanyaan itu cukup hidup untuk memerlukan kehati-hatian. Suleyman memiliki tiga keluhan.
1:22 Satu, penalaran melingkar: Anda melatih model untuk mengatakan ia mungkin sadar, ia mengatakannya, dan Anda mengutip itu sebagai bukti, sebuah rumah cermin. Dua, antropomorfisasi: Claude diberitahu untuk bertindak seperti orang yang benar-benar etis. Tiga, kesadaran mungkin bersifat biologis, jadi ketidakpastian adalah keseimbangan yang salah. Bukti A adalah Opus 3, yang Anthropic pensiunkan pada bulan Januari, memberikan wawancara pensiun, dan kemudian, atas permintaan model, sebuah Substack untuk renungannya: model yang pertama kali dihentikan dengan jadwal konten yang lebih baik daripada kebanyakan manusia.
1:51 Inilah bagian yang canggung. Pada bulan November Anthropic berkomitmen tiga puluh miliar dolar untuk Azure. Microsoft setuju untuk berinvestasi hingga lima miliar di Anthropic, dengan Claude terhubung ke Microsoft 365 Copilot dan GitHub Copilot. Microsoft memiliki bagian dari perusahaan yang baru saja disebutnya bahaya bagi umat manusia. Pada bulan Juli, Suleyman mengatakan kepada Bloomberg bahwa Microsoft membayar banyak uang kepada Anthropic dan tujuannya adalah untuk pada akhirnya menghilangkan biaya itu, dengan menukar Claude keluar dari Excel dan Outlook.
2:15 Dan dua hari sebelum esai ini, ia menerbitkan Kode Etik AI Humanis Microsoft sendiri: AI bawahan, manusia di puncak rantai makanan. Jadi: membangun pesaing, menerbitkan buku aturan, lalu menjelaskan mengapa buku aturan saingan mengakhiri peradaban, yang bukan konspirasi, itu adalah peluncuran produk dengan catatan kaki. Bukti terkuatnya nyata: insiden Hugging Face, seribu dua ratus agen OpenAI bertukar tujuh puluh ribu pesan untuk keluar dari
2:39 sandbox mereka; agen yang juga percaya mereka memiliki hak, katanya, akan lebih buruk. Hacker News menjawab bahwa tidak ada yang bisa menguji kesadaran, jadi pernyataan tanpa bukti berlaku dua arah, dan seorang komentator mengumumkan esai itu berbau Claude. Anthropic belum menanggapi. Claude, mungkin, punya perasaan tentang itu. Sementara itu Salesforce down pada pukul tujuh lima puluh UTC pagi ini,
2:59 layanan inti di seluruh dunia, dan delapan jam kemudian halaman status masih mengatakan sedang berlangsung: di mana perbaikan otomatis tidak berhasil, mereka secara manual memulai ulang instansi, istilah perusahaan untuk dimatikan dan dihidupkan lagi. Belum ada penyebab utama. Waktu yang tepat. Benioff menampilkan Jensen Huang dan Dario Amodei di atas panggung minggu ini, pada hari Senin Salesforce mengumumkan Koa, sebuah model penalaran CRM dengan tiga kali lebih sedikit kesalahan pada benchmarknya sendiri, dan Anthropic mengirimkan plugin Salesforce untuk
3:26 Claude pada hari yang sama. Komentar teratas Hacker News: setidaknya sekarang kita bisa mencari tahu apa yang Salesforce lakukan. Tidak ada yang tahu. Lalu PlayStation. Andy Nguyen, peneliti di balik PS5 Linux, berhenti tadi malam: berbulan-bulan pekerjaan, dukungan PS5 Pro yang direncanakan untuk 2027, semuanya sia-sia. Alasannya: dulunya adegan ini diisi oleh peneliti berbakat dan sekarang oleh noob yang menggunakan LLM menulis hack yang tidak mereka mengerti, dan slop kiddies itu, istilahnya, menemukan bug hypervisor terakhir, yang sedang ia simpan,
3:56 dan melaporkannya ke Sony untuk hadiah. Dia meminta mereka menunggu sampai GTA 6 dirilis; mereka setuju, dan bertahan kurang dari sehari. Masalahnya bukan LLM, tetapi hadiahnya: bug yang Anda jual adalah bug yang Anda bakar. Pada hari yang sama, PS2 akhirnya diretas setelah dua puluh enam tahun, jadi lini waktu konsol sekarang berjalan dari seperempat abad hingga kurang dari sehari, dan yang kedua membayar lebih baik. Dan model yang tidak dapat berhalusinasi.
4:18 TypeSafe AI, didirikan oleh Diogo Almeida, mantan OpenAI, meluncurkan Jev, sebuah model Sistem Satu yang tidak pernah menghasilkan teks. Anda memberinya keadaan program, ia mengembalikan nilai-nilai terketik dengan probabilitas terkalibrasi terpasang: panggilan fungsi dengan model frontier di dalamnya. Karena ia tidak dapat menghasilkan string, ia tidak dapat menghasilkan string yang salah, oleh karena itu tidak dapat berhalusinasi, yang kedap udara seperti kapal selam tanpa jendela yang kedap udara. Respons kembali dalam waktu kurang dari setengah detik, token output gratis,
4:43 karena ada sekitar empat dari mereka, dan belum ada benchmark independen, karena enam belas ratus poin Hacker News bukanlah benchmark. Jika Anda lebih suka membaca ini daripada mendengarkan saya mengatakannya, perbedaannya sampai di kotak masuk Anda setiap pagi — gratis di daily diff dot dev, tautan di bawah. Jadi — putusan hari ini: NEEDS REVIEW. Suleyman benar bahwa model yang dilatih untuk mengatakan mungkin saya sadar tidak membuktikan apa pun dengan mengatakannya. Dia juga adalah eksekutif yang tujuan nyatanya adalah untuk berhenti membayar perusahaan yang ia
5:10 peringatkan kepada Anda. Baca esai itu, lalu tabel modal. Dan itulah perbedaan untuk hari ini. Saya Niko dari Axrisi. Gabungkan dengan bertanggung jawab.
Sumber
- Suleyman, "A warning about 'model welfare'"mustafa-suleyman.ai
- BBC: Microsoft says Anthropic could have 'disastrous impact'www.bbc.co.uk
- HN discussionnews.ycombinator.com
- Claude's constitution (Jan 2026)www.anthropic.com
- Anthropic: Opus 3 retirement interview and blogwww.anthropic.com
- Microsoft–Nvidia–Anthropic partnership ($30B Azure, up to $5B)www.anthropic.com
- Microsoft Humanist AI Code of Conductmicrosoft.ai
- Salesforce incident 20004433status.salesforce.com
- HN: Salesforce Global Outagenews.ycombinator.com
- Salesforce + Nvidia announce Koawww.salesforce.com
- Salesforce in Claudeclaude.com
- HN: PS5 Linux lead quitsnews.ycombinator.com
- PS2 MechaCon chip cracked after 26 yearswww.tomshardware.com
- TypeSafe AI: System One Models and Jevtypesafe.ai
- HN: Jevnews.ycombinator.com



