# Google baru saja merilis model peretasan. Ini perbedaannya.

Published: 2026-09-07

Google merilis Gemini 3.8 Flash ($0.75 masuk / $3.75 keluar, harga berlipat ganda 1 Januari) dan Gemini 3.8 Flash Cyber — sebuah model pencari kerentanan yang hanya dijualnya kepada 650 "pembela tepercaya" yang telah disaring — dan empat jam kemudian Meta merilis Muse Spark 1.3 dengan tingkat "kontributor" $0.10-per-juta di mana diskonnya adalah transkrip sesi Anda. Kami memeriksa keduanya terhadap satu tolok ukur yang tidak ditulis oleh kedua perusahaan. Putusan: SHIP IT.

Canonical: https://thedailydiff.dev/id/video/2026-09-02-flash-cyber/

## Isi video ini

- Google merilis Gemini 3.8 Flash + Flash Cyber (86.2% CyberGym, Program Fairwind)
- Meta merilis Muse Spark 1.3: $1.25/$4.25, atau $0.10/$0.20 jika Meta boleh melatihnya
- Tiga situs membuat 215,128 halaman "perangkat lunak terbaik" palsu; Perplexity mengutipnya

## Transkrip terjemahan

Diterjemahkan dari narasi asli bahasa Inggris. Audio dan teks tersedia yang dikontrol oleh YouTube.

0:00 Google merilis model Flash ketiganya dalam enam minggu hari ini, ditambah versi yang dilatih untuk meretas, dan empat jam kemudian Meta merilis sebuah model yang berharga sepuluh sen per juta token jika Anda membiarkan Zuckerberg membaca kode Anda, jadi perang harga AI sekarang memiliki divisi keamanan siber. Ini hari Rabu, dan perbedaannya panjang. Gemini 3.8 Flash mencapai sebelas ratus poin di Hacker News, Muse Spark 1.3 mengambil hampir tujuh ratus lebih, dan di antaranya, sebuah toko riset menemukan tiga situs web yang menerbitkan dua ratus lima belas ribu

0:28 halaman perangkat lunak terbaik palsu murni agar Perplexity akan mengutipnya. Juga hari ini: sebuah postingan yang memohon Anda untuk tetap menggunakan Firefox mendapat sembilan ratus delapan puluh delapan poin, dan halaman bantuan Mistral tentang cara keluar dari pelatihan mendapat hampir lima ratus, sebagian besar dari orang Eropa yang menemukan opsi kedaulatan melatih pada prompt Anda secara default. Dalam video ini: berapa biaya sebenarnya Gemini 3.8 Flash, model peretasan Google hanya akan dijual kepada enam ratus lima puluh mitra, tingkat sepuluh sen Meta dan apa yang sebenarnya dikenakan, dan satu tolok ukur yang tidak ditulis oleh kedua perusahaan.

0:59 Ini hari Rabu, 2 September, dan ini adalah The Daily Diff. Gemini 3.8 Flash adalah tujuh puluh lima sen per juta token masuk dan tiga tujuh puluh lima keluar, sama dengan 3.7 Flash dari tiga minggu lalu, dengan catatan kaki yang mengatakan harga berlipat ganda pada 1 Januari, yang merupakan uji coba gratis dengan langkah-langkah tambahan. Pada tolok ukur slide-deck, yang tak terkalahkan, ia mencetak 54.9 persen pada HLE-Verified, X mengatakan ia mengalahkan Sol dan Opus 5 di Terminal-Bench, dan Logan Kilpatrick memposting 73.7 pada DeepSWE, satu-satunya tolok ukur pengkodean

1:29 jangka panjang yang belum dihafal, diduga. Simon Willison memintanya untuk membuat hal keren di HTML dan mendapatkan simulasi partikel dalam tiga belas detik dengan 1.8 sen, berjalan pada enam puluh bingkai per detik, karena enam puluh telah dikodekan ke dalam halaman. Postingan Google sendiri menjelaskan keuntungan dengan kalimat yang akan saya bingkai: 3.8 Flash bekerja lebih keras. Ia menjalankan langkah-langkah penalaran tambahan, memanggil alat secara berulang, dan, kutipan, mungkin menggunakan lebih banyak token, yang merupakan bahasa perusahaan untuk meteran berjalan lebih cepat. Dewan DeepSWE independen setuju pada kedua hal: Flash mencetak tujuh puluh empat

2:02 persen, setara dengan Opus 5 dengan seperlima biaya per tugas, tetapi ia membutuhkan seratus enam puluh enam langkah dan seratus empat puluh tiga ribu token keluaran untuk mencapai sana, lebih dari dua kali lipat yang dihabiskan Sol. Artificial Analysis membakar seratus empat puluh juta token dan seribu tujuh puluh delapan dolar hanya untuk menilainya. Murah per token, banyak bicara per tugas, dan token pertama tiba setelah dua belas detik berpikir. Kemudian setengah yang menarik.

2:23 Gemini 3.8 Flash Cyber adalah model yang sama dengan rel pengaman yang dilonggarkan untuk, kutipan, pembela tepercaya, dan Sundar mengatakan itu mencapai 86.2 persen pada CyberGym, tolok ukur untuk menemukan kerentanan secara otonom. Ia juga menambal: 47.2 persen pada CWE-Bench melawan 47.8 untuk model terdepan terkemuka, tim Chrome mengatakan itu menghasilkan 2.6 kali lebih banyak tambalan yang benar daripada model komersial yang jauh lebih besar, dan peneliti cloud Google menggunakannya untuk menemukan kerentanan kritis dalam waktu kurang dari dua jam, pekerjaan yang biasanya memakan berbulan-bulan, atau seorang remaja yang termotivasi.

2:54 Google bersikeras bahwa mereka memprioritaskan perbaikan daripada eksploitasi, yang merupakan cara sopan untuk mengatakan model itu benar-benar dapat berjalan melalui celah-celah, mereka hanya memintanya untuk tidak melakukannya. Jadi Anda tidak bisa memilikinya. Akses melalui Program Fairwind baru: pemerintah, infrastruktur penting, dan enam ratus lima puluh mitra yang disaring dengan wajib dua faktor. Setiap lab perbatasan sekarang memiliki model peretasan yang tidak akan mereka jual kepada Anda, dan minggu ini adalah model yang murah.

3:16 Empat jam kemudian, Meta merilis Muse Spark 1.3, dan Zuck menyebutnya kinerja terdepan yang hampir terlalu murah untuk diukur, dan itu benar, dengan satu tanda bintang sebesar Menlo Park. Titik akhir normal adalah satu dolar dua puluh lima sen masuk dan empat dua puluh lima sen keluar, lebih dari Gemini. Titik akhir kontributor adalah sepuluh sen masuk, dua puluh sen keluar, pembacaan cache seperlima sen, hingga dua puluh kali lebih murah, dan satu-satunya perbedaan adalah kolom yang bertuliskan 'digunakan untuk meningkatkan produk kami'.

3:40 Jadi diskonnya adalah transkrip sesi Anda, dan untuk sekali ini tidak ada yang perlu membaca lisensinya, karena Meta menulis lisensinya sebagai daftar harga. Komentar teratas: sekarang sangat jelas berapa nilai pencurian token saya. Komentar kedua bertanya-tanya berapa lama sampai seseorang mengekstrak kunci AWS dari model yang dilatih berdasarkan permintaan kontributor. Pada kartu skor Meta sendiri, Spark 1.3 mendapat 75,4 pada DeepSWE, di atas Sol dan Opus 5, dan Meta mengatakan ia menggunakan dua puluh persen lebih sedikit panggilan alat

4:06 dan dua puluh lima persen lebih sedikit token daripada 1.2, taruhan yang berlawanan persis dengan Google, jadi hari ini dua perusahaan iklan terbesar di dunia tidak setuju tentang apakah berbicara lebih banyak itu bagus. Sementara itu Trellner Research meminta Perplexity untuk perangkat lunak terbaik dalam tiga ratus delapan puluh kategori dan membaca setiap kutipan: 59,8 persen berasal dari situs di luar seratus ribu teratas, Wikipedia disebutkan tiga kali dari tujuh setengah ribu, dan tiga situs saudari dengan dua ratus lima belas ribu

4:34 panduan pembelian yang dihasilkan memberi judul pada halaman utama mereka 'Fakta dan Halaman Dasar', ditujukan untuk perayap, bukan untuk Anda. Perang SEO AI telah dimulai, dan senjata pertamanya adalah regex dengan anggaran pemasaran. Itu banyak label harga untuk satu hari Rabu; jika Anda lebih suka membaca ini daripada mendengar saya mengatakannya, 'The Daily Diff' masuk ke kotak masuk Anda setiap pagi — gratis di thedaily diff dot dev, tautan di bawah. Jadi, putusan hari ini: SHIP IT. Gemini 3.8 Flash mengikat Opus 5 pada satu papan yang tidak ditulis Google,

5:00 dengan seperlima harga. Cukup baca tagihan token, dan baca judul kolom Meta. Itulah 'The Daily Diff' hari ini. Saya Niko dari Axrisi. Gabungkan dengan bertanggung jawab.

## Sumber

- [Introducing Gemini 3.8 Flash and 3.8 Flash Cyber](https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/) — blog.google
- [Fairwind Program](https://blog.google/innovation-and-ai/technology/safety-security/fairwind-program/) — blog.google
- [DeepSWE v1.1 leaderboard](https://deepswe.datacurve.ai/) — deepswe.datacurve.ai
- [Artificial Analysis: Gemini 3.8 Flash](https://artificialanalysis.ai/models/gemini-3-8-flash) — artificialanalysis.ai
- [Muse Spark 1.3 pricing](https://developer.meta.com/ai/models/muse-spark/) — developer.meta.com
- [Introducing Muse Spark 1.3](https://research.meta.ai/blog/introducing-muse-spark-1-3) — research.meta.ai
- [Hang on to Your Firefox](https://www.newsonaut.com/articles/hang-on-to-your-firefox) — www.newsonaut.com
- [Mistral: opting out of training](https://help.mistral.ai/en/articles/455207-can-i-opt-out-of-my-input-or-output-data-being-used-for-training) — help.mistral.ai
- [HN: Gemini 3.8 Flash](https://news.ycombinator.com/item?id=49537553) — news.ycombinator.com
- [HN: Muse Spark 1.3](https://news.ycombinator.com/item?id=49541256) — news.ycombinator.com
- [HN: 215,128 "best software" pages](https://news.ycombinator.com/item?id=49536375) — news.ycombinator.com
