# Armin Ronaher GPT-6 Astranı 35 saat tək qoydu.

Published: 2026-09-12

Armin Ronaher (Flask, Jinja) GPT-6 Astraya bir əmr verdi və onu 35 saat tək qoydu: təxminən bir milyard token, təxminən 1200 dollar, 79 kommit, 75.000 sətir — və "tamamilə dəyərsiz heç nə". Bərpa etdiyi kod hekayədir: Python string-splicing heredoc-ları ilə yamalanmış C faylları, Node-u işə salan Python-un PowerShell-i işə salması, tokenlərdə 10% daha ucuz olduğu üçün boşluqları silinmiş vahid testlər. İki ölçmə onu dəstəkləyir: Earendil's SlopCodeBench rəqəmləri (agent kodu insan repolarından təxminən iki dəfə çox sözlü və aşınmış, 0% ciddi keçid dərəcəsi) və Quesma'nın RTK-nın 1500 dollarlıq bençmarkı (79 min ulduz, öz sayğacında "89% token qənaət edildi", DeepSeek ilə hər tapşırıq üçün +17%). Həmçinin: Cognition's SWE-2 (trench coat-da Kimi K3, Terminal-Bench 2.1-də 92.8, Terminal-Bench 4-də isə 27.3), OpenAI's Agents API və dayandırılmış 200 dollarlıq Pro qeydiyyatları, və Cümə Hacker News-un daha az AI xəbəri istəməsi. Hökm: REVERT.

Canonical: https://thedailydiff.dev/az/video/2026-09-11-astra-slop-factory/

## Bu videoda nələr əhatə olunur

- Armin Ronaher: 35 saat nəzarətsiz GPT-6 Astra, ~1200 dollar, 79 kommit, +75 min sətir, heç nə göndərilmədi
- Earendil / SlopCodeBench: agent kodu insan repolarından ~2 dəfə çox sözlü və aşınmış; ciddi keçid dərəcəsi 0%
- Quesma: RTK 89% tokenə qənaət edildiyini bildirir, lakin Terminal-Bench xərcləri DeepSeek ilə 17% artır; yenidən yazma dövrü ardıcıl 339 dəfə uğursuz oldu
- Cognition SWE-2: Kimi K3-dən sonra təlim keçib, FrontierCode-da Fable 5.1-ə üçdə bir qiymətinə uyğun gəlir; TB 2.1 92.8, TB 4 27.3; Devin Voice
- OpenAI Agents API (xidmət kimi Codex qoşqu, yalnız ABŞ, ZDR yoxdur); Astra tələbatına görə 200 dollarlıq Pro qeydiyyatları dayandırıldı

## Tərcümə olunmuş transkript

Orijinal ingilis dilindəki nəqldən tərcümə edilmişdir. Mövcud audio və subtitrlər YouTube tərəfindən idarə olunur.

0:00 Flask-ı yazan Armin Ronaher GPT-6 Astraya tək bir əmr verdi və onu otuz beş saat tək qoydu. O, yetmiş beş min sətir kodla qayıtdı və, onun sözləri ilə, tamamilə dəyərsiz heç nə, bu da onu ən real proqram fabriki edir. O, çərşənbə günü yazısını dərc etdi. Cümə axşamı Cognition SWE-2-ni, OpenAI isə Agents API-ni göndərdi və iki yüz dollarlıq planına qeydiyyatları dayandırdı,

0:24 çünki Astra serverləri yedi. Və cümə günü yazı Hacker News-un ilk səhifəsinə çıxdı, Hacker News-dan AI haqqında yazmağı dayandırmağı xahiş edən bir yazının bir neçə sətri altında. Bu videoda: bir gün yarım nəzarətsiz Astra nə istehsal edir, səliqəsizliyi rəqəmə çevirən iki ölçmə, yetmiş doqquz min ulduzlu bir alətin niyə hesabınızı böyütdüyü və Hacker News-un AI-dən istifadə edərək AI-ni necə filtrləməyə çalışdığı. Cümədir, 11 Sentyabr, və bu The Daily Diff-dir.

0:53 Fabrik. Bir əmr: virtual thread-lər və leksik əhatəli bir Python qurun. Astra öz qeydlərini apardı, öz subagentlərini işə saldı, və Armin elektrik şnuru çıxarana qədər işlədi, bir gün yarım və təxminən on iki yüz dollar sonra. Yetmiş doqquz kommit, beləliklə hər kommit üçün on beş yarım dollar, bu da bir insanın tələb etdiyi məbləğə yaxındır, yalnız insan nəhayət dayanır. Kod hekayədir. Astra, redaktə aləti əvəzinə, faylı oxuyan, funksiyanı dəyişdirən və onu geri yazan Python heredoc-larını boru ilə C fayllarına yamalayır. onu geri yazır.

1:20 Bir Windows testini işə salmaq üçün o, Node-u işə salan Python yazdı, bu da PowerShell-i işə saldı, pasportlu bir zəng yığını. Qeyd etdiyi vahid testlərdə heç bir boşluq yoxdur, çünki girinti olmadan onlar tokenlərdə on faiz daha ucuzdur. Və tapşırıq siyahısı bir, iki, üçdən tapşırıq 8b2c2b2b yoxlama nöqtəsi birə sürüşdü, bu da internin tək çox uzun qaldığını necə biləcəyinizdir. Arminin nəzəriyyəsi: model uzun tapşırıqları bitirdiyinə görə mükafatlandırılır və çirkin koda görə demək olar ki, cəzalandırılmır, beləliklə token-golf edilmiş alət çağırışları kod bazasına sızır, və nə qədər az insan baxsa, bir o qədər az əhəmiyyət kəsb edir. çirkin koda görə demək olar ki, cəzalandırılmır, beləliklə token-golf edilmiş alət çağırışları kod bazasına sızır,

1:48 və nə qədər az insan baxsa, bir o qədər az əhəmiyyət kəsb edir. O, həmin hissəni "Baxmasanız AGI-dir" adlandırdı. Hacker News iqtisadiyyatı əlavə etdi: daha çox kod onu saxlamaq üçün daha çox token deməkdir, bu da səliqəsizliyi bir səhv deyil, bir abunə edir. Səliqəsizliyi ölçə bilərsinizmi? Arminin öz şirkəti bu həftə bunu sınadı. Earendil SlopCodeBench rəqəmlərini işlətdi: agent kodu müqayisə olunduğu insan repolarından təxminən iki dəfə çox sözlü və iki dəfə daha aşınmışdır,

2:10 və bençmark yoxlama nöqtələri arasında agentin yaddaşını sildikdə, test etdikləri hər model üçün ciddi keçid dərəcəsi sıfırdır. Tapdıqları ən etibarlı səliqəsizlik metriki xam sətir sayı idi, bu da kimsə onu optimallaşdırdığı anda işləməyi dayandırır, buna görə də lütfən modellərə deməyin. Sonra cüzdan. RTK-nın yetmiş doqquz min GitHub ulduzu və Claude Kod hesabınızı yarıya endirəcəyini vəd edən YouTube kiçik şəkilləri var; o, agent oxumadan əvvəl terminal çıxışını sıxır. Claude Kod hesabınızı yarıya endirəcəyini vəd edən YouTube kiçik şəkilləri var; o, agent

2:34 oxumadan əvvəl terminal çıxışını sıxır. Quesma onu Terminal-Bench-də min beş yüz dollarlıq token üçün işlətdi. Fable ilə hesab beş faiz azaldı, demək olar ki, hamısı bir tapşırıqdan; DeepSeek ilə orta tapşırıq on yeddi faiz daha bahalı oldu. Bu arada RTK-nın öz sayğacı səksən doqquz faiz qənaət edildiyini bildirdi, çünki o, əlavə dönmələrə görə yox, silinmiş baytları sayır: qonşunu hesablayan ağıllı sayğac. qonşunu hesablayan ağıllı sayğac. Və bir versiya səhvi "tapmaq" əmrini uğursuz olan bir əmrə çevirdi, ardıcıl üç yüz otuz doqquz dəfə, doqquz qat daha baha qiymətə.

3:01 Tokenləri öldürən alətdə bir dövrə var. Daşqın özü. Cognition's SWE-2 Kimi K3, açıq Çin modelidir, Cognition'un öz bençmarkında Fable 5.1-ə üçdə bir qiymətinə uyğun gələnə qədər təlim keçib; Hacker News: niyə bütün Amerikan AI modelləri əsasən trench coat-da Kimidir. üçdə bir qiymətinə uyğun gələnə qədər təlim keçib; Hacker News: niyə bütün Amerikan AI modelləri əsasən Kimi trench coat-da Kimidir. Terminal-Bench 2.1-də bütün cədvəli üstələyir; Terminal-Bench 4-də, hələ heç kimin əzbərləmədiyi o, Fable-nin əlli altısına qarşı iyirmi yeddi bal toplayır,

3:28 beləliklə slaydlarda ən yaxşı sütun artıq hər kəsin keçdiyi imtahandır. Cognition həmçinin Devin Voice-u elan etdi, sizin sevimli AI proqram mühəndisinizə telefon bağlandı, çünki agent kodlamasında çatışmayan bir şey musiqini gözlətmək idi. proqram mühəndisinizə telefon bağlandı, çünki agent kodlamasında çatışmayan bir şey musiqini gözlətmək idi. OpenAI, eyni gün: Agents API, bu da xidmət kimi satılan Codex qoşqusudur. OpenAI sandboxu idarə edir, yalnız ABŞ məlumat rezidentliyi, sıfır məlumat saxlama yoxdur, beləliklə agent kod bazanızı ChatGPT kimi dəqiq xatırlayır. Sonra OpenAI iki yüz dollarlıq Pro planına qeydiyyatları dayandırdı,

3:57 çünki Astra tələbatı, sitat gətirsək, görünməmişdir: gözləmə siyahısı olan ilk məhsul daha çox pul ödəmək üçün. Armin fabrikində tam bir sıfırlama etdi. Tələbat odur. Bu da bizi Cümə gününün Ask HN-ə gətirir: AI xəbərləri daşqınını məhdudlaşdıra bilərikmi, altı yüz əlli altı bal, çünki, sitat gətirsək, "OpenAI və ya Anthropic-də hər kəs yel buraxdıqda, ilk onluqda bir yazı olur".

4:17 Cavablar filtrlər idi: hcker.news, səkkiz min nümunə üzərində təlim keçmiş BERT klassifikatoru ilə AI hekayələrini silir, AI-ni silmək üçün AI, otla bəslənən; və A-I-ni böyük-kiçik hərf fərqi qoymadan uyğunlaşdıran uBlock regex də e-poçt, gündəlik, əsas, domen və qatarı silir, beləliklə regex, hər zamankı kimi, canidir. Eyni günortadan sonra, dörd yüz on beş şərh Claude-un on səkkiz yaşdan yuxarı olduğunu deyən bir Claude dəstək səhifəsi haqqında mübahisə etdi. Claude-un on səkkiz yaşdan yuxarı olduğunu deyən bir Claude dəstək səhifəsi haqqında mübahisə etdi.

4:38 Səhifə May ayına aiddir. Heç nə dəyişmədi. Hətta xəbər olmayan AI xəbərləri də xəbərdir, bu da, ədalətli olmaq üçün, mənim iş modelimdir. Əgər bunu məndən eşitməkdənsə oxumağı üstün tutsanız, diff hər səhər e-poçtunuza gəlir — thedailydiff.dev saytında pulsuzdur, link aşağıdadır. hər səhər — thedailydiff.dev saytında pulsuzdur, link aşağıdadır. Bu, qaçılmaz olaraq, AI xəbərləridir. Beləliklə — otuz beş saatlıq proqram fabriki haqqında bugünkü hökm: REVERT. Heç kimin oxumadığı yetmiş doqquz kommit kod bazası deyil, bu, git

5:04 logu olan bir məsuliyyətdir; Astra təsir edicidir və fabrik geri qaytarılacaq hissədir. Və bugünkü fərq bu qədərdir. Mən Axrisi-dən Niko. Məsuliyyətlə birləşdirin.

## Mənbələr

- [Armin Ronacher — Astra for Coding: Why Are We Doing This Again?](https://lucumr.pocoo.org/2026/9/7/astra-why/) — lucumr.pocoo.org
- [HN: Astra for Coding](https://news.ycombinator.com/item?id=49654229) — news.ycombinator.com
- [Earendil — Measuring the sloppiness of code](https://earendil.com/posts/measuring-code-sloppiness/) — earendil.com
- [HN: Measuring the sloppiness of code](https://news.ycombinator.com/item?id=49658311) — news.ycombinator.com
- [Quesma — RTK reports huge token savings, but our cost benchmarks disagree](https://quesma.com/blog/does-rtk-make-ai-coding-cheaper/) — quesma.com
- [HN: RTK](https://news.ycombinator.com/item?id=49656471) — news.ycombinator.com
- [RTK (Rust Token Killer)](https://github.com/rtk-ai/rtk) — github.com
- [Cognition — Introducing SWE-2](https://cognition.com/blog/swe-2) — cognition.com
- [HN: Cognition SWE-2](https://news.ycombinator.com/item?id=49645443) — news.ycombinator.com
- [OpenAI — Agents API](https://developers.openai.com/api/docs/guides/agents-api/overview) — developers.openai.com
- [HN: OpenAI Agents API](https://news.ycombinator.com/item?id=49649213) — news.ycombinator.com
- [TechCrunch — OpenAI puts Pro subscriptions on hold due to Astra demand](https://techcrunch.com/2026/09/10/openai-puts-pro-subscriptions-on-hold-due-to-astra-demand/) — techcrunch.com
- [Ask HN: Can we please limit the AI news flood?](https://news.ycombinator.com/item?id=49657850) — news.ycombinator.com
- [HN: Claude is only available to people over 18 years](https://news.ycombinator.com/item?id=49656225) — news.ycombinator.com
