# Armin Ronacher nechal GPT-6 Astra samú 35 hodín.

Published: 2026-09-12

Armin Ronacher (Flask, Jinja) dal GPT-6 Astra jeden prompt a nechal ju samotnú 35 hodín: asi miliarda tokenov, asi 1 200 dolárov, 79 commitov, 75 000 riadkov — a „absolútne nič cenné“. Kód, ktorý získala, je príbeh: C súbory opravené Python string-splicing heredocmi, Python spúšťajúci Node spúšťajúci PowerShell, unit testy s odstránenými medzerami, pretože sú o 10 % lacnejšie v tokenoch. Podporujú ho dve merania: čísla Earendil's SlopCodeBench (kód agenta je asi dvakrát výrečnejší a erodovaný ako ľudské repozitáre, 0 % úspešnosť striktného prechodu) a benchmark Quesma za 1 500 dolárov pre RTK (79k hviezd, „89 % ušetrených tokenov“ na vlastnom počítadle, +17 % na úlohu s DeepSeek). Tiež: Cognition's SWE-2 (Kimi K3 v trenčkote, 92,8 na Terminal-Bench 2.1 vs 27,3 na Terminal-Bench 4), OpenAI's Agents API a pozastavené prihlášky na Pro za 200 dolárov a piatkový Hacker News, ktorý žiadal menej AI noviniek. Verdikt: REVERT.

Canonical: https://thedailydiff.dev/sk/video/2026-09-11-astra-slop-factory/

## Čo toto video pokrýva

- Armin Ronacher: 35 hodín bezobslužnej GPT-6 Astra, ~$1 200, 79 commitov, +75 tisíc riadkov, nič nespustené
- Earendil / SlopCodeBench: kód agenta ~2x výrečnejší a erodovaný ako ľudské repozitáre; miera striktného prechodu 0%
- Quesma: RTK hlási 89% ušetrených tokenov, ale náklady na Terminal-Bench sa s DeepSeek zvýšia o 17%; prepisovací cyklus zlyhal 339-krát za sebou
- Cognition SWE-2: post-trénovaný z Kimi K3, zodpovedá Fable 5.1 na FrontierCode za tretinu ceny; TB 2.1 92.8 vs TB 4 27.3; Devin Voice
- OpenAI Agents API (základ Codexu ako služba, len pre USA, bez ZDR); Pozastavené registrácie Pro za 200 dolárov kvôli dopytu po Astre

## Preložený prepis

Preložené z pôvodného anglického rozprávania. Dostupný zvuk a titulky sú kontrolované službou YouTube.

0:00 Armin Ronacher, muž, ktorý napísal Flask, dal GPT-6 Astra jeden príkaz a nechal ju samotnú tridsaťpäť hodín. Vrátila sa so sedemdesiatpäťtisíc riadkami kódu a, podľa jeho slov, absolútne nič cenné, čo z nej robí najrealistickejšiu softvérovú továreň, aká kedy bola postavená. Správu zverejnil v stredu. Vo štvrtok Cognition dodal SWE-2 a OpenAI dodal Agents API a pozastavil registrácie pre svoj plán za dvesto dolárov,

0:24 pretože Astra pohltila servery. A v piatok sa správa dostala na titulnú stránku Hacker News, niekoľko riadkov pod príspevkom, ktorý žiadal Hacker News, aby prestal uverejňovať príspevky o AI. V tomto videu: čo produkuje deň a pol bezobslužnej Astry, dve merania, ktoré premenia neporiadok na číslo, prečo nástroj so sedemdesiatdeväť tisíc hviezd zvyšuje váš účet a ako sa Hacker News pokúsil filtrovať AI, pomocou AI. Je piatok, 11. septembra, a toto je The Daily Diff.

0:53 Továreň. Jeden prompt: vytvorte Python s virtuálnymi vláknami a lexikálnym rozsahom. Astra si viedla vlastné poznámky, spustila vlastných subagentov, a bežala, kým Armin nevytiahol zástrčku, deň a pol a asi dvanásťsto dolárov neskôr. Sedemdesiatdeväť commitov, takže pätnásť a pol dolára za commit, čo je zhruba to, čo si účtuje človek, s tým rozdielom, že človek nakoniec prestane. Kód je príbeh. Namiesto nástroja na úpravu, Astra opravuje C súbory tak, že potrubím Python heredocs, ktoré prečítajú súbor, nahradia funkciu reťazcom a zapíšu ho späť.

1:20 Na spustenie jedného Windows testu napísala Python, ktorý spustil Node, ktorý spustil PowerShell, zásobník volaní s pasom. Unit testy, ktoré odovzdala, nemajú vôbec žiadne medzery, pretože bez odsadenia sú o desať percent lacnejšie v tokenoch. A zoznam úloh sa posunul z jedna, dva, tri na úlohu 8b2c2b2b checkpoint jeden, podľa čoho viete, že stážista bol príliš dlho sám. Arminova teória: model je odmenený za dokončenie dlhých úloh a sotva potrestaný za škaredý kód, takže tokenovo skrátené volania nástrojov prenikajú do kódovej základne,

1:48 a čím menej ľudí sa pozerá, tým menej na tom záleží. Túto sekciu nazval Je to AGI, ak sa nepozeráš. Hacker News pridal ekonomiku: viac kódu znamená viac tokenov na jeho údržbu, čo robí z neporiadku nie chybu, ale predplatné. Môžete zmerať neporiadok? Arminova vlastná spoločnosť to skúsila tento týždeň. Earendil spustil čísla SlopCodeBench: kód agenta je asi dvakrát výrečnejší a dvakrát erodovaný ako ľudské repozitáre, s ktorými sa porovnáva,

2:10 a keď benchmark vymaže pamäť agenta medzi kontrolnými bodmi, miera prísneho prechodu pre každý testovaný model je nula. Najspoľahlivejšia metrika neporiadku, ktorú našli, bol surový počet riadkov, ktorá prestane fungovať v momente, keď ju niekto optimalizuje, takže prosím, nehovorte to modelom. Potom peňaženka. RTK má sedemdesiattisíc hviezd na GitHub-e a miniatúry na YouTube sľubujúce znížiť váš účet za Claude Code na polovicu; komprimuje výstup terminálu predtým, ako ho agent

2:34 prečíta. Quesma ho spustila na Terminal-Bench za tisícpäťsto dolárov tokenov. S Fable sa účet znížil o päť percent, takmer všetko z jednej úlohy; s DeepSeek sa priemerná úloha predražila o sedemnásť percent. Medzitým vlastné počítadlo RTK hlásilo osemdesiatdeväť percent ušetrených, pretože počíta odstránené bajty, nie dodatočné otáčky spôsobené: inteligentný merač, ktorý účtuje susedovi. A jedna chyba verzie prepísala find na príkaz, ktorý zlyhal, tristotridsaťdeväťkrát za sebou, za deväťnásobnú cenu.

3:01 Nástroj, ktorý zabíja tokeny, má slučku. Samotná záplava. Cognition's SWE-2 je Kimi K3, otvorený čínsky model, post-trénovaný, kým sa nevyrovná Fable 5.1 na vlastnom benchmarku Cognition za tretinu ceny; Hacker News: prečo sú všetky americké AI modely v podstate Kimi v trenčkote. Na Terminal-Bench 2.1 sa umiestňuje na vrchole celej tabuľky; na Terminal-Bench 4, ten, ktorý si ešte nikto nezapamätal, dosahuje dvadsaťsedem oproti Fableho päťdesiatšesť,

3:28 takže na benchmarkoch v prezentáciách je najlepší stĺpec ten test, ktorý už všetci prešli. Cognition tiež oznámil Devin Voice, váš obľúbený AI softvérový inžinier práve dostal pevnú linku, pretože jediná vec, ktorá agentnému kódovaniu chýbala, bola hudba pri čakaní. OpenAI, v rovnaký deň: Agents API, čo je nástroj Codex predávaný ako služba. OpenAI prevádzkuje sandbox, len pre údaje v USA, žiadne nulové uchovávanie dát, takže agent si pamätá vašu kódovú základňu presne tak dobre, ako ChatGPT. Potom OpenAI pozastavilo registrácie pre Pro plán za dvesto dolárov,

3:57 pretože dopyt po Astre je, citujem, bezprecedentný: prvý produkt s čakacím zoznamom na zaplatenie viac. Armin spálil celý reset na svojej továrni. On je ten dopyt. Čo nás privádza k piatkovému Ask HN: môžeme prosím obmedziť záplavu AI správ, šesťsto päťdesiatšesť bodov, pretože, citujem, zakaždým, keď niekto z OpenAI alebo Anthropic prdne, je tam top-ten príspevok.

4:17 Odpovede boli filtre: hcker dot news odstraňuje AI príbehy pomocou klasifikátora BERT trénovaného na osemtisíc príkladoch, AI na vymazanie AI, trávou kŕmené; a regex uBlock zhodujúci sa s A-I bez ohľadu na veľké a malé písmená tiež odstraňuje email, denné, hlavné, doména a trénovať, takže regex, ako vždy, je zloduch. V rovnaké popoludnie, štyristopätnásť komentárov sa hádalo o stránke podpory Claude hovoriac, že Claude je osemnásťplus.

4:38 Stránka je datovaná v máji. Nič sa nezmenilo. Dokonca aj správy o AI, ktoré nie sú správami, sú správy, čo je, úprimne, aj môj obchodný model. Ak si to radšej prečítate, než aby ste ma počuli hovoriť, rozdiel vám príde do schránky každé ráno — zadarmo na daily diff dot dev, odkaz nižšie. Je to, nevyhnutne, správa o AI. Takže — dnešný verdikt o tridsaťpäťhodinovej softvérovej továrni: REVERT. Sedemdesiatdeväť commitov, ktoré nikto nečítal, nie je kódová základňa, je to záväzok s git

5:04 logom; Astra je pôsobivá a továreň je časť, ktorú treba vrátiť. A to je dnešný rozdiel. Som Niko z Axrisi. Zlučujte zodpovedne.

## Zdroje

- [Armin Ronacher — Astra for Coding: Why Are We Doing This Again?](https://lucumr.pocoo.org/2026/9/7/astra-why/) — lucumr.pocoo.org
- [HN: Astra for Coding](https://news.ycombinator.com/item?id=49654229) — news.ycombinator.com
- [Earendil — Measuring the sloppiness of code](https://earendil.com/posts/measuring-code-sloppiness/) — earendil.com
- [HN: Measuring the sloppiness of code](https://news.ycombinator.com/item?id=49658311) — news.ycombinator.com
- [Quesma — RTK reports huge token savings, but our cost benchmarks disagree](https://quesma.com/blog/does-rtk-make-ai-coding-cheaper/) — quesma.com
- [HN: RTK](https://news.ycombinator.com/item?id=49656471) — news.ycombinator.com
- [RTK (Rust Token Killer)](https://github.com/rtk-ai/rtk) — github.com
- [Cognition — Introducing SWE-2](https://cognition.com/blog/swe-2) — cognition.com
- [HN: Cognition SWE-2](https://news.ycombinator.com/item?id=49645443) — news.ycombinator.com
- [OpenAI — Agents API](https://developers.openai.com/api/docs/guides/agents-api/overview) — developers.openai.com
- [HN: OpenAI Agents API](https://news.ycombinator.com/item?id=49649213) — news.ycombinator.com
- [TechCrunch — OpenAI puts Pro subscriptions on hold due to Astra demand](https://techcrunch.com/2026/09/10/openai-puts-pro-subscriptions-on-hold-due-to-astra-demand/) — techcrunch.com
- [Ask HN: Can we please limit the AI news flood?](https://news.ycombinator.com/item?id=49657850) — news.ycombinator.com
- [HN: Claude is only available to people over 18 years](https://news.ycombinator.com/item?id=49656225) — news.ycombinator.com
