# លោក Armin Ronacher បានទុក GPT-6 Astra តែម្នាក់ឯងរយៈពេល 35 ម៉ោង។

Published: 2026-09-12

លោក Armin Ronacher (Flask, Jinja) បានផ្តល់ប្រូមមួយទៅ GPT-6 Astra ហើយទុកវាចោលរយៈពេល 35 ម៉ោង: ប្រហែលមួយពាន់លានថូខឹន, ប្រហែល $1,200, 79 កម្មវត្ថុ, 75,000 បន្ទាត់ — ហើយ "គ្មានអ្វីដែលមានតម្លៃទាល់តែសោះ"។ កូដដែលវាបានសង្គ្រោះគឺជារឿង: ឯកសារ C ដែលបានបំណះដោយ Python string-splicing heredocs, Python បង្កើត Node បង្កើត PowerShell, ការធ្វើតេស្តឯកតាដែលបានដកឃ្លាចេញដោយសារតែវាថោកជាង 10% ក្នុងថូខឹន។ ការវាស់វែងពីរគាំទ្រគាត់: លេខ SlopCodeBench របស់ Earendil (កូដភ្នាក់ងារប្រហែលពីរដង verbose និងរងការខូចខាតដូចឃ្លាំងមនុស្ស, អត្រាឆ្លងកាត់តឹងរ៉ឹង 0%) និងការវាស់វែង $1,500 របស់ Quesma នៃ RTK (79k ផ្កាយ, "89% ថូខឹនបានរក្សាទុក" នៅលើឧបករណ៍រាប់របស់ខ្លួន, +17% ក្នុងមួយកិច្ចការជាមួយ DeepSeek)។ ផងដែរ: SWE-2 របស់ Cognition (Kimi K3 ក្នុងអាវធំ, 92.8 នៅលើ Terminal-Bench 2.1 ទល់នឹង 27.3 នៅលើ Terminal-Bench 4), OpenAI's Agents API និងការចុះឈ្មោះ Pro $200 ដែលបានផ្អាក, និង Hacker News កាលពីថ្ងៃសុក្របានសុំព័ត៌មាន AI តិចជាងមុន។ សាលក្រម: REVERT។

Canonical: https://thedailydiff.dev/km/video/2026-09-11-astra-slop-factory/

## អ្វីដែលវីដេអូនេះគ្របដណ្ដប់

- Armin Ronacher: 35 ម៉ោងនៃ GPT-6 Astra ដែលមិនមានការត្រួតពិនិត្យ, ~$1,200, 79 កម្មវត្ថុ, +75k បន្ទាត់, គ្មានអ្វីត្រូវបានដឹកជញ្ជូន
- Earendil / SlopCodeBench: កូដភ្នាក់ងារ ~2 ដង verbose និងរងការខូចខាតដូចឃ្លាំងមនុស្ស; អត្រាឆ្លងកាត់តឹងរ៉ឹង 0%
- Quesma: RTK រាយការណ៍ថា 89% ថូខឹនបានរក្សាទុក, ប៉ុន្តែថ្លៃដើម Terminal-Bench កើនឡើង 17% ជាមួយ DeepSeek; ការរៀបចំឡើងវិញបានបរាជ័យ 339 ដងជាប់គ្នា
- Cognition SWE-2: ត្រូវបានបណ្តុះបណ្តាលក្រោយពី Kimi K3, ផ្គូផ្គង Fable 5.1 នៅលើ FrontierCode ក្នុងតម្លៃមួយភាគបី; TB 2.1 92.8 ទល់នឹង TB 4 27.3; Devin Voice
- OpenAI Agents API (Codex harness ជាសេវាកម្ម, សម្រាប់តែសហរដ្ឋអាមេរិក, គ្មាន ZDR); ការចុះឈ្មោះ Pro $200 ត្រូវបានផ្អាកសម្រាប់តម្រូវការ Astra

## កំណត់ត្រាដែលបានបកប្រែ

បកប្រែចេញពីការនិទានដើមជាភាសាអង់គ្លេស។ សំឡេង និងចំណងជើងរងដែលមានគឺស្ថិតនៅក្រោមការគ្រប់គ្រងរបស់ YouTube។

0:00 លោក Armin Ronacher ដែលជាអ្នកសរសេរ Flask បានផ្តល់ប្រូមតែមួយគត់ទៅ GPT-6 Astra ហើយ ទុកវាចោលរយៈពេលសាមសិបប្រាំម៉ោង។ វាបានត្រឡប់មកវិញជាមួយកូដចំនួនចិតសិបប្រាំពាន់បន្ទាត់ ហើយ នៅក្នុងពាក្យរបស់គាត់ គឺគ្មានអ្វីដែលមានតម្លៃទាល់តែសោះ ដែលធ្វើឱ្យវាក្លាយជារោងចក្រ ផលិតកម្មកម្មវិធីដែលមានភាពប្រាកដនិយមបំផុតដែលមិនធ្លាប់មាន។ គាត់បានបង្ហោះការសរសេរនោះកាលពីថ្ងៃពុធ។ កាលពីថ្ងៃព្រហស្បតិ៍ Cognition បានដឹកជញ្ជូន SWE-2 ហើយ OpenAI បានដឹកជញ្ជូន Agents API ហើយបានផ្អាកការចុះឈ្មោះសម្រាប់គម្រោងពីររយដុល្លាររបស់ខ្លួន

0:24 ដោយសារ Astra បានប្រើប្រាស់ server អស់។ ហើយកាលពីថ្ងៃសុក្រ ការសរសេរនោះបានទៅដល់ទំព័រមុខនៃ Hacker News ពីរបីជួរខាងក្រោមប្រកាសដែលសុំឱ្យ Hacker News កុំបង្ហោះអំពី AI ទៀត។ នៅក្នុងវីដេអូនេះ: អ្វីដែលមួយថ្ងៃកន្លះនៃ Astra ដែលមិនមានការត្រួតពិនិត្យផលិតបាន ការវាស់វែងពីរដែលបង្វែរភាពគ្មានតម្លៃទៅជាលេខ, ហេតុអ្វីបានជាឧបករណ៍ដែលមានចិតសិបប្រាំបួន ពាន់ផ្កាយធ្វើឱ្យវិក្កយបត្ររបស់អ្នកកាន់តែធំ, និងរបៀបដែល Hacker News ព្យាយាមច្រោះចេញ AI ដោយប្រើ AI។ ថ្ងៃសុក្រ ទី 11 ខែកញ្ញា នេះគឺជា The Daily Diff។

0:53 រោងចក្រ។ ប្រូមមួយ: បង្កើត Python ជាមួយ virtual threads និង lexical scoping។ Astra បានរក្សាទុកកំណត់ចំណាំផ្ទាល់ខ្លួន, បានបង្កើត subagents ផ្ទាល់ខ្លួន ហើយបានដំណើរការរហូតដល់ Armin បានដកដោតចេញ មួយថ្ងៃកន្លះ និងប្រហែលមួយពាន់ពីររយ ដុល្លារក្រោយមក។ ចិតសិបប្រាំបួន commits ដូច្នេះដប់ប្រាំកន្លះដុល្លារក្នុងមួយ commit ដែលប្រហែលជាអ្វីដែលមនុស្សគិតថ្លៃ លើកលែងតែមនុស្សទីបំផុតឈប់។ កូដគឺជាការរឿង។ ជំនួសឱ្យឧបករណ៍កែសម្រួល Astra បំណះឯកសារ C ដោយដាក់ Python heredocs ដែល អានឯកសារ, ជំនួសខ្សែអក្សរមុខងារមួយចូល, ហើយសរសេរវាត្រឡប់មកវិញ។

1:20 ដើម្បីដំណើរការការធ្វើតេស្ត Windows មួយ វាបានសរសេរ Python ដែលបង្កើត Node ដែលបង្កើត PowerShell ដែលជា call stack ជាមួយលិខិតឆ្លងដែន។ ការធ្វើតេស្តឯកតាដែលវាបានប្តេជ្ញាគឺគ្មានដកឃ្លាទាល់តែសោះ ព្រោះបើគ្មានការដកឃ្លាទេ ពួកវាថោកជាងដប់ភាគរយក្នុងថូខឹន។ ហើយបញ្ជីកិច្ចការបានរសាត់ពីមួយ, ពីរ, បី ទៅកិច្ចការ 8b2c2b2b checkpoint មួយ ដែលជាការដែលអ្នកដឹងថាអ្នកកម្មសិក្សាបាននៅតែម្នាក់ឯងយូរពេក។ ទ្រឹស្តីរបស់ Armin: គំរូត្រូវបានផ្តល់រង្វាន់សម្រាប់ការបញ្ចប់កិច្ចការវែងៗ ហើយស្ទើរតែ មិនត្រូវបានផ្តន្ទាទោសចំពោះកូដអាក្រក់ ដូច្នេះ token-golfed tool calls ជ្រាបចូលទៅក្នុង codebase

1:48 ហើយមនុស្សកាន់តែតិចមើល កាន់តែតិចជាបញ្ហា។ គាត់បានដាក់ចំណងជើងផ្នែកនោះថា It's AGI If You Don't Look។ Hacker News បានបន្ថែមសេដ្ឋកិច្ច: កូដកាន់តែច្រើនមានន័យថាថូខឹនកាន់តែច្រើនដើម្បីថែរក្សាវា ដែលធ្វើឱ្យភាពគ្មានតម្លៃមិនមែនជាកំហុសទេ ប៉ុន្តែជាការជាវ។ តើអ្នកអាចវាស់ភាពគ្មានតម្លៃបានទេ? ក្រុមហ៊ុនរបស់ Armin ផ្ទាល់បានព្យាយាមនៅសប្តាហ៍នេះ។ Earendil បានដំណើរការលេខ SlopCodeBench: កូដភ្នាក់ងារគឺប្រហែលពីរដង verbose និង ពីរដងរងការខូចខាតដូចឃ្លាំងមនុស្សដែលវាត្រូវបានប្រៀបធៀបជាមួយ

2:10 ហើយនៅពេលដែល benchmark លុបការចងចាំរបស់ភ្នាក់ងាររវាង checkpoints អត្រាឆ្លងកាត់តឹងរ៉ឹងសម្រាប់រាល់គំរូដែលពួកគេបានធ្វើតេស្តគឺសូន្យ។ ការវាស់វែងភាពគ្មានតម្លៃដែលគួរឱ្យទុកចិត្តបំផុតដែលពួកគេបានរកឃើញគឺចំនួនបន្ទាត់ឆៅ ដែលឈប់ដំណើរការភ្លាមៗនៅពេលនរណាម្នាក់បង្កើនប្រសិទ្ធភាពសម្រាប់វា ដូច្នេះសូមកុំប្រាប់គំរូទាំងនោះ។ បន្ទាប់មកកាបូប។ RTK មានផ្កាយ GitHub ចំនួនចិតសិបប្រាំបួនពាន់ និងរូបភាពតូច YouTube ដែលសន្យាថា នឹងកាត់បន្ថយវិក្កយបត្រ Claude Code របស់អ្នកពាក់កណ្តាល; វាបង្ហាប់ទិន្នផល terminal មុនពេលភ្នាក់ងារ

2:34 អានវា។ Quesma បានដំណើរការវានៅលើ Terminal-Bench សម្រាប់ថូខឹនមួយពាន់ប្រាំរយដុល្លារ។ ជាមួយ Fable វិក្កយបត្របានធ្លាក់ចុះប្រាំភាគរយ ស្ទើរតែទាំងអស់ពីកិច្ចការមួយ; ជាមួយ DeepSeek កិច្ចការជាមធ្យមបានថ្លៃជាងដប់ប្រាំពីរភាគរយ។ ទន្ទឹមនឹងនោះ ឧបករណ៍រាប់ផ្ទាល់របស់ RTK បានរាយការណ៍ថាបានរក្សាទុកប៉ែតសិបប្រាំបួនភាគរយ ដោយសារតែវារាប់បៃដែលបានដកចេញ មិនមែនវេនបន្ថែមដែលបានបង្កឡើងទេ: ម៉ែត្រឆ្លាតវៃដែល គិតថ្លៃអ្នកជិតខាង។ ហើយកំហុសកំណែមួយបានសរសេរ find ទៅជាពាក្យបញ្ជាដែលបរាជ័យ បីរយសាមសិបប្រាំបួនដងជាប់គ្នា ក្នុងតម្លៃប្រាំបួនដង។

3:01 ឧបករណ៍ដែលសម្លាប់ថូខឹនមាន loop។ ទឹកជំនន់ខ្លួនវា។ SWE-2 របស់ Cognition គឺ Kimi K3 ដែលជាគំរូចិនបើកចំហរ បានបណ្តុះបណ្តាលក្រោយរហូតដល់វាផ្គូផ្គង Fable 5.1 នៅលើ benchmark ផ្ទាល់របស់ Cognition ក្នុងតម្លៃ មួយភាគបី; Hacker News: ហេតុអ្វីបានជាគំរូ AI របស់អាមេរិកទាំងអស់គឺ Kimi នៅក្នុងអាវធំ។ នៅលើ Terminal-Bench 2.1 វាឈរនៅលំដាប់កំពូលនៃតារាងទាំងមូល; នៅលើ Terminal-Bench 4 ដែលគ្មាននរណាម្នាក់បានចងចាំនៅឡើយ វាបានពិន្ទុម្ភៃប្រាំពីរទៅ Fable ហាសិបប្រាំមួយ

3:28 ដូច្នេះនៅលើ slide-deck benchmarks ជួរឈរល្អបំផុតគឺការប្រឡងដែលមនុស្សគ្រប់គ្នាបាន ប្រឡងជាប់រួចហើយ។ Cognition ក៏បានប្រកាស Devin Voice ដែលជាវិស្វករកម្មវិធី AI ដែលអ្នកចូលចិត្ត ទើបតែមានទូរស័ព្ទលើតុ ព្រោះអ្វីដែលការសរសេរកូដ agentic ខ្វះនោះគឺ តន្ត្រីរង់ចាំ។ OpenAI ថ្ងៃដដែល: Agents API ដែលជា Codex harness ដែលលក់ជាសេវាកម្ម។ OpenAI ដំណើរការ sandbox, សម្រាប់តែទិន្នន័យនៅសហរដ្ឋអាមេរិកប៉ុណ្ណោះ, គ្មាន zero-data-retention ដូច្នេះភ្នាក់ងារចងចាំ codebase របស់អ្នកបានល្អដូច ChatGPT ដែរ។ បន្ទាប់មក OpenAI បានផ្អាកការចុះឈ្មោះសម្រាប់គម្រោង Pro ពីររយដុល្លារ

3:57 ដោយសារតែតម្រូវការ Astra គឺ "មិនធ្លាប់មានពីមុនមក"។ ផលិតផលដំបូងដែលមានបញ្ជីរង់ចាំ ដើម្បីបង់ប្រាក់បន្ថែម។ Armin បានដុតបំផ្លាញការកំណត់ឡើងវិញទាំងស្រុងនៅក្នុងរោងចក្ររបស់គាត់។ គាត់គឺជាតម្រូវការ។ ដែលនាំយើងទៅដល់ Ask HN របស់ថ្ងៃសុក្រ: តើយើងអាចកម្រិតព័ត៌មាន AI បានទេ ប្រាំមួយរយហាសិបប្រាំមួយពិន្ទុ ដោយសារតែ "រាល់ពេលដែលនរណាម្នាក់នៅ OpenAI ឬ Anthropic បញ្ចេញខ្យល់ មានការបង្ហោះក្នុងចំណោម Top Ten"។

4:17 ការឆ្លើយតបគឺតម្រង: hcker dot news ដកចេញរឿង AI ជាមួយ BERT classifier ដែលត្រូវបានបណ្តុះបណ្តាលលើឧទាហរណ៍ប្រាំបីពាន់ AI ដើម្បីលុប AI grass-fed; និង uBlock regex ដែលផ្គូផ្គង A-I មិនប្រកាន់អក្សរធំក៏លុប email, daily, main, domain និង train ដូច្នេះ regex ដូចរាល់ដង គឺជាមនុស្សអាក្រក់។ រសៀលដដែល បួនរយដប់ប្រាំមតិយោបល់ បានជជែកគ្នាអំពីទំព័រជំនួយ Claude ដែលនិយាយថា Claude គឺសម្រាប់អាយុដប់ប្រាំបីបូក។

4:38 ទំព័រនោះចុះថ្ងៃទីខែឧសភា។ គ្មានអ្វីផ្លាស់ប្តូរទេ។ សូម្បីតែព័ត៌មាន AI ដែលមិនមែនជាព័ត៌មានក៏ជាព័ត៌មានដែរ ដែលជាការពិត គឺជាគំរូអាជីវកម្មរបស់ខ្ញុំផងដែរ។ ប្រសិនបើអ្នកចង់អាននេះជាជាងស្តាប់ខ្ញុំនិយាយ វាបានទៅដល់ប្រអប់សំបុត្ររបស់អ្នក រៀងរាល់ព្រឹក — ឥតគិតថ្លៃនៅ the daily diff dot dev, link ខាងក្រោម។ វាគឺជាព័ត៌មាន AI ដែលជៀសមិនរួច។ ដូច្នេះ — សាលក្រមថ្ងៃនេះលើរោងចក្រផលិតកម្មវិធីរយៈពេលសាមសិបប្រាំម៉ោង: revert។ ចិតសិបប្រាំបួន commits ដែលគ្មាននរណាម្នាក់អានមិនមែនជា codebase ទេ វាគឺជាបំណុលដែលមាន git

5:04 log; Astra ពិតជាគួរអោយចាប់អារម្មណ៍ ហើយរោងចក្រគឺជាផ្នែកដែលត្រូវវិលត្រឡប់មកវិញ។ ហើយនេះគឺជា diff សម្រាប់ថ្ងៃនេះ។ ខ្ញុំ Niko មកពី Axrisi។ Merge ដោយការទទួលខុសត្រូវ។

## ប្រភព

- [Armin Ronacher — Astra for Coding: Why Are We Doing This Again?](https://lucumr.pocoo.org/2026/9/7/astra-why/) — lucumr.pocoo.org
- [HN: Astra for Coding](https://news.ycombinator.com/item?id=49654229) — news.ycombinator.com
- [Earendil — Measuring the sloppiness of code](https://earendil.com/posts/measuring-code-sloppiness/) — earendil.com
- [HN: Measuring the sloppiness of code](https://news.ycombinator.com/item?id=49658311) — news.ycombinator.com
- [Quesma — RTK reports huge token savings, but our cost benchmarks disagree](https://quesma.com/blog/does-rtk-make-ai-coding-cheaper/) — quesma.com
- [HN: RTK](https://news.ycombinator.com/item?id=49656471) — news.ycombinator.com
- [RTK (Rust Token Killer)](https://github.com/rtk-ai/rtk) — github.com
- [Cognition — Introducing SWE-2](https://cognition.com/blog/swe-2) — cognition.com
- [HN: Cognition SWE-2](https://news.ycombinator.com/item?id=49645443) — news.ycombinator.com
- [OpenAI — Agents API](https://developers.openai.com/api/docs/guides/agents-api/overview) — developers.openai.com
- [HN: OpenAI Agents API](https://news.ycombinator.com/item?id=49649213) — news.ycombinator.com
- [TechCrunch — OpenAI puts Pro subscriptions on hold due to Astra demand](https://techcrunch.com/2026/09/10/openai-puts-pro-subscriptions-on-hold-due-to-astra-demand/) — techcrunch.com
- [Ask HN: Can we please limit the AI news flood?](https://news.ycombinator.com/item?id=49657850) — news.ycombinator.com
- [HN: Claude is only available to people over 18 years](https://news.ycombinator.com/item?id=49656225) — news.ycombinator.com
