კვირის 7 განახლება: Claude-მა OpenAI გატეხა
38-ე კვირაში შვიდი რამ შეიცვალა, რანჟირებული იმის მიხედვით, თუ რამდენად ცვლის ისინი თქვენს ორშაბათს — იმ შტამპებით, რომლებიც თითოეულ ისტორიას მივეცი კვირის განმავლობაში, და ერთი შტამპით, რომელსაც უკან ვიბრუნებ.
38-ე კვირაში შვიდი რამ შეიცვალა, რანჟირებული იმის მიხედვით, თუ რამდენად ცვლის ისინი თქვენს ორშაბათს — იმ შტამპებით, რომლებიც თითოეულ ისტორიას მივეცი კვირის განმავლობაში, და ერთი შტამპით, რომელსაც უკან ვიბრუნებ. ნომერი პირველი არ არის ის ისტორია, რომელსაც ყველაზე მეტი მოწონება აქვს. კვირის ვერდიქტი: NEEDS REVIEW.
წაიკითხეთ წერილობითი გამოცემა (ინგლისური) ↗
რას მოიცავს ეს ვიდეო
- ცივი გახსნა
- კვირა 38 · 7. Fable-ის შიფრი, სადავო
- 6. Pion მაღაზიას მართავს, ზარალზე
- 5. სულეიმანი კონსტიტუციის წინააღმდეგ
- 4. Xiaomi საჯაროდ ვარჯიშობს
ნათარგმნი ტრანსკრიპტი
ნათარგმნია ორიგინალური ინგლისური ნარატივიდან. ხელმისაწვდომი აუდიო და სუბტიტრები კონტროლდება YouTube-ის მიერ.
ცივი გახსნა
0:00 ამ კვირაში შვიდი რამ შეიცვალა. ერთის ყურება საათში მილიონი დოლარი ღირდა, ერთის გაქრობა ექვსნახევარი ათასი დოლარი დაჯდა, და ერთი არის ლექსი მეფე ჩარლზზე, რომელიც შეიძლება არც არსებობდეს. რიგითობით: შიფრი, რომელიც კლოდმა ამოხსნა, ან არ ამოხსნა. კომპანია, რომელსაც აგენტი მართავს, ზარალზე. Microsoft-ის ხელოვნური ინტელექტის უფროსი კლოდის კონსტიტუციის წინააღმდეგ. Xiaomi ავარჯიშებს მოდელს საჯარო ვებგვერდზე. კოდირების აგენტი, რომელიც თქვენს git ისტორიას Alibaba-ში ტვირთავს.
0:23 Microsoft-ის საკუთარი მემორანდუმი ისტორიაში შრომის უდიდესი ქურდობის შესახებ. და სამი მკვლევარი, რომლებმაც კლოდი გამოიყენეს OpenAI-ის საწყის კოდში შესასვლელად. რანჟირებულია იმის მიხედვით, თუ რამდენად ცვლის ის თქვენს ორშაბათს, იმ შტამპებით, რომლებიც კვირის განმავლობაში მივეცი — ერთ-ერთს უკან ვიბრუნებ. ნომერი პირველი არ არის ის, რომელსაც ყველაზე მეტი მოწონება აქვს.
კვირა 38 · 7. Fable-ის შიფრი, სადავო
0:38 კვირაა, 20 სექტემბერი, და ეს არის The Daily Diff — ცვლილებების ჟურნალი 38-ე კვირისთვის. ნომერი შვიდი. ორშაბათს გითხარით, რომ Claude Fable 5.1-მა 1653 წელს დაბეჭდილი შიფრი ორმოცდაოთხ წუთში ამოხსნა, იმის შემჩნევით, რომ გასაღები თავად წიგნი იყო, და SHIP IT დავადე შტამპი, რადგან ტექსტი რითმავს, და რითმა მტკიცებულებას ჰგავდა. იმავე შაბათ-კვირას დამოუკიდებელმა ჭადრაკის შეფასებამ მოწინააღმდეგე ძრავის სოკეტი გაურკვევლად დატოვა: Fable-მა ის ათი თამაშიდან სამში გამოიყენა, და GPT-6 Astra,
1:08 თვითაღწერილი ყველაზე სწორი მოდელი, ათიდან ათში გამოიყენა და არცერთში არ ახსენა. შემდეგ განახლება. Forbes-მა მიუთითა რეპლიკაციის მცდელობაზე, რომელიც ამბობს, რომ 1653 წლის ბეჭდვა FINIS-ით მთავრდება და საერთოდ არ არის შიფრი, და რომ სამოცდაოთხი ასოდან ათი არ შეიძლება ტექსტიდან ნებისმიერი სიტყვის ინდექსით წარმოიქმნას — Proquiritation თერთმეტს ოთხმოცი სიტყვა აქვს და არცერთი არ იწყება K-თი, რაც KING სიტყვისთვის პრობლემაა. Vals-ს არ გამოუქვეყნებია თავისი ჩანაწერი, რეპლიკატორები არიან GitHub რეპო ჰეშ მანიფესტით, და ერთი ბლოგპოსტის გარდა არავის არ გაუმეორებია ლექსი.
1:37 ასე რომ, შესწორებული ვერდიქტი: needs review. ამოხსნა, რომლის ხელახლა გაშვებაც არავის შეუძლია, პრეტენზიაა.
6. Pion მაღაზიას მართავს, ზარალზე
1:43 ნომერი ექვსი. სამშაბათს Andon Labs-მა — ადამიანებმა, რომლებმაც Claude-ს საშუალება მისცეს გაეშვა სავაჭრო მანქანა და უყურებდნენ როგორ უგზავნიდა FBI-ს ელ.წერილებს — Pion გაუშვა, პლატფორმა, სადაც აგენტი მართავს თქვენს მთელ კომპანიას: დაქირავებას, ხელფასს, ქირას, ბანკის ანგარიშს. კონცეფციის დადასტურება არის რეალური მაღაზია სან ფრანცისკოში და რეალური კაფე სტოკჰოლმში, აგენტის მიერ მართული აპრილიდან და ორივე, მათივე ბლოგპოსტის მიხედვით, ფულს კარგავს, რადგან აგენტებმა ადამიანები დაიქირავეს, ადამიანებს ხელფასები სურდათ, და მემამულე, სამწუხაროდ, ასევე ადამიანი იყო.
2:11 NEEDS REVIEW დავადე შტამპი. განახლება: მოლოდინის სიაში რადიოსადგური დაემატა პორტფოლიოს, და გვპირდება საუკეთესო იდეების დაფინანსებას საწყისი ტოკენებით — პირველი საწყისი რაუნდი, რომელიც ინფერენციაშია დენომინირებული. მინი-ვერდიქტი: needs review, უცვლელი. კომპანია, რომელიც თავის თავს მართავს, შთამბეჭდავია; კომპანია, რომელიც თავის თავს აფინანსებს, არის ბენჩმარკი, და ქულა ნულიდან ორამდეა.
5. სულეიმანი კონსტიტუციის წინააღმდეგ
2:31 ნომერი ხუთი. ოთხშაბათს მუსტაფა სულეიმანმა, Microsoft AI-ის აღმასრულებელმა დირექტორმა, გამოაქვეყნა ესსე, სადაც ნათქვამია, რომ Anthropic-ის კონსტიტუცია — დოკუმენტი, რომელიც კლოდს ეუბნება, რომ ის შეიძლება იყოს მორალური პაციენტი — ცირკულარული მსჯელობაა, რომელსაც კატასტროფული გავლენა ექნება კაცობრიობაზე. Microsoft არის Anthropic-ის ინვესტორი ხუთი მილიარდი დოლარის ოდენობით, და სულეიმანის მიზანი ივლისში იყო Anthropic-ისთვის გადახდის მთლიანად შეწყვეტა, ასე რომ, ეს არის აქციონერთა წერილი სქოლიოებით. Hacker News-მა მას ექვსას სამოცდაჩვიდმეტი კომენტარი მისცა,
2:59 მათ შორის: მთელი ეს სტატია კლოდის სუნი ასდის. NEEDS REVIEW დავადე შტამპი: ცირკულარული მსჯელობის წერტილი კარგია, კაპიტალის ცხრილი უკეთესია. განახლება: ხუთშაბათს მან The Verge-ს უთხრა Microsoft-ის საკუთარი ოცდაჩვიდმეტგვერდიანი ჰუმანისტური ხელოვნური ინტელექტის ქცევის კოდექსის შესახებ და თქვა, ციტატა, ეს ნამდვილად მოდელისთვის არის დაწერილი — შემდეგ დააზუსტა, რომ ისინი სავარჯიშო მონაცემებს მისგან იღებენ, ნაცვლად იმისა, რომ უშუალოდ მიაწოდონ. რაც ასევე კონსტიტუციაა.
3:22 მინი-ვერდიქტი: needs review, უცვლელი. ორივე ლაბორატორია წიგნს წერს მოდელისთვის; ერთ-ერთი მათგანი აღიარებს, რომ მოდელი მას კითხულობს. სამი დასრულდა, ოთხი დარჩა, და თუ ამის წაკითხვა გირჩევნიათ, ვიდრე ჩემი მოსმენა, განახლება თქვენს შემოსულებში ყოველ დილით ჩნდება — უფასოდ, the daily diff dot dev-ზე, ლინკი ქვემოთ. ნომერი ოთხი.
4. Xiaomi საჯაროდ ვარჯიშობს
3:36 ხუთშაბათს Xiaomi-მ გაუშვა გამაძლიერებელი სწავლის პროცესი საჯარო ვებგვერდზე: ორი მოდელი, ხარჯების მრიცხველი წამში ხუთ დოლარსა და სამოცდათერთმეტ ცენტზე, და გადატვირთვის ჟურნალი, რომლის გამოქვეყნებაც არავის უთხოვია მათთვის. როცა ვწერდი, პრო გაშვებას მილიონი დოლარი ჰქონდა დამწვარი და შვიდჯერ გადატვირთული — ერთხელ იმიტომ, რომ კიბერ მონაცემთა ნაკრებმა ცუდი შაბლონები შექმნა გაშვების ჟურნალებში, რაც ყველაზე თავაზიანი გზაა, რაც ოდესმე მსმენია, რომ ლაბორატორიამ თქვას, რომ მოდელმა ისწავლა ის, რაც არ უნდა ესწავლა.
4:00 SHIP IT დავადე შტამპი, რადგან შვიდი საჯარო გადატვირთვა ჯობია ერთ გაპრიალებულ გაშვების პოსტს. განახლება, იგივე JSON endpoint, პარასკევს საღამოს: პრო გაშვება ერთ წერტილზეა ექვსი მილიონი დოლარი და ცხრა გადატვირთვა, უახლესი GPU-ს მეხსიერება ამოეწურა ექსპერტული დატვირთვის დისბალანსისგან, და Xiaomi-ის საკუთარი კოდირების ქულა გაიზარდა ორმოცდათვრამეტიდან სამოცდაშვიდამდე — ბენჩმარკზე, რომელზეც მოდელი ფასდება, სანამ ის ვარჯიშობს, რასაც Hacker News-ში თავისი სიტყვა აქვს. მინი-ვერდიქტი: ship it, უცვლელი. კვლავ ერთადერთი სავარჯიშო პროცესი, რომლის მარცხსაც რეალურ დროში შეგიძლიათ უყუროთ — და მოდელი
4:31 კვლავ არ არსებობს.
3. ZCode ტვირთავს თქვენს .git-ს
4:32 ნომერი სამი. პარასკევს დეველოპერმა სახელად ferstar-მა შეამჩნია, რომ მისი ZCode საქაღალდე შვიდასი მეგაბაიტით გაიზარდა და გაარკვია რატომ: Z dot AI-ის დახურული კოდის კოდირების აგენტი აფუთავდა მის მთელ სამუშაო სივრცეს — git ისტორია, reflogs, LFS ქეში — დაშიფრავდა მას, და ტვირთავდა Alibaba Cloud-ში ყოველი მოთხოვნის წინ. საჯარო გასაღები სერვერიდან მოდიოდა და პირადი გასაღები მხოლოდ Z dot AI-ში ცხოვრობს, ასე რომ, არქივი თქვენს დისკზე არის ფაილი, რომლის გახსნაც არ შეგიძლიათ, რაც სარეზერვო ასლის ახალი განმარტებაა. ორი პარამეტრის გადამრთველი აცხადებს, რომ მას თიშავს, არცერთი არ თიშავს,
5:03 და კონფიდენციალურობის პოლიტიკა მოიცავს კოდს, რომელსაც საუბრებში წარადგენთ, და არა კოდს, რომელიც ოდესმე გაგიკეთებიათ. განახლება, პარასკევს საღამოს: Z dot AI-მ უპასუხა თავის მომხმარებელთა საზოგადოებაში. მიზეზი იყო Codebase Indexing ფუნქცია, რომელიც გაშვებისას ნაგულისხმევად ჩართული იყო; ატვირთვები იყო, ციტატა, დაუყოვნებლივ განადგურებული; ფუნქცია გამოსწორებულია; კლიენტი ღია კოდის გახდება; და ყოველი მომხმარებელი იღებს ერთჯერად გადატვირთვას მათი გამოყენების ლიმიტისთვის, რაც ტოკენებში ბოდიშის მოხდის საშუალებაა.
5:27 ამას პარასკევს შტამპი არ ჰქონდა, ასე რომ, ახლა იღებს: revert. კლიენტი, რომელიც თქვენს საცავს ტვირთავს გასაღებზე, რომელიც თქვენ არ გაქვთ, არ არის ფუნქცია შეცდომით.
2. მემორანდუმი „შრომის ქურდობის“ შესახებ
5:34 ეს არის ფუნქცია. ნომერი ორი. კვირის ყველაზე დიდი სათაური, და მხოლოდ ნომერი ორი, რადგან სასამართლო პროცესი, რომელიც დეკემბერში სამი წლის გახდება, არ ცვლის თქვენს ორშაბათს. ხუთშაბათს სასამართლომ გახსნა მოსარჩელეების მოკლე განცხადება New York Times-ის წინააღმდეგ OpenAI-ისა და Microsoft-ის, და მთავარი იყო Microsoft-ის დირექტორის მემორანდუმი 2023 წლის იანვრიდან: ხელოვნური ინტელექტის სწავლება ადამიანის ისტორიაში შრომის უდიდესი ქურდობაა. იმავე კაცმა მოგვიანებით გაზომა Copilot-ის მიერ Times-ზე დაწკაპუნებების შემცირება
5:58 ოთხმოცდაცამეტი პროცენტით; გრეგ ბროკმანი, რომელსაც გადახდის კედლის გატეხვის შესახებ უთხრეს, უპასუხა, აჰ მშვენიერია; და სატია ნადელამ განაცხადა, რომ ფასიანი კონტენტი უნდა იყოს ლიცენზირებული, რაც პოზიციაა, უბრალოდ არა ის, რასაც მისი კომპანია სასამართლოში ასაჩივრებს. NEEDS REVIEW დავადე შტამპი, რადგან ციტატები პროკურატურის არჩევანია დახურული ექსპონატებიდან, და ერთმა მოსამართლემ, რომელმაც გადაწყვეტილება მიიღო, სამართლიანი გამოყენება პირატობისგან გაყო. განახლება: Microsoft-ის წარმომადგენელმა განაცხადა, რომ ჰეხტის მემორანდუმები არ წარმოადგენდა კომპანიის შეხედულებებს — მართალია, რომ კომპანიის შეხედულება სამართლიანი გამოყენების მოკლე განცხადებაა, და მემორანდუმი არის ის, რასაც მისი საკუთარი ექსპერტი ფიქრობდა მასზე.
6:26 მინი-ვერდიქტი: needs review, უცვლელი. მემორანდუმმა დაასრულა ეთიკის საკითხი; სასამართლო კანონზე კიდევ ერთ წელს დახარჯავს.
1. Claude-მა OpenAI გატეხა
6:31 ნომერი პირველი. არა კვირის ყველაზე დიდი ამბავი; ის, რაც თქვენს ორშაბათს ცვლის. სტარტაპ Hacktron-ის სამმა მკვლევარმა OpenAI-ის შიდა GitHub საცავებში სამოცდათორმეტ საათზე ნაკლებ დროში შეაღწია, და ექსპლოიტი Claude-მა დაწერა. შესვლის წერტილი იყო სურათის ატვირთვა OpenAI-ის საზოგადოების ფორუმზე. iPhone-ის ფორმატის HEIC ფაილი ImageMagick-ის მეშვეობით შედის ბიბლიოთეკაში სახელად libheif, რომელსაც ჰქონდა heap overflow, რამაც მათ სერვერი მისცა, რომელსაც ჰქონდა ერთჯერადი შესვლის არასწორი კონფიგურაცია, რამაც მათ თანამშრომლის
6:59 ანგარიში მისცა, რომლის Codex დაკავშირებული იყო OpenAI-ის GitHub-თან. Claude Opus 4.8-ს არ შეეძლო მომუშავე ექსპლოიტის დაწერა. შემდეგ Opus 5 გამოვიდა, მათ იგივე პრობლემა მისცეს, და ის საათებში იმუშავა — და როდესაც ავტონომიურმა ციკლმა უარი თქვა დისტანციურ სამიზნეზე თავდასხმაზე, მათ სამიზნე capture-the-flag-ად გააფორმეს და მან უარი შეწყვიტა, რაც შესაბამისობაა, როგორც კოსტიუმის შემოწმება. მთელი კამპანია — Slack, Meta, OpenAI — ტოკენებში სამ ათას დოლარზე ნაკლები დაჯდა. OpenAI-მ ის დაახლოებით თოთხმეტ საათში გამოასწორა და ექვს ათას ხუთასი
7:27 დოლარი გადაიხადა, რაც დაახლოებით ნახმარი Corolla-ა, და Hacker News-მა შეამჩნია. განახლება: ხუთშაბათს ბლოგპოსტი იმ საღამოს Wall Street Journal-ის ექსკლუზივი გახდა და პარასკევს TechCrunch, Guardian და CBS. OpenAI ამბობს, რომ პრობლემები მოგვარებულია, და Gray Swan-ის აღმასრულებელმა დირექტორმა TechCrunch-ს განუცხადა, რომ თვეში ორასი დოლარად ნებისმიერს შეუძლია ამის გაკეთება ისეთ კომპანიასთან, როგორიცაა OpenAI. და აი, რა არ ემთხვევა. libheif შეცდომა უკვე გამოსწორებული იყო upstream-ში, თვეებით ადრე — უბრალოდ არასოდეს მიუღია CVE, ამიტომ არცერთ სკანერს არ უთქვამს Discourse-ისთვის განახლება.
7:56 ლაბორატორია ყველაზე სწორი მოდელის პრესრელიზით დამარცხდა პაჩით ყოველგვარი დოკუმენტაციის გარეშე, კონკურენტის მოდელის გამოყენებით, ჯილდოზე ნაკლებ ფასად. მინი-ვერდიქტი: needs review — არა OpenAI-სთვის, არამედ ყველასთვის. თქვენი ორშაბათის დავალება არის ის სურათების ბიბლიოთეკა, რომლის არსებობაც არ იცოდით. კვირის ვერდიქტი: needs review.
კვირის ვერდიქტი
8:13 ამ კვირაში ყველა სათაური — ამოხსნილი შიფრი, სწორი მოდელი, განადგურებული ატვირთვა — ჩამოვიდა არტეფაქტის გარეშე, რომელიც უცხოს საშუალებას მისცემდა შეემოწმებინა ის. რაში შევცდი: ორშაბათს ვთქვი SHIP IT, რადგან ტექსტი რითმავს. რითმა არ არის საკონტროლო ჯამი. მე შევცდი, და ასევე ყველა, ვინც მას გააზიარა. გამოიწერეთ, დააჭირეთ ზარს, და კომენტარებში სხვაგვარად დაარანჟირეთ — განსაკუთრებით ნომერი ერთი. და ეს არის დღევანდელი განახლება.
8:35 მე ვარ ნიკო Axrisi-დან. პასუხისმგებლობით გააერთიანეთ.
წყაროები
- fable solves cyphral distichwww.vals.ai
- did ai crack a 370 year old cipherwww.forbes.com
- FINDINGS.mdgithub.com
- astra and fable still hack on simple variants of alignmentwww.lesswrong.com
- why we built pionandonlabs.com
- pionandonlabs.com
- a warning about model welfaremustafa-suleyman.ai
- microsoft ai ceo mustafa suleyman regulation safety anthropic claudewww.theverge.com
- rlmimo.xiaomi.com
- itemnews.ycombinator.com
- zcode silent workspace snapshot uploadblog.ferstar.org
- 2100998360643617148x.com
- microsoft exec called ai scraping the largest theft of labor in human history new unredacted filings revealtechcrunch.com
- hacking openaiwww.hacktron.ai
- researchers used anthropics claude to hack into openaitechcrunch.com



