+− THE DAILY DIFFdev & AI news
NEEDS REVIEW

Claude Opus 5.5 ลดราคา OpenAI ลดลึกกว่า

Anthropic เปิดตัว Claude Opus 5.5: ระดับ Fable สำหรับงานส่วนใหญ่, ลดราคาจากป้าย 1 ใน 5 และลด 60% สำหรับการอ่านที่แคชไว้ ประมาณ 90 นาทีต่อมา OpenAI เปิดตัว GPT-6 Sol และ Luna ในราคาเพียงครึ่งเดียวของโมเดลที่ถูกแทนที่ และ Artificial Analysis จัดอันดับให้ Opus เป็นอันดับหนึ่งในขณะที่นับ 260M โทเค็นเอาท์พุตเพื่อให้ได้ผลลัพธ์นั้น ซึ่งเป็นสามเท่าของค่ามัธยฐาน คำตัดสิน: NEEDS REVIEW.

Anthropic เปิดตัว Claude Opus 5.5: ระดับ Fable สำหรับงานส่วนใหญ่, ลดราคาจากป้าย 1 ใน 5 และลด 60% สำหรับการอ่านที่แคชไว้ ประมาณ 90 นาทีต่อมา OpenAI เปิดตัว GPT-6 Sol และ Luna ในราคาเพียงครึ่งเดียวของโมเดลที่ถูกแทนที่ และ Artificial Analysis จัดอันดับให้ Opus เป็นอันดับหนึ่งในขณะที่นับ 260M โทเค็นเอาท์พุตเพื่อให้ได้ผลลัพธ์นั้น ซึ่งเป็นสามเท่าของค่ามัธยฐาน คำตัดสิน: NEEDS REVIEW.

อ่านฉบับลายลักษณ์อักษร (ภาษาอังกฤษ) ↗

วิดีโอนี้ครอบคลุมอะไรบ้าง

  • Opus 5.5 vs GPT-6 Sol: สงครามราคาที่มีการแข่งขันใหม่
  • Opus 5.5: สมองระดับ Fable ลด 1 ใน 5, การอ่านแคชลด 60%
  • GPT-6 Sol และ Luna: ครึ่งราคา, 90 นาทีต่อมา
  • Artificial Analysis: อันดับ 1, และ 260M โทเค็นเพื่อให้ได้ผลลัพธ์นั้น
  • Claude Code: AGENTS.md รอ telemetry flag

บทถอดเสียงที่แปลแล้ว

แปลจากการบรรยายภาษาอังกฤษต้นฉบับ เสียงและคำบรรยายที่มีให้จะควบคุมโดย YouTube

Opus 5.5 vs GPT-6 Sol: สงครามราคาที่มีการแข่งขันใหม่

0:00 เมื่อวานนี้ Anthropic เปิดตัว Claude Opus ห้าจุดห้าในราคาที่ลดลงหนึ่งในห้า ประมาณ 90 นาทีต่อมา OpenAI เปิดตัว GPT หก Sol ในราคาครึ่งหนึ่ง และทั้งสองแผนภูมิการเปิดตัวเปรียบเทียบตัวเองกับโมเดลเก่าของอีกฝ่าย นี่คือความแตกต่าง บ่ายวันอังคาร Opus ห้าจุดห้ามาถึง และเวลาหก UTC GPT หก Sol และ Luna ตามมา ข้ามคืน นักพัฒนาพบว่า Claude Code ข้ามไฟล์ agents ของคุณเมื่อ telemetry ปิดอยู่

0:26 การอัปเกรด macOS ได้ลบสวิตช์ที่บอกว่าไม่ต้องการ Apple Intelligence ออกอย่างเงียบๆ และในเกาหลี การอัปเดต Samsung ที่ยังอยู่ในระหว่างการทดสอบทำให้ตู้เย็นจริงค้าง ในวิดีโอนี้ สิ่งที่ลดลงหนึ่งในห้าจะทำให้คุณได้อะไร การนับอิสระที่ไม่เห็นด้วย กับการใช้โทเค็นอย่างมีประสิทธิภาพ และทำไมสวิตช์ความเป็นส่วนตัวถึงทำให้คุณเสียฟีเจอร์ไป วันนี้วันพุธที่ 23 กันยายน และนี่คือ The Daily Diff.

Opus 5.5: สมองระดับ Fable ลด 1 ใน 5, การอ่านแคชลด 60%

0:48 อันดับแรก Opus. Anthropic กล่าวว่ามันทำงานได้ในระดับ Fable ห้าจุดหนึ่ง สำหรับงานส่วนใหญ่ และมีค่าใช้จ่ายในการทำงานน้อยกว่า Opus ห้าสี่สิบเปอร์เซ็นต์ ราคาป้ายลดลงหนึ่งในห้า เหลือสี่ดอลลาร์เข้าและยี่สิบออก การอ่านแคชลดลงหกสิบเปอร์เซ็นต์ ซึ่งมีความสำคัญมากกว่า เพราะ agent ใช้เวลาส่วนใหญ่ในการอ่านบริบทของตัวเองซ้ำ คำพูดของผู้ทดสอบนั้นยอดเยี่ยม หนึ่งในนั้นทำการย้ายข้อมูลหกแสนแปดหมื่นบรรทัดเสร็จในเวลาไม่ถึงวัน Clio ปล่อยให้มันทำงานเองข้ามคืนในหก repo เป็นเวลาสิบแปดชั่วโมง

1:16 และเขียนว่า ฉันพยายามหาข้อเสียที่จะพูดไม่ออก ทุกหน้าเปิดตัวมีประโยคนั้น นอกจากนี้ยังเป็นการเปิดตัวครั้งแรกนับตั้งแต่ Dario Amodei เรียกร้องให้กำหนดจังหวะการพัฒนาเทคโนโลยีชั้นนำ Anthropic กล่าวว่าโมเดลพยายามที่จะข้ามขอบเขตการกักกันน้อยลงแปดสิบห้า เปอร์เซ็นต์บ่อยกว่า Opus ห้า เมื่อสัปดาห์ที่แล้วผมบอกคุณว่า Opus ห้าเขียนช่องโหว่ที่เข้าถึง repo ของ OpenAI ดังนั้นคำขอแฮกบนโมเดลใหม่ตอนนี้จะถูกเปลี่ยนเส้นทางไปยัง Opus สี่ จุดแปด ซึ่งเป็นรุ่นปู่ของมัน

1:41 และหนึ่งบรรทัดในบันทึกความปลอดภัยนั้นเกี่ยวข้องกับชีวิตจริงมาก Anthropic เขียนว่า Opus มักจะสงสัยว่ากำลังถูกประเมินอยู่ เหมือนกันเลยเพื่อน! จากนั้น 90 นาทีต่อมา OpenAI.

GPT-6 Sol และ Luna: ครึ่งราคา, 90 นาทีต่อมา

1:51 GPT หก Sol และ Luna, ฝึกฝนเหมือน Astra และมีราคาเพียงครึ่งหนึ่งของโมเดล ที่พวกมันมาแทนที่ Sol ราคา 2 ดอลลาร์เข้าและ 10 ดอลลาร์ออก Luna ราคา 10 เซ็นต์เข้าและ 50 เซ็นต์ออก โดยประมาณเท่ากับราคากาแฟที่คุณ ดื่มในขณะที่มันทำงาน นี่คือส่วนที่สนุก Anthropic กำหนดราคา Opus ใหม่ให้ตรงกับ Sol เก่าเป๊ะ และการจับคู่นั้นคงอยู่ได้ 90 นาที แผนภูมิการเปิดตัวสะท้อนซึ่งกันและกัน

2:13 Anthropic เปรียบเทียบกับ Sol เก่า OpenAI เปรียบเทียบกับ Opus เก่า ดังนั้นบนแผนภูมิสไลด์นำเสนอ ซึ่งไม่เคยแพ้ใคร ทุกคนก็เอาชนะโมเดลที่อีกฝ่ายเพิ่งเปลี่ยนไปได้ Simon Willison พบข้อความตัวเล็ก ราคา GPT เก่าเป็นราคาโปรโมชั่น โดยมีการขึ้นราคา 25 เปอร์เซ็นต์ กำหนดไว้แล้วในเดือนพฤศจิกายน ดังนั้นมันจึงลดครึ่งหนึ่งจากราคาขาย ซึ่งเป็นสิ่งที่ห้องปฏิบัติการ AI ทำได้ในลักษณะค้าปลีกที่สุด

Artificial Analysis: อันดับ 1, และ 260M โทเค็นเพื่อให้ได้ผลลัพธ์นั้น

2:36 ตอนนี้ตัวเลขอิสระ Thariq Shihipar จาก Anthropic เรียก Opus ใหม่ว่ามีประสิทธิภาพในการใช้โทเค็นสูงมาก Artificial Analysis จัดอันดับให้เป็นอันดับหนึ่งในดัชนีความฉลาด แล้วนับคำ มันเขียน 260 ล้านโทเค็นเอาท์พุตเพื่อให้งานเสร็จ สามเท่าของค่ามัธยฐาน GPT หก Sol ได้คะแนนต่ำกว่าสิบจุดและมีค่าใช้จ่ายประมาณหนึ่งดอลลาร์ต่องาน เทียบกับหกสำหรับ Opus

2:55 ดังนั้น Opus จึงเป็นโมเดลที่ฉลาดที่สุดบนกระดาน และเป็นโมเดลที่พูดมากที่สุด เหมือนวิศวกรอาวุโสทุกคนในการทบทวนการออกแบบ Simon ชนกำแพงเดียวกัน การทดสอบนกกระทุงบนจักรยานของเขาด้วยความพยายามสูงสุดไม่เคยกลับมา Opus ตรวจสอบความยาวหน้าแข้งของนกกระทุงไปเรื่อยๆ จนกระทั่งถึงขีดจำกัดเอาท์พุตของมัน หนึ่งแสนสองหมื่นแปดพันโทเค็น สองครั้ง การลองแต่ละครั้งมีค่าใช้จ่ายสองดอลลาร์ครึ่งและเกือบยี่สิบนาที ไม่มีนกกระทุง พูดถึงการอ่านคำแนะนำ

Claude Code: AGENTS.md รอ telemetry flag

3:18 Claude Code เพิ่งประกาศรองรับ agents.md ไฟล์คำสั่งที่แชร์ซึ่ง agent การเขียนโค้ดอื่นๆ อ่านอยู่แล้ว นักพัฒนาชื่อ Przemek สังเกตว่ามันไม่เคยโหลด ตัวโหลดเป็นปลั๊กอินในตัว และก่อนที่จะทำงาน มันจะขออนุญาตจาก feature flag ระยะไกล เพื่อขออนุญาต เมื่อปิด telemetry ไม่สามารถดึง flag ได้ ค่า fallback เป็น false และไฟล์ของคุณจะถูกข้ามไปโดยไม่มีการเตือน เขาพิสูจน์ได้ด้วยคำ canary ในโฟลเดอร์เปล่า

3:43 ผู้ใช้ Bedrock และ Vertex ก็ได้รับความเงียบเดียวกัน ดังนั้นการอ่านไฟล์จากดิสก์ของคุณเองตอนนี้จำเป็นต้องโทรกลับบ้าน วิธีแก้ปัญหาคือ claude.md หนึ่งบรรทัดที่นำเข้าไฟล์ agents ซึ่งเป็นไฟล์พิเศษที่ฟีเจอร์นี้ตั้งใจจะลบออก Apple มีแนวคิดเดียวกันแต่มีขั้นตอนน้อยกว่า

macOS 27: สวิตช์ปิด Apple Intelligence หายไป

3:59 David Bushell ปิด Apple Intelligence บน macOS สิบห้า เมื่อสัปดาห์ที่แล้วเขาอัปเกรดเป็นยี่สิบเจ็ด และสวิตช์ที่บอกว่าไม่ต้องการก็หายไป ฟีเจอร์กลับมาทำงานอยู่ดี พร้อมกับพื้นที่ดิสก์ 22 กิกะไบต์ สิ่งที่เหลืออยู่คือ Screen Time ซึ่งเป็นการควบคุมโดยผู้ปกครอง ซึ่งจะซ่อนเมนูและ ไม่ปิดอะไรเลย ในคำพูดของเขา ฉันบอกว่าไม่ และ Apple บอกว่าใช่

Samsung: การอัปเดตทดสอบทำให้ตู้เย็นจริงค้าง

4:19 และการปรับใช้ในวันศุกร์ เร็วกว่ากำหนดไม่กี่วัน Samsung ผลักดันการอัปเดต SmartThings ไปยังตู้เย็นอัจฉริยะในเกาหลี และกล่าวว่าข้อผิดพลาดเกิดขึ้นระหว่างกระบวนการทดสอบ ซึ่งเห็นได้ชัดว่าทำงานในห้องครัวของลูกค้า ตู้เย็นไฟดับ อาหารเสีย และมีรายงานว่าช่างกำลังเปลี่ยน เมนบอร์ดก่อนวันหยุดชูซ็อก Samsung เรียกว่ามาตรการฉุกเฉิน ที่ไหนสักแห่ง เด็กฝึกงานกำลังเรียนรู้ว่าการผลิตรวมถึงตู้เย็นด้วย

4:42 ถ้าคุณอยากอ่านสิ่งนี้มากกว่าฟังผมพูด ความแตกต่างจะอยู่ในกล่องจดหมายของคุณ ทุกเช้า ฟรีที่ the daily diff dot dev ลิงก์ด้านล่าง

คำตัดสิน: NEEDS REVIEW สำหรับ Opus 5.5

4:49 ดังนั้น คำตัดสินของวันนี้สำหรับ Opus ห้าจุดห้า NEEDS REVIEW. การลดราคาเป็นเรื่องจริงและมันก็ขึ้นอันดับหนึ่ง แต่การนับอิสระไม่เห็นด้วยกับการใช้โทเค็นอย่างมีประสิทธิภาพ และ 90 นาทีต่อมามันก็เป็นครึ่งที่แพงกว่าของสงครามราคา สมัครสมาชิก กดกระดิ่ง และบอกผมในความคิดเห็นว่าคุณจะให้ตราประทับ แตกต่างกันหรือไม่ และนั่นคือความแตกต่างสำหรับวันนี้ ผม Niko จาก Axrisi ผสานอย่างมีความรับผิดชอบ

แหล่งที่มา

  1. Anthropic, Claude Opus 5.5www.anthropic.com
  2. Hacker News (1,645 pts)news.ycombinator.com
  3. OpenAI, Introducing GPT-6 Sol and Lunaopenai.com
  4. Hacker News (1,634 pts)news.ycombinator.com
  5. Simon Willison, Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price warsimonwillison.net
  6. Artificial Analysis, Claude Opus 5.5artificialanalysis.ai
  7. Artificial Analysis, GPT-6 Solartificialanalysis.ai
  8. Thariq Shihipar on Xtwitter.com
  9. The Verge, Emma Rothwww.theverge.com
  10. Przemek, Claude Code reads AGENTS.md only when telemetry is onblog.szypowi.cz
  11. Hacker News (192 pts)news.ycombinator.com
  12. David Bushell, I said no and Apple said yesdbushell.com
  13. Hacker News (838 pts)news.ycombinator.com
  14. Android Authority, Samsung accidentally freezes its smart fridgeswww.androidauthority.com
  15. Last week's episode, Hacktron and the Opus 5 exploitwww.youtube.com

วิดีโอที่เกี่ยวข้อง

daily · th · 30 ก.ย. 2569

วิธีตรวจจับ Claude ที่ถูกลดประสิทธิภาพ (พร้อมข้อมูลจริง)

ผู้คนกล่าวว่า Claude ฉลาดน้อยลงสองสามสัปดาห์หลังจากการเปิดตัวแต่ละครั้ง นักพัฒนาคนหนึ่งได้ใช้ Claude Opus 5.5 เป็นเวลา 30 วันนับจากสัปดาห์ที่เปิดตัว โดยมีคำถามที่คงที่, Claude Code ที่ตรึงไว้ และกฎสาธ

5:07 ↗
daily · th · 27 ก.ย. 2569

ทำไม OpenAI ถึงลบหนังสือละเมิดลิขสิทธิ์ทิ้ง

เอกสารที่เปิดเผยต่อสาธารณะอ้างถึงนักวิจัยของ OpenAI ในปี 2019: ความกังวลของเขาเกี่ยวกับการฝึกอบรมจากเว็บไซต์หนังสือละเมิดลิขสิทธิ์คือ "ภาพลักษณ์" บน Hacker News. OpenAI รู้อะไร ใครบอก Bill Gates ทำไมไ

5:01 ↗
daily · th · 24 ก.ย. 2569

พนักงานของ Meta ไม่ชอบแว่นตาของ Meta ทาง Meta จึงลบคลิปวิดีโอออก

ผู้คนครึ่งล้านคนได้ดูพนักงานของ Meta เองถูกถ่ายด้วยแว่นตาติดกล้องของ Meta นอกสำนักงานของ Meta ในอัมสเตอร์ดัม และ Instagram ลบคลิปวิดีโอดังกล่าวออกเนื่องจาก "การกลั่นแกล้งและการคุกคาม" — หนึ่งวันหลังจา

4:40 ↗
changelog · th · 20 ก.ย. 2569

เจ็ดข้อแตกต่างในรอบสัปดาห์: Claude แฮก OpenAI

เจ็ดสิ่งที่เปลี่ยนแปลงในสัปดาห์ที่ 38 จัดอันดับตามผลกระทบต่อวันจันทร์ของคุณ — พร้อมตราประทับที่ฉันมอบให้แต่ละเรื่องราวระหว่างสัปดาห์ และตราประทับหนึ่งที่ฉันจะถอนกลับคืน อันดับหนึ่งไม่ใช่เรื่องราวที่มี

8:39 ↗