เจาะลึกผลทดสอบ AI Benchmark ล่าสุด! Claude Opus 5.5 ปะทะ GPT-6 Astra

TL;DR 

Anthropic เปิดตัว Claude Opus 5.5: มีประสิทธิภาพเทียบเท่ารุ่นท็อปอย่าง Fable 5.1 แต่ลดต้นทุนการทำงานลงถึง 40%
ชนะ GPT-6 Astra ในหลายหมวด: ทำคะแนนได้โดดเด่นในงานเขียนโค้ด (Agentic Coding) งานวิเคราะห์ข้อมูล/การเงิน และด้านความปลอดภัย
ราคาถูกลงอย่างชัดเจน: ค่าบริการทั้ง Input/Output tokens และ Cache ลดลง 20% - 60% เมื่อเทียบกับ Opus 5
ข้อจำกัด: GPT-6 Astra ยังคงทำได้ดีกว่าในด้าน Business Workflows และการวิจัยทางวิทยาศาสตร์ เนื่องจากระบบความปลอดภัยของ Opus 5.5 มีการแทรกแซงในงานเสี่ยงสูง
ยังคงมีความผิดพลาด: แม้ว่าจะเป็นโมเดลระดับเรือธงของแต่ละค่ายที่ลงทุนมหาศาล ยังมีงานเกือบครึ่งที่ยังจบลงด้วย Error, Time out หรือไม่ผ่านเกณฑ์ความสำเร็จ

(more…)

FBI เรียกร้องสมาชิก ShinyHunters มอบตัว หลังตำรวจจับกุมผู้ต้องสงสัยรายล่าสุด

FBI ออกคำเตือนถึงสมาชิกกลุ่ม ShinyHunters ให้เข้ามอบตัว หลังตำรวจเนเธอร์แลนด์จับกุมชายรายหนึ่ง ซึ่ง FBI ระบุว่าเป็นหนึ่งในผู้นำที่ถูกกล่าวหาว่ามีส่วนเกี่ยวข้องกับกลุ่มดังกล่าว (more…)