Anthropic เปิดตัว Claude Opus 4.8 เมื่อวันอังคารที่ผ่านมา ซึ่งทำคะแนน benchmark SWE-bench ได้ 78% สูงขึ้น 15% จากเวอร์ชันก่อน โดยยังคงราคา API เท่าเดิม ผู้ทดสอบช่วงแรกระบุว่าโมเดลจัดการงาน refactor หลายไฟล์ได้เสถียรขึ้น ทั้งนี้การพัฒนาเวอร์ชันนี้มาจากการปรับวิธีการ training ใหม่ที่เน้นงาน agentic coding โดยเฉพาะ ซึ่งช่วยเพิ่มประสิทธิภาพในการเขียนโค้ดและแก้ไขข้อผิดพลาดในโปรเจกต์ขนาดใหญ่ ขณะที่ Anthropic ยังไม่เปิดเผยรายละเอียดการปรับปรุงด้านภาษาธรรมชาติและตรรกะการคิดของโมเดล
AIAnthropicClaude OpusSWE-benchcodingbenchmark
สรุปด้วย MAF Local AI · เนื้อหาต้นฉบับเป็นของแหล่งข่าว