Anthropic เปิดตัว Claude Opus 5: ราคาครึ่งเดียวแต่ประสิทธิภาพเฉียดเรือธง แถมให้คุณปรับ "ระดับความพยายาม" เอง
โมเดลตัวที่สี่ในสองเดือนของ Anthropic มาแล้ว จุดขายของ Claude Opus 5 ไม่ใช่การไต่อันดับอีกครั้ง แต่คือโจทย์เลขคณิตที่เป็นจริงมาก ประสิทธิภาพเฉียดเรือธง ราคาครึ่งเดียว บวกกับปุ่มปรับ "ระดับความพยายาม" ที่ปรับเองได้
นักพัฒนาอิสระคนหนึ่งในไทเป ทุกสิ้นเดือนต้องทำเรื่องเดิม เปิดบิล API คำนวณว่าฟังก์ชันไหนควรลดจากโมเดลเรือธงมาโมเดลระดับกลางเพื่อประหยัด หลังจาก Anthropic เปิดตัว Claude Opus 5 เมื่อ 24 กรกฎาคม สมการของเขามีตัวแปรใหม่ โมเดลตัวนี้ทำ "ประสิทธิภาพกับต้นทุน" ให้เป็นปุ่มสามขั้นตรง ๆ ให้เขาไม่ต้องเลือกอย่างใดอย่างหนึ่งอีกต่อไป
ภูมิหลังของเหตุการณ์
จังหวะการออกไพ่รอบนี้ของ Anthropic เร็วผิดปกติ มิถุนายนออก Mythos 5, Fable 5, Sonnet 5 ติด ๆ กัน 24 กรกฎาคมยก Claude Opus 5 มาอีก ไม่ถึงสองเดือนสี่โมเดล การวางตำแหน่งของ Opus 5 ชัดเจน ใช้ราคาราวครึ่งหนึ่งของเรือธง Fable 5 ให้ความสามารถที่เฉียดเรือธง ราคา API คงเท่ารุ่นก่อน Opus 4.8 คือ input 5 ดอลลาร์ต่อล้าน tokens, output 25 ดอลลาร์ รหัสโมเดล claude-opus-5 วันเปิดตัวขึ้นให้ใช้เต็มรูปแบบทันทีบน Claude API, Claude.ai, Claude Code และ Claude Cowork ไม่มีการแบ่งโซนต่อคิว
ใบคะแนนที่ทางการประกาศ (ล้วนเป็นการประเมินของ Anthropic เอง) ใน Frontier-Bench v0.1 เหนือกว่าทุกโมเดล ถึงกว่าสองเท่าของ Opus 4.8 ARC-AGI 3 เป็นสามเท่าของโมเดลอันดับสอง OSWorld 2.0 เอาชนะคะแนนดีที่สุดของ Fable 5 ด้วยต้นทุนราวหนึ่งในสาม และ CursorBench 3.2 ด้านช่วยเขียนโค้ด ห่างจากจุดสูงสุดของ Fable 5 ไม่ถึง 0.5%
ประเด็นสำคัญครั้งนี้
- ราคา: 5 / 25 ดอลลาร์ต่อล้าน tokens เท่ากับ Opus 4.8 ราวครึ่งหนึ่งของ Fable 5
- ระดับ effort: สามขั้น low / medium / high ให้นักพัฒนาปรับสมดุลระหว่างความฉลาดกับต้นทุนเองบนโมเดลตัวเดียวกัน
- Fast mode: ความเร็ว output 2.5 เท่า ราคาเป็น 2 เท่าของอัตราพื้นฐาน
- ด้านความปลอดภัย: ทางการเรียกว่าเป็น "โมเดล Opus ที่จัดแนว (aligned) ที่สุด" คาดว่าความถี่ที่ตัวจำแนกความปลอดภัยทำงานจะต่ำกว่า Fable 5 ถึง 85% และเปิดตัว automatic fallbacks แบบ beta เมื่อกลไกความปลอดภัยทำงานจะเปลี่ยนให้โมเดลระดับต่ำกว่ารับช่วงอัตโนมัติ แทนที่จะแจ้ง error ตรง ๆ
- ขอบเขต: ความสามารถงานความมั่นคงไซเบอร์ยังต่ำกว่าเรือธง Mythos 5 ทางการระบุชัด
วิเคราะห์ผลกระทบต่อตลาด
ต่อผู้ใช้ในไต้หวัน การเปลี่ยนแปลงโดยตรงสำหรับผู้ใช้สมัครสมาชิกทั่วไปคือ บน Claude.ai มีโมเดลหลักประจำวันที่แรงขึ้นเพิ่มมาอีกตัว สำหรับผู้ใช้ขั้นสูง ระดับ effort หมายถึง "หนึ่งการสมัครสมาชิกมีสามบุคลิก" ค้นข้อมูลใช้ low เขียนงานใช้ medium โจทย์ยากเปิด high ประสบการณ์ใกล้เคียง "โมเดลตัวเดียวเล่นทั้งสนาม" มากขึ้น
ต่อการใช้งานในองค์กร ผู้รับที่เป็นจริงที่สุดของการเปิดตัวครั้งนี้คือ SME ที่ไวต่อต้นทุน แต่ก่อนตรรกะสองทาง "อยากได้คุณภาพก็ขึ้นเรือธง อยากประหยัดก็ลดระดับ" ถูกระดับ effort เปลี่ยนเป็นสเปกตรัมต่อเนื่อง งานอย่างบริการลูกค้าและการประมวลผลเอกสารที่ปริมาณมากแต่ตื้นลึกต่างกัน ปรับระดับแบบไดนามิกได้ในไปป์ไลน์ API เดียว automatic fallbacks ก็ใช้ได้จริงกับฉากบริการลูกค้า เมื่อกลไกความปลอดภัยทำงานบริการไม่สะดุด แค่ลดระดับการตอบ เป็นมิตรกว่าการแจ้ง error ต่อผู้ใช้ตรง ๆ มาก
ต่อนักพัฒนา มีสามเรื่องควรลงมือ หนึ่ง เอางานที่ใช้ Opus 4.8 อยู่เปลี่ยนไปรัน claude-opus-5 ทดสอบถดถอยหนึ่งรอบ อัปเกรดราคาเท่าเดิมไม่มีเหตุผลที่จะไม่กิน สอง ใส่ระดับ effort เข้าในการออกแบบสถาปัตยกรรม เราติงตามความยากของงาน ประหยัดกว่าดูแลตรรกะเราติงหลายโมเดลเอง สาม สังเกตธรรมชาติของการประเมินตัวเองของทางการ ตัวเลขคูณเหล่านั้นล้วนมาจาก benchmark ของ Anthropic เอง ก่อนขึ้นใช้จริงยืนยันด้วยชุดประเมินของตัวเองเสมอ คือพื้นฐาน
แนวโน้มการพัฒนาในอนาคต
สองเดือนสี่โมเดล สัญญาณชัดเจน การแข่งขันของแล็บระดับท็อปเปลี่ยนจาก "ปีละครั้งท่าไม้ตาย" เป็น "ส่งมอบต่อเนื่อง" โมเดลกลายเป็นผลิตภัณฑ์ที่วนซ้ำบ่อยเหมือนซอฟต์แวร์ การออกแบบ "ให้ผู้ใช้ปรับประสิทธิภาพเอง" อย่างระดับ effort คาดว่าจะถูกคู่แข่งตามทำ เพราะมันแก้ทั้งความซับซ้อนของสายผลิตภัณฑ์ฝั่งผู้ผลิตและความกังวลเรื่องต้นทุนฝั่งลูกค้าพร้อมกัน ต่อระบบนิเวศการประยุกต์ AI ของไต้หวัน ความคุ้มค่าของชั้นโมเดลที่ดีขึ้นต่อเนื่องหมายถึงจุดโฟกัสการแข่งขันเร่งย้ายไปที่ชั้นแอป โมเดลจะเลือกที่ถูกและใช้ดี คูเมืองต้องขุดเอง
บทสรุปและความเห็นจาก TheAI Academy
ความเห็น Opus 5 ไม่ใช่โมเดลที่แรงที่สุด แต่อาจเป็นโมเดลที่ "ทุกบาทซื้อความฉลาดได้มากที่สุด" ในไตรมาสนี้ ระดับ effort เปลี่ยนการควบคุมต้นทุนจากปัญหาสถาปัตยกรรมเป็นพารามิเตอร์ตัวเดียว นี่คือนวัตกรรมที่นักพัฒนารู้สึกได้ที่สุด
คำแนะนำที่เป็นรูปธรรมสำหรับผู้อ่าน ผู้ใช้สมัครสมาชิกจ่ายเงินสลับงานประจำวันไปใช้ Opus 5 สักสัปดาห์ สัมผัสด้วยตัวเองว่าช่องว่างกับเรือธงคุ้มกับส่วนต่างราคาไหม นักพัฒนา API สัปดาห์นี้จัดคิวทดสอบถดถอยอัปเกรดราคาเท่าเดิมหนึ่งรอบ อยากปรับพรอมป์ให้เหมาะไปด้วย คลังเทมเพลตพรอมป์บนเว็บไซต์ใช้ควบคู่ได้
แหล่งข้อมูล
ข้างต้นรวบรวมตามข้อมูลสาธารณะ ยึดตามทางการเป็นสำคัญ
คำถามที่พบบ่อย
Claude Opus 5 กับ Fable 5 เลือกอย่างไร
การวางตำแหน่งทางการคือ Opus 5 ใช้ราคาราวครึ่งหนึ่งเฉียดประสิทธิภาพของFable 5 งานประจำวันและงานพัฒนาส่วนใหญ่ใช้ Opus 5 ก่อนได้ งานสำคัญที่ไวต่อคุณภาพอย่างยิ่งค่อยขึ้นเรือธง วิธีที่เชื่อถือได้ที่สุดคือเอางานจริงของตัวเองมารันทั้งสองฝั่งเปรียบเทียบ
ระดับ effort คืออะไร ส่งผลต่อค่าใช้จ่ายไหม
การตั้งค่าสามขั้น low / medium / high ควบคุมความลึกที่โมเดลทุ่มการให้เหตุผล ระดับยิ่งสูง token ที่ output ยิ่งมาก การตอบยิ่งลึก ค่าใช้จ่ายก็เพิ่มตามปริมาณ token ราคาต่อหน่วยไม่เปลี่ยน สิ่งที่เปลี่ยนคือปริมาณการใช้
ตอนนี้ใช้ในไต้หวันได้แล้วไหม
ได้ วันเปิดตัวขึ้นให้ใช้ทันทีบน Claude API (รหัสโมเดล claude-opus-5), Claude.ai, Claude Code และ Claude Cowork เปิดทั่วโลก ไม่มีการจำกัดตามโซน
คะแนนประเมินที่ทางการประกาศเชื่อถือได้ไหม
ที่บทความอ้างล้วนเป็นผลการประเมินของ Anthropic เอง ทิศทางพอใช้อ้างอิงได้ แต่การประเมินตัวเองของผู้ผลิตย่อมเอื้อต่อผลิตภัณฑ์ตัวเองโดยธรรมชาติ นักพัฒนาก่อนขึ้นใช้จริงควรยืนยันด้วยข้อมูลงานของตัวเอง คะแนนเฉพาะที่แพร่ในสื่อหากไม่ปรากฏในประกาศทางการ บทความนี้ไม่นำมาใช้ทั้งหมด