Claude Sonnet 5.5 มาแล้ว เร็วขึ้น 30% ต้นทุนลดสูงสุด 30% เขียนโค้ดเก่งขึ้น

THE SUMMARY:

Anthropic เปิดตัว Claude Sonnet 5.5 โมเดล AI รุ่นใหม่ที่เร็วขึ้น 30% ต้นทุนลดสูงสุด 30% เน้นงานประจำวันที่ต้องการความคล่องตัว แต่คงความสามารถระดับสูงในการเขียนโค้ด วิเคราะห์ข้อมูล และสร้างเอกสาร

Sonnet 5.5 ออกแบบมาให้เข้ามาเสริมการทำงานของ Claude Opus 5.5 ที่เน้นงานซับซ้อนและต้องใช้การตัดสินใจอย่างรอบคอบ ส่วน Sonnet 5.5 จะเหมาะกับงานที่มีขอบเขตชัดเจน เช่น การแก้บั๊ก การเขียนเอกสาร การทำสไลด์ และการสร้างสเปรดชีต รวมถึงงานด้านการออกแบบที่ต้องการความประณีต

ด้านประสิทธิภาพ Anthropic ระบุว่า Sonnet 5.5 ทำคะแนนใน Terminal-Bench 4.0 ได้ 70.6% เพิ่มขึ้นอย่างมากจาก Sonnet 5 ที่ทำได้ 10.3% และในการทดสอบ GDPval-AA ซึ่งจำลองงานจริงจาก 44 อาชีพใน 9 อุตสาหกรรม Sonnet 5.5 ก็ทำคะแนนได้ใกล้เคียงกับ Opus 5.5

หนึ่งในความสามารถที่น่าสนใจคือการทำงานแบบ Long-horizon หรืองานที่ต้องดำเนินการต่อเนื่องเป็นเวลานาน รวมถึงความสามารถด้านการมองเห็น โดย Sonnet 5.5 เป็นโมเดลตระกูล Sonnet รุ่นแรกที่สามารถเล่น Pokémon Red จนจบเกมจากภาพหน้าจอได้

เขียนโค้ดดีขึ้น ใช้ทรัพยากรน้อยลง

ด้านการเขียนโค้ดถือเป็นหนึ่งในจุดที่ Sonnet 5.5 พัฒนาขึ้นอย่างชัดเจน ในการทดสอบ FrontierCode ที่ระดับความพยายามสูงสุด โมเดลทำคะแนนได้สูงกว่า Sonnet 5 ถึง 10 คะแนน ขณะที่ใช้ต้นทุนต่อภารกิจเพียงประมาณหนึ่งในสิบห้า

ผู้ทดสอบยังพบว่า Sonnet 5.5 สามารถทำความเข้าใจ Codebase ได้รวดเร็ว และรวมการเรียกใช้เครื่องมือหลายขั้นตอนเข้าด้วยกันมากขึ้น ส่งผลให้กระบวนการทำงานสั้นลงและช่วยลดต้นทุน

นอกจากโค้ดแล้ว Sonnet 5.5 ยังถูกปรับปรุงสำหรับงาน Knowledge Work เช่น การวิเคราะห์ข้อมูล การทำรายงาน การสร้างสไลด์ และงานที่ต้องใช้ความรู้เฉพาะทาง โดย Anthropic ระบุว่าในการทดสอบภายใน โมเดลสามารถสร้างรายงานผลประกอบการ 10 สไลด์จากข้อมูลและเทมเพลตที่ให้มา ซึ่งผู้เชี่ยวชาญประเมินว่ามีคุณภาพเพียงพอสำหรับนำไปใช้งานได้ทันที

เร็วขึ้นกว่า 30% ราคาเท่าเดิม

จุดเด่นอีกอย่างคือ Sonnet 5.5 สร้างผลลัพธ์ได้เร็วกว่า Sonnet 5 มากกว่า 30% แต่ราคายังคงอยู่เท่าเดิม

  • Input: 2 เหรียญ / ล้านโทเคน
  • Output: 10 เหรียญ / ล้านโทเคน
  • Cache Read: 0.20 เหรียญ / ล้านโทเคน

แต่เนื่องจาก Sonnet 5.5 ใช้จำนวนโทเคนต่อภารกิจน้อยลง Anthropic ระบุว่าต้นทุนจริงต่อหนึ่งงานสามารถลดลงได้สูงสุด 30% เมื่อเทียบกับ Sonnet 5

ผู้ใช้ยังสามารถปรับระดับ Effort เพื่อเลือกระหว่างความเร็ว ต้นทุน และคุณภาพได้ หากเลือก Low โมเดลจะตอบเร็วและใช้โทเคนน้อย เหมาะกับงานทั่วไป ส่วน High จะใช้เวลาคิดและตรวจสอบผลลัพธ์มากขึ้น เหมาะกับงานที่ซับซ้อน

เพิ่มความเข้มงวดด้านความปลอดภัย

Anthropic ยังยกระดับมาตรการความปลอดภัย โดยเฉพาะด้าน Cybersecurity เนื่องจาก Sonnet 5.5 มีความสามารถด้านไซเบอร์เพิ่มขึ้นอย่างมาก สำหรับงานไซเบอร์ที่มีความเสี่ยงสูง ระบบจะสลับไปใช้ Sonnet 5 โดยอัตโนมัติ ขณะที่การเขียนโค้ดและการแก้บั๊กทั่วไปยังสามารถใช้งาน Sonnet 5.5 ได้ตามปกติ

นอกจากนั้นยังเพิ่มระบบป้องกันการดึงกระบวนการคิดของโมเดลไปสร้างโมเดลอื่น หรือที่เรียกว่า Distillation รวมถึงเพิ่มมาตรการป้องกันการนำโมเดลไปใช้ในทางที่ไม่เหมาะสม ส่วนด้านชีววิทยา Sonnet 5.5 ยังคงใช้มาตรการป้องกันในระดับเดียวกับ Sonnet 5 โดยเน้นจำกัดคำขอที่มีความเสี่ยงสูง

สำหรับนักพัฒนา Sonnet 5.5 เปิดให้ใช้งานแล้วบนแพลตฟอร์มหลัก รวมถึง Amazon Web Services, Google Cloud และ Microsoft Azure พร้อมรองรับการใช้งานผ่าน Claude Platform ในชื่อโมเดล claude-sonnet-5-5

ที่มา anthropic

นักเขียนสาย Introvert ที่ชื่นชอบเรื่องนวัตกรรมและความคิดสร้างสรรค์ ใช้เวลาว่างกับ มังงะ, เสียงเพลงและ idol

Sidebar Search
Popular Now
Loading

Signing-in 3 seconds...

Signing-up 3 seconds...