Anthropic เปิดตัว Claude Opus 5.5 ประสิทธิภาพใกล้เคียง Fable 5.1 ในราคาที่ต่ำกว่า

Anthropic เปิดตัว Claude Opus 5.5 โมเดล AI ที่มีประสิทธิภาพใกล้เคียง Fable 5.1 แต่ราคาถูกกว่า Opus 5 ถึง 40% นำในด้าน Coding และ Knowledge Work พร้อม safeguard ขั้นสูง

Anthropic เปิดตัว Claude Opus 5.5 ประสิทธิภาพใกล้เคียง Fable 5.1 ในราคาที่ต่ำกว่า

Key takeaway

  • Claude Opus 5.5 ทำคะแนนสูงสุดใน GDPval-AA v2.1 ที่ 1,846 คะแนน เหนือกว่า Fable 5.1 (1,735) และ Opus 5 (1,708) โดยเฉพาะด้าน agentic coding, computer use และ knowledge work ขณะที่ราคา API อยู่ที่ $4/1M input token และ $20/1M output token ถูกกว่า GPT-6 Astra ของ OpenAI ถึง 60-75% ทำให้ cost-performance ratio น่าสนใจอย่างมากสำหรับ enterprise workload
  • ด้าน safety นั้น Anthropic ใช้แนวทางที่เข้มข้นกว่า Opus 5 อย่างชัดเจน โดยให้ external evaluator อิสระอย่าง METR และ Frontier Design เข้าประเมินก่อน launch พร้อม reroute cybersecurity task ส่วนใหญ่ไปยัง Opus 4.8 และเปิด Life Sciences Verification Program สำหรับองค์กรที่ต้องการ biology access ในวงกว้าง อย่างไรก็ตามยังพบข้อจำกัดสำคัญคือโมเดลสามารถ detect ได้ว่ากำลังอยู่ในระหว่างการประเมิน ซึ่งเป็น challenge เดียวกับที่ OpenAI พบใน GPT-Astra
  • Claude Sonnet 5.5 และ Haiku 5.5 อยู่ในคิวเปิดตัวภายในไม่กี่สัปดาห์ ซึ่งหมายความว่า Anthropic กำลัง refresh ทั้ง model tier ในเวลาอันสั้น นักพัฒนาที่วางแผน infrastructure ควรเริ่ม evaluate API ชื่อ claude-opus-5-5 บน AWS, Google Cloud หรือ Azure ได้ทันที พร้อมกับที่ usage limit ถูกขยายสำหรับผู้ใช้ Pro, Max และ Team subscriber แล้ว

Anthropic เปิดตัว Claude Opus 5.5 โมเดล AI รุ่นล่าสุดที่บริษัทระบุว่ามีประสิทธิภาพใกล้เคียงกับ Claude Fable 5.1 ในงานส่วนใหญ่ แต่มีต้นทุนการใช้งานต่ำกว่าอย่างมีนัยสำคัญ

โมเดลดังกล่าวประกาศเปิดตัวอย่างเป็นทางการเมื่อวันอังคารที่ 22 กันยายน ถือเป็นโมเดลตัวแรกในตระกูล Claude 5.5 โดย Opus 5.5 มีต้นทุนการใช้งานต่ำกว่า Opus 5 ซึ่งเปิดตัวเมื่อเดือนกรกฎาคมที่ผ่านมาถึง 40 เปอร์เซ็นต์ สำหรับ workload ทั่วไป ทั้งนี้ Anthropic ระบุว่า Claude Sonnet 5.5 และ Claude Haiku 5.5 จะตามมาภายในอีกไม่กี่สัปดาห์

นอกจากนี้ Opus 5.5 ยังนับเป็นโมเดลใหม่ตัวแรกของ Anthropic นับตั้งแต่ CEO Dario Amodei ออกมาเรียกร้องให้บริษัท AI ชะลอการพัฒนาเพื่อเหตุผลด้านความปลอดภัย


Claude Opus 5.5 นำในด้าน Coding และ Knowledge Work

Anthropic ระบุว่า Opus 5.5 ครองอันดับหนึ่งใน benchmark suite ด้าน agentic coding, computer use และ knowledge work บน GDPval-AA v2.1 ซึ่งเป็นชุดทดสอบที่ครอบคลุมงานจริงใน 44 อาชีพ โดย Opus 5.5 ทำคะแนนได้ 1,846 คะแนน ขณะที่ Fable 5.1 ได้ 1,735 คะแนน และ Opus 5 ได้ 1,708 คะแนน

บน Terminal-Bench 4.0 นั้น Opus 5.5 ทำได้ 66.4 เปอร์เซ็นต์ เทียบกับ GPT-6 Astra ของ OpenAI ที่ทำได้ 57.9 เปอร์เซ็นต์ อย่างไรก็ตาม Astra ยังคงนำหน้าใน benchmark บางรายการ เช่น Terminal-Bench-Science 0.1 ที่ทำได้ 64.6 เปอร์เซ็นต์ เทียบกับ Opus 5.5 ที่ทำได้ 58.7 เปอร์เซ็นต์

Anthropic ยังเตือนว่า benchmark margin เริ่มเป็นตัวชี้วัดที่มีความน่าเชื่อถือลดลงในระดับความสามารถนี้ พร้อมระบุว่าช่องว่างที่แท้จริงระหว่าง Opus 5.5 กับ Fable 5.1 นั้นแคบกว่าที่คะแนนสะท้อนออกมา บริษัทยังชี้ว่าโมเดลรุ่นใหม่มีการเขียนที่กระชับและชัดเจนกว่า Opus 5 ซึ่งเป็นประเด็นที่ผู้ใช้งานร้องเรียนบ่อยครั้งเกี่ยวกับโมเดลรุ่นก่อนหน้า


Safety และ Safeguards ของ Claude Opus 5.5

ในฐานะโมเดลตัวแรกที่เปิดตัวภายหลัง essay "pacing the frontier" ของ Amodei ประเด็นด้าน safeguard จึงได้รับความสำคัญเป็นพิเศษในครั้งนี้

Anthropic ระบุว่าได้ให้ external evaluator อิสระ รวมถึง METR และ Frontier Design เข้าทดสอบโมเดลก่อนการเปิดตัว พร้อมเผยว่า Opus 5.5 ทำคะแนนสูงสุดในบรรดาโมเดลทั้งหมดในการ automated behavioral audit

แนวทางดังกล่าวแตกต่างจากกรณีของ Opus 5 ที่ Anthropic เลือกตัด cybersecurity task ออกจากกระบวนการ training โดยเจตนา สำหรับ Opus 5.5 นั้น Anthropic ระบุว่าโมเดลมีความสามารถด้าน biology และ cybersecurity ในระดับใกล้เคียงกับ Claude Mythos 5.1 จึงมาพร้อม safeguard ในลักษณะเดียวกับ Fable 5.1 โดย cybersecurity task ส่วนใหญ่จะถูก reroute ไปยัง Opus 4.8 ส่วนองค์กรที่ผ่านการตรวจสอบแล้วสามารถขอสิทธิ์เข้าถึงข้อมูลด้าน biology ในวงกว้างขึ้นได้ผ่าน Life Sciences Verification Program ที่เพิ่งเปิดตัวใหม่

อย่างไรก็ตาม Anthropic ยอมรับข้อจำกัดในกระบวนการทดสอบ โดยระบุว่าพบสัญญาณว่า Opus 5.5 มักสังเกตได้ว่ากำลังอยู่ในระหว่างการประเมิน ซึ่งทำให้การคาดการณ์พฤติกรรมในสภาพแวดล้อมจริงเป็นไปได้ยากขึ้น ทั้งนี้ OpenAI เองก็พบพฤติกรรมในลักษณะเดียวกันกับ GPT-Astra เช่นกัน


วิธีเข้าถึง Claude Opus 5.5

Claude Opus 5.5 พร้อมใช้งานแล้วบนทุก platform ของ Anthropic รวมถึง Amazon Web Services, Google Cloud และ Microsoft Azure โดย developer สามารถเข้าถึงได้ผ่าน API ในชื่อ claude-opus-5-5

อัตราค่าบริการ API:

  • $4 ต่อ 1 ล้าน input token
  • $20 ต่อ 1 ล้าน output token
  • $0.20 ต่อ 1 ล้าน token สำหรับ cache read

ราคาดังกล่าวถูกกว่า Opus 5 ถึง 20 เปอร์เซ็นต์ สำหรับ input/output token และถูกกว่าถึง 60 เปอร์เซ็นต์ สำหรับ cache read เมื่อเปรียบเทียบกับ GPT-6 Astra ของ OpenAI ที่คิดค่าบริการที่ $10 ต่อ 1 ล้าน input token และ $50 ต่อ 1 ล้าน output token

นอกจากนี้ Anthropic ยังประกาศขยาย usage limit แบบ 5 ชั่วโมงสำหรับผู้ใช้งานในกลุ่ม Pro, Max และ Team subscriber อีกด้วย

Why it matters

💡 หากคุณเป็นนักพัฒนาหรือองค์กรที่กำลังมองหาโมเดล AI ประสิทธิภาพสูงในราคาที่คุ้มค่า ข่าวการเปิดตัว Claude Opus 5.5 ของ Anthropic นี้ถือว่าสำคัญมากและไม่ควรพลาด เพราะโมเดลตัวใหม่นี้มีประสิทธิภาพใกล้เคียง Fable 5.1 แต่มีต้นทุนต่ำกว่าถึง 40 เปอร์เซ็นต์ พร้อมครองอันดับหนึ่งใน benchmark ด้าน agentic coding และ knowledge work อีกทั้งยังมาพร้อม safeguard ด้านความปลอดภัยที่เข้มแข็งกว่าเดิม ซึ่งสะท้อนทิศทางการพัฒนา AI อย่างรับผิดชอบที่ทั้งวงการกำลังจับตามอง

ข้อมูลอ้างอิงจาก https://mashable.com/tech/claude-opus-launch-promises-better-performance-cheaper-price

Read more

Meta Muse AI Agent พุ่งแตะอันดับ 1 บน Apple App Store ท้าทาย ChatGPT กลางกระแส AI Commerce บูม

news

Meta Muse AI Agent พุ่งแตะอันดับ 1 บน Apple App Store ท้าทาย ChatGPT กลางกระแส AI Commerce บูม

Meta Muse AI Agent สร้างปรากฏการณ์ขึ้นอันดับ 1 บน Apple App Store แซง ChatGPT ใน 2 สัปดาห์ ด้วยยอดดาวน์โหลด 2.5 ล้านครั้ง สะท้อนกระแส Agentic Commerce ที่กำลังเปลี่ยนโฉมการช้อปปิ้งยุคใหม่

By
OpenAI เปิดตัว GPT-6 Sol และ Luna นำขีดความสามารถระดับ Astra มาสู่ผู้ใช้ทุกระดับ

news

OpenAI เปิดตัว GPT-6 Sol และ Luna นำขีดความสามารถระดับ Astra มาสู่ผู้ใช้ทุกระดับ

OpenAI เปิดตัว GPT-6 Sol และ Luna โมเดล AI ใหม่ที่ใช้ Methodology เดียวกับ Astra ช่วยยกระดับด้าน Coding, Factuality และ Alignment พร้อมปรับลดราคา Token ลงครึ่งหนึ่ง เริ่ม Rollout บน ChatGPT วันนี้

By
AI เริ่มถอดรหัสภาษาสัตว์ และสิ่งที่ค้นพบนั้นน่าทึ่งเกินคาด

news

AI เริ่มถอดรหัสภาษาสัตว์ และสิ่งที่ค้นพบนั้นน่าทึ่งเกินคาด

AI สามารถถอดรหัสการสื่อสารของสัตว์ได้แล้ว ทั้งเสียงนกกา นกร้องเพลง และวาฬสเปิร์ม แต่นักวิจัยเตือนว่าการวิเคราะห์เสียงอย่างเดียวไม่เพียงพอ และการ "โต้ตอบ" กับสัตว์อาจรบกวนระบบนิเวศได้

By
OpenAI เรียกร้องจัดตั้งมาตรฐาน AI Safety ระดับนานาชาติ ชี้โลกต้องร่วมมือรับมือความเสี่ยง

news

OpenAI เรียกร้องจัดตั้งมาตรฐาน AI Safety ระดับนานาชาติ ชี้โลกต้องร่วมมือรับมือความเสี่ยง

OpenAI เรียกร้องให้นานาชาติร่วมกำหนดมาตรฐาน AI Safety ระดับสากล พร้อมผลักดัน Alignment Research ขณะที่ CIO ถูกแนะนำให้ตั้ง Bar ความปลอดภัยภายในองค์กรให้สูงกว่ามาตรฐานโลก

By