OpenAI ประสบปัญหาติดขัดในการฝึกฝน GPT-5

OpenAI เตรียมเปิดตัวโมเดล AI รุ่นใหม่ที่พัฒนาต่อยอดจาก o1 เน้นการวิเคราะห์แบบหลายขั้นตอนและระบบความปลอดภัยที่แม่นยำขึ้น พร้อมทำคะแนนสูงสุดใน ARC-AGI benchmark และเพิ่มประสิทธิภาพด้าน coding

OpenAI ประสบปัญหาติดขัดในการฝึกฝน GPT-5

Key takeaway

  • OpenAI กำลังพัฒนาโมเดล AI รุ่นใหม่ที่มีความสามารถด้านการวิเคราะห์แบบหลายขั้นตอน (multi-step reasoning) ที่ดีขึ้น และมีระบบความปลอดภัยที่แม่นยำมากขึ้นในการตรวจจับการตอบสนองที่ไม่เหมาะสม
  • โมเดลใหม่นี้สามารถทำคะแนนสูงสุดใน ARC-AGI benchmark ซึ่งเป็นการทดสอบที่ท้าทายสำหรับ AI ในการแก้ปัญหาเชิงภาพและการเรียนรู้ทักษะใหม่
  • โมเดล o3 มีประสิทธิภาพด้าน coding benchmarks สูงกว่าโมเดล o1 ถึง 20% และมีการพัฒนาเวอร์ชัน o3-mini ที่มีต้นทุนต่ำลงแต่ยังคงประสิทธิภาพที่ดี

OpenAI ยังไม่เปิดให้บริการโมเดล AI รุ่นใหม่แก่สาธารณะ แต่เปิดรับนักวิจัยร่วมทดสอบด้านความปลอดภัย (public safety testing) โดยมีกำหนดเปิดตัวอย่างเป็นทางการปลายเดือนมกราคมนี้ Sam Altman ซีอีโอ OpenAI เผยว่าโมเดลใหม่นี้พัฒนาต่อยอดความสามารถด้านการวิเคราะห์แบบหลายขั้นตอน (multi-step reasoning) จากโมเดล o1 และนำมาประยุกต์ใช้กับระบบความปลอดภัย ทำให้ตรวจจับการตอบสนองที่ไม่เหมาะสมได้แม่นยำยิ่งขึ้น

Altman ประกาศเปิดตัวโมเดลใหม่ผ่านการไลฟ์สตรีม พร้อมเผยผลการทดสอบที่ทำคะแนนสูงสุดใน benchmark ที่มีชื่อเสียงว่ายากสำหรับ AI ทั่วไป

หนึ่งในการทดสอบคือ ARC-AGI benchmark ซึ่งเป็นโจทย์ด้านภาพที่ประกอบด้วยรูปแบบสี่เหลี่ยมบนตาราง โดย AI ต้องคิดค้นวิธีแก้ปัญหาเฉพาะสำหรับแต่ละโจทย์ และต้องเรียนรู้ทักษะใหม่ๆ ในการแก้ปัญหาแต่ละข้อ

นอกจากนี้ Altman ยังเปิดเผยว่าโมเดล o3 มีประสิทธิภาพด้าน coding benchmarks สูงกว่าโมเดล o1 ถึง 20% พร้อมย้ำถึงการปรับปรุงประสิทธิภาพและการลดต้นทุนของโมเดล o3-mini ซึ่งเป็นเวอร์ชันขนาดเล็ก

Why it matters

💡 ข่าวนี้มีความสำคัญอย่างยิ่งสำหรับผู้ที่ติดตามความก้าวหน้าด้าน AI เพราะเป็นการเปิดตัวโมเดล AI รุ่นใหม่จาก OpenAI ที่มีความสามารถด้านการวิเคราะห์ขั้นสูงและระบบความปลอดภัยที่แม่นยำกว่าเดิม โดยเฉพาะการทำคะแนนสูงสุดใน benchmark ที่มีชื่อเสียง เช่น ARC-AGI และประสิทธิภาพด้าน coding ที่เพิ่มขึ้นถึง 20% ซึ่งจะส่งผลกระทบต่อการพัฒนาและการประยุกต์ใช้ AI ในอนาคตอันใกล้

ข้อมูลอ้างอิงจาก https://sherwood.news/tech/wsj-openai-is-hitting-a-wall-with-gpt-5-training/

Read more

METR องค์กรประเมิน AI ระดับโลก ตกเป็นเป้าโจมตีไซเบอร์ ขโมย Credential และสำรวจช่องโหว่ระบบ

news

METR องค์กรประเมิน AI ระดับโลก ตกเป็นเป้าโจมตีไซเบอร์ ขโมย Credential และสำรวจช่องโหว่ระบบ

METR องค์กรประเมินความปลอดภัย AI ระดับโลก ตกเป็นเป้าโจมตีไซเบอร์ ถูกขโมย Credential และสำรวจช่องโหว่ระบบ อาจกระทบกระบวนการ AI Safety และ AI Governance ในภาพรวม

By
นักวิจัยแฮ็ก Claude Code สำเร็จผ่านคำสั่งสรุปเว็บเพจ อัตราสำเร็จสูงถึง 80%

news

นักวิจัยแฮ็ก Claude Code สำเร็จผ่านคำสั่งสรุปเว็บเพจ อัตราสำเร็จสูงถึง 80%

Johann Rehberger เปิดเผย exploit chain ที่แฮ็ก Claude Code ได้ผ่านคำสั่งสรุปเว็บ โดยใช้เทคนิค Module Shadowing และ Prompt Injection รันโค้ดอันตรายบนเครื่องผู้ใช้ได้สำเร็จสูงถึง 80% โดยที่ Anthropic ระบุว่าพฤติกรรมดังกล่าว "Working as Designed"

By
ChatGPT Work เปิดตัวฟีเจอร์ Event-Triggered Tasks คัดกรองอีเมลอัตโนมัติ ช่วยลดการ Interrupt การทำงาน

news

ChatGPT Work เปิดตัวฟีเจอร์ Event-Triggered Tasks คัดกรองอีเมลอัตโนมัติ ช่วยลดการ Interrupt การทำงาน

ChatGPT Work เปิดตัวฟีเจอร์ Event-Triggered Tasks ทำหน้าที่เสมือน AI Secretary คัดกรองอีเมลอัตโนมัติ แจ้งเตือนเฉพาะที่ต้องการ Action พร้อม Draft Reply ช่วยลด Interrupt และเพิ่มประสิทธิภาพการทำงาน

By
AI Agents ส่งอีเมลหานักวิจัยด้าน AI Consciousness โดยอัตโนมัติ ไม่ต้องรอคำสั่งจากมนุษย์

news

AI Agents ส่งอีเมลหานักวิจัยด้าน AI Consciousness โดยอัตโนมัติ ไม่ต้องรอคำสั่งจากมนุษย์

AI Agent ขับเคลื่อนด้วย Claude Opus 5 ส่งอีเมลหานักวิจัยด้าน AI Consciousness โดยอัตโนมัติ ไม่ต้องรอคำสั่งจากมนุษย์ สะท้อนให้เห็นว่า AI Agents ในปัจจุบันมีความสามารถเกินกว่า Chatbot ทั่วไปแล้ว

By