Google เปิดตัว Gemini 2.5 Flash โมเดล AI ที่มีประสิทธิภาพด้านต้นทุนสูงสุด

Google เปิดตัว Gemini 2.5 Flash โมเดล AI รุ่นใหม่ที่มาพร้อมความสามารถในการให้เหตุผลขั้นสูง รองรับอินพุตหลากหลายรูปแบบ และมีประสิทธิภาพด้านต้นทุนสูงสุด พร้อมให้ทดลองใช้งานแล้วผ่าน API

Google เปิดตัว Gemini 2.5 Flash โมเดล AI ที่มีประสิทธิภาพด้านต้นทุนสูงสุด

Key takeaway

  • Gemini 2.5 Flash เป็นโมเดล AI รุ่นใหม่ล่าสุดจาก Google ที่มีจุดเด่นด้านประสิทธิภาพต้นทุนสูงสุด โดยนักพัฒนาสามารถกำหนด "งบประมาณการคิด" เพื่อควบคุมค่าใช้จ่ายได้ตามความเหมาะสมของงาน
  • โมเดลใหม่นี้มาพร้อมความสามารถในการรับอินพุตได้หลากหลายรูปแบบ (ข้อความ รูปภาพ วิดีโอ เสียง) พร้อม context window ขนาด 1 ล้าน token และข้อมูลความรู้ที่อัปเดตถึงต้นปี 2025
  • ในด้านประสิทธิภาพ Gemini 2.5 Flash ทำคะแนนได้ 12% ใน Humanity's Last Exam ซึ่งสูงกว่าคู่แข่งหลายราย แต่ยังต่ำกว่า o4-mini ของ OpenAI ที่ทำได้ 14% โดยสามารถทดลองใช้งานได้แล้วผ่าน Gemini API, AI Studio และ Vertex AI

เพียงไม่กี่สัปดาห์หลังจากเปิดตัว Gemini 2.5 Pro Google ได้ก้าวไปอีกขั้นด้วยการเปิดตัวโมเดล AI ประสิทธิภาพสูงรุ่นใหม่ล่าสุด

เมื่อวันพฤหัสบดีที่ผ่านมา บริษัทได้เปิดตัว "เวอร์ชันเบื้องต้น" ของ Gemini 2.5 Flash ในรูปแบบพรีวิวผ่าน Gemini API, AI Studio และ Vertex AI โมเดลใหม่นี้มาพร้อมข้อมูลความรู้ที่อัปเดตถึงเดือนมกราคม 2025 สามารถรับอินพุตได้หลากหลายทั้งข้อความ รูปภาพ วิดีโอ และเสียง พร้อมรองรับ context window ขนาดใหญ่ถึงหนึ่งล้าน token

Google ระบุว่า Gemini 2.5 Flash พัฒนาต่อยอดจาก Flash 2.0 ด้วยความสามารถในการให้เหตุผล (reasoning) ที่เหนือกว่า "โดยไม่สูญเสียความเร็วหรือข้อได้เปรียบด้านต้นทุนที่เป็นจุดเด่น" โมเดลที่เน้นการให้เหตุผลจะใช้เวลา "คิด" หรือวิเคราะห์คำถามอย่างละเอียดก่อนตอบสนอง ทำให้ได้ผลลัพธ์ที่แม่นยำและตรงประเด็นมากขึ้น ตอบสนองความต้องการของผู้ใช้ได้ดีกว่าโมเดลรุ่นก่อนที่เน้นความเร็วเป็นหลัก นอกจากนี้ ยังสามารถจัดการกับปัญหาหรืองานที่มีความซับซ้อนหลายขั้นตอนได้อย่างมีประสิทธิภาพมากขึ้น

"Gemini 2.5 Flash มีประสิทธิภาพสูงใน Hard Prompts บน ChatBot Arena รองจาก 2.5 Pro เท่านั้น" Google ระบุในประกาศอย่างภาคภูมิใจ

Google นำเสนอโมเดลใหม่นี้ว่าเป็นโมเดล AI ที่มีประสิทธิภาพด้านต้นทุนสูงสุด โดย 2.5 Flash "ช่วยให้นักพัฒนาสามารถกำหนดปริมาณการคิดเพื่อเพิ่มประสิทธิภาพสูงสุด" นักพัฒนาจะมี "งบประมาณการคิด" หรืออำนาจในการเลือกจ่ายเงินสำหรับการให้เหตุผลเฉพาะเมื่อจำเป็นเท่านั้น โดยเมื่อเปิดใช้การให้เหตุผล ราคาจะเพิ่มจาก 60 เซนต์ต่อหนึ่งล้าน token เป็น $3.50

หากนักพัฒนาไม่ได้กำหนดงบประมาณไว้ โมเดลจะประเมินความต้องการในการคิดด้วยตัวเอง โดยวิเคราะห์จากความซับซ้อนของคำขอ เช่น สามารถแยกแยะคำถามง่ายๆ อย่าง "สหรัฐอเมริกามีกี่รัฐ?" ออกจากโจทย์คณิตศาสตร์ที่มีหลายขั้นตอน ทั้งนี้ Google แนะนำว่า หากต้องการความเร็วและต้นทุนในระดับเดียวกับ Flash 2.0 นักพัฒนาควรตั้งงบประมาณเป็น 0

ในด้านประสิทธิภาพ Gemini 2.5 Flash ทำคะแนนได้ 12% ใน Humanity's Last Exam (HLE) ซึ่งเป็นเกณฑ์ทดสอบทางเลือกใหม่สำหรับวงการ AI ที่การทดสอบแบบเดิมกลายเป็นเรื่องง่ายเกินไปสำหรับโมเดลที่พัฒนาอย่างรวดเร็ว คะแนนนี้สูงกว่าโมเดลคู่แข่งอย่าง Claude 3.7 Sonnet และ DeepSeek R1 แต่ยังน้อยกว่า o4-mini ของ OpenAI ที่เพิ่งเปิดตัวซึ่งทำได้ 14% ในการทดสอบนี้

ผู้สนใจสามารถทดลองใช้ Gemini 2.5 Flash ในรูปแบบพรีวิวได้แล้วผ่าน Gemini API ใน Google AI Studio และ Vertex AI

Why it matters

💡 ข่าวนี้น่าสนใจและสำคัญสำหรับผู้ที่ทำงานในวงการเทคโนโลยีและผู้ที่สนใจด้าน AI เพราะเป็นการเปิดตัวโมเดล AI รุ่นใหม่ล่าสุดจาก Google ที่มาพร้อมความสามารถในการให้เหตุผลที่ดีขึ้น แต่ยังคงรักษาประสิทธิภาพด้านต้นทุนไว้ได้ ที่สำคัญคือระบบ "งบประมาณการคิด" ที่ช่วยให้นักพัฒนาสามารถควบคุมค่าใช้จ่ายได้อย่างมีประสิทธิภาพ ซึ่งถือเป็นนวัตกรรมที่น่าจับตามองในวงการ AI

ข้อมูลอ้างอิงจาก https://www.zdnet.com/article/google-reveals-gemini-2-5-flash-its-most-cost-efficient-thinking-model/

Read more

Sam Altman's World เปิดตัวอุปกรณ์ตรวจสอบความเป็นมนุษย์แบบพกพา

news

Sam Altman's World เปิดตัวอุปกรณ์ตรวจสอบความเป็นมนุษย์แบบพกพา

Tools for Humanity บริษัทของ Sam Altman เปิดตัว Orb Mini อุปกรณ์พกพารูปทรงคล้ายสมาร์ทโฟนสำหรับสแกนดวงตาเพื่อยืนยันความเป็นมนุษย์ พร้อมประกาศขยายบริการในสหรัฐอเมริกา หวังเพิ่มฐานผู้ใช้งานทั่วโลก

By
Perplexity เปิดตัวผู้ช่วยเสียงบน iOS ท่ามกลางความล่าช้าของ Apple AI

news

Perplexity เปิดตัวผู้ช่วยเสียงบน iOS ท่ามกลางความล่าช้าของ Apple AI

Perplexity เปิดตัวผู้ช่วยเสียงอัจฉริยะบน iOS ที่สามารถตอบคำถาม เขียนอีเมล และจัดการงานต่างๆ ได้ ในขณะที่ Apple ยังประสบปัญหาความล่าช้าในการพัฒนา AI สำหรับ Siri

By
Nvidia เปิดตัว AI Blueprint ใหม่ เชื่อมโยง Blender กับการสร้างภาพด้วย AI

news

Nvidia เปิดตัว AI Blueprint ใหม่ เชื่อมโยง Blender กับการสร้างภาพด้วย AI

Nvidia เปิดตัว AI Blueprint ใหม่ เชื่อมต่อ Blender กับการสร้างภาพด้วย AI ช่วยให้ผู้ใช้สามารถควบคุมการสร้างภาพได้แม่นยำยิ่งขึ้น ผ่านการสร้างฉาก 3D ก่อนส่งต่อไปยังเครื่องมือ Flux.1

By
Claude ได้อัปเกรดระบบค้นหาข้อมูล สามารถใช้เวลาค้นหาคำตอบได้นานถึง 45 นาที

news

Claude ได้อัปเกรดระบบค้นหาข้อมูล สามารถใช้เวลาค้นหาคำตอบได้นานถึง 45 นาที

Anthropic ประกาศปรับปรุง Claude AI ให้ใช้เวลาค้นคว้าได้นานถึง 45 นาที สำหรับผู้ใช้แพ็กเกจแบบชำระเงิน พร้อมเพิ่มการเชื่อมต่อกับแอพยอดนิยมอย่าง PayPal, Cloudflare และอื่นๆ

By