Google เปิดตัวโมเดล Gemini 3.6 Flash และ 3.5 Flash-Lite เน้นความเร็วและประสิทธิภาพสูง เพื่อรองรับการสร้าง AI Agent ในระดับสากล พร้อมเปิดตัว Gemini 3.5 Flash Cyber สำหรับงานความปลอดภัยไซเบอร์
Google เปิดตัว Gemini 3.6 Flash และ 3.5 Flash-Lite เร็ว ฉลาด ประสิทธิภาพสูง
โมเดล Gemini รุ่นใหม่ล่าสุดมอบประสิทธิภาพ ความเร็ว และความเชื่อถือได้ เพื่อการสร้าง AI Agent ในระดับสเกลที่ใหญ่ขึ้น

เหล่านักพัฒนา และลูกค้าที่กำลังสร้าง AI Agent สำหรับใช้งานจริง ต้องการประสิทธิภาพในการใช้ Token ที่สูงขึ้น ความหน่วงที่ต่ำลง และประสิทธิภาพที่เชื่อถือได้มากขึ้น ซีรีส์โมเดล Flash ของเราถูกสร้างขึ้นเพื่อให้จุดสมดุลระหว่างประสิทธิภาพและคุณภาพ เพื่อให้สามารถขยายเวิร์กโฟลว์แบบ Agentic ได้ และจากการต่อยอด Gemini 3.5 Flash เราขอแนะนำโมเดล Gemini รุ่นใหม่ดังนี้:
3.6 Flash: โมเดลหลักที่ให้ประสิทธิภาพด้านการเขียนโค้ด, ด้านความรู้ และความสามารถแบบ Multimodal ที่ดีขึ้น จากดัชนี Artificial Analysis พบว่าการใช้ Output Token ลดลง 17% เมื่อเทียบกับ 3.5 Flash และในบางการทดสอบอย่าง DeepSWE โดย Datacurve พบว่าลดลงได้ถึง 65% โดยทั้งหมดนี้มาพร้อมกับราคาต่อ Output Token ที่ถูกลง
3.5 Flash-Lite: โมเดลระดับ 3.5 ที่เร็วที่สุด และคุ้มค่าที่สุด โดยทำความเร็วได้ถึง 350 Output Token ต่อวินาที ตามการวัดผลของ Artificial Analysis และมีประสิทธิภาพเหนือกว่ารุ่น Flash-Lite รุ่นก่อนหน้าอย่างมากในเวิร์กโฟลว์แบบ Agentic
3.5 Flash Cyber ใน CodeMender: แอปพลิเคชันด้านความปลอดภัยไซเบอร์ที่ประสบความสำเร็จต้องอาศัยการประสานงานอย่างระมัดระวังระหว่างโมเดลและโครงสร้างพื้นฐานของ Agent เป็นการรวมตัวของโมเดลเฉพาะทางด้านไซเบอร์ที่มีประสิทธิภาพสูงรุ่นใหม่ เข้ากับเอเจนต์ความปลอดภัยของโค้ด CodeMender ซึ่งให้ประสิทธิภาพที่สามารถแข่งขันได้ในระดับแนวหน้า
Gemini 3.6 Flash: มีประสิทธิภาพและคุณภาพดีกว่า 3.5 Flash
Gemini 3.6 Flash ถูกสร้างขึ้นโดยตรงจากคำติชมของนักพัฒนาและลูกค้าจากรุ่น 3.5 Flash ซึ่งไม่เพียงแต่ยกระดับการเขียนโค้ดและงานด้านความรู้เท่านั้น แต่ยังปรับปรุงประสิทธิภาพการใช้ Token อย่างมีนัยสำคัญ ตัวอย่างเช่น ในดัชนี Artificial Analysis พบว่า 3.6 Flash ใช้ Output Token น้อยกว่า 3.5 Flash ถึง 17% อีกทั้งยังใช้ขั้นตอนการให้เหตุผล (Reasoning steps) และการเรียกใช้ Tool น้อยลงเพื่อให้บรรลุเวิร์กโฟลว์แบบหลายขั้นตอน
ประสิทธิภาพที่เพิ่มขึ้นนี้มาพร้อมกับราคาที่ถูกลงกว่า 3.5 Flash โดยมีราคา 1.50 ดอลลาร์ ต่อ 1 ล้าน Input Token และ 7.50 ดอลลาร์ ต่อ 1 ล้าน Output Token ซึ่งช่วยลดต้นทุนรวมของแต่ละงาน AI Agent ทำให้การสร้างและรันเอเจนต์มีความคุ้มค่ามากขึ้น
ประสิทธิภาพสูงขึ้น แต่ 3.6 Flash ยังเห็นการเติบโตของประสิทธิภาพเมื่อเทียบกับ 3.5 Flash ในหลายกรณีการใช้งาน:
- 3.6 Flash ให้ความแม่นยำสูงขึ้น โดยมีการแก้ไขโค้ดที่ไม่ต้องการน้อยลง และลดรอบการทำงานซ้ำ (Execution loops) ดังที่เห็นใน DeepSWE (49% เทียบกับ 37%) และแสดงการปรับปรุงอย่างมีนัยสำคัญในงานวิจัย ML ดังที่เห็นใน MLE Bench (63.9% เทียบกับ 49.7%)
- มีความสามารถในการใช้งานคอมพิวเตอร์ (Computer use) ที่ดีขึ้น จากที่เห็นใน OSWorld-Verified (83.0% เทียบกับ 78.4%) โดยขณะนี้ Computer use เป็นเครื่องมือ Built-in ฝั่งไคลเอนต์ผ่าน Gemini API และ Gemini Enterprise แล้ว
- มีประสิทธิภาพเหนือกว่า 3.5 Flash ในงานด้านความรู้ ดังที่แสดงในเบนช์มาร์ก เช่น GDPval-AA v2 (1421 เทียบกับ 1349) โดยลูกค้าอย่าง Hebbia และ Harvey พบว่าโมเดลนี้มีความสามารถเป็นพิเศษในงานแบบ Multimodal เช่น การวิเคราะห์เอกสาร แผนภูมิ และข้อมูล รวมถึงการดราฟรายงาน


สร้างขึ้นพร้อมความปลอดภัย
3.6 Flash มาพร้อมกับการป้องกัน Frontier Safety ที่เข้มงวดขึ้นในโดเมนด้านสารเคมี ชีวภาพ รังสี และนิวเคลียร์ (CBRN) รวมถึงการนำไปใช้ในทางที่ผิดด้านการโจมตีทางไซเบอร์ การป้องกันเหล่านี้ทำให้โมเดลมีความทนทานต่อการ Jailbreak มากขึ้นอย่างมาก ในขณะเดียวกัน โมเดลยังถูกฝึกมาเพื่อลดการปฏิเสธการทำงานสำหรับการใช้งานที่เป็นประโยชน์
สำหรับข้อมูลเพิ่มเติม สามารถดูได้ที่ Model Card ของ 3.6 Flash
Gemini 3.5 Flash-Lite: สร้างมาเพื่อสเกลงาน AI Agent
นอกเหนือจากรุ่น Flash เรายังเปิดตัว Gemini 3.5 Flash-Lite ซึ่งออกแบบมาสำหรับงานที่ต้องการความหน่วงต่ำ และงานที่ต้องการ Throughput สูง ซึ่งสำคัญมากสำหรับเวิร์กโฟลว์ของนักพัฒนา เช่น การค้นหาแบบ Agentic และการประมวลผลเอกสาร
3.5 Flash-Lite เป็นโมเดลที่เร็วที่สุดในซีรีส์ 3.5 โดยจากการวัดผลของ Artificial Analysis พบว่าทำงานได้ถึง 350 Output Token ต่อวินาที ด้วยราคา 0.3 ดอลลาร์ ต่อ 1 ล้าน Input Token และ 2.5 ดอลลาร์ ต่อ 1 ล้าน Output Token พร้อมคุณภาพที่เหนือกว่า 3.1 Flash-Lite อย่างมาก ทำให้ 3.5 Flash-Lite มอบสัดส่วนประสิทธิภาพต่อราคาที่ยอดเยี่ยมสำหรับนักพัฒนาและลูกค้าที่ต้องจัดการกับปริมาณทราฟฟิกในการผลิตที่สูง

3.5 Flash-Lite ช่วยให้การขยายระบบ Agentic เป็นไปได้อย่างมีประสิทธิภาพ โดยในทุกระดับการคิด (Thinking levels) โมเดลนี้มีประสิทธิภาพเหนือกว่า 3.1 Flash-Lite อย่างมีนัยสำคัญ นักพัฒนาสามารถกำหนดค่าโมเดลให้ความสำคัญกับการประมวลผลที่ความหน่วงต่ำและต้นทุนต่ำสำหรับงานปริมาณมาก โดยใช้ระดับการคิดแบบ minimal และ low หรือเลือกใช้ระดับการคิดที่สูงขึ้นเพื่อประมวลผลงานย่อยแบบ multi-step subagent ขณะนี้โมเดลยังมี Computer use เป็นเครื่องมือ Built-in เพื่อรองรับงาน Agentic เหล่านี้ในหลากหลายพื้นผิวอย่างเชื่อถือได้
นี่คือก้าวสำคัญในการเขียนโค้ดและงาน Agentic ดังที่เห็นใน Terminal-Bench 2.1 (54% เทียบกับ 31%), การรองรับ Context ยาวๆ ดังที่เห็นใน GDM-MRCR v2 (72.2% เทียบกับ 60.1%) และการประมวลผลงานในโลกจริงดังที่เห็นใน GDPval-AA v2 (1140 เทียบกับ 642) ซึ่งทำให้มันเป็นตัวเลือกที่เร็วกว่าและมีความสามารถมากกว่าสำหรับเวิร์กโฟลว์บนทั้ง 2.5 และ 3 Flash


ลูกค้ากลุ่มแรกของ 3.5 Flash-Lite ต่างเน้นย้ำถึงการผสมผสานที่โดดเด่นระหว่างความเร็ว ความฉลาด และความคุ้มค่าด้านต้นทุน สำหรับการขยายเวิร์กโฟลว์แบบ Agentic และงานประมวลผลข้อมูล
สำหรับข้อมูลเพิ่มเติมเกี่ยวกับโมเดล สามารถดูได้ที่ Model Card ของ 3.5 Flash-Lite
Gemini 3.5 Flash Cyber ใน CodeMender: ค้นหาและแก้ไขช่องโหว่ได้อย่างมีประสิทธิภาพ
โมเดล AI ในปัจจุบันมีความสามารถในการหาช่องโหว่ด้านความปลอดภัยได้เร็วกว่าที่ระบบปัจจุบันจะแก้ไขได้ทัน การรับมือกับภัยคุกคามที่เติบโตนี้ต้องใช้แนวทางในการรักษาความปลอดภัยซอฟต์แวร์ที่มีความสามารถและประสิทธิภาพสูง
ประสิทธิภาพและความเร็วของ Flash ทำให้มันเป็นรากฐานที่เหมาะสมในการตรวจจับ ตรวจสอบ และแก้ไขปัญหาความปลอดภัยของโค้ดในระดับสเกล โดย Gemini 3.5 Flash Cyber ถูกสร้างขึ้นบนพื้นฐานของ 3.5 Flash และได้รับการปรับจูน (Fine-tuned) เพื่อค้นหาและแก้ไขช่องโหว่ด้านความปลอดภัยไซเบอร์ ในราคาต่อ Token ที่ถูกกว่าโมเดลขนาดใหญ่
ภายใน CodeMender ซึ่งใช้เอเจนต์ 3.5 Flash Cyber หลายตัวทำงานร่วมกันเพื่อสร้างรายงานฉบับเดียว 3.5 Flash Cyber สามารถทำประสิทธิภาพได้ในระดับแนวหน้าบนเบนช์มาร์กยอดนิยมอย่าง CyberGym
เนื่องจากเทคโนโลยีนี้มีลักษณะการใช้งานแบบสองทาง (Dual-use) เราจึงใช้แนวทางที่ระมัดระวังในการปรับใช้ 3.5 Flash Cyber โดยโมเดลนี้จะเปิดให้ใช้งานเฉพาะสำหรับรัฐบาลและพาร์ทเนอร์ที่ได้รับความไว้วางใจผ่าน CodeMender เร็วๆ นี้ ภายใต้โปรแกรมนำร่องที่จำกัดการเข้าถึง ซึ่งจะช่วยให้ผู้ป้องกันด่านหน้าสามารถค้นหาและแก้ไขช่องโหว่สำคัญได้ก่อนที่จะถูกโจมตี ในขณะที่ช่วยลดความเสี่ยงจากการนำไปใช้ในทางที่ผิดในวงกว้าง
เริ่มใช้งานได้ตั้งแต่วันนี้เป็นต้นไป
3.6 Flash และ 3.5 Flash-Lite พร้อมใช้งานแล้วตั้งแต่วันนี้:
- สำหรับนักพัฒนาใน Gemini API ผ่าน Google AI Studio และ Android Studio โดย 3.6 Flash ยังมีให้ใช้งานใน Google Antigravity อีกด้วย สามารถเริ่มต้นได้ที่คู่มือสำหรับนักพัฒนา
- สำหรับองค์กรใน Gemini Enterprise Agent Platform และ 3.6 Flash ยังมีให้ใช้งานในแอป Gemini Enterprise
- สำหรับทุกคนผ่านแอป Gemini โดย 3.5 Flash-Lite กำลังทยอยเปิดตัวใน Google Search
ที่มา: Google Blog
