Google เปิดตัว Gemini 3.6 Flash, 3.5 Flash-Lite และ 3.5 Flash Cyber: ทุกอย่างที่คุณต้องรู้
Google เพิ่งเปิดตัว Gemini 3.6 Flash, 3.5 Flash-Lite และ 3.5 Flash Cyber ราคา เบนช์มาร์ก ช่องทางใช้งาน ความปลอดภัย และแผน Gemini 4 — สรุปครบจบในที่เดียว
โมเดล Flash ใหม่สามตัวในวันเดียว
เมื่อ 21 กรกฎาคม 2026 Google ประกาศโมเดล Gemini ใหม่สามตัวพร้อมกัน: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite และ Gemini 3.5 Flash Cyber จุดร่วมชัดเจนมาก — ทุกตัวมุ่งแก้ปัญหาเดียวกันที่นักพัฒนาพูดถึงตลอด: AI agent ในระบบจริงต้องการ ประสิทธิภาพโทเคนที่สูงขึ้น ความหน่วงต่ำลง และผลลัพธ์ที่เชื่อถือได้มากขึ้น ไม่ใช่แค่คะแนนพาดหัวที่ใหญ่ขึ้น
บทความนี้แจกแจงว่าแต่ละโมเดลมีไว้ทำอะไร ราคาเท่าไร ใช้ได้ที่ไหนวันนี้ และ Google บอกใบ้อะไรเกี่ยวกับอนาคต (สปอยล์: Gemini 3.5 Pro กำลังทดสอบกับพาร์ตเนอร์ และ การ pre-train ของ Gemini 4 เริ่มไปแล้ว) ตัวเลขทั้งหมดมาจากประกาศอย่างเป็นทางการ
ภาพรวมไลน์อัป
| โมเดล | บทบาท | สถิติเด่น | การเข้าถึง |
|---|---|---|---|
| Gemini 3.6 Flash | ตัวหลัก: เขียนโค้ด งานความรู้ มัลติโมดัล | โทเคนเอาต์พุตน้อยกว่า 3.5 Flash 17% ในราคาที่ถูกลง | ใช้งานทั่วไปได้แล้ววันนี้ |
| Gemini 3.5 Flash-Lite | โมเดลคลาส 3.5 ที่เร็วที่สุดและคุ้มค่าที่สุด | 350 โทเคนเอาต์พุต/วินาที (Artificial Analysis) | ใช้งานทั่วไปได้แล้ววันนี้ |
| Gemini 3.5 Flash Cyber | ผู้เชี่ยวชาญความปลอดภัย ค้นหาและแก้ช่องโหว่ | แข่งกับโมเดลระดับ frontier บน CyberGym ภายใน CodeMender | เฉพาะโครงการนำร่องแบบจำกัดสิทธิ์ |
Gemini 3.6 Flash: ตัวหลักคนใหม่
3.6 Flash สร้างต่อยอดจากฟีดแบ็กของนักพัฒนาที่มีต่อ 3.5 Flash โดยตรง จุดขายไม่เหมือนการเปิดตัวโมเดลทั่วไป: ไม่ใช่แค่ เก่งขึ้น แต่ ประหยัดขึ้น บน Artificial Analysis Index มันใช้ โทเคนเอาต์พุตน้อยกว่า 3.5 Flash 17% และในบางเบนช์มาร์ก — เช่น DeepSWE โดย Datacurve — Google พบการลดลง สูงสุดถึง 65% อีกทั้งยังใช้ขั้นตอนการคิดและการเรียกเครื่องมือน้อยลงในการทำเวิร์กโฟลว์หลายขั้นให้เสร็จ ซึ่งทบต้นเป็นการประหยัดจริงในงานแบบ agent

ไฮไลต์เบนช์มาร์กเทียบกับ 3.5 Flash:
| เบนช์มาร์ก | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|
| DeepSWE (เขียนโค้ดแบบ agent) | 49% | 37% |
| MLE Bench (วิจัย ML) | 63.9% | 49.7% |
| OSWorld-Verified (การใช้คอมพิวเตอร์) | 83.0% | 78.4% |
| GDPval-AA v2 (งานความรู้) | 1421 | 1349 |
รายละเอียดวันเปิดตัวอีกสองข้อที่สำคัญสำหรับนักพัฒนา:
- การใช้คอมพิวเตอร์กลายเป็นเครื่องมือฝั่งไคลเอนต์ในตัว ผ่าน Gemini API และ Gemini Enterprise — ไม่ต้องสร้างโครงสร้างเสริมแยกต่างหาก
- ลูกค้ากลุ่มแรกมี Figma, Harvey, Hebbia และ JetBrains; Hebbia กับ Harvey ชูจุดแข็งมัลติโมดัลโดยเฉพาะ เช่น การแยกวิเคราะห์เอกสาร การวิเคราะห์กราฟและข้อมูล และการร่างรายงาน
เดโมของ Google ที่เทียบประสิทธิภาพโทเคนแบบเคียงข้างกันบนงาน OSWorld น่าดูมาก: เดโมประสิทธิภาพโทเคน 3.6 Flash vs 3.5 Flash (วิดีโอ)
สำหรับการเปรียบเทียบแบบตัวต่อตัวฉบับเต็ม ดูบทวิเคราะห์เจาะลึก Gemini 3.6 Flash vs 3.5 Flash ของเรา
Gemini 3.5 Flash-Lite: สร้างมาเพื่อสเกลเวิร์กโฟลว์แบบ agent
Flash-Lite คือหมากสำหรับงานปริมาณมหาศาล เป็น โมเดลที่เร็วที่สุดในซีรีส์ 3.5 ที่ 350 โทเคนเอาต์พุตต่อวินาที (Artificial Analysis) มุ่งเป้าที่การค้นหาแบบ agent การประมวลผลเอกสาร และไปป์ไลน์ใดก็ตามที่ throughput เป็นคอขวด
การก้าวกระโดดด้านคุณภาพจาก 3.1 Flash-Lite น่าทึ่งมาก — Terminal-Bench 2.1 ที่ 54% เทียบกับ 31%, GDM-MRCR v2 บริบทยาวที่ 72.2% เทียบกับ 60.1% และ GDPval-AA v2 ที่ 1140 เทียบกับ 642 ที่น่าตกใจคือมันเอาชนะ Gemini 3 Flash ที่ตัวใหญ่กว่าในการประเมินแบบ agent หลายรายการ รวมถึง SWE-Bench Pro (54.2% เทียบกับ 49.6%) และ OSWorld-Verified (74.0% เทียบกับ 65.1%)
โมเดลมาพร้อม ระดับการคิดที่ปรับได้ — ใช้ระดับ minimal/low สำหรับงานปริมาณมากที่เน้นความหน่วงต่ำ หรือเพิ่มระดับสำหรับงาน subagent หลายขั้นตอน — และการใช้คอมพิวเตอร์ก็มีในตัวเช่นกัน ลูกค้ากลุ่มแรกมี Ashler, Palo Alto Networks และ Ramp และโมเดลกำลัง ทยอยเปิดใช้ใน Google Search และแอป Gemini
คู่มือเวิร์กโฟลว์ agent ของ 3.5 Flash-Lite ของเราครอบคลุมระดับการคิด การคำนวณต้นทุน และการเลือกโมเดลอย่างละเอียด
ราคา: ถูกลงทั้งสองระดับ
| โมเดล | อินพุต ($/1M โทเคน) | เอาต์พุต ($/1M โทเคน) | หมายเหตุ |
|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | ถูกกว่า 3.5 Flash แถมโทเคนเอาต์พุตน้อยลง ~17% |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | ราคาต่อประสิทธิภาพดีที่สุดสำหรับทราฟฟิกปริมาณมาก |
| Gemini 3.5 Flash Cyber | — | — | ไม่มีราคาสาธารณะ; นำร่องแบบจำกัดสิทธิ์ผ่าน CodeMender |
เรื่องต้นทุนที่แท้จริงอยู่ที่การคูณ: 3.6 Flash คิดเงิน ต่อโทเคน ถูกลง และ ผลิตโทเคนต่องานน้อยลง ดังนั้นต้นทุนจริงต่อหนึ่งงาน agent จึงลดลงมากกว่าที่ตารางราคาบอก
Gemini 3.5 Flash Cyber: ผู้เชี่ยวชาญหลังม่านกำมะหยี่
โมเดลตัวที่สามแตกต่างออกไป 3.5 Flash Cyber สร้างบนฐาน 3.5 Flash และ fine-tune มาเพื่อค้นหาและแก้ช่องโหว่ความปลอดภัย ในราคาต่อโทเคนที่ถูกกว่าโมเดลใหญ่ มันทำงานภายใน CodeMender ซึ่งเป็น agent ความปลอดภัยโค้ดของ Google โดย agent 3.5 Flash Cyber หลายตัวทำงานร่วมกันเพื่อสร้างรายงานรวมฉบับเดียว — บรรลุประสิทธิภาพระดับแข่งกับโมเดล frontier บนเบนช์มาร์ก CyberGym

เนื่องจากเทคโนโลยีนี้ใช้ได้สองทาง Google จึงตั้งใจ ไม่ ปล่อยเป็นวงกว้าง: จะ เปิดให้เฉพาะรัฐบาลและพาร์ตเนอร์ที่ไว้ใจได้ผ่าน CodeMender ในโครงการนำร่องแบบจำกัดสิทธิ์เท่านั้น เป้าหมายคือให้ฝ่ายป้องกันแนวหน้าได้แต้มต่อในการแพตช์ช่องโหว่ร้ายแรงก่อนถูกโจมตี
ความปลอดภัย: jailbreak น้อยลง การปฏิเสธก็น้อยลง
3.6 Flash มาพร้อม มาตรการป้องกัน Frontier Safety ที่ยกระดับ ครอบคลุม การใช้งานในทางที่ผิดด้าน CBRN (เคมี ชีวภาพ รังสี นิวเคลียร์) และการโจมตีไซเบอร์ Google บอกว่าโมเดล ทนต่อ jailbreak มากขึ้นอย่างมีนัยสำคัญ พร้อมกันนั้นยังถูกฝึกให้ ลดการปฏิเสธคำขอที่ไม่เป็นอันตราย — คือคอมโบที่นักพัฒนาต้องการจริง ๆ ไม่ใช่ท่าทีปฏิเสธทุกอย่างแบบทื่อ ๆ
ใช้ที่ไหนได้บ้างวันนี้
| ช่องทาง | Gemini 3.6 Flash | Gemini 3.5 Flash-Lite |
|---|---|---|
| Gemini API (Google AI Studio, Android Studio) | ✅ | ✅ |
| Google Antigravity | ✅ | — |
| Gemini Enterprise Agent Platform | ✅ | ✅ |
| แอป Gemini Enterprise | ✅ | — |
| แอป Gemini | ✅ | ✅ |
| Google Search | — | ✅ กำลังทยอยเปิด |
| CodeMender (3.5 Flash Cyber) | นำร่องแบบจำกัด: เฉพาะรัฐบาลและพาร์ตเนอร์ที่ไว้ใจได้ |
คำใบ้แผนอนาคต: 3.5 Pro และ Gemini 4
โน้ตมองไปข้างหน้าสองข้อที่ซ่อนอยู่ในประกาศ ควรค่าแก่ความสนใจ:
- Gemini 3.5 Pro กำลังทดสอบกับพาร์ตเนอร์ โดยวางแผนเปิดกว้าง “ทันทีที่พร้อม”
- Google ได้ เริ่มรอบ pre-training ที่ทะเยอทะยานที่สุด — สำหรับ Gemini 4 — และบอกว่า “ตื่นเต้นกับความคืบหน้า”
อ่านรวมกันแล้ว การปล่อยโมเดลระดับ Flash ครั้งนี้ดูเหมือนการล็อกชั้นประสิทธิภาพให้แน่นก่อนการรุกครั้งใหญ่ของ frontier รอบถัดไป
สรุป
ถ้าคุณสร้าง agent นี่คือการเปิดตัวที่หาได้ยากซึ่งทางเลือกที่ถูกต้องชัดเจนมาก: 3.6 Flash สำหรับงาน agent ที่เน้นคุณภาพ, 3.5 Flash-Lite สำหรับ throughput ปริมาณสูง — ทั้งคู่ถูกกว่ารุ่นที่มาแทน ส่วน Flash Cyber ส่งสัญญาณว่า Google มองทิศทางของโมเดล fine-tune เฉพาะทางไว้อย่างไร: ทรงพลัง แคบ และถูกจำกัดการเข้าถึงอย่างตั้งใจ