AI Guide

Gemini 3.1 Flash-Lite: ราคา ฟีเจอร์ และวิธีใช้งาน

Gemini 3.1 Flash-Lite คือโมเดล Gemini 3 ที่คุ้มค่าที่สุดของ Google ดูราคา ฟีเจอร์ เบนช์มาร์ก และวิธีใช้งานบน Chat Smith
Gemini 3.1 Flash-Lite: ราคา ฟีเจอร์ และวิธีใช้งาน
E
Editorial Team
Jul 22, 2026 ・ 2 mins read

Gemini 3.1 Flash-Lite คือโมเดลที่คุ้มค่าที่สุดในตระกูล Gemini 3 ของ Google ออกแบบมาสำหรับทีมที่ต้องการความเร็วและสเกลโดยไม่ต้องแบกรับต้นทุนสูง ในขณะที่โมเดลระดับเรือธงเลือกความลึกมากกว่าความเร็ว Flash-Lite กลับสลับสมการนั้น มันตอบสนองได้เร็ว ราคาถูกกว่ามาก แต่ยังทำงานจริงได้ ไม่ว่าจะเป็นการแปลภาษา ถอดเสียง ดึงข้อมูล และสรุปเอกสาร ด้วยคุณภาพที่ใกล้เคียง Gemini 2.5 Flash คู่มือนี้จะอธิบายว่า Gemini 3.1 Flash-Lite ทำอะไรได้บ้าง ราคาเทียบกับโมเดลอื่นในตระกูล Gemini อย่างไร และเหมาะกับงานแบบไหนบน Chat Smith

Gemini 3.1 Flash-Lite คืออะไร?

Gemini 3.1 Flash-Lite เป็นโมเดลที่เบาที่สุดและคุ้มค่าที่สุดในตระกูล Gemini 3 ของ Google ออกแบบมาสำหรับงานที่มีปริมาณสูงและไวต่อความหน่วง ซึ่งเป็นงานเบื้องหลังที่รันหลักพันหรือหลักล้านครั้งต่อวัน ที่ทุกมิลลิวินาทีและทุกเศษเซนต์มีความหมาย Google เปิดให้ทดลองใช้ก่อนผ่าน Gemini API บน Google AI Studio และสำหรับองค์กรผ่าน Vertex AI ก่อนเปิดให้ใช้งานทั่วไป

เมื่อเทียบกับรุ่นก่อนหน้าอย่าง Gemini 2.0 Flash-Lite และ Gemini 2.5 Flash-Lite รุ่นนี้มีการพัฒนาคุณภาพอย่างชัดเจน ลดช่องว่างกับ Gemini 2.5 Flash ในด้านความสามารถหลัก เช่น การทำตามคำสั่ง การให้เหตุผล และความเข้าใจเสียง ขณะที่ยังคงราคาระดับ Lite นอกจากนี้ยังรองรับระดับการคิด 4 ระดับที่ปรับได้ (น้อยที่สุด ต่ำ กลาง สูง) ให้นักพัฒนาปรับความลึกของการให้เหตุผลตามความยากของแต่ละคำขอ

ฟีเจอร์หลักของ Gemini 3.1 Flash-Lite

รับข้อมูลได้หลายรูปแบบ ส่งออกเป็นข้อความ

Gemini 3.1 Flash-Lite รับข้อมูลนำเข้าได้ทั้งข้อความ รูปภาพ วิดีโอ เสียง และไฟล์ PDF แต่ส่งออกได้เฉพาะข้อความเท่านั้น รองรับหน้าต่างบริบทอินพุตสูงสุด 1,048,576 โทเคน และเอาต์พุตสูงสุด 65,536 โทเคน เพียงพอสำหรับประมวลผลเอกสารยาว ไฟล์เสียงทั้งหมด หรือประวัติแชทจำนวนมากในการเรียกครั้งเดียว

ระดับการคิดที่ปรับได้

ไม่ใช่ทุกคำขอที่ต้องการการให้เหตุผลเชิงลึก Gemini 3.1 Flash-Lite ให้กำหนดระดับการคิดในแต่ละการเรียกได้ ยอมแลกความหน่วงเล็กน้อยเพื่อความแม่นยำที่สูงขึ้นในโจทย์ที่ยาก หรือข้ามขั้นตอนคิดเพิ่มไปเลยเมื่องานง่ายและความเร็วสำคัญกว่า

ออกแบบมาเพื่องาน Agentic และปริมาณสูง

นอกจากความเร็ว โมเดลนี้ยังรองรับการประมวลผลแบบแบตช์ การแคชพรอมป์ต การเรียกฟังก์ชัน เอาต์พุต JSON แบบมีโครงสร้าง การรันโค้ด และการอ้างอิงผลค้นหา ซึ่งเป็นโครงสร้างพื้นฐานที่ pipeline แบบ agentic และตัวจำแนกอัตโนมัติต้องการจริง ไม่ใช่แค่หน้าต่างแชท

ราคาและประสิทธิภาพของ Gemini 3.1 Flash-Lite

Gemini 3.1 Flash-Lite ราคา $0.25 ต่อล้านโทเคนอินพุต และ $1.50 ต่อล้านโทเคนเอาต์พุต ซึ่งประมาณครึ่งหนึ่งของราคา Gemini 3 Flash ด้านความเร็ว ผลเบนช์มาร์กอิสระจาก Artificial Analysis พบว่ามีเวลาตอบสนองโทเคนแรกที่เร็วขึ้นอย่างชัดเจนและปริมาณเอาต์พุตสูงกว่า Gemini 2.5 Flash ขณะที่คุณภาพเทียบเท่าหรือดีกว่า

ระดับจุดเน้นตัวอย่างบน Chat Smith
Proการให้เหตุผลเชิงลึก วิเคราะห์ระดับงานวิจัยGemini 2.5 Pro
Flashสมดุลระหว่างความเร็วและความสามารถGemini 3 Flash
Flash-Liteเร็วที่สุด ราคาต่ำที่สุด งานปริมาณสูงGemini 3.1 Flash-Lite

Flash-Lite ไม่ใช่โมเดลเดียวที่ออกแบบมาสำหรับระดับนี้ GPT-5 Nano และ Claude Haiku 4.5 ก็ใช้แนวคิดเดียวกัน คือยอมลดความลึกของการให้เหตุผลเพื่อแลกกับความเร็วและต้นทุน ทั้งสามโมเดลเหมาะกับงานความถี่สูงแบบเดียวกัน ในตระกูลของ Google เอง Gemini 3.1 Flash-Lite เข้ามาแทนที่ Gemini 2.5 Flash-Lite เป็นตัวเลือกราคาประหยัดค่าเริ่มต้น ขณะที่ Gemini 2.5 Flash ยังคงเป็นมาตรฐานด้านคุณภาพที่มันพยายามไล่ตาม

วิธีใช้ Gemini 3.1 Flash-Lite บน Chat Smith

Chat Smith ให้คุณเข้าถึง Gemini 3.1 Flash-Lite ได้โดยตรง พร้อมกับโมเดลอื่นๆ ของ Googleทั้งหมด ทำให้สลับโมเดลตามงานได้แทนที่จะยึดติดกับโมเดลเดียว เหมาะเป็นตัวเลือกเริ่มต้นเมื่อคุณต้องการผลลัพธ์ที่เร็วและราคาถูก เช่น คำตอบสั้นๆ ร่างแรก การแปลภาษา หรือสรุป PDF ยาวๆ และยังสามารถส่งงานให้โมเดลที่หนักกว่าได้เสมอเมื่องานต้องการการให้เหตุผลที่ลึกขึ้น

สำหรับงานที่ต้องจัดการเอกสารจำนวนมาก การรวมความเร็วของ Flash-Lite เข้ากับเครื่องมือสรุป PDFของ Chat Smith ช่วยให้คัดกรองรายงานยาวๆ ได้อย่างรวดเร็วก่อนเปิดไฟล์เต็ม

คำถามที่พบบ่อย

Gemini 3.1 Flash-Lite คืออะไร?

Gemini 3.1 Flash-Lite คือโมเดลที่คุ้มค่าที่สุดของ Google ในตระกูล Gemini 3 ออกแบบมาสำหรับงานปริมาณสูงและความหน่วงต่ำ เช่น การแปลภาษา การถอดเสียง และการดึงข้อมูลแบบมีโครงสร้าง โดยมีคุณภาพใกล้เคียง Gemini 2.5 Flash

Gemini 3.1 Flash-Lite ราคาเท่าไหร่?

ราคา $0.25 ต่อล้านโทเคนอินพุต และ $1.50 ต่อล้านโทเคนเอาต์พุต ซึ่งประมาณครึ่งหนึ่งของราคา Gemini 3 Flash ทำให้เป็นหนึ่งในวิธีที่ประหยัดที่สุดสำหรับรันงาน AI ปริมาณสูง

Gemini 3.1 Flash-Lite เหมาะกับงานแบบไหนที่สุด?

เหมาะกับงานที่เกิดขึ้นบ่อยและมีขอบเขตชัดเจน เช่น การแปลภาษา การถอดเสียง การดึงข้อมูลแบบมีโครงสร้าง การสรุปเอกสาร และการทำหน้าที่จำแนกงานแบบเบา เพื่อตัดสินใจว่าคำขอนั้นต้องใช้โมเดลที่หนักกว่าหรือไม่

สรุป

Gemini 3.1 Flash-Lite ให้ความสามารถส่วนใหญ่ของโมเดล Gemini เรือธงในราคาที่ถูกกว่ามาก จึงเป็นตัวเลือกที่ใช้งานได้จริงสำหรับงานเบื้องหลังปริมาณสูง ซึ่งเป็นส่วนใหญ่ของการใช้งาน AI จริงในทางปฏิบัติ คุณสามารถลองใช้ได้โดยตรงบน Chat Smith พร้อมกับโมเดลอื่นๆ ทั้งหมดในระบบ

logo chat smith

Editorial Team

ทีมบรรณาธิการ Chat Smith ประกอบด้วยผู้ที่หลงใหลใน AI นักวิจัย และนักสร้างสรรค์คอนเทนต์ที่มุ่งมั่นทำให้ปัญญาประดิษฐ์เข้าถึงได้ง่ายและใช้งานได้จริงมากขึ้น ผ่านบล็อก Chat Smith เราแบ่งปันเทรนด์ AI ล่าสุด รีวิวเครื่องมือ ข้อมูลเชิงลึกในอุตสาหกรรม และคู่มือที่นำไปใช้ได้จริง เพื่อช่วยให้บุคคลและธุรกิจได้รับประโยชน์สูงสุดจาก AI พันธกิจของเราคือการนำเสนอเนื้อหาที่ชัดเจน เชื่อถือได้ และเข้าใจง่าย เพื่อช่วยให้ผู้อ่านได้รับข้อมูลที่ทันสมัย ทำงานได้อย่างมีประสิทธิภาพ และก้าวทันโลก AI ที่เปลี่ยนแปลงอย่างรวดเร็ว

บทความที่เกี่ยวข้อง

ยกระดับงานของคุณ, เพียงคลิกเดียว!

ทุกอย่างที่คุณต้องใช้เพื่อขับเคลื่อนโปรเจกต์อยู่แค่ปลายนิ้ว