AI Guide

Gemini 3.1 Flash-Lite完整介紹:價格與功能

Gemini 3.1 Flash-Lite是Google Gemini 3系列中最經濟實惠的模型。了解價格、功能、效能評測,以及如何在Chat Smith中使用。
Gemini 3.1 Flash-Lite完整介紹:價格與功能
E
Editorial Team
Jul 22, 2026 ・ 1 mins read

Gemini 3.1 Flash-Lite是Google Gemini 3系列中最具成本效益的模型,專為需要速度與規模、但不想付出高昂成本的團隊而設計。旗艦模型通常選擇深度而非速度,Flash-Lite卻反其道而行:回應快速、成本只是一小部分,卻仍能完成翻譯、語音轉錄、資料擷取與文件摘要等實際工作,品質更逼近Gemini 2.5 Flash。本文將說明Gemini 3.1 Flash-Lite實際能做什麼、在Gemini系列中的價格比較,以及它在Chat Smith工作流程中的定位。

什麼是Gemini 3.1 Flash-Lite?

Gemini 3.1 Flash-Lite是Google Gemini 3系列中最輕量、最經濟實惠的模型,專為高流量、對延遲敏感的工作負載而設計——也就是那些每天執行成千上萬次的背景任務,在這類場景中,每一毫秒、每一分錢的差距都很重要。Google最初透過Google AI Studio的Gemini API釋出預覽版,並透過Vertex AI提供給企業用戶,之後才正式全面上線。

相較於前代的Gemini 2.0 Flash-Lite與Gemini 2.5 Flash-Lite,這個版本在品質上有明顯提升——在指令遵循、推理與音訊理解等核心能力上大幅縮小與Gemini 2.5 Flash之間的差距,同時維持Lite等級的價格。它還支援四種可調整的思考等級(最低、低、中、高),讓開發者能依照每次請求的難度來調整推理深度。

Gemini 3.1 Flash-Lite的主要功能

多模態輸入、純文字輸出

Gemini 3.1 Flash-Lite可接受文字、圖片、影片、音訊與PDF檔案作為輸入,但輸出僅限文字。它支援最多1,048,576個token的輸入內容視窗,以及最多65,536個token的輸出,足以在單次呼叫中處理長篇文件、完整的錄音檔或大量的對話記錄。

可調整的思考等級

並非每個請求都需要深入推理。Gemini 3.1 Flash-Lite讓每次呼叫都能設定思考等級,遇到較困難的問題時可以犧牲一點延遲換取更高的準確度,而任務簡單、速度優先時則能完全跳過額外的推理步驟。

為代理式與高流量工作負載而設計

除了速度之外,這個模型還支援批次處理、提示快取、函式呼叫、結構化JSON輸出、程式碼執行與搜尋接地,這些都是代理式流程與自動分類器真正需要的基礎架構,而不只是一個聊天視窗。

Gemini 3.1 Flash-Lite的價格與效能

Gemini 3.1 Flash-Lite的定價為每百萬輸入token 0.25美元、每百萬輸出token 1.50美元,大約是Gemini 3 Flash成本的一半。在速度方面,Artificial Analysis的獨立評測發現,它的首個token回應時間明顯快於Gemini 2.5 Flash,輸出吞吐量也更高,而品質則與之相當甚至更好。

等級定位Chat Smith上的範例
Pro深度推理、研究等級的分析Gemini 2.5 Pro
Flash速度與能力的平衡Gemini 3 Flash
Flash-Lite最快速度、最低成本,適合高流量任務Gemini 3.1 Flash-Lite

Flash-Lite並不是唯一鎖定這個等級的模型。GPT-5 NanoClaude Haiku 4.5也採用相同的設計理念——犧牲一部分推理深度來換取速度與成本優勢,這三款模型都適合處理同類型的高頻任務。在Google自家的產品線中,Gemini 3.1 Flash-Lite取代Gemini 2.5 Flash-Lite成為預設的經濟型選項,而Gemini 2.5 Flash則仍是它在品質上努力追趕的標竿。

如何在Chat Smith中使用Gemini 3.1 Flash-Lite

Chat Smith讓你能直接使用Gemini 3.1 Flash-Lite,同時搭配Google的其他模型陣容,讓你依照任務切換模型,而不必只依賴單一模型。當你需要快速、便宜的輸出時——例如簡短回覆、初稿、翻譯,或摘要一份很長的PDF——它會是很好的預設選擇,而當工作需要更深入的推理時,你也隨時可以切換到更強大的模型。

對於文件密集的工作流程,將Flash-Lite的速度與Chat Smith的PDF摘要工具結合,能在開啟完整檔案之前快速篩選冗長的報告。

結論

Gemini 3.1 Flash-Lite以極低的成本,提供了旗艦級Gemini模型大部分的能力,使它成為高流量背景任務的實用預設選擇——而這類任務其實佔了實際AI使用量的大部分。你可以直接在Chat Smith中試用它,並搭配產品線中的其他所有模型。

常見問題

1. 什麼是Gemini 3.1 Flash-Lite?

Gemini 3.1 Flash-Lite是Google Gemini 3系列中最具成本效益的模型,專為翻譯、語音轉錄與結構化資料擷取等高流量、低延遲任務而設計,品質逼近Gemini 2.5 Flash。

2. Gemini 3.1 Flash-Lite的價格是多少?

定價為每百萬輸入token 0.25美元、每百萬輸出token 1.50美元,大約是Gemini 3 Flash成本的一半,是執行高流量AI工作負載最經濟的方式之一。

3. Gemini 3.1 Flash-Lite最適合用在哪些地方?

它適合翻譯、語音轉錄、結構化資料擷取、文件摘要等高頻率且定義明確的任務,也常被用作輕量級路由——透過快速分類判斷一項請求是否需要交給更強大的模型處理。

logo chat smith

Editorial Team

Chat Smith 编辑团队由一群热爱人工智能的研究人员、内容创作者和技术爱好者组成,致力于让 AI 变得更加易于理解和实用。通过 Chat Smith 博客,我们分享最新的 AI 趋势、工具评测、行业洞察和实用指南,帮助个人和企业充分发挥 AI 的价值。我们的使命很简单:提供清晰、可靠且易于理解的内容,帮助读者在快速发展的 AI 世界中保持信息领先、提升效率并抢占先机。

相关文章

提升你的工作效率, 只需一键!

推动项目向前所需的一切触手可及。