BackgroundImage

開始與 Gemini 3.1 Flash-Lite 對話

使用 Gemini 3.1 Flash-Lite 及其全家族模型,每天享有更多訊息額度。

Gemini 3.1 Flash-Lite:用於高頻任務的低成本多模態模型

Gemini 3.1 Flash-Lite 是 Google 為高頻輕量任務設計的低成本模型。Google 將其定位為低延遲、成本優化的多模態模型,適用於高頻代理式工作流程、簡單資料擷取、翻譯與對延遲與成本敏感的應用場景。

Gemini 3.1 Flash-Lite 面向開發者、產品團隊、營運團隊與日常使用者,適合需要大規模快速多模態處理的場景。相較於 Gemini 3.1 Pro Preview 與 Gemini 3.5 Flash,它較少聚焦深度推理,而更偏向效率、路由、擷取、翻譯與高頻輔助任務。

Gemini 3.1 Flash-Lite:重要規格

以下是 Gemini 3.1 Flash-Lite 的主要規格,以及它們如何影響實際使用體驗。

  • 上下文窗口 - 1,048,576 input tokens: 支援超大輸入,可處理長文件、音訊、影片、PDF 與結構化資料,同時保持低成本。
  • 最大輸出長度 - 65,536 tokens: 支援長摘要、轉錄內容、結構化擷取結果與較長說明輸出。
  • 速度與效率 - 低延遲設計: 專為高頻與低成本場景設計,適用於大規模生產環境。
  • 成本效率 - 每 1M tokens 輸入 $0.25(文字/圖片/影片)或音訊 $0.50 / 輸出 $1.50: 適合翻譯、擷取、分類與高頻應用。
  • 推理能力 - 支援輕量 thinking: 可在需要時增加推理深度,同時保持日常任務高效率。
  • 多模態能力 - 支援文字、圖片、影片、音訊與 PDF: 可用於轉錄、文件摘要、影像擷取與跨媒體處理。

比較 Gemini 3.1 Flash-Lite、Gemini 3.5 Flash 與 Gemini 3.1 Pro Preview

各模型在性能、速度與使用情境上的差異簡要比較。

功能Gemini 3.1 Flash-LiteGemini 3.5 FlashGemini 3.1 Pro Preview
知識截止時間
2025年1月
2025年1月
2025年1月
上下文視窗(Token)
1,048,576 input tokens
1,048,576 input tokens
1,048,576 input tokens
最大輸出長度(Token)
65,536
65,536
65,536
輸入形式
文字、圖片、影片、音訊、PDF
文字、圖片、影片、音訊、PDF
文字、圖片、影片、音訊、PDF
輸出形式
文字
文字
文字
延遲(OpenRouter 資料)
低延遲
未官方公開
未官方公開
速度
高速
高速
未官方公開
每百萬 Token 的輸入/輸出成本
$0.25(文字/圖片/影片輸入)或 $0.50(音訊輸入)/ $1.50 輸出
$1.50 / $9.00
$2.00 / $12.00(<=200K prompts);$4.00 / $18.00(>200K prompts)
推理表現
實用型
進階
進階
程式性能
(基於 SWE-bench Verified)
未官方公開
55.1%(SWE-Bench Pro);76.2%(Terminal-Bench 2.1)
54.2%(SWE-Bench Pro);70.3%(Terminal-Bench 2.1)
最適合用途
高頻輕量任務、翻譯、擷取、分類、摘要、多模態處理與低成本代理流程
代理式程式設計、多步驟工作流、長上下文推理、多模態任務與大規模專業應用
進階多模態推理、軟體工程、代理式工作流程、工具使用與複雜分析

來源:  Google Gemini 3.1 Flash-Lite 文件

最適合使用 Gemini 3.1 Flash-Lite 的情境

Gemini 3.1 Flash-Lite 適合需要低成本、高頻率與快速多模態處理的工作流程。

  • 翻譯任務: 用於大量多語言內容、客服訊息與評論翻譯。
  • 語音轉文字: 將音訊、語音備忘錄轉換為文字。
  • 資料擷取: 從文件、PDF、表單與訊息中提取結構化資料。
  • 任務路由: 對請求進行分類並分流到不同模型或流程。
  • 文件處理: 摘要 PDF、整理大量文件與資訊。
  • 日常 AI 輔助: 快速寫作、摘要、學習與簡單研究任務。

如何存取 Gemini 3.1 Flash-Lite

使用 Gemini 3.1 Flash-Lite 可透過 API 或聊天介面快速存取。

1. 官方 API

可透過 Gemini API 使用 gemini-3.1-flash-lite 模型 ID,支援多模態輸入、thinking、結構化輸出、函數呼叫、程式執行、搜尋增強與 URL 上下文等能力。

2. EssayDone AI Chat

若不想設定 API,可透過 EssayDone AI Chat 直接使用 Gemini 3.1 Flash-Lite。

適合用於翻譯、摘要、寫作、文件處理、研究與日常生產力任務。

常見問題

以下是關於 Gemini 3.1 Flash-Lite 的常見問題。

Gemini 3.1 Flash-Lite 是推理模型嗎?

是的。Gemini 3.1 Flash-Lite 支援輕量 thinking,但主要針對高頻低成本任務優化。

Google Gemini 3.1 Flash-Lite 的費用是多少?

價格為:文字/圖片/影片輸入 $0.25 / 1M tokens,音訊輸入 $0.50 / 1M tokens,輸出 $1.50 / 1M tokens。

Gemini 3.1 Flash-Lite 最適合哪些任務?

適用於翻譯、轉錄、擷取、分類、摘要與高頻多模態處理任務。

Gemini 3.1 Flash-Lite 的多模態能力如何?

支援文字、圖片、影片、音訊與 PDF,可用於轉錄與多模態文件分析。

Gemini 3.1 Flash-Lite 與 Gemini 3.5 Flash / Pro Preview 有何差異?

相較 Flash 更偏低成本與高頻處理;相較 Pro Preview 則能力較弱但成本更低。

在 EssayDone AI Chat 使用 Gemini 3.1 Flash-Lite 有什麼優勢?

在 EssayDone AI Chat 使用可免 API 設定直接進行快速多模態任務。