使用 3.5 Flash-Lite 時,您可以運用不同思考層級,在品質、速度和權杖輸出之間取得平衡:
- 使用
thinking_level.MINIMAL處理延遲時間較短或較簡單的分類和擷取工作:3.5 Flash-Lite 預設會盡量減少思考,以提升速度和成本效益。這種設定非常適合處理分類、路徑或 JSON 擷取等高處理量工作。 - 使用
thinking_level.MEDIUM或thinking_level.HIGH做為子代理程式:如果您使用 3.5 Flash-Lite 做為自主子代理程式,撰寫程式碼、執行終端機指令或呼叫外部 API,請將思考層級設為中或高。如果使用最低思考層級,可能會導致多步驟工作過早終止工具。
與先前的 Gemini 模型相比,3.5 Flash-Lite 可能會出現下列重大變更:
- 系統不支援溫度參數、Top-K 和 Top-P 等參數的自訂值。如果您為這些參數設定自訂值,系統會忽略該值。
- 系統不支援頻率和出現次數處罰參數的自訂值。為這些參數設定自訂值會擲回錯誤。
- 系統不支援最後一個輸入回合的角色為
Model的 API 要求。下列類型的要求會傳回錯誤:- 使用 Interactions API 時:
input陣列中最後一個物件具有"type": "model_output"的要求。 - 使用 GenerateContent API 時:
contents陣列中最後一個物件具有"role": "model"的要求。
- 使用 Interactions API 時:
在 Agent Studio 中試用 部署範例應用程式 查看價格
| 模型 ID | gemini-3.5-flash-lite |
|
|---|---|---|
| 形式 |
|
|
| 權杖限制 | 脈絡窗口 | 1,048,576 |
| 輸出詞元數量上限 | 65,536 | |
| 功能 |
|
|
| 工具 | ||
| 用量方案 |
|
|
| 技術規格 | 圖片 |
|
| 文字 |
|
|
| 影片 |
|
|
| 音訊 |
|
|
| 參數預設值 |
|
|
| 支援的地區 |
|
|
|
||
|
||
|
||
| 版本 |
|
|
| 安全性控管 | 線上預測 |
|
| 批次推論 |
|
|
| 脈絡快取 |
|
|
| 詳情請參閱安全控管措施。 | ||