Gemini 支援更進階的圖像編輯和多輪遞進編輯,並提供更新的安全篩選器,讓您享有更彈性且限制較少的體驗。
下列 Gemini 模型支援圖片編輯功能:
按一下即可展開支援的機型
如要進一步瞭解模型功能,請參閱「Gemini 模型」。
編輯圖片
控制台
如要編輯圖片,請按照下列步驟操作:
- 開啟 Agent Studio > 建立提示。
- 按一下「切換模型」,然後選取顯示的模型。
- 在「輸出」面板中,從下拉式選單選取「圖片和文字」。
- 按一下「插入媒體」圖示 (),然後從選單中選取來源,並按照對話方塊的指示操作。
- 在「撰寫提示」文字區域中,輸入要對圖片進行的編輯。
- 按一下「提示」 () 按鈕。
Gemini 會根據你的描述,生成所提供圖片的編輯版本。這項程序只需要幾秒鐘,但視容量而定,速度可能會相對較慢。
Python
安裝
pip install --upgrade google-genai
詳情請參閱 SDK 參考文件。
設定環境變數,透過 Vertex AI 使用 Google Gen AI SDK:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Java
瞭解如何安裝或更新 Java。
詳情請參閱 SDK 參考說明文件。
設定環境變數,透過 Vertex AI 使用 Google Gen AI SDK:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Go
瞭解如何安裝或更新 Go。
詳情請參閱 SDK 參考文件。
設定環境變數,透過 Vertex AI 使用 Google Gen AI SDK:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Node.js
安裝
npm install @google/genai
詳情請參閱 SDK 參考文件。
設定環境變數,透過 Vertex AI 使用 Google Gen AI SDK:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
REST
在終端機中執行下列指令,在目前目錄中建立或覆寫這個檔案:
curl -X POST \
-H "Authorization: Bearer $(gcloud auth print-access-token)" \
-H "Content-Type: application/json" \
https://${API_ENDPOINT}:generateContent \
-d '{
"contents": {
"role": "USER",
"parts": [
{"fileData": {
"mimeType": "image/jpg",
"fileUri": "FILE_NAME"
}
},
{"text": "Convert this photo to black and white, in a cartoonish style."},
]
},
"generationConfig": {
"imageConfig": {
"aspectRatio": "16:9",
"imageSize": "4K",
"responseModalities": ["TEXT", "IMAGE"],
"imageOutputOptions": {
"mimeType": "image/png"
},
"personGeneration": "allow_all"
},
},
"safetySettings": {
"method": "PROBABILITY",
"category": "HARM_CATEGORY_DANGEROUS_CONTENT",
"threshold": "BLOCK_MEDIUM_AND_ABOVE"
},
}' 2>/dev/null >response.json
如要進一步瞭解模型功能,包括支援的長寬比和輸出解析度,請參閱「Gemini 模型」。
Gemini 會根據您的描述生成圖片。這項程序只需幾秒鐘,但視容量而定,速度可能會較慢。
多輪圖像編輯
多輪編輯功能可讓你在模型顯示編輯後的圖片回覆後,回覆模型並進行變更。
下列 Gemini 模型支援多輪編輯:
按一下即可展開支援的機型
建議整個要求檔案的大小上限為 50 MB。
如要測試多輪圖像編輯功能,請參閱下列筆記本:
如要查看使用 Gemini 3 Pro 圖像模型建立及編輯圖像的多輪對話相關程式碼範例,請參閱使用思想特徵進行多輪圖像編輯的範例。
後續步驟
如要進一步瞭解 Gemini 圖像生成功能,請參閱下列連結: