Gemini 圖像生成最佳做法

如要提升圖像生成結果的品質,請遵循下列最佳做法:

  • 具體說明:提供越多詳細資訊,生成結果就越貼近需求。舉例來說,請嘗試「華麗的精靈板甲,刻有銀葉圖案,高領和肩甲形狀像獵鷹翅膀」,而非「奇幻盔甲」。

  • 提供背景資訊和意圖:說明圖片的用途,協助模型瞭解背景資訊。舉例來說,「為極簡風的高檔護膚品牌設計標誌」比「設計標誌」更有效。

  • 反覆測試及修正:第一次嘗試時,請別期待能生成完美的圖片。 使用後續提示詞進行微調,例如「將光線調暖」或「將角色的表情改得更嚴肅」。

  • 使用逐步說明:如果是複雜的場景,請將要求分成多個步驟。例如:「首先,在黎明時分建立寧靜的霧林背景。然後,在前景中加入長滿青苔的古老石祭壇。最後,在祭壇頂端放置一把發光的劍。」

  • 描述你想要的內容,而不是不想要的內容:請正面描述場景,例如「空蕩蕩的街道,沒有任何交通跡象」,而不是說「沒有車」。

  • 控制攝影機:引導攝影機畫面。使用攝影和電影術語描述構圖,例如「廣角鏡頭」、「微距鏡頭」或「低角度透視」。

  • 圖片提示:使用「製作…的圖片」或「生成圖片」等詞組描述意圖。否則多模態模型可能會以文字回覆,而非圖片。

  • 傳遞思想特徵使用 Gemini 時,建議您在多輪圖像建立和編輯期間,將思想特徵傳遞回模型。這樣一來,您就能在互動過程中保留推論脈絡。如需使用 Gemini 進行多輪圖像編輯的程式碼範例,請參閱使用思想特徵進行多輪圖像編輯的範例

後續步驟

如要進一步瞭解 Gemini 圖像生成功能,請參閱下列連結: