Imagen 3是谷歌旗下DeepMind團隊在2024年5月14日(美國東部時間)Alphabet I/O開發者大會上推出的新一代文生圖模型。相較前代Imagen 2,該模型顯著提升了文本理解能力,可精準解析複雜提示詞並生成細節豐富、光影層次分明的圖像,同時減少干擾元素和生成錯誤。通過集成SynthID隱形數字水印技術,該模型能有效應對Deepfake風險。目前可通過ImageFX工具進行私人預覽,未來將向Vertex AI平台用戶和企業客戶開放。
基本介紹
- 發布時間:2024年5月14日
- 開發者:DeepMind團隊
- 核心技術:SynthID隱寫水印
- 套用平台:ImageFX、Vertex AI
- 生成工具:支持草圖快速出圖
- 文本渲染:高精度文字生成
發布背景
技術特點
- 文本處理能力可解析包含超長複雜描述的提示詞,準確捕捉細微語義,文本匹配度較Imagen 2提升
- 圖像質量最佳化通過改進算法架構:
- 圖像解析度最高達8K級別
- 生成速度較同類產品快40%
- 文字渲染突破在圖像內生成文字時,拼寫錯誤率降低至0.8%,支持15種語言文字融合生成
安全措施
- 全系集成SynthID隱形加密水印,採用量子抗性數字簽名技術
- 數據標註階段建立包含1.2億張圖像的審核庫,過濾率達99.97%
- 生成內容採用SynthID技術添加隱形水印
套用與限制
- 暫不支持解析度自主調節(固定16:9比例)
- 缺乏局部重繪等編輯功能
- 企業用戶需通過Vertex AI申請API密鑰
