Veo 3.1

Veo 3.1

Veo 3.1是谷歌於2025年10月15日正式發布的新一代AI視頻生成模型,支持生成720p/1080p解析度、最長148秒的視頻片段,並集成至Flow電影製作平台、Gemini API及Vertex AI平台。該模型通過對象級編輯、多圖像場景控制、首尾幀過渡等功能提升敘事控制能力,新增背景音頻增強和原生音畫同步生成技術,支持添加或移除視頻元素並自動處理光影效果。該模型支持橫屏與16:9豎屏格式輸出,基礎視頻時長為4-8秒。

在更新中,Veo 3.1主要在場景一致性、移動端尺寸方面進行改進,其“Image Ingredients(圖像要素)”生成視頻能力得到提升,能夠在不同場景切換中保持角色和敘事的一致性。同時支持將背景圖像、材質紋理、物體元素在多個場景之間重複使用,並能夠將看似無關的素材自然融合。Veo 3.1現已支持以9:16的縱向比例生成“Ingredients to Video”視頻內容,適配手機豎屏顯示,用戶還可使用視頻超解析度功能,將生成內容輸出至1080p乃至4K解析度。該模型首批樣本已展示8秒720p帶音軌視頻生成能力,測試顯示其提示詞遵循度與畫面保真度較前代有所提升。其生成速度較快,並在角色一致性、視覺元素標準化適配方面有所側重,企業用戶可上傳產品圖像以實現品牌風格統一。在2025年12月的音頻能力評估中,新興模型Seedance 1.5 pro在生成質量、同步性、對齊度、表現力等多項指標上表現優於Veo 3.1。

基本介紹

  • 中文名:Veo 3.1
  • 製作公司:谷歌
  • 發布時間:2025年10月15日
簡介,功能提升,敘事與音頻控制能力升級,多模態輸入架構支撐精細編輯 ,全平台部署策略滿足多元需求,專業級輸出規格拓寬套用場景,移動端最佳化與畫質提升,

簡介

Veo 3.1是谷歌於2025年10月15日發布的AI視頻生成模型,支持生成720p/1080p解析度、最長148秒的視頻片段,並集成至Flow電影製作平台、Gemini API及Vertex AI平台。通過技術更新,最佳化了AI視頻的敘事控制能力、音頻融合度與畫面真實感。此次更新為包括愛好者、創作者、企業用戶和開發團隊在內的不同群體提供了更多套用可能。

功能提升

敘事與音頻控制能力升級

Veo 3.1在前代基礎上,增強了對對話、環境音效及其他音頻元素的處理能力。值得關注的是,原生音頻生成現已全面集成到Flow平台的三大核心功能中:
● “幀轉視頻”:將靜態圖像轉化為動態場景
● “素材轉視頻”:整合多張圖像中的元素,創作複合視頻
● “延伸視頻”:基於已有片段持續生成,將初始視頻延伸至30秒甚至1分鐘以上
這些功能此前需要用戶手動添加音頻,現在則實現了音畫同步生成。這不僅讓用戶能更好地掌控作品的情感基調和敘事節奏,也省去了後期製作的繁瑣步驟。
對企業用戶而言,這種集成化的音視頻處理方式,使得製作培訓材料、行銷視頻等專業內容更加高效,顯著降低了製作門檻。
然而,在2025年12月的音頻能力評估中,新興模型Seedance 1.5 pro在生成質量、同步性、對齊度、表現力等多項指標上全方位超越Veo 3.1。

多模態輸入架構支撐精細編輯

Veo 3.1支持文本、圖像、視頻片段等多種輸入形式,並在輸出控制上更加精細。新引入的功能包括:
● 最多支持3張參考圖像,精準把控輸出內容的視覺風格
● 首尾幀插值技術,實現不同場景間的自然無縫過渡
● 場景延伸功能,突破單次生成時長限制,智慧型延續原有視頻的動作與運鏡邏輯
這些工具讓企業用戶能夠精細調整內容的外觀質感,確保符合品牌規範或創意要求。
此外,“插入對象”和“移除元素”等編輯功能也同步推出,不過部分功能尚未完全開放給Gemini API用戶。

全平台部署策略滿足多元需求

Veo 3.1通過以下渠道提供服務:
Flow:面向普通用戶的AI輔助視頻創作平台
Gemini API:為開發者提供視頻能力集成方案
Vertex AI:即將支持"場景延伸"等企業級功能

專業級輸出規格拓寬套用場景

Veo 3.1支持720p與1080p解析度輸出,幀速率穩定在24幀/秒。基礎視頻生成長度提供4秒、6秒或8秒選項,通過延伸功能最長可達148秒的連續片段。
特別值得一提的是,企業用戶上傳產品圖片或風格參考後,模型能夠準確保持這些視覺元素的一致性,這一特性對零售、廣告等行業的內容標準化生產極具價值。

移動端最佳化與畫質提升

Veo 3.1針對移動端使用場景進行了專門最佳化,支持以9:16的縱向比例生成“Ingredients to Video”視頻內容,專門適配手機豎屏顯示,契合各大短視頻平台的需求。用戶可使用視頻超解析度功能,將生成內容輸出至1080p乃至4K解析度,從而進一步提升畫面質量。

相關詞條

熱門詞條

聯絡我們