HunyuanVideo是由騰訊公司開發的開源視頻生成大模型。該模型基於深度學習技術,參數規模達130億,支持文本生成視頻、圖像生成視頻及視頻編輯功能,具備物理規律模擬和高動態畫面生成能力。它採用3D因果變分自編碼器架構和全注意力機制,支持480P至720P解析度視頻生成,套用於廣告創作、短視頻製作等領域。
2024年該模型完成開發,2025年1月3日上線Web端自定義文本生成視頻功能。同年5月28日,騰訊發布基於該模型的語音數字人HunyuanVideo-Avatar,結合MuseV技術支持多景別視頻生成。2024年該模型在GitHub開源,提供Apache 2.0協定代碼庫及預訓練模型權重,集成多模態大語言模型提升語義理解精度。
基本介紹
- 外文名:HunyuanVideo
- 所屬公司:騰訊
- 類別:開源視頻生成大模型
- 參數規模:達130億
發展歷史,產品功能,
發展歷史
2025年5月28日,騰訊混元發布並開源的語音數字人模型HunyuanVideo-Avatar,由騰訊混元視頻大模型(HunyuanVideo)及騰訊音樂天琴實驗室MuseV技術聯合研發。
產品功能
支持頭肩、半身與全身景別,以及多風格、多物種與雙人場景,面向視頻創作者提供高一致性、高動態性的視頻生成能力。

