HunyuanVideo

HunyuanVideo

HunyuanVideo是由騰訊公司開發的開源視頻生成大模型。該模型基於深度學習技術,參數規模達130億,支持文本生成視頻、圖像生成視頻及視頻編輯功能,具備物理規律模擬和高動態畫面生成能力。它採用3D因果變分自編碼器架構和全注意力機制,支持480P至720P解析度視頻生成,套用於廣告創作、短視頻製作等領域。

2024年該模型完成開發,2025年1月3日上線Web端自定義文本生成視頻功能。同年5月28日,騰訊發布基於該模型的語音數字人HunyuanVideo-Avatar,結合MuseV技術支持多景別視頻生成。2024年該模型在GitHub開源,提供Apache 2.0協定代碼庫及預訓練模型權重,集成多模態大語言模型提升語義理解精度。

基本介紹

  • 外文名:HunyuanVideo
  • 所屬公司:騰訊
  • 類別:開源視頻生成大模型
  • 參數規模:達130億
發展歷史,產品功能,

發展歷史

2025年5月28日,騰訊混元發布並開源的語音數字人模型HunyuanVideo-Avatar,由騰訊混元視頻大模型(HunyuanVideo)及騰訊音樂天琴實驗室MuseV技術聯合研發。

產品功能

支持頭肩、半身與全身景別,以及多風格、多物種與雙人場景,面向視頻創作者提供高一致性、高動態性的視頻生成能力。

相關詞條

熱門詞條

聯絡我們