Qwen-Long

Qwen-Long是阿里雲於2024年5月21日發布的通義千問系列GPT-4級主力模型,其技術特性包括支持最高1000萬tokens長文本輸入,可處理約1500萬字或1.5萬頁文檔的多語言複雜場景。該模型通過異構晶片互聯、HPN7.0網路等自研技術實現推理成本最佳化,輸入價格直降97%至0.0005元/千tokens,約為GPT-4價格的1/400,1元人民幣可處理200萬tokens(相當於5本《新華字典》文字量)。阿里雲此次降價旨在加速AI套用普及,推動公共雲+API模式成為企業用模主流。

基本介紹

  • 所屬公司:阿里雲
  • 發布時間:2024年5月21日
  • 長文本支持:1000萬tokens
  • 降價幅度:輸入價降97%
  • 輸入價格:0.0005元/千tokens
  • 輸出價格:0.002元/千tokens
技術特性,價格調整,技術支撐,行業影響,市場定位,

技術特性

  • 長文本處理能力:支持最高1000萬tokens的超長文本輸入,可解析Word、PDF、Markdown等格式文檔,適用於多語言複雜上下文場景。
  • 性能對標:技術指標與GPT-4保持同一級別,在文本理解、生成等核心能力上達到行業領先水平。
  • 系統集成:深度整合阿里雲百鍊平台,提供從數據處理到模型調用的全鏈路服務能力。

價格調整

2024年5月21日,阿里雲宣布Qwen-Long的API價格體系調整:
  • 輸入價格:從0.02元/千tokens降至0.0005元/千tokens,降幅達97%,調用成本僅為GPT-4的1/400。
  • 輸出價格:同步下調90%至0.002元/千tokens,形成輸入與輸出8:1的調用比例最佳化。
  • 定價對比:輸入成本顯著低於同期GPT-4(0.22元/千tokens)、Gemini 1.5 Pro(0.12元/千tokens)等國際主流模型。

技術支撐

  • 異構計算架構:採用自研的異構晶片互聯技術,實現GPU與ASIC晶片的高效協同計算。
  • 網路最佳化:HPN7.0網路協定提升分散式訓練效率,降低數據傳輸延遲。
  • 存儲系統:CPFS並行檔案系統支撐大規模數據處理,單集群吞吐量達TB/秒級。

行業影響

  • 價格戰觸發:引發國內大模型行業降價潮,如百度文心大模型宣布免費、位元組跳動豆包模型價格下調至0.0008元/千tokens。
  • 套用普及加速:阿里雲預測2024年日調用量將突破100億次,公共雲API模式降低企業用模門檻。
  • 商業策略爭議:行業專家指出價格戰可能壓縮企業利潤空間,但傅盛認為"性能瓶頸倒逼技術降本",李開復預測"年降推理成本10倍"的技術趨勢。

市場定位

作為通義千問長文本增強版模型,Qwen-Long聚焦企業級套用場景:
  • 長文檔分析:支持法律契約、科研論文等超長文本的語義解析與摘要生成。
  • 多輪對話:通過1000萬tokens上下文視窗實現跨會話狀態跟蹤,提升客服、教育等場景的互動連貫性。
  • 成本敏感行業:1元處理200萬tokens的定價策略覆蓋中小企業的數位化轉型需求。

相關詞條

熱門詞條

聯絡我們