Qwen-Long是阿里雲於2024年5月21日發布的通義千問系列GPT-4級主力模型,其技術特性包括支持最高1000萬tokens長文本輸入,可處理約1500萬字或1.5萬頁文檔的多語言複雜場景。該模型通過異構晶片互聯、HPN7.0網路等自研技術實現推理成本最佳化,輸入價格直降97%至0.0005元/千tokens,約為GPT-4價格的1/400,1元人民幣可處理200萬tokens(相當於5本《新華字典》文字量)。阿里雲此次降價旨在加速AI套用普及,推動公共雲+API模式成為企業用模主流。
基本介紹
- 所屬公司:阿里雲
- 發布時間:2024年5月21日
- 長文本支持:1000萬tokens
- 降價幅度:輸入價降97%
- 輸入價格:0.0005元/千tokens
- 輸出價格:0.002元/千tokens
技術特性
- 長文本處理能力:支持最高1000萬tokens的超長文本輸入,可解析Word、PDF、Markdown等格式文檔,適用於多語言複雜上下文場景。
- 性能對標:技術指標與GPT-4保持同一級別,在文本理解、生成等核心能力上達到行業領先水平。
- 系統集成:深度整合阿里雲百鍊平台,提供從數據處理到模型調用的全鏈路服務能力。
價格調整
- 輸入價格:從0.02元/千tokens降至0.0005元/千tokens,降幅達97%,調用成本僅為GPT-4的1/400。
- 輸出價格:同步下調90%至0.002元/千tokens,形成輸入與輸出8:1的調用比例最佳化。
- 定價對比:輸入成本顯著低於同期GPT-4(0.22元/千tokens)、Gemini 1.5 Pro(0.12元/千tokens)等國際主流模型。
技術支撐
- 異構計算架構:採用自研的異構晶片互聯技術,實現GPU與ASIC晶片的高效協同計算。
- 網路最佳化:HPN7.0網路協定提升分散式訓練效率,降低數據傳輸延遲。
- 存儲系統:CPFS並行檔案系統支撐大規模數據處理,單集群吞吐量達TB/秒級。
行業影響
- 價格戰觸發:引發國內大模型行業降價潮,如百度文心大模型宣布免費、位元組跳動豆包模型價格下調至0.0008元/千tokens。
- 套用普及加速:阿里雲預測2024年日調用量將突破100億次,公共雲API模式降低企業用模門檻。
- 商業策略爭議:行業專家指出價格戰可能壓縮企業利潤空間,但傅盛認為"性能瓶頸倒逼技術降本",李開復預測"年降推理成本10倍"的技術趨勢。
市場定位
- 長文檔分析:支持法律契約、科研論文等超長文本的語義解析與摘要生成。
- 多輪對話:通過1000萬tokens上下文視窗實現跨會話狀態跟蹤,提升客服、教育等場景的互動連貫性。
- 成本敏感行業:1元處理200萬tokens的定價策略覆蓋中小企業的數位化轉型需求。
