GPT-oss-20b

GPT-oss-20b,是當地時間2025年8月5日OpenAI發布的開放權重AI模型。該模型總參數210億,每token激活36億參數,專為低延遲、本地化或專業場景設計,僅需16GB記憶體即可在邊緣設備(如消費級筆記本電腦或台式機)上運行。根據技術報告顯示,該模型與o3-mini性能相當,在AIME和HealthBench等測試中表現更佳。

基本介紹

  • 軟體名稱:GPT-oss-20b
  • 上線時間:2025年8月5日
  • 開發商:OpenAI
模型參數,發展歷程,性能測試,模型架構,模型特點,

模型參數

該模型總參數210億,每token激活36億參數,專為低延遲、本地化或專業場景設計,僅需16GB記憶體即可在邊緣設備(如消費級筆記本電腦或台式機)上運行。

發展歷程

當地時間2025年8月5日,OpenAI發布了開放權重AI模型GPT-oss-20b。
當地時間 2025年8月6日,微軟宣布通過 Windows AI Foundry 平台向 Windows 11 用戶提供 OpenAI 最新發布的免費開源大模型 gpt-oss-20b。通過該平台,用戶可以直接在本地電腦上調用 AI 功能、API,以及各類熱門開源模型。

性能測試

根據技術報告顯示,gpt-oss-20b與o3-mini性能相當,在AIME和HealthBench等測試中表現更佳。
測試結果顯示,gpt-oss-20b在終端側具備強大的推理能力,開發者將可通過主流模型平台獲取該模型,並在搭載相應處理器的設備上實現高效運行。

模型架構

gpt-oss模型採用混合專家(MoE)架構,基於Transformer框架,通過交替使用密集注意力和局部帶狀稀疏注意力機制,結合分組多查詢注意力(組大小為8)和旋轉位置編碼(RoPE),實現高效推理和記憶體利用,支持高達128,000 token的上下文長度(約300-400頁小說文本)。

模型特點

gpt-oss系列採用Apache 2.0許可,與中國開源模型(如DeepSeek、Qwen 3)一致,無copyleft限制或專利風險,相較於Meta Llama的複雜許可(月活躍用戶超7億需付費)更加企業友好。
任何消費者、開發者或企業可免費下載模型,進行參數級微調以適配特定用例,並用於商業服務或創收,無需向OpenAI支付費用。
更重要的是,模型支持本地運行,無需聯網,數據無需上傳至雲端,滿足金融、醫療、法律、軍事及政府等高度監管行業的數據隱私需求。

相關詞條

熱門詞條

聯絡我們