GPT-OSS 120B
GPT-OSS 120B是OpenAI于2025年8月发布的开源旗舰推理模型,采用MoE架构(总参数1170亿/激活51亿),支持128K上下文,Apache 2.0协议可免费商用。推理能力接近o4-mini(MML…
📋 工具信息卡片
GPT-OSS 120B 是什么
GPT-OSS 120B 是 OpenAI 于 2025 年 8 月 5 日发布的开源权重模型系列中的旗舰型号。它是一个为推理、编码和函数调用等场景优化的专家混合(MoE)大语言模型。
该模型采用Apache 2.0协议开源,总参数量约1170亿,但每次推理仅激活约51亿参数,在保证高性能的同时大大降低了计算成本。GPT-OSS 120B 是 OpenAI 在开源领域的重要尝试,旨在为开发者提供一个性能强大、成本可控、可商用的解决方案。
⚡ 核心优势
🧠 强大的推理能力
- 在核心推理基准测试中表现接近 OpenAI 的 o4-mini 模型。
- MMLU(通用推理):接近 90%
- AIME(数学推理):超过 95%
- 复杂逻辑推理(XSCT Bench):97.0 分
💰 成本与效率
- 高效部署:模型可在一块 80GB 显存的 GPU(如NVIDIA H100/A100)上高效运行。
- 低推理成本:通过仅对 MoE 权重进行 4-bit 量化等技术,大幅降低部署和推理成本。
- 速度表现:在单张 A100 80GB 上,生成速度可达 23 tokens/秒。
🛡️ 安全与开源协议
- Apache 2.0 许可:宽松的商业友好协议,允许自由使用、修改和分发,包括用于商业目的。
- 安全评估:OpenAI 对模型进行了全面的安全训练和评估,其安全基准表现与 OpenAI 的前沿闭源模型相当。
如何开始使用
- 🌐 在线试用:可通过 Hugging Face 上的 Playground 或 gpt-oss.com 等平台在线体验。主流云平台如 Google Cloud Vertex AI、AWS Bedrock 等也已支持。
- 💻 本地部署:使用 Ollama 或 Hugging Face Transformers 等工具在本地运行。企业级部署可考虑 NVIDIA TensorRT-LLM 以获得最佳性能。
- 📦 模型下载:在 Hugging Face 或 ModelScope 搜索 "gpt-oss-120b" 下载模型权重。
✅ 优点
- Apache 2.0 开源,可免费商用
- 推理能力接近 o4-mini,性能强大
- 单卡80GB显存即可部署,硬件门槛低
- 原生支持函数调用、代码执行等Agent能力
- OpenAI出品,安全性与可靠性有保障
⚠️ 注意事项
- 128K上下文相比部分竞品(如1M)较短
- 中文能力未经专门优化,需自行微调
- 需自行部署和维护,有一定技术门槛
- 部分高级功能(如联网)需自行实现
常见问题
Q:GPT-OSS 120B可以免费商用吗?
A:可以。模型采用 Apache 2.0 协议开源,允许自由使用、修改和分发,包括商业用途。
Q:需要什么硬件才能运行?
A:模型可在单张80GB显存的GPU(如NVIDIA H100、A100)上高效运行。
Q:GPT-OSS 120B和o4-mini有什么区别?
A:o4-mini是OpenAI的闭源推理模型,性能更强但不可商用部署。GPT-OSS 120B是开源版本,性能接近o4-mini,但可自由部署、修改和商用。
Q:模型支持中文吗?
A:模型以英文为主,具备基本的中文理解能力。如需高精度中文处理,建议在中文数据上进行微调。
相关工具推荐
- Ollama:本地运行大模型的最便捷工具之一,支持GPT-OSS 120B。
- Hugging Face Transformers:最流行的开源模型加载与推理库。
- NVIDIA TensorRT-LLM:企业级高性能推理优化框架。
- vLLM:高吞吐量、低延迟的LLM推理引擎。
✍️ 点评
GPT-OSS 120B 是 OpenAI 在开源领域的里程碑式贡献。它将接近 o4-mini 的推理能力与 Apache 2.0 商用友好的开源协议相结合,让开发者能够在单张80GB显存GPU上部署一个世界顶级的推理模型。
其 MoE 架构设计在性能与成本的平衡上表现出色——每次推理仅激活51亿参数,却能达到1170亿参数模型的性能水平。原生支持的函数调用、代码执行等 Agent 能力,使其成为构建自主AI智能体的理想基座。
对于开发者、研究机构和企业用户而言,GPT-OSS 120B 提供了一个性能强大、成本可控、可商用的开源选择,有望成为开源社区构建下一代AI应用的重要基础设施。
一句话总结:GPT-OSS 120B——OpenAI开源的旗舰推理模型,MoE架构实现单卡部署,Apache 2.0协议免费商用,让顶级AI能力触手可及。