GPT-OSS 120B

GPT-OSS 120B

GPT-OSS 120B是OpenAI于2025年8月发布的开源旗舰推理模型,采用MoE架构(总参数1170亿/激活51亿),支持128K上下文,Apache 2.0协议可免费商用。推理能力接近o4-mini(MML…

浏览:19
点赞:0
地区:美国
🚀 访问官网 📱 手机查看
🏷️ 标签: Agent模型 Apache 2.0 GPT-OSS GPT-OSS 120B MoE大语言模型 OpenAI开源模型 函数调用 单卡部署 开源AI 推理模型

📋 工具信息卡片

模型名称:GPT-OSS 120B
模型类型:开源权重MoE大语言模型
开发方:OpenAI
开源协议:Apache 2.0
发布日期:2025年8月5日
总参数量:约1170亿
激活参数量:约51亿 / token
上下文窗口:128K tokens
硬件要求:单张80GB显存GPU(如H100/A100)
知识截止:2024年6月1日
核心定位:为推理、编码和函数调用优化的高性能开源模型,将强大的推理能力与Apache 2.0商用友好的开源协议相结合,使开发者能以低成本部署和定制顶级AI能力

GPT-OSS 120B 是什么

GPT-OSS 120B 是 OpenAI 于 2025 年 8 月 5 日发布的开源权重模型系列中的旗舰型号。它是一个为推理、编码和函数调用等场景优化的专家混合(MoE)大语言模型

该模型采用Apache 2.0协议开源,总参数量约1170亿,但每次推理仅激活约51亿参数,在保证高性能的同时大大降低了计算成本。GPT-OSS 120B 是 OpenAI 在开源领域的重要尝试,旨在为开发者提供一个性能强大、成本可控、可商用的解决方案。

⚡ 核心优势

🧠 强大的推理能力

  • 在核心推理基准测试中表现接近 OpenAI 的 o4-mini 模型。
  • MMLU(通用推理):接近 90%
  • AIME(数学推理):超过 95%
  • 复杂逻辑推理(XSCT Bench):97.0

💰 成本与效率

  • 高效部署:模型可在一块 80GB 显存的 GPU(如NVIDIA H100/A100)上高效运行。
  • 低推理成本:通过仅对 MoE 权重进行 4-bit 量化等技术,大幅降低部署和推理成本。
  • 速度表现:在单张 A100 80GB 上,生成速度可达 23 tokens/秒

🤖 智能体Agent)能力

  • 函数调用(Function Calling):能理解并调用外部工具或API
  • 代码执行(Python Code Execution):能直接运行 Python 代码来完成任务。
  • 网络搜索(Web Browsing):可主动联网获取最新信息。
  • 结构化输出(Structured Outputs):能以 JSON 等格式返回数据,方便程序处理。

🛡️ 安全与开源协议

  • Apache 2.0 许可:宽松的商业友好协议,允许自由使用、修改和分发,包括用于商业目的。
  • 安全评估:OpenAI 对模型进行了全面的安全训练和评估,其安全基准表现与 OpenAI 的前沿闭源模型相当。

如何开始使用

  • 🌐 在线试用:可通过 Hugging Face 上的 Playground 或 gpt-oss.com 等平台在线体验。主流云平台如 Google Cloud Vertex AIAWS Bedrock 等也已支持。
  • 💻 本地部署使用 OllamaHugging Face Transformers 等工具在本地运行。企业级部署可考虑 NVIDIA TensorRT-LLM 以获得最佳性能。
  • 📦 模型下载Hugging FaceModelScope 搜索 "gpt-oss-120b" 下载模型权重。

✅ 优点

  • Apache 2.0 开源,可免费商用
  • 推理能力接近 o4-mini,性能强大
  • 单卡80GB显存即可部署,硬件门槛低
  • 原生支持函数调用、代码执行等Agent能力
  • OpenAI出品,安全性与可靠性有保障

⚠️ 注意事项

  • 128K上下文相比部分竞品(如1M)较短
  • 中文能力未经专门优化,需自行微调
  • 需自行部署和维护,有一定技术门槛
  • 部分高级功能(如联网)需自行实现

常见问题

Q:GPT-OSS 120B可以免费商用吗?

A:可以。模型采用 Apache 2.0 协议开源,允许自由使用、修改和分发,包括商业用途。

Q:需要什么硬件才能运行?

A:模型可在单张80GB显存的GPU(如NVIDIA H100、A100)上高效运行。

Q:GPT-OSS 120B和o4-mini有什么区别?

A:o4-mini是OpenAI的闭源推理模型,性能更强但不可商用部署。GPT-OSS 120B是开源版本,性能接近o4-mini,但可自由部署、修改和商用。

Q:模型支持中文吗?

A:模型以英文为主,具备基本的中文理解能力。如需高精度中文处理,建议在中文数据上进行微调。

相关工具推荐

  • Ollama:本地运行大模型的最便捷工具之一,支持GPT-OSS 120B。
  • Hugging Face Transformers:最流行的开源模型加载与推理库。
  • NVIDIA TensorRT-LLM:企业级高性能推理优化框架。
  • vLLM:高吞吐量、低延迟的LLM推理引擎。

✍️ 点评

GPT-OSS 120B 是 OpenAI 在开源领域的里程碑式贡献。它将接近 o4-mini 的推理能力与 Apache 2.0 商用友好的开源协议相结合,让开发者能够在单张80GB显存GPU上部署一个世界顶级的推理模型。

其 MoE 架构设计在性能与成本的平衡上表现出色——每次推理仅激活51亿参数,却能达到1170亿参数模型的性能水平。原生支持的函数调用、代码执行等 Agent 能力,使其成为构建自主AI智能体的理想基座。

对于开发者、研究机构和企业用户而言,GPT-OSS 120B 提供了一个性能强大、成本可控、可商用的开源选择,有望成为开源社区构建下一代AI应用的重要基础设施。

一句话总结:GPT-OSS 120B——OpenAI开源的旗舰推理模型,MoE架构实现单卡部署,Apache 2.0协议免费商用,让顶级AI能力触手可及。

相关导航

暂无评论

暂无评论...
NavCN AI工具导航

NavCN是一个专业的AI工具导航网站,收录最新AI工具和热门AI应用,涵盖AI写作、AI绘画、AI视频、AI办公、AI编程等1000+AI工具,并提供AI工具推荐、评测和教程,帮助用户快速找到好用的AI工具。

Copyright © 2026 NavCN 桂ICP备2026002643号-2  Design by NavCN