Claude Opus 4.6
Claude Opus 4.6 是 Anthropic 于 2026 年 2 月 5 日发布的旗舰级大语言模型。首次在 Opus 系列中支持 100 万(1M)token 上下文窗口,按标准价格计费,无长上下文溢价。
📋 工具信息卡片
Claude Opus 4.6 是什么
Claude Opus 4.6 是 Anthropic 于 2026 年 2 月 5 日发布的旗舰级大语言模型。它建立在 Opus 4.5 的智能基础之上,为编码、智能体(Agent)和企业工作流带来了全新水平的可靠性与精确度。
Opus 4.6 是Anthropic迄今为止最强大的模型,在代理编码、计算机使用、工具调用、搜索和金融等领域均处于行业领先地位。它在多项评估中达到了最先进的水平,包括智能编码、多学科推理、知识工作和智能搜索等。
⚡ 核心特性
- 🧠 1M 超长上下文窗口:首次在 Opus 系列中支持 100 万 token 上下文窗口,且按标准价格计费,无长上下文溢价。在 1M token 的 MRCR v2 检索任务中得分 78.3%,为同类模型最高。
- 📄 128K 最大输出:最大输出 token 数从 64K 翻倍至 128K,非常适合生成长篇内容、详细代码或综合分析。
- 🎯 自适应思考(Adaptive Thinking):模型能根据上下文线索自动判断需要使用多少扩展思考。开发者可通过 /effort 参数精确控制推理强度,在智能、速度和成本之间灵活平衡。
- 🔧 上下文压缩(Context Compaction):API 支持 Claude 自行总结上下文,执行更长运行时间的任务而不会触及限制。
- 🌐 多模态与文件支持:支持文本、图像、音频、视频输入,单次请求最多可处理 600 张图片或 PDF 页面(此前为 100 张)。
- 🤖 智能体与编码优化:在智能体编码、计算机使用、代码审查和调试方面进行了专门优化,能在大型代码库中更可靠地运行。在 SWE-bench 编码基准中得分 80.8%。
📊 性能表现
- 🏆 多项基准测试领先:在智能体编码评估 Terminal-Bench 2.0 中得分最高;在复杂多学科推理测试 Humanity's Last Exam 中领先所有前沿模型。
- 📈 经济价值领先:在评估金融、法律等领域经济价值知识工作表现的 GDPval-AA 测试中,Opus 4.6 比行业次优模型(OpenAI GPT-5.2)高出约 144 Elo 分。
- 🔍 信息检索能力:在衡量模型查找在线难以定位信息能力的 BrowseComp 中表现优于任何其他模型。
- 💻 编程能力:SWE-bench 编码基准得分 80.8%,超越 Sonnet 4.6(79.6%)等模型。在 AIME 2026 数学推理测试中得分 96.4%。
价格方案
Opus 4.6 采用标准 API 定价,1M 上下文窗口无额外溢价:
| 计费项目 | 价格(每百万 tokens) |
|---|---|
| 输入 (Input) | $5.00 |
| 输出 (Output) | $25.00 |
💡 提示缓存(Prompt Caching)可节省高达 90% 的成本,批量处理(Batch Processing)可节省 50%。标准定价适用于整个 1M 窗口,900K token 的请求与 9K token 的请求按相同单价计费。
🌐 可用性
- Claude 平台:claude.ai 及 Claude API
- 云平台:Amazon Bedrock、Google Cloud Vertex AI、Microsoft Foundry
- Claude Code:Max、Team 和 Enterprise 用户可使用 Opus 4.6 及其 1M 上下文
- 模型 ID (Amazon Bedrock):
anthropic.claude-opus-4-6-v1
✅ 优点
- 1M 超长上下文,无额外溢价
- 128K 最大输出,翻倍提升
- 多项基准测试行业领先
- 自适应思考与 effort 控制
- 支持多模态输入
- 企业级安全与可靠性
⚠️ 注意事项
- 旗舰模型定价较高
- 推理速度慢于 Sonnet 系列
- 部分用户反馈性能波动
- 后续已有 Opus 4.7、4.8 等更新版本
常见问题
Q:Opus 4.6 的 1M 上下文需要额外付费吗?
A:不需要。1M 上下文窗口已全面开放,按标准价格计费,无任何长上下文溢价。
Q:Opus 4.6 和 Sonnet 4.6 的主要区别是什么?
A:Opus 4.6 是旗舰模型,性能更强(SWE-bench 80.8% vs 79.6%),定价更高($5/$25 vs $3/$15),推理速度较慢。
Q:Opus 4.6 支持哪些输入模态?
A:支持文本、图像、音频、视频输入,单次请求最多可处理 600 张图片或 PDF 页面。
Q:Opus 4.6 现在还能用吗?
A:Opus 4.6 仍可通过 API 和云平台访问。Anthropic 已发布 Opus 4.7、4.8 和 Opus 5 等更新版本。
相关工具推荐
- Claude Code:Anthropic 官方 AI 编程助手,深度集成 Opus 4.6。
- Claude Sonnet 4.6:性价比更优的中端模型。
- Amazon Bedrock:可访问 Opus 4.6 的主要云平台。
- Google Cloud Vertex AI:另一个支持 Opus 4.6 的云平台。
✍️ 点评
Claude Opus 4.6 是 Anthropic 在旗舰模型领域的里程碑式发布。它首次将 1M 上下文窗口引入 Opus 系列,并以标准价格计费,彻底改变了长上下文任务的成本结构。128K 的最大输出翻倍,使其在生成长篇内容时更加实用。
在性能上,Opus 4.6 在编码(SWE-bench 80.8%)、经济价值知识工作(GDPval-AA 领先 GPT-5.2 约 144 Elo 分)和复杂推理等多个维度均达到行业领先水平。自适应思考和 /effort 参数控制为开发者提供了前所未有的灵活性。
对于需要处理超长上下文、复杂推理和高难度编码任务的企业和开发者而言,Claude Opus 4.6 提供了一个功能强大、定价透明、生态完善的旗舰模型选择。
一句话总结:Claude Opus 4.6——Anthropic 旗舰推理模型,1M 上下文无溢价、128K 输出翻倍、多项基准领先,为智能体与企业级工作流树立新标杆。
📊 正文约 1500 字