Claude 3.7 Sonnet
Claude 3.7 Sonnet官网,全球首个混合推理模型,编程能力一流
模型背景与发布
Claude 3.7 Sonnet 是由 Anthropic 公司开发的最新 AI 模型,于 2025 年 2 月 24 日正式发布。该模型被定位为“迄今最智能的模型”,并首次引入了混合推理功能,结合了普通大型语言模型(LLM)和专门的推理模型能力。
Claude 3.7 Sonnet官网: https://claude.ai/

核心功能与技术特点
混合推理模式
- 标准模式:提供近乎即时的响应,适合快速交互。
- 扩展思考模式:允许模型逐步推理,展示思维过程,特别适用于复杂问题。这一模式显著提升了数学、物理和指令遵循任务的性能。
上下文窗口与输出能力
- 支持高达 200K 的上下文窗口,输出容量较前代增加 15 倍,最高可达 128K 令牌(其中 64K 为一般可用,128K 为 beta 版本)。
编程与开发支持
- 在 SWE-bench Verified 基准测试中,标准模式达到 70.3% 的成绩(使用高计算资源),在 TAU-bench 中表现优异。
- 支持长达 128K 令牌的代码生成,适合大型代码生成任务。
- 与 Claude 3.7 Sonnet 同时推出的还有 Claude Code,这是一个用于代理编程的命令行工具,能够让开发者直接从终端将重要的工程任务委托给 Claude。
性能与基准测试
- 在多个基准测试中表现出色,特别是在实际应用场景中:
- 数学与科学:扩展思考模式显著提升了数学和物理问题的解决能力。
- 多模态与代理编码:在指令遵循、一般推理和多模态任务中表现出色。
- 编码能力:在处理复杂代码库和使用高级工具方面展现出显著优势,编码能力全面超越其他现有模型。
可用性与集成
- Anthropic 平台:适用于所有计划(免费、专业、团队、企业),通过 Claude.ai(网页、iOS、Android)提供聊天体验。
- 云服务:集成至 Amazon Bedrock 和 Google Cloud 的 Vertex AI。
- API 访问:通过 Anthropic API 提供,文档详见 API 文档。
定价与成本优化
- 定价与 Claude 3.5 Sonnet 一致:
- 每百万输入令牌 3 美元。
- 每百万输出令牌 15 美元(包括思考令牌)。
- 成本优化选项包括:
- 提示缓存可节省高达 90% 成本。
- 批量处理可节省 50% 成本。
安全与可靠性
- 与前代相比,减少了 45% 的不必要拒绝,提升了用户体验。
- 经过外部专家的广泛测试,满足安全、可靠性和安全性标准。
应用场景
- 编码生成:支持长达 128K 令牌的输出,适合大型代码生成任务。
- 高级聊天机器人:增强知识问答、视觉数据提取和客户服务代理。
- 内容生成与分析:适用于研究总结、金融建模和机器人流程自动化。
- 多模态任务:在医疗影像分析、研究总结和代码审查中具有应用潜力。
总结
Claude 3.7 Sonnet 是 Anthropic 在 AI 领域的又一力作,其混合推理模式和强大的编程能力使其在复杂任务处理上表现出色。无论是快速响应还是深度思考,Claude 3.7 Sonnet 都能为用户提供灵活且高效的解决方案。

官方原文
今天,我们宣布推出 Claude 3.7 Sonnet1,这是我们迄今为止最智能的模型,也是市场上第一个混合推理模型。Claude 3.7 Sonnet 可以产生几乎即时的响应或逐步的、分步的思考,这些思考对用户来说是可见的。API 用户还可以精细控制模型思考的时间长度。
Claude 3.7 Sonnet 在编码和前端网页开发方面表现出特别显著的改进。除了模型,我们还推出了一款用于代理编码的命令行工具,即 Claude Code。Claude Code 作为有限的研究预览版提供,允许开发者直接从终端将大量工程任务委托给 Claude。

Claude 3.7 Sonnet 现已在所有 Claude 计划中可用——包括免费、专业、团队和企业版——以及 Anthropic API、Amazon Bedrock 和 Google Cloud 的 Vertex AI。扩展思考模式在除免费 Claude 级别之外的所有表面上都可用。
在标准模式和扩展思维模式下,Claude 3.7 Sonnet 的价格

与其前辈相同:每百万输入令牌 3 美元,每百万输出令牌 15 美元——包括思维令牌。
Claude 3.7 Sonnet:前沿推理变得实用
我们开发了具有不同哲学思想的 Claude 3.7 Sonnet,与市场上其他推理模型不同。正如人类使用一个大脑进行快速反应和深入思考一样,我们认为推理应该是前沿模型的一个集成能力,而不是一个完全独立的模型。这种统一的方法也为用户创造了一个更加无缝的体验。
Claude 3.7 Sonnet 以多种方式体现这一理念。首先,Claude 3.7 Sonnet 既是普通 LLM 又是推理模型:你可以选择何时让模型正常回答,何时让它在回答前思考更长时间。在标准模式下,Claude 3.7 Sonnet 代表了 Claude 3.5 Sonnet 的升级版。在扩展思考模式下,它在回答前会进行自我反思,这提高了它在数学、物理、指令遵循、编码和其他许多任务上的表现。我们通常发现,在这两种模式下,对模型的提示效果相似。
其次,通过 API 使用 Claude 3.7 Sonnet 时,用户还可以控制思考的预算:您可以告诉 Claude 思考不超过 N 个 token,对于 N 的任何值,直到其输出限制的 128K 个 token。这允许您在回答的质量(以及成本)和速度之间进行权衡。
第三,在开发我们的推理模型时,我们相对较少优化数学和计算机科学竞赛问题,而是将重点转向更反映企业实际使用LLMs的现实世界任务。
早期测试展示了 Claude 在编码能力方面的全面领导力:Cursor 指出,Claude 再次在现实世界的编码任务中处于最佳水平,从处理复杂代码库到高级工具使用,各方面都有显著提升。认知发现,在规划代码更改和处理全栈更新方面,Claude 远优于其他任何模型。Vercel 强调了 Claude 在复杂代理工作流程中的卓越精确度,而 Replit 已成功部署 Claude 从头开始构建复杂的 Web 应用程序和仪表板,其他模型则停滞不前。在 Canva 的评估中,Claude 始终生产出成品级的代码,具有卓越的设计品味,并大幅减少了错误。



克劳德代码
自 2024 年 6 月起,Sonnet 已成为全球开发者的首选模型。今天,我们通过推出 Claude Code——我们的首款代理编码工具——在有限的研究预览中进一步赋能开发者。
Claude 代码是一个活跃的协作伙伴,可以搜索和阅读代码,编辑文件,编写和运行测试,将代码提交并推送到 GitHub,并使用命令行工具——在每一步都让您保持同步。
克劳德代码是一款早期产品,但已经成为了我们团队不可或缺的工具,尤其是在测试驱动开发、调试复杂问题和大规模重构方面。在早期测试中,克劳德代码一次就完成了通常需要 45 分钟以上手动工作才能完成的任务,减少了开发时间和开销。
在接下来的几周内,我们计划根据我们的使用情况不断改进它:提高工具调用的可靠性、添加对长时间运行命令的支持、改进应用内渲染,并扩展 Claude 对其自身能力的理解。
我们的目标是更好地理解开发者如何使用 Claude 进行编码,以指导未来模型改进。通过加入这个预览,您将获得我们构建和改进 Claude 所使用的相同强大工具,您的反馈将直接塑造其未来。
与 Claude 合作处理您的代码库
我们还在 Claude.ai 上提升了编码体验。我们的 GitHub 集成现在适用于所有 Claude 计划——允许开发者直接将代码仓库连接到 Claude。
Claude 3.7 诗篇是我们迄今为止最好的编码模型。通过更深入地了解您的个人、工作和开源项目,它成为您在最重要的 GitHub 项目中进行错误修复、开发功能和构建文档的更强大伙伴。
负责任地建设
我们对 Claude 3.7 Sonnet 进行了广泛的测试和评估,与外部专家合作,确保其符合我们的安全、安全和可靠性标准。Claude 3.7 Sonnet 在区分有害和良性请求方面也更加细腻,与前辈相比,减少了 45%的不必要拒绝。
该版本的系统卡片涵盖了多个类别中的新安全成果,提供了我们负责任扩展政策评估的详细分解,其他 AI 实验室和研究人员可以将其应用于他们的工作。卡片还讨论了伴随计算机使用出现的潜在风险,特别是提示注入攻击,并解释了如何评估这些漏洞以及如何训练 Claude 来抵抗和减轻这些风险。此外,它还探讨了推理模型可能带来的潜在安全效益:理解模型如何做出决策的能力,以及模型推理是否真正值得信赖和可靠。阅读完整的系统卡片以了解更多信息。
展望未来
Claude 3.7 Sonnet和 Claude 代码标志着向真正增强人类能力的人工智能系统迈出的重要一步。凭借其深入推理、自主工作和有效协作的能力,它们让我们更接近一个未来,在那里人工智能丰富了人类所能实现的事情。
我们期待您探索这些新功能,并看看您将如何使用它们。一如既往,我们欢迎您在模型持续改进和发展的过程中提供反馈。
数据评估
本站非猪ai导航提供的Claude 3.7 Sonnet都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由非猪ai导航实际控制,在2025年2月26日 上午12:02收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,非猪ai导航不承担任何责任。
