跳到正文
Daily Edition · AI industry record
Live desk ●
发布综合报道2 分钟阅读更新于作者:AI Tools Daily

Anthropic 发布 Claude 4:Opus 4 与 Sonnet 4 双旗舰登场

Anthropic 在首届 Code with Claude 开发者大会推出 Claude Opus 4 和 Sonnet 4,主打长时自主编程任务。

Anthropic 于 2025 年 5 月 22 日在首届 Code with Claude 开发者大会上发布 Claude 4 系列:旗舰 Opus 4 与高性价比 Sonnet 4,两者均为混合推理(hybrid-reasoning)模型。

Claude 4 主打持续数小时的自主 Agentic 任务:发布会上 Anthropic 展示了 Opus 4 连续工作数小时完成复杂编程任务的能力,被媒体称为当时“全球最强编程模型”。模型在遵循指令和减少幻觉方面也明显改进。

Anthropic 强调,Claude 4 延续了其在 AI 安全和对齐上的研究成果。

战略选择:把宝押在编程上

在对手们比拼多模态与消费级体验时,Anthropic 选择把 Claude 4 的发布舞台设在开发者大会——会名就叫 Code with Claude。同场 GA 的 Claude Code 把模型能力封装进终端工作流,而此前公司主导的 MCP 协议已成为工具连接事实标准(参见本站 MCP 生态报道)——模型、工具、协议三层同时落子,编程赛道的纵深布局自此成形。

长时自主性:新的竞争维度

Claude 4 把“连续工作数小时”写进发布会主题,标志着评价标准从基准分转向任务完成度:模型能否在无人干预下拆解目标、调用工具、自我纠错地工作半天。这条曲线后来被自家迭代不断拉长:Sonnet 4.5 宣称可自主工作 30 小时以上,Opus 4.5 继续加码——“长时自主性”自 Claude 4 起成为行业公认的竞争维度。

商业验证

这场押注的回报有目共睹:Anthropic 年化收入从 2025 年初的约 10 亿美元增至 8 月的超 50 亿,企业 API 与 Claude Code 是主引擎,9 月 F 轮估值冲上 1830 亿美元(参见本站相关报道);Cursor、Windsurf 等主流工具长期默认搭载 Claude 系模型。编程场景贡献了本轮 AI 商业化中最硬的企业收入。

本站解读

Claude 4 是“垂直深耕胜过全面铺开”的教科书案例:放弃部分消费级声量,换来开发者心智与付费意愿最强的场景。此后 Opus 4.1、Sonnet 4.5、Opus 4.5 以季度级节奏迭代,“编程最强”的心智牌被牢牢钉在 Anthropic 身上——而这张牌的奖金,就是编程这个商业化最确定赛道的定价权。

本文综合自官方公告及公开报道,原始来源见文末链接。

本文提到的工具