anti-ai.app

· 观察

Claude Opus 5 成为 Claude Code 默认前沿编码模型

威胁

发布至今约两周,尚无任何第三方影响证据。Anthropic 自评基准指向 AI 编程 IDE wrapper、长上下文 RAG 中间件、窄域计算机视觉自动化工具可能面临价格和工作流压力,但以下每一条都是带独立可检验回看日期的预测,不是已确认的损害。

发生了什么变化

原生 100 万 token 上下文进入 Claude Code 默认路径,而非需要另外开通的功能;Anthropic 公布的 FreeCAD 案例显示,模型在没有直接读图能力的情况下,在任务中途自行搭建了一套计算机视觉流水线,并调试出一个竞品模型遗漏的根因问题。

Anthropic 于 2026-07-24 发布 Claude Opus 5,成为 Claude Code 中新的默认 Opus 模型,Anthropic 官方产品发布与 anthropics/claude-code 的 GitHub changelog(v2.1.219)两个独立来源均已确认。已核实的触发事实:原生 100 万 token 上下文、fast mode 定价每百万 token $10/$50(基础价两倍、速度约 2.5 倍),以及 Anthropic 自评在 Frontier-Bench v0.1、ARC-AGI-3、OSWorld 2.0、CursorBench 3.2、Zapier AutomationBench 上的领先表现。除这些触发事实外,发布至今约两周,尚无任何独立的受影响方证据——没有观察到竞品调价、融资变化或流量下滑。以下所有“影响”内容都是带日期的预测,不是定案:AI 编程 IDE wrapper 类回看日期为 2026-09-15,长上下文 RAG 中间件与窄域 RPA/计算机视觉工具类回看日期为 2026-10-06。在其中任一回看日期出现真实的受影响方信号之前,整体 verdict 维持 Watchlist。

被波及的类别

  • AI 编程 IDE wrapper: Anthropic 自评的 CursorBench 3.2 得分与一个指名前沿竞品相差仅 0.5%,但推理成本约为其一半;如果该基准在独立使用中站得住,仍绑定旧一代模型定价的编程 IDE 竞品将同时面临成本和质量劣势。这是预测:请在 2026-09-15(发布满 8 周)前观察 Cursor、Windsurf 等同类工具是否公开调价、更换底层模型或做出竞争回应。
  • 长上下文中间件 / RAG 分片工具: 原生 100 万 token 上下文作为 Claude Code 默认路径而非另开权限的功能,降低了官方所述“用检索与分片模拟长上下文”这类中间件的必要性。这是预测:请在 2026-10-06(发布满 10 周)前观察同类 RAG 分片厂商是否出现增长放缓信号,或“长上下文 vs RAG”类对比查询是否增多。
  • 窄域 RPA / 计算机视觉自动化工具: Anthropic 公布的 FreeCAD 案例中,模型在发现自己无法直接读图后,当场自行搭建了一套计算机视觉流水线,这是通用 agent 现场拼装出窄域工具能力的具体例证,而非泛泛的营销语言。这是预测:请在 2026-10-06 前观察是否有独立开发者/社区复现类似“通用 agent 现场解决窄域自动化任务”的报告,或窄域 RPA/计算机视觉工具厂商是否有公开回应。

被波及的品牌 / 服务

  • Cursor (cursor.com)
  • Windsurf (windsurf.com)
  • LlamaIndex (llamaindex.ai)
  • UiPath (uipath.com)

来源