For the complete documentation index, see llms.txt. This page is also available as Markdown.

1.1 Anthropic 与 Claude 的诞生

1.1.1 硅谷的“异类”:Anthropic 的起源

故事始于 2021 年。那一年,人工智能领域正处于爆发的前夜,一场关于 AI 未来发展方向的变革正在旧金山酝酿。

从 OpenAI 到 Anthropic

Anthropic 的创始人是 Dario Amodei(前 OpenAI 研究副总裁,GPT-2 和 GPT-3 核心研发负责人)和他的妹妹 Daniela Amodei(前 OpenAI 安全与政策副总裁)。然而,随着 AI 模型能力的指数级增长,他们对 AI 安全性的担忧也日益加深。

在 OpenAI 内部,关于“商业化速度”与“安全研究”的优先级之争逐渐显现。Amodei 兄妹坚信,如果不从根本上解决 AI 的可控性(Steerability)和可解释性(Interpretability),盲目追求更强的算力和更大的参数规模可能会给人类带来不可预知的风险。

于是,带着“构建可靠、可解释和可操纵的 AI 系统”的愿景,他们带领一群志同道合的核心研究员(包括 GPT-3 的首席作者 Tom Brown 等人)离开了 OpenAI,创立了 Anthropic

“公益”性质的企业架构

Anthropic 并非一家传统的初创公司。它注册为 Public Benefit Corporation (PBC),即“公益公司”。这意味着在法律层面,公司的董事会有义务平衡股东利益与公共利益。这种架构确保了即使在巨大的商业诱惑面前,Anthropic 仍能坚守“AI 安全第一”的底线。

1.1.2 核心理念:宪法式 AI

如果说 ChatGPT 的核心技术是 RLHF(人类反馈强化学习),那么 Claude 的核心差异化技术就是 Constitutional AI (CAI)

RLHF 的局限性

传统的 RLHF 依赖大量人类标注员来给 AI 的回复打分,存在难以扩展和价值观黑盒等问题。

用 AI 来监督 AI

Constitutional AI 提出了一种革命性的方法:Anthropic 制定了一套明确的原则(即“宪法”),涵盖联合国人权宣言、隐私规范、Sparrow 原则以及非西方视角的多元文化价值观。模型根据这套“宪法”进行 自我批评自我修正,再通过 RLAIF(AI 反馈强化学习)进行优化。这种方法使 Claude 的行为更加稳定、透明且符合预期。

关于 Constitutional AI 的详细训练流程和技术原理,请参见 第十一章:宪法式 AI

1.1.3 为什么叫“Claude”?

这个名字是对信息论之父 Claude Shannon (克劳德·香农) 的致敬。

香农在 1948 年发表的《通信的数学理论》奠定了现代数字世界的基石。他提出的“比特(Bit)”概念,得以量化信息。Anthropic 选择这个名字,寓意着希望这款 AI 能像香农的理论一样,成为人类与信息交互的 基础性工具——精确、高效且充满智慧。

这也解释了为什么 Claude 在处理长文本、逻辑推理和代码任务时表现出一种冷静、客观(甚至略显严谨)的“工程师气质”。

1.1.4 为什么选择 Claude?

在 2026 年的 AI 战场上,Claude 凭借独特的优势占据了半壁江山。

技术层面的护城河

  • 超长上下文 (Context Window):Claude 是最早突破 100K 和 200K Token 窗口的模型。这使得它能够一次性读完整本技术书籍、分析庞大的代码库或处理复杂的法律合同。这不仅仅是“记忆力”好,更是“全局理解力”的质变。

  • Artifacts (工件):2024 年推出的 Artifacts 改变了人机交互的形态。代码、SVG 图表、React 组件不再是单纯的文本流,而是变成了可独立预览、编辑的“实体”。这让 Claude 从“对话者”变成了“协作者”。

  • 无与伦比的代码能力:在 SWE-bench 等权威基准测试中,Claude 持续霸榜。其生成的代码逻辑严密,且更擅长遵循复杂的工程规范。

企业级安全

得益于 Constitutional AI,Claude 对于企业客户来说是 最安全 的选择。它极少出现“越狱”行为,不会随意泄露敏感信息,这让金融、医疗和法律等高合规要求的行业对其青睐有加。

生态系统

随着 Model Context Protocol (MCP) 的推出,Claude 正在成为连接万物的枢纽。它不再局限于浏览器,而是能通过 MCP 深入到文件系统、数据库和 Slack 工作区中。

1.1.5 里程碑时刻

  • 2021: Anthropic 成立。

  • 2022.12.15: Anthropic 公开发布 Constitutional AI 研究文章《Constitutional AI: Harmlessness from AI Feedback》,系统阐述用一套原则和 AI 反馈训练更无害模型的方法。

  • 2023.03: Claude 1 发布,初露锋芒。

  • 2023.05: Claude 上下文窗口从 9K 扩展到 100K(业内率先公开提供)。

  • 2023.07: Claude 2 发布,延续 100K 上下文并提升综合能力。

  • 2024.03: Claude 3 (Opus/Sonnet/Haiku) 发布,全面超越 GPT-4。

  • 2024.06: Claude 3.5 Sonnet 发布,重新定义了“模型智商”与“速度”的平衡。

  • 2024.10: Computer Use (计算机操控) 公测,AI 开始拥有“手”和“眼”。

  • 2024.11: MCP (模型上下文协议) 正式发布,成为连接 AI 与外部世界的标准。

  • 2025.02.24: Claude 3.7 Sonnet 发布,首次引入 Extended Thinking 混合推理模式;Claude Code CLI 发布 (Preview),开发者首次获得 Agentic 编程终端工具。

  • 2025.05: Claude Opus 4 与 Sonnet 4 发布;Claude Code 正式 GA。Opus 4 作为预防性措施在 ASL-3 防护标准下部署(官方明确并未认定其跨过 ASL-3 能力阈值)。

  • 2025.08: Claude Opus 4.1 增量升级,SWE-bench Verified 从 72.5% 提至 74.5%(+2 个百分点)。

  • 2025.09: Claude Sonnet 4.5 发布,匹配 Opus 4.1 能力,价格更低。

  • 2025.10: Claude Haiku 4.5 发布,达到 Sonnet 4.5 约 90% 的编码能力,速度快 4-5 倍。

  • 2025.11: Claude Opus 4.5 发布;长对话能力仍应按官方上下文窗口、提示缓存、压缩和记忆文档分别核对,不应把“长对话管理”当作独立官方产品名。

  • 2026.02: Claude Opus 4.6 与 Sonnet 4.6 发布,均支持 1M Token 上下文窗口。

  • 2026.04: 同月密集发布:① Claude Opus 4.7(SWE-bench Verified 87.6%,视觉分辨率与复杂多步任务一致性显著提升);② Claude Mythos Preview(研究预览)并启动 Project Glasswing 防御性安全计划;③ 2026-04-09 三重公告——Claude Cowork 转为 GAClaude Managed Agents 公开测试(API 2026-04-10 上线)、企业级权限/连接器控制;④ 2026-04-14 Routines(研究预览)发布。

  • 2026.05: Claude Managed Agents 持续迭代(2026-05-07 新增三项功能,2026-05-19 新增隐私与安全特性);2026-05-28 Claude Opus 4.8 发布,成为彼时最强的通用可用模型(沿用 4.7 的 $5/$25 定价、1M 上下文、128K 输出),并为 Claude Code 带来 Dynamic Workflows(研究预览)。

  • 2026.06–07: 2026-06-09 Claude Fable 5 正式 GA($10/$50、1M 上下文、128K 输出、Adaptive Thinking 常开),Claude Mythos 5 同日面向 Project Glasswing 受邀客户开放;两者于 6 月 12 日暂停访问后,Fable 5 于 7 月 1 日恢复全球访问。2026-07-01 公告称 Mythos 5 当时恢复给一组美国机构;当前可用性应以模型目录的 Project Glasswing 获批客户邀请制口径为准。Claude Sonnet 5 同期发布,带来新的 tokenizer、默认 Adaptive Thinking 和迁移约束。


了解了 Claude 的身世,自然会好奇:Anthropic 究竟发布了哪些模型?Opus、Sonnet 和 Haiku 到底有何区别?

➡️ Claude 模型家族全景

最后更新于