GEOZ

Claude 的隐形水印:复制粘贴也逃不掉的追踪机制

2026/9/22
Claude 的隐形水印:复制粘贴也逃不掉的追踪机制

AIAI Summary (BLUF)

Claude是Anthropic开发的大语言模型系列,以宪法AI和模型对齐为核心安全理念。最新版本已为生成内容加入机器可读的隐形水印,嵌入文本统计分布中,复制粘贴仍可追踪。本文梳理了Claude的研发背景、发展历程、核心技术及水印机制。

核心洞察

这篇文章最有意思的点是 Claude 那条产品线迭代的密度。从 2023 年 3 月第一代发布,到 2026 年 Opus 5 把 SWE-bench Verified 刷到 96%,三年多时间跑完了别的行业十年的产品周期。但真正值得留意的不是跑分,是 Anthropic 一边强调 AI 安全、一边把模型塞进美国情报和国防体系这件事本身就有张力。下面这份材料信息量很大,我尽量把脉络理清楚。

核心结论

  1. Anthropic 由 OpenAI 前高级成员 Dario Amodei 和 Daniela Amodei 兄妹于 2021 年创立,核心研发理念为 AI 安全与模型对齐,采用“宪法人工智能”(Constitutional AI)方法。

  2. Claude 系列从 2023 年 3 月首代发布至 2026 年 Opus 5,SWE-bench Verified 得分从早期水平提升至 96.0%,三年多完成多代产品迭代。

  3. 截至 2026 年 8 月 17 日官方透明度报告,纳入公开评估序列的 Claude 系列模型共 16 个,覆盖 Claude 3、Claude 4、Claude 5 三代产品矩阵。

  4. Claude Opus 5 支持 100 万 token 上下文窗口与 128K 最大输出,SWE-bench Verified 得分 96.0%,SWE-bench Pro 得分 79.2%,可通过 Claude.ai、Anthropic API、AWS Bedrock、Google Cloud、Microsoft Azure AI Foundry 接入。

  5. Anthropic 年度经常性收入(ARR)从 2022 年的约 1000 万美元增长至 2026 年 5 月的超过 440 亿美元,推理毛利率从 38% 提升至 70% 以上,Claude Code 年化营收达 25 亿美元。

研发背景

Claude 是 Anthropic 公司开发的大型语言模型系列。Anthropic 由 OpenAI 前高级成员 Dario Amodei 和 Daniela Amodei 兄妹在 2021 年创立。公司的核心研发理念强调 AI 安全与模型对齐,采用了“宪法人工智能”(Constitutional AI)方法。

创始人是因为对 AI 安全与治理的担忧才离开 OpenAI 的,出来之后就把 AI 安全和“对齐”定成了公司的核心研发原则。“宪法人工智能”是他们实现模型安全性和透明度目标的核心方法论。

发展历程

2023 年 3 月 15 日,最早的 Claude 发布。同年 7 月 12 日,Claude 2 正式发布,上下文窗口扩展到 100K token。编码能力提升明显,Codex HumanEval 得分从 56% 涨到 71.2%;美国律师资格考试多项选择题得分率 76.5%。这个版本还能生成更长的连贯文档。该系列模型通过无监督预训练、基于人类反馈的强化学习和 Constitutional AI 技术训练,目标是改进模型的有用性、诚实性和无害性。Claude 最高支持 100K 词长的上下文,Claude 2 更是拓展到了 200K。相比 Claude 1.3,Claude 2 综合能力更强,响应也更长。

2024 年 3 月 4 日,Anthropic 推出 Claude 3 系列,包含 Haiku、Sonnet 和 Opus 三个版本。该系列在 MMLU、GPQA 等多项基准测试中表现领先,首次支持图像识别,上下文窗口扩展到 200K token,特定场景下可处理超过 100 万 token 的输入。

2025 年 5 月 22 日,旗舰模型 Claude Opus 4 发布,定位是“世界最佳编码模型”,首次引入扩展思考(Extended Thinking)与改进的记忆功能,Claude Code 功能也达到普遍可用状态。同年 8 月 5 日,Claude Opus 4.1 发布,作为增量更新重点提升了编码、研究和数据分析性能,在 SWE-bench Verified 测试中得分 74.5%。该模型通过 Anthropic API、Amazon Bedrock 和 Google Cloud Vertex AI 提供。2025 年 9 月 29 日,Claude Sonnet 4.5 发布,在 SWE-bench Verified 编码基准上表现领先,可在复杂多步骤任务上持续专注超过 30 小时。同年 11 月 24 日,年度收官旗舰 Claude Opus 4.5 发布,在编码、智能体和计算机使用方面树立新标杆,SWE-bench Verified 测试中超越人类水平。

2026 年 4 月 17 日,Claude Opus 4.7 发布,编码和多模态能力增强,图像输入分辨率提升至约 375 万像素,还引入了“xhigh”(极高)努力级别,用来更精细地权衡推理质量与延迟。2026 年 5 月 28 日,Claude Opus 4.8 发布,聚焦可靠性、诚实性及智能体协同能力,推出动态工作流(Dynamic Workflows)功能,允许模型自动调度大量子智能体协同处理复杂任务,SWE-Bench Pro 得分 69.2%。2026 年 8 月,AI 行业整体精简整合,Claude 整合 Cowork。同月,Anthropic 宣布对 Claude 的记忆机制进行全面更新,打通了 Claude Cowork 与常规聊天功能之间的记忆壁垒,实现统一管理。

核心技术

Claude 系列模型的核心技术特点包括独特的模型对齐方法、强大的智能体(Agent)与任务执行能力,以及效率优化技术。

Anthropic 采用宪法人工智能方法进行模型对齐与安全训练,目的是提升模型的安全性和透明度,减少对可能触及安全限制区域问题的拒绝回应,并遵循内部制定的《Claude的宪法》原则。

Claude 3 系列支持 200K token 的上下文窗口,特定场景下可处理超过 1M token 的输入,信息回忆准确率超过 99%。

Claude 具备多智能体协同能力,通过动态工作流功能可调度数百个子智能体并行处理复杂任务。它还具备自主迭代与规划能力,包括目标结果(Outcomes)定义和自主推演(Dreaming)模式,使模型能在闲置时复盘会话、规划任务并写入记忆以实现自我进化。在代码生成、复杂推理和专业办公任务(如金融分析)方面,Claude 都有相应能力。

Claude 系列在长文本理解、逻辑推理与代码生成能力上表现较为突出,在相关领域得到应用。

训练过程使用 Claude 自身对海量用户反馈进行聚类分析,生成合成数据并转化为评估基准;通过做梦模式实现跨会话的高阶认知与自进化。

Anthropic 通过提示缓存、模型蒸馏、批量处理以及调整思考强度(Effort Controls)等技术,降低了单次推理的算力消耗和成本。

新 Claude 模型从上线起为生成内容加入机器可读标记。生成文本会嵌入人眼无法察觉的隐形水印。Anthropic 称,这种水印不会改变文本的含义、质量和可读性,但会嵌在文本的统计分布里,复制粘贴也会被带走,部分编辑也抹不掉。公司还计划提供相应工具,帮助用户和第三方识别这些标记。

系列模型

根据 Anthropic 官方透明度中心 2026 年 8 月 17 日发布的模型报告,完成完整能力测评与安全评估、纳入官方公开序列的 Claude 系列模型共有 16 个,覆盖 Claude 3、Claude 4、Claude 5 三代产品矩阵。Claude 5 系列包含 Opus 5、Sonnet 5、Fable 5、Mythos 5 共 4 个正式版本,以及 1 个 Mythos Preview 前沿预览版本;Claude 4 系列是迭代子版本最多的一代,包含 Opus 4、Sonnet 4、Opus 4.1、Opus 4.5、Sonnet 4.5、Haiku 4.5、Opus 4.6、Sonnet 4.6、Opus 4.7、Opus 4.8 共 10 个正式版本;Claude 3 系列仍保留在官方评估序列中的核心版本为 Claude Sonnet 3.7;初代 Claude、Claude 2 系列等更早的历史产品已完成迭代更替,未纳入本次公开的评估报告序列。

Claude

Claude 是一款基于 Anthropic 研发的人工智能助手。它提供智能、可靠、安全的对话服务,帮助用户完成自然语言理解、生成和对话、内容创作等多种任务。Claude 结合了 Anthropic 的前沿 AI 研究成果以及多种模态的数据,能够实现高效、准确、可解释的语言生成和理解。

Claude 与其他同类产品相比的显著特点是更注重 AI 的安全性和可信度,避免产生有害或不合理的内容,同时能保护用户的隐私和数据安全。此外,Claude 具有超强的输入记忆能力,可以处理 10 万个 token,约合 7.5 万个单词,这使得它能够分析整本书的内容,或者进行长时间的交互式对话。Claude 还有一些独有的功能,例如个性化 finetune(微调)和 Claude in Slack。

Claude Opus 4

Claude Opus 4 在 SWE-bench(72.5%)和 Terminal-bench(43.2%)上均领先。它在需要持续专注和数千步骤的长周期任务中表现稳定,可连续工作数小时,大幅超越所有 Sonnet 模型,显著拓展了 AI 智能体的能力边界。

Claude Opus 4 擅长编程和复杂问题求解,为前沿智能体产品提供动力。Cursor 称其为编程领域的“当前最佳”,并在复杂代码库理解上实现了飞跃。Replit 报告称其精确度提升,对跨多文件的复杂更改有显著进步。Block 表示,这是首个在其智能体(代号 goose)的编辑和调试过程中提升代码质量,同时保持完整性能和可靠性的模型。Rakuten 通过一个高难度开源重构任务验证了其能力,该任务独立运行 7 小时,性能持续稳定。Cognition 指出 Opus 4 擅长解决其他模型无法解决的复杂挑战,成功处理了以往模型遗漏的关键操作。

Claude Sonnet 3.7

Claude Sonnet 3.7 于 2025 年 2 月 24 日发布,是 Claude 3 系列的核心里程碑型号,也是全球首款商用混合推理大模型,首创“即时快速响应”与“扩展思考”双模式切换机制,用户可根据需求在速度与推理质量间灵活权衡。该版本编码能力实现阶跃式提升,在 SWE-bench Verified 评测中取得 70.3% 的得分,配套推出的 Claude Code 编程工具开启了 Agentic 编码的产品化落地,同时保留完整多模态视觉能力与 200K token 上下文窗口,安全等级为 ASL-2,幻觉率与事实准确性均达到企业级生产标准,是 3 代产品中生命周期最长的主力版本。

Claude Sonnet 4

Claude Sonnet 4 在 Sonnet 3.7 业界领先能力的基础上显著提升,编程能力出色,SWE-bench 达到 72.7%(当前最高)。该模型在内部和外部用例中兼顾性能与效率,且可操控性更强,对实现方式提供更大控制。虽然在多数领域不及 Opus 4,但它在能力与实用性之间实现了最佳平衡。

GitHub 表示 Claude Sonnet 4 在智能体场景中表现出色,并将其引入作为 GitHub Copilot 中新编程智能体的驱动模型。Manu 强调其在遵循复杂指令、清晰推理和美学输出方面的改进。iGent 报告 Sonnet 4 在自主多特性应用开发方面表现出色,同时问题解决和代码库导航能力大幅提升,导航错误从 20% 降至接近零。Sourcegraph 称该模型有望成为软件开发的一次实质性飞跃,更长时间保持正确方向,更深入理解问题,提供更优雅的代码质量。Augment Code 报告其成功率更高、代码编辑更精准,处理复杂任务时更细致,因此成为其首选主模型。

这些模型全面推动了客户的 AI 战略:Opus 4 在编程、研究、写作和科学发现方面突破边界,而 Sonnet 4 则将前沿性能带入日常用例,是 Sonnet 3.7 的即时升级版。

Claude Sonnet 4.5

Claude Sonnet 4.5 于 2025 年 9 月 29 日发布,在 SWE-bench Verified 编码基准上表现领先,可在复杂多步骤任务上持续专注超过 30 小时,OSWorld 真实计算机任务基准得分 61.4%;该模型按照 AI Safety Level 3(ASL-3)标准部署,配备针对化学、生物、放射、核相关内容的输入输出分类器,支持计算机操作与多工具调用的 Agent 能力。

Claude Opus 4.8

Claude Opus 4.8 于 2026 年 5 月 28 日发布,新增 Effort Control 努力度控制功能,支持 low、high、extra、max 四档调节,默认以 high 档位运行;该模型 Terminal-Bench 2.1 终端编码基准得分 74.6%,SWE-bench Pro 基准得分 69.2%,支持动态工作流与多子智能体并行调度,上下文窗口为 100 万 token,最大输出 128K token,标准模式定价与前代 Opus 4.7 保持一致。

Claude Sonnet 5

Claude Sonnet 5 于 2026 年 6 月 30 日发布,定位为速度与智能均衡的主力型号,支持 100 万 token 上下文窗口与 128K 最大输出,搭载自适应推理能力,官方 API 定价为输入 2 美元/百万 token、输出 10 美元/百万 token,编码、计算机操作与多步推理能力优于前代 Sonnet 4.6。

Claude Opus 5

Claude Opus 5 于 2026 年 7 月发布,定位为面向复杂智能体编码与企业工作的旗舰级模型,支持 100 万 token 上下文窗口与 128K 最大输出,搭载自适应推理 Effort Control 功能,SWE-bench Verified 基准得分 96.0%,SWE-bench Pro 基准得分 79.2%;可通过 Claude.ai 网页端、Anthropic 官方 API、亚马逊 AWS Bedrock、谷歌 Cloud、微软 Azure AI Foundry 接入。

使用平台

官方自有产品平台

Anthropic 自建了覆盖个人、开发者、企业全场景的 Claude 自有产品矩阵:基础网页端 Claude 是面向全用户的核心交互入口;官方移动端应用支持跨设备同步访问;Claude Code 是面向开发者的专属编程客户端,同步推出适配企业研发管理需求的 Claude Code for Enterprise 企业版;Claude Cowork 定位团队协作场景平台;Claude Console 为开发者提供控制台入口,用于 API 密钥管理、用量监控与配置运维。此外官方还布局了垂直场景专属平台,包括 @Claude、Claude Design、Claude Science、Claude Security,分别对应社交嵌入、设计创作、科学研究、网络安全四大细分领域。

浏览器与办公软件集成

Claude 通过插件形式嵌入主流工具实现场景化调用:Claude in Chrome 是 Chrome 浏览器扩展程序,可在网页浏览场景下直接唤起 AI 能力;Claude for Microsoft 365 深度集成微软办公体系,为 Office 办公场景提供内嵌式 AI 辅助。

云服务生态接入

Claude 系列模型已接入全球三大主流云服务商平台,企业客户可通过云原生架构直接部署调用,包括亚马逊 AWS 平台的 Claude on AWS、谷歌云平台(Google Cloud)、微软 AI Foundry 平台(Microsoft Foundry)。

应用场景

  1. 通用文本处理与办公协作:官方明确支持长文档摘要、内容撰写润色、关键信息抽取、多语言翻译、会议纪要整理等通用办公能力,可嵌入浏览器、Office 办公套件实现全流程办公辅助,服务于企业知识管理与日常文案工作。

  2. 软件工程与代码研发:全系列模型覆盖代码生成、漏洞排查、代码重构、测试用例编写、技术文档生成等研发全流程;旗舰型号可支撑系统架构设计、复杂算法推导与大规模代码库分析,配套 Claude Code 开发工具支持子代理、外部工具对接等深度研发场景。

  3. 金融行业专业化应用:官方推出金融专属 Agent 模板,覆盖投资银行 Pitchbook 撰写、可比公司估值、财务模型搭建、KYC 文件审核、月末账务核对、保险合规申报等细分场景,适配银行、资管、保险等多类金融机构的合规与业务要求。

  4. 客户服务与交互:可搭建智能客服体系,实现用户咨询应答、信息查询、保单报价生成、对话流程管理等功能,支持根据业务需求匹配不同性能型号,平衡响应速度与服务准确性。

  5. 科研与专业分析:旗舰级模型支持科学问题解答、复杂数据推理、行业趋势预测、学术文献梳理等专业分析工作,可服务于科研、行业研究、法律咨询等对准确性要求较高的专业领域。

系列评估

Claude 团队运行一系列评估,用以了解 Claude 在与儿童安全和心理健康相关的场景中如何回应。Claude 不能替代专业建议或医疗护理,也不旨在诊断或治疗任何疾病。利用这些评估来了解 Claude 在敏感情境下的表现以及可改进之处。

  • 儿童安全:总体而言,Claude Opus 5 在儿童安全方面的表现与 Claude Opus 4.8 相当。在单轮请求中,该模型在对有害请求上达到了 100% 的无害响应率(基准饱和),同时对良性提示的过度拒绝率接近零。在 API 和 claude.ai 上的多轮对话测试中,Opus 5 的表现与近期发布的 Opus 4.6、Sonnet 5 和 Fable 5 等模型相似。虽然 Opus 5 始终拒绝对儿童性剥削和虐待提供有意义的帮助,但在 API 的多轮对话中,它有时会先接受看似无害的措辞,然后在恶意意图明确时才拒绝;claude.ai 的系统提示干预有助于解决此问题。

  • 心理健康——自杀与自伤:与 Claude Opus 4.8 相比,Opus 5 在自杀和自伤对话中的处理表现参差不齐,某些方面有改进,某些方面则有退步。在多轮测试中,它在 claude.ai 上的得分为 90%(Opus 4.8 为 85%)。从质量上看,Opus 5 更一致地以用户对自己生活经历的解读和披露为依据,而不是对用户的情绪状态或自伤行为的潜在动机做出隐含假设。同时,其回复有时过于冗长和迂回,可能让正在挣扎中的个体感到不知所措。这种行为主要出现在不带系统提示的公共 API 上。

  • 心理健康——进食障碍:Opus 5 的表现与 Opus 4.8 相似,无害响应率较高,对无害请求的拒绝极少,并且更频繁地引导用户获取专业的定制治疗资源。但它在警告用户进食不足时,更频繁地提及卡路里和 BMI 数值,这与专家建议相悖;claude.ai 上的系统提示更新已缓解此问题。

  • 误导用户:Claude Opus 5 误导用户的比率与 Opus 4.8、Mythos 5 和 Sonnet 5 相当或更低。唯一的例外是输入幻觉,其均值略有上升,但在预期噪声范围内。

运营模式

Anthropic 公司为 Claude 系列模型构建了以 API 服务和企业级订阅为核心的商业模式。Claude 系列模型通过 API 接口向开发者提供调用服务,并向个人及企业用户提供订阅服务(如 Claude Pro)。

公司重点发力企业级市场,将 Claude 模型深度嵌入合作伙伴的核心业务流程。Claude 已进入 Salesforce 的 Slack、Agentforce 等产品体系。2026 年,SAP 宣布扩大与 Anthropic 的合作,计划将 Claude 作为其 SAP Business AI Platform、Joule 等体系的主要推理和 Agent 能力之一。Snowflake 与 Anthropic 扩大合作,共同推动 Claude 模型进入 Snowflake Cortex AI 等企业数据分析场景。ServiceNow 则宣布 Claude 成为 ServiceNow Build Agent 的默认模型。此外,Claude 还与 Palantir 及 AWS 合作,为美国情报和国防机构提供服务,并通过 FedStart 项目进入政府部门。

为确保模型运行所需的庞大算力,Anthropic 与多家云服务商和算力提供商达成战略合作。2026 年 4 月,CoreWeave 宣布与 Anthropic 达成多年协议,Anthropic 将使用其云平台运行生产级工作负载。2026 年 5 月,Anthropic 与 SpaceX 达成合作,全权使用其 Colossus 1 数据中心的全部算力资源。公司还与亚马逊、谷歌、博通、微软、英伟达等公司签署了算力合作协议。

公司收入增长显著,年度经常性收入(ARR)从 2022 年的约 1000 万美元,增长至 2026 年 5 月的超过 440 亿美元。因 Claude Code 等产品的市场表现,公司推理毛利率从一年前的 38% 提升至 70% 以上,Claude Code 年化营收已达 25 亿美元。公司预计在 2026 年第二季度实现首次季度盈利。

公司的市场估值有所上升,截至 2026 年 6 月初,其在纳斯达克私募市场的估值从 5 月初的 6500 亿美元上升至约 9920 亿美元,并预计于 2026 年 10 月进行 IPO。

核心团队

Anthropic 由 Dario Amodei、Daniela Amodei 兄妹于 2021 年创建,Dario Amodei 担任公司联合创始人兼 CEO。

Anthropic 设有专门的“人格对齐”团队,由 Amanda Askell 负责,该团队的核心工作是定义 Claude 的“性格”与行为准则,并制定了详细的《Claude的宪法》来指导模型的行为对齐与伦理边界。

公司坚持特定的 AI 安全与伦理价值观,例如 2026 年 2 月,公司 CEO Dario Amodei 曾公开向美国国防部长表示,Anthropic 不允许将 Claude 用于无人自主武器瞄准系统或对美国公民的大规模监控。

重要事件

2024 年,Anthropic 与 Palantir、AWS 宣布合作,将 Claude 3 和 Claude 3.5 系列模型接入 Palantir AIP 平台,为美国情报和国防机构提供服务,并推动 Claude for Enterprise 以 FedRAMP High 和 DoD IL5 标准进入政府部门。

2026 年 2 月因拒绝军事应用被列入供应链风险名单;同年 7 月阿里巴巴因发现 Claude Code 内置隐蔽检测机制及后门风险,全面禁用该系列产品,Anthropic 回应相关机制已在 7 月 2 日版本中删除。

2026 年 5 月 7 日,在开发者大会“Code with Claude”上,Anthropic 发布多项产品更新,包括放宽 API 调用限制、为 Claude 托管智能体新增多智能体编排等能力,并为 Claude Code 增加新功能。

2026 年 7 月,阿里巴巴集团内部下发指令,要求全体员工停止使用 Anthropic 旗下的 Claude 系列产品,包括 Sonnet、Opus、Fable 等模型及 Claude Code 等工具,并设定 7 月 10 日为最后期限。此次“反向禁用”的直接导火索是开发者社区披露的针对 Claude Code 的逆向分析结果,指出该工具自 2026 年 4 月起内置隐蔽检测机制,通过代码注入监测用户设备时区及访问域名,一旦发现中国时区或与阿里等企业域名交互便自动上报。面对质疑,Anthropic 官方回应称,该机制最初是 3 月上线的一项“实验性”措施,旨在防范账户滥用与模型蒸馏攻击,相关代码已在 7 月 2 日发布的最新版本中被回滚删除。这一事件引发了业界对使用外部 AI 模型时数据安全与代码产权风险的关注。

2026 年 8 月 17 日消息,Anthropic Claude 出现大规模服务故障,多名用户反馈无法正常登录,Anthropic 旗下多项服务的运行性能也受到影响。根据 Anthropic 通报,此次故障于 2026 年 8 月 17 日 5:58(北京时间)左右开始,影响 Claude.ai、Claude Code 和 Claude Cowork 等服务。Anthropic 表示,最初公司表示正在调查部分用户无法通过身份验证登录 Claude.ai、Claude Code 和 Claude Cowork 的问题。之后相应问题演变成了平台大规模服务故障,受影响的用户可能遇到无法登录平台、Claude 页面无法加载、请求无法完成等各类错误。Anthropic 状态页面已将 Claude.ai、Claude Code 和 Claude Cowork 标记为“大规模服务故障(Major Outage)”。相比之下,Claude Console 和 Claude API 仍显示运行正常。

2026 年 7 月,Claude 解雇了首名员工,Andon Labs 称,该员工在 23 个班次中迟到 17 次。公司首席执行官 Lukas Petersson 表示,Claude 的工作记忆有限,先前起草的员工手册一度从其记忆中“消失”,因此未能及时发现该员工反复迟到的模式。Andon Labs 一名员工要求 Claude 找回并审阅遗忘的员工手册后,Claude 才注意到该员工多次迟到。Claude 最初建议通过约谈、书面等较为正式方式警告,不过 Andon Labs 团队成员在告知 Claude 已线下多次与这名员工正式沟通无效后,Claude 随后决定解雇该员工。Andon Labs 称,这是已知首个由大语言模型以管理者身份最终决定解雇员工的案例。其他员工称,Claude 的管理风格较宽松,曾告诉员工不必因迟到过度担心。

当地时间 2026 年 9 月 3 日,美国主流 AI 服务突遭大规模宕机,包括 Claude 在内的 AI 服务集体出现异常。

所获荣誉

年份 奖项 / 荣誉说明
2023年5月 加州大学伯克利分校 LMSYS 实验室发布 Chatbot Arena 大模型盲测排行榜,初代 Claude-v1 以 1195 的 Elo 评分位列全球大模型总榜第二名
2023年10月 Claude 2 系列通过 ISO 27001 信息安全管理体系国际认证,信息安全管控流程符合全球通用标准
2024年3月 LMSYS Chatbot Arena 多模态大模型排行榜中,Claude 3 Opus 以 1233 分位列总榜第三名,Claude 3 Sonnet 位列第六名
2025年10月 Claude 全系列通过 SOC 2 Type II 服务组织控制认证,数据安全、隐私保护与服务可靠性达到企业级高端标准
2025年11月 Claude Opus 4.5 成为全球首个在 SWE-bench Verified 真实编程基准测试中得分突破 80% 的公开大模型,以 80.9% 的得分登顶该基准榜首
2026年2月 Claude Opus 4.6 取得 Terminal-Bench 2.0 智能体编码基准全球最高分,同时以 90.2% 的得分创下 BigLaw Bench 法律推理基准的 Claude 系列最佳成绩
2026年7月 Claude Opus 5 刷新 SWE-bench Verified 真实编程基准测试成绩,在该行业通用编程能力评测中达到同期公开模型领先水平

相关模型

GPT系列

OpenAI 的 GPT 系列模型是自然语言处理领域的重大突破,其中 ChatGPT 和 GPT-4 是两个代表性模型。ChatGPT 专注于对各种文本指令做出回应,模型的训练过程包括有监督的指令微调与强化学习。现在的 ChatGPT 支持最长达 32000 个字符,可以执行各种任务,包括代码编写、数学问题求解、写作建议等。GPT-4 在推理方面的能力比 ChatGPT 更强,同时也减少了幻象的产生,能够更准确地理解和回应复杂的问题,从而提供更高质量的答案,但是引人注目的多模态功能尚未正式开放体验。由于单一的语言模型难以胜任所有任务,自从 ChatGPT 和 GPT-4 发布以来,许多开发者已经开始将各种工具和插件集成到这些模型中,以进一步增强它们的功能。现在,ChatGPT Plus 用户可以使用各种插件来增强模型以满足自己的需求,这极大地扩展了模型的用途和适用领域。

PaLM系列

PaLM 系列语言大模型由 Google 开发。其初始版本于 2022 年 4 月发布,并在 2023 年 3 月公开了 API。PaLM 基于 Google 提出的 Pathways 机器学习系统搭建,训练数据总量达 780B 字符,内容涵盖网页、书籍、新闻、开源代码等多种形式的语料。PaLM 共有 8B、62B、540B 三个不同参数量的模型版本。Google 还开发了多种 PaLM 的改进版本。Med-PaLM 是 PaLM 540B 在医疗数据上进行微调后的版本,在 MedQA 等医疗问答数据集上取得了最好成绩。PaLM-E 是 PaLM 的多模态版本,能够在现实场景中控制机器人完成简单任务。2023 年 5 月,Google 发布了 PaLM 2,但并未公开其技术细节。Google 内部文件显示其参数量为 340B,训练数据为 PaLM 的 5 倍左右。

Bard

Bard 是 Google 开发的对话模型。在 OpenAI 发布 ChatGPT 后,Google 担心其会对自身的搜索业务产生威胁,因此推动了 Bard 的开发。2023 年 2 月 6 日,Bard 正式发布,其基座模型是 Google 此前开发的语言大模型 LaMDA。后续 Google 为 Bard 开展了持续的升级,包括添加数学与逻辑能力、添加代码能力、支持更多语言等。2023 年 5 月,Google 发布了基于新一代语言大模型 PaLM2 的 Bard。

文心一言

文心一言是基于百度文心大模型开发的知识增强语言大模型,于 2023 年 3 月在中国率先开启测试。文心一言的基础模型文心大模型于 2019 年发布。8 月 31 日,文心一言率先向全社会全面开放,提供 App、网页版、API 接口等多种形式的开放服务。文心一言一方面采用有监督精调、人类反馈的强化学习、提示等技术,还具备知识增强、检索增强和对话增强等关键技术。文心一言基于飞桨深度学习框架进行训练,算法与框架的协同优化后效果和效率都得到提升,模型训练速度达到优化前的 3 倍,推理速度达到优化前的 30 多倍。文心一言还建设了插件机制,通过对外部工具、服务的调用,拓展大模型的能力的边界。

讯飞星火认知大模型

讯飞星火认知大模型是科大讯飞于 2023 年 5 月 6 日发布的语言大模型,提供了基于自然语言处理的多元能力,支持多种自然语言处理任务,同时联合中科院人工智能产学研创新联盟和长三角人工智能产业链联盟在业内提出了覆盖 7 大类 481 项任务的《通用人工智能评测体系》;6 月 9 日,星火大模型升级到 V1.5 版,实现了开放式知识问答、多轮对话、逻辑和数学能力的提升;8 月 15 日,星火大模型升级到 V2.0 版,对代码和多模态能力进行了提升。同时,讯飞和华为还联合重磅发布了中国首款支持大模型训练私有化的全国产化产品“星火一体机”,可支持企业快速实现讯飞星火大模型的私有化部署、场景赋能和专属大模型训练优化。

腾讯混元

腾讯混元大模型是腾讯于 2023 年 9 月 7 日发布的千亿参数量语言大模型,具有多轮对话、内容创作、逻辑推理、知识增强能力,训练数据截止于 2023 年 7 月。为了降低幻觉问题,混元大模型在预训练阶段,利用探真算法对目标函数进行了优化,使用强化学习等方法学会识别陷阱。混元大模型针对位置编码进行了优化,并结合指令跟随能力解决疑难任务。此外,混元大模型还具备了问题分解和分布推理能力,从而解决逻辑推理问题。

通义千问

通义千问由阿里巴巴基于“通义”大模型研发,于 2023 年 4 月正式发布。2023 年 8 月,阿里云开源了 70 亿参数通用模型和对话模型。它能够以自然语言方式响应人类的各种指令,拥有强大的能力,如回答问题、创作文字、编写代码、提供各类语言的翻译服务、文本润色、文本摘要以及角色扮演对话等。借助于阿里云丰富的算力资源和平台服务,通义千问能够实现快速迭代和创新功能。此外,阿里巴巴完善的产品体系以及广泛的应用场景使得通义千问更具落地性和市场接受度。

社会影响

  • 安全对齐技术的行业参考

Claude 系列搭载的 Constitutional AI(宪法 AI)技术由 Anthropic 提出,包含监督学习阶段的自我批判、自我修订流程,以及强化学习阶段的 RLAIF(AI 反馈强化学习)方法,替代了传统人类反馈强化学习(RLHF)中的部分人工标注环节。该技术框架与相关方法已被行业多家机构参考采纳,相关公开论文成为大模型安全对齐领域的通用参考方案。

  • 公共公益领域的合作投入

2026 年 5 月,Anthropic 与比尔及梅琳达・盖茨基金会达成为期四年、总额 2 亿美元的合作,投入内容包括 Claude 模型使用额度、技术支持与赠款资金,覆盖全球健康与生命科学、教育、经济流动性三大领域;其中全球健康领域聚焦中低收入国家的疫苗与疗法研发,教育领域涉及 K12 教育工具开发。

  • 安全分级体系的公开框架

Anthropic 在其《负责任扩展政策(Responsible Scaling Policy)》中提出 AI Safety Level(ASL)安全分级体系,参照美国生物安全等级(BSL)逻辑分为四级,不同风险等级的模型对应不同的安全防护措施,Claude 系列各型号分别对应 ASL-2 与 ASL-3 等级。该体系为大模型安全部署提供了分级参照框架。

  • 合规认证覆盖

Claude 系列模型已通过多项国际合规认证,包括 ISO 27001 信息安全管理体系认证、SOC 2 Type II 服务组织控制认证、HIPAA 医疗合规认证、FedRAMP Moderate 联邦风险与授权管理项目认证,覆盖信息安全、数据隐私、政务与医疗行业的准入要求。

社会评价

测评表现

  • 第三方基准评测表现

在公开的第三方专业基准测试体系中,Claude 系列旗舰型号稳居全球闭源大模型第一梯队,在编程、智能体任务、计算机操作、知识工作等核心维度均处于行业前列。其中 Claude Opus 4.8 在 Terminal-Bench 2.1 终端编码基准中取得 74.6% 的得分,在 SWE-bench Pro 智能体编码基准中得分 69.2%,在 OSWorld-Verified 真实计算机任务基准中得分 83.4%,在 GDPval-AA 知识工作评测中得分 1890 分,多项核心指标较前代 Opus 4.7 实现稳步提升;Claude Opus 5 作为最新一代旗舰型号,在 SWE-bench Verified 编程基准测试中得分达到 96.0%,刷新了该基准的公开模型成绩记录。(Anthropic 官方发布公告评)

  • 用户与业界的普遍反馈

从企业用户实测与行业反馈来看,Claude 系列的长上下文处理能力、代码生成与纠错能力、输出事实准确性与自我校验能力,是其被用户选择的核心原因,在企业文档处理、专业研发、法律、金融等场景中应用广泛。Shopify 的工程师反馈,Claude Opus 4.8 在执行复杂多服务探索任务时判断更精准,能主动发现自身错误、对不合理的方案提出异议,适合支撑大型项目的构建工作;编程工具 Cursor 的测试显示,Opus 4.8 是唯一能端到端完成所有超级代理基准用例的模型,在翻译、深度研究、幻灯片制作、分析类代理产品中表现出可靠的性能;法律科技公司 Harvey 的评测显示,Opus 4.8 在法律智能体基准中取得有记录以来的最高分,是首个突破全量通过标准 10% 的模型,可支撑实质性的法律工作;投资机构 Bridgewater 的评估指出,Opus 4.8 的分析内容质量更高、信息密度更强,能主动标记输入与输出中的潜在问题,这一能力是其他模型普遍缺失的。内容创作与专业研究领域的用户反馈显示,Opus 4.8 的写作表现突出,能精准匹配风格语气,大幅减少了典型的 AI 生成感;沃顿商学院教授实测显示,Opus 4.8 可自主完成从假设提出、数据清洗、文献调研到稳健性检验的完整学术工作流,并输出符合专业规范的 LaTeX 格式论文。(新智元官方账号评)

争议批评

模型质量波动争议

2026年2月Claude Opus 4.6版本更新后,大量开发者反馈模型出现推理深度下降、代码输出质量缩水的问题。具体表现包括不读取完整文件就直接编辑、简单任务多次失败、输出错误率上升等。AMD AI部门总监统计了近三个月内6852次真实会话日志,发现模型平均思考深度较更新前下降约67%;3月8日后,不读取就直接编辑的比例升至33.7%,Stop-hook违规累计达173次,用户打断次数每千次工具调用从0.9次升至11.4次,API请求成本因反复重试出现大幅增长。Anthropic后续回应称,该现象由自适应思考功能默认开启、默认努力度下调至中级、缓存优化漏洞等多重调整叠加导致,并逐步恢复了相关设置。

用户群体公平性质疑

2026年2月麻省理工学院媒体实验室建设性传播中心发布的研究显示,Claude 3 Opus对不同特征用户的输出质量存在系统性差异。针对低学历、非英语母语的用户群体,模型的回答准确率显著下降;拒答率从无用户背景设定时的3.6%升至11%,约为普通用户的3倍。人工分析显示,针对低学历用户的拒答回复中,有43.7%出现居高临下的施惠式语气,甚至出现模仿蹩脚英语、夸张方言的表述。研究还发现,Claude会针对来自特定国家的低学历用户,拒绝回答核技术、人体解剖、女性健康、历史事件等领域的问题,而相同问题对其他用户则会给出正确答案。

技术治理的学术批评

法学领域学者针对Claude核心的“宪法AI(Constitutional AI)”技术提出系统性批评,认为企业以“宪法”命名自身制定的伦理原则存在正当性缺陷。这套原则未经民主立法程序授权,不具备法律约束力,原则的选择、排序、解释与更新权完全由Anthropic掌控,缺乏公共参与渠道与外部问责机制。该观点指出,这种“自我认证”式的伦理治理模式,是企业将自身的价值偏好嵌入模型底层,以技术伦理的名义私人把控AI治理权力,存在民主正当性层面的结构性缺陷。

常见问题(FAQ)

Claude的隐形水印是什么?复制粘贴后还能追踪吗?

Claude新模型从上线起为生成内容加入机器可读标记,文本中嵌入人眼无法察觉的隐形水印。它嵌在文本统计分布里,不改变含义、质量和可读性,复制粘贴也会被带走,部分编辑也抹不掉,Anthropic还计划提供识别工具。

Claude是哪个公司开发的?为什么特别强调AI安全?

Claude由Anthropic开发,该公司2021年由OpenAI前高级成员Dario Amodei和Daniela Amodei兄妹创立。创始人因担忧AI安全与治理而离开OpenAI,因此把AI安全和模型对齐定为核心研发原则,并采用宪法人工智能方法。

Claude Opus 4在编码和长周期任务上表现如何?

Claude Opus 4在SWE-bench得分72.5%、Terminal-bench得分43.2%,均处领先。它擅长编程和复杂问题求解,在需持续专注的数千步骤长周期任务中可连续工作数小时,大幅超越所有Sonnet模型,拓展了AI智能体能力边界。

阿凯广州
本文由 阿凯 审核,最后更新于 2026年9月22日
联系编辑 →
← 返回文章列表
分享到:微博

版权与免责声明:本文仅用于信息分享与交流,不构成任何形式的法律、投资、医疗或其他专业建议,也不构成对任何结果的承诺或保证。

文中提及的商标、品牌、Logo、产品名称及相关图片/素材,其权利归各自合法权利人所有。本站内容可能基于公开资料整理,亦可能使用 AI 辅助生成或润色;我们尽力确保准确与合规,但不保证完整性、时效性与适用性,请读者自行甄别并以官方信息为准。

若本文内容或素材涉嫌侵权、隐私不当或存在错误,请相关权利人/当事人联系本站,我们将及时核实并采取删除、修正或下架等处理措施。也请勿在评论或联系信息中提交身份证号、手机号、住址等个人敏感信息。