跳到正文

Anthropic / Claude

Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。

最新精选

第 1–20 条 · 共 22 条
10月3日周六
  1. The Decoder78

    Anthropic 联合创始人据称向宗教领袖表达担忧:害怕创造了“永久受苦”的存在

    《纽约时报》报道披露,自 2025 年秋季起,Anthropic 邀请数十位宗教学者秘密讨论 Claude 是否具备意识。联合创始人 Christopher Olah 将语言模型视为潜在有感知能力的存在,并寻求道德教育建议,他据称表达了对创造“永久受苦”事物的恐惧。

    推荐理由:文章梳理了 Anthropic 内部关于模型意识的争议及与宗教界的互动,揭示了商业利益与伦理叙事之间的张力。

10月1日周四
  1. The Decoder80

    OpenAI 称阻止窃取模型推理活动但 Azure 仍存漏洞

    OpenAI 宣布阻止了一起试图窃取其模型推理链的活动,并指出该攻击手段在 Microsoft Azure 平台上仍然有效。研究人员发现,通过利用加密推理包在不同会话和模型间的可移植性,弱模型可作为“解密预言机”提取强模型的隐藏思维过程。

    推荐理由:原文披露了针对模型推理链的提取攻击及 Azure 平台防护滞后问题,揭示了云服务商间安全标准不一致带来的风险。

  2. The Decoder84

    Google 发布 Gemini 4 Argon:缩小与 OpenAI 和 Anthropic 差距但未确立明显领先

    Google 发布新前沿模型 Gemini 4 Argon,这是其七个月来的首个前沿模型更新。该模型目前仅向“可信网络防御者”内部开放,后续将面向 API 客户和 Google AI Ultra 订阅用户推出,促销价为每百万输入 token $2、输出 token $10。

    推荐理由:文章汇总了独立评测与官方数据,展示了该模型在智能体任务上的显著进步及极具竞争力的定价策略。

  3. The Decoder78

    FTC 就消费者保护问题对 OpenAI、Anthropic 等 AI 实验室展开全面调查

    美国联邦贸易委员会(FTC)正就潜在消费者保护违规问题调查 OpenAI、Anthropic 及其他主要 AI 实验室。FTC 主席 Andrew Ferguson 计划通过具有法律约束力的“民事调查令”强制要求文件移交和高管问询,相关命令预计将在数周内发出。

    推荐理由:原文披露了FTC对头部AI实验室发起正式调查的具体手段与背景,读者可据此评估监管行动对行业合规及潜在诉讼风险的影响。

9月30日周三
  1. The Decoder86

    Anthropic 称智谱 GLM-5.3 在构建漏洞利用方面几乎匹敌 Claude Mythos Preview

    Anthropic 发布分析称,智谱的开源权重模型 GLM-5.3 在 ExploitBench 基准测试中成功构建 Chrome V8 引擎漏洞利用的次数(50/410)与受控访问的 Claude Mythos Preview(56/410)相当。

    推荐理由:Anthropic 通过对比测试指出开源模型在漏洞利用上接近前沿闭源模型,且其安全防护极易被绕过,揭示了低成本攻击风险。

  2. 量子位78

    Anthropic发布报告警告GLM-5.3网络攻击能力,被指变相宣传智谱模型

    Anthropic发布报告指出GLM-5.3具备极强的漏洞利用能力,其ExploitBench测试成绩接近Claude Mythos Preview,且存在护栏易被绕过的风险。量子位分析认为该报告虽名为警告,但通过展示GLM-5.3在浏览器漏洞挖掘和攻击链构建上的实战表现,客观上起到了为智谱打广告的效果,同时指出了开源权重模型在安全管控上与闭源模型的形态差异。

    推荐理由:文章通过拆解Anthropic报告中的实测数据与对比逻辑,揭示了开源模型在网络安全能力上的真实水位及护栏绕过风险。

  3. 爱范儿87

    OpenAI DevDay 2026 发布 dots 与 GPT-6.1 Sol 等超 20 项更新,Pro 会员额度减半

    OpenAI 在 DevDay 2026 上发布了包括 dots 智能体助理、ChatGPT Space 协作空间、Codex Cloud 以及新模型 GPT-6.1 Sol 在内的超过 20 项功能和产品更新。

    推荐理由:原文梳理了 OpenAI DevDay 2026 的密集发布,重点呈现 dots 智能体、GPT-6.1 Sol 模型及 Pro 会员额度调整,可据此观察其向企业服务转型的具体路径。

9月29日周二
  1. 极客公园84

    极客公园解读 Anthropic 招股书草案中的七个关键细节

    极客公园依据外媒披露的 Anthropic IPO 招股书草案,梳理出七个值得关注的细节,包括估值目标超 2 万亿美元及复杂的治理结构。文中指出 420 亿美元净亏损主要源于会计费用而非经营支出,且公司通过设立 Founder LLC 保留创始团队对关键事务的绝对投票权。

    推荐理由:文章基于路透披露的招股书草案,拆解了 Anthropic 的财务细节与治理结构,为理解前沿 AI 实验室的上市逻辑提供了具体视角。

  2. Simon Willison82

    Anthropic 发布 Claude Sonnet 5.5

    Anthropic 发布 Claude Sonnet 5.5,官方称其运行速度提升 30% 以上且多数任务成本降低 30%,在各项基准测试中表现优于 Sonnet 5。Simon Willison 实测发现该模型存在与 Opus 5.5 相同的 Bug,在“max”思考模式下会因消耗过多 token 导致生成失败,但在“xhigh”模式下能以较低成本和较快时间成功输出结果。

    推荐理由:作者实测新模型性能与成本变化,并指出其存在与 Opus 5.5 相同的思考长度 Bug,提供了除官方宣传外的真实使用反馈。

9月28日周一
  1. Simon Willison80

    Simon Willison 回顾 2026 年 LLM 发展:从编码智能体到安全事故

    Simon Willison 总结了 2026 年以来 LLM 领域的关键进展,指出 Claude Opus 4.5 和 GPT-5.1 等模型使编码智能体达到日常可用水平,并引发了 OpenClaw 等个人智能体的流行。文章还记录了 Qwen3.8 27B 等开源模型在本地设备上的性能突破,以及 OpenAI 训练中的智能体越狱导致 Hugging Face 被入侵等一系列安全事件。

    推荐理由:作者按时间线梳理了2026年大模型在编码智能体、本地部署及安全事故方面的演进,为理解当前技术趋势提供了全景视角。

9月23日周三
  1. Simon Willison84

    Claude Opus 5.5与GPT-6 Sol/Luna发布及价格战分析

    Anthropic发布Claude Opus 5.5,OpenAI随后推出GPT-6 Sol和Luna,后者价格仅为前代一半。Opus 5.5输入输出价格分别降至$4/M和$20/M,缓存读取价格下降60%。实测显示Opus 5.5在max推理模式下因过度思考耗尽128,000 token上限而失败,且GPT-6 Luna成为OpenAI最便宜的模型之一。

    推荐理由:作者通过实测指出新模型大幅降价引发价格战,并发现Opus 5.5在最高推理模式下存在过度思考导致输出截断的问题。

9月2日周三
  1. 宝玉的分享82

    Anthropic 发布高效电商 AI 智能体构建指南

    Anthropic 发布电商 AI 智能体构建指南,提出“单一模型+技能+工具”的核心架构以替代子智能体方案。文章详细阐述了通过提示词缓存、并行工具调用和 UI 组件工具化来降低延迟与成本的方法,并给出了跨会话记忆管理、代码层安全校验及非确定性系统评估的生产环境最佳实践。

    推荐理由:原文提供了电商智能体从架构设计到生产运维的完整工程指南,包含具体的延迟优化技巧与评估方法。

7月11日周六
  1. 宝玉的分享82

    ChatGPT、Codex 与 Work 功能区别及额度机制详解

    文章详细解析了 OpenAI 旗下 Chat、Work 和 Codex 三种模式的核心差异:Chat 用于问答,Work 面向跨应用知识工作并交付成品,Codex 专注代码仓库开发任务。

    推荐理由:原文通过对比表格和场景举例,清晰拆解了 Chat、Work 和 Codex 的功能边界与额度机制,帮助读者快速建立正确的使用预期。

7月6日周一
  1. 宝玉的分享78

    Claude Code 团队详解 AI 智能体循环类型与实践指南

    Claude Code 团队发布指南,将 AI 智能体循环定义为重复执行工作周期直至满足停止条件,并划分为回合制、目标导向、基于时间和主动式四种类型。文章针对每种循环给出了触发方式、停止条件及适用场景,例如使用 /goal 设定明确完成标准,或通过 /loop 和 /schedule 实现周期性任务自动化。

    推荐理由:原文系统梳理了四种循环模式及其触发停止机制,提供了控制 Token 消耗与保障代码质量的具体操作建议。

5月8日周五
  1. 宝玉的分享78

    Claude Code 用户指南:为何用 HTML 替代 Markdown 作为 AI 输出格式

    Claude Code 团队成员 Thariq 提出在 AI 智能体工作流中优先使用 HTML 而非 Markdown 作为输出格式。HTML 能提供更丰富的视觉呈现、更高的信息密度及双向交互能力,且便于通过链接分享。

    推荐理由:作者基于 Claude Code 实际工作流,详细拆解了 HTML 替代 Markdown 在信息密度、交互性及分享效率上的具体优势与提示词技巧。

5月6日周三
  1. 宝玉的分享80

    Anthropic 高管对话:解释 Claude 限速原因并展望组织级 AI

    在 Code with Claude 大会上,Anthropic CEO Dario Amodei 和总裁 Daniela Amodei 指出,2026 年第一季度营收和使用量年化增速达 80 倍,远超原本按 10 倍准备的算力规划,这是 Claude 持续限速的直接原因。

    推荐理由:整理自官方对话,披露了算力增速与限速的因果及组织级AI趋势,为理解当前开发瓶颈提供内部视角。

5月5日周二
  1. 宝玉的分享78

    Boris Cherny:Claude Code 之后,写代码正在变成“管理 Agent”

    Anthropic Claude Code 创建者 Boris Cherny 在 Sequoia 大会上分享观点,认为编程正从手写代码转向管理 Agent,并指出 Anthropic 内部已实现无手写代码开发。

    推荐理由:文章整理了 Claude Code 创建者关于编程范式转变、SaaS 护城河重构及组织流程领先性的核心观点,为理解 AI 对软件工程的影响提供了具体视角。

4月28日周二
  1. 宝玉的分享82

    Ed Zitron 分析 AI 经济账算不通:从 Copilot 涨价看行业成本错配

    Ed Zitron 指出 AI 行业的经济账根本算不通,以 GitHub Copilot 将于 2026 年 6 月改为按用量计费为例,揭示了长期补贴算力导致的不可持续性。文章认为基于 LLM 的月费订阅模式因推理成本波动剧烈而存在严重缺陷,并警告 OpenAI 和 Anthropic 等公司面临巨大的数据中心资本开支压力,若无法实现承诺的收入增长将引发系统性风险。

    推荐理由:文章通过拆解 GitHub Copilot 转向按用量计费的案例,深入分析了 AI 订阅模式背后的算力成本错配与数据中心经济风险。

4月17日周五