Charity Majors 谈 AI 如何改变软件工程:从怀疑到视其为代际变革
Honeycomb CTO Charity Majors 认为 Opus 4.5 与 Claude Code 促使 AI 成为软件工程的代际变革,类比云计算对基础设施的影响。她指出代码生成经济已变,人类应聚焦验证系统而非代码审查,并主张工程需构建能安全发布未读代码的体系。
Honeycomb CTO Charity Majors 认为 Opus 4.5 与 Claude Code 促使 AI 成为软件工程的代际变革,类比云计算对基础设施的影响。她指出代码生成经济已变,人类应聚焦验证系统而非代码审查,并主张工程需构建能安全发布未读代码的体系。
通用 Agent 将凭借 Skill 和 MCP 生态吃掉垂直应用,少数赢家通吃。模型能力与成本构成最终护城河,用户忠诚度低且易因更优模型切换。小团队应聚焦基于 Agent 的插件开发而非底层框架,普通用户越早使用越能提升效率。
OpenAI 推出 GPT-5.6(含 Sol 和 Luna)并将桌面编码产品更名为 ChatGPT Work,SpaceX AI 发布低成本 Grok 4.5,Meta 上线 Muse Spark 1.1。中国开源模型占 OpenRouter 周 token 量超 30%,NVIDIA 发布 Nemotron-Labs-Diffusion 三模式语言模型。
Anthropic 推出 Claude Sonnet 5,主打限时折扣定价与增强的智能体编码能力,并部署了新的网络安全分类器。Etched 获得价值 10 亿美元的推理硬件需求,中国开源 LongCat 2.0 MoE 模型展示大规模训练效率。Google 同步上线 NotebookLM 视频摘要功能及 Nano Banana 2 Lite 图像生成器。
Anthropic 获准向特定机构发布 Mythos-5,OpenAI 推出仅限约 20 家获批组织访问的 GPT-5.6 “Sol”,Meta 面临模型审查压力。GLM 5.2 以 MIT 许可证开源并优化长上下文编码性能。此外,OpenAI 联合 Broadcom 在 TSMC 3nm 工艺上推出 Jalapeño 推理 ASIC,Groq 融资 6.5 亿美元转向 neocloud。
Anthropic 因政府命令切断 Fable 5 和 Mythos 5 访问权限,SpaceX 以约 $1.75T 估值完成 IPO 并斥资 $60B 收购 AI 编程初创公司 Cursor。ChatGPT 市场份额首次跌破 50%,Moonshot 发布 Kimi K2.7-Code,NVIDIA 推出 Nemotron 3 Ultra 等开源模型。
Anthropic 发布 Claude Fable 5,引发关于严格护栏与静默降级的争议。Apple 推出基于 Gemini 合作的 Siri AI,Google 上线 Gemini 3.5 Live Translate 并调整订阅价格。OpenAI 秘密提交 IPO 申请,Bezos 支持的 Prometheus 融资 120 亿美元,DeepSeek 寻求 70 亿美元外部融资。
Anthropic 发布 Claude Opus 4.8,提升基准分数并推出 Dynamic Workflows;Microsoft 展示基于 OpenClaw 的 Scout 助手及 MAI Thinking 1 等自研模型。
宝玉分享对 GitHub 热门项目 Caveman 的实测分析,该项目旨在让 AI 像原始人一样说话以节省 Token,README 声称能节省 65%。JetBrains 的测试显示,在 Claude Code 运行 86 个真实编程任务时,Caveman 实际仅节省 8.5% 的输出 Token,且未显著影响任务质量。
文章详细解析了 OpenAI 旗下 Chat、Work 和 Codex 三种模式的核心差异:Chat 用于问答,Work 面向跨应用知识工作并交付成品,Codex 专注代码仓库开发任务。
推荐理由:原文通过对比表格和场景举例,清晰拆解了 Chat、Work 和 Codex 的功能边界与额度机制,帮助读者快速建立正确的使用预期。
Claude Code 团队发布指南,将 AI 智能体循环定义为重复执行工作周期直至满足停止条件,并划分为回合制、目标导向、基于时间和主动式四种类型。文章针对每种循环给出了触发方式、停止条件及适用场景,例如使用 /goal 设定明确完成标准,或通过 /loop 和 /schedule 实现周期性任务自动化。
推荐理由:原文系统梳理了四种循环模式及其触发停止机制,提供了控制 Token 消耗与保障代码质量的具体操作建议。
宝玉指出 Anthropic 推出的 Claude Design 能生成高完成度的可交互原型,而 OpenAI 的 Codex 尚未推出同类产品,核心原因在于 GPT-5.5 模型在系统架构设计和状态管理方面的能力不足。
Google I/O 发布 Gemini 3.5(含 Flash 版)、常驻智能体 Gemini Spark 及多模态视频模型 Gemini Omni。xAI 推出 Grok Build,Cursor Composer 2.5 以低成本匹配 Opus 4.7 和 GPT-5.5 基准。
OpenAI 发布 GPT Realtime 2 语音 API,Thinking Machines 预览低延迟全双工对话系统。Anthropic 推出 Claude for Legal 并深化 AWS 合作,Sam Altman 出庭作证引发关注。
宝玉翻译并分享了 Anthropic 发布的《创始人手册》,指导创业者如何利用 AI 重塑初创公司生命周期。文章将创业分为构思、MVP、发布和扩展四个阶段,分别介绍了如何使用 Chat、Claude Cowork 和 Claude Code 进行市场调研、智能体编程、流程自动化及安全审查。
宝玉撰文解析 Forward Deployed Engineer(FDE)这一新兴岗位,指出其核心职责是驻扎客户现场进行代码集成与调试,区别于传统咨询顾问。
Anthropic Claude Code 和 Cowork 产品线工程与产品负责人 Fiona Fung 在 Code with Claude 2026 大会上分享了 AI 时代管理工程团队的经验。
文章深入解析了包裹在大语言模型之外的软件架构 Agent Harness,指出其包含编排循环、工具、记忆等 12 个核心组件。通过改变底层架构而非模型本身,即可显著提升系统在 TerminalBench 2.0 等基准测试中的表现。
Arnav Gupta 撰文指出当前企业裁员潮并非单纯由 AI 直接取代岗位引起,而是源于 AI 带来的代码产出激增未能转化为相应的商业收入成果。文章认为在“对齐”成本高昂且组织存在冗余的背景下,企业为抵消巨额 Token 支出并加速流程,不得不通过裁员来削减人力成本和组织摩擦,这一趋势将持续直到学会将 AI 投入有效转化为实际业务价值。
Claude Code 团队成员 Thariq 提出在 AI 智能体工作流中优先使用 HTML 而非 Markdown 作为输出格式。HTML 能提供更丰富的视觉呈现、更高的信息密度及双向交互能力,且便于通过链接分享。
推荐理由:作者基于 Claude Code 实际工作流,详细拆解了 HTML 替代 Markdown 在信息密度、交互性及分享效率上的具体优势与提示词技巧。
在 Code with Claude 大会上,Anthropic CEO Dario Amodei 和总裁 Daniela Amodei 指出,2026 年第一季度营收和使用量年化增速达 80 倍,远超原本按 10 倍准备的算力规划,这是 Claude 持续限速的直接原因。
推荐理由:整理自官方对话,披露了算力增速与限速的因果及组织级AI趋势,为理解当前开发瓶颈提供内部视角。
Anthropic Claude Code 创建者 Boris Cherny 在 Sequoia 大会上分享观点,认为编程正从手写代码转向管理 Agent,并指出 Anthropic 内部已实现无手写代码开发。
推荐理由:文章整理了 Claude Code 创建者关于编程范式转变、SaaS 护城河重构及组织流程领先性的核心观点,为理解 AI 对软件工程的影响提供了具体视角。
OpenAI 发布 GPT-5.5,xAI 推出 Grok Voice Think Fast 1.0,DeepSeek 开源 V4。Google 拟向 Anthropic 投资至多 $40B,Meta 收购 Manus 受阻。最新研究聚焦模型对 AI 安全研究的潜在破坏行为。
OpenAI 推出擅长文本生成的 ChatGPT Images 2.0,阿里 Qwen 3.6 Max Preview 转为仅 API 模式。Moonshot AI 开源 1T 参数 MoE 模型 Kimi K2.6,MiniMax M 2.7 在 SWE-Pro 得分 56.22%。
Ed Zitron 指出 AI 行业的经济账根本算不通,以 GitHub Copilot 将于 2026 年 6 月改为按用量计费为例,揭示了长期补贴算力导致的不可持续性。文章认为基于 LLM 的月费订阅模式因推理成本波动剧烈而存在严重缺陷,并警告 OpenAI 和 Anthropic 等公司面临巨大的数据中心资本开支压力,若无法实现承诺的收入增长将引发系统性风险。
推荐理由:文章通过拆解 GitHub Copilot 转向按用量计费的案例,深入分析了 AI 订阅模式背后的算力成本错配与数据中心经济风险。
Anthropic Claude Code 和 Cowork 产品负责人 Cat Wu 在 Lenny's Podcast 中透露,团队将功能交付周期从半年压缩至一天,并解释了这一速度背后的机制。
黄仁勋接受 Dwarkesh Patel 两小时专访,提出“输入是电子,输出是 Token”定义 Nvidia 使命,并强烈反对将 AI 芯片视为武器或实施对华出口管制。他承认早年未投资 Anthropic 导致其转向 TPU/Trainium 是特例而非趋势,强调 CUDA 护城河在于装机量与跨云生态,并指出能源政策比芯片产能更制约未来。
Anthropic 发布由 Claude Opus 4.7 驱动的 Claude Design,支持从自然语言描述直接生成可运行的 React/CSS 高保真交互原型。
推荐理由:作者通过实测案例展示了从模糊需求到可运行代码的完整流程,并对比了传统画布工具与AI原生设计工具的范式差异。
文章介绍了 Claude Code 将上下文窗口升级至 100 万 Token 后的会话管理最佳实践。作者解释了上下文衰减概念,并对比了继续、回溯、清空、压缩和子智能体五种决策路径。针对何时开启新会话、如何用回溯代替纠正以及压缩翻车的原因,给出了具体的操作建议和判断标准。
宝玉分享《Why Your “AI-First” Strategy Is Probably Wrong》一文,认为 AI First 的本质是软件工程 First,人需从代码编写转向关键节点判断。
作者指出频繁开启新会话会触发全价上下文重建从而增加成本,建议理解提示缓存机制后优先在活跃会话中继续工作。文中详细说明了缓存前缀匹配与存活时间规则,提供了禁用 1M 上下文及设置自动压缩阈值的 JSON 配置代码。此外还列出了精简 CLAUDE.md、限制模型阅读范围及使用子智能体隔离上下文等六条操作规则以减少 Token 消耗。
推荐理由:原文基于提示缓存机制纠正了频繁开新会话的习惯,并给出了模型切换与上下文压缩的具体配置方法。
针对 Claude Code 50 多万行泄漏源码,作者提出四步学习法:先跑起来、以点带线分析功能、动手二次开发、最后从零搭建架构。强调闭源优势在于隐藏防蒸馏逻辑与 /buddy 等彩蛋,Anthropic 回应称问题源于流程而非个人。
Delphi Ventures 创始合伙人 José Maria Macedo 发布文章,总结其在中国 AI 生态圈为期两周的实地考察心得。他看好深圳硬件供应链的密集网络效应及拓竹等公司的盈利能力,但对软件领域持悲观态度,指出闭源模型与西方存在显著差距且估值泡沫严重。Macedo 认为本土 VC 偏好大厂背景导致缺乏原创性创始人,而多数中国创业者正优先瞄准全球市场并采用西方工具链。
Anthropic Claude Code 团队工程师 Thariq Shihipar 分享了内部使用 Skills 加速开发的实战经验,梳理出九类常见 Skill 模式及编写最佳实践。
推荐理由:原文总结了 Anthropic 内部数百个 Skills 的分类体系与编写技巧,提供了从库参考到运维自动化的具体落地方法。
文章提出了智能体工程(Agentic Engineering)的八个等级,涵盖从 Tab 补全、上下文工程、复合工程、MCP 与技能、Harness Engineering、后台智能体到自主智能体团队的演进路径。