跳到正文

Agent 智能体

让模型自主规划、调用工具、完成多步任务的技术方向——从 Claude Code、Manus 到各家 Agent 框架与评测基准的全部动态。

最新精选

第 61–68 条 · 共 68 条
5月5日周二
  1. 宝玉的分享78

    Boris Cherny:Claude Code 之后,写代码正在变成“管理 Agent”

    Anthropic Claude Code 创建者 Boris Cherny 在 Sequoia 大会上分享观点,认为编程正从手写代码转向管理 Agent,并指出 Anthropic 内部已实现无手写代码开发。

    推荐理由:文章整理了 Claude Code 创建者关于编程范式转变、SaaS 护城河重构及组织流程领先性的核心观点,为理解 AI 对软件工程的影响提供了具体视角。

4月30日周四
  1. Google DeepMind82

    Google DeepMind 发布 AI co-clinician 研究计划

    Google DeepMind 宣布启动 AI co-clinician 研究计划,旨在探索 AI 如何作为协作成员增强医生专业能力并提升护理质量。该研究在盲测评估中显示,AI co-clinician 在98个初级保健查询案例中有97例未出现关键错误,且在开放式药物知识问答上超越其他前沿模型。

    推荐理由:原文展示了AI在真实临床查询中零关键错误及多模态远程诊疗的模拟评估,为理解医疗AI从文本向实时交互演进提供了具体数据支撑。

  2. 宝玉的分享78

    Demis Hassabis 谈 AGI 缺口、智能体现状与下一个科学突破

    Google DeepMind CEO Demis Hassabis 在 YC 访谈中指出,当前 AI 范式距离 AGI 仍有 50% 概率需要一两个关键突破,主要缺失在于持续学习、长程推理和记忆机制。

    推荐理由:Google DeepMind CEO 详细拆解了 AGI 缺失的关键拼图、智能体投入产出比争议以及科学发现的本质,为理解当前 AI 瓶颈提供了权威视角。

4月29日周三
  1. 宝玉的分享78

    Karpathy 访谈:Vibe Coding 只是开始,Agentic Engineering 才是关键

    Andrej Karpathy 在 Sequoia Capital 的 AI Ascent 访谈中提出,2025 年 12 月是其个人编程体验的转折点,AI 生成代码从“需修补”变为“直接可用”。

    推荐理由:Karpathy 区分了 Vibe Coding 抬高下限与 Agentic Engineering 保住上限,并指出 LLM 能力呈锯齿状分布,为理解 AI 编程现状提供了清晰框架。

4月6日周一
  1. 宝玉的分享80

    Claude Code 省 Token 指南:慎用 1M 上下文,不开新会话或者总是开新会话都不对

    作者指出频繁开启新会话会触发全价上下文重建从而增加成本,建议理解提示缓存机制后优先在活跃会话中继续工作。文中详细说明了缓存前缀匹配与存活时间规则,提供了禁用 1M 上下文及设置自动压缩阈值的 JSON 配置代码。此外还列出了精简 CLAUDE.md、限制模型阅读范围及使用子智能体隔离上下文等六条操作规则以减少 Token 消耗。

    推荐理由:原文基于提示缓存机制纠正了频繁开新会话的习惯,并给出了模型切换与上下文压缩的具体配置方法。

3月28日周六
  1. 宝玉的分享78

    Notion联合创始人Simon Last:不再手写代码与Agent工作流实践

    Notion联合创始人Simon Last在访谈中透露自2025年夏天起不再手写代码,并分享了Notion AI系统的演进历程。Notion的AI harness大约每六个月推倒重写一次,团队经历多次失败后于2026年2月发布可自主运行的Custom Agent。

    推荐理由:访谈披露了Notion每六个月重写AI系统层的策略,以及从直接做事工具转向管理Agent平台的定位变化。

  2. 宝玉的分享78

    宝玉分析飞书 CLI 开源及 AI Agent 时代命令行工具回归原因

    宝玉撰文分析飞书开源 lark-cli 的现象,指出在 AI Agent 时代,CLI 因具备自描述性、文本交互天然适配以及不占用上下文窗口等优势,正重新成为主流接口。

    推荐理由:文章结合飞书 CLI 开源案例,深入剖析了 AI Agent 时代命令行工具回归的技术逻辑与产品设计要点。

3月17日周二