跳到正文

#Agent

今日 0 条
10月3日周六
10月2日周五
  1. ComfyUI Blog65

    ComfyUI 发布 Comfy Agent:首个面向创作流程的智能体

    ComfyUI 正式推出 Comfy Agent,该功能已在 Comfy Cloud 上线并计划数周后登陆 Comfy Desktop。Comfy Agent 直接嵌入应用内部,能根据自然语言描述自动规划、构建、运行和迭代工作流,支持并行聊天及实时协作编辑画布。目前处于 Beta 阶段,用户可通过 cloud.comfy.org 免费试用初始对话额度,后续还将扩展至本地环境以支持自定义节点生成。

    推荐理由:ComfyUI 推出内置智能体,将工作流构建、调试与迭代自动化,降低创意实现的技术门槛。

10月1日周四
  1. GitHub Blog26

    GitHub Universe 2026 十大技术演讲精选

    GitHub Universe 2026 聚焦 Copilot 记忆基准、MCP 细粒度授权及 Vite+ 工具链等前沿议题。GitHub 研究揭示累积上下文可能降低性能,Pomerium 演示身份感知代理以强化 MCP 安全边界。此外,会议还将探讨 npm 供应链风险、AI 代码验证机制及低连接环境下的软件开发实践。

  2. Google DeepMind93

    Google DeepMind 发布 Gemini 4 Argon:面向复杂工作流的前沿智能模型

    Google DeepMind 宣布推出新前沿模型 Gemini 4 Argon,该模型旨在通过深度推理支持复杂的长周期工作流,目前正通过 Fairwind Program 向受信任的网络安全防御者逐步开放。

    推荐理由:原文披露了 Gemini 4 Argon 在长上下文输出、软件工程及网络安全防御上的具体基准数据与分阶段开放策略,为评估前沿模型在复杂工作流中的实际效能提供了关键参考。

9月30日周三
9月29日周二
  1. GitHub Blog73

    GitHub 开源 AI 安全智能体任务流:如何发现 24 个 Android 漏洞

    GitHub Security Lab 发布了开源的 Taskflow Agent,通过定制化的提示词工作流自动化 Android 应用的安全审计,目前已协助发现并报告了 24 个漏洞。

    推荐理由:GitHub Security Lab 开源了用于 Android 漏洞审计的 AI 任务流,提供了具体的 Prompt 设计思路和两个高危漏洞挖掘案例。

9月26日周六
  1. GitHub Blog42

    GitHub Copilot 应用新手指南:如何用 canvases 构建自定义工作流

    GitHub Copilot 应用推出 canvases 功能,允许用户通过 `/create-canvas` 指令用自然语言生成看板、清单等双向交互界面。该工具支持人与 AI 智能体实时同步操作状态,无需编写代码即可定制工作流。生成的 canvas 可作为扩展保存并共享给团队,实现即时协作而非传统的命令等待模式。

9月25日周五
  1. Google DeepMind73

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将低延迟流式视频与实时对话能力结合,为 Gemini Enterprise 提供具备动态视觉化身的交互体验。

    推荐理由:原文详细说明了实时视觉化身在异步工具调用和多语言同步上的技术实现,为企业构建具备连续在场感的智能体提供了具体参考。

9月23日周三
9月22日周二
  1. PyTorch78

    Shopify 如何利用 PyTorch 和 vLLM 构建持续学习循环

    Shopify 通过 PyTorch 和 vLLM 建立持续学习循环,将生产失败数据转化为模型权重更新,使 GraphQL Agent 在超越前沿模型质量的同时降低 96% 的服务成本。该流程包括定义质量评估标准、校准 LLM 裁判、利用自动研究优化基线、通过监督微调和 GRPO 强化学习更新参数,以及使用 Gist 压缩技术减少提示词长度以提升推理速度。

    推荐理由:原文详细拆解了从定义质量到模型微调及提示词压缩的完整闭环,为构建自进化AI系统提供了可复用的工程路径。

9月21日周一
9月18日周五
9月16日周三
  1. Google DeepMind86

    Google DeepMind 发布 Gemini 3.8 Live 和 3.8 Live Extended Thinking 模型

    Google DeepMind 推出 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款新模型,旨在提升近实时推理能力以支持更复杂的语音交互任务。

    推荐理由:原文披露了 Gemini 3.8 Live 系列在实时推理、多语言切换及后台工具调用上的具体能力升级与基准表现,为构建生产级语音智能体提供了明确的技术参考。

9月15日周二
9月14日周一
9月12日周六
9月11日周五
9月10日周四
  1. OpenAI62

    OpenAI 推出 Agents API

    OpenAI 发布 Agents API,旨在帮助开发者在云端构建和部署智能体。该接口提供了一套用于编排多步任务、工具调用及状态管理的标准化组件。

    推荐理由:原文介绍了面向智能体构建的新 API,开发者可据此评估其在现有工作流中的集成潜力。

9月9日周三
9月6日周日
9月3日周四
  1. Google DeepMind65

    Google DeepMind 推出 Fairwind Program 提供政府与企业主动网络防御能力

    Google DeepMind 启动 Fairwind Program,向政府和可信合作伙伴开放基于 Gemini 3.8 Flash Cyber 和 CodeMender 的高级网络防御能力。该计划旨在帮助防御者以代理规模自主发现、验证并修复漏洞,将补丁生成时间从数周缩短至几分钟。目前已有超过 650 家全球合作伙伴参与,重点保护公共部门网络、关键基础设施及核心技术平台。

    推荐理由:原文披露了 Fairwind Program 的准入机制与核心组件,读者可据此评估其在关键基础设施防御中的实际部署价值。

9月2日周三
  1. Google AI68

    Google 启动 Fairwind 计划,向政府与企业开放高级 AI 网络防御能力

    Google 推出 Fairwind 计划,向政府、关键基础设施运营商及可信合作伙伴提供受限访问权限,利用其最先进的人工智能进行主动网络防御。该计划整合了 Gemini 3.8 Flash Cyber 模型与 CodeMender 框架,使防御者能够在安全的云环境中以代理规模自主发现、验证并修复代码漏洞,将原本需数周的手动修复过程缩短至几分钟。

    推荐理由:原文披露了面向政府与企业的受限访问计划,结合 Gemini 3.8 Flash Cyber 与 CodeMender 实现漏洞自动修复,展示了 AI 在主动网络防御中的具体落地路径。

8月27日周四
  1. Google DeepMind78

    Google DeepMind 发布 Gemini 3.5 Transcribe 语音转文字模型

    Google DeepMind 发布最新语音转文字模型 Gemini 3.5 Transcribe,旨在实现精准且智能的实时转录。该模型在 Artificial Analysis 测试中流式和非流式平均词错率分别为 4.0% 和 2.6%,支持超过 85 种语言及最多三个说话人的身份识别。

    推荐理由:原文给出了新模型的流式与非流式词错率数据、多语言支持范围以及开发者 API 接入方式,读者可以据此评估其在实时交互场景中的实际表现。

8月21日周五