跳到正文

#产品更新

今日 0 条
10月3日周六
10月2日周五
  1. NVIDIA78

    NVIDIA 发布 GPT-6 Astra Ultrafast:基于 Blackwell GPU 实现 8 倍推理加速

    OpenAI 的 GPT-6 Astra Ultrafast 模型现已通过 NVIDIA Blackwell GPU 在 API 及 ChatGPT Work/Codex 中上线,其 token 生成速度比 Astra Standard 模式快至多 8 倍。

    推荐理由:原文说明了GPT-6 Astra Ultrafast在NVIDIA Blackwell GPU上的8倍加速效果及其对开发者工作流的影响,读者可据此评估其在实际编码和交互场景中的性能提升价值。

  2. ComfyUI Blog65

    ComfyUI 发布 Comfy Agent:首个面向创作流程的智能体

    ComfyUI 正式推出 Comfy Agent,该功能已在 Comfy Cloud 上线并计划数周后登陆 Comfy Desktop。Comfy Agent 直接嵌入应用内部,能根据自然语言描述自动规划、构建、运行和迭代工作流,支持并行聊天及实时协作编辑画布。目前处于 Beta 阶段,用户可通过 cloud.comfy.org 免费试用初始对话额度,后续还将扩展至本地环境以支持自定义节点生成。

    推荐理由:ComfyUI 推出内置智能体,将工作流构建、调试与迭代自动化,降低创意实现的技术门槛。

10月1日周四
9月30日周三
9月29日周二
9月28日周一
9月26日周六
  1. GitHub Blog42

    GitHub Copilot 应用新手指南:如何用 canvases 构建自定义工作流

    GitHub Copilot 应用推出 canvases 功能,允许用户通过 `/create-canvas` 指令用自然语言生成看板、清单等双向交互界面。该工具支持人与 AI 智能体实时同步操作状态,无需编写代码即可定制工作流。生成的 canvas 可作为扩展保存并共享给团队,实现即时协作而非传统的命令等待模式。

9月25日周五
  1. Google DeepMind73

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将低延迟流式视频与实时对话能力结合,为 Gemini Enterprise 提供具备动态视觉化身的交互体验。

    推荐理由:原文详细说明了实时视觉化身在异步工具调用和多语言同步上的技术实现,为企业构建具备连续在场感的智能体提供了具体参考。

9月24日周四
  1. Google DeepMind78

    Google DeepMind 发布 Private AI Compute 安全服务器端内存更新

    Google DeepMind 为其 Private AI Compute 平台引入安全服务器端内存功能,实现跨设备的持久化 AI 记忆并保持设备级隐私标准。该架构通过硬件隔离的安全飞地、端到端加密通道及仅存于用户设备的加密密钥,确保云端数据即使 Google 也无法访问。官方同步发布了更新的技术白皮书、防篡改软件记录及独立审计报告以增强透明度。

    推荐理由:原文详述了云端持久记忆与设备端密钥分离的架构,为理解隐私保护下的跨设备 AI 连续性提供了技术依据。

9月23日周三
9月22日周二
  1. PyTorch68

    vLLM 推出硬件无关模型层以兼顾前沿性能与多硬件兼容

    vLLM 引入新的“硬件无关”(HW agnostic)模型层,旨在解决内部实现变更导致与 fullgraph torch.compile 不兼容的问题,从而支持非 NVIDIA 加速器、旧款 GPU 及多样化模型。

    推荐理由:vLLM 引入硬件无关层以平衡前沿性能优化与多硬件兼容性,在 H100 上实现接近原生实现的吞吐量。

  2. NVIDIA38

    NVIDIA 推出 DSX Ready 计划以认证 AI 工厂电源与冷却产品

    NVIDIA 发布 DSX Ready 认证计划,旨在验证符合其 AI 工厂参考设计要求的合作伙伴产品。该计划首批涵盖电池储能系统(BESS)和冷却分配单元(CDU),已纳入 Hitachi Energy、Tesla、LG Electronics 等厂商方案。此举帮助构建者降低集成风险,确保电源与冷却设施适配整体架构以优化 AI 产出。

  3. NVIDIA40

    NVIDIA 解析物理 AI 规模化部署为何需全层级安全

    NVIDIA Halos 作为首个全栈物理 AI 安全系统,覆盖自动驾驶与机器人从硬件到验证的全生命周期。该方案整合 DRIVE AGX Thor、IGX Thor 及 Alpamayo 模型,通过仿真与合成数据应对动态环境风险。随着 2035 年预计部署 4900 万辆 L3-5 级 AV 和 6000 万台工业机器人,这种持续的安全保障成为规模化落地的关键。

9月21日周一
9月18日周五
  1. Google AI26

    Google 与设计师在纽约时装周利用 Google Flow 定制 AI 工具

    Google Envisioning Studio 联合设计师 Jane Wade 和 Sergio Hudson,基于 Google Flow 开发 Styling Suite 与 Runway Visualization 两款定制工具。前者支持数字模特虚拟造型以替代耗时三天的线下试装,后者通过模拟秀场灯光道具优化预算控制。用户可用自然语言描述需求,无需编程即可构建专属工作流。

9月17日周四
9月16日周三