NVIDIA DGX Spark 推出 64GB 统一内存版本
NVIDIA DGX Spark 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等合作伙伴提供 64GB 统一内存的新配置,起售价为 $4,999。
NVIDIA DGX Spark 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等合作伙伴提供 64GB 统一内存的新配置,起售价为 $4,999。
OpenAI 的 GPT-6 Astra Ultrafast 模型现已通过 NVIDIA Blackwell GPU 在 API 及 ChatGPT Work/Codex 中上线,其 token 生成速度比 Astra Standard 模式快至多 8 倍。
推荐理由:原文说明了GPT-6 Astra Ultrafast在NVIDIA Blackwell GPU上的8倍加速效果及其对开发者工作流的影响,读者可据此评估其在实际编码和交互场景中的性能提升价值。
CoreWeave 宣布在云端提供 NVIDIA Vera Rubin NVL72 系统,首批客户 Cognition 实测显示其 SWE-2 推理工作负载的总 Token 吞吐量较 GB200 NVL72 提升高达 4.8x。
OpenAI 在 DevDay 2026 上发布了包括 dots 智能体助理、ChatGPT Space 协作空间、Codex Cloud 以及新模型 GPT-6.1 Sol 在内的超过 20 项功能和产品更新。
推荐理由:原文梳理了 OpenAI DevDay 2026 的密集发布,重点呈现 dots 智能体、GPT-6.1 Sol 模型及 Pro 会员额度调整,可据此观察其向企业服务转型的具体路径。
OpenAI 在 DevDay 2026 发布多项更新,Codex 现支持可复用的云端开发环境和仓库安全漏洞扫描,Agents API 新增 Computer Use 功能以允许智能体自主操作软件。
推荐理由:原文梳理了Codex环境复用、安全扫描及Agents API的Computer Use能力,并披露了Decisions API与Ultrafast定价,为开发者评估新工作流提供依据。
DeepSeek 正式推出 DeepSeek Harness 桌面端,提供 macOS 和 Windows 安装包,登录赠送 6 元额度。该版本支持常驻后台运行、定时自动化任务及 Office/PDF 预览,并允许用户通过创作模式让 AI 自行编写安装新插件。
推荐理由:实测展示了从终端到桌面的交互变化,以及自动化任务和插件自生成能力如何降低普通用户的使用门槛。
OpenAI DevDay 2026 共发布超过 20 项公告,涵盖 GPT-6 Astra、ChatGPT、Codex、APIs、安全及面向开发者的新工具。
一目科技推出全球最薄可量产仿生视触觉传感器 SENTRA T0,厚度低于 3 毫米。该方案利用光探测形变,在指尖面积实现 24 万个感知点及 5mN 力精度,解决灵巧手安装难题并赋予机器人类人触觉能力。
可灵 AI 推出 Kling 4.0 大版本更新,主打真实、可控与专业,在画面真实感及叙事完整度上实现提升。该模型支持 10-bit HDR 与 4K/1080P 分辨率输出,单次原生生成最长可达 30 秒,并允许输入最多 15 项参考素材以精准控制运镜与构图。此外,可灵还推出了兼具高性价比与高效速度的 Kling 4.0 Flash 版本,已于 9 月 28 日开放小范围体验。
Nvidia 周一发布了名为 Open Agent Safety Platform 的新软件平台,旨在为 AI 开发者提供设置智能体安全防护措施的工具,防止其突破沙箱限制。
Basis 利用 GPT-6 Astra 完成 50 个标签页的税务工作簿,速度比 GPT-5.6 Sol 快 2 倍。GPT-6 Astra 对用户意图的理解更强,提升了 Basis 在实际应用中的信心。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将低延迟流式视频与实时对话能力结合,为 Gemini Enterprise 提供具备动态视觉化身的交互体验。
推荐理由:原文详细说明了实时视觉化身在异步工具调用和多语言同步上的技术实现,为企业构建具备连续在场感的智能体提供了具体参考。
Hyper3D 近日上线 Agentic Mode,整合 Rodin 与 LLM 多模态能力,实现自主理解输入并规划建模路径。该功能将生成范围拓展至工业设计,支持从带尺寸图纸生成可调整三维模型。此前其已通过 MCP 接入 Codex、Claude Code 等智能体,旨在降低专业 3D 创作门槛。
Google DeepMind 为其 Private AI Compute 平台引入安全服务器端内存功能,实现跨设备的持久化 AI 记忆并保持设备级隐私标准。该架构通过硬件隔离的安全飞地、端到端加密通道及仅存于用户设备的加密密钥,确保云端数据即使 Google 也无法访问。官方同步发布了更新的技术白皮书、防篡改软件记录及独立审计报告以增强透明度。
推荐理由:原文详述了云端持久记忆与设备端密钥分离的架构,为理解隐私保护下的跨设备 AI 连续性提供了技术依据。
invideo 借助 GPT-6 Astra 实现更精准的编辑规划,将色彩校正与调色效率提升三倍。该方案支持在一天内生成 50 种自定义特效,显著优化了视频制作流程。
GPT-6 通过提高缓存命中率、引入新诊断工具及显式断点,显著优化了提示词缓存机制。这些改进配合相关控制选项,有效降低了推理延迟与服务成本。
GPT-6 Astra 使 Parallel 的智能体在劳动力市场数据研究与综合任务中,相比此前模型将耗时与成本均降低一半。
NVIDIA 发布 DSX Ready 认证计划,旨在验证符合其 AI 工厂参考设计要求的合作伙伴产品。该计划首批涵盖电池储能系统(BESS)和冷却分配单元(CDU),已纳入 Hitachi Energy、Tesla、LG Electronics 等厂商方案。此举帮助构建者降低集成风险,确保电源与冷却设施适配整体架构以优化 AI 产出。
NVIDIA Halos 作为首个全栈物理 AI 安全系统,覆盖自动驾驶与机器人从硬件到验证的全生命周期。该方案整合 DRIVE AGX Thor、IGX Thor 及 Alpamayo 模型,通过仿真与合成数据应对动态环境风险。随着 2035 年预计部署 4900 万辆 L3-5 级 AV 和 6000 万台工业机器人,这种持续的安全保障成为规模化落地的关键。
NVIDIA 推出 DSX 平台,通过 MaxLPS、Flex 等技术组件优化 AI 工厂每兆瓦的 Token 吞吐量。Lambda 在 HGX B200 集群上的首次验证显示,智能管理固定功率预算可使 Token 吞吐量提升 24%,性能功耗比提高 23%。
推荐理由:原文披露了 NVIDIA DSX 平台在固定功率预算下提升 Token 吞吐量的实测数据及电网响应案例,为评估 AI 工厂能效优化提供了具体参考。
NVIDIA 在 AI Infra Summit 上公布 Vera Rubin 和 DSX 平台的最新进展,重点展示了通过优化 Tokens Per Watt 提升 AI 工厂能效的成果。
推荐理由:原文披露了 Vera Rubin 与 DSX 平台在 tokens per watt 上的实测数据,读者可据此评估 AI 工厂的能效优化路径。
Perplexity 采用 GPT-6 Astra 负责撰写通信内容、修改软件及监控生产系统等端到端任务。相比早期模型,Perplexity 对该模型的介入频率大幅降低,显示出对其自主执行能力的更高信任度。
OpenAI 发布 Agents API,旨在帮助开发者在云端构建和部署智能体。该接口提供了一套用于编排多步任务、工具调用及状态管理的标准化组件。
推荐理由:原文介绍了面向智能体构建的新 API,开发者可据此评估其在现有工作流中的集成潜力。
Google DeepMind 推出 AlphaGenome Atlas,这是一个包含人类基因组中 90 亿个单核苷酸变异预测的平台。该工具提供 AVI 评分以快速排序变异影响,并支持通过网站、API 和 Google Antigravity 技能访问。外部合作者已利用其识别罕见病关键变异并发现与常见性状相关的稀有变异。
推荐理由:原文提供了覆盖全基因组的变异预测平台及评分工具,读者可据此评估其在罕见病研究和群体遗传学中的实际效用。
OpenAI 发布 ChatGPT Images 2.5,旨在将用户的想法、草图和参考照片转化为更具个性化和精致感的图像。该功能致力于生成更能准确反映用户意图的图片,提升创意表达效果。
Google 推出 Gemini 3.7 Flash,作为面向编码与智能体的主力模型,其每百万 token 价格仅为前代一半。同时发布搭载 Tensor G6 芯片的 Pixel 11 系列设备,并上线 Gemini 3.5 Transcribe 语音转文字模型。此外,Gemini 应用月活跃用户突破 10 亿,成为 Google 历史上增长最快的产品。
Google DeepMind 宣布在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 模型中推出智能体视频理解(agentic video understanding)功能。
推荐理由:原文给出了视频分析中 token 消耗降低 88% 的具体数据及 API 调用方式,读者可据此评估其在长视频处理场景下的成本效益与落地可行性。
Gemini 3.5 Flash 现已将计算机操作(computer use)作为内置工具支持,此前该能力仅存在于独立的 Gemini 2.5 模型中。开发者可通过 Gemini API 和 Gemini Enterprise Agent Platform 构建能跨浏览器、移动端和桌面环境进行感知、推理及行动的自定义智能体。
推荐理由:原文说明了计算机操作能力从独立模型整合进主模型的变化,并给出了针对提示注入风险的安全措施与开发入口。
Google DeepMind 在 Project Genie 中推出基于 Street View 的实景锚定能力,允许用户选择美国境内的真实地点作为生成世界的起点,并应用如“海洋世界”或“黑白电影”等风格进行创意重构。
推荐理由:Project Genie 接入 Street View 真实影像,让 AI 生成的虚拟世界能锚定现实地点,为智能体提供更具真实感的交互环境。
Google DeepMind 推出 Gemini for Science,包含三个基于 Google Labs 的实验性工具和集成在 Google Antigravity 中的 Science Skills。
推荐理由:原文展示了面向科研的 Agent 工具集与技能包,读者可据此了解 AI 如何加速假设生成、计算发现及文献分析等核心科研环节。
Google DeepMind 的 Co-Scientist 工具协助剑桥大学 Clare Bryant 教授团队识别导致严重疾病的分子开关。该工具通过生成并排序假设,将原本需两到三年的实验工作缩短至六个月,精准定位关键氨基酸突变。
Google DeepMind 发布基于 Gemini 构建的多智能体 AI 系统 Co-Scientist,旨在通过迭代生成、辩论和演化假设来加速科学研究。该系统包含生成、反思、排名和演化等专用智能体,并引入类似 AlphaGo 的“想法锦标赛”机制对假设进行验证和排序。
推荐理由:原文展示了多智能体协作生成假设的具体机制及在肝病、ALS等领域的实测案例,为科研人员评估AI辅助发现工具提供了可参考的落地场景。