ChatGPT Work 与 Codex 分析功能如何将 AI 使用关联至业务价值
ChatGPT Work 和 Codex 的分析功能帮助团队理解 AI 使用情况与支出,识别培训需求,并将采用率与业务成果相关联。
ChatGPT Work 和 Codex 的分析功能帮助团队理解 AI 使用情况与支出,识别培训需求,并将采用率与业务成果相关联。
Hex 借助 GPT-6 Astra 驱动其数据智能体,将复杂分析结果自动转化为交互式可视化报告。这一功能使企业员工能够轻松生成并分享高质量的视觉化数据分析成果。
NVIDIA 推出 DSX 平台,通过 MaxLPS、Flex 等技术组件优化 AI 工厂每兆瓦的 Token 吞吐量。Lambda 在 HGX B200 集群上的首次验证显示,智能管理固定功率预算可使 Token 吞吐量提升 24%,性能功耗比提高 23%。
推荐理由:原文披露了 NVIDIA DSX 平台在固定功率预算下提升 Token 吞吐量的实测数据及电网响应案例,为评估 AI 工厂能效优化提供了具体参考。
NVIDIA 在 AI Infra Summit 上公布 Vera Rubin 和 DSX 平台的最新进展,重点展示了通过优化 Tokens Per Watt 提升 AI 工厂能效的成果。
推荐理由:原文披露了 Vera Rubin 与 DSX 平台在 tokens per watt 上的实测数据,读者可据此评估 AI 工厂的能效优化路径。
Fyxer 利用 OpenAI 模型、微调、记忆功能及真实用户反馈,打造可信赖的 AI 行政助理。该工具能整理收件箱并以每位用户的语气起草邮件。
Perplexity 采用 GPT-6 Astra 负责撰写通信内容、修改软件及监控生产系统等端到端任务。相比早期模型,Perplexity 对该模型的介入频率大幅降低,显示出对其自主执行能力的更高信任度。
Google Search 通过 AI Mode 的 Canvas 工具为用户生成个性化训练计划,并支持连接 YouTube Music 创建定制跑步歌单。该功能还利用包含超 600 亿条商品列表的 Shopping Graph,提供基于特定约束(如鞋宽、预算)的装备推荐与比价服务,帮助用户高效完成赛前准备。
OpenAI 在 ChatGPT Work 中推出 Data agent,允许用户通过自然语言连接公司数据、挖掘洞察并构建交互式仪表板。该功能旨在让所有人利用 AI 将数据转化为实际价值,简化数据分析与可视化流程。
OpenAI 正式推出专为金融服务设计的 ChatGPT 版本,旨在帮助分析师完成从研究到客户演示的全流程工作。该工具集成了数据检索、财务建模及文档生成能力,支持用户快速构建估值模型并输出符合行业标准的报告。
OpenAI 与 GSA 联合宣布,向符合条件的联邦、州、地方及部落政府提供 $0 许可费、50% 使用折扣及扩展的网络防御支持。该举措旨在降低公共部门获取先进 AI 技术的门槛,同时强化其网络安全防护能力。
OpenAI 发布 Agents API,旨在帮助开发者在云端构建和部署智能体。该接口提供了一套用于编排多步任务、工具调用及状态管理的标准化组件。
推荐理由:原文介绍了面向智能体构建的新 API,开发者可据此评估其在现有工作流中的集成潜力。
Google Search 推出 Live Game Feed,提供实时比赛回顾、AI 洞察及视频集锦。用户可通过 AI Mode 连接 Yahoo Fantasy 或 Sleeper 账户,获取基于阵容的定制建议。该功能目前在美国移动端以英语提供,后续将扩展至大学球队及全球更多地区。
Google DeepMind 推出 AlphaGenome Atlas,这是一个包含人类基因组中 90 亿个单核苷酸变异预测的平台。该工具提供 AVI 评分以快速排序变异影响,并支持通过网站、API 和 Google Antigravity 技能访问。外部合作者已利用其识别罕见病关键变异并发现与常见性状相关的稀有变异。
推荐理由:原文提供了覆盖全基因组的变异预测平台及评分工具,读者可据此评估其在罕见病研究和群体遗传学中的实际效用。
OpenAI 发布 ChatGPT Images 2.5,旨在将用户的想法、草图和参考照片转化为更具个性化和精致感的图像。该功能致力于生成更能准确反映用户意图的图片,提升创意表达效果。
OpenAI 正在扩大对新闻业的支持力度。该计划面向学生、教育工作者、记者及新闻机构,提供工具、培训和合作伙伴关系。
1Password 工程师利用 Codex 快速构建新功能及内部工具,使工程生产力提升 21%。该方案在确保代码达到生产就绪状态的同时,严格维持了高安全策略标准。
Comfy 推出 Forward Deployed Creatives 服务,由专家嵌入企业团队构建并交付可自主维护的 AI 工作流。该服务通过验证、构建、赋能和移交四阶段,解决原型难以规模化及生产就绪问题。核心目标是实现团队对流程的完全所有权,避免工具因人员变动而失效。
Google DeepMind 启动 Fairwind Program,向政府和可信合作伙伴开放基于 Gemini 3.8 Flash Cyber 和 CodeMender 的高级网络防御能力。该计划旨在帮助防御者以代理规模自主发现、验证并修复漏洞,将补丁生成时间从数周缩短至几分钟。目前已有超过 650 家全球合作伙伴参与,重点保护公共部门网络、关键基础设施及核心技术平台。
推荐理由:原文披露了 Fairwind Program 的准入机制与核心组件,读者可据此评估其在关键基础设施防御中的实际部署价值。
Google 推出 Fairwind 计划,向政府、关键基础设施运营商及可信合作伙伴提供受限访问权限,利用其最先进的人工智能进行主动网络防御。该计划整合了 Gemini 3.8 Flash Cyber 模型与 CodeMender 框架,使防御者能够在安全的云环境中以代理规模自主发现、验证并修复代码漏洞,将原本需数周的手动修复过程缩短至几分钟。
推荐理由:原文披露了面向政府与企业的受限访问计划,结合 Gemini 3.8 Flash Cyber 与 CodeMender 实现漏洞自动修复,展示了 AI 在主动网络防御中的具体落地路径。
Google 推出 Gemini 3.7 Flash,作为面向编码与智能体的主力模型,其每百万 token 价格仅为前代一半。同时发布搭载 Tensor G6 芯片的 Pixel 11 系列设备,并上线 Gemini 3.5 Transcribe 语音转文字模型。此外,Gemini 应用月活跃用户突破 10 亿,成为 Google 历史上增长最快的产品。
Google DeepMind 宣布在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 模型中推出智能体视频理解(agentic video understanding)功能。
推荐理由:原文给出了视频分析中 token 消耗降低 88% 的具体数据及 API 调用方式,读者可据此评估其在长视频处理场景下的成本效益与落地可行性。
Google 推出 Google Pics,这是一款基于 Nano Banana 模型构建的图像创建和编辑工具,正在向 Google AI Pro、Ultra 订阅用户及大多数 Workspace 商业客户逐步开放。
推荐理由:原文说明了基于 Nano Banana 模型的图片编辑能力以及直接嵌入 Workspace 应用的工作流变化,读者可据此评估其对现有设计协作流程的影响。
ComfyUI 宣布原生集成 Trellis.2 和 Pixal3D 两个开源 3D 生成模型,无需自定义节点或编译 CUDA 扩展即可运行。此次更新重构了 3D 工作流,新增 Load/Preview/Save 3D 节点及网格后处理功能,并移除了非商业许可依赖,支持在消费级硬件上免费进行包括商业用途在内的资产生成。
推荐理由:原生集成消除了编译依赖和许可限制,并配套完整的3D后处理节点,降低了本地高质量3D生成的门槛。
ComfyUI 通过 Partner Nodes 正式接入 Google 的 Gemini Omni 1.1 Flash 模型。该节点在单个界面中提供文本转视频、图像转视频、参考图转视频、视频编辑和场景扩展功能,支持 360p 至 4K 分辨率输出,并为每个片段自动生成音频轨道。
推荐理由:ComfyUI 集成 Gemini Omni 1.1 Flash,支持从文本到视频及指令式编辑,最高输出 4K 分辨率并自动生成音频。
Comfy 宣布成为 MiniMax H3 商业许可证的首个官方经销商,支持本地商用。该许可涵盖视频、音频及音乐模型,允许 LoRA 训练与微调,并包含 Forward Deployed Creatives 专家服务。用户可通过 Comfy 获取专业版或企业版计划,实现从开源权重到合规商用的无缝衔接。
Google Search AI Mode 升级,支持在对话中追踪超300家航司的机票价格、查询航班与酒店的积分或里程成本,并实现酒店直接预订。该功能已在180多个国家上线,初期支持Alaska Airlines、Hilton等合作伙伴,美国用户可通过Google Pay完成安全预订。
Google Search 提供五种工具助力家居装饰,包括利用 AI Mode 可视化家具摆放、通过 Lens 识别并购买复古单品。用户还可借助 Circle to Search 追踪灵感、使用 Search Live 指导 DIY 安装,以及查看价格历史以优化购物决策。
ComfyUI 现已原生支持阿里巴巴最新视频生成模型 Wan 3.0。该版本支持单次生成最长 30 秒的视频,无需拼接,并允许通过 @ 语法引用最多 10 张图片、5 个视频和 5 个音频片段作为参考素材。Wan 3.0 还新增了网页文档解析输入、480p 低成本档位以及基于指令的精准视频编辑功能,用户需将 ComfyUI 更新至 v0.33.4 或通过 Comfy Cloud 使用。
推荐理由:ComfyUI 原生支持 Wan 3.0,提供 30 秒长视频生成及多模态参考控制能力。
Google Search 在 AI Mode 和 AI Overviews 中上线五项教育工具,包括交互式可视化、免费练习测验及 Lens 解题辅导。Gemini Notebook 现已集成至搜索,支持跨产品同步笔记与资料分析。相关功能正以英文向全球逐步推送。
ComfyUI 正式开源其 MCP 服务器,支持在本地机器上直接运行,允许 Claude、Codex 等智能体连接本地 ComfyUI 环境。该更新实现了本地与云端的统一接入,智能体能自动读取硬件配置以评估模型兼容性,并处理权重下载、节点匹配及工作流执行等复杂设置任务。
推荐理由:ComfyUI 将 MCP 服务器完全开源并支持本地运行,用户可通过单一智能体无缝调度本地与云端资源,显著降低本地部署门槛。
ComfyUI 正式支持最新开源视频模型 LTX-2.5,提供本地运行和 Partner Nodes 托管两种使用方式。该版本引入了基于复杂度的新渲染方法、扩散式视频解码器以及自定义 Gemma 4 12B 文本编码器,并保留了原生 4K、音视频同步及最高 50fps 帧率等特性。
推荐理由:ComfyUI 官方同步支持 LTX-2.5,提供了开源权重与托管节点两种接入方式及关键渲染特性说明。
ComfyUI 现已原生支持 Wan Animate 2 及其高效变体 Lite,提供高保真角色动画和实时流式生成能力。该模型采用端到端 Diffusion Transformer 架构直接处理驱动视频,消除了中间运动提取器以提升动作质量和身份保持度,并支持文本驱动的视角控制。
推荐理由:ComfyUI原生支持Wan Animate 2,通过端到端架构提升动作保真度并实现实时流式动画生成。
Seedance 2.5 现已通过 Partner Nodes 在 ComfyUI 中可用。该模型支持单次生成长达 30 秒的连续视频片段,并允许在一次运行中使用最多 50 个参考资产(包括图像、视频和音频)来锁定角色、环境和运动细节。
推荐理由:原文详细说明了 Seedance 2.5 在 ComfyUI 中实现单次生成 30 秒连续视频及多模态参考资产控制的具体能力,为视频创作者提供了新的工作流选择。
ComfyUI 宣布通过 Partner Nodes 正式提供 FLUX 3 Video 功能,这是 Black Forest Labs 首个统一多模态模型的视频部分。
推荐理由:ComfyUI 官方接入 FLUX 3 视频生成能力,支持原生音频与多风格控制,用户可直接获取工作流模板进行创作。
Comfy 正式推出 Team 计划,将团队整合至单一共享工作区、统一积分池及一张账单中。该计划提供 $200 至 $2,500 的月度积分承诺档位,支持按量折扣最高达 20%,并内置管理员控制功能以简化计费与成员管理。
ComfyUI MCP 推出针对批量生成的新工具集,包括支持单次提交最多 50 个任务的 `submit_batch`、状态监控 `get_batch_status` 和结果收集 `get_batch_output`。
Google DeepMind 在印度启动 ATL Saathi 实时试点,这是一款基于 Gemini 3.5 Flash 模型的 Web 应用,旨在为 Atal Tinkering Labs 教师提供全天候规划与培训助手。该工具支持 8 种语言,利用 NotebookLM 整理课程并生成项目方案、接线图及安全指南,目前已在 100 所试点学校部署,助力将传统实验室转型为 AI 增强型发现实验室。
Gemini 3.5 Flash 现已将计算机操作(computer use)作为内置工具支持,此前该能力仅存在于独立的 Gemini 2.5 模型中。开发者可通过 Gemini API 和 Gemini Enterprise Agent Platform 构建能跨浏览器、移动端和桌面环境进行感知、推理及行动的自定义智能体。
推荐理由:原文说明了计算机操作能力从独立模型整合进主模型的变化,并给出了针对提示注入风险的安全措施与开发入口。
Google DeepMind 宣布与英国政府合作开发基于 Gemini 的 AI 规划原型,旨在将住宅规划申请的处理时间缩短 50%。该工具通过整合数据、识别本地政策、总结反馈和起草评估报告来辅助规划官员,但官员仍保留最终审批权并拥有完整的审计追踪记录。
Google DeepMind 在 Project Genie 中推出基于 Street View 的实景锚定能力,允许用户选择美国境内的真实地点作为生成世界的起点,并应用如“海洋世界”或“黑白电影”等风格进行创意重构。
推荐理由:Project Genie 接入 Street View 真实影像,让 AI 生成的虚拟世界能锚定现实地点,为智能体提供更具真实感的交互环境。