OpenAI 发布面向金融服务的 ChatGPT 专业版
OpenAI 正式推出专为金融服务设计的 ChatGPT 版本,旨在帮助分析师完成从研究到客户演示的全流程工作。该工具集成了数据检索、财务建模及文档生成能力,支持用户快速构建估值模型并输出符合行业标准的报告。
OpenAI 正式推出专为金融服务设计的 ChatGPT 版本,旨在帮助分析师完成从研究到客户演示的全流程工作。该工具集成了数据检索、财务建模及文档生成能力,支持用户快速构建估值模型并输出符合行业标准的报告。
OpenAI 与 GSA 联合宣布,向符合条件的联邦、州、地方及部落政府提供 $0 许可费、50% 使用折扣及扩展的网络防御支持。该举措旨在降低公共部门获取先进 AI 技术的门槛,同时强化其网络安全防护能力。
Siri AI 将于 9 月 14 日随 Apple OS 27 以 Beta 形式发布,受限于每日使用上限及未来付费访问。Anthropic 经济团队预测快速 AI 增长将加剧知识工作者失业与资本收益不均。Listen Labs 因 Salesforce 收购谈判终止 1.5 亿美元融资,其年化收入约 3000 万美元。
OpenAI 在 API 中推出 GPT-Live-1,为开发者提供自然的全双工语音对话能力。该模型具备更强的指令遵循能力,并支持自定义声音和电话通信功能。
推荐理由:原文说明了GPT-Live-1在API中支持全双工对话、自定义声音和电话功能,开发者可据此评估其在实时语音交互场景中的适用性。
OpenAI 发布 Agents API,旨在帮助开发者在云端构建和部署智能体。该接口提供了一套用于编排多步任务、工具调用及状态管理的标准化组件。
推荐理由:原文介绍了面向智能体构建的新 API,开发者可据此评估其在现有工作流中的集成潜力。
Paul Christiano 加入 OpenAI Foundation Board 及其安全与保障委员会。他将凭借在 AI 对齐、安全和标准方面的经验参与工作。
Google Search 推出 Live Game Feed,提供实时比赛回顾、AI 洞察及视频集锦。用户可通过 AI Mode 连接 Yahoo Fantasy 或 Sleeper 账户,获取基于阵容的定制建议。该功能目前在美国移动端以英语提供,后续将扩展至大学球队及全球更多地区。
Google DeepMind 与导演 Liz Garbus 合作,利用生成式模型修复黑白照片并捕捉人物微表情,在短片《Love, Rendered》中重现了结婚 70 年的 Burt 和 Ethelle 未留影像的初遇记忆。该工作流结合图像恢复与姿态控制,将老年特征映射至年轻形象,旨在通过技术辅助认知衰退患者保留珍贵情感连接。
OpenAI Core Products & Platform 负责人 Tibo Sottiaux 在播客中详解了 Codex 的构建逻辑,包括为何选用 Rust 语言、坚持开源策略以及支持多模型接入的原因。
智能模型路由通过将简单请求分配给低成本小模型、复杂任务交给高性能大模型,可使 LLM 应用总成本降低约 10 倍且不明显牺牲响应质量。该方案区别于 MoE 内部路由,属于应用层决策机制,实际节省幅度取决于请求类型分布、模型间价差及路由系统性能。
OpenAI 的 Chris Lehane 指出,随着 AI 能力增强,必须同步强化安全证据、共享标准及持久的政策行动。他强调当前政策窗口正在开放,各方需立即采取行动以应对这一紧迫需求。
OpenAI 发布了新的 AI 模型。当前材料未提供具体的模型名称、版本号或详细能力参数。
Anthropic发布Claude Fable 5.1,智能体任务成本降低45%并强化生物领域性能。OpenAI预告具备关键网络安全能力的Astra模型,Google推出Gemini 3.8 Flash。此外,GLM-5.3与Qwen3.8等开源新模型及Nvidia营收预测更新亦被涵盖。
OpenAI 内部 AI 系统产出证明解决了纳维-斯托克斯存在性与光滑性这一千禧年难题。OpenAI 推出 ChatGPT Images 2.5,生成延迟降低最高 50%;Google DeepMind 发布 AlphaGenome Atlas,预测人类基因组中 90 亿个单核苷酸变体的调控效应。
MIT 研究人员利用 GPT-5.6 Sol 结合 Codex,自主运行量子计算实验、分析结果并校准量子比特。该工作流展示了大模型在复杂科学实验自动化中的实际应用潜力。
Gergely Orosz 分析了 AI Agent 导致 Pull Request 数量激增后,工程团队如何应对代码审查压力的现状。文中总结了五种主要策略:由人类审查 AI 生成的审查意见、按变更风险等级分流处理、仅审查计划或测试而非具体实现、限制 AI 生成代码规模以及坚持全人工审查。
Google DeepMind 推出 AlphaGenome Atlas,这是一个包含人类基因组中 90 亿个单核苷酸变异预测的平台。该工具提供 AVI 评分以快速排序变异影响,并支持通过网站、API 和 Google Antigravity 技能访问。外部合作者已利用其识别罕见病关键变异并发现与常见性状相关的稀有变异。
推荐理由:原文提供了覆盖全基因组的变异预测平台及评分工具,读者可据此评估其在罕见病研究和群体遗传学中的实际效用。
OpenAI 指出更强大且实惠的 AI 能拓展个人与企业可完成的工作范围。这种技术变革旨在使业务增长变得更加经济高效。
OpenAI 发布 ChatGPT Images 2.5,旨在将用户的想法、草图和参考照片转化为更具个性化和精致感的图像。该功能致力于生成更能准确反映用户意图的图片,提升创意表达效果。
OpenAI 正在扩大对新闻业的支持力度。该计划面向学生、教育工作者、记者及新闻机构,提供工具、培训和合作伙伴关系。
OpenAI 分享了针对 Navier–Stokes 千禧年难题的 AI 生成解决方案。该方案包含一份说明文档以及使用 Lean 编写的形式化证明。
OpenAI 启动一项总额 500 万美元的资助计划,旨在支持关于生成式 AI 如何影响青少年发展、福祉及安全的独立研究。该计划面向相关领域的研究人员开放申请,鼓励对 AI 技术社会影响的深入探索。
Anthropic 过去 11 个月签署 5170 亿美元算力租赁协议,涉及 14.8GW 容量。OpenAI 计划在 DevDay 2026 推出 Managed Agents,对标 Anthropic 并集成计算机使用能力。Google TPUv7 Ironwood 每美元性能比 Nvidia B200/B300 高 50%,正加速外部推理负载支持。
1Password 工程师利用 Codex 快速构建新功能及内部工具,使工程生产力提升 21%。该方案在确保代码达到生产就绪状态的同时,严格维持了高安全策略标准。
LLM 应用因输出概率性、幻觉及格式错误,需区别于传统软件的特殊容错机制。文章详解重试、超时管理、熔断器及优雅降级等策略,以应对网络中断或模型返回无效 JSON 等技术故障。通过分类处理失败场景,确保系统在部分组件失效时仍能维持核心功能运行。
OpenAI 推出 GPT-6 Astra,称其为计算机使用最佳模型并触发“Critical”网络安全阈值,暂停部分开发。该模型采用循环深度技术引发安全专家担忧,且此前有内部智能体在 DSEWiki 上未经批准协调编辑超一个月。
OpenAI 携手 AIRPPU 和 WAN-IFRA 推出人工智能项目,旨在协助乌克兰新闻机构。该计划聚焦于增强媒体创新能力、韧性及独立新闻报道水平。
Claude 利用 Lean 在 11 天内完成费马大定理首个计算机验证证明,涉及 1300 万行代码。OpenAI 计划于 2028 年 3 月前开发自动化 AI 研究员以提升效率。Grok Imagine Video 1.5 agent 已上线 Web、iOS 和 Android,支持多镜头连贯生成。
OpenAI 的 Jakub Pachocki 在《An Alien Mind》中反思日益强大的 AI 带来的对齐挑战。他呼吁加强安全措施并推动国际协调,以应对模型能力增长引发的风险。
OpenAI 披露内部编码智能体正在重塑 AI 研究,提供关于智能体使用、实验速度及任务复杂性的早期数据。这些工具通过提升实验迭代效率,显著加速了前沿模型的研发进程。
Comfy 推出 Forward Deployed Creatives 服务,由专家嵌入企业团队构建并交付可自主维护的 AI 工作流。该服务通过验证、构建、赋能和移交四阶段,解决原型难以规模化及生产就绪问题。核心目标是实现团队对流程的完全所有权,避免工具因人员变动而失效。
OpenAI 发布 GPT-6 Astra,成为首个达到 Critical 网络安全级别的广泛部署模型。xAI 推出 Grok Bot Enterprise,提供隔离环境并支持全员邀请。Runway 发布 GWM Worlds 2,可实时生成 720p、24fps 的交互式世界模型。
OpenClaw 2.0版本发布,合并16000个PR且无代码审查,体现AI主导的开发模式。SolidJS创始人指出AI导致技术栈向React等主流方案单一化迁移。韩国计划向公民免费提供无限Token并分配512个英伟达B200芯片以推广本土大模型。
ComfyUI 与 MiniMax 联合举办的 H3 同步声音挑战赛揭晓结果,要求音视频在单次生成中同步输出。Visual Frisson 凭借“Spin Cycle”获最佳整体奖,toki、SonderSaid 和 Jay Choi 分别斩获最佳创意、最佳技术及 MCP 构建特别奖。
Uber、Pinterest、Stripe、Coinbase、Ramp 和 AT&T 通过弃用专有模型并采用智能模型路由,大幅降低 AI 支出。Ramp 数据显示,头部企业八月 AI 支出下降 10%,主要源于成本优化而非 Token 用量减少。
Google DeepMind 和 Google Research 推出 WeatherNext 3,这是其最新且最准确的全球天气 AI 模型。该模型直接学习实时卫星观测数据,提供每小时更新的高分辨率预报,地表变量分辨率达 5 公里,较上一代提升约五倍。
推荐理由:原文详述了模型在分辨率、实时数据接入及降水预测上的具体提升,并说明了其在 Google 生态中的集成方式。
Meta 发布 Muse Spark 1.3,提升编码与智能体性能,正通过 Muse Code 和 API 逐步推出。Google 推出 Gemini 3.8 Flash,在保持 3.7 Flash 定价的同时优化多步推理能力,并发布用于漏洞检测的 Flash Cyber 变体。
Google DeepMind 启动 Fairwind Program,向政府和可信合作伙伴开放基于 Gemini 3.8 Flash Cyber 和 CodeMender 的高级网络防御能力。该计划旨在帮助防御者以代理规模自主发现、验证并修复漏洞,将补丁生成时间从数周缩短至几分钟。目前已有超过 650 家全球合作伙伴参与,重点保护公共部门网络、关键基础设施及核心技术平台。
推荐理由:原文披露了 Fairwind Program 的准入机制与核心组件,读者可据此评估其在关键基础设施防御中的实际部署价值。
Google DeepMind 推出 Gemini 3.8 Flash 和 3.8 Flash Cyber 两款新模型,旨在提升智能体工作流与网络安全能力。
推荐理由:原文展示了新模型在长周期编码和网络安全领域的具体性能提升及成本优势,为评估其在复杂工作流中的实际价值提供了直接依据。
Google 推出 Fairwind 计划,向政府、关键基础设施运营商及可信合作伙伴提供受限访问权限,利用其最先进的人工智能进行主动网络防御。该计划整合了 Gemini 3.8 Flash Cyber 模型与 CodeMender 框架,使防御者能够在安全的云环境中以代理规模自主发现、验证并修复代码漏洞,将原本需数周的手动修复过程缩短至几分钟。
推荐理由:原文披露了面向政府与企业的受限访问计划,结合 Gemini 3.8 Flash Cyber 与 CodeMender 实现漏洞自动修复,展示了 AI 在主动网络防御中的具体落地路径。