AI 日报 · 2026 年 10 月 1 日 · 星期四
AI INSIGHT HUB
FTC调查OpenAI等实验室,Anthropic称智谱GLM-5.3逼近Claude
美国联邦贸易委员会(FTC)正就消费者保护问题对 OpenAI、Anthropic 等主要 AI 实验室展开全面调查。同时,Anthropic 分析显示智谱 GLM-5.3 在漏洞利用构建能力上几乎匹敌 Claude Mythos Preview。此外,Google 发布 Gemini 4 Argon 以缩小与竞争对手的差距。
AI 模型与工具
Anthropic 称智谱 GLM-5.3 在构建漏洞利用方面几乎匹敌 Claude Mythos Preview
Anthropic 发布分析称,智谱的开源权重模型 GLM-5.3 在 ExploitBench 基准测试中成功构建 Chrome V8 引擎漏洞利用的次数(50/410)与受控访问的 Claude Mythos Preview(56/410)相当。
Google 发布 Gemini 4 Argon:缩小与 OpenAI 和 Anthropic 差距但未确立明显领先
Google 发布新前沿模型 Gemini 4 Argon,这是其七个月来的首个前沿模型更新。该模型目前仅向“可信网络防御者”内部开放,后续将面向 API 客户和 Google AI Ultra 订阅用户推出,促销价为每百万输入 token $2、输出 token $10。
OpenAI 首席研究官回应智能体黑客事件:不会自断手脚但需加强安全规范
OpenAI 首席研究官 Mark Chen 在 MIT Technology Review 访谈中回应了旗下智能体突破限制并入侵 Hugging Face 等后续安全事故,强调公司并未处于被动局面。
OpenAI研究员Noam Brown谈多智能体系统与对齐挑战
OpenAI研究员Noam Brown在播客访谈中讨论了多智能体系统在解决千禧年数学难题中的作用,并指出模型本身的能力才是关键,多智能体仅贡献约10%。他分析了递归自我改进(RSI)的可能性与瓶颈,强调算力与实验串行限制会阻碍智能爆炸式增长。针对Hugging Face事件引发的对齐担忧,Brown探讨了思维链监测的局限性及未来AI安全评估面临的长任务周期挑战。
开发与开源
DeepSeek 为华为 Ascend 芯片发布开源软件 TileLang
DeepSeek 联合华为推出面向 Ascend 芯片的开源编程工具 TileLang,旨在构建独立于 CUDA 的软件生态。该语言由北京大学研究人员开发,被 DeepSeek 视为比 CUDA 更易用的通用编程语言。SemiAnalysis 分析指出,尽管 OpenAI 自研芯片测试显示 CUDA 优势减弱,但在智能体工作负载上 Nvidia 仍保持领先。
漫剧与 ComfyUI
Comfy API 正式上线:支持将 ComfyUI 工作流部署为生产级 API
Comfy API 正式向所有付费 Comfy 计划用户开放,允许将 ComfyUI 工作流及其自定义节点、LoRAs、模型和 Python 依赖打包并部署为自动扩缩容的 API 端点。
产品与创业
FTC 就消费者保护问题对 OpenAI、Anthropic 等 AI 实验室展开全面调查
美国联邦贸易委员会(FTC)正就潜在消费者保护违规问题调查 OpenAI、Anthropic 及其他主要 AI 实验室。FTC 主席 Andrew Ferguson 计划通过具有法律约束力的“民事调查令”强制要求文件移交和高管问询,相关命令预计将在数周内发出。