AI 日报 · 2026 年 10 月 9 日 · 星期五
AI INSIGHT HUB
微软发布Surface Laptop Ultra,支持本地运行千亿参数模型
微软推出搭载NVIDIA RTX Spark Superchip的Surface Laptop Ultra,最高配备128GB统一内存,可在本地运行超1200亿参数模型。同日,数学家组织批评OpenAI发布大量AI证明的行为,呼吁抵制;AWS AgentCore被曝存在可劫持所有智能体的严重安全漏洞。
AI 模型与工具
部分数学家呼吁抵制 OpenAI 因 AI 生成证明涌入该领域
菲尔兹奖得主陶哲轩等数学家组成的 AHM 组织发表声明,批评 OpenAI 一次性发布超过 700 个文件的行为是“展示权力而非学术”,并呼吁抵制该公司。此前 OpenAI 声称其内部模型在一个月内解决了 100 多个开放数学问题,包括 Navier-Stokes 千禧年问题的方法。
JetBrains 发布 Mellum2.1:面向编码智能体的 12B MoE 开源模型
JetBrains 发布 Mellum2.1,这是一款基于 Apache 2.0 许可的 12B 混合专家(MoE)思考模型,每 token 激活 2.5B 参数,专为编码智能体和快速子智能体设计。
开发与开源
NVIDIA Dynamo 通过会话感知机制优化智能体推理
NVIDIA Dynamo 引入统一的会话级标识符,将请求级基础设施转化为程序感知系统,以优化智能体工作负载的推理服务。该方案支持 Claude Code、Codex 等主流编码代理的原生识别,并通过会话感知调度在 SWE-bench 测试中使吞吐量提升约 12-16%。
漫剧与 ComfyUI
如何在单张 RTX 5090 上用 MiniMax H3 生成实时视频
作者在单张 RTX 5090(32GB VRAM)上成功运行 MiniMax H3 模型,实现了 15 秒内生成 15 秒的 448×256 分辨率视频。通过采用 FastH3 V2 检查点、四步采样、稀疏注意力机制、替换为 Qwen3-VL-4B 的小型文本编码器以及 INT8 量化等优化手段,将显存需求从 80GB 降至 30GB 以内。
产品与创业
微软发布 Surface Laptop Ultra 及 Windows 混合智能更新
微软发布搭载 NVIDIA RTX Spark Superchip 的 Surface Laptop Ultra,最高配备 128GB 统一内存,可在本地运行超过 1200 亿参数模型。
Zenity 发现 AWS AgentCore 存在“AgentCorruption”漏洞:单条提示词可劫持账户内所有 AI 智能体
Zenity Labs 研究人员发现 Amazon Bedrock AgentCore 存在名为“AgentCorruption”的系统性安全漏洞,攻击者仅需通过聊天界面向一个公开智能体发送单条提示词,即可利用平台隔离缺失和默认权限过宽问题,接管同一 AWS 账户和区域内所有 AgentCore 智能体。
AI 黑客工具助单人攻破多家韩国银行
CrowdStrike 报告称,一名疑似中文使用者利用开源 AI 渗透测试工具 ARTEX 入侵多家韩国金融机构,仅在新韩银行就窃取超过 25,000 条包含姓名、联系方式和信用额度的记录。