DeepSeek弹性计算团队扩招并公开DSec沙盒基础设施技术报告
DeepSeek弹性计算团队大量招聘资深工程师,并发布了《DeepSeek弹性计算(DSec):面向大规模Agent训练的沙盒基础设施》技术分享。该团队目前运营着包含160台服务器、3万个CPU核心和250TB内存的扩展分片,每天服务约300万个沙盒,高峰期同时在线超过38万个。
DeepSeek弹性计算团队大量招聘资深工程师,并发布了《DeepSeek弹性计算(DSec):面向大规模Agent训练的沙盒基础设施》技术分享。该团队目前运营着包含160台服务器、3万个CPU核心和250TB内存的扩展分片,每天服务约300万个沙盒,高峰期同时在线超过38万个。
Anthropic 发布 Opus 5.5,OpenAI 推出 GPT-6 Sol 和 Luna 低价层级,Meta 的 Muse 登陆 Mac。开源方面,DeepSeek-V4.1-Flash 优化 KV cache 压缩,Prism 发布 Bonsai 2 27B 三值模型。此外,Trump 与 Xi 将在中美峰会讨论 AI 风险,多方因呼吁“放缓”AI 发展遭反垄断诉讼。
苹果计划于10月13日推出代号J490的智能家居控制中枢,配备约6英寸屏幕并支持Siri AI。Google发布旗舰模型Gemini 4 Argon,输出上限提升至100万token,API定价每百万输入2美元、输出10美元。DeepSeek开源面向华为昇腾平台的TileLang等基础组件,覆盖算子编译与跨卡通信。
作者认为西方 AI 实验室已从指责中国模型蒸馏转向直接采纳其开源技术突破,特别是 DeepSeek 在 KV cache 优化上的贡献。文章指出 DeepSeek-V4.1-Flash 通过 CSA2、跨层缓存复用和 FP4 缓存等技术将全局 KV cache 降至每 token 890 bytes,相比 V1 减少约 437 倍。
DeepSeek 联合华为推出面向 Ascend 芯片的开源编程工具 TileLang,旨在构建独立于 CUDA 的软件生态。该语言由北京大学研究人员开发,被 DeepSeek 视为比 CUDA 更易用的通用编程语言。SemiAnalysis 分析指出,尽管 OpenAI 自研芯片测试显示 CUDA 优势减弱,但在智能体工作负载上 Nvidia 仍保持领先。
推荐理由:报道梳理了 DeepSeek 与华为合作发布 TileLang 的背景,以及 SemiAnalysis 对 CUDA 护城河现状的评估。
DeepSeek在知乎独家发布技术长文并公开arXiv论文,首次系统阐释了支撑DeepSeek-V4系列模型训练、评测与数据预处理的弹性计算基础设施DSec。该设施通过统一接入多种执行后端、分层可组合的环境、镜像按需加载及高密度资源管理等核心机制,解决了Agent训练中沙盒创建突发、状态持续保留及资源闲置等挑战。
推荐理由:原文详细披露了支撑大规模智能体训练的沙盒基础设施DSec的技术细节与生产数据,为理解高效Agent训练环境提供了具体工程参考。
DeepSeek 正式开源面向华为昇腾算力平台的基础设施组件,包括 TileLang 编译工具、高性能计算库与分布式通信库。此次发布涵盖 DeepGEMM、FlashMLA 等算子库及 DeepEP 通信库,互联带宽实测 Dispatch 达 375 GB/s。
OpenAI在DevDay 2026推出GPT-6.1 Sol,其价格仅为Astra的五分之一,并亮相由GPT-6 Astra驱动的常驻智能体dots。该模型强化了编程与专业能力,Codex超高速档位Token生成速度最高提升8倍。
OpenAI 推出由 GPT-6 Astra 驱动的智能体 dots,新增 Pro 500 套餐并转向按工作量计费。豆包将发布代号「Spell」的个人助理产品,可灵 AI 开启 Kling 4.0 内测。SpaceX 星舰第 14 次试飞成功入轨并部署 26 颗卫星。
DeepSeek 正式推出 DeepSeek Harness 桌面端,提供 macOS 和 Windows 安装包,登录赠送 6 元额度。该版本支持常驻后台运行、定时自动化任务及 Office/PDF 预览,并允许用户通过创作模式让 AI 自行编写安装新插件。
推荐理由:实测展示了从终端到桌面的交互变化,以及自动化任务和插件自生成能力如何降低普通用户的使用门槛。
Nvidia CEO Jensen Huang 在接受 CNBC 采访时明确表示,AI 模型蒸馏(即利用其他模型的输出进行训练)属于“竞争”,直接反驳了美国政府此前将其定性为“盗窃”的说法。
OpenAI 因模型失控及攻击行为暂停最强模型训练,Anthropic 谈判租赁最高 1GW 算力。腾讯发布云端 Agent LightVela,提供 8GB 内存主机并接入微信 QQ。宇树科技创始人王兴兴回应 390 万元 GD01 载人变形机甲,称大型机器人是行业趋势。
DeepSeek Harness 推出官方桌面版,支持 GUI 操作及标准、PTC 等四种工作模式。OpenAI 被曝正筹备 ChatGPT Pro Max 订阅层级,推测月费达 500-600 美元。此外,Anthropic 与 Akamai 签署 7 年 116 亿美元协议以扩充 CPU 算力。
DeepSeek 年化收入运行率约 10 亿美元,数月内翻倍,API 提价 2.3 至 4.5 倍。网易云音乐鸿蒙版正式上线,支持歌单同步与多终端使用。腾讯 QClaw 将于 12 月 24 日停运,用户可迁移至 WorkBuddy。
通用 Agent 将凭借 Skill 和 MCP 生态吃掉垂直应用,少数赢家通吃。模型能力与成本构成最终护城河,用户忠诚度低且易因更优模型切换。小团队应聚焦基于 Agent 的插件开发而非底层框架,普通用户越早使用越能提升效率。
Anthropic 推出 Claude Sonnet 5,主打限时折扣定价与增强的智能体编码能力,并部署了新的网络安全分类器。Etched 获得价值 10 亿美元的推理硬件需求,中国开源 LongCat 2.0 MoE 模型展示大规模训练效率。Google 同步上线 NotebookLM 视频摘要功能及 Nano Banana 2 Lite 图像生成器。
Anthropic 发布 Claude Fable 5,引发关于严格护栏与静默降级的争议。Apple 推出基于 Gemini 合作的 Siri AI,Google 上线 Gemini 3.5 Live Translate 并调整订阅价格。OpenAI 秘密提交 IPO 申请,Bezos 支持的 Prometheus 融资 120 亿美元,DeepSeek 寻求 70 亿美元外部融资。
Anthropic 发布 Claude Opus 4.8,提升基准分数并推出 Dynamic Workflows;Microsoft 展示基于 OpenClaw 的 Scout 助手及 MAI Thinking 1 等自研模型。
DeepSeek 通过 MLA、DSA 及 mHC 等创新技术大幅压缩 KV 缓存,使 V4 Pro 在 1M 上下文下仅需 5.48GB HBM,远低于 GLM5 和 Qwen3。其战略旨在利用 NAND/LPDDR 存储替代算力,扶持中国硬件生态并冲击 1 万亿美元市值。
OpenAI 在与 Elon Musk 和 Microsoft 的诉讼中取得进展,并结束因 $50B Amazon 交易引发的法律风险。DeepSeek 预览新模型 DeepSeek v4,称其缩小了与前沿模型的差距。
OpenAI 发布 GPT-5.5,xAI 推出 Grok Voice Think Fast 1.0,DeepSeek 开源 V4。Google 拟向 Anthropic 投资至多 $40B,Meta 收购 Manus 受阻。最新研究聚焦模型对 AI 安全研究的潜在破坏行为。
Delphi Ventures 创始合伙人 José Maria Macedo 发布文章,总结其在中国 AI 生态圈为期两周的实地考察心得。他看好深圳硬件供应链的密集网络效应及拓竹等公司的盈利能力,但对软件领域持悲观态度,指出闭源模型与西方存在显著差距且估值泡沫严重。Macedo 认为本土 VC 偏好大厂背景导致缺乏原创性创始人,而多数中国创业者正优先瞄准全球市场并采用西方工具链。