NVIDIA DGX Spark 推出 64GB 统一内存版本
NVIDIA DGX Spark 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等合作伙伴提供 64GB 统一内存的新配置,起售价为 $4,999。
NVIDIA DGX Spark 将于本月通过 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 等合作伙伴提供 64GB 统一内存的新配置,起售价为 $4,999。
华为发布 Mate 90、Pro、Pro Max 及 RS 非凡大师四款旗舰,起售价 5999 元并即日开售。Mate 90 Pro Max 搭载麒麟 9050 Pro,NPU 性能提升 140%,支持硬件级光追与 12000 尼特峰值亮度灵珑屏。全系引入通信共享功能,Pro Max 典藏版及 RS 可外挂售价 5999 元的睿影 Z10 一英寸传感器模块化相机。
阿里云在中国汽车公有云市场份额达 45.2%,在六项细分赛道均获第一。其通过千问座舱 Agent、真武 V900 芯片及数据产线重构,实现从智能驾驶到组织效能的全链路覆盖。目前已有超 30 家车企基于阿里云开展研发,平头哥真武 810E 实践规模超 15 万卡。
高通在骁龙峰会上发布第六代骁龙 8 超级至尊版和至尊版两款 2nm 移动平台,宣布 CPU 主频首次突破 5GHz,NPU 支持最高 300 亿参数 MoE 模型终端运行。公司正加速向覆盖终端、边缘和数据中心的智能体 AI 全栈解决方案演进,通过重构计算架构与连接能力,旨在成为个人智能体跨设备运行的计算底座。
OPPO ColorOS 智慧产品研发总监姜昱辰提出以意图驱动定义 AI 手机,认为当前行业尚无产品达标。OPPO 确立端侧自研模型与开放云端基座的战略,将连续上下文记忆视为 Personal AI 核心,并推出 ColorOS 17「即将发生」主动服务功能及 MobileMem 评测基准。此外,OPPO 发布新形态 AI 硬件「心力球」,试图通过持续获取物理世界信号强化 AIOS 能力。
在普通硬件运行大模型需通过量化、层级卸载、混合专家、知识蒸馏、剪枝及推测解码等技术降低内存占用与计算量。以8B参数模型为例,仅权重即需约16GB内存,且受限于RAM/VRAM容量及带宽瓶颈。这些方法旨在解决推理阶段的显存不足问题,使已训练模型能在资源受限设备上实现可用响应速度。
Google 宣布其技术已支持全球 86% 人口使用的 300 多种语言,并推出 Gemini 3.5 Live Translate 实现 70 种语言的实时语音翻译。
Google DeepMind 发布 Gemma 4 12B,这是一款旨在在笔记本电脑上运行的高性能多模态模型。该模型采用统一的无编码器架构,视觉和音频输入直接流入 LLM 主干,无需传统独立编码器,从而降低延迟和内存占用。
推荐理由:原文给出了无编码器统一架构和16GB显存本地运行门槛,读者可以据此判断其在笔记本上实现多模态智能体的可行性。