跳到正文

#端侧

今日 0 条
10月2日周五
10月1日周四
  1. 爱范儿25

    华为 Mate 90 系列发布:搭载麒麟 9050 Pro,支持睿影 Z10 模块化相机

    华为发布 Mate 90、Pro、Pro Max 及 RS 非凡大师四款旗舰,起售价 5999 元并即日开售。Mate 90 Pro Max 搭载麒麟 9050 Pro,NPU 性能提升 140%,支持硬件级光追与 12000 尼特峰值亮度灵珑屏。全系引入通信共享功能,Pro Max 典藏版及 RS 可外挂售价 5999 元的睿影 Z10 一英寸传感器模块化相机。

9月28日周一
  1. 极客公园73

    高通发布第六代骁龙 8 双旗舰并确立智能体全栈技术路线

    高通在骁龙峰会上发布第六代骁龙 8 超级至尊版和至尊版两款 2nm 移动平台,宣布 CPU 主频首次突破 5GHz,NPU 支持最高 300 亿参数 MoE 模型终端运行。公司正加速向覆盖终端、边缘和数据中心的智能体 AI 全栈解决方案演进,通过重构计算架构与连接能力,旨在成为个人智能体跨设备运行的计算底座。

9月25日周五
  1. 极客公园53

    OPPO 姜昱辰:大模型差距缩小,AI 手机靠端侧与记忆拉开差距

    OPPO ColorOS 智慧产品研发总监姜昱辰提出以意图驱动定义 AI 手机,认为当前行业尚无产品达标。OPPO 确立端侧自研模型与开放云端基座的战略,将连续上下文记忆视为 Personal AI 核心,并推出 ColorOS 17「即将发生」主动服务功能及 MobileMem 评测基准。此外,OPPO 发布新形态 AI 硬件「心力球」,试图通过持续获取物理世界信号强化 AIOS 能力。

9月21日周一
  1. ByteByteGo35

    如何在廉价硬件上运行大模型:量化、卸载与蒸馏等技术解析

    在普通硬件运行大模型需通过量化、层级卸载、混合专家、知识蒸馏、剪枝及推测解码等技术降低内存占用与计算量。以8B参数模型为例,仅权重即需约16GB内存,且受限于RAM/VRAM容量及带宽瓶颈。这些方法旨在解决推理阶段的显存不足问题,使已训练模型能在资源受限设备上实现可用响应速度。

9月16日周三
6月9日周二
  1. Google DeepMind82

    Google DeepMind 发布 Gemma 4 12B:统一无编码器多模态模型

    Google DeepMind 发布 Gemma 4 12B,这是一款旨在在笔记本电脑上运行的高性能多模态模型。该模型采用统一的无编码器架构,视觉和音频输入直接流入 LLM 主干,无需传统独立编码器,从而降低延迟和内存占用。

    推荐理由:原文给出了无编码器统一架构和16GB显存本地运行门槛,读者可以据此判断其在笔记本上实现多模态智能体的可行性。