跳到正文

NVIDIA 英伟达

英伟达的 AI 芯片与生态动态:GPU 新品、CUDA 生态、机器人平台与 AI 算力市场的风向。

最新精选

第 1–8 条 · 共 8 条
10月2日周五
  1. NVIDIA78

    NVIDIA 发布 GPT-6 Astra Ultrafast:基于 Blackwell GPU 实现 8 倍推理加速

    OpenAI 的 GPT-6 Astra Ultrafast 模型现已通过 NVIDIA Blackwell GPU 在 API 及 ChatGPT Work/Codex 中上线,其 token 生成速度比 Astra Standard 模式快至多 8 倍。

    推荐理由:原文说明了GPT-6 Astra Ultrafast在NVIDIA Blackwell GPU上的8倍加速效果及其对开发者工作流的影响,读者可据此评估其在实际编码和交互场景中的性能提升价值。

9月29日周二
  1. 爱范儿84

    AMD 以 82 亿美元收购李飞飞创立的 World Labs

    AMD 宣布以约 82 亿美元全股票方式收购李飞飞创立的 AI 初创公司 World Labs,交易预计于 2026 年底前完成。World Labs 专注于空间智能研究,其开发的 Atlas 模型能根据有限输入预测新视角并解决稀疏重建问题。收购完成后,李飞飞将出任 AMD 执行副总裁兼首席科学家,直接向 CEO 苏姿丰汇报,双方计划共同建设覆盖硬件、软件及开放模型的 AI 生态。

    推荐理由:AMD 收购 World Labs 旨在通过空间智能研究反哺硬件设计,展示了芯片巨头在物理 AI 领域的生态布局逻辑。

9月22日周二
9月16日周三
  1. NVIDIA65

    NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 中展示领先性能

    NVIDIA Vera Rubin NVL72 系统在 MLPerf Inference v6.1 预览提交中 debut,其吞吐量比 GB300 NVL72 高出最多 3.7 倍(Qwen3-VL)和 2.5 倍(DeepSeek-R1)。GB300 NVL72 在四机架 288-GPU 配置下实现了 99% 的扩展效率,且软件优化使 v6.1 版本性能较 v6.0 提升最高 1.6 倍。

    推荐理由:原文给出了 Vera Rubin NVL72 在 MLPerf Inference v6.1 中的具体吞吐倍数和扩展效率数据,读者可据此评估新一代硬件对推理成本的实际影响。

  2. NVIDIA68

    NVIDIA 发布 DSX 平台以最大化 AI 工厂生产效率

    NVIDIA 推出 DSX 平台,通过 MaxLPS、Flex 等技术组件优化 AI 工厂每兆瓦的 Token 吞吐量。Lambda 在 HGX B200 集群上的首次验证显示,智能管理固定功率预算可使 Token 吞吐量提升 24%,性能功耗比提高 23%。

    推荐理由:原文披露了 NVIDIA DSX 平台在固定功率预算下提升 Token 吞吐量的实测数据及电网响应案例,为评估 AI 工厂能效优化提供了具体参考。

5月10日周日
  1. 宝玉的分享78

    英伟达Jim Fan宣告VLA时代结束并提出世界动作模型WAM

    英伟达机器人与AI研究组负责人Jim Fan在Sequoia AI Ascent 2026演讲中宣布VLA路线过时,提出以DreamZero为代表的世界动作模型(WAM)新范式。他指出VLA架构参数过度集中于语言而忽视物理动作,主张通过人类第一人称视频预训练和动作微调实现“底层同构”,并预测2040年前完成机器人终局。

    推荐理由:文章梳理了英伟达Jim Fan关于机器人范式从VLA转向WAM的演讲核心,提供了对遥操作数据局限及神经缩放定律的具体分析。