跳到正文

全部动态

今日 0 条
10月2日周五
  1. NVIDIA78

    NVIDIA 发布 GPT-6 Astra Ultrafast:基于 Blackwell GPU 实现 8 倍推理加速

    OpenAI 的 GPT-6 Astra Ultrafast 模型现已通过 NVIDIA Blackwell GPU 在 API 及 ChatGPT Work/Codex 中上线,其 token 生成速度比 Astra Standard 模式快至多 8 倍。

    推荐理由:原文说明了GPT-6 Astra Ultrafast在NVIDIA Blackwell GPU上的8倍加速效果及其对开发者工作流的影响,读者可据此评估其在实际编码和交互场景中的性能提升价值。

  2. 量子位68

    何恺明团队发布NAT-ARC:用ImageNet预训练视觉模型攻克ARC抽象推理

    何恺明团队最新论文提出NAT-ARC,一种不依赖LLM的纯视觉ARC解题方案。该方法通过在ImageNet上进行MAE预训练来初始化视觉编码器,使模型将自然图像中学到的视觉能力迁移至抽象格子推理任务。NAT-ARC在ARC-1基准上单模型pass@2得分63.4%,集成后达70.2%,以约四分之一的参数量逼近专用LLM系统性能,并验证了预训练对视觉路线scaling瓶颈的突破作用。

  3. ComfyUI Blog65

    ComfyUI 发布 Comfy Agent:首个面向创作流程的智能体

    ComfyUI 正式推出 Comfy Agent,该功能已在 Comfy Cloud 上线并计划数周后登陆 Comfy Desktop。Comfy Agent 直接嵌入应用内部,能根据自然语言描述自动规划、构建、运行和迭代工作流,支持并行聊天及实时协作编辑画布。目前处于 Beta 阶段,用户可通过 cloud.comfy.org 免费试用初始对话额度,后续还将扩展至本地环境以支持自定义节点生成。

    推荐理由:ComfyUI 推出内置智能体,将工作流构建、调试与迭代自动化,降低创意实现的技术门槛。

10月1日周四
  1. GitHub Blog26

    GitHub Universe 2026 十大技术演讲精选

    GitHub Universe 2026 聚焦 Copilot 记忆基准、MCP 细粒度授权及 Vite+ 工具链等前沿议题。GitHub 研究揭示累积上下文可能降低性能,Pomerium 演示身份感知代理以强化 MCP 安全边界。此外,会议还将探讨 npm 供应链风险、AI 代码验证机制及低连接环境下的软件开发实践。

  2. The Decoder75

    Glow Security发现超1.3万张公司内部截图被AI智能体公开上传至GitHub

    安全初创公司Glow Security发现超过13,000张来自343家组织(包括财富500强和AI实验室)的内部软件项目截图被AI智能体公开上传至GitHub。由于GitHub仅允许通过浏览器而非命令行在私有项目的Pull Request中附加图片,开发者使用的AI智能体自动创建了位于个人账号下的公共仓库来存储这些包含客户数据、登录凭证和未发布功能的截图,导致安全团队未能察觉这一数据泄露行为。

  3. NVIDIA26

    NVIDIA AI 工厂如何通过高产出、长寿命与通用性最大化投资回报

    NVIDIA AI 工厂通过极致全栈协同设计实现最高能效,Vera Rubin NVL72 系统每兆瓦吞吐量较 GB300 NVL72 提升超 30 倍,DeepSeek V4 Pro 模型成本降低至多 45 倍。CUDA 平台跨代兼容确保持续软件优化,使 A100 等旧硬件在部署六年后仍具商业价值并延长折旧周期。该架构支持从语言到物理 AI 的全类型负载,通过广泛适用性深化需求以最大化投资回报。

  4. The Decoder84

    AI系统Ataraxos击败Stratego世界冠军Niemeijer

    新研究提出的AI系统Ataraxos击败了Stratego历史上最成功的玩家Jeroen Niemeijer,有效胜率达到85%。该系统仅使用16块Nvidia H100 GPU训练一周,成本不足8000美元,远低于此前DeepMind的DeepNash系统所需的数百万美元。

    推荐理由:原文对比了Ataraxos与DeepNash在算力成本上的巨大差异,并展示了其在多种不完全信息博弈中的泛化能力。

  5. The Decoder80

    OpenAI 称阻止窃取模型推理活动但 Azure 仍存漏洞

    OpenAI 宣布阻止了一起试图窃取其模型推理链的活动,并指出该攻击手段在 Microsoft Azure 平台上仍然有效。研究人员发现,通过利用加密推理包在不同会话和模型间的可移植性,弱模型可作为“解密预言机”提取强模型的隐藏思维过程。

    推荐理由:原文披露了针对模型推理链的提取攻击及 Azure 平台防护滞后问题,揭示了云服务商间安全标准不一致带来的风险。

  6. 爱范儿25

    华为 Mate 90 系列发布:搭载麒麟 9050 Pro,支持睿影 Z10 模块化相机

    华为发布 Mate 90、Pro、Pro Max 及 RS 非凡大师四款旗舰,起售价 5999 元并即日开售。Mate 90 Pro Max 搭载麒麟 9050 Pro,NPU 性能提升 140%,支持硬件级光追与 12000 尼特峰值亮度灵珑屏。全系引入通信共享功能,Pro Max 典藏版及 RS 可外挂售价 5999 元的睿影 Z10 一英寸传感器模块化相机。

  7. 极客公园40

    阿里云升级Agent基础设施,实现数据处理耗时减少40%与训练提速2.4倍

    阿里云在云栖大会发布针对Agent负载的基础设施升级方案,通过MaxCompute和EMR优化使具身智能数据处理耗时减少40%,PAI-DLC 3.0将多模态模型端到端训练速度提升2.4倍。新推出的ADA服务采用多智能体协同,配合Hologres自进化查询优化器,旨在打通从数据入湖到系统自我进化的全链路,解决Agent并发试错带来的计算压力。

  8. 极客公园25

    谷歌发布 Gemini 4 Argon;中国生成式 AI 用户超 7 亿;美光净利暴涨 895%

    谷歌发布 Gemini 4 Argon,单次输出上限达约 100 万 tokens,在长流程软件工程测试中创纪录并优于 GPT-6 Astra。CNNIC 报告显示截至 2026 年上半年,我国生成式人工智能用户规模突破 7 亿人,普及率超 50%。美光科技公布 2026 财年财报,归母净利润同比增长 895.07%,并开始量产 512GB DDR5 RDIMM 内存模块。

  9. 爱范儿80

    Gemini 4 Argon 正式发布,写作与知识能力领先但仅向部分伙伴开放

    Google 正式发布旗舰模型 Gemini 4 Argon,目前仅通过 Fairwind 计划向少量网络安全合作伙伴开放,普通用户需等待后续付费 API 和订阅者通道。

    推荐理由:原文梳理了 Gemini 4 Argon 的跑分、定价及开放策略,指出其写作与知识能力优于编程,并提及内部对其实际性能的质疑。

  10. 爱范儿25

    早报:苹果拟10月13日发布家庭中枢,Google发布Gemini 4 Argon,DeepSeek开源昇腾组件

    苹果计划于10月13日推出代号J490的智能家居控制中枢,配备约6英寸屏幕并支持Siri AI。Google发布旗舰模型Gemini 4 Argon,输出上限提升至100万token,API定价每百万输入2美元、输出10美元。DeepSeek开源面向华为昇腾平台的TileLang等基础组件,覆盖算子编译与跨卡通信。

  11. The Decoder84

    Google 发布 Gemini 4 Argon:缩小与 OpenAI 和 Anthropic 差距但未确立明显领先

    Google 发布新前沿模型 Gemini 4 Argon,这是其七个月来的首个前沿模型更新。该模型目前仅向“可信网络防御者”内部开放,后续将面向 API 客户和 Google AI Ultra 订阅用户推出,促销价为每百万输入 token $2、输出 token $10。

    推荐理由:文章汇总了独立评测与官方数据,展示了该模型在智能体任务上的显著进步及极具竞争力的定价策略。

  12. Hacker News · AI65

    普渡大学CS240教授复盘AI作弊检测与处理争议

    普渡大学计算机系教授Jeffrey A. Turkstra发布长文,回顾其在CS 240课程中使用自研静态分析工具Argus识别AI生成代码的经历。由于该工具在学期末才投入使用并触发大规模自查,引发学生和家长关于程序正义及胁迫感的强烈反弹,校方最终决定撤销对早期作业的追溯性处罚。

  13. Google DeepMind93

    Google DeepMind 发布 Gemini 4 Argon:面向复杂工作流的前沿智能模型

    Google DeepMind 宣布推出新前沿模型 Gemini 4 Argon,该模型旨在通过深度推理支持复杂的长周期工作流,目前正通过 Fairwind Program 向受信任的网络安全防御者逐步开放。

    推荐理由:原文披露了 Gemini 4 Argon 在长上下文输出、软件工程及网络安全防御上的具体基准数据与分阶段开放策略,为评估前沿模型在复杂工作流中的实际效能提供了关键参考。

  14. The Decoder62

    Google 在 Gemini 中推出 Skills 以取代 Gems

    Google 在全球范围内为 Gemini chat 推出“Skills”功能,用以取代原有的 Gems(类似 OpenAI 的 Custom GPTs)。Skills 是一种源自 Anthropic 的开放标准详细提示词格式,用户可通过输入斜杠加名称来调用,Gemini 也能根据对话历史自动生成并在检测到匹配提示时自动运行。