Meta 发布 Muse Gadgets 开源项目并推出 Muse Home Link 设备
Meta 宣布推出名为 Muse Gadgets 的开源项目,允许爱好者构建自己的 AI 硬件。该项目包含适用于 ESP32 开发板的固件以及用于连接自制设备至 Meta AI 智能体 Muse 的 Linux SDK,代码采用 Apache 2.0 许可证。
Meta 宣布推出名为 Muse Gadgets 的开源项目,允许爱好者构建自己的 AI 硬件。该项目包含适用于 ESP32 开发板的固件以及用于连接自制设备至 Meta AI 智能体 Muse 的 Linux SDK,代码采用 Apache 2.0 许可证。
Aleph Alpha 发布了名为 Kolibri 的开源大语言模型,采用混合专家架构,总参数 78.1B,每 token 激活约 3.46B。该模型专为德语和英语优化,支持最高 100 万 token 的上下文窗口,并在德语数学推理和长文档检索上表现优异。作者指出其权重需约 78GB 显存,目前仅支持本地部署,且在多轮工具调用和编码任务上弱于部分竞品。
推荐理由:作者通过实测验证了该模型在德语处理上的效率优势,并详细列出了其在长上下文和推理能力上的具体表现与局限。
TypeSafe 推出开源决策模型 Clef 和 Kev,支持 Jev-API 兼容及本地运行。OpenAI 因泄露机密信息解雇三名安全研究员,并推迟 GPT-6.1 Astra 发布。微软 MAI-Transcribe-2-Streaming 在 Artificial Analysis 榜单登顶,支持 60 种语言实时转录。
PyTorch 团队利用 TLX 扩展在 NVIDIA Blackwell (B200) 上优化了 Meta GEM 模型的 Jagged Flash Attention 内核。该实现代码量约为 3.2K 行,比 FlashAttention-4 (FA4) 减少约 3 倍,且在 jagged 形状下前向传播快约 13%、反向传播快约 50%,超越了当前 SOTA 的 FA4 性能。
ComfyUI 启动开发者平台挑战赛,要求参与者在两周内将付费功能重构为开源工作流。参赛者需使用 Comfy API、SDK 或 Router 构建并部署,前 100 名可获免费积分。最高奖金为 $10,000 现金及 NVIDIA GeForce RTX 5090 显卡,作品须包含开源许可证且于 10/19 截止提交。
DeepSeek 联合华为推出面向 Ascend 芯片的开源编程工具 TileLang,旨在构建独立于 CUDA 的软件生态。该语言由北京大学研究人员开发,被 DeepSeek 视为比 CUDA 更易用的通用编程语言。SemiAnalysis 分析指出,尽管 OpenAI 自研芯片测试显示 CUDA 优势减弱,但在智能体工作负载上 Nvidia 仍保持领先。
推荐理由:报道梳理了 DeepSeek 与华为合作发布 TileLang 的背景,以及 SemiAnalysis 对 CUDA 护城河现状的评估。
Torch Spyre 利用智能体测试选择流水线与声明式 YAML 框架,达成 PyTorch CRCR 的 L2 级集成。该方案自动从代码和执行证据中筛选适配 IBM Spyre 加速器的测试用例,无需修补上游测试即可验证回归。相关模式旨在通过 PyTorch OpenReg 回馈社区,供其他 out-of-tree 后端复用。
GitHub 公布 H1 2026 透明度中心数据,政府下架请求激增至 708 次,主要源于报告方法调整而非审核实践变化。文章回顾了加州 AI 透明度法案 SB 1000 的修订进展及年龄验证等州立法动态,并指出 AB 2713 未获采纳,相关定义细化仍是后续重点。
PyTorch 基金会 OSPO 与学术外联工作组启动“从学术界到采用”项目征集,旨在帮助基于 PyTorch、DeepSpeed 等技术的学术开源项目实现可持续化。入选的 8 个项目将在 PyTorch Conference North America 2026 的 Day 0 活动中进行闪电演讲,并参与由维护者指导的实操工作坊,以解决文档、治理及社区建设等转型难题。
GitHub 联合耶鲁大学对 1,039 名用户开展调研,发现 80% 的开发者希望获得编写节能代码的工具,74% 期望能测量软件的环境影响。尽管多数受访者担忧 AI 及全球变暖带来的环境压力,但仅 10% 认为日常开发对减少个人碳足迹有显著作用。GitHub 建议从识别计算浪费入手,并推出开源 Daily Efficiency Improver 工作流辅助定位优化机会。
llm 0.36 版本发布。该更新由 Simon Willison 于 2026-09-22 公布,涉及 openai 和 llm 相关项目动态。
NVIDIA 在 ROSCon 大会上发布 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速软件包,旨在通过引入新的智能体工作流帮助人类和 AI Agent 共同构建机器人。
推荐理由:NVIDIA 发布 Isaac ROS 5.0,引入支持 AI Agent 的工作流和 GPU 加速包,帮助开发者与智能体协作构建机器人应用。
小米开源全模态模型 MiMo-V2.6 Pro 和 Flash,支持智能体协作构建3D场景及多模态生成。xAI 发布 Grok 4.7,采用更大基座模型提升编码与安全能力,定价为输入 $2/M tokens、输出 $6/M tokens。Anthropic 正在测试即将发布的 Opus 5.5,传闻定价为输入 $4/M tokens、输出 $20/M tokens。
Harvard 与 ETH Zurich 的研究者发布 TinyTorch,这是一个允许用户从张量到 Transformer 逐步构建工作 ML 框架的开源课程。
推荐理由:作者分享了构建教学版框架的完整方法论,包括 API 对齐、硬件下限设定及教师基础设施设计,为开源课程建设提供了可复用的工程经验。
NVIDIA 指出 AI 安全是工程问题,需在 Agent 栈各层实施可执行控制。其开源安全运行时 OpenShell 在代理推理之外强制策略并提供沙箱执行,Cisco DefenseClaw 与 JFrog 已基于此构建治理与技能验证能力。
PyTorch Day Japan 2026 定于 12 月 10 日在东京举办,由 PyTorch Foundation、Hugging Face、IBM 和三菱电机联合主办。会议聚焦 vLLM、DeepSpeed、Ray 等生态项目及物理 AI、边缘计算等技术方向。目前征集演讲提案截止至 9 月 27 日,注册费在 11 月 11 日前为 ¥5,000。
PyTorch Conference North America 2026将于10月20日至21日在加州圣何塞举行,重点展示编译器架构、跨硬件内核DSL及低精度量化等前沿成果。
PHP框架Laravel宣布禁止提交issue,仅接受Pull Request以过滤垃圾信息并降低维护成本。Anthropic利用Claude AI耗时11天将安德鲁·怀尔斯的费马大定理人工证明翻译为Lean语言程序,生成超1300万行代码,创下最长数学程序纪录。
OpenClaw 2.0版本发布,合并16000个PR且无代码审查,体现AI主导的开发模式。SolidJS创始人指出AI导致技术栈向React等主流方案单一化迁移。韩国计划向公民免费提供无限Token并分配512个英伟达B200芯片以推广本土大模型。
Uber、Pinterest、Stripe、Coinbase、Ramp 和 AT&T 通过弃用专有模型并采用智能模型路由,大幅降低 AI 支出。Ramp 数据显示,头部企业八月 AI 支出下降 10%,主要源于成本优化而非 Token 用量减少。
Google 推出 Gemini 3.7 Flash,作为面向编码与智能体的主力模型,其每百万 token 价格仅为前代一半。同时发布搭载 Tensor G6 芯片的 Pixel 11 系列设备,并上线 Gemini 3.5 Transcribe 语音转文字模型。此外,Gemini 应用月活跃用户突破 10 亿,成为 Google 历史上增长最快的产品。
ComfyUI 正式开源其 MCP 服务器,支持在本地机器上直接运行,允许 Claude、Codex 等智能体连接本地 ComfyUI 环境。该更新实现了本地与云端的统一接入,智能体能自动读取硬件配置以评估模型兼容性,并处理权重下载、节点匹配及工作流执行等复杂设置任务。
推荐理由:ComfyUI 将 MCP 服务器完全开源并支持本地运行,用户可通过单一智能体无缝调度本地与云端资源,显著降低本地部署门槛。
MiniMax 发布第三代视频模型 H3,这是其首个开放权重的视频模型,已在 ComfyUI 中实现 Day-0 原生支持。该模型支持文本、图像、视频和音频输入,能生成最高 2K 分辨率、15 秒时长的视频,并同步生成原生立体声音频。通过剪枝调制权重、int8 量化及自定义内核等技术,H3 在 ComfyUI 中的显存占用降低 66%,使得 RTX 3060 等消费级 GPU 也能进行本地推理。
推荐理由:原文说明了 H3 的开放权重特性及在 ComfyUI 中的本地推理优化细节,读者可据此评估其在消费级硬件上的实际部署可行性。
Anthropic 推出 Claude Sonnet 5,主打限时折扣定价与增强的智能体编码能力,并部署了新的网络安全分类器。Etched 获得价值 10 亿美元的推理硬件需求,中国开源 LongCat 2.0 MoE 模型展示大规模训练效率。Google 同步上线 NotebookLM 视频摘要功能及 Nano Banana 2 Lite 图像生成器。
DeepSeek 通过 MLA、DSA 及 mHC 等创新技术大幅压缩 KV 缓存,使 V4 Pro 在 1M 上下文下仅需 5.48GB HBM,远低于 GLM5 和 Qwen3。其战略旨在利用 NAND/LPDDR 存储替代算力,扶持中国硬件生态并冲击 1 万亿美元市值。