Christina Koch 与 James Manyika 探讨太空、技术与发现
NASA宇航员Christina Koch与Google研究副总裁James Manyika在“技术与社会对话”系列中,围绕太空探索、机器人及AI合作展开讨论。Koch分享其在国际空间站328天驻留、首次全女性太空行走及Artemis II任务经历,并阐述从25万英里外视地球为“生命之舟”的视角。
NASA宇航员Christina Koch与Google研究副总裁James Manyika在“技术与社会对话”系列中,围绕太空探索、机器人及AI合作展开讨论。Koch分享其在国际空间站328天驻留、首次全女性太空行走及Artemis II任务经历,并阐述从25万英里外视地球为“生命之舟”的视角。
Google DevFest 2026 于10月1日至12月31日举行,覆盖115个国家的800多场活动。本届以“Build, Secure, Scale”为主题,开发者将通过 codelabs 和 agent-athons 实操 Gemini、Google AI Studio 及 Web MCP 等工具。
Google Search 通过 AI Mode 的 Canvas 工具为用户生成个性化训练计划,并支持连接 YouTube Music 创建定制跑步歌单。该功能还利用包含超 600 亿条商品列表的 Shopping Graph,提供基于特定约束(如鞋宽、预算)的装备推荐与比价服务,帮助用户高效完成赛前准备。
Siri AI 将于 9 月 14 日随 Apple OS 27 以 Beta 形式发布,受限于每日使用上限及未来付费访问。Anthropic 经济团队预测快速 AI 增长将加剧知识工作者失业与资本收益不均。Listen Labs 因 Salesforce 收购谈判终止 1.5 亿美元融资,其年化收入约 3000 万美元。
Google Search 推出 Live Game Feed,提供实时比赛回顾、AI 洞察及视频集锦。用户可通过 AI Mode 连接 Yahoo Fantasy 或 Sleeper 账户,获取基于阵容的定制建议。该功能目前在美国移动端以英语提供,后续将扩展至大学球队及全球更多地区。
Google DeepMind 与导演 Liz Garbus 合作,利用生成式模型修复黑白照片并捕捉人物微表情,在短片《Love, Rendered》中重现了结婚 70 年的 Burt 和 Ethelle 未留影像的初遇记忆。该工作流结合图像恢复与姿态控制,将老年特征映射至年轻形象,旨在通过技术辅助认知衰退患者保留珍贵情感连接。
OpenAI 内部 AI 系统产出证明解决了纳维-斯托克斯存在性与光滑性这一千禧年难题。OpenAI 推出 ChatGPT Images 2.5,生成延迟降低最高 50%;Google DeepMind 发布 AlphaGenome Atlas,预测人类基因组中 90 亿个单核苷酸变体的调控效应。
Google DeepMind 推出 AlphaGenome Atlas,这是一个包含人类基因组中 90 亿个单核苷酸变异预测的平台。该工具提供 AVI 评分以快速排序变异影响,并支持通过网站、API 和 Google Antigravity 技能访问。外部合作者已利用其识别罕见病关键变异并发现与常见性状相关的稀有变异。
推荐理由:原文提供了覆盖全基因组的变异预测平台及评分工具,读者可据此评估其在罕见病研究和群体遗传学中的实际效用。
Anthropic 过去 11 个月签署 5170 亿美元算力租赁协议,涉及 14.8GW 容量。OpenAI 计划在 DevDay 2026 推出 Managed Agents,对标 Anthropic 并集成计算机使用能力。Google TPUv7 Ironwood 每美元性能比 Nvidia B200/B300 高 50%,正加速外部推理负载支持。
Google DeepMind 和 Google Research 推出 WeatherNext 3,这是其最新且最准确的全球天气 AI 模型。该模型直接学习实时卫星观测数据,提供每小时更新的高分辨率预报,地表变量分辨率达 5 公里,较上一代提升约五倍。
推荐理由:原文详述了模型在分辨率、实时数据接入及降水预测上的具体提升,并说明了其在 Google 生态中的集成方式。
Meta 发布 Muse Spark 1.3,提升编码与智能体性能,正通过 Muse Code 和 API 逐步推出。Google 推出 Gemini 3.8 Flash,在保持 3.7 Flash 定价的同时优化多步推理能力,并发布用于漏洞检测的 Flash Cyber 变体。
Google DeepMind 启动 Fairwind Program,向政府和可信合作伙伴开放基于 Gemini 3.8 Flash Cyber 和 CodeMender 的高级网络防御能力。该计划旨在帮助防御者以代理规模自主发现、验证并修复漏洞,将补丁生成时间从数周缩短至几分钟。目前已有超过 650 家全球合作伙伴参与,重点保护公共部门网络、关键基础设施及核心技术平台。
推荐理由:原文披露了 Fairwind Program 的准入机制与核心组件,读者可据此评估其在关键基础设施防御中的实际部署价值。
Google DeepMind 推出 Gemini 3.8 Flash 和 3.8 Flash Cyber 两款新模型,旨在提升智能体工作流与网络安全能力。
推荐理由:原文展示了新模型在长周期编码和网络安全领域的具体性能提升及成本优势,为评估其在复杂工作流中的实际价值提供了直接依据。
Google 推出 Fairwind 计划,向政府、关键基础设施运营商及可信合作伙伴提供受限访问权限,利用其最先进的人工智能进行主动网络防御。该计划整合了 Gemini 3.8 Flash Cyber 模型与 CodeMender 框架,使防御者能够在安全的云环境中以代理规模自主发现、验证并修复代码漏洞,将原本需数周的手动修复过程缩短至几分钟。
推荐理由:原文披露了面向政府与企业的受限访问计划,结合 Gemini 3.8 Flash Cyber 与 CodeMender 实现漏洞自动修复,展示了 AI 在主动网络防御中的具体落地路径。
Google 推出 Gemini 3.7 Flash,作为面向编码与智能体的主力模型,其每百万 token 价格仅为前代一半。同时发布搭载 Tensor G6 芯片的 Pixel 11 系列设备,并上线 Gemini 3.5 Transcribe 语音转文字模型。此外,Gemini 应用月活跃用户突破 10 亿,成为 Google 历史上增长最快的产品。
Google DeepMind 宣布在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 模型中推出智能体视频理解(agentic video understanding)功能。
推荐理由:原文给出了视频分析中 token 消耗降低 88% 的具体数据及 API 调用方式,读者可据此评估其在长视频处理场景下的成本效益与落地可行性。
Google 推出 Google Pics,这是一款基于 Nano Banana 模型构建的图像创建和编辑工具,正在向 Google AI Pro、Ultra 订阅用户及大多数 Workspace 商业客户逐步开放。
推荐理由:原文说明了基于 Nano Banana 模型的图片编辑能力以及直接嵌入 Workspace 应用的工作流变化,读者可据此评估其对现有设计协作流程的影响。
Google发布Gemini 3.7 Flash,SpaceXAI推出支持500K上下文的Grok 4.6。OpenAI公布Jalapeño推理芯片早期结果,显示更优能效与低延迟,计划年底内部部署。开源模型Qwen 3.8(27B参数)在性能上可与GPT-5.6及Claude Opus竞争。
ComfyUI 通过 Partner Nodes 正式接入 Google 的 Gemini Omni 1.1 Flash 模型。该节点在单个界面中提供文本转视频、图像转视频、参考图转视频、视频编辑和场景扩展功能,支持 360p 至 4K 分辨率输出,并为每个片段自动生成音频轨道。
推荐理由:ComfyUI 集成 Gemini Omni 1.1 Flash,支持从文本到视频及指令式编辑,最高输出 4K 分辨率并自动生成音频。
Google DeepMind 推出 Gemini Omni 1.1 Flash,通过 Gemini API 在 Google AI Studio 中提供新的创意控制和生成式视频功能。
推荐理由:原文详细列出了场景延长、首尾帧插值及4K升频等具体参数与API调用方式,为开发者提供了可直接落地的生成式视频工作流优化方案。
Google Search AI Mode 升级,支持在对话中追踪超300家航司的机票价格、查询航班与酒店的积分或里程成本,并实现酒店直接预订。该功能已在180多个国家上线,初期支持Alaska Airlines、Hilton等合作伙伴,美国用户可通过Google Pay完成安全预订。
Google DeepMind 宣布推出全球首个针对专有前沿 AI 模型的双盲评估机制,旨在通过加密“盒子”隔离外部评估数据,防止模型在测试前接触题目导致的基准污染。该方案与 Singapore AI Safety Institute、OpenMined、AVERI 和 MLCommons 合作,目前已在 Gemini Flash Lite 模型上进行测试。
推荐理由:原文介绍了利用加密环境防止基准污染的双盲评估方法,为验证前沿模型真实能力提供了新的技术路径。
Google DeepMind 发布最新语音转文字模型 Gemini 3.5 Transcribe,旨在实现精准且智能的实时转录。该模型在 Artificial Analysis 测试中流式和非流式平均词错率分别为 4.0% 和 2.6%,支持超过 85 种语言及最多三个说话人的身份识别。
推荐理由:原文给出了新模型的流式与非流式词错率数据、多语言支持范围以及开发者 API 接入方式,读者可以据此评估其在实时交互场景中的实际表现。
Google Search 提供五种工具助力家居装饰,包括利用 AI Mode 可视化家具摆放、通过 Lens 识别并购买复古单品。用户还可借助 Circle to Search 追踪灵感、使用 Search Live 指导 DIY 安装,以及查看价格历史以优化购物决策。
Google DeepMind 发布文章回顾从 Atari 到 EVE Online 的 15 年游戏 AI 研究历程,并宣布与 Fenris Creations 建立新的研究合作伙伴关系。其通用智能体 SIMA 2 由 Gemini 驱动,能在 No Man's Sky 等游戏中实现类人交互,无需修改游戏代码即可支持实时推理与对话。
Google Search 在 AI Mode 和 AI Overviews 中上线五项教育工具,包括交互式可视化、免费练习测验及 Lens 解题辅导。Gemini Notebook 现已集成至搜索,支持跨产品同步笔记与资料分析。相关功能正以英文向全球逐步推送。
Addy Osmani 分享从构建 Chrome DevTools 到 AI 开发的职业路径,指出 AI 辅助编程的最大风险是“认知投降”,即开发者对问题理解的退化。他提倡通过“循环工程”实现人与智能体的相互增强,并强调软件工程师因具备问责能力而不可替代。
Google DeepMind 发布 Gemini 3.7 Flash,这是其针对编码和智能体任务的最强主力模型。该版本在 FrontierCode 1.1 Main (43.6% vs 34.4%) 和 DeepSWE v1.1 (65.3% vs 49.0%) 等基准测试中显著优于前代,并在 GDP.pdf 和 AutomationBench 上展现更强的推理能力。
推荐理由:新模型在代码生成和复杂文档处理上显著提升,且价格减半,适合评估其在生产环境中的成本效益。
Google DeepMind 推出大规模多语言手语转文本(SL2T)模型,首次将手语AI应用于消费级产品,支持美国手语(ASL)到英语的实时转换。该模型基于超过10万小时、涵盖50多种手语的数据训练,通过MediaPipe Holistic提取人体姿态关键点而非原始视频以保护隐私,直接输出流式文本。
推荐理由:原文给出了SL2T模型的技术原理、隐私保护机制及在Pixel 11上的落地入口,读者可以据此判断其如何改变聋人用户的输入体验。
Google DeepMind 宣布开源 WeatherNext 2 和 WeatherNext Cyclones 模型,其 Nature 论文显示该 AI 模型在气旋路径、强度和风结构预测上达到 SOTA,平均为预报员提供额外一天的预警时间,相当于过去十年的气象技术进步。
推荐理由:WeatherNext 在气旋预测中实现相当于十年气象进步的精度提升,并开源了模型权重与代码。
Google DeepMind 正式发布 Gemini Robotics ER 2,这是其最新的高阶“具身推理”模型,旨在通过视频理解、任务编排和多机器人协作提升机器人在物理世界中的实用性。
推荐理由:新模型通过视频理解实现任务进度追踪与多机器人协作,并公开了API接入入口及基准测试数据。
Google DeepMind 推出最新音乐生成模型 Lyria 3.5,并即日起在 Google Flow Music 中向用户开放。该模型在音乐性、歌词质量、人声表现和创作控制四个方面进行了升级,包括生成更复杂的旋律结构、提高提示词遵循度、增强人声情感表达以及允许用户更轻松地控制输出节奏和时长。
Google DeepMind 推出 Gemini Robotics 2 系列模型,赋予机器人全身智能控制、精细灵巧操作及多机协作能力。该系列包含用于视觉语言动作控制的 VLA 模型、作为高层大脑的 ER 推理模型以及支持快速适配新硬件的端侧模型。目前 ER 模型已在 Google AI Studio 上线,VLA 和端侧模型向早期合作伙伴开放。
推荐理由:原文详细拆解了全身体控制、灵巧操作及多机协作的技术实现,为理解通用物理AI的落地路径提供了具体参考。
Google 宣布向 Genesis Mission 投入 4000 万美元的 AI tokens 和 credits,以加速科学发现前沿。
Google DeepMind 发布 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型,旨在提升 AI 智能体的构建效率与可靠性。
推荐理由:原文给出了三款新模型在效率、延迟和特定场景下的具体性能数据与定价,读者可以据此评估其在智能体工作流中的实际落地价值。
Anthropic 推出 Claude Sonnet 5,主打限时折扣定价与增强的智能体编码能力,并部署了新的网络安全分类器。Etched 获得价值 10 亿美元的推理硬件需求,中国开源 LongCat 2.0 MoE 模型展示大规模训练效率。Google 同步上线 NotebookLM 视频摘要功能及 Nano Banana 2 Lite 图像生成器。
Anthropic 获准向特定机构发布 Mythos-5,OpenAI 推出仅限约 20 家获批组织访问的 GPT-5.6 “Sol”,Meta 面临模型审查压力。GLM 5.2 以 MIT 许可证开源并优化长上下文编码性能。此外,OpenAI 联合 Broadcom 在 TSMC 3nm 工艺上推出 Jalapeño 推理 ASIC,Groq 融资 6.5 亿美元转向 neocloud。
Anthropic 发布 Claude Fable 5,引发关于严格护栏与静默降级的争议。Apple 推出基于 Gemini 合作的 Siri AI,Google 上线 Gemini 3.5 Live Translate 并调整订阅价格。OpenAI 秘密提交 IPO 申请,Bezos 支持的 Prometheus 融资 120 亿美元,DeepSeek 寻求 70 亿美元外部融资。
Google DeepMind 推出基于 Gemini 3.5 Flash 微调的轻量级网络安全模型 Gemini 3.5 Flash Cyber,旨在高效查找、验证和修补软件漏洞。
推荐理由:原文展示了轻量级模型在代码安全扫描中的成本与效率优势,并给出了通过多次调用提升发现率的工程实践。
Google DeepMind 与 Isomorphic Labs 于 2026 年 7 月 16 日联合公布其生物韧性(bioresilience)方法,旨在通过防止模型滥用和利用 AI 技术增强社会对疫情等事件的抵御能力。