NVIDIA 把开放模型、物理 AI 和个人 agent 电脑打包成一套基础设施叙事
[AINews] NVIDIA Cosmos 3, Nemotron 3 Ultra, and RTX Spark
这封 AINews 聚焦 NVIDIA 在 COMPUTEX 前后释放的一组关键 AI 基建产品:Cosmos 3、Nemotron 3 Ultra 和 RTX Spark。Cosmos 3 被描述为面向物理 AI 的开放 omnimodal 世界模型,统一语言、图像、视频、音频与动作;Nemotron 3 Ultra 是 550B 级开放权重 LLM,被称为新的美国开源 SOTA;RTX Spark 则把 1 petaflop 级个人 AI 计算带到与 Microsoft 合作的本地 agent PC 方向。对 builder 来说,这不是单点发布,而是 NVIDIA 在模型、硬件、runtime、机器人和本地 agent 场景上构建完整生态的信号。
这封 AINews 最值得精读的地方在于,它没有只把 NVIDIA 的 COMPUTEX 发布会当成硬件新闻,而是把 Cosmos 3、Nemotron 3 Ultra 和 RTX Spark 放在同一条技术主线上看:agent 与物理 AI 会成为未来计算需求的主要来源。Cosmos 3 的核心信息是,NVIDIA 正在把语言、图像、视频、音频和动作统一到一个 Mixture-of-Transformers 架构中,用自回归 reasoner 搭配 diffusion generator,并提供 Nano、Super 以及面向 Text2Image、Image2Video 的微调版本。文中还提到 Cosmos 3 在开放权重图像生成和视频生成榜单上取得领先位置,这意味着 NVIDIA 不只是卖 GPU,也在争夺开放模型生态的话语权。Nemotron 3 Ultra 则补上通用语言模型层:550B-A55B、开放权重、强调效率和速度,被社区称为新的美国开源 SOTA,用来对标 Qwen、Kimi 等中国开源模型。第三块 RTX Spark 更直接面向产品形态:1 petaflop 个人计算芯片,与 Microsoft、OpenClaw、Hermes Agent 等结合,指向本地运行 agent 的个人电脑。隐含判断是,NVIDIA 正在把“agent 消耗算力”变成统一商业叙事:模型要开放以吸引开发者,硬件要下沉到 PC 与边缘设备,机器人和自动驾驶需要世界模型,企业和个人 agent 又需要安全 runtime 与本地上下文。值得继续关注的是,这些开放模型是否真的能形成开发者采用,而不是停留在发布会指标;RTX Spark 这类设备能否产生新的本地 agent 应用范式;以及 NVIDIA 在模型层越做越深后,会如何与 OpenAI、Anthropic、开源社区和下游应用开发者重新分工。
它把今天多封邮件反复出现的 NVIDIA agent 主题讲得最完整,覆盖模型、硬件、开放生态和本地 agent。对 AI builder 来说,这是判断未来端侧 AI、物理 AI 和开放模型生态走向的重要线索。
如果 RTX Spark 和 Cosmos/Nemotron 这类开放模型形成开发者生态,AI 应用可能从纯云端 API 调用转向本地推理、混合部署和更强的设备上下文。独立开发者需要关注本地 agent runtime、端侧模型能力和硬件可得性,而不只是追最新云模型。
- 01Cosmos 3 统一语言、图像、视频、音频和动作,采用 reasoner 加 diffusion generator 的 Mixture-of-Transformers 架构。
- 02Cosmos 3 提供 Nano、Super 以及 Text2Image、Image2Video 微调版本,并被描述为开放权重图像/视频生成的新 SOTA。
- 03Nemotron 3 Ultra 是 550B-A55B 开放权重 LLM,被社区视为美国开源模型的重要追赶。
- 04RTX Spark 是与 Microsoft 预览的 1 petaflop 个人 AI 计算方向,目标是让 agent 在本地 PC 上运行。
- 05NVIDIA 的发布把物理 AI、agent、本地计算和开放模型串成一个完整生态,而不是单一产品更新。
- — 这些开放模型的真实开发者采用率,会不会比发布会指标更重要?
- — 本地 agent PC 的杀手级场景是什么:隐私、成本、低延迟,还是更强的个人上下文?
- — NVIDIA 深入模型层后,会与云模型公司和开源社区形成互补还是竞争?
- — 对小团队来说,端侧 AI 会降低成本,还是引入新的硬件适配复杂度?
GitHub 如何为 agent 时代重构代码协作与基础设施
Latent.Space 采访 GitHub COO Kyle Daigle,核心问题是:当 coding agents 开始以远超人类速度提交代码,GitHub 这样的软件协作基础设施还能否承受。邮件提到 AI 代码/提交增长带来 Actions、数据库、monorepo、可用性、开源维护者负担、PR 信任机制等多维压力,也讨论 GitHub 内部如何用 WorkIQ、MCP、Slack、Teams、email、Copilot workflows、桌面 app、CLI 和 cloud agents 组织工作。它对 builder 的价值在于提醒大家:agent 不是简单提高产能,而是在改写软件供应链、审查流程、组织记忆和开发者定义。
GitHub 是软件生产的默认基础设施,agent 带来的代码洪水会直接改变 CI/CD、PR、开源协作和企业开发流程。
- — 邮件称 coding agents 在 2026 年带来大规模代码增长,并给 GitHub 基础设施造成新压力。
- — 访谈讨论 WorkIQ、MCP、micro-skills、Copilot workflows、cloud agents 等 GitHub 内部 AI 工作流。
- — 重点问题包括 agent PR、AI review、开源信任、Actions 负载和 Copilot 从补全走向更完整工作台。
AI Valley 追踪 NVIDIA agent PC、Anthropic IPO 与 OpenAI 模型传闻
AI Valley 用信息流方式汇总当天 AI 新闻,头条是 NVIDIA 发布面向 AI agents 的新一代 PC 与 RTX Spark 芯片,称 Dell、Lenovo、HP、Asus、MSI 等厂商已有 40 多款机型规划,目标是让开发者、创作者和玩家在本地运行 agent,而不是所有任务都依赖云端。它还提到 Anthropic 已秘密提交 IPO 文件、OpenAI 可能准备发布 GPT-5.6、OpenAI Codex 可控制 Windows PC 等消息。需要注意的是,邮件中 Anthropic 估值和收入数字明显异常,应谨慎看待原文表述。
它反映了主流 AI 日报如何把本地 agent PC、模型发布和 AI 公司资本化放在同一天的产业叙事中。
- — NVIDIA RTX Spark 被描述为让 agent 在个人电脑本地运行的硬件平台。
- — 邮件称多家 PC 厂商已有 40 多款相关机型规划。
- — 同时覆盖 Anthropic IPO、GPT-5.6 传闻和 Codex 控制 Windows PC 等新闻。
TLDR Design:Copilot 改版、Autodesk 收购 MaintainX,以及 AI 时代的设计方法
TLDR Design 这期主要从产品设计和企业软件角度看 AI。最重要的是 Microsoft 365 Copilot 重新设计:加载速度提升超过 50%,加入任务感知 prompt workspace 和基于邮件、文件、聊天、会议的 Work IQ 层,并带动 Word、Excel、PowerPoint、Outlook 中 Copilot 使用增长。另一条重要新闻是 Autodesk 以 36 亿美元现金收购 MaintainX,补足从设计到运营的“operate”层,并获得可用于 AI 的维护数据。观点文章部分讨论 AI 设计仍像 1999 年互联网早期,chat 可能只是临时界面;也提醒敏捷设计不能只追求 minimum,而要确保 viable。
这封邮件把 AI 从模型新闻拉回产品界面、工作流和企业软件并购,适合关注 AI 产品化的人读。
- — Microsoft 365 Copilot 新版强调更快加载、任务感知工作区和 Work IQ 上下文层。
- — Autodesk 以 36 亿美元收购 MaintainX,进入维护与运营层。
- — 多篇设计文章强调 AI 时代需要发明新交互,而不是停留在 chat 默认界面。
The Neuron:从 Clicky 到 RTX Spark,个人电脑正在变成 agent 机器
The Neuron 从两个方向描述人机界面变化:一边是 Clicky 这样的 Mac app,可贴近光标、看屏幕、听语音并启动后台 agent,还有开源版本 OpenClicky;另一边是无编程背景的人用 Replit、Claude、Claude Code、Gemini、Higgsfield、Kling 等工具做出 iPhone app。主新闻则是 NVIDIA 与 Microsoft 的 RTX Spark Windows PC 平台:最高 1 petaflop AI 性能、128GB unified memory,可本地运行 120B 参数模型,并配合 Windows 安全工具和 NVIDIA OpenShell 限制 agent 权限。它的核心判断是,电脑未来可能不像被用户逐项操作的工具,而更像被用户管理的员工。
它把本地 agent 硬件和新型桌面交互连接起来,说明 agent 时代的变化不只在模型,也在操作系统和用户界面。
- — Clicky/OpenClicky 代表贴近屏幕、光标和语音的新 agent UI。
- — RTX Spark PC 被描述为可本地运行大型 agent 的个人电脑平台。
- — 邮件强调电脑会从需要用户操作的工具,转向用户管理的 agent 工作环境。
The Rundown AI:NVIDIA 把 agent 叙事铺到 PC、CPU、机器人和开放模型
The Rundown AI 把 NVIDIA 的 COMPUTEX 叙事概括为“agents across the stack”:RTX Spark 与 Microsoft 合作让 Windows PC 从工具变成 teammate;Vera 被称为“CPU for agents”,据称任务完成速度比竞争对手快 1.8 倍,并被 Anthropic、OpenAI、NYSE 使用;Cosmos 3 是开放机器人模型,让机器人和自动驾驶系统能提前规划;Nemotron 3 Ultra 是 550B 参数开放模型,被称为美国开源模型前列。邮件还提到 Bernie Sanders 寻求公共 AI 股权的新法案、Claude sessions 转 skills 的工作流、Meta AI 被滥用访问 IG 账号等其他新闻。
它清晰呈现 NVIDIA 的全栈战略:agent 不只是软件趋势,而是从芯片、PC、CPU、模型到机器人都被重新组织的计算需求。
- — RTX Spark、Vera、Cosmos 3、Nemotron 3 Ultra 都被放进 NVIDIA 的 agent 计算叙事。
- — 邮件强调未来 compute 的消费者可能更多是 agent,而不是直接操作软件的人。
- — 同时补充了 AI 政策、安全和 workflow 工具相关新闻。