NVIDIA

标签「NVIDIA」下的文章

共 4 篇文章

英伟达发布 Cosmos 3 Edge,可在机器人端侧运行的世界模型

英伟达于 2026 年 8 月 19 日发布 Cosmos 3 Edge,这是一款专为机器人端侧控制设计的 4B 参数 omni 模型,包含一个 2B 参数的 Nemotron 推理器。该模型属于 Cosmos 3 系列,与 Cosmos 3 Nano 和 Cosmos 3 Super 共享物理世界数据预训练,具备物体运动和交互的基础理解。其核心优势在于模型足够小,可直接在英伟达 Jetson Thor 上运行,无需数据中心 GPU。后训练是使模型适应机器人操作任务的关键,英伟达提供了完整教程,训练数据来自 nvidia/Cosmos3-DROID 数据集,包含 7.6 万条成功遥操作轨迹,覆盖 86 个任务和 564 个场景,使用 Franka Panda 机械臂和 Robotiq 夹爪采集。后训练验证配置需要 64 个节点,每节点配备 4 块 GB200,共 60K 次迭代,耗时约 68 小时,总计约 1.74 万 GB200 小时。在 Jetson AGX Thor T5000 上,后训练策略实时运行,生成动作块约需 1.53 秒,覆盖 2.13 秒运动,闭环 RoboLab 任务成功率达 22.9%。该模型支持多种机器人本体,包括双臂 Franka、UR、WidowX 250 和 LeRobot SO101,教程和代码已开源。这一发布降低了机器人对数据中心算力的依赖,推动了具身智能在边缘场景的应用,标志着英伟达在边缘 AI 和机器人领域的布局进一步深化。

阅读全文

TensorRT Model Connect - 开源模型部署工具,两命令转C+

TensorRT Model Connect(TRTMC)是 NVIDIA 于 2026 年 8 月 18 日以 Apache-2.0 协议在 GitHub 开源的一款模型部署工具,旨在将 Hugging Face 或本地模型检查点直接转换为原生 C++ 推理引擎。开发者仅需 `trtmc build` 和 `trtmc run` 两条命令即可完成部署,全程无需导出 ONNX 中间格式,构建产物为版本化的 .bundle 文件,运行时完全脱离 PyTorch 环境。该项目由 OpenAI Codex Agent 在人类监督下构建,代表了 AI 辅助开发部署工具的范式转变。TRTMC 提供覆盖 105 个模型系列、76 个模型家族的参考实现,包括 Qwen、Llama、Mistral、DeepSeek 等主流开源大语言模型以及 Whisper 语音模型。性能验证方面,在 GB300 快照测试中,102 个 profile 的推理性能较声明基准提升超过 5%。其技术架构将构建阶段与运行时解耦,提供统一的 C++ 任务 API(generate、transcribe、embed 等),并支持 NVIDIA 全系列 GPU(如 A100、H100、Jetson),可实现云端到边缘的全场景部署,适用于大模型推理服务、边缘 AI 推理、C++ 应用集成与模型快速评估。该工具通过版本化 .bundle 天然支持模型回滚与灰度发布,为生产环境提供了高一致性的交付单元。

阅读全文

AI-First Board Series-THE MODEL IS THE EASY PART NOW, DEPLOYING IT IS THE MOAT-Week of June 29 – July 3, 2026

本文由 Ekta Chopra 发表于2026年7月4日,核心论点是:当前企业 AI 领域的竞争瓶颈已从模型开发转向模型部署,因此‘前线部署工程师’(Forward Deployed Engineer, FDE)成为决定AI战略成败的关键角色,且必须由一个中心化团队统一掌握路线图,以联邦式架构分散执行。文章以该周发生的多项行业重磅动态作为论据支撑:微软投资 25 亿美元、配备 6000 名工程师成立‘Microsoft Frontier Company’,专门提供 AI 部署服务,将‘部署’而非‘模型’产品化;OpenAI 的 GPT-5.6 停留在受政府影响的受限预览阶段,并提議讓美國政府持股 5%,顯示模型发布已成政策性协商事件;Anthropic 将其能量转向发布垂直化研究平台 Claude Science,并在两周内经历模型出口管制被暂停和恢复;NVIDIA 推出针对 AI 云服务的收入分成和信贷模式,将 Claude 模型集成至 Azure 的 Microsoft Foundry;Alibaba 内部禁用 Claude Code;Google 因算力紧张限制 Meta 使用 Gemini。这些事件共同表明,模型能力正迅速商品化,而能够将模型能力转化为具体业务价值、适应本地化环境、进行流程重构和获得信任的 FDE 角色与专业部署治理体系,才是企业真正的护城河。文章详细定义了 FDE 的技能集——包括扎实的生产工程能力、产品判断力、领域认知、模型评估能力和高层沟通力,并为企业董事会如何评估和投资这一维度提供了具体议程。

阅读全文

Fuzzball将英伟达DGX Spark转化为可随时运行的任意规模AI开发与推理环境

2026年7月(具体日期不详),CIQ宣布其Fuzzball人工智能与高性能计算编排平台已为NVIDIA DGX Spark提供可投入生产使用的AI计算与推理环境,后续计划支持更多平台。Fuzzball可将AI模型从构思到推理服务上线的周期从数月压缩至数天,单台DGX Spark在启用首日即可成为全功能AI开发部署环境,内置数百个工作流模板,无需重构即可扩展至数千块GPU,还可无缝迁移至NVIDIA GB300 NVL72等更大规模GPU部署。该方案主要面向需保障数据不出本地的Sovereign AI场景,打通本地DGX Spark、现有高性能计算集群与云GPU资源的统一运营模型,消除AI团队与高性能计算团队的运营割裂问题,解决此前受监管行业机构必须在AI投产与数据自主可控之间二选一的痛点。CIQ还宣布将于2026年7月16日太平洋夏令时12:00举办题为“借助Fuzzball部署您的专属大语言模型并推进至生产环境”的网络研讨会,开放公开注册。该方案体现出面向主权AI、本地到云的统一编排以及工作流一键扩展等关键能力,针对金融、医疗等强监管行业的AI落地需求提供了工程化解决路径。

阅读全文