返回 文章 apply CMS 文章

NVIDIA 开发者博客近期文章汇总:从 NIM 优化到 CUDA Rust

NVIDIA 开发者博客近期文章汇总,覆盖 LLM 服务优化、生物分子结构预测、CUDA 新特性与 Rust GPU 编程等前沿技术。

NVIDIACUDALLM推理NIM
成长分 / 100 72 综合收获、行动、留存与影响

NVIDIA 开发者博客近期文章汇总:从 NIM 优化到 CUDA Rust
为什么值得读了解 NVIDIA 在 LLM 推理优化、多模态服务、边缘部署等方面的最新技术进展。

获取 CUDA Toolkit 13.4 新特性及 CUDA Rust 编程的官方信息。

关键洞察
  1. 全栈 NIM 优化可在 Nemotron 3 Ultra 上带来 2.5 倍的用户量提升。
  2. BioNeMo 推理运行时支持高通量蛋白质结构预测。
  3. 编码-预填充-解码(EPD)分离可加速多模态模型服务。
转成行动

深入阅读

正文与原文对照

原文保真覆盖:全文原文字符:8882

近期文章

2026年9月10日

全栈 NIM 优化如何在 Nemotron 3 Ultra 上带来 2.5 倍的用户量

部署大型语言模型只是迈向生产级服务的第 一步。生产团队还需要服务尽可能多的并发用户……

6 分钟阅读

全栈 NIM 优化如何在 Nemotron 3 Ultra 上带来 2.5 倍的用户量

2026年9月10日

使用 BioNeMo 推理运行时进行高通量结构预测

生物分子结构预测如今常常在蛋白质组规模上运行,其目标是让整个工作列表高效地通过流水线。NVIDIA……

11 分钟阅读

使用 BioNeMo 推理运行时进行高通量结构预测

2026年9月10日

从晶圆出厂到首个 token:用 Nemotron 和 Palantir Foundry 将供应链专业知识编码化

NVIDIA 拥有世界上规模最大、最复杂的供应链之一,其绩效从晶圆出厂到首个 token 进行衡量。这一间隔……

12 分钟阅读

从晶圆出厂到首个 token:用 Nemotron 和 Palantir Foundry 将供应链专业知识编码化

2026年9月09日

何时使用编码-预填充-解码分离来加速多模态模型服务

编码-预填充-解码(EPD)分离是一种面向多模态模型的推理优化技术,它将视觉编码器阶段与……分离

14 分钟阅读

何时使用编码-预填充-解码分离来加速多模态模型服务

2026年9月09日

CUDA Toolkit 13.4 新增 Windows on Arm 支持以及对共享 GPU 的更强控制

每一次 NVIDIA CUDA Toolkit 发布都会带来功能和性能改进,帮助开发者从 NVIDIA GPU 以及更广泛的 NVIDIA……中获得更多收益

15 分钟阅读

CUDA Toolkit 13.4 新增 Windows on Arm 支持以及对共享 GPU 的更强控制

2026年9月08日

推出 CUDA Rust:编写 GPU 内核的两条路径

2026 年 9 月,NVIDIA 宣布将深入拥抱使用 Rust 进行原生 GPU 编程。CUDA C++ 和 CUDA Python 是成熟的企业级工具链,而……

13 分钟阅读

推出 CUDA Rust:编写 GPU 内核的两条路径

2026年9月04日

使用 NVIDIA NemoClaw 构建内存驱动型智能体

企业工作涵盖消息、决策、项目以及随时间变化的责任义务。一个在缺乏这些上下文的情况下启动的 AI 智能体必须重建这些上下文……

6 分钟阅读

使用 NVIDIA NemoClaw 构建记忆驱动的智能体

2026年9月4日

前沿推理抵达边缘:如何在 NVIDIA Jetson 上部署和优化模型

在边缘运行推理和智能体 AI 一直比它本应达到的难度更大。直到最近,能够进行多步推理的模型仍然太大,无法运行……

10 分钟阅读

前沿推理抵达边缘:如何在 NVIDIA Jetson 上部署和优化模型

2026年9月3日

如何在联邦式 Kubernetes 和 AI 平台之间传递用户身份

现代 AI 平台不再是一个登录界面背后的单一应用。用户可能从中央门户开始,打开一个受治理的数据集,启动一个……

13 分钟阅读

如何在联邦式 Kubernetes 和 AI 平台之间传递用户身份

2026年9月3日

NVIDIA PAIR 虚拟推理路由器扩展本地网络上的可用算力

AI 智能体正在通过协同工作学会做更多事情。一个主导智能体可以将复杂任务拆分为更小的作业,并将这些作业分配给专门的子智能体……

11 分钟阅读

NVIDIA PAIR 虚拟推理路由器扩展本地网络上的可用算力

2026年9月2日

实践中的现代 CUDA 工具箱:一步步优化演练

NVIDIA CUDA 仍然是 GPU 加速计算的基础,为从科学模拟到大规模 AI 训练的一切提供动力。但编写……

18 分钟阅读

实践中的现代 CUDA 工具箱:一步步优化演练

2026年9月2日

使用推测解码协同设计 AI 模型以实现更快的 LLM 推理

本文是 AI 模型协同设计系列文章的第三篇。它探讨了如何使用推测解码在保持准确性的同时加速 LLM 推理,并……

15 分钟阅读

使用推测解码协同设计 AI 模型以实现更快的 LLM 推理

一幅展示智能体安全的插图。

2026年9月1日

使用 NVIDIA Nemotron 构建自适应智能体网络安全系统

AI 正在改变网络安全的节奏。智能体系统可以协调工作,并在长时间跨度内追求复杂目标。安全团队正开始……

11 分钟阅读

使用 NVIDIA Nemotron 构建自适应智能体网络安全系统

2026年9月1日

如何在不超支的情况下为 AI 推理和 TCO 确定 GPU 规模

AI 采用的激增正在改变从聊天机器人到内容生成的一切。然而,一个常见的痛点依然存在:组织如何能够自信地……

13 分钟阅读

如何在不超支的情况下为 AI 推理和 TCO 确定 GPU 规模

蛋白质分子的图片。

2026年8月31日

在 Claude Science 中运行 NVIDIA BioNeMo NIM 微服务进行蛋白质结构预测

智能体 AI 正在改变研究的方式。AI 科学家可以阅读论文、提出假设、调用模型,并确定哪些实验应优先进行……

12 分钟阅读

在 Claude Science 中运行 NVIDIA BioNeMo NIM 微服务进行蛋白质结构预测

展示使用 NuRec 重新渲染视频后的原始视图和新视图的图。

2026年8月31日

使用 NVIDIA Omniverse NuRec 跨车辆平台扩展 AV 感知

感知栈由承载它的车辆所塑造。将同一软件迁移到新的车型系列——例如,从 SUV 到轿车或其他车辆……

15 分钟阅读

使用 NVIDIA Omniverse NuRec 跨车辆平台扩展 AV 感知