近期文章

2026年9月10日
全栈 NIM 优化如何在 Nemotron 3 Ultra 上带来 2.5 倍的用户量
部署大型语言模型只是迈向生产级服务的第 一步。生产团队还需要服务尽可能多的并发用户……
6 分钟阅读
全栈 NIM 优化如何在 Nemotron 3 Ultra 上带来 2.5 倍的用户量

2026年9月10日
使用 BioNeMo 推理运行时进行高通量结构预测
生物分子结构预测如今常常在蛋白质组规模上运行,其目标是让整个工作列表高效地通过流水线。NVIDIA……
11 分钟阅读

2026年9月10日
从晶圆出厂到首个 token:用 Nemotron 和 Palantir Foundry 将供应链专业知识编码化
NVIDIA 拥有世界上规模最大、最复杂的供应链之一,其绩效从晶圆出厂到首个 token 进行衡量。这一间隔……
12 分钟阅读
从晶圆出厂到首个 token:用 Nemotron 和 Palantir Foundry 将供应链专业知识编码化

2026年9月09日
何时使用编码-预填充-解码分离来加速多模态模型服务
编码-预填充-解码(EPD)分离是一种面向多模态模型的推理优化技术,它将视觉编码器阶段与……分离
14 分钟阅读

2026年9月09日
CUDA Toolkit 13.4 新增 Windows on Arm 支持以及对共享 GPU 的更强控制
每一次 NVIDIA CUDA Toolkit 发布都会带来功能和性能改进,帮助开发者从 NVIDIA GPU 以及更广泛的 NVIDIA……中获得更多收益
15 分钟阅读
CUDA Toolkit 13.4 新增 Windows on Arm 支持以及对共享 GPU 的更强控制

2026年9月08日
推出 CUDA Rust:编写 GPU 内核的两条路径
2026 年 9 月,NVIDIA 宣布将深入拥抱使用 Rust 进行原生 GPU 编程。CUDA C++ 和 CUDA Python 是成熟的企业级工具链,而……
13 分钟阅读

2026年9月04日
使用 NVIDIA NemoClaw 构建内存驱动型智能体
企业工作涵盖消息、决策、项目以及随时间变化的责任义务。一个在缺乏这些上下文的情况下启动的 AI 智能体必须重建这些上下文……
6 分钟阅读

2026年9月4日
前沿推理抵达边缘:如何在 NVIDIA Jetson 上部署和优化模型
在边缘运行推理和智能体 AI 一直比它本应达到的难度更大。直到最近,能够进行多步推理的模型仍然太大,无法运行……
10 分钟阅读
前沿推理抵达边缘:如何在 NVIDIA Jetson 上部署和优化模型

2026年9月3日
如何在联邦式 Kubernetes 和 AI 平台之间传递用户身份
现代 AI 平台不再是一个登录界面背后的单一应用。用户可能从中央门户开始,打开一个受治理的数据集,启动一个……
13 分钟阅读
如何在联邦式 Kubernetes 和 AI 平台之间传递用户身份

2026年9月3日
NVIDIA PAIR 虚拟推理路由器扩展本地网络上的可用算力
AI 智能体正在通过协同工作学会做更多事情。一个主导智能体可以将复杂任务拆分为更小的作业,并将这些作业分配给专门的子智能体……
11 分钟阅读
NVIDIA PAIR 虚拟推理路由器扩展本地网络上的可用算力

2026年9月2日
实践中的现代 CUDA 工具箱:一步步优化演练
NVIDIA CUDA 仍然是 GPU 加速计算的基础,为从科学模拟到大规模 AI 训练的一切提供动力。但编写……
18 分钟阅读

2026年9月2日
使用推测解码协同设计 AI 模型以实现更快的 LLM 推理
本文是 AI 模型协同设计系列文章的第三篇。它探讨了如何使用推测解码在保持准确性的同时加速 LLM 推理,并……
15 分钟阅读

2026年9月1日
使用 NVIDIA Nemotron 构建自适应智能体网络安全系统
AI 正在改变网络安全的节奏。智能体系统可以协调工作,并在长时间跨度内追求复杂目标。安全团队正开始……
11 分钟阅读
使用 NVIDIA Nemotron 构建自适应智能体网络安全系统

2026年9月1日
如何在不超支的情况下为 AI 推理和 TCO 确定 GPU 规模
AI 采用的激增正在改变从聊天机器人到内容生成的一切。然而,一个常见的痛点依然存在:组织如何能够自信地……
13 分钟阅读
如何在不超支的情况下为 AI 推理和 TCO 确定 GPU 规模

2026年8月31日
在 Claude Science 中运行 NVIDIA BioNeMo NIM 微服务进行蛋白质结构预测
智能体 AI 正在改变研究的方式。AI 科学家可以阅读论文、提出假设、调用模型,并确定哪些实验应优先进行……
12 分钟阅读
在 Claude Science 中运行 NVIDIA BioNeMo NIM 微服务进行蛋白质结构预测

2026年8月31日
使用 NVIDIA Omniverse NuRec 跨车辆平台扩展 AV 感知
感知栈由承载它的车辆所塑造。将同一软件迁移到新的车型系列——例如,从 SUV 到轿车或其他车辆……
15 分钟阅读
