返回 文章 学习 CMS 文章

Together AI 在 NVIDIA GTC 2026 发布多项创新:推理、代理、语音 AI 与开放模型

Together AI 在 GTC 2026 上发布多项与 NVIDIA 合作的新产品,涵盖推理优化、代理工作流、语音 AI 和开放模型,并举办多场技术会议。

Together AINVIDIA GTC 2026Dynamo 1.0Nemotron 3 Super
成长分 / 100 72 综合收获、行动、留存与影响

Together AI 在 NVIDIA GTC 2026 发布多项创新:推理、代理、语音 AI 与开放模型
为什么值得读了解 Together AI 与 NVIDIA 在 Dynamo 1.0、OpenShell、Nemotron 3 Super 和 Parakeet ASR 模型上的最新合作。

获取关于生产级推理、多代理工作流和实时语音代理的实用技术见解。

关键洞察
  1. Together AI 已在推理栈中使用 NVIDIA Dynamo 1.0,以优化生产用例的性能。
  2. NVIDIA NemoClaw 结合 Together 的模型库和专用端点,简化了运行 OpenClaw 始终在线助手的流程。
  3. NVIDIA Nemotron 3 Super 是一个 120B 总参数(12B 活跃参数)的混合专家模型,支持 1M 令牌上下文窗口,专为多代理工作流设计。
转成行动

深入阅读

正文与原文对照

原文保真覆盖:全文原文字符:5513

今年,Together AI 很高兴能参与 NVIDIA GTC,带来多项重大发布和塑造 AI 生态的对话——从前沿模型发布到新的语音 AI 能力,以及与我们的研究和工程领导者的技术会议。

如果您参加 GTC,我们很乐意与您联系。

关键发布

在 GTC 2026 上,我们参与的几项发布突出了一个核心主题:AI 系统正变得更加开放、具备代理能力,并准备好投入生产。Together AI,作为 AI 原生云,旨在支持这一转变——帮助开发者训练、塑造和部署大规模 AI 系统,并具备实际应用所需的性能和成本效益。今天我们在 GTC 上发布多项内容。

在 Together AI 中使用 NVIDIA Dynamo 1.0

NVIDIA 发布了 NVIDIA Dynamo 1.0,这是一个用于大规模生成式和代理推理的开源软件。我们很高兴与 NVIDIA 在 Dynamo 1.0 上合作,并且已经在我们的推理栈中使用 Dynamo,以在生产用例中提供更优化的性能。在 Together AI,我们致力于开放创新,并期待探索 Dynamo 1.0 可以应用的各种用例。

通过 NVIDIA OpenShell 连接 Together 的高性能推理

Together AI 和 NVIDIA 正在合作开发 NVIDIA NemoClaw——一个开源栈,通过单条命令简化运行 OpenClaw 始终在线助手的流程,并提高安全性。作为 NVIDIA Agent Toolkit 的一部分,它安装了 NVIDIA OpenShell 运行时——一个用于运行自主代理和开源模型(如 NVIDIA Nemotron)的安全环境。Together 很高兴托管 NVIDIA OpenShell 运行时,专为希望使用高性能模型构建代理的客户创建。Together AI 拥有一个包含超过 150 个优化模型的模型库,现在可以通过 NemoClaw 轻松访问。结合 Together 的专用端点,开发者可以在生产规模下获得其推理引擎的速度和成本效益。

利用 NVIDIA Nemotron 3 Super 进行多代理工作流

NVIDIA Nemotron 3 Super 是一个混合专家模型,专为高性能推理和多代理工作流设计。它结合了 Mamba-Transformer 架构和 1M 令牌上下文窗口,支持长程推理和复杂的代理交互。该模型拥有 120B 总参数(每个令牌 12B 活跃参数),经过优化,即使单个 GPU 也能高效运行多个协作代理——非常适合 AI 原生工作流,如软件开发代理、金融分析和网络安全自动化。Nemotron 3 Super 可以通过我们的 专用模型推理 部署,为开发者提供一种简单且可扩展的方式,在生产中运行高级推理模型。

使用 NVIDIA Parakeet TDT 0.6B V3 构建语音代理

作为我们近期语音解决方案发布的一部分,NVIDIA Parakeet TDT 0.6b V3 自动语音识别(ASR)模型现已上线 Together AI 模型库,为开发者提供针对实时语音应用优化的高性能、低延迟转录能力。通过将 Parakeet 的 ASR 准确性与 Together 的高性能推理基础设施相结合,AI 原生开发者可以构建生产就绪的语音代理,实现快速、可靠且可扩展的转录。

Together 会议

Together AI 团队与 Cursor、Decagon 等客户将在多场 GTC 会议中分享见解,涵盖从生产推理到开放 AI 研究等主题。

会议包括:

工程化真实世界的大语言模型推理:连接开源与生产系统

3 月 17 日 • 下午 2:00

Yineng Zhang — Together AI 高级总监

大规模生产推理中的硬核经验

3 月 17 日 • 下午 4:00

Yuchen Wu,Cursor 工程师 | Ce Zhang — Together AI 首席技术官

通过研究中的开源 AI 建立信任与发现

3 月 18 日 • 下午 2:00

Percy Liang — Together AI 联合创始人

构建和扩展 AI 原生应用的幕后

3 月 18 日 • 下午 4:00

Alan Yiu,Decagon 产品副总裁 | Charles Zedlewski — Together AI 首席产品官

欢迎莅临 #1213 展位

除会议外,Together 团队还将在整周举办展位活动和周边活动,包括聚焦下一代 AI 基础设施和 AI 原生应用的精选高管交流会。

欢迎前来:

  • 观看 Together AI 基础设施和模型的现场演示
  • 了解团队如何扩展生产推理和代理系统
  • 与构建开放 AI 模型和基础设施未来的研究人员和工程师交流

立即在 Together AI 无服务器端点试用 Nemotron 模型:https://www.together.ai/models

了解更多并预约会议:https://www.together.ai/gtc-san-jose-2026