×
首页 首页 IT数码 智能和AI 查看内容
发表文章
分享

英伟达:DeepSeek-R1 模型现已上线 NIM 微服务平台

发布者: IT007编辑02| 2025-1-31 16:52| 查看: 82| 评论: 0|原作者: 浩淼|来自: IT之家

摘要: 1 月 31 日消息,英伟达今日宣布,DeepSeek-R1 模型现已在build.nvidia.com上作为 NVIDIA NIM 微服务预览版提供。DeepSeek-R1 NIM 微服务可以在单个 NVIDIA HGX H200 系统上每秒提供多达 3,872 tokens。据介绍,开发 ...
 1 月 31 日消息,英伟达今日宣布,DeepSeek-R1 模型现已在 build.nvidia.com 上作为 NVIDIA NIM 微服务预览版提供。DeepSeek-R1 NIM 微服务可以在单个 NVIDIA HGX H200 系统上每秒提供多达 3,872 tokens。


据介绍,开发人员可以测试和试验应用程序编程接口(API),该接口预计将很快作为可下载的 NIM 微服务提供,这是 NVIDIA AI Enterprise 软件平台的一部分。


DeepSeek-R1 NIM 微服务通过支持行业标准 API 简化了部署。企业可以通过在其首选的加速计算基础设施上运行 NIM 微服务来最大限度地提高安全性和数据隐私。将 NVIDIA AI Foundry 与 NVIDIA NeMo 软件结合使用,企业还将能够为专用 AI 代理创建自定义的 DeepSeek-R1 NIM 微服务。


为方便各种规模的企业部署 AI 服务,英伟达于 2024 年 3 月推出了 NIM(Nvidia Inference Microservices)云原生微服务。


NIM 是一套经过优化的云原生微服务,旨在缩短上市时间,并简化生成式 AI 模型在云、数据中心和 GPU 加速工作站的任何位置的部署。它使用行业标准 API,抽象化 AI 模型开发和生产包装的复杂性,从而扩展开发者池。

最新评论(0)