logo NVIDIA AI 技术专区

NVIDIA AI 技术专区
NVIDIA技术博客在线研讨会NVIDIA 培训和认证
去全站搜索看看?

登录社区云

登录社区云,与社区用户共同成长

NVIDIA AI 技术专区

邀请您加入社区

欢迎加入社区

欢迎加入社区

kubernetes
  • 视频录播和讲义下载|大模型 PD 分离推理秒级配置寻优与 K8s 多组件编排

    NVIDIA 面向数据中心多节点环境的开源分布式推理服务框架 Dynamo 的组件 AIConfigurator 和 Grove,分享它们分别如何解决 PD 分离架构下大模型推理的两个核心落地难题:在庞大配置空间中高效寻优,以及在 Kubernetes 上优雅编排多组件推理服务。P/D 分离的抉择,到 Prefill/Decode 资源的配比,再到并行策略的设定,庞大的参数空间使得人工调优如同大海

    NVIDIA AI 技术专区
    2026-02-04 09:53:32
     564 
     5 
    #kubernetes#容器#云原生
  • k8s使用gpu

    三、修改containerd配置文件使用gpu容器运行时,二、安装nvidia-device-plugin插件。部署一个简易测试含gpu的pod。一、安装gpu容器运行时。

    A 阿峰
    2025-08-06 10:54:02
     610 
     10 
    #kubernetes#容器#云原生
没有更多了
回到
顶部
logo 提供社区服务与技术支持
logo 提供社区服务与技术支持
©1999-2023北京创新乐知网络技术有限公司 京ICP备19004658号