FEATURED · 精选文章

NemoClaw DGX Station Express 安装实战:Nemotron 3 Ultra 550B 与 DeepSeek V4 Flash 一键部署与边界约束

发布时间 / 2026/9/20 15:52:03
来源 / 创域科博编辑部
栏目 / 资讯中心
NemoClaw DGX Station Express 安装实战:Nemotron 3 Ultra 550B 与 DeepSeek V4 Flash 一键部署与边界约束 NemoClaw DGX Station Express 安装实战Nemotron 3 Ultra 550B 与 DeepSeek V4 Flash 一键部署与边界约束【免费下载链接】NemoClawRun agents like Hermes, LangChain Deep Agents, and OpenClaw more securely inside NVIDIA OpenShell with managed inference项目地址: https://gitcode.com/gh_mirrors/ne/NemoClawDGX Station Express 是 NemoClaw 为单台或成对 DGX Station GB300 提供的精简引导流程安装器在完成硬件与软件资格判定后向操作员提供「Nemotron 3 Ultra 550B 自动配对」与「DeepSeek V4 Flash」两个受维护的推理选项并统一负责主机准备、第三方软件同意、建议网络策略、默认沙箱与重启/登录后续恢复。读完本文你将掌握 Express 的资格判定规则、--force-station-install的验证专用语义、两条安装路径的底层模型与配方映射以及哪些环境变量必须保持未设置、哪些操作必须交由安装器独占执行。本文对应仓库文档 docs/resources/prompt-assets/dgx-station.md并以 scripts/install.sh、scripts/prepare-dgx-station-host.sh 与 managed-inference/recipes 下的实际实现为佐证。何时使用这些指令硬件检测先行DGX Station Express 指令仅在硬件检测确认目标机器是 DGX Station 之后才允许使用。也就是说Express 流程不是用户自由选择的入口而是安装器完成平台识别后的条件分支——检测到非 Station 平台时相关标志会被直接拒绝见下文「标志互斥与校验」。在向操作员提供 Station Express 选项之前安装器必须先完成Station 软件资格检查。资格判定由安装器调用 scripts/prepare-dgx-station-host.sh 中的classify_dgx_station_release逻辑完成分类结果包括generic-ubuntu通用 Ubuntu 镜像supported-dgx-os受支持的 DGX OSOTA 形式supported-colossus-baseos受支持的 Colossus BaseOSsupported-ai-developer-tools受支持的 AI Developer Tools 镜像。对应地scripts/install.sh 中的 Express 元数据边界明确接受以下发布形态见install.sh中 Unsupported DGX Station OS 的报错文本通用 Ubuntu 24.04 ARM64、OTA 形式的 DGX OS 7.2.0 / 7.4.0 / 7.5.0、无 OTA 的 DGX OS 7.6.x 系列或经过显式合格认证的 Station 出厂镜像。DGX_PRETTY_NAME仅用于诊断不决定资格结论。软件资格未通过时的处理验证专用的 --force-station-install当硬件合格但软件资格未通过时不得继续走 Express 的正常选项而应向操作员说明当前发布档案release profile阻断了 Station Express 引导也阻断了直接 GPU 策略direct-GPU policy的创建仅在一种情况下提供--force-station-install确属真实的 Station GB300 硬件但发布元数据未被识别此时它是文档化的、验证专用validation-only的恢复路径说明验证专用处理的语义保留出厂软件栈、不运行引导onboarding、不选择模型退出并给出「安装受支持的 DGX Station 软件档案」的指引。在验证专用处理完成之后流程必须停止操作员需要先安装受支持的软件档案之后才能不带--force-station-install重新运行普通安装器。验证专用模式绝不会“顺便”进入 Express 的模型选择——--force-station-install的校验函数validate_force_station_install_override位于 scripts/install.sh会强制以下互斥约束不能与--station-deepseek、NEMOCLAW_VLLM_MODEL、NEMOCLAW_MODEL组合它是验证专用不做任何模型选择覆盖平台必须检测为 DGX Station GB300PCI 厂商0x10de、设备0x31c2/0x31c3见 scripts/prepare-dgx-station-host.sh 顶部的GB300_PCI_*常量若发布状态已属于受支持分类generic-ubuntu / supported-dgx-os / supported-colossus-baseos / supported-ai-developer-tools则报错并提示移除该标志不能与NEMOCLAW_NO_EXPRESS1、非交互模式含由NON_INTERACTIVE_SOURCE触发的间接非交互或NEMOCLAW_PROVIDER组合需要交互终端express_prompt_can_read_tty检查失败时调用fail_force_station_terminal_required报错提示 curl|bash 管道必须可用/dev/tty。只有软件资格通过的 Station才继续进入下方 Express 选择流程并由安装器做最终的运行时与准备决策。安装器权威原则不要绕过 Express 分支Express 流程遵循一条铁律以所选维护版本官方安装器的行为为唯一权威覆盖 Station 资格、主机准备、模型选择、同意确认以及重启/登录后的恢复。因此不要单独运行 Station 准备辅助脚本scripts/prepare-dgx-station-host.sh来代替安装器的内置准备不要通过预先设置 provider 与 model 环境变量来“复刻”Express 效果——这类变量在 Express 分支中是被明确禁止设置的见下文。两个 Station Express 选项安装器提供两个 Express 选项二者共用同一套 Station 检测、主机准备、同意、建议策略、默认沙箱与修订版revision恢复流程自动配对选择默认路径普通安装器选择nemotron-3-ultra-550b-a55b并检测两条已配置的私有/30ConnectX-8 网轨rail的确定性对端上是否已有一个已被信任的对等节点peer。若找到合格配对则使用 vLLM 0.25.1 Ray 2.56.0 的双 Station 配方以nemotron-ultra名义提供服务否则保留单 Station Ultra 配方以nvidia/nemotron-3-ultra-550b-a55b名义提供服务。install.sh中的对应常量如下STATION_ULTRA_VLLM_MODELnemotron-3-ultra-550b-a55bSTATION_ULTRA_SERVED_MODELnvidia/nemotron-3-ultra-550b-a55bSTATION_ULTRA_DUAL_SERVED_MODELnemotron-ultraSTATION_ULTRA_LEGACY_VLLM_IMAGEvllm/vllm-openaisha256:0fec7ec5f3e6bc168e54899935fb0557da908a4832a1dbc88e2debcf2f889416单机场景的运行时清单可在 managed-inference/recipes/vllm.nemotron-3-ultra-550b-a55b-nvfp4.station-arm64-single.v1.yaml 中查看该 ServingRecipe 使用与上述一致的 vLLM 镜像约 10.67 GB 镜像下载、architecture: arm64、gpuRequest: all并注入VLLM_WEIGHT_OFFLOADING_DISABLE_PIN_MEMORY1与VLLM_NVFP4_GEMM_BACKENDflashinfer-trtllm两个运行时环境变量对应模型清单见 managed-inference/models/vllm.nemotron-3-ultra-550b-a55b-nvfp4.v1.yaml。DeepSeek V4 Flash显式覆盖通过--station-deepseek标志选择deepseek-v4-flash以deepseek-ai/DeepSeek-V4-Flash名义提供服务。install.sh中的对应常量为STATION_DEEPSEEK_VLLM_MODELdeepseek-v4-flash与STATION_DEEPSEEK_SERVED_MODELdeepseek-ai/DeepSeek-V4-Flash。--station-deepseek的校验函数validate_station_deepseek_override同样有硬性约束平台必须检测为 DGX Station不能与NEMOCLAW_NO_EXPRESS1、非交互模式或NEMOCLAW_PROVIDER组合NEMOCLAW_VLLM_MODEL若被设置只能等于deepseek-v4-flash或其别名deepseek-ai/deepseek-v4-flash并且必须运行在交互终端中curl|bash 管道需要/dev/tty可用否则调用fail_station_deepseek_terminal_required直接失败。同意前必须说明的边界在征得操作员同意之前必须逐条说明以下边界缺一不可通用 Ubuntu 上的包变更在通用 Ubuntu 上Express 可能安装或更改固定的 NVIDIA 开源驱动、Docker 与 Buildx、NVIDIA Container Toolkit以及经过审核的出厂dkms过渡在合格出厂镜像上安装器走有界验证与修复路径而不是替换出厂软件栈。docker 组成员权限官方 Station 准备可能把受信任的本地账户加入docker组这等同于授予 root 级控制权只适合受信任的单用户开发主机。重启与恢复官方 Station 准备可能需要操作员控制的重启且恢复时只接受已被认可的 NemoClaw 修订版。prepare-dgx-station-host.sh用退出码表达这一流程--apply返回退出码10表示需要操作员控制的重启重启后再次运行--apply再运行--verify退出码11表示已加入 docker 组需新开登录会话后再次运行--apply无需重启退出码12表示已有 vLLM 工作负载需要安装器做所有权选择。网络责任划分NemoClaw不配置两条私有网轨、不扫描网络、不建立 SSH 信任、也不重启任何一台 Station物理隔离、防火墙、SSH 信任与手动重启全部由操作员负责。双站运行时信任前提双 Station 运行时使用未经认证的 Ray、NCCL 与 vLLM 协调流量包括 TCP 端口6379上的 Ray head 与 Ray worker 流量。因此两台 Station 以及任何能触达任一条网轨的主机必须互相信任共享的/24网段不等价于所需的直连私有/30网轨。磁盘空间Nemotron Ultra Express 需要下载约352 GB的模型数据DeepSeek Express 下载其固定的 vLLM 容器与模型数据。两者都要求模型缓存文件系统与 Docker 存储有足够空间。测试边界DGX Station 仅在一台物理 DGX Station GB300上、跨合格档案做过带限制的测试双 Station 配置尚未经过验证也没有专属 CI 覆盖。交互式询问与三个选择安装器以固定提问开始“Which DGX Station Express option would you like?”您希望使用哪个 DGX Station Express 选项备选自动配对选择使用 Nemotron 3 Ultra 550B——存在合格且受信任的对等节点时用双站配方否则用单站 Ultra 配方DeepSeek V4 Flash显式--station-deepseek覆盖都不是按正常方式自行选择运行时与模型。提问必须保持可见、可应答安装器随后展示的第三方软件通知与 Express 总结也必须逐条保留等待操作员响应不得预先应答或压制。选中 Express 模型后的执行规则一旦操作员选择了 Express 模型以下规则必须严格执行设置NEMOCLAW_AGENT为 starter prompt 中已选定的 agent如 hermes、LangChain Deep Agents 或 OpenClaw 之一。自动配对选择运行不带--station-deepseek的普通安装器除非用户已预先选定受信任的对等节点否则不要主动提供 peer若提供了显式 peer则该 peer 必须通过资格校验否则 setup 停止而不是回退到单站。DeepSeek传入--station-deepseek且不带任何其他模型选择覆盖。以下环境变量一律不得设置NEMOCLAW_PROVIDER、NEMOCLAW_VLLM_MODEL、NEMOCLAW_MODEL、NEMOCLAW_NON_INTERACTIVE、NEMOCLAW_YES、NEMOCLAW_ACCEPT_THIRD_PARTY_SOFTWARE、NEMOCLAW_NO_EXPRESS。保持未设置NEMOCLAW_SANDBOX_NAME、NEMOCLAW_POLICY_TIER、web 搜索设置与消息通道设置让安装器应用其 Express 默认值建议策略、默认沙箱。不要单独运行scripts/prepare-dgx-station-host.sh 的--check、--verify或--applyStation 资格与准备由安装器独占负责。只在安全的交互终端运行安装器。如果编码代理 UI 无法保持安装器提示可见并接收操作员响应应在安装前停止。让安装器自行展示第三方软件通知与 Express 总结每个官方确认项保持可见等待操作员响应不预先应答、不抑制。不传--force-station-install除非安装器在真实 Station GB300 硬件上拒绝了发布元数据且操作员另行选择了文档化的临时覆盖。遵守安装器在必需重启或登录过渡后打印的命令按其指引继续。描述 Ultra 时称其为普通 Express 选择分布式双站拓扑只有在安装器报告「对端 Station、GPU、网轨、MAC、路由、邻居与巨帧jumbo-frame检查均合格」之后才可描述为已选定。关于对端配对的细节scripts/install.sh 在双站分支中打印Checking for one pretrusted reciprocal dual-DGX Station peer on the two direct /30 rail counterparts.并在发现「完整运行中的 NemoClaw 托管双站 head」或「正在运行的旧版单站 Ultra head」时分别延迟主机准备_STATION_EXPRESS_DEFERRED_MANAGED_PAIR/_STATION_EXPRESS_MIGRATING_LEGACY_HEAD交由后续协调器重新验证互惠物理配对后再复用既有生命周期——这印证了「显式 peer 必须合格不合格即停止而非回退」的实现语义。拒绝 Express 后的正常选择流程如果操作员选择「都不是」选项 3安装器继续正常的 provider 选择流程检测到已就绪的 vLLM 服务时提供既有 vLLM提供托管 vLLMmanaged vLLM提供受支持的本地 Ollama提供所选 agent 支持的全部托管或兼容 provider。更多资源安装器入口与全部标志、环境变量说明scripts/install.sh--station-deepseek、--force-station-install、NEMOCLAW_NO_EXPRESS1、NEMOCLAW_ACCEPT_THIRD_PARTY_SOFTWARE1等Station 主机准备辅助脚本安装器内部使用含--check/--apply/--verify/--bind-controller与退出码语义scripts/prepare-dgx-station-host.sh单站 Ultra 运行时配方managed-inference/recipes/vllm.nemotron-3-ultra-550b-a55b-nvfp4.station-arm64-single.v1.yaml双站 vLLM 集群实现与测试src/lib/inference/vllm-station-cluster.ts、src/lib/inference/vllm-dual-station.test.ts平台身份探测src/lib/inference/dgx-station-identity.ts完整上手与双站指南docs/get-started/dgx-station-preparation.mdx、docs/inference/set-up-vllm-on-two-dgx-stations.mdx、docs/inference/set-up-vllm.mdx。【免费下载链接】NemoClawRun agents like Hermes, LangChain Deep Agents, and OpenClaw more securely inside NVIDIA OpenShell with managed inference项目地址: https://gitcode.com/gh_mirrors/ne/NemoClaw创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
RELATED — 相关阅读

相关资讯

LATEST — 最新资讯

最新发布

TODAY — 本日精选

新闻

WEEKLY — 本周精选

新闻

MONTHLY — 本月精选

新闻