LLM
未读
华为昇腾910B服务器上部署Qwen3-30B-A3B并使用EvalScope推理性能测试
使用 MindIE、vllm-ascend 推理引擎在华为昇腾910B显卡上运行 Qwen3-30B-A3B 模型,然后简单测试下推理性能 一、准备 1.1 环境信息 模型 Qwen3-30B-A3B MindIE 运行该模型需要至少2张卡,推荐4张 服务器型号 Atlas 800I A2 1台 显
华为昇腾910B GPU服务器初始化准备及安装k8s运行环境
介绍如何在华为昇腾 910B GPU 服务器上安装驱动、固件、CANN等基础工具,NPU卡相关配置以及配置可以让容器使用GPU资源的环境配置 说明: 这里将 GPU 与 NPU 两个名词混用了 下面的步骤是基于 Atlas 800I A2 推理服务器操作 一、驱动查找固件安装 需要先在服务器上安装驱
DevOps
未读
从零搭建 K8s 使用 NVIDIA GPU 的环境
在搭建k8s后,如果集群包含 GPU 节点并且需要运行的 Pod(比如模型服务)使用 GPU 资源,除了 Kubernetes 的常规组件,还需要在集群中安装并配置与 GPU 相关的环境与服务。 一、GPU 节点环境准备 首先需要给 GPU 服务器安装驱动,并给容器运行时安装 nvidia-cont
DevOps
未读
在命令行切换多个K8S集群
公司有多个 k8s 环境,在自己办公电脑上连接、切换多个 k8s 集群会比较麻烦,所以想到使用 shell 函数来比较方便的在多个 k8s 集群之间切换 完整配置 使用的电脑是 Mac,shell 用的是 zsh 下面是完整的配置,放在~/.kube.zsh alias k='kubectl'
al