DevOps
未读
Vibe Coding 实践经验总结
"There's a new kind of coding I call 'vibe coding', where you fully give in to the vibes, embrace exponentials, and forget that the code even exists."
LLM
未读
vLLM/SGLang 适配 GLM-4.6V 模型
随着 vLLM/SGLang 等推理引擎的更新,下面内容记录的方式可能已经不再适用,可以考虑尝试直接使用最新版本的 vLLM/SGLang 运行 记录使用 vLLM/SGLang 部署 GLM-4.6V 的适配过程 模型: HuggingFace: zai-org/GLM-4.6V ModelSco
LLM
未读
大模型启动命令备忘单
记录大模型启动命令,针对同一个模型不同量化精度及不同推理引擎分别记录 记录的显卡型号为测试模型时使用的环境,可以根据自己实际的显卡进行测试是否可以运行 Embedding Qwen/Qwen3-VL-Embedding-8B HuggingFace: Qwen/Qwen3-VL-Embedding-
DevOps
未读
MinIO Operator 扩容多节点 MinIO 集群
使用的 MinIO 为 MinIO Operator 方式部署的,这里记录的扩容方式也是使用 Operator 方式扩容,将现有的4个MinIO节点扩容为 8 个节点,准备好k8s节点之后,对 MinIO 自身的扩容只需要在 MinIO Operator 的前端页面上操作就好了 暂时没有比较好的对单
DevOps
未读
使用 rclone 同步 MinIO 数据
rclone 是一个命令行工具,可以用来管理云存储产品中的文件,也可以实现不同云存储产品之间的数据同步,比如将 MinIO 中的数据同步到阿里云 OSS 等 rclone 支持的云产品列表:https://rclone.org/#providers 之前工作中也曾使用 rclone 将 MinIO
LLM
未读
在华为910B GPU服务器上运行DeepSeek-R1-0528模型
记录在两台910B4服务器上运行 W8A8 量化的 DeepSeek-R1-0528 模型,并使用 EvalScope 做一个简单的推理性能测试,后面还有一些推理性能相关的参数介绍以及模型报错排查方法 一、环境信息 模型 DeepSeek-R1-0528-W8A8-MindIE 需要是W8A8量化过
DevOps
未读
跨 StorageClass 迁移 PVC 数据
之前部署服务时 PVC 使用的 StorageClass 为 local-path,现在为了服务高可用需要切换到 longhorn,所以需要对现有使用 local-path 作为 StorageClass 的 PVC 做数据迁移 经过评估下面这种方式最合适,并且有下面优点: 操作简便,相比能想到的其