DeepSeek Harness 命令速查

DeepSeek Harness CLI 命令在线速查:涵盖模型管理、推理优化、分布式训练、API 网关等常用命令,点击命令即可复制。

未找到匹配的命令,请尝试其他关键词

会话管理

操作命令
启动交互会话harness
单次执行harness run "你的指令"
继续会话harness continue
列出历史harness history
清除历史harness history clear
查看状态harness status
查看版本harness --version

模型管理

⚠️ DeepSeek Harness 支持多种模型格式和量化方式
操作命令
列出模型harness model list
下载模型harness model pull deepseek-llm-7b-chat
加载模型harness model load deepseek-llm-7b-chat
卸载模型harness model unload deepseek-llm-7b-chat
量化模型harness model quantize model.bin --bits 4
转换格式harness model convert model.pt --format gguf
查看模型信息harness model info deepseek-llm-7b-chat
删除模型harness model delete deepseek-llm-7b-chat

推理优化

操作命令
启动推理服务harness serve --model deepseek-llm-7b-chat
设置并发数harness serve --workers 4
启用批处理harness serve --batch-size 32
设置 KV 缓存harness serve --kv-cache 8192
启用量化推理harness serve --quantize int4
设置 GPU 内存harness serve --gpu-memory-utilization 0.9
启用流式输出harness serve --stream
停止服务harness serve stop

训练管理

操作命令
启动训练harness train --config train.yaml
分布式训练harness train --distributed --gpus 4
设置学习率harness train --lr 1e-5
设置 batch sizeharness train --batch-size 8
启用梯度累积harness train --grad-accum 4
设置 checkpointharness train --save-every 1000
继续训练harness train --resume checkpoint.pt
查看训练日志harness train logs --tail 100

API 网关

⚠️ API 网关提供统一的模型访问接口和负载均衡
操作命令
启动网关harness gateway start
停止网关harness gateway stop
重启网关harness gateway restart
查看状态harness gateway status
添加后端harness gateway backend add --url http://localhost:8000
移除后端harness gateway backend remove --id backend_1
列出后端harness gateway backend list
查看日志harness gateway logs --tail 50

故障排查

① GPU 内存不足

根因:模型过大或 batch size 过高 · 解法:启用量化或减少 batch size
操作命令
启用量化harness serve --quantize int4
减少 batchharness serve --batch-size 8

② 推理延迟高

根因:未启用优化或资源不足 · 解法:启用 KV 缓存和批处理
操作命令
启用缓存harness serve --kv-cache 8192
增加并发harness serve --workers 8

③ 训练 loss 不下降

根因:学习率不当或数据问题 · 解法:调整学习率并检查数据
操作命令
调整学习率harness train --lr 5e-6
检查数据harness data validate dataset.json

④ API 网关连接失败

根因:后端服务不可用或网络问题 · 解法:检查后端状态和网络连接
操作命令
检查后端harness gateway backend health
测试连接curl http://localhost:8080/v1/models

⑤ 模型加载失败

根因:模型文件损坏或格式不兼容 · 解法:重新下载或转换格式
操作命令
验证模型harness model verify model.bin
重新下载harness model pull model-name --force
您的足迹: