1、相关指令

显卡信息

nvidia-smi

llama 版本确认

llama-cli --version

hugging face 大模型下载

$env:HF_ENDPOINT="https://hf-mirror.com"
hf download hf://unsloth/Qwen3.8-27B-GGUF/Qwen3.8-27B-UD-Q4_K_XL.gguf  --local-dir ./

大模型加载

llama-server -m ".\Qwen3.8-27B-UD-Q4_K_XL.gguf" -ngl 999 

大模型体检

http://127.0.0.1:8080/health

接入deepseek harness配置

qwen

qwen-local

http://127.0.0.1:8080/v1

密钥随意输入

2、视频链接

请参照视频操作,视频链接


付费咨询,远程一对一指导,请联系:gao_mygoh 。