UnboxVPS · 搬瓦工指南

搬瓦工 VPS 部署 DeepSeek / Ollama 轻量大模型与 API 中转实战

2026-08-18 部署实战

核心摘要与部署建议

搬瓦工 VPS 纯 CPU 环境可通过 Ollama 运行 DeepSeek-R1 1.5B/7B 蒸馏版微型模型,用于代码补全或日常对话;也可以将 VPS 部署为中转服务,调用 DeepSeek 官方 API。

大模型运行模式与可行性参数

部署模式VPS 建议配置推荐模型响应速度适用场景
Ollama 本地 CPU 推理2核 CPU / 2GB+ 内存DeepSeek-R1-Distill-Qwen-1.5B8-12 tokens/s个人私密笔记、轻量代码补全
Ollama 进阶推理4核 CPU / 4GB+ 内存DeepSeek-R1-Distill-Qwen-7B2-4 tokens/s深度文本生成与问答
DeepSeek API 中转调用1核 CPU / 1GB 内存即可DeepSeek-V3 / R1 完整版 API取决于官方 API全功能大模型中转调用

实操命令与部署说明

# 1. 一键安装 Ollama 环境
curl -fsSL https://ollama.com/install.sh | sh

# 2. 运行 DeepSeek 1.5B 蒸馏模型
ollama run deepseek-r1:1.5b

搬瓦工的高主频 CPU 在轻量 1.5B 模型推理上表现良好。如需可视化界面,结合 Docker 部署 Open-WebUI 即可快速上手。

常见问题解答 (FAQ)

Q:没有独立 GPU,VPS 跑大模型会不会造成 CPU 资源超载?

答:搬瓦工允许短时间满载,长时间连续推理建议适度限制 CPU 线程数量(如设置 OMP_NUM_THREADS=2),或主要采用 API 中转模式。