Ollama 本地部署大模型完全指南:5分钟跑起 Llama 3 / Qwen 3 / DeepSeek

Ollama 让本地运行大模型变得极其简单。
本文带你 5 分钟跑起本地大模型。
一、安装 Ollama
macOS
Linux
Windows从官网下载安装包:
二、下载并运行模型
三、API 调用Ollama 自动提供 OpenAI 兼容 API:
四、推荐模型(按显存)显存
推荐模型
4GB
qwen2.5:3b, llama3.2:3b
8GB
qwen3:8b, llama3.1:8b
12GB
qwen3:14b, deepseek-coder-v2:16b
24GB+
qwen3:32b, llama3.1:70b
五、Web UI 集成推荐使用 Open WebUI:
访问 http://localhost:3000 即可使用类似 ChatGPT 的界面。
[Claude Code 实战指南:
终端里的 AI 编程代理怎么用?(2026 国内版)
](/article/claude-code-tutorial)[NextChat 部署指南:
Vercel 一键部署专属 AI 助手,支持 DeepSeek 等 16+ 大模型
](/article/nextchat-deploy-guide)[Zed 编辑器体验:
号称最快的代码编辑器,到底有多强?
](/article/zed-vs-vscode)[Windows 包管理器 winget 完全指南:
告别手动下载安装软件
](/article/winget-windows-tools)[2026 年 VS Code 必备插件推荐:
让开发效率翻倍的 20 个神器
](/article/vscode-extensions-2026)