零代码部署本地大模型:Ollama+Open WebUI可视化搭建DeepSeek开发环境 最近在尝试本地部署大模型时发现很多开发者被复杂的命令行和依赖环境劝退。特别是对于 Codex 这类工具虽然功能强大但官方渠道的访问和配置对国内用户并不友好。本文将分享一套无需编写代码、全程可视化点击操作的 Codex 国内下载、安装及接入 DeepSeek 模型的完整方案。无论你是想快速体验大模型能力的前端同学还是希望集成 AI 功能的后端开发者都能按照本文步骤在半小时内完成从零到一的搭建与调用。1. 核心概念与工具选择在开始操作之前我们有必要厘清几个关键概念这能帮助你更好地理解整个流程并在遇到问题时快速定位。1.1 什么是 CodexCodex 并非一个单一的软件它更常被指代为 OpenAI 发布的一个基于 GPT-3 的模型专门用于代码生成。然而在开源社区和实际应用中“Codex”也常被用来代指一系列开源的大模型客户端或管理工具。这类工具通常提供一个图形化界面GUI用于连接、管理和调用不同的后端大语言模型LLM例如 DeepSeek、ChatGLM、Qwen 等。本文所指的正是后者——一个能够让你通过点击界面轻松接入并管理 DeepSeek 模型的可视化客户端。1.2 为什么选择 DeepSeek 模型DeepSeek 是由深度求索公司开发的开源大语言模型系列。选择它作为接入目标主要基于以下几点考虑对国内环境友好模型权重在国内可以稳定下载无需特殊网络环境。强大的代码能力DeepSeek-Coder 等模型在代码生成、补全和解释方面表现优异非常适合开发者。丰富的规格选择提供从 1B、7B、33B 到 67B 等多种参数规模的模型可根据自身硬件条件GPU 显存灵活选择。开源与免费模型完全开源可用于研究和商业用途没有调用次数和费用的限制。1.3 整体方案架构我们的目标是在本地计算机上部署一个“客户端-模型”架构客户端Codex 工具提供用户交互界面。你在这里输入问题它负责将问题发送给模型并展示模型返回的回答。模型服务DeepSeek作为“大脑”运行在本地或局域网内的另一台服务器上。它接收客户端请求进行推理计算并返回结果。通信桥梁客户端和模型服务通过标准的 API 接口通常是 OpenAI API 兼容格式进行通信。本文将使用一个集成了模型服务启动和客户端界面的一体化工具极大简化流程真正做到“点击即用”。2. 环境准备与工具下载工欲善其事必先利其器。本节将详细介绍所需的软件环境并提供稳定的国内下载渠道。2.1 系统与硬件要求操作系统Windows 10/11 64位或 macOS 10.15或 Ubuntu 18.04 等主流 Linux 发行版。本文以 Windows 11 为例进行演示其他系统操作逻辑类似。硬件配置CPU建议 Intel i5 或 AMD Ryzen 5 及以上。内存至少 16 GB RAM。运行 7B 参数模型建议 32GB 以上以获得更好体验。显卡GPU非必须但强烈推荐。拥有 NVIDIA GPU显存至少 6GB如 RTX 3060可以极大加速模型推理。如果只有 CPU推理速度会较慢但可以运行小参数模型如 1.8B。磁盘空间至少预留 20 GB 可用空间用于存放工具和模型文件。2.2 所需工具下载我们将使用Ollama和Open WebUI的组合方案。Ollama 是一个强大的本地大模型运行和管理的命令行工具而 Open WebUI原名 Ollama WebUI则为其提供了极其优雅且功能全面的图形化界面。两者结合完美符合我们“点击操作”的需求。Ollama负责模型的拉取、加载和运行。国内下载访问 Ollama 官网通常较慢。你可以通过国内的开源镜像站或软件仓库寻找下载链接。一个可靠的方法是搜索“Ollama GitHub Release”在发布页面找到对应系统的安装包如 Windows 的.exe文件。也可以使用国内开发者提供的网盘分流请注意文件安全性。Open WebUI提供类似 ChatGPT 的 Web 界面。安装方式Open WebUI 通常通过 Docker 安装最为简便。因此你需要先安装 Docker Desktop。总结下载清单Ollama 安装包Windows 用户下载.exeDocker Desktop安装包请确保从官方或可信渠道下载这些工具。对于 DockerWindows 用户可以直接从 Docker 官网下载 Docker Desktop for Windows 安装程序。3. 基础环境安装与配置安装过程非常简单基本都是“下一步”操作。3.1 安装 Docker Desktop运行下载好的Docker Desktop Installer.exe。按照安装向导提示操作所有配置保持默认即可。安装完成后重启电脑。重启后在开始菜单找到并启动 “Docker Desktop”。首次启动需要等待一段时间系统右下角托盘出现 Docker 鲸鱼图标且状态稳定非闪烁表示启动成功。可选为了后续命令操作方便可以打开 PowerShell 或 CMD输入docker --version验证安装是否成功。3.2 安装 Ollama运行下载好的 Ollama Windows 安装程序例如OllamaSetup.exe。安装过程同样非常简单一路点击“下一步”即可完成。安装完成后Ollama 会作为后台服务自动启动。你可以在系统托盘找到一个绵羊图标。验证安装打开一个新的 PowerShell 或 CMD 窗口输入以下命令ollama --version如果显示出版本号如ollama version 0.1.xx说明安装成功。4. 拉取与运行 DeepSeek 模型这是核心步骤我们将通过几条简单的命令让 Ollama 把 DeepSeek 模型下载到本地并运行起来。4.1 通过 Ollama 拉取模型Ollama 官方库中已经收录了 DeepSeek 系列模型。我们以中等规模的deepseek-coder:6.7b模型为例它在代码能力和资源消耗之间取得了很好的平衡。打开PowerShell建议以管理员身份运行避免权限问题。输入以下命令并回车ollama pull deepseek-coder:6.7b命令解释ollama pull是拉取模型的命令deepseek-coder:6.7b是模型名称和标签。等待下载完成。这是一个需要耐心的过程因为模型文件大约有 4-5 GB。下载速度取决于你的网络环境。Ollama 会自动处理一切包括下载、验证和存储。4.2 运行模型服务模型拉取完成后需要将其运行起来作为一个本地的 API 服务。在 PowerShell 中输入以下命令ollama run deepseek-coder:6.7b首次运行会进行一些初始化之后你会看到一个交互式命令行界面类似于的提示符。这表示模型服务已经启动并且你可以在这个命令行里直接和模型对话了。你可以尝试输入一个问题例如 用Python写一个快速排序函数模型会开始生成代码。这证明你的 DeepSeek 模型已经在本地正常运行。重要提示请保持这个 PowerShell 窗口开启不要关闭。关闭窗口就意味着停止了模型服务。后续我们的 Open WebUI 需要连接这个服务。5. 部署 Open WebUI 图形化界面虽然命令行可以交互但我们的目标是“点击操作”。Open WebUI 提供了完美的 Web 界面。5.1 使用 Docker 一键部署 Open WebUI这是最推荐的方式无需关心 Python 依赖等问题。确保 Docker Desktop 正在运行系统托盘鲸鱼图标稳定。打开一个新的 PowerShell 或 CMD 窗口。输入以下 Docker 命令并回车docker run -d -p 3000:8080 --add-hosthost.docker.internal:host-gateway -v open-webui:/app/backend/data --name open-webui ghcr.io/open-webui/open-webui:main命令参数解释-d后台运行容器。-p 3000:8080将本机的 3000 端口映射到容器的 8080 端口Open WebUI 的服务端口。--add-hosthost.docker.internal:host-gateway这是一个关键配置让容器内的服务能够访问到主机host上运行的 Ollama 服务。-v open-webui:/app/backend/data将容器内的数据目录挂载到本地的 Docker 卷open-webui这样你的聊天记录、设置等数据在容器重启后不会丢失。--name open-webui给容器起一个名字方便管理。ghcr.io/open-webui/open-webui:main使用的 Open WebUI 镜像。命令执行后Docker 会开始拉取 Open WebUI 镜像并创建容器。首次运行需要下载镜像稍等片刻。5.2 访问与配置 Open WebUI打开你的浏览器Chrome, Edge, Firefox 等。在地址栏输入http://localhost:3000首次访问会进入注册页面。创建一个管理员账号只需输入用户名和密码邮箱可选。登录后点击界面左下角的设置齿轮图标。在设置侧边栏中找到“连接器”或“模型设置”相关选项。你需要添加 Ollama 作为后端。找到类似“Ollama API Base URL”的输入框。输入http://host.docker.internal:11434host.docker.internal是 Docker 容器访问宿主机的特殊域名。11434是 Ollama 服务的默认端口。点击“保存”或“测试连接”。如果配置正确页面上方或设置页面通常会提示连接成功。6. 在 Open WebUI 中调用 DeepSeek 模型所有配置完成后就可以享受图形化操作的便利了。6.1 选择模型并开始对话回到 Open WebUI 主界面聊天界面。在界面顶部或侧边栏通常会有一个模型选择下拉框。点击它。如果前面的连接配置正确下拉框中应该能自动列出你本地 Ollama 已经拉取并运行的模型其中就包括deepseek-coder:6.7b。选择deepseek-coder:6.7b。现在你可以在下方的输入框中用自然语言提问了例如“帮我写一个 Python 函数计算斐波那契数列。”“解释一下 JavaScript 中的闭包概念。”“我有一段 Java 代码报空指针异常帮我分析一下。”点击发送模型就会在界面中流式输出回答。你可以进行多轮对话界面会保存聊天历史。6.2 界面功能体验Open WebUI 提供了丰富功能新建/切换对话可以创建不同主题的对话互不干扰。聊天历史左侧边栏保存所有历史对话随时可回溯。模型参数调整在输入框附近或设置中可以调整“温度”控制创造性、“最大生成长度”等高级参数。代码高亮模型返回的代码块会自动高亮显示可复制。Markdown 渲染回答中的标题、列表、链接等会以美观的格式渲染。7. 常见问题与排查思路即使按照教程操作也可能遇到一些问题。以下是常见问题的排查方法。问题现象可能原因解决思路访问http://localhost:3000失败Docker 容器未成功启动端口被占用。1. 在 PowerShell 运行docker ps查看open-webui容器状态是否为Up。2. 运行docker logs open-webui查看容器日志。3. 尝试更换端口如将命令中的-p 3000:8080改为-p 8080:8080然后访问http://localhost:8080。Open WebUI 中无法列出模型或连接失败Ollama 服务未运行Open WebUI 连接配置错误。1. 检查运行ollama run的 PowerShell 窗口是否仍在运行。2. 在浏览器中直接访问http://localhost:11434如果 Ollama 服务正常会返回一个简单的 JSON 信息。3.重点检查Open WebUI 设置中的 “Ollama API Base URL” 是否为http://host.docker.internal:11434。ollama pull下载模型速度极慢网络连接到 Ollama 官方服务器不畅。1.配置镜像加速这是最有效的办法。在 PowerShell 中设置环境变量$env:OLLAMA_HOST”127.0.0.1:11435”(临时)更持久的方法是创建或修改C:\Users\你的用户名\.ollama\config.json文件加入{ “host”: “127.0.0.1:11435” }然后重启 Ollama 服务。请注意11435是一个示例需替换为可用的镜像端口具体镜像地址需自行搜索可靠的国内源。模型回答速度非常慢CPU模式使用 CPU 进行推理计算能力有限。1. 这是预期行为。考虑拉取更小的模型如deepseek-coder:1.3b。2. 如果拥有 NVIDIA GPU确保已安装正确的 CUDA 驱动。Ollama 会自动检测并使用 GPU。运行ollama run时观察输出看是否有Using GPU的提示。Docker 命令执行报错Docker Desktop 未运行命令语法错误镜像拉取失败。1. 确认 Docker Desktop 已启动托盘图标稳定。2. 仔细核对命令特别是标点符号和空格。3. 尝试运行docker --version确认 Docker 命令行可用。4. 检查网络或尝试重启 Docker Desktop。8. 最佳实践与进阶建议完成基础搭建后以下几点建议能让你的本地大模型体验更佳。8.1 模型管理探索更多模型Ollama 支持众多模型。运行ollama list查看已下载的模型。运行ollama pull model-name尝试其他模型如llama3.2:3b通用对话、qwen2.5:7b通义千问等。释放显存/内存当你切换模型或暂时不用时可以在运行ollama run的窗口中按CtrlC中断当前模型然后运行新的ollama run命令。也可以直接关闭窗口需要时再重新运行。8.2 系统优化GPU 加速如果你有 NVIDIA GPU 但 Ollama 未使用请确保安装了最新版的 NVIDIA 显卡驱动。Ollama 对 CUDA 支持良好通常能自动识别。后台服务化Windows不希望一直开着 PowerShell 窗口可以将 Ollama 设置为系统服务。以管理员身份打开 PowerShell运行ollama serve这个命令会在后台启动服务。然后你可以关闭窗口Ollama 仍在运行。通过ollama list等命令依然可以管理模型。8.3 Open WebUI 进阶使用用户管理在 Open WebUI 的设置中可以创建多个用户账号分配给不同的团队成员使用。对话导出重要的对话可以导出为 Markdown 或 PDF 文件保存。自定义模型Open WebUI 也支持连接其他兼容 OpenAI API 的模型服务只需在设置中配置对应的 API Base URL 和 API Key。8.4 安全与隐私本地部署的最大优势所有对话数据、模型权重都留在你的本地机器上没有任何数据上传风险非常适合处理敏感或私有代码。网络隔离如果你在公司内网使用确保该服务localhost:3000不会被外部网络直接访问。如需在内网分享请评估网络安全策略。通过以上步骤你已经成功搭建了一个完全本地化、可视化操作的 DeepSeek 代码大模型环境。这套组合Ollama Open WebUI是目前社区中最受欢迎、最易用的方案之一它屏蔽了底层复杂的部署细节让开发者能专注于与大模型交互本身。接下来你可以尝试用它来辅助日常的代码编写、调试、学习新技术甚至集成到你的 IDE如 VS Code 通过插件调用本地 Ollama API中进一步提升开发效率。