
一、部署架构Windows11 Ollama Qwen3.5:4B二、windows电脑配置Ollama是一个开源的本地大模型运行框架对硬件门槛很低仅要求Windows 10/11 64 位系统内存≥8GB支持 AVX 指令集11 代酷睿全部支持本次实践的笔记本电脑配置如下CPU11 代英特尔 i5-1135G7 4 核 8 线程内存16GB可用 15.8GB核显Iris Xe Graphics128MB 显存共享内存核显系统Win11 25H2电脑配置越高可以通过Ollama部署的大模型就越大。根据本电脑的硬件配置适合部署4B40亿个参数及以下的大模型7B及以上的大模型就不适合本电脑内存不够。三、基于Ollama部署大模型步骤基于Ollama部署大模型步骤如下安装Ollama、进入window终端CMD/PowerShell、Ollama拉取大模型、Ollama启动大模型、大模型对话交互。3.1安装Ollama打开官网OllamaOllama is the easiest way to automate your work using open models, while keeping your data safe.https://ollama.com/点击Download、Download for Windows下载安装包如图1、图2所示。双击安装包一路默认下一步自动完成安装安装完成后电脑开始菜单会出现「Ollama」同时后台自动启动 Ollama 服务无需手动启动图1. Ollama官网图2. 点击“Download for Windows”开始下载3.2 进入window终端CMD/PowerShell通过cmd命令进入windows终端或者打开Powershell终端。快捷键Win R输入cmd回车打开命令提示符或者右键开始菜单选择“Windows 终端 (管理员)”图3. 点击“命令提示符”进入CMD终端3.3 Ollama拉取大模型在cmd终端执行Ollama命令拉取大模型。ollama pull qwen3.5:4b图4. 拉取大模型3.4 Ollama启动大模型拉取大模型后可以继续通过命令查看已经部署好的大模型、启动大模型。查看本地已经拉取部署好的大模型ollama list启动一个大模型ollama run qwen3.5:4b图5. 查看本地部署的大模型3.5 大模型对话交互上一步通过命令ollam run qwen3.5:4b启动大模型后就会出现下图所示的大模型对话交互界面。首先cmd终端会提示“Send a message”。然后你输入想问的问题就能得到答案。大模型先给出思考过程再逐步给出问题的答案。图6. cmd终端对话大模型四、大模型交互升级如果希望通过可视化的界面与大模型交互可以安装open-webui工具。在cmd终端运行下面代码后电脑右下角工具栏出现ollama图标如图7所示。点击“Open Ollama”就可以进入Ollama的可视化交互界面如图8所示。ollama run open-webui图7. 电脑右下角工具栏出现ollama图标点击“New Chat”就可以进入聊天界面。跟上面终端交互类似已经提示了“Send a message”。用户输入问题大模型就会逐步返回思考过程、答案。图8. Ollama可视化交互界面大模型名字右侧有云朵、下载标志就意味着这些模型未部署在本地可以云端调用。大模型qwen3.5:4b右侧没有任何标识意味着已经本地化部署好了可直接免费、安全的使用。图9. 显示本地部署的大模型qwen3.5:4bLaunch就可以进入其他工具部署界面。比如想继续部署智能体Claude Code、OpenClaw、Codex可以复制命令比如ollama launch claude然后进入windows的CMD中执行命令安装对应的智能体工具。ollama launch claude图10. Launch板块的内容五、Ollama常用命令小结查看版本与帮助ollama --version ollama -h ollama run -h # 看run命令专属参数大模型下载与管理# 拉取下载模型 ollama pull qwen3.5:4b # 查看本地已经下载全部模型 ollama list # 简写ollama ls # 查看模型详情参数、模板、系统提示词 ollama show qwen3.5:4b # 删除本地模型释放磁盘空间 ollama rm qwen3.5:4b # 复制模型做自定义模型副本 ollama cp qwen3.5:4b my-qwen # 推送模型到远程仓库个人很少用 ollama push my-qwen模型运行、对话、停止# 启动模型进入终端交互式聊天 ollama run qwen3.5:4b # 查看当前正在内存中运行的模型 ollama ps # 停止正在运行的模型释放内存/显存 ollama stop qwen3.5:4blaunch 启动智能体套件ollama launch ollama launch claude --model qwen3.5:4b大模型运行控制# 低温度适合标书问答、事实类任务 ollama run qwen3.5:4b --temperature 0.1 # 扩大上下文窗口可以读更长标书文档 ollama run qwen3.5:4b --ctx-size 8192 # --verbose 输出详细日志排查速度、内存问题 ollama run qwen3.5:4b --verbose自定义模型Modelfile微调后打包进 ollama 用这个# 根据Modelfile创建自定义模型 ollama create bid-qwen -f ModelfileModelfile示例FROM qwen3.5:4b PARAMETER temperature 0.2 PARAMETER num_ctx 8192 SYSTEM 你是投标标书问答专家严格依据标书内容回答