首页 > AI工具教程 > Ollama怎么用 本地运行大模型工具教程

Ollama怎么用 本地运行大模型工具教程

更新时间:2026-10-09 10:41:27 发布时间:14分钟前 阅读:2次

Ollama是一个本地运行大模型的工具,安装后用一行命令就能在电脑上运行Llama、Qwen、DeepSeek等开源模型。模型文件下载完成后,日常对话可以离线进行;首次安装和下载模型需要联网。下面从安装、运行到API调用,带你完整走一遍。

第一步:安装Ollama

先打开Ollama官网,根据电脑系统下载安装包。Windows下载后双击安装;macOS下载应用并拖到“应用程序”;Linux可以在终端执行:curl -fsSL https://ollama.com/install.sh | sh。安装结束后打开终端或命令提示符,输入ollama –version,如果显示版本号,就说明命令行工具已就绪。

如果终端提示找不到命令,先关闭并重新打开终端,再检查是否安装成功。Windows用户也可以在PowerShell运行:irm https://ollama.com/install.ps1 | iex。安装程序通常会启动后台服务;若后续提示连接不上服务,可先启动Ollama应用,再重试命令。模型运行速度主要取决于内存、显卡和模型大小。

第二步:下载和运行模型

模型需要按名称下载,初次使用要保持联网。打开终端,输入ollama run qwen2.5,Ollama会拉取该模型并进入对话界面;模型名称和版本标签可在Ollama模型库查看。下载完成后,在提示符后输入问题并回车即可聊天,输入/bye退出。下载时间和占用空间会随模型大小变化。

运行时若内存不足或回答特别慢,先退出对话,换用更小的模型版本。想确认本机已经下载哪些模型,执行ollama list;查看正在运行的模型可用ollama ps。删除不再需要的模型可以输入ollama rm 模型名称,例如ollama rm qwen2.5。删除后需要再次使用时,必须重新下载。

切换不同模型

切换模型不需要卸载Ollama:先退出当前对话,再运行另一条命令,例如ollama run llama3.2或ollama run deepseek-r1。想固定具体版本,就使用模型库展示的完整名称和标签,例如ollama run 模型名:标签。不同版本的体积、能力和硬件需求不同,选择前先看清模型页面信息。

如果只想先下载、不马上进入聊天,可以执行ollama pull 模型名称,例如ollama pull qwen2.5;稍后再用ollama run qwen2.5启动。模型文件保存在本机磁盘,建议预留足够空间。模型一旦下载完成,通常无需网络就能再次运行,但安装、更新或下载其他模型仍需要联网。

第三步:通过API调用

Ollama服务运行后,默认在本机的http://localhost:11434提供接口。可用curl测试聊天API:curl http://localhost:11434/api/chat -d ‘{“model”:”qwen2.5″,”messages”:[{“role”:”user”,”content”:”你好,请介绍一下自己”}],”stream”:false}’。把qwen2.5改成本机已有的模型名,命令会返回JSON格式的回复。

如果接口报“模型不存在”,先执行ollama list确认名称,再用ollama pull 模型名称下载。若程序需要流式输出,可调整请求参数;初次调试建议保留“stream”:false,方便一次读取完整结果。默认接口用于本机访问,除非明确配置网络访问和安全措施,不要直接暴露给公网。

不想在本机安装模型、或电脑资源有限时,也可以了解国内云端方案,例如火山引擎:volcengine.cgref.cn。需要本地运行就从安装Ollama、下载小模型开始;教程内容整理自“润灭”。

“`

标签:
微信        
微信号runmie