Ollama本地部署教程|Ollama官网下载安装图文(附热门模型清单)

简介: Ollama 是一款免费开源的本地大模型运行工具,支持 Windows/macOS/Linux,可离线运行 Llama、Qwen、DeepSeek 等主流模型。数据不出本地,隐私安全;命令行+API 设计,适合开发者集成。模型下载快、生态丰富,是隐私敏感用户和本地 AI 开发者的首选。(239 字)

Ollama 是一款免费开源的本地大模型运行工具,通俗点说,就是让你在自己的电脑上直接跑 AI 大模型(比如 Llama、Qwen、DeepSeek)的软件。


以前想用大模型基本都得联网调用别人的服务,数据要传到云端。Ollama 把模型下载到本地,装好之后一条命令就能和 AI 对话,断网也能用,数据全程不出电脑,隐私和安全性是它核心的卖点。


和它同领域的工具还有 LM Studio、GPT4All、Jan 等,几款工具的差别主要在用法和生态上:


工具 使用方式 模型来源 是否免费开源 适合人群
Ollama 命令行 + 本地 API 模型库丰富、更新快 免费开源 开发者、想把 AI 集成进程序的用户
LM Studio 图形界面 模型库 + 手动导入 免费(部分功能付费) 习惯点鼠标操作的用户
GPT4All 图形界面 内置精选模型 免费开源 纯新手,想开箱即用
Jan 图形界面 内置 + 自定义导入 免费开源 喜欢现代简洁界面的用户


Ollama 的更新非常频繁,适配 Windows、macOS、Linux 三个平台。

下载Ollama

Ollama安装包:Ollama安装包(源自官网,放心使用)

安装Ollama

1)Windows安装

直接双击 OllamaSetup.exe 启动,点击 Install:



安装程序会自动安装到当前用户目录,不需要手动选择路径,也不需要额外配置,等待进度条走完即可:



安装完成后 Ollama 会自动启动,任务栏右下角会出现一个羊驼图标(Ollama 的 Logo),说明服务已经在后台运行了。



验证安装是否成功。按 Win + R 打开运行窗口,输入 cmd 回车打开命令提示符,输入 ollama --version 命令后回车:



看到类似 ollama version 0.33.2 的输出,就说明安装成功了。

2)macOS安装

macOS 用户双击启动 Ollama.dmg ,把 Ollama 拖入应用程序文件夹即可。启动后菜单栏会出现羊驼图标,打开终端输入 ollama --version 验证安装。

3)Linux安装

Linux 推荐使用官方安装脚本,打开终端执行以下命令:

curl -fsSL https://ollama.com/install.sh | sh

脚本会自动下载安装包并配置好系统服务,安装完成后输入 ollama --version 验证。

Ollama配置(Windows)

Ollama 默认将模型存储到 C 盘(通常为C:\Users\Administrator\.ollama\models),这对 C 盘可用容量有限的小伙伴非常不友好,我们可以手动将其修改为其它非系统盘。


修改的方法很简单,进入“Settings”界面,参照下图完成修改:


Ollama本地部署

Ollama 主要通过命令行界面进行操作。打开终端(Windows 用户可以使用 PowerShell 或 CMD),就可以开始使用 Ollama 了。

1)找到想装的模型

访问 Ollama 官网模型库:https://ollama.com/library,找到你想使用的 AI 模型,比如 deepseek:

点击 deepseek-r1,进入下图的页面,就能看到运行它的命令,是不是很简单:

2)安装模型

这里以 qwen2.5 模型为例,在 CMD 窗口执行如下命令:

ollama run qwen2.5


耐心等待模型下载完,下载过程可能需要一些时间,具体取决于模型大小和网络速度。7B模型大约需要4GB存储空间,13B模型需要8GB,70B模型则需要40GB以上:



一切准备就绪后,就可以和 AI 模型聊天了:



对于新手用户,建议先从较小的模型开始尝试,比如llama2:7b或mistral:7b。熟悉基本操作后,再根据需求尝试更大的模型或专用模型。


装完之后,就可以在主界面配置装好的模型,然后就可以畅快的对话了:


3)Ollama常用命令

平时用得最多的命令汇总如下,建议收藏备用:


命令 作用
ollama run 模型名 运行模型并对话,没下载会自动下载
ollama pull 模型名 只下载模型,不运行
ollama list 查看本机已下载的模型
ollama ps 查看正在运行的模型和内存占用
ollama stop 模型名 停止正在运行的模型,释放内存
ollama rm 模型名 删除模型,释放磁盘空间
ollama show 模型名 查看模型详细信息
ollama --version 查看 Ollama 版本

Ollama热门模型推荐

模型库里的模型非常多,新手容易挑花眼。这里按用途整理了几款热门且好用的开源模型:


模型 参数规模 特点 适合场景
Qwen2.5 / Qwen3(通义千问) 0.5B~72B 阿里开源,中文能力突出,速度快 中文对话、写作、代码,新手首选
DeepSeek-R1 1.5B~70B 推理能力强,擅长数学和逻辑 解题、编程、深度思考类任务
Llama 3.3(Meta) 8B~70B 通用均衡,开源生态最完善 通用助手、英文任务
Gemma 3(Google) 1B~27B 轻量高效,支持图像输入 低配置机器、多模态场景
Phi-4(微软) 14B 小参数强推理,省资源 配置一般又想体验强推理的用户


选择建议:电脑配置一般(16 GB 内存)先从 7B~8B 参数的中文模型(qwen2.5 或 deepseek-r1)入手;内存充足或有好显卡再尝试 14B、32B 的更大模型。参数越大智商越高,但需要的硬件也越高,不必盲目追求大模型。

Ollama新手注意事项

1)模型文件本身很大,一个模型少则几个 GB,多则几十 GB,默认存放在 C 盘用户目录下的 .ollama 文件夹里。如果 C 盘空间紧张,一定要提前修改存储路径,避免 C 盘被塞满。


2)中文场景优先选国产开源模型。Ollama 模型库里的 Qwen(通义千问)、DeepSeek 对中文的支持明显更好,Llama 等英文模型虽然也能说中文,但质量和速度都不如国产模型。


3)没有独立显卡也能跑大模型,只是慢一些。相比显卡,内存是更关键的因素:想流畅跑 7B~8B 的模型建议 16 GB 内存起步,跑更大的模型需要更多内存或高端显卡。

相关文章
|
20天前
|
人工智能 缓存 前端开发
DeepSeek Harness 首发实测 + 入门教程,夯爆了!梁神我错了
DeepSeek Harness + DeepSeek V4 Pro 项目实战保姆级教程!手把手带你从零安装开源 AI 编程工具,开发架构图、知识讲解网站、3D 网页游戏、全栈 AI 应用 4 个项目,覆盖运行模式选择、插件安装与开发,看看能不能对标 Claude。
13223 89
DeepSeek Harness 首发实测 + 入门教程,夯爆了!梁神我错了
|
8天前
|
人工智能 自然语言处理 安全
阿里云千问办公、Qoder Teams、Qoder CN区别与选择指南:模型能力、适用场景与最新活动参考
本文聚焦阿里云2026年推出的三款自研AI办公产品,清晰拆解千问办公、Qoder Teams、Qoder CN的差异化定位与能力边界:千问办公主打职场全场景提效,支持自然语言指令一键完成PPT生成、数据分析等高频办公任务;Qoder Teams面向程序员团队,深度整合AI代码生成、团队协同与企业知识库能力;Qoder CN则专为金融、政务等强合规场景打造,实现数据不出境与VPC私有化部署。文章同步给出分场景选型指南与最新活动定价,帮助不同类型的企业按需组合产品,实现业务岗、研发岗与强合规场景的AI能力全覆盖。
阿里云千问办公、Qoder Teams、Qoder CN区别与选择指南:模型能力、适用场景与最新活动参考
|
3天前
|
缓存 人工智能 API
阿里云Qwen3.8‑Flash完整能力解析:模型特性、API调用实操与计费规则深度拆解
在AI应用快速落地的当下,开发者与企业选型大模型API,不再只单纯关注评测榜单分数,推理速度、上下文长度、多模态能力、工具调用稳定性以及实际调用成本,共同决定项目能否平稳上线。Qwen3.8‑Flash作为新一代多模态混合专家模型,主打高性能推理与低成本开销,面向编程开发、智能Agent工作流、超长文档解析、图文混合理解等高频场景,提供托管API服务,权重同时开放可供本地部署,兼容主流接口协议,能够无缝接入各类开发工具链。很多开发者在接入过程中,容易混淆普通按量Token计费、缓存计费、各类订阅计划之间的差异,造成实际账单超出预估。本文从模型底层架构、核心功能能力、适用场景、API调用实操、完
790 0
|
13天前
|
Web App开发 人工智能 API
16 个超火的 DeepSeek Harness 插件,大肥鱼已经落后 N 个版本了。。。
DeepSeek Harness 精选插件推荐合集,从图片识别、浏览器操控、多 Agent 协作到手机远程控制,一口气带你看完 DSH 社区热门的十几个插件,覆盖技能扩展、UI 界面增强、整活玩法三大类,让你的鲸鱼变得更强。
1782 4
|
14天前
|
人工智能 Java BI
【AI】DeepSeek Harness 安装、运行、管理插件
本文介绍了如何运行DeepSeek开源的Agent框架DeepSeek Harness(dsh)。主要内容包括:使用nvm安装适配的Node版本;通过代理加速克隆GitHub源码;使用pnpm安装依赖并启动项目;配置DeepSeek API Token;安装扩展功能的插件。该框架自带Web界面,支持模型适配、文件编辑等插件化功能
1959 1
|
人工智能 JavaScript 开发工具
DeepSeek Harness 本地安装与使用指南
DeepSeek Harness(DSH)是DeepSeek AI开源的Agent运行框架,支持本地文件操作、命令执行与工具调用。基于Cordis插件架构,具备高扩展性与强可控性,适合开发者搭建可控Agent环境或开展模型基准测试。当前为开发者预览版,需Node.js环境,推荐先用`npx @deepseek-ai/dsh web`快速体验。
5224 0
|
9天前
|
人工智能 Linux iOS开发
Ollama使用教程:Ollama官网下载、Ollama本地部署大模型(2026最新)
Ollama 是一款免费开源的本地大模型运行工具,支持在 Windows/macOS/Linux 上离线运行 Qwen、DeepSeek、Llama 等主流开源模型,数据不出本机、隐私安全。提供 OpenAI 兼容 API,命令行一键拉取/运行/管理模型,无需联网,无调用限制,是开发者与 AI 爱好者部署本地 AI 助手的理想选择。(239 字)
|
16天前
|
人工智能 JavaScript 测试技术
保姆级教程:DeepSeek Harness从安装到跑通测试,30分钟上手
DeepSeek Harness是DeepSeek开源的AI Agent运行时,主打“一行命令安装、5分钟跑通”。它让模型真正动手干活——读代码、跑测试、分析失败、生成修复方案。本文手把手教你30分钟从零上手,覆盖安装、配置、实测及避坑指南,助你快速掌握下一代AI编程范式。
|
6天前
|
人工智能 监控 测试技术
Qwen3.8-Flash 来了,100万上下文、Agent、Coding 都加强了
8月26日,通义千问发布Qwen3.8-Flash-Next:125B参数、每Token仅激活6B,原生支持26万Token、可扩展至100万上下文;Coding、Agent与工具调用能力显著增强,面向真实软件工程任务,推动大模型从“回答问题”迈向“完成工作”。