OL
软件

Ollama

Ollama 0.32.5 是本地模型运行服务,提供命令行、HTTP API 和模型管理能力,适合在个人电脑或服务器上运行受支持的语言与多模态模型。

版本 0.32.5Windows x64macOSLinux x64MIT 核心;模型与运行时组件各自许可

适合做什么

Ollama 适合把本地模型作为一个可复用的运行服务,供命令行、桌面客户端或自建 Web 界面调用。它不是完整的知识库或团队管理后台;文档检索、账号权限、审计和多用户隔离需要由上层应用补齐。

0.32.5 与资源边界

本页归档 Ollama 0.32.5 的 Windows x64、macOS 与 Linux x64 资源。模型本身需要单独下载并占用大量磁盘,量化规格会影响质量、速度和内存。应用核心许可不替代模型或运行时组件的许可,部署前应保留完整版本与条款记录。

API 监听与数据路径

本地服务默认适合在受控环境中使用。改变监听地址、容器端口或反向代理后,API 请求可能被其他设备访问,应同时配置网络隔离、访问控制、日志脱敏和备份。模型、提示词和生成日志的落盘位置也应在部署前确认。

本地模型的部署顺序

先选择与显存、内存和磁盘预算匹配的模型规格,再在本机用短提示验证拉取、加载、响应、停止和缓存路径。确认服务只监听预期接口后,逐步接入桌面客户端或 Web 界面;模型、提示词、量化版本和运行参数单独记录,方便比较速度与质量。

API 与数据留存检查

接入前明确调用方、端口、身份校验、超时和并发限制,默认只在受控网络中开放。测试日志脱敏后再保存,定期检查模型目录、提示词、生成结果和缓存的磁盘增长;升级或更换模型前保留旧版本清单与回滚路径,避免服务恢复时丢失配置。

维护记录

本页于 2026-08-23 根据 Ollama 0.32.5 三平台资源、模型管理、命令行与 HTTP API、服务监听和模型许可边界复核。

SAVE TO CLOUD

保存到自己的网盘

打开网盘后可直接获取,也可以先保存到自己的网盘,方便换设备继续使用。

链接最近检查:2026-08-06
先保存,再按需获取电脑端使用对应网盘 APP 扫码;手机端直接点击保存按钮。
使用指南

Ollama 0.32.5 安装、模型运行与 HTTP API 教程

先在本机运行一个小型模型并完成一次 API 调用,再考虑改变监听地址、接入 Web 客户端或部署到服务器。

安装前准备

  • 核对 Windows x64、macOS 或 Linux x64 安装包,并为模型、缓存和日志预留空间。
  • 准备非敏感测试提示词和可删除的模型,生产密钥与客户资料不要直接放入首次测试。
  • 如果准备供其他设备访问,先确定网络范围、认证方式、反向代理和备份策略。
01

安装步骤

  1. 01

    安装 0.32.5

    Windows 解压 x64 ZIP,macOS 安装 DMG,Linux 解压对应 TAR.ZST 并按系统方式启动服务;安装后先核对 ollama --version。

  2. 02

    检查服务状态

    确认本机服务已经启动,并在本地终端执行模型列表或帮助命令;先保持默认本地监听,不急于改端口或绑定全部网卡。

  3. 03

    拉取一个测试模型

    选择与硬件匹配的模型和量化版本,等待下载完成后记录名称、大小和许可;模型来源与应用许可要分开保存。

02

快速上手

  1. 01

    完成一次本地对话

    使用 ollama run 运行测试模型,记录首字延迟、生成速度、上下文和内存占用,结束后确认服务能正常退出或复用。

  2. 02

    调用本机 HTTP API

    从本机脚本发起最小请求,检查响应格式、模型名称和错误处理;请求中使用虚构内容,不把密钥或个人资料写入日志。

  3. 03

    再接入其他客户端

    客户端连接前先固定模型名和 API 地址,在同一台机器上验证成功后再开放局域网访问;每扩大一次范围都重新检查认证与防火墙。

使用建议

  • 模型推理速度与量化、上下文、内存、CPU/GPU 和并发请求有关,单次测试结果不代表所有模型。
  • Ollama 服务接口的访问边界取决于监听地址、容器映射和代理配置,API 端口不应当作天然的身份验证层。
  • 模型文件可能包含不同许可和使用限制,尤其是商业、再分发和训练数据相关条款,需要单独记录。
故障排查与卸载方法

运行模型时内存不足怎么办?

先减少并发和上下文,选择更小或更低量化的模型,检查后台进程与缓存;不要在未确认磁盘空间的情况下反复拉取多个版本。

局域网客户端连接不上怎么办?

从监听地址、端口映射、防火墙和代理逐层检查,先用本机请求确认服务状态;开放局域网前配置访问控制并保留回滚设置。

  1. 记录模型和服务配置保存需要保留的模型清单、API 客户端配置和自定义服务参数;撤销外部客户端中不再使用的访问权限。
  2. 停止服务并清理数据停止 Ollama 服务后按需删除应用、模型和缓存目录,确认没有客户端依赖或备份任务仍指向这些路径。
常见问题

常见问题

Ollama 是聊天界面还是模型服务?

它的核心是本地模型运行服务和命令行工具,也提供便于使用的交互入口。需要知识库、团队账号或完整 Web 工作区时,通常还要搭配其他客户端。

Ollama 的 API 会暴露到公网吗?

默认应按本机或受控局域网服务处理。修改监听地址、反向代理或容器端口前,应先配置访问控制、网络隔离和日志策略,避免把未认证接口直接暴露。

模型下载后占用空间很大怎么办?

模型文件、层缓存和不同量化版本会分别占用磁盘。先查看模型清单和目录,再删除确认不再使用的版本,保留正在运行的模型与配置记录。

下载时需要提取码吗?

夸克网盘无需提取码;百度网盘所需的四位提取码会直接显示在下载入口旁。