LM
SOFTWARE

LM Studio

在本地下载、加载和运行大语言模型的桌面工具,提供聊天界面、本地模型管理和兼容 API 服务。

WindowsmacOSLinux专有软件,具体以发行方许可条款为准

适合做什么

LM Studio 将模型搜索、下载、加载、对话和本地 API 集中到桌面界面,适合希望在个人电脑上试用 GGUF 或 MLX 模型、验证提示词、连接本地开发工具的用户。它减少了手工配置推理命令的门槛,但不会消除模型许可证、硬件容量和数据安全方面的限制。

硬件判断比安装更重要

能安装应用不代表能流畅运行任意模型。模型权重、上下文缓存和并发请求都会占用内存或显存;同一参数规模的不同量化文件占用也不同。首次使用应从较小模型开始,通过实际加载占用和生成速度判断设备上限,而不是只依据模型名称。

隐私与网络边界

模型加载后可以在本地运行,但模型搜索和首次下载仍需要网络。启动本地 API 时要确认监听地址:只供本机使用时不应暴露到局域网,更不应在没有鉴权和防火墙的情况下开放到公网。输入内容是否完全离线,还取决于所用插件、MCP 服务和外部工具。

维护记录

本页于 2026-08-06 根据当前系统要求、模型运行和本地 API 资料复核。具体安装包、运行时和模型兼容性以实际资源为准。

DOWNLOAD

选择下载方式

链接最近检查:2026-08-06

下载前请核对资源版本和授权范围。本站不提供破解软件及未经授权的资料。

GUIDE

LM Studio 安装、下载模型与本地运行教程

本教程重点处理系统兼容、模型体积和内存占用三个容易出错的环节,再完成一次本地对话和 API 启动。

安装前准备

  • macOS 需要 Apple Silicon 与较新的系统;Windows x64 设备需支持 AVX2,Linux 需核对架构和 AppImage 运行条件。
  • 建议准备至少 16 GB 内存;较大的模型、上下文和并发会进一步增加内存或显存需求。
  • 模型文件可能占用数 GB 到数十 GB,下载前确认磁盘剩余空间和网络条件。
01

安装步骤

  1. 01

    选择正确平台版本

    macOS 区分 Apple Silicon 支持范围,Windows 核对 x64 或 ARM 架构,Linux 核对 x64 或 ARM64;不满足 CPU 指令集要求时不要强行运行。

  2. 02

    安装或启动应用

    按平台完成安装;Linux AppImage 需要赋予执行权限并从普通用户环境启动。首次运行后先确认模型存储目录。

  3. 03

    检查运行时与硬件识别

    在应用设置中确认可用运行时、CPU、GPU 和内存信息。硬件未被正确识别时先解决驱动或运行时问题,再下载大型模型。

02

快速上手

  1. 01

    搜索并选择模型

    根据用途、许可证、参数规模、量化方式和上下文长度筛选模型。首次使用选择体积较小且说明完整的量化版本。

  2. 02

    下载并加载模型

    下载完成后加载模型,观察预计内存占用。若加载失败或系统频繁交换内存,改用更小模型、较低量化或更短上下文。

  3. 03

    对话并按需启动 API

    先在本地聊天界面验证生成是否正常;需要连接开发工具时,再启动本地服务并限制监听地址与访问范围。

使用建议

  • 模型能加载不代表适合长上下文或多并发,逐项增加负载并观察内存峰值。
  • 下载模型前阅读其许可证、用途限制和训练说明,不把本地运行等同于可以任意商用。
  • 本地 API 若监听局域网地址,应配置防火墙并避免暴露到公网。
故障排查与卸载方法

模型加载到一半失败怎么办?

关闭其他占用内存的程序,降低上下文长度并改用更小或更高压缩的量化文件;同时确认模型文件下载完整。

生成速度很慢怎么办?

检查是否正确使用可用 GPU、模型是否超出显存导致频繁换页,以及上下文是否过长;小模型通常比盲目提高线程数更有效。

  1. 决定是否保留模型模型目录通常远大于应用本身,卸载前记录存储位置并决定是否保留供其他工具使用。
  2. 卸载应用与清理缓存通过系统方式移除应用;确认不再需要后,再清理模型、下载缓存和本地服务配置。
FAQ

常见问题

LM Studio 安装后为什么还不能直接聊天?

应用本身不附带所有模型权重,需要先选择并下载与设备内存、显存相匹配的模型文件,再加载模型开始对话。

选择多大的模型比较合适?

先看可用内存或显存,而不是只看磁盘空间。首次使用宜从较小量化模型和较短上下文开始,确认稳定后再逐步提高规模。

下载时需要提取码吗?

夸克网盘无需提取码;百度网盘所需的四位提取码会直接显示在下载入口旁。