LM Studio
在本地下载、加载和运行大语言模型的桌面工具,提供聊天界面、本地模型管理和兼容 API 服务。
适合做什么
LM Studio 将模型搜索、下载、加载、对话和本地 API 集中到桌面界面,适合希望在个人电脑上试用 GGUF 或 MLX 模型、验证提示词、连接本地开发工具的用户。它减少了手工配置推理命令的门槛,但不会消除模型许可证、硬件容量和数据安全方面的限制。
硬件判断比安装更重要
能安装应用不代表能流畅运行任意模型。模型权重、上下文缓存和并发请求都会占用内存或显存;同一参数规模的不同量化文件占用也不同。首次使用应从较小模型开始,通过实际加载占用和生成速度判断设备上限,而不是只依据模型名称。
隐私与网络边界
模型加载后可以在本地运行,但模型搜索和首次下载仍需要网络。启动本地 API 时要确认监听地址:只供本机使用时不应暴露到局域网,更不应在没有鉴权和防火墙的情况下开放到公网。输入内容是否完全离线,还取决于所用插件、MCP 服务和外部工具。
维护记录
本页于 2026-08-06 根据当前系统要求、模型运行和本地 API 资料复核。具体安装包、运行时和模型兼容性以实际资源为准。
选择下载方式
下载前请核对资源版本和授权范围。本站不提供破解软件及未经授权的资料。
LM Studio 安装、下载模型与本地运行教程
本教程重点处理系统兼容、模型体积和内存占用三个容易出错的环节,再完成一次本地对话和 API 启动。
安装前准备
- macOS 需要 Apple Silicon 与较新的系统;Windows x64 设备需支持 AVX2,Linux 需核对架构和 AppImage 运行条件。
- 建议准备至少 16 GB 内存;较大的模型、上下文和并发会进一步增加内存或显存需求。
- 模型文件可能占用数 GB 到数十 GB,下载前确认磁盘剩余空间和网络条件。
安装步骤
- 01
选择正确平台版本
macOS 区分 Apple Silicon 支持范围,Windows 核对 x64 或 ARM 架构,Linux 核对 x64 或 ARM64;不满足 CPU 指令集要求时不要强行运行。
- 02
安装或启动应用
按平台完成安装;Linux AppImage 需要赋予执行权限并从普通用户环境启动。首次运行后先确认模型存储目录。
- 03
检查运行时与硬件识别
在应用设置中确认可用运行时、CPU、GPU 和内存信息。硬件未被正确识别时先解决驱动或运行时问题,再下载大型模型。
快速上手
- 01
搜索并选择模型
根据用途、许可证、参数规模、量化方式和上下文长度筛选模型。首次使用选择体积较小且说明完整的量化版本。
- 02
下载并加载模型
下载完成后加载模型,观察预计内存占用。若加载失败或系统频繁交换内存,改用更小模型、较低量化或更短上下文。
- 03
对话并按需启动 API
先在本地聊天界面验证生成是否正常;需要连接开发工具时,再启动本地服务并限制监听地址与访问范围。
使用建议
- 模型能加载不代表适合长上下文或多并发,逐项增加负载并观察内存峰值。
- 下载模型前阅读其许可证、用途限制和训练说明,不把本地运行等同于可以任意商用。
- 本地 API 若监听局域网地址,应配置防火墙并避免暴露到公网。
故障排查与卸载方法
模型加载到一半失败怎么办?
关闭其他占用内存的程序,降低上下文长度并改用更小或更高压缩的量化文件;同时确认模型文件下载完整。
生成速度很慢怎么办?
检查是否正确使用可用 GPU、模型是否超出显存导致频繁换页,以及上下文是否过长;小模型通常比盲目提高线程数更有效。
- 决定是否保留模型模型目录通常远大于应用本身,卸载前记录存储位置并决定是否保留供其他工具使用。
- 卸载应用与清理缓存通过系统方式移除应用;确认不再需要后,再清理模型、下载缓存和本地服务配置。
常见问题
LM Studio 安装后为什么还不能直接聊天?
应用本身不附带所有模型权重,需要先选择并下载与设备内存、显存相匹配的模型文件,再加载模型开始对话。
选择多大的模型比较合适?
先看可用内存或显存,而不是只看磁盘空间。首次使用宜从较小量化模型和较短上下文开始,确认稳定后再逐步提高规模。
下载时需要提取码吗?
夸克网盘无需提取码;百度网盘所需的四位提取码会直接显示在下载入口旁。
