Содержание
- Что такое LM Studio и что она умеет
- Бесплатна ли LM Studio: лицензия и условия
- Как скачать и установить на Windows, macOS и Linux
- Системные требования: ОЗУ, VRAM, процессор, диск
- Как скачать и подключить модели
- Какие бесплатные модели запускать
- Настройки инференса без платных функций
- Платные версии, подписки и ограничения
- Локальный сервер и OpenAI-совместимый API
- Бесплатные аналоги и альтернативы
- Как обновлять и получать беты
- Типичные ошибки и их решение
- Частые вопросы
LM Studio бесплатно: запуск LLM на своём ПК
Черновик готовит редакция с помощью ИИ. За стандарт издания отвечает главный редактор — Валерий Курземнек.
Материал редакции Зерокодера. Счёт по выдаче снят собственным прогоном 7 октября 2026 года; цитаты источников приведены дословно. Обновлено: октябрь 2026.
LM Studio бесплатно запускает языковые модели прямо на вашем компьютере: приложение с графическим интерфейсом ищет, скачивает и запускает открытые LLM, а переписка остаётся на устройстве. С июля 2025 года приложение разрешено бесплатно использовать и дома, и для внутренних рабочих задач. Ниже — установка, требования к железу, подбор моделей, настройки и типичные ошибки. Мы скачали топ-10 Яндекса по запросу «lm studio бесплатно»: текст отдали 10 из 10.
Что такое LM Studio и что она умеет
Возможности к 2026 году заметно расширились. В том же обзоре перечислено: режим работы с документами, локальный API-сервер, OpenAI-совместимые и Anthropic-совместимые endpoint’ы, CLI и headless-режим. Отдельно упомянут запуск нескольких моделей и подключение к сторонним приложениям.
Практическая ценность — приватность. В материале на iPhones.ru сказано: в LM Studio все действия, переписки и прочие данные хранятся только на устройстве пользователя. Там же отмечено, что это будет на 100% ваш собственный ИИ-помощник, за который не придётся платить.
Поиск и скачивание моделей в LM Studio требуют сети. В обзоре на Yudaev School уточнено, что приложение может работать офлайн после загрузки весов модели на компьютер.
Бесплатна ли LM Studio: лицензия и условия
Приложение бесплатное. В обзоре на Yudaev School прямо указано: с июля 2025 года приложение разрешено бесплатно использовать и дома, и для внутренних рабочих задач. Это снимает главный вопрос про коммерческое применение внутри компании.
В подборке на iPhones.ru LM Studio описана как бесплатное приложение, которое запускает нейросетевые чат-боты прямо на вашем компьютере. Там же подчёркнуто: платить не придётся, в отличие от ChatGPT и многих онлайн-нейросетей.
Отдельная тема — страницы-двойники. В выдаче по запросу встречается сайт lmstudio-official.com с заголовком про тарифы и бесплатный доступ, где упоминается оплата картой РФ. Это сторонний ресурс. Скачивать приложение стоит с lmstudio.ai.
| Вопрос | Ответ по источникам |
|---|---|
| Цена приложения | Бесплатно |
| Личное использование | Разрешено |
| Внутренние рабочие задачи | Разрешено с июля 2025 года |
| Поиск и скачивание моделей | Требуют интернета |
В обзоре на Yudaev School уточнено, что LM Studio может работать офлайн после загрузки весов модели на компьютер.
Как скачать и установить на Windows, macOS и Linux
Установка занимает несколько минут. В инструкции на Skillbox Media порядок такой: перейдите на сайт lmstudio.ai и нажмите на кнопку Download. Дальше выбираете сборку под свою систему и запускаете установщик.
Платформы перечислены на странице lm-studio.me: Apple Silicon Mac (M1/M2/M3) с macOS 13.6 или выше; ПК с Windows / Linux с процессором, поддерживающим AVX2 (обычно это более новые ПК). Для ARM и систем без GPU на Хабре упомянуты отдельные сборки моделей.
Вес установщика стоит учесть заранее. В подборке на thecode.media указано: установщик весит более 500 мб, LM Studio может потреблять много ресурсов из-за графического интерфейса. Для сравнения, там же сказано, что установщик Ollama весит 1.8 ГБ.
Порядок действий:
- Скачайте сборку с lmstudio.ai под свою ОС.
- Установите и запустите приложение.
- Откройте вкладку поиска моделей.
- Введите название модели в строке поиска.
- Скачайте подходящий квант и загрузите модель в чат.
Системные требования: ОЗУ, VRAM, процессор, диск
Ориентиры в источниках различаются. На странице lm-studio.me рекомендуют 16 ГБ или более оперативной памяти и 6 ГБ или более видеопамяти для ПК. В обзоре на Yudaev School для LM Studio приведены рекомендации 16 ГБ RAM и не менее 4 ГБ выделенной VRAM на Windows; там же уточнено, что приложение может работать без дискретной видеокарты.
Диск считается по конкретной модели. В инструкции на Skillbox Media для Qwen3 4B Thinking 2507 указано: понадобится 4 ГБ оперативной памяти и 3 ГБ места на диске. В примере первого запуска на Хабре скачивают сборку Gemma 3 объёмом 6–8 ГБ. В обзоре на vc.ru диапазон от 2,5 до 17 ГБ относится к разным версиям Qwen 3.
| Железо | Пример запуска | Ориентир по источникам |
|---|---|---|
| ОЗУ | Простейший чатбот на Mac M1 с 8 ГБ | Рекомендуют 16 ГБ и выше |
| VRAM | Возможен запуск без дискретной видеокарты | На Windows рекомендуют 4 ГБ; lm-studio.me приводит 6 ГБ для ПК |
| Процессор | AVX2 для x64 Windows | На macOS поддерживается Apple Silicon |
| Диск | Qwen3 4B Thinking 2507: 3 ГБ | Версии Qwen 3 в обзоре vc.ru: от 2,5 до 17 ГБ |
Это примеры и рекомендации из источников; требование к памяти и размер файла проверяйте для выбранной сборки модели.
Как скачать и подключить модели
В LM Studio два пути загрузки моделей. На Хабре описаны собственный маркетплейс приложения и внешние сайты, включая Hugging Face. Для первого пути откройте Discover и введите название модели: в инструкции Skillbox Media показан пример Qwen3-4b-thinking-2507. Для второго пути скопируйте адрес выбранной LLM-модели на Hugging Face и вставьте его в строку поиска загрузчика LM Studio — такой способ приведён на iPhones.ru.
В обзоре на Yudaev School сказано: 4-bit и другие квантованные версии уменьшают объём памяти, который требуется модели, ценой некоторой потери качества. Там же приведено правило выбора: не выбирайте 13B-модель для 8 ГБ RAM только потому, что она есть в каталоге — ориентируйтесь на реальное требование к памяти.
Промпт, чтобы модель сама помогла подобрать квант под ваше железо:
Ты помогаешь выбрать локальную LLM для LM Studio. Моё железо: [ОЗУ], [VRAM], [процессор]. Задача: [ваша задача]. Предложи три модели из каталога LM Studio, для каждой укажи число параметров, подходящий квант (Q4_K_M, Q5_K_M или иной), примерный объём файла и ожидаемую скорость. Отдельно предупреди, если модель не поместится в память.
Вариации той же задачи: подбор модели под кодинг; подбор под русскоязычные тексты; подбор под анализ документов; подбор под слабый ноутбук без дискретной видеокарты; подбор под длинный контекст.
Какие бесплатные модели запускать
Выбор зависит от задачи. На Хабре приведена логика: Mistral для скорости, LLaMA3 для качества ответов, DeepSeek-Coder или CodeGemma — как ассистент для кодинга. Там же сказано: золотой серединой для обычного потребительского железа с GPU можно считать 16–22b.
В обзоре на vc.ru отмечено: Gemma 3 превосходит o3-mini в программировании, как заявляют разработчики, но она не отображает свои «мысли» и часто переходит на английский язык. Про DeepSeek там же сказано: самой DeepSeek V 3.2 официально в LM Studio нет.
| Модель | Размер | Под что |
|---|---|---|
| Qwen3 4B Thinking | 4 ГБ ОЗУ, 3 ГБ диска | Повседневные задачи, рассуждения |
| gpt-oss-20b | 16 ГБ ОЗУ | Стиль ответов ChatGPT |
| qwen2.5-coder-14b | 8–12 ГБ VRAM, 16 ГБ ОЗУ | Код и техдокументация |
| gemma-3-12b | около 32 ГБ ОЗУ | Текст, код, изображения |
| phi-4-mini-reasoning | 16 ГБ ОЗУ | Компактные рассуждения |
Настройки инференса без платных функций
Все ключевые параметры доступны в бесплатной версии. Temperature отвечает за «творческость» модели: при низком значении (0.2–0.5) ответы будут точными, лаконичными и почти шаблонными — хорошо подойдёт для техподдержки или кратких инструкций; при высоком (0.8–1.2) модель начинает «фантазировать» — чаще выбирает менее вероятные слова, создавая более живые, нестандартные и креативные тексты.
Max Tokens прямо ограничивает длину ответа. На Хабре приведён приём: если модель «разгоняется» и пишет больше, чем надо — выставляем лимит, например, 200 или 512 токенов. Это экономит время на слабом железе.
GPU offload определяет, сколько слоёв уходит на видеокарту. Проверить фактическое распределение можно по загрузке: в Ollama в терминале можно выполнить ollama ps и посмотреть колонку PROCESSOR, если там 100% CPU, модель работает через оперативную память и процессор. Логика та же: если ответы идут медленно, часть слоёв осталась на CPU.
Контекст влияет на память сильнее, чем кажется. В подборке на thecode.media сравнение: если вы запускаете нейросеть на 8 млрд параметров с контекстным окном в 8 тыс. токенов, то будет одна нагрузка на систему, если решите запустить ИИ на 20 млрд параметров с контекстным окном в 200 тыс. — совсем другая.
Промпт для системной настройки под конкретную роль:
Ты — [роль: технический писатель / ревьюер кода / редактор]. Отвечай на русском языке. Держи ответ в пределах [N] предложений. Если данных не хватает, задай один уточняющий вопрос вместо догадки. Не выдумывай факты, даты и числа. Формат вывода: [список / абзац / таблица].
Вариации: системный промпт для техподдержки; для генерации описаний товаров; для ревью кода; для перевода; для конспектирования документов.
Платные версии, подписки и ограничения
Платных версий самого приложения в источниках нет. В обзоре на Yudaev School зафиксировано: с июля 2025 года приложение разрешено бесплатно использовать и дома, и для внутренних рабочих задач. В подборке на iPhones.ru LM Studio названа бесплатным приложением.
Ограничения носят технический характер. В подборке на thecode.media отмечено, что LM Studio может потреблять много ресурсов из-за графического интерфейса. В обзоре на Yudaev School для LM Studio уточнено: поиск и скачивание моделей требуют интернета; офлайн-работа начинается после загрузки весов на компьютер.
Есть и содержательные ограничения моделей. В инструкции на Skillbox Media отмечено: у Qwen 3 нет доступа к веб-поиску, поэтому она способна выдумывать события и искажать информацию. Там же приведён пример про DeepSeek, который аккуратно обходит вопросы о Тайване и событиях на площади Тяньаньмэнь в 1989 году.
Отдельно про ресурсы. В том же материале сказано: для работы с моделями на 70 миллиардов параметров вам нужно не менее 64 ГБ оперативной памяти и видеокарта с большим объёмом VRAM; даже 32 ГБ ОЗУ может быть недостаточно для локального запуска нейросетей уровня ChatGPT — такие модели будут тормозить или вообще не запустятся.
Локальный сервер и OpenAI-совместимый API
Локальный API-сервер входит в бесплатный набор. В обзоре на Yudaev School перечислены OpenAI-совместимые и Anthropic-совместимые endpoint’ы, CLI и headless-режим.
Практический пример есть в обзоре на vc.ru. Чтобы связать LM Studio и Telegram, в скрипт с настройкой бота нужно добавить ссылку на сервер (например, http://10.0.85.2:1234) и токен бота. Бота создают в @BotFather, там же система присылает уникальный токен. В том же материале описан кейс: попробовали сделать Telegram-бота на базе Gemma 3, который генерирует описание товаров для карточек на маркетплейсах.
Порядок подключения:
- Загрузите модель в LM Studio.
- Включите локальный сервер в интерфейсе.
- Скопируйте адрес с портом.
- Пропишите адрес и токен в скрипте бота или клиента.
- Отправьте тестовый запрос.
Промпт для проверки связки через API:
Ты — ассистент, подключённый к локальному серверу LM Studio. Ответь одним абзацем на запрос: [ваш запрос]. Если соединение работает, добавь строку «сервер отвечает». Если запрос непонятен, попроси уточнение.
Вариации: проверка OpenAI-совместимого endpoint’а; проверка потоковой выдачи; проверка длинного контекста; проверка русского языка; проверка JSON-вывода.
Бесплатные аналоги и альтернативы
Сравнение полезно, когда LM Studio не подходит по железу или сценарию. В обзоре на Yudaev School перечислены: LM Studio, Ollama, GPT4All, KoboldCpp, ComfyUI, AUTOMATIC1111 и LocalAI — это прежде всего приложения, интерфейсы или среды запуска.
Ollama в 2026 году сочетает desktop-приложение, CLI и локальный API; активно развивает поддержку GGUF и MLX, GPU-ускорение, локальные coding-agent сценарии и интеграции. Старое описание «только терминал и без GUI» уже неверно: с 2025 года у Ollama есть приложение для macOS и Windows с загрузкой моделей, чатами и работой с файлами.
| Инструмент | Интерфейс | Кому |
|---|---|---|
| LM Studio | Графический | Новичкам, старт за минуты |
| Ollama | GUI, CLI, API | Разработке и интеграциям |
| GPT4All | Графический | Чату с документами |
| Jan AI | Графический | Новичкам для локального чата |
| llama.cpp | Библиотека | Разработчикам |
В подборке thecode.media Jan AI описан как приложение с низким порогом входа, подходящее новичкам.
Как обновлять и получать беты
На официальной странице загрузки lmstudio.ai/download перечислены разделы Download LM Studio, Install llmster и Beta and Experimental Releases. В разделе Beta and Experimental Releases указан отдельный адрес страницы бета-сборок.
Порядок обновления:
- Откройте lmstudio.ai/download.
- Сверьте установленную версию с текущей.
- Скачайте свежий установщик под свою ОС.
- Запустите скачанный установщик и следуйте инструкциям на экране.
- Для новых функций загляните в раздел Beta and Experimental Releases.
После обновления проверьте список My Models. В инструкции Skillbox Media этот раздел описан как список языковых моделей, сохранённых на компьютере: для каждого файла доступны имя разработчика, число параметров, тип квантования и размер.
Типичные ошибки и их решение
Первая ошибка — модель не помещается в память. В подборке на thecode.media описано: появляется ошибка out of memory; в этом случае помогает более лёгкая версия модели с квантованием, например, Q4 вместо Q8 или FP16.
Вторая ошибка — ответы идут минутами. В подборке на thecode.media описан случай, когда модель отвечает по 2–3 минуты на простой вопрос. Для LM Studio там советуют проверить настройки загрузки модели и GPU Offload: чем больше слоёв уходит на GPU, тем быстрее обычно работает генерация.
Третья ошибка — не хватает токенов на ответ. В обзоре на vc.ru описано, что в режиме сложных рассуждений модель может слишком долго думать и исчерпать контекстное окно до полноценного ответа. В подборке на thecode.media для LM Studio указана настройка Context Length; проверьте её, если модель обрывает длинный текст или теряет начало запроса.
Четвёртая — модель выдумывает факты. В инструкции на Skillbox Media сказано: у Qwen 3 нет доступа к веб-поиску, поэтому она способна выдумывать события и искажать информацию. Проверяйте даты, числа и имена по внешним источникам.
Пятая — выбор слишком крупной модели. В обзоре на Yudaev School приведено правило: не выбирайте 13B-модель для 8 ГБ RAM только потому, что она есть в каталоге. Ориентируйтесь на реальное требование к памяти.
Промпт для диагностики проблемы:
Ты — диагностический ассистент по LM Studio. Симптом: [что происходит]. Моё железо: [ОЗУ], [VRAM], [модель и квант]. Назови три вероятные причины по порядку вероятности и для каждой дай одно конкретное действие: снизить квант, уменьшить контекст, изменить GPU offload или взять модель меньшего размера.
Вариации: диагностика ошибки out of memory; диагностика медленных ответов; диагностика обрыва генерации; диагностика проблем с API; диагностика русского языка в ответах.
Частые вопросы
LM Studio бесплатна навсегда или это пробный период?
Приложение бесплатное, пробного периода нет. В обзоре на Yudaev School указано, что с июля 2025 года приложение разрешено бесплатно использовать и дома, и для внутренних рабочих задач. В подборке на iPhones.ru оно описано как бесплатное приложение. Платить за сам запуск моделей не нужно.
Можно ли использовать LM Studio в коммерческих целях?
Для внутренних рабочих задач использование разрешено с июля 2025 года. Это следует из обзора на Yudaev School. Условия конкретных моделей при этом различаются. Перед выпуском продукта проверьте лицензию выбранной модели отдельно.
Сколько оперативной памяти нужно для запуска моделей?
На странице lm-studio.me рекомендуют 16 ГБ оперативной памяти и 6 ГБ видеопамяти для ПК. На iPhones.ru отмечено, что простейший чатбот запустится даже на базовом Mac с чипом M1 и 8 ГБ оперативной памяти. В инструкции Skillbox Media для gemma-3-12b приведён ориентир около 32 ГБ оперативной памяти.
Какие модели лучше запускать на слабом компьютере?
Начните с компактных квантованных версий. В обзоре на Yudaev School советуют для слабого компьютера брать небольшие квантованные модели в GPT4All, LM Studio или Ollama. В инструкции на Skillbox Media для Qwen3 4B Thinking 2507 указано: понадобится 4 ГБ оперативной памяти и 3 ГБ места на диске.
Как подключить LM Studio к другому приложению?
Через локальный сервер и OpenAI-совместимый endpoint. В обзоре на vc.ru описан пример: чтобы связать LM Studio и Telegram, в скрипт с настройкой бота нужно добавить ссылку на сервер (например, http://10.0.85.2:1234) и токен бота. Токен выдаёт @BotFather. Там же описан кейс с ботом на базе Gemma 3 для описаний товаров.
Если нужен разбор по установке моделей на конкретную систему, смотрите инструкцию по Дипсику на ПК и сравнение DeepSeek с Алисой. Про сбои связи есть материал про мобильный интернет, а про откат версий — про старую версию.
