Что значит «установить Qwen»
Под этим запросом прячутся три разных задачи. Первая — поставить приложение Qwen Chat на телефон или компьютер: это обычный клиент облачного чата, о нём отдельная статья. Вторая — развернуть открытую модель у себя, чтобы она работала локально. Третья — подключить Qwen к своим программам через API.
Эта статья про второй вариант. Локальный запуск бесплатен, не зависит от регистрации и лимитов и не отправляет ваши данные в облако. Цена — требования к железу.
Какая модель подойдёт
Главная открытая модель поколения 3.8 — Qwen 3.8 27B. Она выложена на Hugging Face под лицензией Apache 2.0, понимает текст и картинки, по умолчанию работает в режиме рассуждений. В сжатом виде (квантизация Q4) весит около 18 ГБ и комфортно идёт на видеокарте с 24 ГБ памяти или на Mac с Apple Silicon и 24 ГБ объединённой памяти.
Флагман Qwen 3.8 Max — облачная модель. Существует и огромная открытая текстовая версия на 2,4 трлн параметров, но это сотни гигабайт даже в сильном сжатии — для дома не вариант. На слабом компьютере берите младшие модели прошлого поколения Qwen 3 — например, на 8 или 4 млрд параметров: они запускаются даже без мощной видеокарты, но заметно проще в ответах.
Установка через Ollama
Поставьте Ollama
Скачайте установщик с сайта ollama.com для Windows, macOS или Linux и установите как обычную программу.
Скачайте модель
В терминале: ollama pull qwen3.8:27b. Загрузка около 18 ГБ.
Запустите
ollama run qwen3.8:27b — откроется чат прямо в терминале. Выход — /bye.
Для слабого ПК
Вместо 27B попробуйте ollama run qwen3:8b или qwen3:4b.
Установка через LM Studio
Если терминал пугает, есть LM Studio — программа с обычным окном чата. В ней поиск моделей встроен: введите Qwen, выберите версию в формате GGUF под объём памяти (программа подсказывает, влезет ли модель) и нажмите загрузку. Потом выберите модель вверху окна и пишите.
Для карт на 16 ГБ ищите сборки Qwen 3.8 27B с более сильным сжатием — около 13–17 ГБ. Качество немного падает, но модель помещается.
Настройка контекста
Модель умеет работать с очень длинным контекстом — до 262 тыс. токенов, но каждый токен контекста занимает видеопамять. На карте 24 ГБ начните с 32 тыс. токенов: это около 4 ГБ поверх самой модели. Если ответы начинают тормозить или программа падает, уменьшите контекст.
Как удалить Qwen
В Ollama: ollama list покажет скачанные модели, ollama rm qwen3.8:27b удалит нужную и освободит место. В LM Studio — раздел со скачанными моделями, кнопка удаления у файла. Приложение Qwen Chat удаляется как любое другое, но аккаунт при этом остаётся.
Когда быстрее через ИИ-агента
Если видеокарты на 24 ГБ нет, а Qwen нужен для работы, проще взять его в облаке. В ИИ-агенте LeanTech есть Qwen 3.8 Max и Qwen 3.8 Flash, а рядом — ChatGPT, Claude, DeepSeek и Gemini. Агент отдаёт не только ответ, но и файл: документ Word, таблицу Excel, презентацию. Без VPN и зарубежного номера, оплата картой РФ.
Чего агент не делает: не ставится на ваш компьютер и не запускает модели локально, не работает внутри чужих программ, не делает 3D, а видео генерирует только на тарифах Pro и Power.