Что такое Qwen

Qwen - семейство открытых языковых моделей от Alibaba, распространяется под лицензией Apache 2.0, которая разрешает и коммерческое, и исследовательское использование. Линейка моделей охватывает диапазон от 0,6 до 235 миллиардов параметров. В веб-интерфейсе работает крупная модель с контекстным окном 262 144 токена.

Три способа доступа без VPN

chat.qwen.ai - веб-чат, открывается без входа в аккаунт, регистрация по email опциональна для базового использования. Демо на Hugging Face - работает вообще без регистрации, на общих GPU-ресурсах платформы. Локальный запуск через Ollama - требует один раз скачать модель, дальше работает полностью офлайн без ограничений запросов.

Веб-чат chat.qwen.ai

Сайт открывается без предварительного входа. Первое сообщение обычно сопровождается предложением зарегистрироваться, чтобы разблокировать генерацию видео, более высокие лимиты запросов и историю переписки - но для регистрации достаточно email, подтверждение по телефону не обязательно для базового доступа. По независимым оценкам, без регистрации доступно порядка 50 бесплатных запросов в час, точная цифра может отличаться в зависимости от нагрузки на сервер.

Демо на Hugging Face

Демо Qwen3 на huggingface.co/spaces/Qwen/Qwen3-Demo работает на общих ресурсах ZeroGPU, полностью бесплатно и без входа в аккаунт. Минус - при высокой нагрузке демо может показывать сообщение о занятости и временно отказывать в ответе, это ограничение общей инфраструктуры, а не самого демо.

Локальная установка через Ollama

Понадобится компьютер на Mac, Windows или Linux и бесплатная программа Ollama с ollama.com/download. Запуск - две команды:

ollama --version
ollama run qwen3:4b

После скачивания модель работает полностью локально, без обращения к интернету и без ограничений на число запросов.

Какой размер модели выбрать

По официальным данным Ollama, доступны варианты: qwen3:0.6b (523 МБ на диске, контекст 40K), qwen3:1.7b (1,4 ГБ), qwen3:4b (2,5 ГБ, контекст 256K), qwen3:8b (5,2 ГБ, контекст 40K), qwen3:14b (9,3 ГБ, контекст 40K), qwen3:30b (19 ГБ, контекст 256K) и qwen3:235b (142 ГБ, контекст 256K). Для ноутбука с 16 ГБ оперативной памяти разумный выбор - qwen3:4b или qwen3:8b: они помещаются в память с запасом и отвечают достаточно быстро для повседневных задач.

Что с качеством русского языка

По независимым тестам модель справляется с русским языком без грубых ошибок падежей и без заметного калькирования с английского - как в веб-версии, так и в локальном запуске через Ollama. Есть нюанс с локальными компактными моделями: они по умолчанию проговаривают ход рассуждения перед финальным ответом, из-за чего вывод получается длиннее и на первый взгляд более путаным, хотя сам финальный ответ остаётся корректным.

OpenRouter для доступа к Qwen из России не работает

По независимым проверкам, доступ к Qwen через OpenRouter с российских IP-адресов заблокирован - соединение обрывается на уровне Cloudflare с ошибкой проверки. Актуальность этого ограничения стоит перепроверять напрямую перед тем, как строить на нём рабочий процесс, поскольку подобные блокировки со временем меняются в любую сторону.

Частые проблемы

  1. Лимит запросов в веб-чате плавающий и зависит от загрузки сервера в конкретный момент.
  2. Демо на Hugging Face иногда показывает статус «занято» из-за общих GPU-ресурсов.
  3. Локальные модели по умолчанию проговаривают цепочку рассуждений, что делает ответ длиннее ожидаемого.
  4. Платные тарифы Alibaba обычно требуют способ оплаты, не привязанный к российской карте.

Чек-лист

Доступ к Qwen без VPN
  1. Открыт chat.qwen.ai и отправлен тестовый запрос на русском без регистрации
  2. При перегрузке веб-чата опробовано демо на Hugging Face как запасной вариант
  3. Для безлимитного офлайн-доступа установлена Ollama и подобран размер модели под объём оперативной памяти
  4. Учтено, что локальные модели проговаривают рассуждение перед финальным ответом
  5. Актуальность блокировки OpenRouter для российских IP проверена перед тем, как полагаться на неё в рабочем процессе
Нужна ли регистрация, чтобы попробовать Qwen в браузере?
Нет, chat.qwen.ai открывается и отвечает на сообщения без входа в аккаунт - регистрация нужна только для более высоких лимитов, истории переписки и генерации видео.
Можно ли пользоваться Qwen совсем без интернета?
Да, после установки Ollama и скачивания нужной модели она работает полностью локально и офлайн, без обращения к серверам Alibaba.
Какую модель Qwen выбрать для ноутбука с 16 ГБ оперативной памяти?
Разумный выбор - qwen3:4b (2,5 ГБ на диске) или qwen3:8b (5,2 ГБ) - обе помещаются в память с запасом и отвечают достаточно быстро для повседневных задач.
Почему локальный ответ Qwen получается длиннее, чем ожидалось?
Компактные локальные модели по умолчанию проговаривают ход рассуждения перед финальным ответом - сам итоговый ответ при этом остаётся корректным, просто вывод длиннее.
Под какой лицензией распространяется Qwen?
Apache 2.0 - разрешает как исследовательское, так и коммерческое использование моделей.
Работает ли доступ к Qwen через OpenRouter из России?
По независимым проверкам - нет, соединение с российских IP блокируется на уровне Cloudflare, но такие ограничения стоит перепроверять напрямую перед тем, как на них полагаться.
Источники
  1. Ollama Library: qwen3
← Все статьи блога