Что такое Qwen
Qwen - семейство открытых языковых моделей от Alibaba, распространяется под лицензией Apache 2.0, которая разрешает и коммерческое, и исследовательское использование. Линейка моделей охватывает диапазон от 0,6 до 235 миллиардов параметров. В веб-интерфейсе работает крупная модель с контекстным окном 262 144 токена.
Три способа доступа без VPN
chat.qwen.ai - веб-чат, открывается без входа в аккаунт, регистрация по email опциональна для базового использования. Демо на Hugging Face - работает вообще без регистрации, на общих GPU-ресурсах платформы. Локальный запуск через Ollama - требует один раз скачать модель, дальше работает полностью офлайн без ограничений запросов.
Веб-чат chat.qwen.ai
Сайт открывается без предварительного входа. Первое сообщение обычно сопровождается предложением зарегистрироваться, чтобы разблокировать генерацию видео, более высокие лимиты запросов и историю переписки - но для регистрации достаточно email, подтверждение по телефону не обязательно для базового доступа. По независимым оценкам, без регистрации доступно порядка 50 бесплатных запросов в час, точная цифра может отличаться в зависимости от нагрузки на сервер.
Демо на Hugging Face
Демо Qwen3 на huggingface.co/spaces/Qwen/Qwen3-Demo работает на общих ресурсах ZeroGPU, полностью бесплатно и без входа в аккаунт. Минус - при высокой нагрузке демо может показывать сообщение о занятости и временно отказывать в ответе, это ограничение общей инфраструктуры, а не самого демо.
Локальная установка через Ollama
Понадобится компьютер на Mac, Windows или Linux и бесплатная программа Ollama с ollama.com/download. Запуск - две команды:
ollama --version ollama run qwen3:4b
После скачивания модель работает полностью локально, без обращения к интернету и без ограничений на число запросов.
Какой размер модели выбрать
По официальным данным Ollama, доступны варианты: qwen3:0.6b (523 МБ на диске, контекст 40K), qwen3:1.7b (1,4 ГБ), qwen3:4b (2,5 ГБ, контекст 256K), qwen3:8b (5,2 ГБ, контекст 40K), qwen3:14b (9,3 ГБ, контекст 40K), qwen3:30b (19 ГБ, контекст 256K) и qwen3:235b (142 ГБ, контекст 256K). Для ноутбука с 16 ГБ оперативной памяти разумный выбор - qwen3:4b или qwen3:8b: они помещаются в память с запасом и отвечают достаточно быстро для повседневных задач.
Что с качеством русского языка
По независимым тестам модель справляется с русским языком без грубых ошибок падежей и без заметного калькирования с английского - как в веб-версии, так и в локальном запуске через Ollama. Есть нюанс с локальными компактными моделями: они по умолчанию проговаривают ход рассуждения перед финальным ответом, из-за чего вывод получается длиннее и на первый взгляд более путаным, хотя сам финальный ответ остаётся корректным.
OpenRouter для доступа к Qwen из России не работает
По независимым проверкам, доступ к Qwen через OpenRouter с российских IP-адресов заблокирован - соединение обрывается на уровне Cloudflare с ошибкой проверки. Актуальность этого ограничения стоит перепроверять напрямую перед тем, как строить на нём рабочий процесс, поскольку подобные блокировки со временем меняются в любую сторону.
Частые проблемы
- Лимит запросов в веб-чате плавающий и зависит от загрузки сервера в конкретный момент.
- Демо на Hugging Face иногда показывает статус «занято» из-за общих GPU-ресурсов.
- Локальные модели по умолчанию проговаривают цепочку рассуждений, что делает ответ длиннее ожидаемого.
- Платные тарифы Alibaba обычно требуют способ оплаты, не привязанный к российской карте.
Чек-лист
- Открыт chat.qwen.ai и отправлен тестовый запрос на русском без регистрации
- При перегрузке веб-чата опробовано демо на Hugging Face как запасной вариант
- Для безлимитного офлайн-доступа установлена Ollama и подобран размер модели под объём оперативной памяти
- Учтено, что локальные модели проговаривают рассуждение перед финальным ответом
- Актуальность блокировки OpenRouter для российских IP проверена перед тем, как полагаться на неё в рабочем процессе