Открытые веса · Apache 2.0
Полные веса на Hugging Face: скачивай, запускай локально, дообучай и встраивай в продукты без ограничений и без токен-платы.
Открытое поколение Qwen от Alibaba под Apache 2.0. Плотная 27B на одной GPU и быстрый MoE 35B-A3B — лучший открытый кодер, self-host и приватность. Без VPN — оплата картой РФ.
Привет! Я Qwen 3.6 — открытая модель Alibaba. Меня можно скачать и запустить на своей GPU. Пишу код, рассуждаю и работаю офлайн. Что делаем?
Помоги поднять меня локально в vLLM
Готово: 27B на одной GPU, порт 8000, OpenAI-совместимый API. Подключить Qwen Code?
Qwen (Tongyi Qianwen) — открытая нейросеть от Alibaba Cloud, впервые выпущенная в 2023 году. Команда сделала ставку на открытые веса и многоязычие как на главное отличие: уже в 2024 году семейство Qwen2.5 с версиями Coder, Math и VL стало одним из лидеров среди open-source LLM, а Qwen3 в 2025-м добавил гибридный режим рассуждений и 119 языков.
В основе — архитектура Mixture-of-Experts: у флагмана 235B параметров, но на каждый токен активны лишь ~22B — мощность флагмана при стоимости лёгкой модели. Веса опубликованы под лицензией Apache 2.0 — их можно скачать, запускать локально и дообучать под свои задачи.
Qwen особенно силён в переводе и локализации: 119 языков с сохранением тона и терминологии — от документов и договоров до интерфейсов приложений. Qwen-Coder генерирует и отлаживает код на 40+ языках программирования, а Qwen-VL понимает изображения, диаграммы и сканы — извлекает данные и отвечает по картинке.
Полные веса на Hugging Face: скачивай, запускай локально, дообучай и встраивай в продукты без ограничений и без токен-платы.
Плотная 3.6-27B помещается на одну потребительскую видеокарту, а MoE 35B-A3B активирует лишь 3B параметров — быстро и экономно.
3.6-27B обгоняет Gemma 4 и на агентном кодинге превосходит даже прошлый закрытый 3.5-397B. Идеален для локальной разработки.
Встроенные вызовы инструментов, MCP и code interpreter. Подключается к Qwen Code, Cline, Ollama, vLLM и SGLang из коробки.
Плотная 27B помещается на одну потребительскую видеокарту; MoE 35B активирует лишь 3B параметров на токен — быстрый инференс при качестве большой модели.
Полные веса можно скачать, запускать локально, дообучать и встраивать в продукты без ограничений. Работает в vLLM, SGLang, Ollama, llama.cpp.
Встроенная поддержка вызова инструментов, MCP и code interpreter. Подключается к Qwen Code, Cline и другим агентным фреймворкам.
3.6-27B — сильнейший открытый кодер для одной GPU: агентный кодинг, автодополнение, ревью — приватно и без токен-платы.
Reasoning-режим в 27B поднимает Intelligence Index заметно выше — сильная математика и логика в открытой модели.
Данные не уходят наружу: модель крутится на вашем железе. Идеально для чувствительных доменов и офлайн-сценариев.
Полные веса 3.6-27B и 35B-A3B под Apache 2.0
Локальный запуск на своём железе · 1 GPU
Агентный кодинг и MCP из коробки
3.6 Plus и Max через Model Studio
Флагман поколения 3.7: гибридный режим рассуждений, 119 языков и контекст до 256K токенов.
Флагман «Agent Frontier»: до 35 часов автономной работы, 1000+ вызовов инструментов, контекст 1M и агентный кодинг за долю цены.
Открытое поколение: 27B (dense, 1 GPU) и 35B-A3B (MoE) под Apache 2.0. Лучший открытый кодер.
Проприетарная API-версия поколения 3.6 — доступна только через Model Studio, без self-host, в отличие от открытой Qwen 3.6.
Запуск гибридного thinking-режима, 119 языков и MoE-флагмана с открытыми весами.
Большое открытое семейство: версии Coder, Math и VL, размеры от 0.5B до 72B.
MoE-архитектура, рост в бенчмарках и усиленная поддержка многих языков.
Первые открытые модели Alibaba: базовая LLM, Chat и мультимодальная Qwen-VL.
Поднял 3.6-27B на своей 4090 — приватный кодер без токен-платы. Обходит Gemma 4 и не отправляет мой код наружу.
MoE 35B-A3B — 3B активных, летает на инференсе. Дообучили под наш домен через LoRA за вечер. Apache 2.0 решает.
Чувствительные данные не выпускаем наружу — крутим Qwen 3.6 локально. Качество открытой модели впервые достаточно для прода.
Reasoning-режим в 27B удивил: математика и логика на уровне куда более крупных моделей. И всё офлайн.
Стратегия двух треков идеальна: прод на открытой 3.6, а тяжёлых агентов гоняем на 3.7 Max через API.
vLLM, SGLang, Ollama — заводится везде. Qwen-Agent + MCP собрали локального агента, читающего файлы. Без VPN, карта МИР.
Qwen 3.6 входит во все тарифы — отличаются лимиты кредитов и доступ к другим моделям линейки.
0 ₽/мес
5 запросов в день
990 ₽/мес
Для личного использования
1990 ₽/мес
Максимум возможностей: видео и музыка
9990 ₽/мес
Для больших объёмов и разработчиков
Открытое (open-weight) поколение Qwen от Alibaba (апрель 2026) перед закрытым флагманом 3.7 Max. Два ключевых веса: 3.6-27B (плотная, помещается на одну GPU) и 3.6-35B-A3B (MoE, 3B активных). Оба под Apache 2.0.
3.6 — открытая линия: скачиваешь веса и запускаешь на своём железе, дообучаешь под домен. 3.7 Max — закрытый фронтир-агент только по API. Для self-host и приватности — 3.6, для автономных агентов через API — 3.7 Max.
Да. Веса 3.6-27B и 3.6-35B-A3B опубликованы на Hugging Face под лицензией Apache 2.0 — можно запускать локально, дообучать и встраивать в коммерческие продукты.
Нет. Через ClodGPT Qwen 3.6 работает без VPN и без зарубежных карт. Оплата через СБП, МИР, SberPay. Либо запускайте веса локально — вообще без внешних сервисов.
Да. Плотная 3.6-27B рассчитана на одну потребительскую GPU, а MoE 35B-A3B активирует лишь 3B параметров на токен — быстрый инференс при качестве крупной модели. Работает в vLLM, SGLang, Ollama, llama.cpp.
3.6-27B — один из сильнейших открытых кодеров: обгоняет Gemma 4 и на агентном кодинге превосходит даже прошлый закрытый 3.5-397B. Есть reasoning-режим для математики и логики.
Base — 990 ₽/мес, Ultra — 1990 ₽/мес, Pro — 9990 ₽/мес. При годовой оплате скидка 20%.
Без VPN, оплата картой РФ. Бесплатный старт — 5 запросов без карты.
Начать бесплатно