Открытые веса · Apache 2.0
Полные веса на Hugging Face: скачивай, запускай локально, дообучай и встраивай в продукты без ограничений и без токен-платы.
Открытое поколение Qwen от Alibaba под Apache 2.0. Плотная 27B на одной GPU и быстрый MoE 35B-A3B — лучший открытый кодер, self-host и приватность. Без VPN — оплата картой РФ.
Привет! Я Qwen 3.6 — открытая модель Alibaba. Меня можно скачать и запустить на своей GPU. Пишу код, рассуждаю и работаю офлайн. Что делаем?
Помоги поднять меня локально в vLLM
Готово: 27B на одной GPU, порт 8000, OpenAI-совместимый API. Подключить Qwen Code?
Эта страница описывает модель, но запустить её в кабинете пока нельзя. Когда подключим, здесь появятся тариф и цена вызова. Сейчас можно пользоваться другими моделями каталога — они перечислены на странице тарифов.
Qwen (Tongyi Qianwen) — открытая нейросеть от Alibaba Cloud, впервые выпущенная в 2023 году. Команда сделала ставку на открытые веса и многоязычие как на главное отличие: уже в 2024 году семейство Qwen2.5 с версиями Coder, Math и VL стало одним из лидеров среди open-source LLM, а Qwen3 в 2025-м добавил гибридный режим рассуждений и 119 языков.
В основе — архитектура Mixture-of-Experts: у флагмана 235B параметров, но на каждый токен активны лишь ~22B — мощность флагмана при стоимости лёгкой модели. Веса опубликованы под лицензией Apache 2.0 — их можно скачать, запускать локально и дообучать под свои задачи.
Qwen особенно силён в переводе и локализации: 119 языков с сохранением тона и терминологии — от документов и договоров до интерфейсов приложений. Qwen-Coder генерирует и отлаживает код на 40+ языках программирования, а Qwen-VL понимает изображения, диаграммы и сканы — извлекает данные и отвечает по картинке.
Полные веса на Hugging Face: скачивай, запускай локально, дообучай и встраивай в продукты без ограничений и без токен-платы.
Плотная 3.6-27B помещается на одну потребительскую видеокарту, а MoE 35B-A3B активирует лишь 3B параметров — быстро и экономно.
3.6-27B обгоняет Gemma 4 и на агентном кодинге превосходит даже прошлый закрытый 3.5-397B. Идеален для локальной разработки.
Встроенные вызовы инструментов, MCP и code interpreter. Подключается к Qwen Code, Cline, Ollama, vLLM и SGLang из коробки.
Плотная 27B помещается на одну потребительскую видеокарту; MoE 35B активирует лишь 3B параметров на токен — быстрый инференс при качестве большой модели.
Полные веса можно скачать, запускать локально, дообучать и встраивать в продукты без ограничений. Работает в vLLM, SGLang, Ollama, llama.cpp.
Встроенная поддержка вызова инструментов, MCP и code interpreter. Подключается к Qwen Code, Cline и другим агентным фреймворкам.
3.6-27B — сильнейший открытый кодер для одной GPU: агентный кодинг, автодополнение, ревью — приватно и без токен-платы.
Reasoning-режим в 27B поднимает Intelligence Index заметно выше — сильная математика и логика в открытой модели.
Данные не уходят наружу: модель крутится на вашем железе. Идеально для чувствительных доменов и офлайн-сценариев.
Флагман поколения 3.7: гибридный режим рассуждений, 119 языков и контекст до 256K токенов.
Флагман «Agent Frontier»: до 35 часов автономной работы, 1000+ вызовов инструментов, контекст 1M и агентный кодинг за долю цены.
Открытое поколение: 27B (dense, 1 GPU) и 35B-A3B (MoE) под Apache 2.0. Лучший открытый кодер.
Проприетарная API-версия поколения 3.6 — доступна только через Model Studio, без self-host, в отличие от открытой Qwen 3.6.
Запуск гибридного thinking-режима, 119 языков и MoE-флагмана с открытыми весами.
Большое открытое семейство: версии Coder, Math и VL, размеры от 0.5B до 72B.
MoE-архитектура, рост в бенчмарках и усиленная поддержка многих языков.
Первые открытые модели Alibaba: базовая LLM, Chat и мультимодальная Qwen-VL.
Доступно по подписке ClodGPT. Т списываются с месячной квоты тарифа — Base — 990 ₽/мес, Ultra — 1990 ₽/мес, Pro — 9990 ₽/мес. При годовой оплате скидка 20%.
0 ₽/мес
5 запросов в день
990 ₽/мес
Для личного использования
Списывается 9 500 ₽ сразу за 12 месяцев
1990 ₽/мес
Максимум возможностей: видео и музыка
Списывается 19 100 ₽ сразу за 12 месяцев
9990 ₽/мес
Для больших объёмов и разработчиков
Списывается 95 900 ₽ сразу за 12 месяцев
Открытое (open-weight) поколение Qwen от Alibaba (апрель 2026) перед закрытым флагманом 3.7 Max. Два ключевых веса: 3.6-27B (плотная, помещается на одну GPU) и 3.6-35B-A3B (MoE, 3B активных). Оба под Apache 2.0.
3.6 — открытая линия: скачиваешь веса и запускаешь на своём железе, дообучаешь под домен. 3.7 Max — закрытый фронтир-агент только по API. Для self-host и приватности — 3.6, для автономных агентов через API — 3.7 Max.
Да. Веса 3.6-27B и 3.6-35B-A3B опубликованы на Hugging Face под лицензией Apache 2.0 — можно запускать локально, дообучать и встраивать в коммерческие продукты.
Нет. Через ClodGPT Qwen 3.6 работает без VPN и без зарубежных карт. Оплата через карту МИР или СБП. Либо запускайте веса локально — вообще без внешних сервисов.
Да. Плотная 3.6-27B рассчитана на одну потребительскую GPU, а MoE 35B-A3B активирует лишь 3B параметров на токен — быстрый инференс при качестве крупной модели. Работает в vLLM, SGLang, Ollama, llama.cpp.
3.6-27B — один из сильнейших открытых кодеров: обгоняет Gemma 4 и на агентном кодинге превосходит даже прошлый закрытый 3.5-397B. Есть reasoning-режим для математики и логики.
Стоимость в Т появится на этой странице, когда модель будет подключена в ClodGPT. Доступно по подписке ClodGPT; Т списываются с месячной квоты тарифа — Base — 990 ₽/мес, Ultra — 1990 ₽/мес, Pro — 9990 ₽/мес. При годовой оплате скидка 20%.
Модель пока не подключена — начните с других моделей каталога. Без VPN, оплата картой РФ.
Начать бесплатно