Открытые веса · MoE 1T
Полные веса под Modified MIT на Hugging Face. Mixture-of-Experts: 1T параметров, 32B активных — мощь флагмана при затратах компактной модели.
Флагман семейства Kimi K2 от Moonshot AI с открытыми весами. Архитектура MoE на 1T параметров, контекст 256K токенов, нативная мультимодальность и режим рассуждения — уровень топовых закрытых моделей за долю цены. Без VPN, оплата картой РФ.
Привет! Я Kimi K2.6 — новая флагманская модель с открытым кодом. Рассуждаю, пишу код и держу до 256K токенов контекста. Что решаем?
Найди узкое место в этом сервисе и предложи фикс
Вижу сервис на FastAPI. 3 правки: батчинг запросов, async I/O и кеш ответов. Показать патч?
Работает в веб-кабинете без VPN: в чате, в Telegram-боте @clodgpt_bot и в инструментах портала. Доступ по API — на тарифе Pro. Бесплатный тариф: 5 запросов в день к GPT-5.6 Luna, Nano Banana 2 Lite, DeepSeek V4.1 Flash и DeepSeek V3.2, без списания Т, в одном запросе до 100 000 токенов.
| Модель | Тариф | Цена |
|---|---|---|
| Kimi K3 | с Ultra | 3,23 Т / сообщение |
Для текстовых моделей указана цена типичного сообщения — около 1 500 токенов запроса и 2 000 ответа. Фактическая сумма зависит от длины диалога и видна в истории списаний.
Kimi создан китайской компанией Moonshot AI, основанной в 2023 году в Пекине Ян Чжилинем — выпускником Tsinghua и Carnegie Mellon. Компания специализируется на моделях со сверхдлинным контекстом и считается одним из «AI-тигров» Китая с оценкой $3+ млрд. Уже на запуске в 2023 году Kimi Chat поставил рекорд — контекст 200K китайских символов — и быстро стал популярен у студентов и исследователей.
Сегодня Kimi обрабатывает до 2 млн символов в одном диалоге: целые книги, кодовые базы и архивы документов — без потери деталей. Флагман Kimi K2 — открытая MoE-модель на 1 трлн параметров, при этом на токен активны лишь 32B — мощность гиганта при разумной цене inference. Веса K2 опубликованы под открытой лицензией: модель можно запускать локально и дообучать под свои задачи.
Kimi силён в работе с длинными документами — книгами, диссертациями, юридическими архивами, — ищет в интернете в реальном времени и отвечает со ссылками на источники, а K2 справляется с агентными задачами: вызывает инструменты, пишет и запускает код, выполняет многошаговые сценарии самостоятельно.
Полные веса под Modified MIT на Hugging Face. Mixture-of-Experts: 1T параметров, 32B активных — мощь флагмана при затратах компактной модели.
Декомпозиция задач и оркестрация десятков параллельных суб-агентов. Надёжный вызов инструментов через MCP — документы, сайты и таблицы за один прогон.
Репозиторий, книга или архив документов — в одном запросе. Принимает текст и изображения: разбор скриншотов, графиков и макетов.
Пошаговое мышление с сохранением цепочки между шагами — сложная логика, математика и многошаговые агентные сценарии.
Mixture-of-Experts из сотен экспертов активирует лишь часть параметров на токен — мощь огромной модели при затратах компактной.
Целый репозиторий, книга или большой архив документов помещаются в один запрос. Кеширование контекста делает длинные диалоги дешевле.
Веса опубликованы на Hugging Face под свободной лицензией: можно запускать локально через vLLM, SGLang или KTransformers, дообучать и встраивать.
Декомпозиция задач и оркестрация десятков параллельных суб-агентов: документы, сайты и таблицы за один прогон, с вызовом инструментов через MCP.
Пишет код на Python, Rust, Go и превращает промпты и визуальные референсы в готовые к продакшену интерфейсы.
Принимает текст и изображения, держит 256K токенов и отлично подходит для RAG, анализа документов и разбора скриншотов.
Флагман поколения K2: открытая MoE-модель 1T параметров, контекст 256K, мультимодальность, агентный кодинг и оркестрация суб-агентов (Agent Swarm).
Флагман Moonshot AI на 2,8 трлн параметров: рассуждение, работа с большими репозиториями и нативное понимание изображений. Контекст до 1M токенов.
Открытая MoE-модель на 1 трлн параметров. Сильна в агентных и кодовых задачах.
Кодинг-специализация на базе K2.6: сильнее в long-horizon SWE, форсированное рассуждение и на ~30% меньше «думающих» токенов.
Модель рассуждений с поддержкой изображений и длинной цепочкой мысли.
Расширение контекста до 2 млн символов и встроенный поиск в вебе.
Публичный запуск с контекстом 200K китайских символов — рекорд на тот момент.
Ян Чжилинь основывает компанию с фокусом на сверхдлинном контексте.
Доступно с тарифа Ultra. Т списываются с месячной квоты тарифа — Base — 990 ₽/мес, Ultra — 1990 ₽/мес, Pro — 9990 ₽/мес. При годовой оплате скидка 20%.
0 ₽/мес
5 запросов в день
990 ₽/мес
Для личного использования
Списывается 9 500 ₽ сразу за 12 месяцев
1990 ₽/мес
Максимум возможностей: видео и музыка
Списывается 19 100 ₽ сразу за 12 месяцев
9990 ₽/мес
Для больших объёмов и разработчиков
Списывается 95 900 ₽ сразу за 12 месяцев
Kimi K2.6 — флагманская модель поколения K2 от Moonshot AI (апрель 2026). Открытая мультимодальная MoE-модель на 1T параметров (32B активных) с контекстом 256K токенов. Заточена под агентный кодинг, генерацию интерфейсов и оркестрацию суб-агентов (Agent Swarm).
K2.6 — универсальный флагман K2. K2.7 Code — его кодинг-специализация с меньшим числом «думающих» токенов (для длинных инженерных задач). K3 — следующее поколение с более сильным рассуждением. Для общих задач Moonshot рекомендует именно K2.6.
Нет. Через ClodGPT Kimi K2.6 работает без VPN и без зарубежных карт. Оплата через карту МИР или СБП, интерфейс и поддержка на русском.
Да. Веса семейства Kimi опубликованы на Hugging Face под лицензией Modified MIT — модель можно запускать локально (vLLM, SGLang, KTransformers), дообучать и встраивать в свои продукты.
Это агентная архитектура Kimi: модель декомпозирует задачу и оркеструет десятки параллельных суб-агентов с вызовом инструментов через MCP. За один прогон она может подготовить документы, сайты и таблицы с минимумом контроля.
256K токенов — это сотни страниц: целый репозиторий, книга или архив документов помещаются в один запрос без нарезки на части. Кеширование контекста удешевляет длинные диалоги и RAG.
В ClodGPT: Kimi K3 — 3,23 Т за сообщение (типичное сообщение; точная сумма зависит от длины диалога). Доступно с тарифа Ultra; Т списываются с месячной квоты тарифа — Base — 990 ₽/мес, Ultra — 1990 ₽/мес, Pro — 9990 ₽/мес. При годовой оплате скидка 20%.
Без VPN, оплата картой РФ. Бесплатный тариф: 5 запросов в день к GPT-5.6 Luna, Nano Banana 2 Lite, DeepSeek V4.1 Flash и DeepSeek V3.2, без списания Т, в одном запросе до 100 000 токенов.
Начать бесплатно