Открытые веса · MoE 1T
Полные веса под Modified MIT на Hugging Face. Mixture-of-Experts: 1T параметров, 32B активных — мощь флагмана при затратах компактной модели.
Кодинг-специализация семейства Kimi K2 от Moonshot AI с открытыми весами. Всегда в режиме рассуждения, длинные инженерные задачи, контекст 256K и вызов инструментов через MCP — и на ~30% меньше токенов, чем K2.6. Без VPN, оплата картой РФ.
Привет! Я Kimi K2.7 Code — новая флагманская модель с открытым кодом. Рассуждаю, пишу код и держу до 256K токенов контекста. Что решаем?
Найди узкое место в этом сервисе и предложи фикс
Вижу сервис на FastAPI. 3 правки: батчинг запросов, async I/O и кеш ответов. Показать патч?
Работает в веб-кабинете без VPN: в чате, в Telegram-боте @clodgpt_bot и в инструментах портала. Доступ по API — на тарифе Pro. Бесплатный тариф: 5 запросов в день к GPT-5.6 Luna, Nano Banana 2 Lite, DeepSeek V4.1 Flash и DeepSeek V3.2, без списания Т, в одном запросе до 100 000 токенов.
| Модель | Тариф | Цена |
|---|---|---|
| Kimi K3 | с Ultra | 3,23 Т / сообщение |
Для текстовых моделей указана цена типичного сообщения — около 1 500 токенов запроса и 2 000 ответа. Фактическая сумма зависит от длины диалога и видна в истории списаний.
Kimi создан китайской компанией Moonshot AI, основанной в 2023 году в Пекине Ян Чжилинем — выпускником Tsinghua и Carnegie Mellon. Компания специализируется на моделях со сверхдлинным контекстом и считается одним из «AI-тигров» Китая с оценкой $3+ млрд. Уже на запуске в 2023 году Kimi Chat поставил рекорд — контекст 200K китайских символов — и быстро стал популярен у студентов и исследователей.
Сегодня Kimi обрабатывает до 2 млн символов в одном диалоге: целые книги, кодовые базы и архивы документов — без потери деталей. Флагман Kimi K2 — открытая MoE-модель на 1 трлн параметров, при этом на токен активны лишь 32B — мощность гиганта при разумной цене inference. Веса K2 опубликованы под открытой лицензией: модель можно запускать локально и дообучать под свои задачи.
Kimi силён в работе с длинными документами — книгами, диссертациями, юридическими архивами, — ищет в интернете в реальном времени и отвечает со ссылками на источники, а K2 справляется с агентными задачами: вызывает инструменты, пишет и запускает код, выполняет многошаговые сценарии самостоятельно.
Полные веса под Modified MIT на Hugging Face. Mixture-of-Experts: 1T параметров, 32B активных — мощь флагмана при затратах компактной модели.
End-to-end инженерные задачи: правит репозитории, планирует шаги и вызывает инструменты через MCP, сохраняя цепочку рассуждения между ходами (preserve thinking).
Репозиторий, книга или архив документов — в одном запросе. Принимает текст и изображения: разбор скриншотов, графиков и макетов.
Всегда думает перед ответом и держит цепочку между шагами, но тратит на ~30% меньше «думающих» токенов, чем K2.6 — дешевле на выполненную задачу.
Mixture-of-Experts из сотен экспертов активирует лишь часть параметров на токен — мощь огромной модели при затратах компактной.
Целый репозиторий, книга или большой архив документов помещаются в один запрос. Кеширование контекста делает длинные диалоги дешевле.
Веса опубликованы на Hugging Face под свободной лицензией: можно запускать локально через vLLM, SGLang или KTransformers, дообучать и встраивать.
Декомпозиция задач и оркестрация десятков параллельных суб-агентов: документы, сайты и таблицы за один прогон, с вызовом инструментов через MCP.
Пишет код на Python, Rust, Go и превращает промпты и визуальные референсы в готовые к продакшену интерфейсы.
Принимает текст и изображения, держит 256K токенов и отлично подходит для RAG, анализа документов и разбора скриншотов.
Флагман поколения K2: открытая MoE-модель 1T параметров, контекст 256K, мультимодальность, агентный кодинг и оркестрация суб-агентов (Agent Swarm).
Флагман Moonshot AI на 2,8 трлн параметров: рассуждение, работа с большими репозиториями и нативное понимание изображений. Контекст до 1M токенов.
Открытая MoE-модель на 1 трлн параметров. Сильна в агентных и кодовых задачах.
Кодинг-специализация на базе K2.6: сильнее в long-horizon SWE, форсированное рассуждение и на ~30% меньше «думающих» токенов.
Модель рассуждений с поддержкой изображений и длинной цепочкой мысли.
Расширение контекста до 2 млн символов и встроенный поиск в вебе.
Публичный запуск с контекстом 200K китайских символов — рекорд на тот момент.
Ян Чжилинь основывает компанию с фокусом на сверхдлинном контексте.
Доступно с тарифа Ultra. Т списываются с месячной квоты тарифа — Base — 990 ₽/мес, Ultra — 1990 ₽/мес, Pro — 9990 ₽/мес. При годовой оплате скидка 20%.
0 ₽/мес
5 запросов в день
990 ₽/мес
Для личного использования
Списывается 9 500 ₽ сразу за 12 месяцев
1990 ₽/мес
Максимум возможностей: видео и музыка
Списывается 19 100 ₽ сразу за 12 месяцев
9990 ₽/мес
Для больших объёмов и разработчиков
Списывается 95 900 ₽ сразу за 12 месяцев
Kimi K2.7 Code — кодинг-ориентированная модель семейства Kimi K2 от Moonshot AI (июнь 2026), построенная на K2.6. Открытая MoE-модель на 1T параметров (32B активных) с контекстом 256K, всегда работает в режиме рассуждения и заточена под end-to-end программные задачи.
Базовые ставки за токен те же, но K2.7 Code сильнее на инженерных бенчмарках и тратит примерно на 30% меньше «думающих» токенов — то есть дешевле на выполненную задачу. Для общего чата Moonshot по-прежнему рекомендует K2.6, а K2.7 Code — для кода и агентов.
Нет. K2.7 Code всегда работает в режиме thinking и сохраняет полную цепочку рассуждения между ходами (preserve thinking) — это повышает качество в агентных сценариях, где контекст накапливается за много шагов.
Нет. Через ClodGPT Kimi K2.7 Code работает без VPN и без зарубежных карт. Оплата через карту МИР или СБП, интерфейс и поддержка на русском.
Да. Веса опубликованы на Hugging Face под лицензией Modified MIT — модель можно запускать локально (vLLM, SGLang, KTransformers), дообучать и встраивать в свои пайплайны и агентов.
K2.7 Code сильна в tool-use по протоколу MCP: она может ходить по файлам репозитория, запускать тесты, вызывать линтеры и внешние сервисы — и вести многошаговый инженерный процесс до готового результата.
В ClodGPT: Kimi K3 — 3,23 Т за сообщение (типичное сообщение; точная сумма зависит от длины диалога). Доступно с тарифа Ultra; Т списываются с месячной квоты тарифа — Base — 990 ₽/мес, Ultra — 1990 ₽/мес, Pro — 9990 ₽/мес. При годовой оплате скидка 20%.
Без VPN, оплата картой РФ. Бесплатный тариф: 5 запросов в день к GPT-5.6 Luna, Nano Banana 2 Lite, DeepSeek V4.1 Flash и DeepSeek V3.2, без списания Т, в одном запросе до 100 000 токенов.
Начать бесплатно