Открытые веса · MoE 1T
Полные веса под Modified MIT на Hugging Face. Mixture-of-Experts: 1T параметров, 32B активных — мощь флагмана при затратах компактной модели.
Флагман семейства Kimi K2 от Moonshot AI с открытыми весами. Архитектура MoE на 1T параметров, контекст 256K токенов, нативная мультимодальность и режим рассуждения — уровень топовых закрытых моделей за долю цены. Без VPN, оплата картой РФ.
Привет! Я Kimi K2.6 — новая флагманская модель с открытым кодом. Рассуждаю, пишу код и держу до 256K токенов контекста. Что решаем?
Найди узкое место в этом сервисе и предложи фикс
Вижу сервис на FastAPI. 3 правки: батчинг запросов, async I/O и кеш ответов. Показать патч?
Kimi создан китайской компанией Moonshot AI, основанной в 2023 году в Пекине Ян Чжилинем — выпускником Tsinghua и Carnegie Mellon. Компания специализируется на моделях со сверхдлинным контекстом и считается одним из «AI-тигров» Китая с оценкой $3+ млрд. Уже на запуске в 2023 году Kimi Chat поставил рекорд — контекст 200K китайских символов — и быстро стал популярен у студентов и исследователей.
Сегодня Kimi обрабатывает до 2 млн символов в одном диалоге: целые книги, кодовые базы и архивы документов — без потери деталей. Флагман Kimi K2 — открытая MoE-модель на 1 трлн параметров, при этом на токен активны лишь 32B — мощность гиганта при разумной цене inference. Веса K2 опубликованы под открытой лицензией: модель можно запускать локально и дообучать под свои задачи.
Kimi силён в работе с длинными документами — книгами, диссертациями, юридическими архивами, — ищет в интернете в реальном времени и отвечает со ссылками на источники, а K2 справляется с агентными задачами: вызывает инструменты, пишет и запускает код, выполняет многошаговые сценарии самостоятельно.
Полные веса под Modified MIT на Hugging Face. Mixture-of-Experts: 1T параметров, 32B активных — мощь флагмана при затратах компактной модели.
Декомпозиция задач и оркестрация десятков параллельных суб-агентов. Надёжный вызов инструментов через MCP — документы, сайты и таблицы за один прогон.
Репозиторий, книга или архив документов — в одном запросе. Принимает текст и изображения: разбор скриншотов, графиков и макетов.
Пошаговое мышление с сохранением цепочки между шагами — сложная логика, математика и многошаговые агентные сценарии.
Mixture-of-Experts из сотен экспертов активирует лишь часть параметров на токен — мощь огромной модели при затратах компактной.
Целый репозиторий, книга или большой архив документов помещаются в один запрос. Кеширование контекста делает длинные диалоги дешевле.
Веса опубликованы на Hugging Face под свободной лицензией: можно запускать локально через vLLM, SGLang или KTransformers, дообучать и встраивать.
Декомпозиция задач и оркестрация десятков параллельных суб-агентов: документы, сайты и таблицы за один прогон, с вызовом инструментов через MCP.
Пишет код на Python, Rust, Go и превращает промпты и визуальные референсы в готовые к продакшену интерфейсы.
Принимает текст и изображения, держит 256K токенов и отлично подходит для RAG, анализа документов и разбора скриншотов.
Полная версия через ClodGPT · история · агентный режим · 256K контекст
Нативное · загрузка кода, фото и PDF · Shortcuts · тёмная тема
Material You · быстрый доступ · режим рассуждения
@ClodGPTBot · Kimi в мессенджере · код, документы и картинки
Флагман поколения K2: открытая MoE-модель 1T параметров, контекст 256K, мультимодальность, агентный кодинг и оркестрация суб-агентов (Agent Swarm).
Новое поколение флагмана Moonshot AI: открытая MoE-модель на 1T параметров, контекст 256K, нативная мультимодальность и режим рассуждения.
Открытая MoE-модель на 1 трлн параметров. Сильна в агентных и кодовых задачах.
Кодинг-специализация на базе K2.6: сильнее в long-horizon SWE, форсированное рассуждение и на ~30% меньше «думающих» токенов.
Модель рассуждений с поддержкой изображений и длинной цепочкой мысли.
Расширение контекста до 2 млн символов и встроенный поиск в вебе.
Публичный запуск с контекстом 200K китайских символов — рекорд на тот момент.
Ян Чжилинь основывает компанию с фокусом на сверхдлинном контексте.
K2.6 держит весь монорепозиторий в 256K контексте и сам гоняет агентов: пишет код, тесты и ревью. Нашёл баги, которые мы не замечали.
Скачали открытые веса, подняли на своих GPU через vLLM. Инференс копеечный, качество почти как в облаке.
Режим рассуждения реально думает над архитектурой. Обсуждаю сложные решения как с сеньором.
Кидаю скриншот макета — K2.6 собирает рабочий компонент. Мультимодальность экономит кучу времени.
Цена за токен на порядок ниже закрытых моделей, а Agent Swarm закрывает целые задачи автономно. Весь AI-функционал крутим на Kimi без VPN.
Агенты с MCP сами ходят по инструментам и правят инфраструктуру. Интеграция экономит часы рутины.
1 кредит = 1 запрос GPT-4o mini. Kimi K2.6-Pro — ~2 кредита, Kimi K2.6-Flash — ~0.5 кредита за сообщение.
0 ₽/мес
5 запросов в день
990 ₽/мес
Для личного использования
1990 ₽/мес
Максимум возможностей: видео и музыка
9990 ₽/мес
Для больших объёмов и разработчиков
Kimi K2.6 — флагманская модель поколения K2 от Moonshot AI (апрель 2026). Открытая мультимодальная MoE-модель на 1T параметров (32B активных) с контекстом 256K токенов. Заточена под агентный кодинг, генерацию интерфейсов и оркестрацию суб-агентов (Agent Swarm).
K2.6 — универсальный флагман K2. K2.7 Code — его кодинг-специализация с меньшим числом «думающих» токенов (для длинных инженерных задач). K3 — следующее поколение с более сильным рассуждением. Для общих задач Moonshot рекомендует именно K2.6.
Нет. Через ClodGPT Kimi K2.6 работает без VPN и без зарубежных карт. Оплата через СБП, МИР, SberPay, интерфейс и поддержка на русском.
Да. Веса семейства Kimi опубликованы на Hugging Face под лицензией Modified MIT — модель можно запускать локально (vLLM, SGLang, KTransformers), дообучать и встраивать в свои продукты.
Это агентная архитектура Kimi: модель декомпозирует задачу и оркеструет десятки параллельных суб-агентов с вызовом инструментов через MCP. За один прогон она может подготовить документы, сайты и таблицы с минимумом контроля.
256K токенов — это сотни страниц: целый репозиторий, книга или архив документов помещаются в один запрос без нарезки на части. Кеширование контекста удешевляет длинные диалоги и RAG.
Base — 990 ₽/мес, Ultra — 1990 ₽/мес, Pro — 9990 ₽/мес. При годовой оплате скидка 20%.
Без VPN, оплата картой РФ. Бесплатный старт — 5 запросов без карты.
Начать бесплатно