Открытый код · MoE 1.6T
Полные веса под MIT на Hugging Face. Mixture-of-Experts: 1.6T параметров, 49B активных — мощь флагмана при затратах компактной модели.
Новейшая флагманская модель DeepSeek с открытым кодом. Архитектура MoE на 1.6T параметров, контекст 1M токенов и режимы рассуждения — уровень топовых моделей за долю цены. Без VPN — оплата картой РФ.
Привет! Я DeepSeek V4 — новая флагманская модель с открытым кодом. Рассуждаю, пишу код и держу до 1M токенов контекста. Что решаем?
Найди узкое место в этом сервисе и предложи фикс
Вижу сервис на FastAPI. 3 правки: батчинг запросов, async I/O и кеш ответов. Показать патч?
Работает в веб-кабинете без VPN: в чате, в Telegram-боте @clodgpt_bot и в инструментах портала. Доступ по API — на тарифе Pro.
| Модель | Тариф | Цена |
|---|---|---|
| DeepSeek V4.1 Flash | Free | 0,13 Т / сообщение |
| DeepSeek V3.2 | Free | 0,48 Т / сообщение |
| DeepSeek V4 Flash | с Base | 0,16 Т / сообщение |
Для текстовых моделей указана цена типичного сообщения — около 1 500 токенов запроса и 2 000 ответа. Фактическая сумма зависит от длины диалога и видна в истории списаний.
DeepSeek V4 — новейшая флагманская модель лаборатории DeepSeek (2026). Открытая MoE-модель: 1.6T параметров (49B активных), контекст 1M токенов и режимы рассуждения — уровень топовых закрытых моделей за долю цены.
Гибридное внимание CSA+HCA даёт контекст 1M токенов почти даром: всего 27% FLOPs и 10% KV-кэша против V3.2. Веса V4-Pro и V4-Flash опубликованы на Hugging Face под свободной лицензией MIT — можно запускать локально и дообучать. Модель — open-source SOTA в агентных бенчмарках кода и сильна в математике и STEM.
Полные веса под MIT на Hugging Face. Mixture-of-Experts: 1.6T параметров, 49B активных — мощь флагмана при затратах компактной модели.
Гибридное внимание CSA+HCA: на 1M контексте всего 27% FLOPs и 10% KV-кэша против V3.2. Монорепо, книга или архив — в одном запросе.
Три уровня: Non-think (быстро), Think High (логический анализ) и Think Max (полное рассуждение). Управляй глубиной под задачу.
Open-source SOTA в агентных бенчмарках. Интеграция с Claude Code и OpenCode — модель пишет, правит и запускает код.
Mixture-of-Experts активирует лишь часть параметров на каждый токен. Мощность огромной модели при вычислительных затратах компактной.
Гибридное внимание CSA+HCA: на 1M контексте всего 27% FLOPs и 10% KV-кэша против V3.2. Миллион токенов стал экономически реальным.
Полные веса V4-Pro и V4-Flash опубликованы на Hugging Face под свободной лицензией. Можно запускать локально, дообучать и встраивать без ограничений.
Open-source SOTA в агентных бенчмарках кода. Работает с Claude Code и OpenCode — пишет, правит и запускает код по задаче.
Целый монорепозиторий, книга или архив документов — в одном запросе. Скидка 5× за попадание в кеш делает RAG особенно дешёвым.
Обходит открытые модели в Math/STEM/Coding и соперничает с топовыми закрытыми. Режим Think Max — для самых сложных задач.
Новое поколение Flash: рассуждение, код и нативное понимание изображений при контексте до 1M токенов.
Новое поколение DeepSeek: гибридное внимание, контекст 1M токенов по умолчанию, MoE 1.6T и режимы рассуждения Think High/Max.
Флагман линейки: максимум интеллекта, глубокий reasoning, топовая математика и код. Контекст 256K.
Лёгкая и быстрая версия V4: мгновенный ответ за копейки для объёмов, кода и реалтайма.
Гибридная модель: режимы reasoning и chat в одном. Быстрее отвечает и лучше держит длинный контекст.
Следующее поколение reasoning. Релиз перенесён — команда дообучает модель.
Модель рассуждений с открытыми весами. Мировой резонанс и уровень топ-моделей в математике.
Флагманская чат-модель на 671B параметров MoE с рекордно дешёвым inference.
MoE-архитектура и резкое снижение цены inference — прорыв по доступности.
Первые открытые модели лаборатории: базовая LLM и специализированная Coder.
Есть на бесплатном тарифе — 5 запросов в день. Т списываются с месячной квоты тарифа — Base — 990 ₽/мес, Ultra — 1990 ₽/мес, Pro — 9990 ₽/мес. При годовой оплате скидка 20%.
0 ₽/мес
5 запросов в день
990 ₽/мес
Для личного использования
Списывается 9 500 ₽ сразу за 12 месяцев
1990 ₽/мес
Максимум возможностей: видео и музыка
Списывается 19 100 ₽ сразу за 12 месяцев
9990 ₽/мес
Для больших объёмов и разработчиков
Списывается 95 900 ₽ сразу за 12 месяцев
V4 — новое поколение (2026): гибридное внимание CSA+HCA, контекст 1M токенов по умолчанию, сильнее в коде и рассуждениях. При этом на 1M контексте требует лишь ~27% FLOPs и 10% KV-кэша от V3.2.
V4-Pro (1.6T / 49B активных) — максимум качества для сложных задач. V4-Flash (284B / 13B активных) — быстрый и дешёвый, почти догоняет Pro в рассуждениях. На ClodGPT доступны обе версии.
Нет. Через ClodGPT DeepSeek V4 работает без VPN и без зарубежных карт. Оплата через карту МИР или СБП.
Да. Веса V4-Pro и V4-Flash опубликованы на Hugging Face под свободной лицензией — модель можно запускать локально, дообучать и встраивать в свои продукты.
Три уровня: Non-think — быстрый ответ, Think High — логический анализ, Think Max — максимальная глубина рассуждения. В чате это Instant Mode (V4-Flash) и Expert Mode (V4-Pro).
1M токенов — это примерно 750 000 слов: целый монорепозиторий, книга или архив документов помещаются в один запрос без нарезки на части.
В ClodGPT: DeepSeek V4.1 Flash — 0,13 Т за сообщение, DeepSeek V3.2 — 0,48 Т за сообщение, DeepSeek V4 Flash — 0,16 Т за сообщение (типичное сообщение; точная сумма зависит от длины диалога). Есть на бесплатном тарифе — 5 запросов в день; Т списываются с месячной квоты тарифа — Base — 990 ₽/мес, Ultra — 1990 ₽/мес, Pro — 9990 ₽/мес. При годовой оплате скидка 20%.
Без VPN, оплата картой РФ. Бесплатный тариф: 5 запросов в день к GPT-5.6 Luna, Nano Banana 2 Lite, DeepSeek V4.1 Flash и DeepSeek V3.2, без списания Т, в одном запросе до 100 000 токенов.
Начать бесплатно