DeepSeek V3.2
Пользователи Cherry Studio теперь могут через встроенный CherryIN бесплатно попробовать сервис DeepSeek V3.2——Флагманская модель MoE со sparse attention от DeepSeek, выпущенная 1 декабря 2025 года, впервые нативно интегрировала «мышление» в вызов инструментов и является идеальным выбором для продвинутых Agent-сценариев и длинного контекста.
Что такое DeepSeek V3.2?
DeepSeek V3.2 развилась на основе V3.2-Exp, использует архитектуру Mixture-of-Experts (MoE) и внедряет DeepSeek Sparse Attention(DSA) механизм sparse attention, который значительно снижает стоимость вывода на длинном контексте, сохраняя при этом сверхкрупное общее число параметров.
Архитектура: MoE + DeepSeek Sparse Attention(DSA)+ Multi-Head Latent Attention(MLA)
Общее число параметров: 685B
Активируемых параметров на токен: около 37B
Число экспертов: 256 экспертов на слой
Открытая лицензия: MIT
Дата выпуска: 1 декабря 2025 года (V3.2-Exp выпущена 29 сентября 2025 года)
V3.2 также выпустила ориентированную на API DeepSeek-V3.2-Speciale версию, которая на сложных задачах рассуждения показала уровень золотой медали на IMO, CMO, ICPC World Finals и IOI 2025.

Продолжая прочный процесс обучения и согласования
DeepSeek V3.2 унаследовала зрелую тренировочную pipeline серии V3 и внесла ключевые расширения для сценариев Agent:
Масштабное предобучение:базовое обучение выполнено на огромном объёме высококачественного многоязычного корпуса, охватывающего код, математику и научные знания.
Введение sparse attention:основная модель и lightning indexer обучались на длине последовательности 128K; для каждого query-токена выбираются 2048 key-value токенов для участия во внимании.
Масштабный синтез данных для Agent:новый метод синтеза обучающих данных для Agent, охватывающий более 1 800 сред и более 85 000 сложных инструкций.
Объединение мышления и вызова инструментов:V3.2 — первая модель DeepSeek, нативно интегрировавшая «мышление» в вызов инструментов; поддерживает вызов инструментов как в «режиме мышления», так и в «режиме без мышления».

Флагманские ключевые возможности
DeepSeek V3.2 делает ставку на комплексные возможности «на уровне GPT-5» и значительно усилена в Agent-сценариях и сложных рассуждениях:
✅ Нативное мышление + вызов инструментов:первая модель DeepSeek, интегрировавшая мышление в использование инструментов
✅ Топовые способности к рассуждению:V3.2-Speciale достигла золотого уровня на IMO / CMO / ICPC World Finals / IOI 2025
✅ Код и задачи разработки:унаследовала сильные способности серии V3 в коде
✅ Стабильность на длинном контексте:возможности анализа длинных документов и целых кодовых баз благодаря DSA
✅ Структурированный вызов инструментов:подходит для построения Agent с многошаговым планированием и выполнением

DeepSeek Sparse Attention: длиннее и экономичнее
DSA — ключевое технологическое обновление V3.2, посредством lightning indexer + тонкогранулярного выбора токенов реализует:
Впервые реализует тонкую sparse attention в большой модели
Снижает ключевую сложность внимания с O(L²)
значительно ускоряя обучение и инференс на длинном контексте, при этом сохраняя почти такое же качество вывода, как у плотного внимания
Короткие диалоги / простые вопросы и ответы
Прямой вызов
Повседневные вопросы и ответы, резюме
Задачи средней сложности
Включить вызов инструментов
Анализ данных, рефакторинг кода
Сложные задачи Agent
Мышление + вызов инструментов
Многошаговое планирование, анализ кодовой базы, обзор длинных документов
Открыто, доступно, дружественно к экосистеме
⚡ Ускорение вывода на длинном контексте благодаря DSA
💰 Через CherryIN в Cherry Studio Бесплатное использование
🖥️ Открытые веса, лицензия MIT, поддержка популярных фреймворков инференса, таких как vLLM, SGLang, с первого дня

Фокус на практических возможностях: код и Agent
DeepSeek V3.2 особенно хорошо показывает себя в реальных рабочих процессах разработки:
Генерация и рефакторинг кода на нескольких языках
Понимание контекста на уровне репозитория и генерация патчей
Инструментальная цепочка Agent: стабильный вызов внешних инструментов, поиск, выполнение кода
Математика и сложные рассуждения: поддержка задач соревновательного уровня
Как использовать в Cherry Studio?
Откройте Cherry Studio, перейдите в Настройки → Сервисы моделей.
Найдите CherryIN провайдера сервиса и включите его.
В списке моделей выберите DeepSeek V3.2.
Вернитесь в чат, в верхнем выборе модели переключитесь на DeepSeek V3.2 и можно начинать диалог.
💡 Подсказка: бесплатная квота моделей, предоставляемая CherryIN, оплачивается официальной командой Cherry Studio; подходит для повседневного тестирования и оценки. Для production-среды рекомендуется использовать вместе с официальным API DeepSeek.
📘 Попробуйте DeepSeek V3.2 прямо сейчас и начните путешествие в мир флагманских рассуждений и Agent!
Получить помощь и отправить отзыв
Если у вас в процессе настройки или использования возникнут какие-либо вопросы, баги или предложения по улучшению функций, пожалуйста, обратитесь к Отзывы и предложения официальным каналам, указанным там.
Последнее обновление
Это было полезно?