DeepSeek V3.2
Пользователи Cherry Studio теперь могут через встроенный CherryIN бесплатно опробовать сервис DeepSeek V3.2——Флагманская модель Sparse Attention MoE от DeepSeek, выпущенная 1 декабря 2025 года; впервые нативно интегрирует «мышление» в вызов инструментов и является идеальным выбором для продвинутых агентных сценариев и длинного контекста.
🚀 Что такое DeepSeek V3.2?
DeepSeek V3.2 развилась на основе V3.2-Exp, использует архитектуру Mixture-of-Experts (MoE) и внедряет DeepSeek Sparse Attention (DSA) механизм разреженного внимания, который при сохранении сверхкрупного общего числа параметров значительно снижает стоимость вывода на длинном контексте.
Архитектура: MoE + DeepSeek Sparse Attention (DSA) + Multi-Head Latent Attention (MLA)
Общее число параметров: 685B
Активируемых параметров на токен: около 37B
Количество экспертов: 256 экспертов на слой
Лицензия с открытым кодом: MIT
Дата выпуска: 1 декабря 2025 года (V3.2-Exp был выпущен 29 сентября 2025 года)
Вместе с V3.2 был также выпущен ориентированный на API DeepSeek-V3.2-Speciale версия, показавшая золотой уровень на сложных задачах рассуждения на IMO, CMO, ICPC World Finals и IOI 2025.

📚 Продолжая солидный процесс обучения и выравнивания
DeepSeek V3.2 унаследовала зрелый обучающий пайплайн серии V3 и внесла ключевые расширения для сценариев Agent:
Масштабное предварительное обучение:базовое обучение было проведено на огромном количестве высококачественных многоязычных корпусов, охватывающих код, математику и научные знания.
Внедрение разреженного внимания:основная модель и lightning indexer обучались при длине последовательности 128K, при этом для каждого query-токена выбирались 2048 key-value токенов для участия во внимании.
Масштабная синтезировка данных для Agent:новый метод синтеза обучающих данных для Agent, охватывающий более 1 800 сред и более 85 000 сложных инструкций.
Интеграция мышления и вызова инструментов:V3.2 — первая модель DeepSeek, которая нативно интегрирует «мышление» в вызов инструментов и поддерживает использование инструментов как в «режиме мышления», так и в «без режима мышления».

⚙️ Ключевые возможности флагманского уровня
DeepSeek V3.2 делает ставку на комплексные возможности «на уровне GPT-5» и значительно усилен в Agent-сценариях и сложном рассуждении:
✅ Нативное мышление + вызов инструментов:первая модель DeepSeek, нативно интегрирующая «мышление» в использование инструментов
✅ Топовый уровень рассуждения:V3.2-Speciale достигла золотого уровня на IMO / CMO / ICPC World Finals / IOI 2025
✅ Код и задачи разработки:унаследовала сильные способности серии V3 в коде
✅ Стабильность длинного контекста:возможности анализа длинных документов и целых кодовых баз, обеспеченные DSA
✅ Структурированный вызов инструментов:подходит для создания Agent с многошаговым планированием и выполнением

💡 DeepSeek Sparse Attention: длиннее, экономичнее
DSA — ключевое технологическое обновление V3.2, посредством lightning indexer + тонкогранулярного выбора токенов реализует:
Впервые реализует тонкогранулярное разреженное внимание в крупной модели
Снижает основную сложность внимания с O(L²)
и заметно ускоряет обучение и вывод на длинном контексте, при этом сохраняя качество вывода почти таким же, как у плотного внимания
Короткий диалог / простые вопросы-ответы
Прямой вызов
Повседневные вопросы-ответы, резюмирование
Задачи средней сложности
Включить вызов инструментов
Анализ данных, рефакторинг кода
Сложные Agent-задачи
Мышление + вызов инструментов
Многошаговое планирование, анализ кодовой базы, обзор длинных документов
🌟 Открытость, доступность, дружелюбность к экосистеме
⚡ Ускорение рассуждений на длинном контексте благодаря DSA
💰 Через CherryIN в Cherry StudioБесплатное использование
🖥️ Открытые веса, лицензия MIT, поддержка с первого дня основных фреймворков инференса, таких как vLLM и SGLang

🧠 Фокус на практических возможностях: код и Agent
DeepSeek V3.2 особенно хорошо показывает себя в реальных рабочих процессах разработки:
Многоязычная генерация и рефакторинг кода
Понимание контекста на уровне репозитория и генерация патчей
Инструменты Agent: стабильный вызов внешних инструментов, поиск, выполнение кода
Математика и сложное рассуждение: поддержка задач соревновательного уровня
🧭 Как использовать в Cherry Studio?
Откройте Cherry Studio, перейдите в Настройки → Сервис моделей。
Найдите CherryIN поставщика услуг и включите.
В списке моделей выберите DeepSeek V3.2。
Вернитесь в чат, в верхнем выборе модели переключитесь на DeepSeek V3.2 и можно начинать разговор.
💡 Подсказка: бесплатный лимит моделей, предоставляемый CherryIN, покрывается официальной командой Cherry Studio и подходит для повседневного ознакомления и оценки; для production-среды рекомендуется использовать его вместе с официальным API DeepSeek.
📘 Немедленно попробуйте DeepSeek V3.2 и начните путешествие в мир флагманского рассуждения и Agent!
💡 Получить помощь и отправить отзыв
Если вы в процессе настройки или использования столкнётесь с любыми вопросами, багами или предложениями по улучшению функций, пожалуйста, обратитесь к Обратная связь и предложения официальным каналам, указанным там.
Последнее обновление
Это было полезно?