For the complete documentation index, see llms.txt. This page is also available as Markdown.

Разделение ролей моделей и рисование Agent

Один Agent может использовать три роли текстовых моделей и вызывать инструмент 【Генерация изображения】 через глобальную модель рисования. Сначала запустите задачу с простой конфигурацией, затем при необходимости разделите роли моделей.

Три роли моделей

Роль
Основные обязанности
Рекомендуемая отправная точка

Основная модель

Понимать цель, вызывать инструменты и генерировать основной результат

Выберите модель, которая уже проверенно стабильно умеет использовать инструменты

Модель Plan

Декомпозировать сложные задачи и составлять план

Сначала то же, что и у основной модели; разделяйте только если действительно нужно

Small-модель

Простые решения, классификация и форматирование

Сначала то же, что и у основной модели, чтобы не добавлять переменные слишком рано

Путь настройки: левое меню 【Работа】 → открыть меню Agent → 【Редактировать】 → 【База】.

Пусть Agent сразу генерирует изображение

Рисование в Agent использует глобальную модель рисования Cherry Studio, а не основную модель Agent.

1

1. Настройте модель рисования

Откройте 【Настройки】 → 【Модель по умолчанию】 → 【Модель рисования】 и выберите модель генерации изображений, уже доступную в сервисе моделей.

2

2. Проверьте инструмент изображений у Agent

Откройте окно редактирования Agent → 【Встроенные инструменты】 и убедитесь, что 【Генерация изображения】 включена.

3

3. Опишите изображение в 【Работе】

Сообщите Agent назначение изображения, главный объект, стиль, композицию, соотношение сторон и то, чего не должно быть. Например:

Сгенерируй для этого релизного текста обложку 16:9. На изображении должен быть настольный AI-рабочий стол в ночной обстановке, в сине-фиолетовой гамме, с местом для заголовка справа, без текста и логотипов бренда.
4

4. Проверьте вызов инструмента и результат

Генерация изображения может требовать подтверждения инструмента и может расходовать квоту сервиса. Сначала проверьте вызываемую модель и параметры, затем разрешите выполнение; результат будет показан прямо в задаче Agent.

默认模型设置中的绘画模型选择
После того как в модели по умолчанию выбрана модель рисования, Agent сможет использовать 【Генерация изображения】.

Часто используемые формулировки

Цель
Промпт должен содержать
Пример

Иллюстрация к статье

Тема, свободное пространство, цветовая гамма, соотношение сторон

«Горизонтальный формат 16:9, объект слева, справа оставить место для заголовка»

Эскиз продукта

Ракурс, материал, фон, ограничения

«Изометрический ракурс, белый фон, без текста»

Изображение для соцсетей

Соотношение для платформы, акцент, требования к тексту

«Квадратное, объект в центре, не генерировать текст»

Изменение по референсному изображению

Вложение, что сохранить и что изменить

«Сохранить персонажа и композицию, заменить только фон и цветовую гамму»

Agent 对话中启用生成图片工具并选择绘画模型
После настройки модели рисования Agent может напрямую генерировать изображения в задаче; если нужен шаблон для массового создания, тогда переходите в 【Рисование】.

Рекомендации по выбору

Требование
Рекомендуемый способ
Сценарий применения
Примечания

Иногда добавить картинку к документу

Включить 【Генерация изображения】 в Agent

Иллюстрации для отчётов, предложений и заметок

Сначала подтвердите размер, стиль и назначение

Многократно использовать один и тот же набор параметров изображения

Использовать шаблон 【Рисование】

Изображения бренда, обложки серии

Перед сохранением шаблона сначала проверьте результат один раз

Редактировать существующее изображение

В 【Рисовании】 предоставьте референсное изображение и требования к изменениям

Изменение цвета, расширение изображения, локальная корректировка

Сохраняйте оригинал, чтобы избежать необратимой перезаписи

Пример из практики: один релизный текст и три изображения

Контент-оператор поместил релизный текст в рабочую папку, чтобы Agent сначала выделил три визуальные темы, а затем по отдельности сгенерировал обложку, схему функции и квадратное изображение для соцсетей. Каждый раз он создавал только одну картинку и подтверждал направление, чтобы не тратить несколько вызовов сразу и потом не переделывать всё.

Почему 【Генерация изображения】 недоступна?

Сначала проверьте, выбрана ли в 【Настройки】 → 【Модель по умолчанию】 модель рисования, затем убедитесь, что соответствующий ей провайдер включён и соединение работает нормально. Наконец, проверьте, не отключён ли инструмент Agent 【Генерация изображения】.

Основная модель сама умеет рисовать — нужна ли ещё модель рисования?

Инструмент Agent 【Генерация изображения】 использует глобальную модель рисования. Даже если основная модель поддерживает мультимодальное понимание, она не заменяет настройку модели рисования здесь.

Последнее обновление

Это было полезно?