> For the complete documentation index, see [llms.txt](https://docs.cherryai.com.cn/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.cherryai.com.cn/docs/jp/advanced-basic/agent-workspace/models-image.md).

# モデルの役割分担と Agent 画像生成

1つの Agent は3種類のテキストモデル役割を使用でき、グローバルの描画モデルを通じて【画像を生成】ツールを呼び出せます。まずはシンプルな構成でタスクを動かし、必要に応じてモデル役割を分割してください。

## 3種類のモデル役割

| 役割        | 主な責務                      | 推奨の開始値                         |
| --------- | ------------------------- | ------------------------------ |
| メインモデル    | 目標を理解し、ツールを呼び出して主な結果を生成する | ツールを安定して使えると確認済みのモデルを1つ選ぶ      |
| Plan モデル  | 複雑なタスクを分解し、計画を立てる         | まず主モデルと同じにし、本当に必要だと確認できてから分割する |
| Small モデル | 簡単な判断、分類、フォーマット整形         | まず主モデルと同じにし、変数を早く増やしすぎないようにする  |

設定パス：左側ナビゲーションの【作業】→ Agent メニューを開く→【編集】→【基本】。

{% hint style="warning" %}
進行中のタスクのモデルを切り替えると、その後の返信の一貫性が変わる場合があります。すでに生成が始まっている返信は設定変更で中断されず、新しいモデルは次のメッセージから使用されます。
{% endhint %}

## Agent に直接画像を生成させる

Agent の描画には Cherry Studio のグローバル描画モデルが使われ、Agent の主モデルではありません。

{% stepper %}
{% step %}

### 1. 描画モデルを設定する

【設定】→【デフォルトモデル】→【描画モデル】を開き、モデルサービスで利用可能な画像生成モデルを選択します。
{% endstep %}

{% step %}

### 2. Agent の画像ツールを確認する

Agent の編集ウィンドウ→【内蔵ツール】を開き、【画像を生成】が有効になっていることを確認します。
{% endstep %}

{% step %}

### 3. 【作業】で画像を説明する

画像の用途、主題、スタイル、構図、比率、そして入れたくない内容を Agent に伝えます。例えば：

```
この製品発表原稿のために、16:9 のヘッダー画像を生成してください。画面は夜のデスク上の AI ワークベンチ、青紫系の色調、右側にタイトル用の余白を確保し、文字やブランドロゴは入れないでください。
```

{% endstep %}

{% step %}

### 4. ツール呼び出しと結果を確認する

画像生成にはツールの承認が必要な場合があり、サービス利用量が発生することもあります。呼び出し先のモデルとパラメータを確認してから実行を許可してください。結果は Agent のタスク内に直接表示されます。
{% endstep %}
{% endstepper %}

<figure><img src="/files/3a09ddc89a7d777b9345d359477d22aa25206ae7" alt="默认模型设置中的绘画模型选择"><figcaption><p>デフォルトモデルで描画モデルを選んだ後、Agent は【画像を生成】を使用できます。</p></figcaption></figure>

## よく使う書き方

| 目的         | プロンプトに含めるべき内容         | 例                         |
| ---------- | --------------------- | ------------------------- |
| 記事用の挿絵     | テーマ、余白、色調、比率          | 「横長 16:9、左側に主題、右側にタイトル領域」 |
| 製品スケッチ     | 視点、素材、背景、制約           | 「等角投影、白背景、文字なし」           |
| SNS用画像     | プラットフォーム比率、焦点、文字の要件   | 「正方形、中央に主題、文字は生成しない」      |
| 参考画像に基づく修正 | 添付ファイル、残したい部分、変更したい部分 | 「人物と構図は維持し、背景と色調だけ差し替える」  |

<figure><img src="/files/919ead18e0e187968feec11caf55622a43c7ae74" alt="Agent 对话中启用生成图片工具并选择绘画模型"><figcaption><p>描画モデルの設定が完了すると、Agent はタスク内で直接画像を生成できます。テンプレート化した大量制作が必要なときにだけ【描画】へ進みます。</p></figcaption></figure>

## 選択のおすすめ

| 要件                | 推奨方法                 | 適用場面             | 注意事項                      |
| ----------------- | -------------------- | ---------------- | ------------------------- |
| たまにドキュメント用の画像を添える | Agent で【画像を生成】を有効にする | レポート、提案書、ノート用の挿絵 | まずサイズ、スタイル、用途を確認する        |
| 同じ画面パラメータを繰り返し使う  | 【描画】テンプレートを使う        | ブランド画像、シリーズ表紙    | テンプレートを保存する前に、まず1回結果を確認する |
| 既存画像を編集する         | 【描画】で参考画像と修正要件を提供する  | 色変更、拡張、部分調整      | 元画像を保持し、元に戻せない上書きを避ける     |

## ユーザー事例：1本の発表原稿に3枚の画像

コンテンツ運営担当者は発表原稿を作業ディレクトリに入れ、Agent にまず3つのビジュアルテーマを抽出させ、その後それぞれヘッダー画像、機能説明図、SNS用の正方形画像を生成させました。毎回1枚だけ生成して方向性を確認することで、一度に複数回の呼び出しを消費して、結局すべてやり直しになるのを避けています。

<details>

<summary>なぜ【画像を生成】が使えないのですか？</summary>

まず【設定】→【デフォルトモデル】で描画モデルが選択されているか確認し、次にそのモデルに対応するサービス提供元が有効で接続正常かを確認してください。最後に Agent の【画像を生成】ツールがオフになっていないか確認します。

</details>

<details>

<summary>主モデル自体が画像を描ける場合でも、描画モデルは必要ですか？</summary>

Agent の【画像を生成】ツールはグローバル描画モデルを使用します。主モデルがマルチモーダル理解に対応していても、ここでの描画モデル設定の代わりにはなりません。

</details>


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.cherryai.com.cn/docs/jp/advanced-basic/agent-workspace/models-image.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
