機能
ClawAIの会話の中でのAI画像生成
ClawAIの会話からGemini、OpenAI、xAI、またはローカルのStable Diffusionモデルを使って画像を生成・編集できます。プロバイダーのフォールバック、進捗表示、再試行もあらかじめ組み込まれています。
すべての機能 · 最終確認日:
一つのリクエストの背後に複数のプロバイダー
画像のリクエストは、Geminiの画像モデル、OpenAIのgpt-image-1、xAIのGrok Imagine、または自分のハードウェアで動くローカルのStable Diffusionモデル(SDXL-TurboとComfyUIワークフロー)で処理できます。選ばれたプロバイダーが失敗した場合、エラーを返すのではなく、リクエストは次のプロバイダーに移ります(まずクラウド、次にローカル)。
特定の画像モデルを自分で選んだ場合は、プロンプトに画像を示すわかりやすいキーワードが含まれていなくても、そのモデルが使われます。
会話の中で、進捗を見ながら生成
画像は生成中に進捗パネルを表示しながら、チャットの中に表示されます。生成をキャンセルすることも、結果が気に入らなければ別のプロバイダーで再試行することもできます。切り替えるための別の画像アプリはありません。
プロンプト、サイズ、編集
プロンプトは最大4,000文字で、画像は256〜4,096ピクセルのサイズで指定できます。最大25 MBの参照画像を添付すれば、一から作るのではなく既存の画像を編集できます。画像生成は有料プランの機能で、チャットのトークンとは別の独自の区分で計量されます。
よくある質問
- どのモデルが画像を生成しますか?
- Geminiの画像モデル、OpenAIのgpt-image-1、xAIのGrok Imagine、そしてローカルのStable Diffusionモデルです。どれが利用できるかは運営者の設定によって異なります。
- 手元にある画像を編集できますか?
- はい。最大25 MBの参照画像を添付して変更したい内容を説明すると、モデルは一から生成するのではなくその画像を編集します。
- 画像生成は無料プランで使えますか?
- 画像生成は有料プランの機能で、チャットとは別に計量されます。どのプランに含まれているかは料金ページでご確認いただけます。
言葉より、実際に試してください
画像生成は専用の画像サービスで動作し、クラウドからローカルモデルへのプロバイダーフォールバックを備え、IMAGEの区分で計量されます。