AIモデル
FireRed Image Edit で利用できる AI画像モデルと AI動画モデルを比較し、ワークフローに合うモデルページまたは生成ツールを開けます。
AI画像モデル
FireRed Image Edit
部分的な再描画、オブジェクト置換、背景変更、スタイル調整に特化した AI 画像編集モデルです。元画像の主要構図や被写体を保ちながら、高品質でコントロールしやすい編集を素早く行えるため、EC商品画像の修正、ポスター更新、SNS素材の最適化、クリエイティブな再加工に最適です。
Nano Banana 2
最大14枚の参照画像、Google検索、4K出力をサポートする次世代マルチモーダル画像生成モデル。最大20,000文字の超長プロンプトでより高い創作の柔軟性を提供します。
Nano Banana 2 Lite
Google DeepMind の最速かつ最も効率的な Gemini Image モデル。低レイテンシの画像生成と編集に向き、素早い下書き、参照画像編集、軽量なビジュアル探索に使えます。
Nano Banana Pro
高忠実度、高精細、構図と人物/物体の一貫性が求められるプロフェッショナルな生成モデル。
Seedream 5.0 Lite
次世代軽量画像生成モデル。強化されたセマンティック理解とフォトリアリスティックなレンダリングを備え、2Kおよび3K出力解像度での高速・高品質なテキストから画像への生成に最適化されています。
GPT-Image 1.5
プロフェッショナルグレードの写実的な画像生成モデルで、繊細な光と影の質感と自然な人物の表情を捉えることに特化しています。テキストから画像、画像から画像の両方のモードをサポートし、忠実度とディテールの再現性に優れた性能を発揮し、特に高い写実性を必要とする商業シーンに適しています。
GPT Image 2
最大16枚の参照画像に対応したマルチリファレンス画像生成モデル。高い一貫性、強いコントロール性、複雑な商用ワークフロー向けに設計されており、テキストから画像・画像から画像の両方に対応します。
Seedream 4.5
究極の自然言語理解力と光影表現力を備えたフラッグシップ視覚生成モデル。機械的なタグの羅列に頼るのではなく、「物語」や「雰囲気」を理解し、超写実的な写真と超現実的なアートの間を自由に切り替えます。
FLUX.2
AI描画の「テキストの呪縛」を打ち破る、次世代の産業グレードモデル。現在最強の指示遵守能力を持ち、画像内の指定された単語/テキストを完璧に生成するだけでなく、複雑な手の動きや物体の空間関係も正確に制御できます。
Z-Image
テキストから画像へのシーンに最適化されたモデル、複雑な記述を視覚的要素に正確にマッピングすることに専念し、特に概念化と抽象的な記述の再現に優れています。
Grok 4.2 Image
xAI's latest Grok 4.2 image generation model, excelling at creative composition and stylized expression. Supports text-to-image and image-to-image, with outstanding performance in portraits, scene rendering, and artistic creation.
FLUX.2 Klein 9B
Black Forest Labs' ultra-fast lightweight image generation model with 9B parameters, delivering blazing speed for high-frequency batch generation and rapid iteration workflows.
Nano Banana
速度優先の汎用画像生成モデル、品質と効率のバランスを取り、迅速な反復と日常の制作に適しています。
GLM Image
Zhipu AIのテキスト画像生成モデル。中国語・英語のバイリンガル理解に優れ、超低コストで高速生成。
AI動画モデル
Veo 3.1
Googleの最新フラッグシップ動画生成モデル。Veo 3.1 Qualityは業界最高峰の物理エンジンと超高忠実度を備え、現実世界の質感、動き、細部を完璧に再現します。16:9、9:16、自動アスペクト比に対応し、商用高品質動画制作に最適です。
Sora 2
Soraシリーズの標準版。OpenAIの優れたプロンプト理解力を維持しつつ、速度とコストを最適化。絵コンテ、SNS動画、迅速なクリエイティブ制作に最適です。
HappyHorse
HappyHorse はアリババの次世代マルチモーダル動画生成モデルで、音声と映像のネイティブな協調生成に対応。単一モデルでテキスト→動画、画像→動画、複数画像参照→動画、動画内インプレイス編集の 4 シーンをカバーし、広告・EC・ショートドラマ・SNS クリエイティブに最適です。
Wan 2.6
Wan 2.6は、テキストから動画、画像から動画、動画から動画の3つのモードをサポートする先進的な動画生成モデルです。5秒、10秒、15秒の長さオプションと720p、1080pの解像度を提供し、多様な動画コンテンツ作成に適したマルチショット機能を備えています。
Kling モーションコントロール
Kling モーションコントロールモデルは、アップロードされた参照画像と動画を通じて、キャラクターの動きと姿勢を正確に制御します。3〜30秒の動画をサポートし、参照と一致したキャラクターアクションを生成でき、キャラクターアニメーションとモーション転送シナリオに最適です。
Kling 2.6
複雑な動きや物理法則の再現で有名です。Kling 2.6は、ダイナミックなキャラクターの動き、複雑な物体の相互作用、映画のようなカメラワークを滑らかに生成することに優れています。
Seedance 1.5 Pro
ByteDanceの先進的な動画生成モデル。Seedance 1.5 Proは、精密なリップシンクと自然な表情を持つキャラクターアニメーションに優れています。リアルな動きの物理演算を備え、複数のアスペクト比(1:1、21:9、4:3、3:4、16:9、9:16)に対応し、柔軟な長さオプション(4秒、8秒、12秒)とオプションの音声生成を提供します。
Seedance 2
ByteDanceの次世代動画生成モデル。Seedance 2 は高画質な映像、複雑な動き、そしてマルチモーダルな参照制御に重点を置いています。テキスト、画像、動画、音声入力をサポートし、より高い一貫性と豊かなカメラ表現が求められる本格的な映像制作に適しています。
Seedance 2.5
ByteDanceの次世代動画生成モデル。テキストからの動画生成、始点・終点フレームによる画像から動画生成、画像・動画・音声を組み合わせた参照生成に対応し、480p/720p、4〜30秒、音声生成を利用できます。
Seedance 2 Fast
Seedance 2 の高速かつ高コスト効率版。アイデアの高速反復、プロンプトの一括テスト、高頻度なコンテンツ制作に最適で、画像・動画・音声の参照入力も引き続きサポートします。
Seedance 2 Mini
Lightweight Seedance 2 for lower-cost drafts with first/last frames and multimodal references.
Grok Imagine
xAI が提供するクリエイティブな動画生成モデル。Grok Imagine はテキスト記述を想像力豊かな動画コンテンツに変換することに優れており、複数のアスペクト比(2:3、3:2、1:1、9:16、16:9)をサポートし、fun、normal、spicy の3つのスタイルモードを提供します。クリエイティブコンテンツ制作と迅速なプロトタイピングに最適です。
Grok Imagine 1.5 Preview
Grok Imagine 1.5 Preview is a newer xAI-style video model for fast text-to-video and image-to-video creation. It supports 16:9 and 9:16 aspect ratios, 480p and 720p resolution, and short duration controls for social clips, ads, and creative tests.
Grok Video
Grok Video は xAI の高度な動画生成モデルで、6秒、10秒、12秒、16秒、20秒の複数の長さに対応。テキストから動画、画像から動画をサポートし、最大5枚の参照画像を使用可能。複数のアスペクト比(16:9、9:16、2:3、3:2、1:1)と最大5000文字のプロンプトに対応。
Gemini Omni
Gemini OmniはGoogleのOmni-Flash-Extベースの先進的な動画生成モデルです。テキストから動画、画像から動画、3枚の参照画像融合に対応。4/6/8/10秒の長さと16:9、9:16のアスペクト比をサポートします。
PixVerse V6
PixVerse V6 は、テキストからの動画生成、画像アニメーション、始点・終点フレームのトランジション、動画延長に対応する柔軟なモデルです。360p〜1080p、1〜15秒、ネイティブ音声を選べます。