AI 模型
比較 FireRed Image Edit 上可用的 AI 圖像模型和 AI 影片模型,並打開最適合你工作流程的模型頁面或生成器。
AI 圖像模型
FireRed Image Edit
專注於局部重繪、物件替換、背景修改與風格微調的 AI 圖片編輯模型。適合在保留原圖主體結構與構圖的前提下,快速完成高品質且可控的編輯,特別適用於電商修圖、海報改圖、社群素材優化與創意二次加工。
Nano Banana 2
基於 Google Gemini Flash Image 的快速、實惠圖像生成模型,支援0.5K至4K解析度,適合日常高頻創作。
Nano Banana 2 Lite
Google DeepMind 速度最快、效率最高的 Gemini Image 模型,適合低延遲圖像生成與編輯。適用於快速草稿、參考圖改圖和輕量成本下的 1K 視覺探索。
Nano Banana Pro
面向高保真、高細節、對構圖與人物/物體一致性要求很高的專業生成模型。
Seedream 5.0 Lite
字節跳動新一代輕量級圖像生成模型,在保持旗艦級視覺品質的同時大幅提升生成速度。支援最多15張批量生成,提示詞理解能力強,適合高頻創作場景。
GPT-Image 1.5
專業級真實感圖像生成模型,擅長捕捉細膩的光影質感與自然的人物表情。支持文生圖和圖生圖兩種模式,在保真度和細節還原上表現出色,特別適合需要高度真實感的商業場景。
GPT Image 2
支援最多16張參考圖的多參考圖像生成模型,適合需要高一致性、強可控性與複雜需求表達的商業創作。支援文生圖與圖生圖,適用於電商主圖、角色設定、品牌海報與多圖融合場景。
Seedream 4.5
旗艦級視覺生成模型,擁有極致的自然語言理解力與光影表現力。它不再依賴機械的標籤堆砌,而是能聽懂「故事」與「氛圍」,在超寫實攝影與超現實藝術間自由切換。
FLUX.2
次世代工業級模型,突破了 AI 繪圖的「文字魔咒」。它擁有目前最強的指令遵循能力,不僅能完美生成圖片內的指定單詞/文本,還能精確控制複雜的人體手部動作與物體空間關係。
Z-Image
專為文本到圖像場景優化的模型,致力於把複雜描述準確映射為視覺元素,尤其擅長概念化與抽象描述還原。
Grok 4.2 Image
xAI 最新的 Grok 4.2 圖像生成模型,擅長創意構圖與風格化表達,支持文生圖和圖生圖,在人物肖像、場景渲染和藝術創作方面表現出色。
FLUX.2 Klein 9B
黑森林實驗室推出的超速輕量圖像生成模型,9B參數量實現極快出圖速度,適合高頻批量生成和快速迭代場景。
Nano Banana
速度優先的通用圖片生成模型,平衡質量與效率,適合快速迭代與日常創作。
GLM Image
智譜AI的文生圖模型,中英文雙語理解能力強。生成速度快、成本極低,適合快速內容創作。
AI 影片模型
Veo 3.1
Google 最新旗艦影片生成模型。Veo 3.1 Quality 擁有業界頂尖的光影物理引擎和超高保真度,能完美還原現實世界的紋理、動態與細節。支援 16:9、9:16 和自動寬高比,適合商業級高品質影片製作。
Sora 2
Sora 系列的標準版本。在保持 OpenAI 優秀的語義理解能力的同時,優化了生成速度與成本。非常適合快速驗證分鏡腳本、社群媒體短影音製作及通用創意生成。
HappyHorse
HappyHorse 是阿里巴巴下一代多模態視頻生成模型,原生支援音視頻協同生成。單一模型涵蓋四種場景——文字生視頻、圖像生視頻、多圖參考生視頻、視頻原位編輯,非常適合廣告、電商、短劇與社群創意內容。
Wan 2.6
Wan 2.6 是一款先進的影片生成模型,支援文字生成影片、圖片生成影片和影片轉影片三種模式。提供 5秒、10秒、15秒 的時長選項 and 720p、1080p 兩種解析度,支援多鏡頭切換功能,適合創作多樣化的影片內容。
Kling 動作控制
Kling 動作控制模型,通過上傳參考圖片和視頻,精準控制角色的動作和姿態。支持3-30秒視頻,可生成與參考一致的角色動作,適合角色動畫 and 動作遷移場境。
Kling 2.6
以驚人的動作一致性和物理規律捕捉著稱。Kling 2.6 擅長生成大幅度的人物動作、複雜的物體交互以及電影級的運鏡效果,畫面細膩且連貫。
Seedance 1.5 Pro
字節跳動先進的影片生成模型。Seedance 1.5 Pro 擅長角色動畫,具有精準的口型同步和自然的表情。擁有逼真的運動物理效果,支援多種影片比例(1:1、21:9、4:3、3:4、16:9、9:16),提供靈活的時長選項(4秒、8秒、12秒),並可選擇生成音訊。
Seedance 2
ByteDance 新一代影片生成模型。Seedance 2 著重高畫質畫面、複雜動作表現與多模態參考控制,支援文字、圖片、影片與音訊輸入,適合需要更高一致性與更強鏡頭語言的專業影片創作。
Seedance 2.5
ByteDance 新一代影片生成模型,支援文字生影片、首尾幀圖片生影片及多模態參考生影片。支援圖片、影片、音訊參考,提供 480p/720p、4–30 秒時長及可選音訊生成。
Seedance 2 Fast
Seedance 2 的高速版本,兼顧生成速度與成本效率。適合快速迭代創意、批量測試提示詞與高頻內容生產,同時保留圖片、影片與音訊參考的支援。
Seedance 2 Mini
Seedance 2 的輕量低成本版本。支援首尾幀與多模態參考,適合草稿、社交短片與大批量試跑。
Grok Imagine
xAI 推出的創意視頻生成模型。Grok Imagine 擅長將文本描述轉化為富有想像力的視頻內容,支持多種寬高比(2:3、3:2、1:1、9:16、16:9),提供 fun、normal、spicy 三種風格模式,適合創意內容製作和快速原型驗證。
Grok Imagine 1.5 Preview
Grok Imagine 1.5 Preview is a newer xAI-style video model for fast text-to-video and image-to-video creation. It supports 16:9 and 9:16 aspect ratios, 480p and 720p resolution, and short duration controls for social clips, ads, and creative tests.
Grok Video
Grok Video 是 xAI 推出的高級視頻生成模型,支持 6秒、10秒、12秒、16秒和20秒多種時長。支持文生視頻和圖生視頻,最多可上傳5張參考圖片。提供多種寬高比(16:9、9:16、2:3、3:2、1:1),支持最長5000字符的提示詞。
Gemini Omni
Gemini Omni 是 Google 基於 Omni-Flash-Ext 的先進視頻生成模型。支援文字生成視頻、單圖生成視頻和3張參考圖融合。支援 4/6/8/10 秒時長,提供 16:9 和 9:16 寬高比。
PixVerse V6
PixVerse V6 是一款靈活的影片生成模型,支援文字生影片、圖片生影片、首尾幀轉場及影片延伸。支援 360p 至 1080p、1 至 15 秒影片,以及可選的原生音訊。