OpenAI
OpenAI GPT Image 2は、生成前に構図を計画する、品質優先の推論型画像モデルです。最先端の文字レンダリング、多言語タイポグラフィ、最大16枚の参照画像による高忠実度な編集を実現し、出力は最大4Kに対応します。
GPT Image 2は、OpenAIの次世代画像モデルで、2026年4月21日にChatGPT Images 2.0として発表され、その後まもなくgpt-image-2 APIとして展開されました。速度と品質のバランスを重視したGPT Image 1.5に対し、GPT Image 2は品質優先のアプローチを採用しています——レンダリングの前に画像構造について能動的に調査・計画・推論を行う、OpenAIが「初の真にエージェント的な画像生成モデル」と位置づける仕組みです。Image Arenaのリーダーボード全体で首位を獲得し、文生図(Text-to-Image)部門では1,512点、2位に+242ポイントの差をつけています。これは、文字の正確さの大幅な向上、密度の高い構図への対応、そして日本語・韓国語・中国語・ヒンディー語・ベンガル語にわたる多言語レンダリングによるものです。文生図と図生図の両方が単一のエンドポイント群でサポートされており、最大16枚の参照画像を組み合わせて被写体・スタイル・レイアウトを統合できます。1:1から21:9、9:16まで11種類のアスペクト比をカバーし、1回のリクエストで1、2、3、4枚のいずれかを生成できます。Astorieでは1K・2K・4Kの3段階の解像度を提供しているため、納品物に応じて出力を選べます。キャンバスにドロップして、推論された文字と商品訴求ポイントを含むメインビジュアルを下書きし、FLUX Kontextに接続してキャラクターバリエーションを作成したり、Runway Gen4やKlingの動画ノードに接続して結果をアニメーション化したりできます。

Connect GPT Image 2 with other AI models on Astorie's infinite canvas. No GPU required — start free.
Get Started FreeGPT Image 1.5は低・中・高の品質級と透明背景対応により、速度と品質のバランスを取っています。GPT Image 2は、レンダリング前に画像を計画する品質優先の推論モデルで、最大16枚の参照入力に対応し、Image Arenaの文生図リーダーボードで+242ポイントの差をつけて首位、出力は最大4Kですが、透明背景には対応していません。最上位の文字精度と多言語レイアウトが必要なら2を、透明背景や最も軽量な級が必要なら1.5を選びましょう。
GPT Image 2は1K・2K・4Kの3段階の解像度を提供しています。1回の生成で1、2、3、4枚のいずれかをリクエストでき、1:1から21:9、9:16まで11種類のアスペクト比から選べます。
できます。GPT Image 2は図生図編集に対応しており、1回のリクエストで最大16枚の参照画像を受け付けます。そのため、被写体・スタイル参照・レイアウト参照を1回の処理で組み合わせることができ、商品バリエーション、多言語広告セット、参照主導の構図制作に役立ちます。
OpenAI
OpenAI GPT Imageは、GPT-4アーキテクチャから直接画像を生成し、高度な言語理解と画像生成を組み合わせたモデルです。GPT Image 1と1.5を提供しており、品質と背景のコントロールが可能です。
View detailsMidjourney
Midjourney v7は、このカテゴリーで最も強い美学的個性を持つ、最も認知度の高いAI画像生成モデルです。Astorieでは、写実的・絵画的表現に強いV7、アニメ表現に特化したNiji 7、キャラクターを固定するOmni Reference、そして繊細な調整が可能なStylization・Variety・Weirdnessの3つのスライダーを、すべてキャンバス上から——Discord不要で——利用できます。
View detailsBlack Forest Labs
Black Forest Labs開発のFLUXは、写実的な出力と優れたプロンプト再現度で知られる、高速・高品質な画像生成モデルファミリーです。無料枠で使えるDevモデルから超高解像度のPro出力まで、幅広いバリエーションを揃えています。
View details