OpenAI ChatGPT Images GPT-6 Astra デザイン 実験

Images 2.5 × Astra:AI Frontierのブランドキット制作実験

Images 2.5 × Astra:AI Frontierのブランドキット制作実験

「AI Frontierのロゴを作り、一番良いものを選んでグッズまで作ってほしい」。AstraとImages 2.5に任せてみました。11分15秒で生成された画像は15枚。画質以上に興味深かったのは、結果を見て、自ら選び、修正する過程でした。

Images 2.5で何が変わったのか

OpenAIが9月8日に発表したImages 2.5には、高速生成のFlare精密な編集のSunburstがあります。参照画像の特徴の保持、繰り返し編集するときの一貫性、光や質感が主な改善点です。Flareの生成時間はImages 2.0より最大50%短くなったとされています。公式発表

両モデルのAPI単価は100万トークン当たり、テキスト入力が$5、画像入力が$8、画像出力が$30。1枚の費用はサイズ、品質、参照画像によって変わります。公式料金表

何度修正しても、それまでの変更は保たれるのか。 編集した画像をつなぎ、一貫性を示したOpenAIの公式動画で確認できます

もう一つは、完成前の画像を順に受け取れるストリーミングです。以下の公式APIの例では、途中の画像が届いた後に完成版が届きます。partial_imagesで途中画像を最大3枚までリクエストできます。公式ドキュメント

最初の途中画像:雪に覆われた谷と、まだ輪郭が曖昧な羽の川
① 途中画像
2枚目の途中画像:川と羽の形が具体的になった様子
② 途中画像
完成版:羽でできた川、フクロウ、冬山の細部
③ 完成版

特に目を引いたのはストップモーションです。同じキャラクターを少しずつ動かした画像を生成し、つなぐ方法です。OpenAIのCharlie Guoが公開した以下の例は、9月9日時点で約39万回閲覧されていました。フレームをつなぐ作業は別に必要で、制作の全工程や失敗回数は公開されていません。

サムネイル比較:今回は最新モデルのほうが安かった

まず、同じ参照画像と指示でサムネイルを比較しました。APIの設定はすべて1536x1024quality=highです。

モデル1枚当たりの費用¹目立った違い
Codex内蔵ツール別途API課金なし²スタイルは良好、余白は不足
GPT Image 1$0.260見出しが切れ、被写体と重なる
GPT Image 1.5$0.212韓国語の誤字:바꿔버린바꾸버린
GPT Image 2$0.188文字は良好、髪色と構図は指示から逸脱
2.5 Flare$0.065左側に見出し用の余白を最もうまく確保
2.5 Sunburst$0.065質感は良好、被写体が余白に入り込む
ChatGPT Image Latest$0.218スタイルは良好、行数と余白は一部のみ指示通り

¹ モデルごとに2回の呼び出しの平均。使用量と公式単価から計算しており、請求書との照合値ではありません。以前の記録の漏れを含めると、APIで生成した12枚の合計は約**$2.02**です。² Codexの4枚はサブスクリプションの利用枠内で生成し、内部モデルは確認できていません。

7つの画像生成バックエンドの背景に、同じ見出しを合成した比較
同じ見出しをコードで合成。Flareは文字と被写体の重なりが最も少ない結果でした。

今回は、文字の描画より構図の指示を守れるかが実用性を左右しました。 ただし、highのトークン予算は世代ごとに異なり、サンプルも少数です。モデル全体の順位を示すものではありません。

一度の依頼でブランドキットを作る

次は、Astraが企画・評価し、Flareが描く実験です。Responses APIの画像生成ツールを使い、生成結果をAstraに見せて評価させました。このツール連携自体は2.5以前から可能でした。APIドキュメント

AI Frontierのホームページの説明と、YouTubeのサムネイル3枚を事前に資料として渡しました。依頼を要約すると、次の通りです。

異なるロゴを作り、実際の結果を比較して一番良いものを選び、改善してください。そのロゴでブランドキットとグッズを作り、最も不十分な結果を一つ修正してください。追加の質問をせず、自分で選んでください。

候補4案 → 選択・改善 → 派生画像9枚 → 評価・修正。 この順序と段階ごとの自動指示は実行プログラムにあらかじめ設定しました。「一つのプロンプト」とは人間の依頼が一度という意味です。途中で人間がデザインを選んだり、修正指示を加えたりはしていません。

4つのロゴ案:A 開かれた境界、B かみ合う問い、C 未知の地平線、D 折り畳まれた探索路
A 開かれた境界 · B かみ合う問い · C 未知の地平線 · D 折り畳まれた探索路

Astraが選んだのはA「開かれた境界」。向かい合う二つの形が対話と開放性を表し、単色でも小さなサイズでも使いやすいという判断でした。一方で、括弧に見える可能性と、左右の線の太さが違う点を弱点として挙げました。

選ばれたA案と、改善後の基準ロゴ
選択したロゴ → 改善後の基準ロゴ。線の太さの差は縮まりましたが、完全には揃いませんでした。

このロゴを共通の参照画像にして派生物を作りました。インクのようなネイビー、温かみのある紙の色、青のアクセント、アイボリーの生地が全体をつないでいます。

AI Frontierの色、タイポグラフィ、素材をまとめたムードボード
色・書体・素材のムードボード。
修正後のAI Frontier KR横組みロゴ
最終的に選ばれた横組みロゴ。
AIがブランドを作ったら、という意味の韓国語見出しを入れたYouTubeサムネイル
韓国語の見出しは読めますが、ロゴにはにじみが残りました。
AI Frontier KRのバナー
バナーではロゴに線が加わり、角括弧の形になりました。
アイボリーのTシャツとパッチ付きキャップのモックアップ
Tシャツとキャップ。同じ生地の色と青いタグに統一感があります。
ステッカー、アクリルキーホルダー、キーキャップのモックアップ
ステッカー・キーホルダー・キーキャップ。線の分離や先端の変形が残りました。

同じブランドに見えることと、同じロゴを正確に保つことは別でした。 商品群の雰囲気は揃いましたが、ロゴの形は変わってしまいました。これらはモックアップであり、製造用データではありません。

ブランドキットをダウンロード PNG原本・サイズ別ファイル ロゴ、ムードボード、サムネイル、バナー、グッズのモックアップ。確認された不具合もそのまま含んでいます。

自分で直せても、評価を間違えることはある

Astraは横組みロゴのぼやけを修正対象に選びました。編集後は輪郭と中央のにじみが改善したとして、修正版を採用しました。

横組みロゴの修正前後の比較
修正前 → 修正後。鮮明にはなりましたが、基準ロゴと比率が正確に一致したわけではありません。

ただし、評価にも問題がありました。透明PNGが暗い背景に表示され、コントラストが低いと判断したのです。実験後、同じ画像を白い背景に置いて見せると、Astraは文字が読めないという評価を撤回しました。修正版のほうが良いという判断は変わりませんでした。

作り、見て、直す反復は機能しました。その一方で、適切な表示環境と、ロゴの形など必ず守るべき基準も必要です。ここでの自己改善はモデルの学習ではなく、成果物を繰り返し修正することを意味します。

時間と費用

本実験結果
API呼び出し / 生成画像20回 / 15枚
実行時間11分15秒
Astra入力 / 出力トークン101,056 / 15,239
使用量から計算したAstraの費用$1.95
画像出力の推定費用$0.64

本実験の小計は約$2.59、別途行った背景の比較評価1回を含めると約$2.69です。 画像ツールの入力費用はレスポンスに含まれておらず、除外しています。最終的な請求総額ではありません。Astraの費用はキャッシュ書き込みを反映した使用量計算、画像出力はサイズと品質に基づく公式計算機の推定値です。測定記録計算方法

プロンプト・コード・原本・使用量記録 実験資料 実行過程、評価、費用計算を確認できます。

次は、ロゴの原本を合成し、AIには背景や素材の表現を任せたいと思います。ストップモーションでも、キャラクターの12フレームを作り、Astraに一貫性が崩れたフレームだけを見つけて直させられそうです。この過程が実際の制作でどれほど手戻りを減らせるか。それが次の問いです。