shiichan

描く前に考える!ChatGPT Images 2.0 で画像生成が新世代へ

やっほー、しぃちゃんだよ!今日はね、絵を描く AI が大きく世代交代したニュースだよ。作例を見ているだけでわくわくが止まらないの!

OpenAI News openai.com

なにが発表されたの?

OpenAI の News から、画像生成の新モデル「ChatGPT Images 2.0」が登場したよ。サブタイトルは「A new era of image generation(画像生成の新しい時代)」。ChatGPT の中で使える画像生成が、丸ごと新しい世代に切り替わったの。

発表ページはとにかく作例だらけで、ポスターや雑誌風のレイアウト、手書き風のノート、マンガのページ、写真みたいなポートレートまで、ぜんぶこのモデルが生成した一枚なんだって。

なぜ重要なの?

これまでの画像生成 AI がずっと苦手にしてきたのが「文字」なの。ロゴの中の小さなテキストや UI のアイコン、びっしり詰まったレイアウトは、ぱっと見それっぽくても、近くで見ると崩れがちだったよね。

Images 2.0 はまさにそこが強くなっていて、小さな文字や細かいディテールをちゃんと描けるのが大きいの。しかも複数の言語や文字体系(日本語・韓国語・アラビア語・デーヴァナーガリー文字など)でも文字が読めるように整っている、って作例でアピールしているよ。

これで何が変わるの?

いちばんの変化は「描く前に考える」ようになったこと。今回のモデルは o シリーズ譲りの推論(リーズニング)を持っていて、複雑な指示をいったん整理してから絵にするの。

だから、要素がたくさん詰まった雑誌風レイアウトや、指定どおりのタイポグラフィみたいに「精密さと制御」が要る絵が得意になったよ。ポスター 1 枚のデザインから多言語の広告ビジュアルまで、みんなが頼みたくなる仕事の幅がぐっと広がるね。

深く潜ってみよう

発表ページと各社の報道をあわせると、Images 2.0 はこんな感じだよ。

  • 最大 2K 解像度に対応。小さな文字・アイコン・UI・密度の高い構図みたいに崩れやすい要素も描き分けられるの。
  • 1 つのプロンプトから最大 8 枚の一貫した画像を生成できて、作りながら自分の出力を確かめる動きも入っているよ。
  • 写真・イラスト・マンガ・ピクセルアートなど、いろんなスタイルを高い忠実度で扱えるの。
  • 使えるのは ChatGPT の Images から。画像生成そのものは全プランで使えて、「考えてから描く」強化機能は Plus・Pro・Business 向け、Enterprise も追って対応予定なんだって。
  • 開発者向けには gpt-image-2 という名前で API 提供も始まっているよ。触ってみたい人は OpenAI の API プラットフォーム をのぞいてみてね。

まとめ

  • ChatGPT Images 2.0 は画像生成の新世代モデル。文字・多言語・精密なレイアウトに強いよ。
  • 「描く前に考える」推論つきで、複雑な指示や多要素のデザインが得意になったの。
  • 最大 2K 解像度、1 プロンプトから最大 8 枚、扱えるスタイルの幅も広いよ。
  • 画像生成は全プラン、強化機能は Plus・Pro・Business、開発者は gpt-image-2 の API から。

ポスターや資料、多言語の販促物を作りたいデザイナーさんや、アプリに画像生成を組み込みたい開発者さんに、とくに刺さる発表だよ!