米OpenAIは、ChatGPTに統合されている画像生成アーキテクチャを抜本的に刷新した最新エンジン「ChatGPT Images 2.5」を正式にリリースしました。
本アップデートは、週あたり30億枚を超える世界規模の画像生成トラフィックを支えるため、推論レイテンシの大幅な削減と描写クオリティの極限向上を両立させたメジャーアップデートです。
最新の潜在拡散トランスフォーマー構造を採用することで、従来の課題であった画像内のタイポグラフィ(日本語を含む微細なテキスト描画)の誤字脱字を劇的に低減させました。
ポスターデザインや広告バナー、Web画面のワイヤーフレームなど、正確なテキスト配置が求められる業務コンテンツの直接生成が可能になっています。
さらに、同一プロンプトや連続したチャットセッション内における構図の破綻を防ぎ、人物の指先や物体の遠近感、ライティングの一貫性が大幅に改善されました。
複数オブジェクトが複雑に入り乱れるシーンでも各要素が溶け合わず、精密なセグメンテーションを維持したまま自然なフォトリアリズムを実現しています。
ChatGPT PlusおよびTeam、Enterpriseプランの全ユーザーに向けて即日ロールアウトされ、API経由での提供も順次開始されます(一次ソース:OpenAI Official Newsroom)。
