核心内容の要約
最近のAIによる画像生成分野では2つの大きな話題があります。1つは、マスクが推進するImagine Image 2.0で、その「精密なレイヤー編集機能」と「絵文字(エモジコン)」の機能により注目を集め、画像生成および編集分野で世界第2位にランクインしましたが、厳格な審査制度によりユーザーから不満の声も上がっています。もう1つは、OpenAIがこっそりとGPT-Image 2の新バージョン(コードネーム:mona-lisa-1)をテストしており、生成される画像のリアルさが大幅に向上し、OpenAI独自のウォータマークが付いています。ただし、知識データの更新は2025年5月までであり、簡易版またはオープンソースモデルではないかと推測されています。
詳細な解説
1. Imagine Image 2.0:「実用的な機能」で逆転を果たしたヒット作
このモデルの成功の秘訣は精密なレイヤー編集にあります。画像を複数の独立したレイヤー(例えば、画像内の服、顔、背景など)に分割し、PSを使わなくても直接編集できるのです:
- 絵文字の変更:例えば、「気が散るボーイフレンド」の画像では、彼女をミルクティーに変えたり、彼氏の視線をゲームを見ているように変更したりできます。
- 透明な背景のエクスポート:画像内の主要な要素(例えば猫)を選択してダウンロードすると、背景のない画像が得られ、絵文字やポスターに直接使用できます。
- 複数画像の統合:5枚の画像を一度にアップロードすると、モデルが自動的に1枚の画像に合成してくれます(例えば、風景、人物、テキストを組み合わせる)。
これらの機能により、Imagine Image 2.0は画像生成および編集分野で世界第2位にランクインし、マスクもX(Twitterの前身)で積極的に宣伝しています。
2. Imagine Image 2.0の長所と短所
長所は明らかです。GPT-Image 2がテキストベースの指示(例えば「背景を青色に変更する」)に頼るのに対し、Imagine Image 2ではレイヤーを直接操作するだけで簡単に編集できます。
しかし短所もあります。審査システムが非常に厳格で、例えばスパイダーマンの画像をアップロードすると「著作権保護」の理由で生成できない場合があり、微妙な内容でもすぐに拒否されるため、「面白い画像を作りたいのに邪魔だ」とユーザーから不満の声が上がっています。
3. OpenAIの新モデル:リアルさは向上したが「知識データの更新が止まっている**
ユーザーはOpenAIがmona-lisa-1をテストしていることに気づきました。その特徴は以下の通りです:
- リアルさの向上:GPT-Image 2の標準モードで生成された看板はAI製造だと一目でわかる(偽物っぽい)のに対し、新モデルではスマートフォンで撮影したような自然なリアルさがあります(動きのあるぼやけや光の不均一さがあります)。
- ウォータマークの存在:OpenAIの検証ツールを使うと、画像にSynthIDウォータマークが付いており、AI製造であることが証明されます。
ただし、知識データは2025年5月22日までしか更新されておらず、例えばAnthropic社のモデルのタイムラインを描かせると、2025年5月以降の内容が正しく表示されない問題があります。GPT-Image 2の簡易版(Mini)またはオープンソース化される予定のモデルではないかと推測されています。
4. AI画像生成技術の競争の変化
以前は、どのモデルがよりクリアで美しい画像を生成するか(例えばMidjourneyによる中国風の幻想的な画像)が競争の焦点でしたが、現在は以下の方向へと変わっています:
- ユーザーフレンドリーなインターフェース:Imagine Image 2のように、一般ユーザーでも簡単に画像を編集できる機能が求められています。
- リアルさの追求:OpenAIの新モデルはスマートフォンで撮影したような自然な感じを目指しており、AI特有の不自然さを避けています。
- 実用性の向上:絵文字の作成や会議用画像の編集など、ユーザーの実際のニーズに応える機能が求められています。
ユーザーはもはや「見た目だけ」でなく、「実際に使える」機能を求めています。
5. 未来への期待
これからAI画像生成技術がどのような新しい展開を見せるか?
現在、ユーザーは同じような情報画像に飽き始めており、今後は以下のような機能が求められるでしょう:
- 一貫性:一連の画像を生成する際に、キャラクターの外見やスタイルが変わらない(例えば漫画の連載で主人公が顔を変えない)。
- 大量のテキストの表示:多くのテキストが含まれる画像でも、テキストがはっきりと表示される。
- 創造的な美術性:Midjourneyのように、印象的な芸術的スタイルの画像を生成できる。
- より柔軟な編集機能:異なる画像の要素を自由に組み合わせたり、AIが自動的に欠けている部分を補完したりできる。
AI画像生成技術は「見せびらかし」の段階から、「実用性」へと徐々に進化しており、将来的には一般ユーザーの日常生活により密接に関わっていくでしょう。