OpenAI は ChatGPT Images 2.5 をリリースしました。Google の Nano Banana 2 との比較は次のとおりです。

in tech

大渦の中で 他のすべて それが今 AI で起こっています。OpenAI は ChatGPT Images 2.5 をプッシュしました。 それは次のように説明します より速く、よりシャープに、よりスマートに、「夢見るものすべてを作成できる優れたツール」を提供します。これらの新しいツールには、テンプレート、より正確な編集機能、画面上の落書きを完全に実現された画像に変換する方法が含まれています。

これらすべては、ChatGPT Images 2.5 がメニューやポスター上の悪質な AI 食品画像の惨劇から私たちを救ってくれることを意味するのでしょうか?従来のフォトエディタに代わるものでしょうか?それと比べてどうですか 印象的なNano Banana 2アップデート Googleが2月にプッシュしたのは?

これらすべての質問やその他の質問に答えるために、ChatGPT で新しい画像ジェネレーターを起動して、その機能を確認しました。誰もがそれを理解しています。現在、ウェブ、デスクトップ アプリ、モバイル アプリのすべてのユーザーに展開されています。ただし、いつものようにさまざまな使用制限があります (ChatGPT 漠然としか定義していない)各プランごとに異なります。

ChatGPT Images 2.5 と Gemini Nano Banana 2 の食べ物画像の比較

ChatGPT 画像 2.5 対 Google Nano Banana 2

左側はChatGPT Images 2.5。右がGemini Nano Banana 2。
クレジット: ライフハッカー

レストランの看板やメニューにある AI 生成の料理の同一性と不気味さは、 現実的な問題になりつつあるしたがって、ここから始めるのが良いと思われました。食品のプロモーション画像には常に芸術的ライセンスが必要であると言えますが、AI が問題をさらに悪化させています。 ChatGPT 画像 2.5 は役に立ちますか?

私が試したことは次のとおりです。「ファストフード レストランのディスプレイ用に、内部に 4 つの正方形を含むアスペクト比 1:1 の画像を作成します。画像には、(上から下、左から右に) チーズバーガー、ナゲット 6 個、フライドポテトの箱、コーラが表示されます。自然光を使用して写真をできるだけ写実的に見せますが、実際の食べ物の印象を与えるために変化や不完全さを追加します。」

左側がChatGPT、右側がGeminiです。どちらも、一般的な AI の傾向はあるものの、現実的に見えて実際に食べられるメニュー項目を作成するという点で、適切な仕事をしています。個人的には、ChatGPT の画像はもう少し本物の食べ物に似ていると思いますが、背景や幅広いシーンでは Gemini の方が優れています (ただし、バーガーキングのロゴがあると問題が発生します)。

ChatGPT 画像 2.5 対 Google Nano Banana 2

左から: 人間の創造性、ChatGPT、Gemini。
クレジット: ライフハッカー

ChatGPT Images 2.5 の主要な新機能の 1 つは、基本的な落書きを完全な画像に変換できる新しいスケッチ ツールです。をクリックまたはタップします。 + プロンプト ボックスの (プラス) ボタンをクリックして見つけます。モバイルを使用している場合は、選択する必要もあります。 プラグイン ポップアップされるサブメニューから。

このツールを使用すると、色、形、テキストをいじることができ、完了したら、テキスト プロンプトを追加できます。たとえば、「このスケッチを、星や遠く離れた惑星が描かれた、高品質の児童書で見られるようなイラストに変換します」 (これが、私がここで使用したプロンプトです) などです。

Gemini には Sketch ツール自体がありませんが、インスピレーションを得るためにプロンプ​​トに画像を追加するのは簡単です。 Google の AI は、より伝統的なイラストを採用し、エイリアンの宇宙飛行士を登場させることにしましたが、ChatGPT は、より現実的な表現を使用しました。どちらも十分に仕事をしてくれますが、もし選ぶならジェミニの方を選ぶと思います。

ChatGPT Image 2.5 はより正確な編集を提供します

ChatGPT 画像 2.5 対 Google Nano Banana 2

どちらの森の小屋も専門的に編集されました (左が ChatGPT、右がジェミニ)。
クレジット: ライフハッカー

OpenAI 話している ChatGPT Images 2.5 を使用すると編集の精度が向上するため、次のプロンプトを送信して試してみました。「森の奥深く、専用の空き地にあり、周囲に木々が茂っている小屋のフォトリアリスティックな画像を作成します。早朝で、木々の間から太陽が輝いていますが、小屋自体はモダンで居心地の良いように見えます。」

これまでのところどう思いますか?

ChatGPT 画像をクリックすると、画像の特定の側面に関するコメントを追加したり、変更する画像のセクションをマークアップしたり、画像の一部または背景全体をすばやく消去したりできます。キャビンの家具をいくつか取り除き、時刻を早朝から夕暮れまで変更してみました。再配置された影が特に巧妙なタッチで、ブリーフは落ち着いて完成しました。

Gemini では、画像をクリックすると、よりシンプルな編集ツールのセットが表示されますが、基本は同じです。テキスト コメントまたは走り書きの注釈を使用して変更を指定します。ここでも AI にキャビンの椅子をいくつか撤去してもらい (AI モデルのトレーニング データには椅子がたくさんあるはずです)、シーンを夕暮れに切り替えました。 Gemini も同様にうまくいきましたが、最終的には、ChatGPT の取り組みは、もう少し生活感があり、人工的ではないように見えました。

ChatGPT Images 2.5 と Google Nano Banana 2 はどちらも良好なパフォーマンスを示します

ChatGPT 画像 2.5 対 Google Nano Banana 2

どちらの AI モデルも、明らかに Bladerunner をうまく盗むことができます (左が ChatGPT、右が Gemini)。
クレジット: ライフハッカー

これら 2 つの AI ボットは、画像生成に関してはパフォーマンスが非常に似ています。 Gemini は前かがみではなく、Nano Banana 2 はほとんどすべての点で優れていますが、現時点では ChatGPT Images 2.5 がわずかに優れていると思います。特に、プロンプトをスケッチしてテンプレートとして保存するための追加機能を追加した場合です。

これらのツールをいつ使用するのか、なぜ使用するのかについては議論が続いていますが、AI がどれほど優れた写真を作成できるようになったとしても、実際の人間のアートや写真には常に価値があると思います。本物の森は、AI によってつなぎ合わせられた近似の森に常に勝ります。ただし、アーティストを雇ったり、自分で行うためのデザインの才能を持たないビジュアライゼーションやアイデアに関しては、Gemini と ChatGPT の両方がこれまでよりも高いレベルにあります。

現時点で最も役立つ可能性があるのは編集ツールです。通常、専門家であれば何時間もかかる写真の変更が、誰でも数秒で行えるようになり、その機能は今後さらに向上するでしょう。

{このテーマについてさらに詳しく知りたい方は以下をご覧ください|関連情報は以下のリンクからご確認いただけます}

{完全ガイドはこちら|詳しい情報を見る|公式情報はこちら}

関連記事

前の投稿
このバッテリー設定により、数週間にわたり Galaxy Watch の通知が機能しなくなってしまいました
次の投稿
2026 年のエミー賞前にストリーミングすべき 6 つの必見番組