これで、Gemini に写真をアップロードして編集できるようになりました。

まとめ:

  • Gemini で写真を無料でアップロード、編集できるようになりました。この機能は、本日より段階的に全ユーザーに展開されます。
  • ユーザーは会話型のテキストプロンプトを介して、Gemini 上で AI 画像を作成および編集することもできます。
  • Google は、Gemini 上のすべての AI 生成画像に、目に見える透かしと目に見えない SynthID デジタル透かしが含まれることを確認しました。

最後に、Google はテキスト プロンプトを使用して Gemini で写真を編集する機能を導入しています。テキスト チャットを通じて、Gemini に既存の写真をアップロードしたり編集したりできるようになりました。さらに、Gemini を使用して AI 画像を作成し、複製して画像を変更することもできます。 Gemini の写真編集機能は、本日より段階的にすべてのユーザーに展開されます。この新しい機能により、ユーザー エクスペリエンスが向上し、強力なクリエイティブ ツールが提供されます。

Google は、AI Studio で Gemini 2.0 Flash モデルを使用したネイティブ画像編集機能を初めて提供しました。私はXNUMX月にこのモデルをテストしましたが、会話形式で画像を編集するのがいかに簡単かに驚きました。 Google のネイティブ画像生成モデルに応えて、OpenAI も ChatGPT にネイティブ画像編集と生成を導入しました。

これにより、ジブリブームが急速に広がり、ChatGPTの利用も増加しました。そして今回、Googleはコンシューマー向けアプリ「Gemini」にネイティブな画像編集機能を搭載しました。Geminiのモバイルアプリとウェブ版の両方で画像編集が可能であることに注目してください。この機能により、Geminiは生成AI分野において強力な競合相手となっています。

ChatGPTとGeminiのネイティブ画像編集機能を比較した結果、世代を超えてキャラクターやシーンの一貫性を維持する点ではGeminiの方がはるかに優れていると言えます。ChatGPTは世代ごとに画像全体を変更しますが、Geminiは驚くほど一貫性を保っています。しかし、画像生成に関してはChatGPTの方がGeminiを上回ります。これは、使用されているモデルアーキテクチャの違いを反映していると言えるでしょう。

ここで、Google が画像生成に Imagen 3 拡散ベース モデルをまだ使用しているのか、それとも Gemini モデルのネイティブ画像生成機能を使用しているのかを知る必要があります。ちなみに、OpenAI は画像の作成と修正に GPT-4o AI モデルを使用しています。この展開は、人工知能の分野で進行中の競争を物語っています。

それに加えて、Google によれば、Gemini で作成または編集されたすべての画像には目に見えない SynthID デジタル透かしが埋め込まれているという。さらに、Google は Gemini で作成されたすべての画像に目に見える透かしを追加します。この措置は、人工知能の利用における透明性と説明責任を強化することを目的としています。

コメントは締め切りました。