top of page

Generatived(Beta)|生成AIの最新ニュースとトレンドを提供

logo.png

ジェミニ、高度な画像理解タスク向けAIを発表

Generatived

25/7/23 9:00

GeminiはAIの視覚理解に新たな次元をもたらし、画像内の複雑な説明や関係性を解析できるようになりました。この進歩により、AIは単純なラベルだけでなく、「最も遠い車」を特定するなど、複雑なフレーズを使って物体を識別できるようになりました。この技術革新により、AIは視覚データとより繊細で人間的な方法で対話する能力が向上します。

AIの能力は、物体の関係性、条件付きロジック、抽象概念、画像内テキスト、多言語ラベルの理解にまで及びます。例えば、Geminiは「傘を持っている人」を識別したり、「ベジタリアン向けの食べ物」を除外したりすることができ、様々な詳細なクエリを処理できる能力を示しています。この機能は、「花束の中で最もしおれた花」の特定や画像内のテキスト認識など、高度な視覚理解を必要とするタスクに特に有効です。

Geminiの会話型画像セグメンテーションの実用的応用範囲は広く、クリエイティブメディア編集の簡素化から安全コンプライアンス監視の強化まで多岐にわたります。デザイナーは自然言語で画像を操作できるようになり、安全管理者は「ヘルメットを着用していない従業員をハイライトしてください」といった指示で、コンプライアンス違反の行動を特定できます。さらに、保険査定担当者はAIに「天候被害のある住宅をSegment」と指示することで、より正確な損害査定を行うことができます。これは、Geminiが抽象的な概念を理解する能力を実証しています。

開発者にとって、Geminiのテクノロジーは大きな前進を意味します。定義済みのクラスにとらわれない柔軟な言語モデルを提供することで、様々な業界向けにカスタマイズされたソリューションの構築を可能にします。さらに、あらゆるセグメンテーションニーズに対応する単一のAPIを備えたシンプルな開発者エクスペリエンスは、高度なビジョンアプリケーションへのアクセスを民主化し、開発者が高度な視覚理解機能を自社製品に容易に統合できるようにします。

この記事を共有:

最新のニュース
Metaが育成施策を開始

Metaが育成施策を開始

26/8/24 14:00

Meta(メンローパーク)は、インドにおけるアーリーステージの消費者向けブランドの成長支援を目的とした、3か月間の育成プログラムを開始した模様だ。

Microsoftがクラウドセキュリティ拡張

Microsoftがクラウドセキュリティ拡張

26/8/24 14:00

Microsoft(レッドモンド)は、クラウドワークロード保護プラットフォーム「Microsoft Defender for Cloud」の機能強化を発表した模様だ。

NVIDIA端末用AIモデル発表

NVIDIA端末用AIモデル発表

26/8/21 14:00

NVIDIA(サンフランシスコ)は、ロボティクス向けのエッジAI用世界モデル「Cosmos 3 Edge」を発表した模様だ。

OpenAIが安全機能を公開

OpenAIが安全機能を公開

26/8/21 14:00

OpenAI(サンフランシスコ)は、ZDR対応顧客向けに単一のセッションを超えた不正検知を可能にする新機能「Private Safety Processing」のプレビューを開始した模様だ。

Copyright © 2024 Generatived - All right Reserved.

この記事を共有:

この記事を共有:

Generatived AI Logo

Generatived は、Generative AIに特化した情報やトレンドをお届けするサービスです。大きく変わりゆく世界の情報を全力でお届けします。

  • Facebook
  • X

フォローをお願いします

言語

最新のニュース
Metaが育成施策を開始

Metaが育成施策を開始

26/8/24 14:00

Meta(メンローパーク)は、インドにおけるアーリーステージの消費者向けブランドの成長支援を目的とした、3か月間の育成プログラムを開始した模様だ。

Microsoftがクラウドセキュリティ拡張

Microsoftがクラウドセキュリティ拡張

26/8/24 14:00

Microsoft(レッドモンド)は、クラウドワークロード保護プラットフォーム「Microsoft Defender for Cloud」の機能強化を発表した模様だ。

NVIDIA端末用AIモデル発表

NVIDIA端末用AIモデル発表

26/8/21 14:00

NVIDIA(サンフランシスコ)は、ロボティクス向けのエッジAI用世界モデル「Cosmos 3 Edge」を発表した模様だ。

OpenAIが安全機能を公開

OpenAIが安全機能を公開

26/8/21 14:00

OpenAI(サンフランシスコ)は、ZDR対応顧客向けに単一のセッションを超えた不正検知を可能にする新機能「Private Safety Processing」のプレビューを開始した模様だ。

bottom of page