Generatived(Beta)|生成AIの最新ニュースとトレンドを提供
.webp)
Google AI Edge、Gemma 3 1B のリリースを発表
Generatived
25/3/13 4:30
Gemma 3 1B は、オープン ウェイト モデルの Gemma ファミリーに新たに追加されたもので、モバイル プラットフォームと Web プラットフォーム間での小規模言語モデル (SLM) の配布を強化するように設計されています。このモデルは、迅速なダウンロードと高速処理のために最適化されており、ユーザーがさまざまなデバイスでさまざまなアプリケーションを使用しながら、集中力を維持できるようにします。
529MB のコンパクトなサイズを誇る Gemma 3 1B は、 Google AI Edge の LLM 推論により 1 秒未満で 1 ページのコンテンツを処理できる優れた処理速度を誇ります。このモデルにより、アプリケーションは自然言語を利用してユーザー インタラクションを促進し、アプリ内データに基づいてコンテンツを生成できるため、開発者はカスタマイズや微調整のオプションを利用できます。
Gemma 3 1B モデルは、効率的であるだけでなく、汎用性も高く、データキャプションからゲーム内ダイアログ、スマート返信、ドキュメント Q&A まで、さまざまなユースケースをサポートします。完全にデバイス上で動作し、オフラインでの利用、コスト削減、低レーテンシー、機密データのプライバシー強化などの利点を提供します。
Gemma 3 1B を使い始めるには、開発者はGitHubからデモ アプリをダウンロードし、希望する処理ユニットを選択して、 Hugging Faceからモデルをダウンロードします。このモデルは、効率的なデバイス内処理のためにGoogle AI Edge の LLM 推論APIを搭載しており、コミュニティが作成した微調整バージョンを使用してカスタマイズできます。モデルのパフォーマンスは、量子化を考慮したトレーニングや読み込み時間の改善など、広範囲にわたる最適化の結果であり、CPU と GPU の両方で効果的に実行されることが保証されています。
最新のニュース
NVIDIA、LLM向けGPU最適化設計指針公開
26/7/14 0:00
NVIDIA(米国カリフォルニア州)は、大規模言語モデル(LLM)の性能を最大限引き出すためのGPU最適化設計ガイドを公開したと発表した。
Microsoft、Copilotに営業・サービスAI強化
26/7/14 0:00
Microsoft(米国ワシントン州)は、Microsoft 365 CopilotとDynamics 365向けに営業・カスタマーサービス業務を支援する新たなエージェント機能を提供開始したと発表した。
NVIDIA、JAX向けHBM削減技術を紹介
26/7/14 0:00
NVIDIA(米国カリフォルニア州)は、JAXを用いた大規模言語モデル(LLM)の学習において、GPU高帯域幅メモリ(HBM)の使用量を抑える「Host Offloading」の活用方法を紹介した。
Copyright © 2024 Generatived - All right Reserved.
ニュース
Generatived は、Generative AIに特化した情報やトレンドをお届けするサービスです。大きく変わりゆく世界の情報を全力でお届けします。
最新のニュース
NVIDIA、LLM向けGPU最適化設計指針公開
26/7/14 0:00
NVIDIA(米国カリフォルニア州)は、大規模言語モデル(LLM)の性能を最大限引き出すためのGPU最適化設計ガイドを公開したと発表した。
Microsoft、Copilotに営業・サービスAI強化
26/7/14 0:00
Microsoft(米国ワシントン州)は、Microsoft 365 CopilotとDynamics 365向けに営業・カスタマーサービス業務を支援する新たなエージェント機能を提供開始したと発表した。
NVIDIA、JAX向けHBM削減技術を紹介
26/7/14 0:00
NVIDIA(米国カリフォルニア州)は、JAXを用いた大規模言語モデル(LLM)の学習において、GPU高帯域幅メモリ(HBM)の使用量を抑える「Host Offloading」の活用方法を紹介した。






