Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif

Google Meluncurkan Model Audio Gemma 4 12B
Generatived
11/6/26, 09.00
Google mengumumkan peluncuran Gemma 4 12B, model AI multimodal yang dirancang untuk berjalan secara lokal di laptop dengan memori minimal 16GB. Model ini menambahkan dukungan input audio asli sambil mempertahankan ukuran perangkat keras yang relatif ringkas.
Perusahaan tersebut menyatakan bahwa Gemma 4 12B memperkenalkan arsitektur terpadu yang memproses input gambar dan audio secara langsung di dalam kerangka model bahasa. Pendekatan ini menghilangkan kebutuhan akan encoder multimodal terpisah dan bertujuan untuk mengurangi kebutuhan memori dan latency.
Hasil Benchmark dilaporkan menempatkan model ini mendekati performa model Mixture of Experts 26B milik Google yang lebih besar. Sistem ini juga mencakup kemampuan Prediksi Multi-Token untuk meningkatkan kecepatan pembuatan dan mendukung alur kerja agen yang lebih canggih.
Model ini dirilis di bawah lisensi Apache 2.0 dan tersedia melalui platform termasuk Hugging Face dan Kaggle. Google juga melaporkan bahwa unduhan di seluruh keluarga Gemma telah melampaui 150 juta, yang mencerminkan adopsi berkelanjutan di antara para pengembang yang membangun aplikasi AI lokal.
Bagikan artikel ini:

%20(1).webp)