top of page
Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif
logo.png

NVIDIA Memperluas Penerapan AI Perusahaan DiffusionGemma

Generatived

18/6/26, 09.00

NVIDIA mengumumkan perluasan dukungan untuk DiffusionGemma, model pembangkitan teks dari Google DeepMind yang dioptimalkan untuk inferensi berkecepatan tinggi di seluruh platform perangkat keras NVIDIA dan lingkungan AI perusahaan.

Model ini menggunakan generasi berbasis difusi untuk membuat hingga 256 token secara paralel, alih-alih menghasilkan teks secara berurutan. Dibangun di atas arsitektur Gemma 4, model ini berisi 25,2 miliar parameter dengan 3,8 miliar parameter aktif selama inferensi.

Menurut perusahaan, DiffusionGemma mencapai hingga 1.000 token per detik pada GPU H100, 150 token per detik pada DGX Spark, dan 2.000 token per detik pada DGX Station. Arsitektur ini dirancang untuk meningkatkan responsivitas sekaligus mengurangi biaya inferensi.

Dukungan tersedia melalui Hugging Face, vLLM, NVIDIA NIM, dan NeMo AutoModel, memungkinkan organisasi untuk menerapkan, menyajikan, dan menyempurnakan model di lingkungan cloud, hybrid, dan on-premises untuk aplikasi AI perusahaan.

Bagikan artikel ini:

Tin tức mới nhất
Microsoft Membandingkan Model Penerapan Sistem Operasi PostgreSQL

Microsoft Membandingkan Model Penerapan Sistem Operasi PostgreSQL

28/8/26, 07.00

Microsoft menerbitkan panduan evaluasi teknis yang membandingkan penerapan PostgreSQL yang dihosting sendiri dengan layanan basis data terkelola.

Microsoft Mendeteksi Kampanye Siber yang Menargetkan Perusahaan

Microsoft Mendeteksi Kampanye Siber yang Menargetkan Perusahaan

28/8/26, 07.00

Microsoft Threat Intelligence mengamati kampanye serangan siber bernama TerminalFix yang menargetkan berbagai jaringan organisasi.

Meta Memperkenalkan Langkah-Langkah Pencegahan Penipuan AI Tingkat Lanjut

Meta Memperkenalkan Langkah-Langkah Pencegahan Penipuan AI Tingkat Lanjut

28/8/26, 07.00

Meta mengumumkan penerapan langkah-langkah keamanan yang ditingkatkan di Polandia untuk memerangi penipuan daring dan konten peniruan identitas.

Alibaba merilis model Flash Next Qwen3.8.

Alibaba merilis model Flash Next Qwen3.8.

28/8/26, 07.00

Alibaba merilis bobot untuk Qwen3.8-Flash-Next, sebuah model pratinjau yang mendemonstrasikan arsitektur multimodal Qwen4 yang akan datang.

Copyright © 2024 Generatived - All right Reserved.

Bagikan artikel ini:

Bagikan artikel ini:

Generatived

Hãy theo dõi chúng tôi

  • Facebook
  • X

Bahasa

Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.

Generatived AI Logo

Generatived adalah layanan yang memberikan informasi dan tren khusus dalam AI Generatif. Kami akan melakukan yang terbaik untuk menyampaikan informasi tentang dunia yang berubah dengan cepat.

  • Facebook
  • X

Ikuti kami

Bahasa

Berita terkini
Microsoft Membandingkan Model Penerapan Sistem Operasi PostgreSQL

Microsoft Membandingkan Model Penerapan Sistem Operasi PostgreSQL

28/8/26, 07.00

Microsoft menerbitkan panduan evaluasi teknis yang membandingkan penerapan PostgreSQL yang dihosting sendiri dengan layanan basis data terkelola.

Microsoft Mendeteksi Kampanye Siber yang Menargetkan Perusahaan

Microsoft Mendeteksi Kampanye Siber yang Menargetkan Perusahaan

28/8/26, 07.00

Microsoft Threat Intelligence mengamati kampanye serangan siber bernama TerminalFix yang menargetkan berbagai jaringan organisasi.

Meta Memperkenalkan Langkah-Langkah Pencegahan Penipuan AI Tingkat Lanjut

Meta Memperkenalkan Langkah-Langkah Pencegahan Penipuan AI Tingkat Lanjut

28/8/26, 07.00

Meta mengumumkan penerapan langkah-langkah keamanan yang ditingkatkan di Polandia untuk memerangi penipuan daring dan konten peniruan identitas.

Alibaba merilis model Flash Next Qwen3.8.

Alibaba merilis model Flash Next Qwen3.8.

28/8/26, 07.00

Alibaba merilis bobot untuk Qwen3.8-Flash-Next, sebuah model pratinjau yang mendemonstrasikan arsitektur multimodal Qwen4 yang akan datang.

bottom of page