Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif
.webp)
NVIDIA Memperluas Opsi Penerapan MiniMax M3
Generatived
18/6/26, 09.00
NVIDIA mengumumkan perluasan dukungan penerapan untuk MiniMax M3, model multimodal campuran para ahli yang dirancang untuk penalaran konteks panjang, alur kerja pengkodean, dan aplikasi pemahaman visual.
Model ini memiliki 428 miliar parameter, mendukung hingga satu juta token konteks, dan memproses teks, gambar, dan video dalam arsitektur terpadu. NVIDIA mengatakan MiniMax Sparse Attention mereka meningkatkan efisiensi untuk beban kerja skala besar.
Pengembang dapat menerapkan MiniMax M3 pada infrastruktur yang dipercepat NVIDIA menggunakan TensorRT LLM, SGLang, vLLM, atau Dynamo. Perusahaan tersebut mengatakan model ini cocok untuk sesi pengkodean yang panjang, analisis video, dan pembuatan konten kreatif.
NVIDIA juga menyoroti dukungan untuk kustomisasi melalui NeMo Framework, yang memungkinkan penyempurnaan dan alur kerja pembelajaran penguatan. Pengembang dapat mengakses model melalui API build.nvidia.com atau mengunduh bobot dari Hugging Face.
Bagikan artikel ini:

