Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif
.webp)
NVIDIA Memperluas Opsi Penerapan MiniMax M3
Generatived
18/6/26, 00.00
NVIDIA mengumumkan perluasan dukungan penerapan untuk MiniMax M3, model multimodal campuran para ahli yang dirancang untuk penalaran konteks panjang, alur kerja pengkodean, dan aplikasi pemahaman visual.
Model ini memiliki 428 miliar parameter, mendukung hingga satu juta token konteks, dan memproses teks, gambar, dan video dalam arsitektur terpadu. NVIDIA mengatakan MiniMax Sparse Attention mereka meningkatkan efisiensi untuk beban kerja skala besar.
Pengembang dapat menerapkan MiniMax M3 pada infrastruktur yang dipercepat NVIDIA menggunakan TensorRT LLM, SGLang, vLLM, atau Dynamo. Perusahaan tersebut mengatakan model ini cocok untuk sesi pengkodean yang panjang, analisis video, dan pembuatan konten kreatif.
NVIDIA juga menyoroti dukungan untuk kustomisasi melalui NeMo Framework, yang memungkinkan penyempurnaan dan alur kerja pembelajaran penguatan. Pengembang dapat mengakses model melalui API build.nvidia.com atau mengunduh bobot dari Hugging Face.
Bagikan artikel ini:
Tin tức mới nhất
NVIDIA Membagikan Panduan Desain Perangkat Keras untuk LLM
14/7/26, 00.00
NVIDIA merilis panduan desain yang menguraikan praktik yang mempertimbangkan perangkat keras untuk model bahasa besar.
Microsoft Memperluas Copilot dengan Agen Layanan Penjualan
14/7/26, 00.00
Microsoft mengumumkan kemampuan AI berbasis agen baru untuk Microsoft 365 Copilot dan Dynamics 365, memperkenalkan Sales Agent dan Service Agent
NVIDIA Menyoroti Fitur Offloading Host JAX untuk Pelatihan LLM
14/7/26, 00.00
NVIDIA menjelaskan bagaimana host offloading di JAX dapat mengurangi tekanan memori bandwidth tinggi GPU selama pelatihan model bahasa yang besar.
Copyright © 2024 Generatived - All right Reserved.
Bagikan artikel ini:
Bagikan artikel ini:
Kategori
Berita
AI dan hukum/peraturan/masyarakat
Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.
Berita terkini
NVIDIA Membagikan Panduan Desain Perangkat Keras untuk LLM
14/7/26, 00.00
NVIDIA merilis panduan desain yang menguraikan praktik yang mempertimbangkan perangkat keras untuk model bahasa besar.
Microsoft Memperluas Copilot dengan Agen Layanan Penjualan
14/7/26, 00.00
Microsoft mengumumkan kemampuan AI berbasis agen baru untuk Microsoft 365 Copilot dan Dynamics 365, memperkenalkan Sales Agent dan Service Agent
NVIDIA Menyoroti Fitur Offloading Host JAX untuk Pelatihan LLM
14/7/26, 00.00
NVIDIA menjelaskan bagaimana host offloading di JAX dapat mengurangi tekanan memori bandwidth tinggi GPU selama pelatihan model bahasa yang besar.






