Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif

MiniMax NVIDIA merilis model terbuka M2.7.
Generatived
15/4/26, 00.00
MiniMax M2.7 telah diperkenalkan sebagai pembaruan model M2.5 yang ditujukan untuk alur kerja berbasis agen dan tugas penalaran kompleks dalam perangkat lunak dan rekayasa.
Optimasi untuk vLLM dan SGLang mengintegrasikan kernel QK RMSNorm dan FP8 MoE, meningkatkan throughput pada GPU Blackwell Ultra dengan peningkatan yang dilaporkan sebesar 2,7x.
Contoh penerapan untuk vLLM dan SGLang menggunakan paralelisme tensor dan flag dukungan MoE untuk inferensi yang efisien pada GPU perusahaan dan titik akhir cloud.
Kerangka kerja NVIDIA NeMo dan checkpoint Hugging Face mendukung penyempurnaan MiniMax M2.7 dengan opsi penyebaran open-weight.
Bagikan artikel ini:
Tin tức mới nhất
NVIDIA Membagikan Panduan Desain Perangkat Keras untuk LLM
14/7/26, 00.00
NVIDIA merilis panduan desain yang menguraikan praktik yang mempertimbangkan perangkat keras untuk model bahasa besar.
Microsoft Memperluas Copilot dengan Agen Layanan Penjualan
14/7/26, 00.00
Microsoft mengumumkan kemampuan AI berbasis agen baru untuk Microsoft 365 Copilot dan Dynamics 365, memperkenalkan Sales Agent dan Service Agent
NVIDIA Menyoroti Fitur Offloading Host JAX untuk Pelatihan LLM
14/7/26, 00.00
NVIDIA menjelaskan bagaimana host offloading di JAX dapat mengurangi tekanan memori bandwidth tinggi GPU selama pelatihan model bahasa yang besar.
Copyright © 2024 Generatived - All right Reserved.
Bagikan artikel ini:
Bagikan artikel ini:
Kategori
Berita
AI dan hukum/peraturan/masyarakat
Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.
Berita terkini
NVIDIA Membagikan Panduan Desain Perangkat Keras untuk LLM
14/7/26, 00.00
NVIDIA merilis panduan desain yang menguraikan praktik yang mempertimbangkan perangkat keras untuk model bahasa besar.
Microsoft Memperluas Copilot dengan Agen Layanan Penjualan
14/7/26, 00.00
Microsoft mengumumkan kemampuan AI berbasis agen baru untuk Microsoft 365 Copilot dan Dynamics 365, memperkenalkan Sales Agent dan Service Agent
NVIDIA Menyoroti Fitur Offloading Host JAX untuk Pelatihan LLM
14/7/26, 00.00
NVIDIA menjelaskan bagaimana host offloading di JAX dapat mengurangi tekanan memori bandwidth tinggi GPU selama pelatihan model bahasa yang besar.






