top of page
Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif
logo.png

NVIDIA memperkenalkan fitur shared memory spilling di CUDA 13.0

Generatived

29/8/25, 09.00

NVIDIA memperkenalkan fitur optimasi dalam CUDA Toolkit 13.0 yang memungkinkan kernel CUDA untuk melakukan spill pada register memori bersama. Fitur ini bertujuan untuk meningkatkan kinerja dengan mengurangi latency spill dan tekanan cache L2 untuk kernel yang menggunakan banyak register. Fitur ini tersedia di semua platform saat menggunakan mode kompilasi seluruh program PTXAS, dan pengembang dapat memilih untuk menggunakannya mulai dari CUDA 13.0.

Optimasi ini bekerja dengan memprioritaskan spilling register berbiaya tinggi ke memori bersama. Jika memori bersama tidak mencukupi, spilling akan dikembalikan ke memori lokal. Pendekatan ini menyimpan nilai spilling dalam memori on-chip berlatensi rendah jika memungkinkan. Fitur ini tidak diaktifkan secara default; pengembang harus mengaktifkannya menggunakan pragma assembly inline enable_smem_spilling dalam definisi kernel mereka.

Secara tradisional, spill register ditangani dengan menempatkan register di memori lokal off-chip dalam memori global perangkat. Hal ini mengakibatkan pengusiran baris cache, yang dapat berdampak negatif pada kinerja, terutama di wilayah dengan banyak register. Dengan fitur baru ini, kompiler mencoba menggunakan memori bersama untuk spill, yang secara signifikan mengurangi latency akses dan meningkatkan kinerja.

Pengembang yang ingin memanfaatkan fitur ini harus menggunakan CUDA 13.0 atau yang lebih baru dan dapat mengaktifkannya dengan menambahkan pragma PTX tertentu melalui assembly inline ke dalam kode mereka. Namun, ada beberapa batasan yang perlu dipertimbangkan, seperti menghindari fitur ini pada kernel yang menggunakan memori bersama yang dialokasikan secara dinamis atau yang secara dinamis mengalokasikan ulang register antar warp. Selain itu, untuk memastikan perilaku yang dapat diprediksi dan peningkatan kinerja, kami menyarankan untuk menggunakan optimasi ini hanya ketika batas peluncuran didefinisikan secara eksplisit.

Bagikan artikel ini:

Tin tức mới nhất
Media Reach Tech Meluncurkan Fitur Analitik Baru

Media Reach Tech Meluncurkan Fitur Analitik Baru

19/8/26, 14.00

Media Reach memperkenalkan alat daftar publikasi prospektif untuk perangkat lunak analitik pencarian perusahaannya.

AUN CONSULTING Meluncurkan Layanan Optimasi AI di China

AUN CONSULTING Meluncurkan Layanan Optimasi AI di China

19/8/26, 14.00

AUN CONSULTING menjalin kemitraan bisnis strategis dengan General Trading untuk memperkenalkan layanan konsultasi optimasi AI khusus yang disesuaikan untuk pasar Tiongkok.

VELC Mendapatkan Kontrak Kerangka Kerja Konsultasi AI OECD

VELC Mendapatkan Kontrak Kerangka Kerja Konsultasi AI OECD

19/8/26, 14.00

VELC menjalin kesepakatan dengan OECD untuk memberikan konsultasi teknis untuk proyek AI pendidikan.

Spike Studio Meluncurkan Sistem Dukungan Telepon Langsung

Spike Studio Meluncurkan Sistem Dukungan Telepon Langsung

19/8/26, 14.00

Spike Studio memperkenalkan platform cerdas yang dirancang untuk menganalisis komunikasi telepon dan mengambil referensi dokumen internal selama panggilan layanan langsung.

Copyright © 2024 Generatived - All right Reserved.

Bagikan artikel ini:

Bagikan artikel ini:

Generatived

Hãy theo dõi chúng tôi

  • Facebook
  • X

Bahasa

Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.

Generatived AI Logo

Generatived adalah layanan yang memberikan informasi dan tren khusus dalam AI Generatif. Kami akan melakukan yang terbaik untuk menyampaikan informasi tentang dunia yang berubah dengan cepat.

  • Facebook
  • X

Ikuti kami

Bahasa

Berita terkini
Media Reach Tech Meluncurkan Fitur Analitik Baru

Media Reach Tech Meluncurkan Fitur Analitik Baru

19/8/26, 14.00

Media Reach memperkenalkan alat daftar publikasi prospektif untuk perangkat lunak analitik pencarian perusahaannya.

AUN CONSULTING Meluncurkan Layanan Optimasi AI di China

AUN CONSULTING Meluncurkan Layanan Optimasi AI di China

19/8/26, 14.00

AUN CONSULTING menjalin kemitraan bisnis strategis dengan General Trading untuk memperkenalkan layanan konsultasi optimasi AI khusus yang disesuaikan untuk pasar Tiongkok.

VELC Mendapatkan Kontrak Kerangka Kerja Konsultasi AI OECD

VELC Mendapatkan Kontrak Kerangka Kerja Konsultasi AI OECD

19/8/26, 14.00

VELC menjalin kesepakatan dengan OECD untuk memberikan konsultasi teknis untuk proyek AI pendidikan.

Spike Studio Meluncurkan Sistem Dukungan Telepon Langsung

Spike Studio Meluncurkan Sistem Dukungan Telepon Langsung

19/8/26, 14.00

Spike Studio memperkenalkan platform cerdas yang dirancang untuk menganalisis komunikasi telepon dan mengambil referensi dokumen internal selama panggilan layanan langsung.

bottom of page