top of page
Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif
logo.png

NVIDIA memperkenalkan fitur shared memory spilling di CUDA 13.0

Generatived

29/8/25, 09.00

NVIDIA memperkenalkan fitur optimasi dalam CUDA Toolkit 13.0 yang memungkinkan kernel CUDA untuk melakukan spill pada register memori bersama. Fitur ini bertujuan untuk meningkatkan kinerja dengan mengurangi latency spill dan tekanan cache L2 untuk kernel yang menggunakan banyak register. Fitur ini tersedia di semua platform saat menggunakan mode kompilasi seluruh program PTXAS, dan pengembang dapat memilih untuk menggunakannya mulai dari CUDA 13.0.

Optimasi ini bekerja dengan memprioritaskan spilling register berbiaya tinggi ke memori bersama. Jika memori bersama tidak mencukupi, spilling akan dikembalikan ke memori lokal. Pendekatan ini menyimpan nilai spilling dalam memori on-chip berlatensi rendah jika memungkinkan. Fitur ini tidak diaktifkan secara default; pengembang harus mengaktifkannya menggunakan pragma assembly inline enable_smem_spilling dalam definisi kernel mereka.

Secara tradisional, spill register ditangani dengan menempatkan register di memori lokal off-chip dalam memori global perangkat. Hal ini mengakibatkan pengusiran baris cache, yang dapat berdampak negatif pada kinerja, terutama di wilayah dengan banyak register. Dengan fitur baru ini, kompiler mencoba menggunakan memori bersama untuk spill, yang secara signifikan mengurangi latency akses dan meningkatkan kinerja.

Pengembang yang ingin memanfaatkan fitur ini harus menggunakan CUDA 13.0 atau yang lebih baru dan dapat mengaktifkannya dengan menambahkan pragma PTX tertentu melalui assembly inline ke dalam kode mereka. Namun, ada beberapa batasan yang perlu dipertimbangkan, seperti menghindari fitur ini pada kernel yang menggunakan memori bersama yang dialokasikan secara dinamis atau yang secara dinamis mengalokasikan ulang register antar warp. Selain itu, untuk memastikan perilaku yang dapat diprediksi dan peningkatan kinerja, kami menyarankan untuk menggunakan optimasi ini hanya ketika batas peluncuran didefinisikan secara eksplisit.

Bagikan artikel ini:

Tin tức mới nhất
Oro Meluncurkan Integrasi Kecerdasan Buatan ERP

Oro Meluncurkan Integrasi Kecerdasan Buatan ERP

21/8/26, 14.00

Oro memperkenalkan koneksi server khusus yang dirancang untuk mengintegrasikan platform perusahaan mereka dengan asisten kecerdasan buatan interaktif secara langsung.

Trepro Menyediakan Pelatihan Kecerdasan Buatan yang Disesuaikan

Trepro Menyediakan Pelatihan Kecerdasan Buatan yang Disesuaikan

21/8/26, 14.00

Trepro menyelenggarakan program pelatihan kecerdasan buatan yang disesuaikan dengan tantangan operasional spesifik bagi karyawan klien perusahaan.

NextGen Bermitra dengan Mobilus di Bidang AI

NextGen Bermitra dengan Mobilus di Bidang AI

21/8/26, 14.00

NextGen membentuk kemitraan bisnis strategis dengan Mobilus untuk mengintegrasikan solusi kecerdasan buatan generatif berbasis cloud dengan sistem private branch exchange (PBX)

DirectCloud Meluncurkan Solusi Keamanan Ransomware Baru

DirectCloud Meluncurkan Solusi Keamanan Ransomware Baru

21/8/26, 14.00

DirectCloud memulai kemitraan keamanan untuk mendistribusikan perangkat lunak pertahanan ransomware khusus untuk endpoint.

Copyright © 2024 Generatived - All right Reserved.

Bagikan artikel ini:

Bagikan artikel ini:

Generatived

Hãy theo dõi chúng tôi

  • Facebook
  • X

Bahasa

Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.

Generatived AI Logo

Generatived adalah layanan yang memberikan informasi dan tren khusus dalam AI Generatif. Kami akan melakukan yang terbaik untuk menyampaikan informasi tentang dunia yang berubah dengan cepat.

  • Facebook
  • X

Ikuti kami

Bahasa

Berita terkini
Oro Meluncurkan Integrasi Kecerdasan Buatan ERP

Oro Meluncurkan Integrasi Kecerdasan Buatan ERP

21/8/26, 14.00

Oro memperkenalkan koneksi server khusus yang dirancang untuk mengintegrasikan platform perusahaan mereka dengan asisten kecerdasan buatan interaktif secara langsung.

Trepro Menyediakan Pelatihan Kecerdasan Buatan yang Disesuaikan

Trepro Menyediakan Pelatihan Kecerdasan Buatan yang Disesuaikan

21/8/26, 14.00

Trepro menyelenggarakan program pelatihan kecerdasan buatan yang disesuaikan dengan tantangan operasional spesifik bagi karyawan klien perusahaan.

NextGen Bermitra dengan Mobilus di Bidang AI

NextGen Bermitra dengan Mobilus di Bidang AI

21/8/26, 14.00

NextGen membentuk kemitraan bisnis strategis dengan Mobilus untuk mengintegrasikan solusi kecerdasan buatan generatif berbasis cloud dengan sistem private branch exchange (PBX)

DirectCloud Meluncurkan Solusi Keamanan Ransomware Baru

DirectCloud Meluncurkan Solusi Keamanan Ransomware Baru

21/8/26, 14.00

DirectCloud memulai kemitraan keamanan untuk mendistribusikan perangkat lunak pertahanan ransomware khusus untuk endpoint.

bottom of page