top of page
Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif
logo.png

NVIDIA memperkenalkan fitur shared memory spilling di CUDA 13.0

Generatived

29/8/25, 00.00

NVIDIA memperkenalkan fitur optimasi dalam CUDA Toolkit 13.0 yang memungkinkan kernel CUDA untuk melakukan spill pada register memori bersama. Fitur ini bertujuan untuk meningkatkan kinerja dengan mengurangi latency spill dan tekanan cache L2 untuk kernel yang menggunakan banyak register. Fitur ini tersedia di semua platform saat menggunakan mode kompilasi seluruh program PTXAS, dan pengembang dapat memilih untuk menggunakannya mulai dari CUDA 13.0.

Optimasi ini bekerja dengan memprioritaskan spilling register berbiaya tinggi ke memori bersama. Jika memori bersama tidak mencukupi, spilling akan dikembalikan ke memori lokal. Pendekatan ini menyimpan nilai spilling dalam memori on-chip berlatensi rendah jika memungkinkan. Fitur ini tidak diaktifkan secara default; pengembang harus mengaktifkannya menggunakan pragma assembly inline enable_smem_spilling dalam definisi kernel mereka.

Secara tradisional, spill register ditangani dengan menempatkan register di memori lokal off-chip dalam memori global perangkat. Hal ini mengakibatkan pengusiran baris cache, yang dapat berdampak negatif pada kinerja, terutama di wilayah dengan banyak register. Dengan fitur baru ini, kompiler mencoba menggunakan memori bersama untuk spill, yang secara signifikan mengurangi latency akses dan meningkatkan kinerja.

Pengembang yang ingin memanfaatkan fitur ini harus menggunakan CUDA 13.0 atau yang lebih baru dan dapat mengaktifkannya dengan menambahkan pragma PTX tertentu melalui assembly inline ke dalam kode mereka. Namun, ada beberapa batasan yang perlu dipertimbangkan, seperti menghindari fitur ini pada kernel yang menggunakan memori bersama yang dialokasikan secara dinamis atau yang secara dinamis mengalokasikan ulang register antar warp. Selain itu, untuk memastikan perilaku yang dapat diprediksi dan peningkatan kinerja, kami menyarankan untuk menggunakan optimasi ini hanya ketika batas peluncuran didefinisikan secara eksplisit.

Bagikan artikel ini:

Tin tức mới nhất
MetaローカルAIモデル公開

MetaローカルAIモデル公開

14/8/26, 05.00

Meta(メンローパーク)は、局所的な人工知能処理に向けた言語モデル「Muse Glimmer」を一般公開したと発表した模様だ。

Alibaba公開AIモデル展開

Alibaba公開AIモデル展開

14/8/26, 05.00

Alibaba(杭州)は、自社最大規模となるオープンウェイト型人工知能モデル「Qwen3.8-2.4T-A95B」の重みデータを一般公開したと発表した模様だ。

Google AI最新技術発表

Google AI最新技術発表

14/8/26, 05.00

Google(マウンテンビュー)は、自社製品やサービスにおける人工知能関連技術の最新成果を公表した模様である。

OpenAI若者向けAI開発連携

OpenAI若者向けAI開発連携

14/8/26, 05.00

OpenAI(サンフランシスコ)は、若年層における人工知能の適切な利活用と安全対策の強化に向けてアメリカ心理学会と連携すると発表した模様だ。

Copyright © 2024 Generatived - All right Reserved.

Bagikan artikel ini:

Bagikan artikel ini:

Generatived

Hãy theo dõi chúng tôi

  • Facebook
  • X

Bahasa

Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.

Generatived AI Logo

Generatived adalah layanan yang memberikan informasi dan tren khusus dalam AI Generatif. Kami akan melakukan yang terbaik untuk menyampaikan informasi tentang dunia yang berubah dengan cepat.

  • Facebook
  • X

Ikuti kami

Bahasa

Berita terkini
MetaローカルAIモデル公開

MetaローカルAIモデル公開

14/8/26, 05.00

Meta(メンローパーク)は、局所的な人工知能処理に向けた言語モデル「Muse Glimmer」を一般公開したと発表した模様だ。

Alibaba公開AIモデル展開

Alibaba公開AIモデル展開

14/8/26, 05.00

Alibaba(杭州)は、自社最大規模となるオープンウェイト型人工知能モデル「Qwen3.8-2.4T-A95B」の重みデータを一般公開したと発表した模様だ。

Google AI最新技術発表

Google AI最新技術発表

14/8/26, 05.00

Google(マウンテンビュー)は、自社製品やサービスにおける人工知能関連技術の最新成果を公表した模様である。

OpenAI若者向けAI開発連携

OpenAI若者向けAI開発連携

14/8/26, 05.00

OpenAI(サンフランシスコ)は、若年層における人工知能の適切な利活用と安全対策の強化に向けてアメリカ心理学会と連携すると発表した模様だ。

bottom of page