top of page
Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif
logo.png

NVIDIA mengumumkan TensorRT 10.0 untuk mesin AI kecil

Generatived

12/6/24, 11.43

NVIDIA mengumumkan peluncuran TensorRT 10.0, yang memperkenalkan mesin penghilang bobot yang secara signifikan mengurangi ukuran mesin model AI. Mesin ini, yang mengecualikan bobot dari kode yang berjalan, dapat mengurangi ukuran mesin lebih dari 95%. Inovasi ini menyederhanakan proses penerapan aplikasi yang menggunakan GPU NVIDIA GeForce RTX dan NVIDIA RTX dengan memungkinkan perangkat pengguna akhir menyeimbangkan kembali bobot menggunakan lean runtime sekitar 40 MB.

Mesin penghilang bobot dirancang untuk mendukung model ONNX dan definisi jaringan lainnya, memungkinkan Anda mengubah bobot tanpa membangun kembali seluruh mesin. Fitur ini sangat berguna dalam skenario yang melibatkan beberapa SKU GPU dan profil pengoptimalan, karena fitur ini meminimalkan duplikasi bobot dan, sebagai hasilnya, mengurangi ukuran biner aplikasi Anda. Mesinnya tetap kompatibel di seluruh pembaruan kecil pada TensorRT dan dapat dibuat dengan tanda kompatibilitas versi, sehingga membuatnya lebih berguna.

TensorRT Cloud, yang saat ini hanya dapat diakses oleh partner tertentu, memperluas kemampuan Anda untuk membuat mesin yang lebih ringan pada berbagai GPU NVIDIA. Pembuatan mesin yang lebih ringan dan penyetelan ulang dukungan untuk NVIDIA TensorRT-LLM akan segera tersedia, sehingga semakin meningkatkan kompresi dan efisiensi model bahasa besar (LLM).

Proses pembuatan dan penerapan mesin yang dikurangi bobotnya menggunakan bobot model selama fase pembuatan untuk melakukan pengoptimalan dan memastikan performa yang konsisten saat bobot disesuaikan kembali nanti. Setelah diserialkan, mesin ini dapat dikalibrasi ulang dalam hitungan detik menggunakan bobot dari file ONNX di perangkat pengguna akhir, sehingga menjaga efisiensi deserialisasi cepat yang dikenal dengan TensorRT. Pendekatan ini tidak hanya memungkinkan Anda untuk menggabungkan lebih banyak fitur AI ke dalam aplikasi Anda tanpa meningkatkan ukuran aplikasi Anda, namun juga memastikan bahwa mesin tetap kompatibel dengan generasi GPU masa depan. saus:

Bagikan artikel ini:

Tin tức mới nhất
Ippu Senkin東和銀行AI導入効率化

Ippu Senkin東和銀行AI導入効率化

20/2/26, 00.00

Ippu Senkin(東京都中央区)は、東和銀行(群馬県前橋市)に生成AIを活用した議事録AIアプリ「Towa Bank AI 1.0 -MEMO-(とわログ)」と規程・手続き検索AIアプリ「Towa Bank AI 1.0 -Buddy-(とわナビ)」を導入し、業務効率化を図った。

カヤック音威子府村AI副村長開発

カヤック音威子府村AI副村長開発

20/2/26, 00.00

面白法人カヤック(神奈川県鎌倉市)は北海道中川郡音威子府村と共同で、村専用の対話型AI「ねっぷちゃん」を開発した。

SHIFT AI 農業にAI導入で新時代

SHIFT AI 農業にAI導入で新時代

20/2/26, 00.00

SHIFT AI(東京都渋谷区)の西田健太郎と安藤雅士は、愛知県西尾市で開催された「2026 食と農のフォーラム西尾」に登壇した。

フレンセルAI×レタッチビジュアルサービス開始

フレンセルAI×レタッチビジュアルサービス開始

20/2/26, 00.00

フレンセル(札幌市)はAI生成技術と人のレタッチ技術を組み合わせたビジュアル制作サービス「AI × RETOUCH LAB」を開始した。

Copyright © 2024 Generatived - All right Reserved.

Bagikan artikel ini:

Bagikan artikel ini:

Generatived

Hãy theo dõi chúng tôi

  • Facebook
  • X

Bahasa

Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.

Generatived AI Logo

Generatived adalah layanan yang memberikan informasi dan tren khusus dalam AI Generatif. Kami akan melakukan yang terbaik untuk menyampaikan informasi tentang dunia yang berubah dengan cepat.

  • Facebook
  • X

Ikuti kami

Bahasa

Berita terkini
Ippu Senkin東和銀行AI導入効率化

Ippu Senkin東和銀行AI導入効率化

20/2/26, 00.00

Ippu Senkin(東京都中央区)は、東和銀行(群馬県前橋市)に生成AIを活用した議事録AIアプリ「Towa Bank AI 1.0 -MEMO-(とわログ)」と規程・手続き検索AIアプリ「Towa Bank AI 1.0 -Buddy-(とわナビ)」を導入し、業務効率化を図った。

カヤック音威子府村AI副村長開発

カヤック音威子府村AI副村長開発

20/2/26, 00.00

面白法人カヤック(神奈川県鎌倉市)は北海道中川郡音威子府村と共同で、村専用の対話型AI「ねっぷちゃん」を開発した。

SHIFT AI 農業にAI導入で新時代

SHIFT AI 農業にAI導入で新時代

20/2/26, 00.00

SHIFT AI(東京都渋谷区)の西田健太郎と安藤雅士は、愛知県西尾市で開催された「2026 食と農のフォーラム西尾」に登壇した。

フレンセルAI×レタッチビジュアルサービス開始

フレンセルAI×レタッチビジュアルサービス開始

20/2/26, 00.00

フレンセル(札幌市)はAI生成技術と人のレタッチ技術を組み合わせたビジュアル制作サービス「AI × RETOUCH LAB」を開始した。

bottom of page