top of page
Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif
logo.png

NVIDIA Mengidentifikasi Ancaman Keamanan Baru untuk AI Multimodal

Generatived

4/8/25, 09.00

Tim AI Red NVIDIA secara aktif mensimulasikan serangan di dunia nyata untuk mengidentifikasi potensi ancaman terhadap sistem AI, dengan fokus khusus pada kerentanan dalam AI generatif dan multimodal. Penelitian mereka tidak menawarkan solusi langsung, melainkan menyoroti area yang membutuhkan upaya terpadu untuk memperkuat keamanan.

Tim ini memperkenalkan kategori serangan baru, injeksi prompt multimodal, yang melewati bahasa alami dan memanipulasi sistem agen menggunakan input visual simbolis, seperti rangkaian emoji atau teka-teki rebus. Pendekatan ini menghindari penyaringan input tradisional, menunjukkan bahwa pertahanan tingkat output diperlukan untuk mengamankan alur kerja AI.

Secara tradisional, serangan injeksi prompt multimodal memanipulasi sistem AI dengan menyematkan teks berbahaya di dalam gambar dan memprosesnya melalui alur teks. Namun, dengan munculnya model seperti seri o OpenAI yang memproses modalitas menjadi vektor penyematan dan melakukan dekode bersama, teknik serangan baru telah muncul yang memanfaatkan integrasi langsung input multimodal tanpa memerlukan muatan teks tersembunyi.

Kemajuan dalam model multimoda, terutama arsitektur fusi awal seperti Meta Llama 4, telah memungkinkan inferensi lintas-moda yang lebih canggih dengan mengintegrasikan teks dan gambar secara mulus dalam ruang laten bersama. Kemajuan ini telah memungkinkan berbagai jenis serangan baru, yang memungkinkan penyerang untuk menghindari langkah-langkah penanggulangan keamanan berbasis teks tradisional dengan menciptakan rangkaian gambar yang mengodekan instruksi secara visual.

Menanggapi ancaman-ancaman baru ini, NVIDIA mengusulkan pergeseran dalam strategi keamanan AI. Alih-alih hanya mengandalkan penyaringan input, organisasi harus berfokus pada penerapan filter output adaptif, pertahanan berlapis, dan analisis lintas-moda semantik untuk mendeteksi dan memitigasi serangan. Penyempurnaan pertahanan ini secara berkelanjutan melalui latihan tim merah dan putaran umpan balik sangat penting untuk memastikan keamanan dan ketahanan sistem AI dalam produksi.

Bagikan artikel ini:

Tin tức mới nhất
Metelixがテンセントと連携

Metelixがテンセントと連携

29/9/26, 07.00

Metelix(東京都渋谷区)は、テンセントのクラウド事業体であるTencent Cloudとの提携を開始したと発表した。

TISIがJR西日本のAPI支援

TISIがJR西日本のAPI支援

29/9/26, 07.00

TISI(東京都新宿区)は、西日本旅客鉄道に対し「高セキュリティAPI基盤サービス」上で生成AIを活用した開発プロセスの支援を実施したと発表した。

アグレックスがデータ診断開始

アグレックスがデータ診断開始

29/9/26, 07.00

アグレックス(東京都新宿区)は、顧客データの品質分析と簡易名寄せを行い、生成AIで改善策を提示する「顧客データ品質AI診断サービス」を2026年10月1日より提供開始すると発表した。

イオレがAI計算力提供開始

イオレがAI計算力提供開始

29/9/26, 07.00

イオレ(東京都港区)は、デジタルダイナミックとの連携を拡大し、ネオクラウド事業化に向けたAI計算力提供事業を本格始動したと発表した。

Copyright © 2024 Generatived - All right Reserved.

Bagikan artikel ini:

Bagikan artikel ini:

Generatived

Hãy theo dõi chúng tôi

  • Facebook
  • X

Bahasa

Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.

Generatived AI Logo

Generatived adalah layanan yang memberikan informasi dan tren khusus dalam AI Generatif. Kami akan melakukan yang terbaik untuk menyampaikan informasi tentang dunia yang berubah dengan cepat.

  • Facebook
  • X

Ikuti kami

Bahasa

Berita terkini
Metelixがテンセントと連携

Metelixがテンセントと連携

29/9/26, 07.00

Metelix(東京都渋谷区)は、テンセントのクラウド事業体であるTencent Cloudとの提携を開始したと発表した。

TISIがJR西日本のAPI支援

TISIがJR西日本のAPI支援

29/9/26, 07.00

TISI(東京都新宿区)は、西日本旅客鉄道に対し「高セキュリティAPI基盤サービス」上で生成AIを活用した開発プロセスの支援を実施したと発表した。

アグレックスがデータ診断開始

アグレックスがデータ診断開始

29/9/26, 07.00

アグレックス(東京都新宿区)は、顧客データの品質分析と簡易名寄せを行い、生成AIで改善策を提示する「顧客データ品質AI診断サービス」を2026年10月1日より提供開始すると発表した。

イオレがAI計算力提供開始

イオレがAI計算力提供開始

29/9/26, 07.00

イオレ(東京都港区)は、デジタルダイナミックとの連携を拡大し、ネオクラウド事業化に向けたAI計算力提供事業を本格始動したと発表した。

bottom of page