Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif

NVIDIA Mengidentifikasi Ancaman Keamanan Baru untuk AI Multimodal
Generatived
4/8/25, 09.00
Tim AI Red NVIDIA secara aktif mensimulasikan serangan di dunia nyata untuk mengidentifikasi potensi ancaman terhadap sistem AI, dengan fokus khusus pada kerentanan dalam AI generatif dan multimodal. Penelitian mereka tidak menawarkan solusi langsung, melainkan menyoroti area yang membutuhkan upaya terpadu untuk memperkuat keamanan.
Tim ini memperkenalkan kategori serangan baru, injeksi prompt multimodal, yang melewati bahasa alami dan memanipulasi sistem agen menggunakan input visual simbolis, seperti rangkaian emoji atau teka-teki rebus. Pendekatan ini menghindari penyaringan input tradisional, menunjukkan bahwa pertahanan tingkat output diperlukan untuk mengamankan alur kerja AI.
Secara tradisional, serangan injeksi prompt multimodal memanipulasi sistem AI dengan menyematkan teks berbahaya di dalam gambar dan memprosesnya melalui alur teks. Namun, dengan munculnya model seperti seri o OpenAI yang memproses modalitas menjadi vektor penyematan dan melakukan dekode bersama, teknik serangan baru telah muncul yang memanfaatkan integrasi langsung input multimodal tanpa memerlukan muatan teks tersembunyi.
Kemajuan dalam model multimoda, terutama arsitektur fusi awal seperti Meta Llama 4, telah memungkinkan inferensi lintas-moda yang lebih canggih dengan mengintegrasikan teks dan gambar secara mulus dalam ruang laten bersama. Kemajuan ini telah memungkinkan berbagai jenis serangan baru, yang memungkinkan penyerang untuk menghindari langkah-langkah penanggulangan keamanan berbasis teks tradisional dengan menciptakan rangkaian gambar yang mengodekan instruksi secara visual.
Menanggapi ancaman-ancaman baru ini, NVIDIA mengusulkan pergeseran dalam strategi keamanan AI. Alih-alih hanya mengandalkan penyaringan input, organisasi harus berfokus pada penerapan filter output adaptif, pertahanan berlapis, dan analisis lintas-moda semantik untuk mendeteksi dan memitigasi serangan. Penyempurnaan pertahanan ini secara berkelanjutan melalui latihan tim merah dan putaran umpan balik sangat penting untuk memastikan keamanan dan ketahanan sistem AI dalam produksi.
Bagikan artikel ini:
Tin tức mới nhất
TISIがJR西日本のAPI支援
29/9/26, 07.00
TISI(東京都新宿区)は、西日本旅客鉄道に対し「高セキュリティAPI基盤サービス」上で生成AIを活用した開発プロセスの支援を実施したと発表した。
アグレックスがデータ診断開始
29/9/26, 07.00
アグレックス(東京都新宿区)は、顧客データの品質分析と簡易名寄せを行い、生成AIで改善策を提示する「顧客データ品質AI診断サービス」を2026年10月1日より提供開始すると発表した。
Copyright © 2024 Generatived - All right Reserved.
Bagikan artikel ini:
Bagikan artikel ini:
Kategori
Berita
AI dan hukum/peraturan/masyarakat
Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.
Berita terkini
TISIがJR西日本のAPI支援
29/9/26, 07.00
TISI(東京都新宿区)は、西日本旅客鉄道に対し「高セキュリティAPI基盤サービス」上で生成AIを活用した開発プロセスの支援を実施したと発表した。
アグレックスがデータ診断開始
29/9/26, 07.00
アグレックス(東京都新宿区)は、顧客データの品質分析と簡易名寄せを行い、生成AIで改善策を提示する「顧客データ品質AI診断サービス」を2026年10月1日より提供開始すると発表した。






