Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif

NVIDIA Mengidentifikasi Ancaman Keamanan Baru untuk AI Multimodal
Generatived
4/8/25, 09.00
Tim AI Red NVIDIA secara aktif mensimulasikan serangan di dunia nyata untuk mengidentifikasi potensi ancaman terhadap sistem AI, dengan fokus khusus pada kerentanan dalam AI generatif dan multimodal. Penelitian mereka tidak menawarkan solusi langsung, melainkan menyoroti area yang membutuhkan upaya terpadu untuk memperkuat keamanan.
Tim ini memperkenalkan kategori serangan baru, injeksi prompt multimodal, yang melewati bahasa alami dan memanipulasi sistem agen menggunakan input visual simbolis, seperti rangkaian emoji atau teka-teki rebus. Pendekatan ini menghindari penyaringan input tradisional, menunjukkan bahwa pertahanan tingkat output diperlukan untuk mengamankan alur kerja AI.
Secara tradisional, serangan injeksi prompt multimodal memanipulasi sistem AI dengan menyematkan teks berbahaya di dalam gambar dan memprosesnya melalui alur teks. Namun, dengan munculnya model seperti seri o OpenAI yang memproses modalitas menjadi vektor penyematan dan melakukan dekode bersama, teknik serangan baru telah muncul yang memanfaatkan integrasi langsung input multimodal tanpa memerlukan muatan teks tersembunyi.
Kemajuan dalam model multimoda, terutama arsitektur fusi awal seperti Meta Llama 4, telah memungkinkan inferensi lintas-moda yang lebih canggih dengan mengintegrasikan teks dan gambar secara mulus dalam ruang laten bersama. Kemajuan ini telah memungkinkan berbagai jenis serangan baru, yang memungkinkan penyerang untuk menghindari langkah-langkah penanggulangan keamanan berbasis teks tradisional dengan menciptakan rangkaian gambar yang mengodekan instruksi secara visual.
Menanggapi ancaman-ancaman baru ini, NVIDIA mengusulkan pergeseran dalam strategi keamanan AI. Alih-alih hanya mengandalkan penyaringan input, organisasi harus berfokus pada penerapan filter output adaptif, pertahanan berlapis, dan analisis lintas-moda semantik untuk mendeteksi dan memitigasi serangan. Penyempurnaan pertahanan ini secara berkelanjutan melalui latihan tim merah dan putaran umpan balik sangat penting untuk memastikan keamanan dan ketahanan sistem AI dalam produksi.
Bagikan artikel ini:
Tin tức mới nhất
steAmがSTEAM人材育成を開始
28/9/26, 07.00
steAm(東京都豊島区)は、企業・組織向けの人財育成プログラム『steAm Human Development Program』を本格展開すると発表した。
ウイングアークが帳票導入
28/9/26, 07.00
ウイングアーク1st(東京都港区)は、三菱UFJファクターのファクタリング事業においてデジタル帳票基盤『SVF』とデジタルトラスト『Trustee』が導入されたと発表した。
NovaEdgeが提案書診断
28/9/26, 07.00
NovaEdge(京都府京都市)は、自治体のプロポーザル案件向け提案書をAIが診断し改善点を提示するクラウドサービス『提案書くんPlus』の提供を開始した。
Copyright © 2024 Generatived - All right Reserved.
Bagikan artikel ini:
Bagikan artikel ini:
Kategori
Berita
AI dan hukum/peraturan/masyarakat
Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.
Berita terkini
steAmがSTEAM人材育成を開始
28/9/26, 07.00
steAm(東京都豊島区)は、企業・組織向けの人財育成プログラム『steAm Human Development Program』を本格展開すると発表した。
ウイングアークが帳票導入
28/9/26, 07.00
ウイングアーク1st(東京都港区)は、三菱UFJファクターのファクタリング事業においてデジタル帳票基盤『SVF』とデジタルトラスト『Trustee』が導入されたと発表した。
NovaEdgeが提案書診断
28/9/26, 07.00
NovaEdge(京都府京都市)は、自治体のプロポーザル案件向け提案書をAIが診断し改善点を提示するクラウドサービス『提案書くんPlus』の提供を開始した。






