Claude Opus 5 Lolos Semua 129 Pengujian Prompt Injection Agen Browser Tanpa Kompromi

Menurut pengungkapan Anthropic melalui platform berita AI Beating, Claude Opus 5 berhasil lolos dalam semua 129 skenario uji prompt injection untuk agen peramban tanpa kompromi, yang menandai terobosan signifikan dalam keamanan agen AI. Dalam pengujian benchmark universal prompt injection dari Gray Swan, Opus 5 mencapai tingkat keberhasilan serangan 2,0% setelah 15 percobaan, jauh melampaui pendahulunya, Opus 4.8 pada 5,5%, serta model tandingan Mythos 5 pada 2,6% dan Fable 5 pada 2,8%.
Penafian: Informasi di halaman ini mungkin berasal dari sumber pihak ketiga dan hanya untuk referensi. Ini tidak mewakili pandangan atau pendapat Gate dan bukan merupakan nasihat keuangan, investasi, atau hukum. Perdagangan aset virtual melibatkan risiko tinggi. Mohon jangan hanya mengandalkan informasi di halaman ini saat membuat keputusan. Untuk detailnya, lihat Penafian.
Komentar
0/400
Tidak ada komentar