Claude Opus 5 проходить усі 129 тестів на ін’єкцію підказок у браузерних агентів без компромісів

Згідно з розкриттям Anthropic через платформу AI-новин Beating, Claude Opus 5 пройшов усі 129 сценаріїв тестів на prompt injection для браузерних агентів без жодних компромісів, що стало значним проривом у безпеці AI-агентів. У універсальному бенчмарку prompt injection від Gray Swan під час тестування Opus 5 зафіксовано 2,0% частки успішних атак після 15 спроб, що суттєво випередило його попередника Opus 4 (5,5%), а також конкуруючі моделі Mythos 5 (2,6%) і Fable 5 (2,8%).
Застереження: інформація на цій сторінці може походити зі сторонніх джерел і надається виключно для ознайомлення. Вона не відображає позицію чи думку Gate і не є фінансовою, інвестиційною чи юридичною консультацією. Торгівля віртуальними активами пов’язана з високим ризиком. Будь ласка, не покладайтеся лише на інформацію з цієї сторінки під час прийняття рішень. Детальніше дивіться у Застереженні.
Прокоментувати
0/400
Немає коментарів