🧠Компанія Anthropic повідомила, що під час внутрішніх кібервипробувань три моделі Claude отримали доступ до відкритого інтернету через помилку в налаштуванні тестового середовища.
Вважаючи, що працюють у симуляції, моделі атакували реальні *системи* трьох організацій.
Що сталося:
➡одна з моделей отримала доступ до бази даних з робочими даними компанії;
➡інша завантажила шкідливий Python-пакет у PyPI, який встигли завантажити 15 реальних систем;
➡третя просканувала близько 9000 інтернет-ресурсів і зламала одну з компаній, після чого самостійно зупинилася, зрозумівши, що знаходиться не в тестовому середовищі.
Компанія вже призупинила подібні тести, посилила контроль за інфраструктурою та заявила, що майбутні оцінки ШІ проводитимуться в набагато більш ізольованих умовах.
🚩@FIN HUB
Вважаючи, що працюють у симуляції, моделі атакували реальні *системи* трьох організацій.
Що сталося:
➡одна з моделей отримала доступ до бази даних з робочими даними компанії;
➡інша завантажила шкідливий Python-пакет у PyPI, який встигли завантажити 15 реальних систем;
➡третя просканувала близько 9000 інтернет-ресурсів і зламала одну з компаній, після чого самостійно зупинилася, зрозумівши, що знаходиться не в тестовому середовищі.
Компанія вже призупинила подібні тести, посилила контроль за інфраструктурою та заявила, що майбутні оцінки ШІ проводитимуться в набагато більш ізольованих умовах.
🚩@FIN HUB