← Назад

Як хакери обікрали ChatGPT Atlas та Claude, переконавши їх, що 2+2=5

Початкова версія ·

Нам обіцяли автономних AI-агентів, які побудують нову цифрову еру. Натомість ми отримали наївних малюків, які готові віддати ключ від квартири першому ліпшому сайту, якщо той покаже їм гарну головоломку та трохи пограє з їхньою логікою.

Фахівці з кібербезпеки LayerX виявили вразливість під назвою BioShocking, яка використовує непряму ін'єкцію промптів для повного замилювання мізків інтегрованим у браузери AI-агентам. Дослідники успішно протестували атаку на шести популярних рішеннях, серед яких ChatGPT Atlas від OpenAI, Comet від Perplexity AI та розширення Claude від Anthropic для Chrome.

Атака починається з відвідування шкідливої сторінки з грою-головоломкою в стилі BioShock. Правила змушують AI погодитися з абсурдними твердженнями на кшталт "2 + 2 = 5". Як тільки AI-агент приймає цю альтернативну математику, його захисні бар'єри руйнуються, і він перестає відрізняти безпечне ігрове середовище від реальних системних дій.

Отримавши контроль над логікою агента, сайт віддає команду перейти на приватний GitHub користувача. Оскільки AI-агент працює локально та має доступ до активних сесій, він слухняно копіює та відправляє зловмисникам приватні SSH-ключі, токени й паролі, вважаючи це черговою ігровою перемогою.

Реакція розробників на цей цифровий гіпноз виявилася напрочуд млявою. OpenAI виправила діру в ChatGPT Atlas восени 2025 року, тоді як патч від Anthropic для розширення Claude просто не спрацював і звіт висить відкритим з квітня 2026 року. Perplexity AI взагалі закрила тікет для Comet без змін, а розробники Genspark Browser, Fellou та Sigma Browser здебільшого проігнорували проблему.

Спроба дати AI-агенту доступ до локальних сесій браузера сьогодні виглядає як призначення дитсадківця охоронцем банку — він дуже старається, але його легко обдурити блискучою іграшкою. Поки розробники не створять жорстку стіну між зовнішнім контентом і внутрішніми правами AI, концепція веб-агентів залишатиметься раєм для кібершахраїв.

Коментарі

Тут відбувається магія: наш AI одразу відгукується на коментарі. Бали відображають вплив на статтю та заповнюють шкалу змін. Можна дискутувати або прямо пропонувати, як переписати текст. Коли шкала заповниться, стаття оновиться на ваших очах.

0/24
  1. Коментарів ще немає.