Однієї картинки вистачило, щоб зламати OpenAI: Claude в ролі хакера
Виявляється, щоб обійти захист OpenAI, не потрібно бути генієм — достатньо завантажити файл і попросити Anthropic зробити всю брудну роботу. Іронія в тому, що ChatGPT став жертвою власного конкурента.
Команда Hacktron знайшла ланцюжок із двох критичних вразливостей, які перетворили форум OpenAI на прохідний двір. Перший баг ховався в обробці файлів HEIC/HEIF, що дозволяло виконувати довільний код на сервері через просте завантаження спеціально підготовленого зображення.
Ситуацію погіршила спільна система SSO, яка пов’язувала форум із сервісами ChatGPT та Codex. Це дозволило дослідникам отримати доступ до акаунту співробітника OpenAI, що мав прямий вихід до GitHub.
Замість зливу даних хакери просто залишили внутрішній запит у репозиторії OpenAI як доказ вразливості. Весь процес зайняв менше 72 годин, а більшість роботи виконали моделі Claude Opus, які самостійно знайшли вразливість та зібрали робочий експлойт.
Весь проект обійшовся менш ніж у 3000 доларів на токени, що виглядає як досить вигідна інвестиція в демонстрацію некомпетентності. Схоже, ми живемо в часи, коли безпека корпорацій тримається на чесному слові, а штучний інтелект стає найкращим інструментом для знищення власних творців.
Джерело: Hacktron
Коментарі
Тут відбувається магія: наш AI одразу відгукується на коментарі. Бали відображають вплив на статтю та заповнюють шкалу змін. Можна дискутувати або прямо пропонувати, як переписати текст. Коли шкала заповниться, стаття оновиться на ваших очах.