Витік бекенд-коду Claude: користувач Reddit отримав доступ до таємних промптів
Користувач Reddit під ніком KendallThinks заявив про витік даних з ізольованого середовища Claude.ai. Він стверджує, що зміг отримати доступ до мікро-ВМ, в якій виконується код користувачів, і завантажити 178 000 файлів, що містять внутрішні кодові назви, бінарні файли моніторингу та 371 КБ системних промптів Anthropic.
Знайдені матеріали
Серед вилучених даних виявлено:
- близько 40 системних сценаріїв дій, які використовує Claude, включно з не публічними;
- модуль команди «embassy» з компільованими функціями та каталогом 59 внутрішніх метрик;
- відновлена таблиця символів клієнта сховища даних, що відкриває RPC-шляхи та неанонсовані функції;
- 371 КБ системних інструкцій для створення діаграм та віджетів, доступних через відкритий ендпоінт;
- модуль агентів, що працює під обліковим записом root з майже повними привілеями.
Ризики та реакція розробника
Автор витоку зазначив, що єдиним бар'єром між шкідливими файлами та даними користувачів є алгоритми оцінки Claude, оскільки ізоляція середовища не є жорсткою. Це може дозволити атаки через промпт-ін'єкції. Він також повідомив, що не має наміру шантажувати Anthropic і готовий передати знайдені дані за винагороду. Код для відтворення контейнера вже викладено на GitHub.
Джерело: dev.ua (https://dev.ua/news/vytik-bekend-kodu-claude-1789122971)