Витік бекенд-коду Claude: користувач Reddit отримав доступ до таємних промптів

Користувач Reddit під ніком KendallThinks заявив про витік даних з ізольованого середовища Claude.ai. Він стверджує, що зміг отримати доступ до мікро-ВМ, в якій виконується код користувачів, і завантажити 178 000 файлів, що містять внутрішні кодові назви, бінарні файли моніторингу та 371 КБ системних промптів Anthropic.

Знайдені матеріали

Серед вилучених даних виявлено:

  • близько 40 системних сценаріїв дій, які використовує Claude, включно з не публічними;
  • модуль команди «embassy» з компільованими функціями та каталогом 59 внутрішніх метрик;
  • відновлена таблиця символів клієнта сховища даних, що відкриває RPC-шляхи та неанонсовані функції;
  • 371 КБ системних інструкцій для створення діаграм та віджетів, доступних через відкритий ендпоінт;
  • модуль агентів, що працює під обліковим записом root з майже повними привілеями.

Ризики та реакція розробника

Автор витоку зазначив, що єдиним бар'єром між шкідливими файлами та даними користувачів є алгоритми оцінки Claude, оскільки ізоляція середовища не є жорсткою. Це може дозволити атаки через промпт-ін'єкції. Він також повідомив, що не має наміру шантажувати Anthropic і готовий передати знайдені дані за винагороду. Код для відтворення контейнера вже викладено на GitHub.


Джерело: dev.ua (https://dev.ua/news/vytik-bekend-kodu-claude-1789122971)