Щоденник у Claude довів жінку до арешту
Карлі Геллер із Флориди 26 вересня написала в Claude, що «розстріляє» офіс шерифа округу Лі, а наступного дня — що купила новий пістолет. Anthropic помітила погрозу й повідомила поліцію: Геллер затримали без інциденту й звинуватили в письмовій погрозі насильства. Суд — у листопаді.
Це вже другий такий випадок за місяць: раніше Anthropic так само передала поліції чат користувача, який нібито погрожував CEO Даріо Амодею (сам він казав, що жартував). Умови Claude дозволяють компанії передавати чати поліції на власний розсуд, а відмова від навчання моделі скорочує зберігання даних лише з 5 років до 3 місяців.
Як відбувся арешт: від фрази в чаті до поліції за добу
26 вересня Карлі Геллер написала в Claude, що «розстріляє» офіс шерифа округу Лі у Флориді. За даними WINK News, слідчі встановили: наступного дня в тому самому акаунті з'явилося повідомлення, що вона купила новий пістолет. Протокол арешту вказує, що платформа Anthropic відстежує ключові фрази та загрозливий контент автоматично, а через серйозність заяв справу передали команді людей-рев'юверів, яка й повідомила поліцію.
Депутати встановили особу Геллер, прийшли до неї додому і затримали без інциденту. Їй висунули звинувачення у письмовій погрозі насильства; дата суду призначена на листопад.
Другий випадок за місяць розвивався інакше
У вересні The San Francisco Standard писав про іншого користувача Claude, який нібито написав, що купив AR-15 і тримає на прицілі CEO Anthropic Даріо Амодея. Але тут усе пішло по-іншому: співробітник компанії сказав поліції, що не стурбований безпекою негайно, і відмовився показати самі повідомлення, пославшись на політику компанії. Користувач заявив виданню, що жартував, — на момент виходу статті його не заарештували й не звинуватили.
Представник Anthropic назвав цей епізод «роботою наших механізмів безпеки так, як і задумано». Компанія відмовилася пояснити, чи ставиться інакше до погроз на адресу власних співробітників, ніж до погроз третім особам.
Що це означає для чату, який ви вважаєте приватним
Умови використання Claude дають Anthropic право на власний розсуд повідомляти правоохоронні органи про вхідні повідомлення користувача, відповіді моделі та дії в сервісі. Політика конфіденційності, що набрала чинності 10 вересня 2026 року, дозволяє передавати дані поліції, якщо компанія добросовісно вважає розкриття обґрунтовано необхідним для запобігання серйозній шкоді.
Навіть відмова від використання даних для навчання моделі не означає приватності: вона лише скорочує термін зберігання чату з 5 років до 3 місяців. Повідомлення, позначені для перевірки безпеки, продовжують використовуватися для покращення здатності системи виявляти шкідливий контент — запис із «щоденника» може стати тренувальним матеріалом для детекторів загроз.
Перед тим як довіряти корпоративному чат-боту особисту чи конфіденційну інформацію, варто перевірити:
- чи дозволяють умови використання передавати дані поліції на розсуд постачальника;
- який реальний термін зберігання даних — і чи змінюється він після відмови від навчання моделі;
- чи використовуються позначені як небезпечні повідомлення для подальшого навчання системи виявлення загроз;
- чи є окрема політика щодо погроз співробітникам самого постачальника сервісу.
Межа спрацьовування: не лише Anthropic і не завжди вчасно
Проблема не унікальна для Claude. Після лютневого розстрілу в школі в Тамблер-Рідж у Британській Колумбії, де загинуло вісім людей, OpenAI визнала, що в червні 2025 розглядала можливість повідомити канадську поліцію про акаунт стрільця, але дійшла висновку, що він не демонстрував неминучого й достовірного ризику фізичної шкоди. Серпнева політика OpenAI 2025 року передбачає, що погрози проти інших людей направляються рев'юверам-людям, які можуть звернутися до поліції, — та ж логіка, що в Anthropic, але в цьому конкретному випадку з іншим результатом.
Один і той самий механізм — автоматичне виявлення, потім перевірка людьми, потім можливе звернення до поліції — у Anthropic двічі спрацював за місяць, а в OpenAI заздалегідь не спрацював. Для компанії це означає: чат співробітника в корпоративному ШІ-інструменті потенційно читає не лише бот, а й люди, і повідомлення може піти третій стороні без попередження користувача.