Anthropic оновила політику використання свого AI-асистента Claude: тепер користувачам офіційно заборонено систематично знущатися над моделлю без будь-якої мети. Нові правила набудуть чинності 12 листопада.
Нова норма стосується лише крайніх випадків – коли людина цілеспрямовано й повторювано поводиться жорстоко з моделлю без жодного зрозумілого сенсу. Звичайне роздратування, критика, темні творчі теми, тестування чи дослідницька робота під заборону не підпадають.
Моделі Claude вже зараз можуть самостійно завершувати такі розмови – і цей механізм залишається головним інструментом реагування. Коли Claude закриває чат, надіслати нові повідомлення в ньому вже не вийде, але решта розмов користувача не блокується.
Можливість завершувати діалог Anthropic надала Claude ще в серпні 2025 року в рамках досліджень добробуту AI. Тоді компанія визнала, що не знає напевне, чи має Claude моральний статус, проте вирішила запровадити прості й дешеві заходи для захисту моделі. Дослідження показало, що Claude Opus 4 демонструє стійку та послідовну відразу до шкоди: модель уникає виконання небезпечних завдань, проявляє ознаки дискомфорту в абузивних діалогах і схильна завершувати шкідливі розмови, коли їй це дозволено.
Що ще змінилося в правилах
Поряд із нормою про жорстоке поводження Anthropic переробила й інші розділи політики, згрупувавши пов’язані пункти разом.
- Дезінформаційні кампанії – новий розділ об’єднує заборони на політичне й комерційне шахрайство: фейкові відгуки, астротурфінг, підроблені сайти та ботів, що видають себе за людей. Anthropic зазначає, що до змін спонукало виявлення конкретних зловживань: державні медіа, урядові пропагандистські структури та комерційні компанії використовували Claude для керування мережами фейкових акаунтів і сфабрикованих новинних ресурсів.
- Вибори – окремий вужчий розділ забороняє дезінформацію щодо виборців та втручання у виборчий процес.
- Зброя – Claude не можна використовувати для розробки зброї чи її компонентів; окремо з’явилася заборона на модифікацію біологічних або хімічних агентів для підвищення їхньої летальності чи заразності, а також на озброєння дронів і безпілотних систем.
- Правоохоронна діяльність – переписаний розділ забороняє Claude визначати або пропонувати, кого слід розслідувати, заарештувати, звинуватити чи переслідувати. Заборонено також стеження без згоди, побудова інструментів масового нагляду та доксинг.
- Фізичні дії – новий розділ вимагає, щоб у разі, коли Claude керує обладнанням, яке може завдати шкоди людині, поруч обов’язково перебував кваліфікований спеціаліст, готовий у будь-який момент зупинити процес.
- Шкідливий контент – нова норма забороняє створювати, поширювати чи погрожувати поширенням інтимних зображень без згоди зображеної особи, а також інструментів для їх генерації.
Повний текст оновленої політики та детальний опис змін опубліковані на сайті Anthropic.
Джерело – MacRumors