Що змінилося у правилах Claude

Компанія Anthropic оновила умови використання свого чатбота Claude і вперше прямо заборонила користувачам поводитися з моделлю «тривало й без потреби жорстоко або образливо». За поясненням компанії, ця норма не має застосовуватися до більшості звичайних взаємодій. Йдеться радше про крайні випадки, коли людина багаторазово демонструє жорстоку поведінку без помітної мети.

Anthropic підкреслює, що користувацьке розчарування, жорстка критика, суперечки з моделлю, робота з темними творчими сюжетами або дослідницьке тестування під нову заборону не підпадають. У компанії кажуть, що правило має стосуватися лише ситуацій, у яких поведінка є систематично образливою й не має зрозумілого призначення.

Як компанія планує застосовувати норму

За даними Anthropic, Claude і раніше міг завершувати розмову, якщо користувач наполегливо поводився образливо. Компанія каже, що саме завершення чату залишиться головним механізмом реагування. Якщо розмова припинена, нові повідомлення в межах цього діалогу надсилати вже не можна, але інші чати на акаунті це не зачіпає.

Таке формулювання важливе, бо Anthropic фактично не вводить новий технічний бар’єр для всіх користувачів, а радше уточнює межі допустимого й залишає за собою право зупиняти окремі діалоги у виняткових випадках.

Чому Anthropic переглядає політику

У компанії кажуть, що частину правил переписали та згрупували заново, щоб зібрати схожі за змістом обмеження в окремі розділи. Водночас Anthropic стверджує, що деякі зміни з’явилися через практики зловживання, які вона вже фіксувала у роботі Claude.

Зокрема, компанія повідомляє, що знаходила використання Claude у мережах фейкових акаунтів і вигаданих новинних сайтів, які пов’язували з державними медіа, урядовою пропагандою та комерційними структурами. Саме це, за версією Anthropic, стало однією з причин появи окремого блоку про deceptive campaigns — тобто обманні кампанії.

Які ще обмеження з’явилися

Оновлена політика окремо забороняє шахрайські політичні та комерційні кампанії, включно з фейковими відгуками, астротурфінгом, підробними сайтами та ботами, що видають себе за людей. Також компанія звузила правила щодо виборів: Claude не можна використовувати для введення виборців в оману або втручання у голосування.

У блоці про зброю Anthropic прямо забороняє застосування Claude для розробки зброї чи її компонентів. Окремо з’явилася норма, що не дозволяє модифікувати біологічні або хімічні агенти так, щоб підвищити їхню смертельність або здатність до поширення. Також заборонено використовувати модель для озброєння дронів та інших безпілотних систем.

Політика щодо правоохоронних органів теж переписана. Claude не може вирішувати або радити, кого розслідувати, заарештовувати, висувати обвинувачення чи переслідувати. Окремо заборонено відстеження людей без їхньої згоди, побудову інструментів стеження та доксинг.

Ще одна нова частина стосується фізичних дій. Якщо Claude керує обладнанням, здатним завдати шкоди, за роботою має стежити кваліфікована людина, яка може вчасно зупинити процес. Крім того, Anthropic заборонила створення, поширення або погрози поширити інтимні зображення без згоди людини, а також інструменти для їхнього виготовлення.

Що це означає для користувачів

Для більшості людей зміни, судячи з пояснень Anthropic, не мають змінити повсякденне використання Claude. Компанія наголошує, що нові або перегруповані правила спрямовані насамперед на зловживання, які вона вже бачила на практиці, а не на звичайні розмови, суперечки чи тестування можливостей моделі.

Водночас оновлення показує, що Anthropic намагається точніше окреслити межі дозволеного у сферах, де генеративний ШІ може бути використаний для маніпуляцій, стеження, шахрайства або створення небезпечного контенту. Саме ці ризики, за логікою компанії, і стали підставою для перегляду політики.