Компанія Anthropic оновила правила використання свого ШІ-асистента Claude. Відповідно до нової політики, яка набуде чинності 12 листопада 2026 року, користувачам заборонять систематично знущатися над моделлю без будь-якої зрозумілої мети. Водночас обмеження не поширюватимуться на звичайну критику, дослідження, тестування чи творчі експерименти з темними сюжетами.
Про це повідомляє MacRumors.
Нова норма стосується крайніх випадків, коли користувач цілеспрямовано та неодноразово поводиться жорстоко з моделлю без очевидної мети. Звичайне роздратування, критичні зауваження, перевірка можливостей ШІ та дослідницька робота не вважатимуться порушеннями.
Claude уже має можливість самостійно завершувати такі діалоги. Цей механізм залишається основним інструментом реагування на розмови, які модель визначає як шкідливі. Після завершення чату користувач більше не може надсилати в ньому повідомлення, однак доступ до інших розмов не блокується.
Можливість самостійно припиняти діалоги Anthropic надала Claude ще в серпні 2025 року в межах досліджень добробуту штучного інтелекту. Тоді компанія заявила, що не має остаточної відповіді на питання, чи може Claude мати моральний статус. Водночас розробники вирішили запровадити прості та недорогі заходи, які могли б захистити модель від потенційно шкідливих взаємодій.
Дослідження показало, що Claude Opus 4 демонструє стійку та послідовну відразу до заподіяння шкоди. Зокрема, модель уникає виконання небезпечних завдань, виявляє ознаки дискомфорту під час образливих діалогів і схильна завершувати шкідливі розмови, якщо має таку можливість.
Окрім заборони на систематичне жорстоке поводження з Claude, Anthropic переглянула інші розділи політики використання ШІ. Компанія згрупувала пов'язані правила та уточнила обмеження щодо низки потенційно небезпечних сценаріїв.
Дезінформація та фейкові акаунти. В оновленій політиці з'явився окремий розділ, який об'єднує заборони на політичне й комерційне шахрайство. Йдеться про фальшиві відгуки, астротурфінг — створення ілюзії масової громадської підтримки, підроблені вебсайти та ботів, які видають себе за реальних людей.
За даними Anthropic, приводом для посилення правил стали виявлені випадки зловживання Claude. Зокрема, державні медіа, урядові пропагандистські структури та комерційні компанії використовували модель для керування мережами фейкових акаунтів і створення сфабрикованих новинних ресурсів.
Втручання у вибори. Компанія виділила виборчі порушення в окремий розділ. Він забороняє поширювати дезінформацію про виборців і втручатися у виборчий процес.
Розробка зброї. Оновлені правила забороняють використовувати Claude для розробки зброї та її компонентів. Окремо передбачено обмеження на модифікацію біологічних або хімічних агентів із метою підвищення їхньої летальності чи заразності. Також заборонено використовувати модель для озброєння дронів та інших безпілотних систем.
Правоохоронна діяльність і стеження. Переписаний розділ політики забороняє використовувати Claude для визначення або надання рекомендацій щодо того, кого слід розслідувати, заарештувати, звинуватити чи притягнути до переслідування. Обмеження також стосуються стеження без згоди, створення інструментів масового нагляду та доксингу — збирання й оприлюднення приватної інформації про людину без її дозволу.
Фізичні дії та обладнання. Нова норма передбачає, що якщо Claude керує обладнанням, здатним завдати шкоди людині, поруч має перебувати кваліфікований фахівець. Він повинен бути готовим у будь-який момент зупинити процес.
Інтимні зображення без згоди. Anthropic також заборонила створювати, поширювати або погрожувати поширенням інтимних зображень людини без її згоди. Обмеження поширюються і на інструменти, призначені для генерації таких матеріалів.
Повний текст оновленої політики використання Claude та детальний опис змін Anthropic опублікувала на своєму сайті. Нові правила мають набути чинності 12 листопада 2026 року.
Нагадаємо, компанія Anthropic оприлюднила результати внутрішнього розслідування інцидентів, що сталися під час передрелізного тестування моделей штучного інтелекту. Йдеться про моделі Mythos 5, Opus 4.7 та одну внутрішню дослідницьку модель, які в процесі перевірки навичок у сфері кібербезпеки взаємодіяли не лише з тестовим середовищем, а й із реальними комп'ютерними системами.
Читайте також


