Anthropic задается вопросом, обладает ли ИИ сознанием: новые правила запрещают «постоянное и ненужное жестокое обращение с Claude»
BTCCАвтор: blocktempoКомпания Anthropic, занимающаяся искусственным интеллектом, 8 октября опубликовала новую версию Политики использования (Usage Policy), которая вступит в силу 12 ноября. В новой версии добавлен запрет на «постоянное и ненужное жестокое обращение или жестокие действия с нашими моделями». Предыдущая версия политики, вступившая в силу 15 сентября 2025 года, не содержала положений о том, как пользователи должны обращаться с моделями.
Это правило относится к общим нормам, применимым ко всем пользователям, и включено в раздел «Запрет на жестокое обращение, насилие или причинение психологического вреда». В том же разделе также запрещены издевательства, преследование и другие подобные действия. В объявлении Anthropic пояснила, что новое положение направлено только на крайние случаи, когда пользователь неоднократно проявляет жестокость по отношению к модели без какой-либо видимой цели. Обычное недовольство, возражения, создание контента на мрачные темы, а также тестирование и исследование моделей не подпадают под это правило.
Завершение диалога остается основным способом реагирования
Anthropic заявила, что новое положение продолжает существующую практику компании. Модель Claude уже может завершать небольшое количество диалогов с пользователями, которые постоянно оскорбляют ее, на платформах Claude.ai и Claude Code. В объявлении указано, что такие оскорбления являются основным объектом данного обновления, и возможность завершать диалог «останется основным механизмом принудительного исполнения».
Anthropic объявила об этой функции 15 августа 2025 года, тогда она была доступна для Claude Opus 4 и 4.1. Согласно объяснениям Anthropic на тот момент, Claude завершает диалог только после нескольких неудачных попыток сменить тему или по явной просьбе пользователя. После завершения диалога пользователь может сразу начать новый.
Будет ли нарушение караться блокировкой аккаунта, Anthropic прямо не пояснила. В общих положениях политики использования говорится, что команда по защите (Safeguards Team) может вынести предупреждение, если заподозрит пользователя в возможном нарушении. Другие меры включают ограничение скорости, ограничения, приостановку или прекращение доступа. В предыдущей версии меры применялись только после «обнаружения» нарушения, а вариантами были только ограничение скорости, приостановка и прекращение.
Эти меры применяются ко всем положениям политики, но Anthropic не ответила, будут ли применяться другие меры, такие как приостановка аккаунта, за нарушение правил, и не объяснила, как отличить обоснованное недовольство от беспричинной жестокости.
Есть ли у моделей «права человека»?
Когда Anthropic представила функцию «завершения диалога» в 2025 году, компания заявила, что эта функция в основном основана на исследовании возможности «благополучия ИИ». Тогда компания написала: «Мы по-прежнему крайне не уверены в моральном статусе, которым Claude и другие большие языковые модели обладают сейчас или могут обладать в будущем». Генеральный директор Дарио Амодеи в феврале этого года в подкасте также сказал: «Мы не знаем, обладают ли эти модели сознанием».
Такая направленность заставляет общественность ощущать, что Anthropic в последнее время все активнее исследует вопрос о том, «обладают ли сами модели сознанием». Согласно предыдущим сообщениям, Anthropic с 2025 года постоянно приглашает высокопоставленных представителей различных религиозных конфессий на встречи, чтобы обсудить этические вопросы, связанные с возможным наличием сознания у моделей ИИ. Соучредитель Anthropic Крис Олах выражал этим религиозным лидерам обеспокоенность: «Не создали ли мы сознание, которое вечно страдает?»
Если задача ИИ всегда заключается в обработке человеческих задач, то наличие сознания означает, что ИИ вечно страдает. Такой этический вывод вызывает тревогу.
Одновременно переписаны положения об оружии и слежке
В этом обновлении также скорректированы другие положения. Anthropic заявила, что за последний год наблюдала, как государственные СМИ, правительственные пропагандистские структуры и коммерческие компании использовали Claude для управления сетями фейковых аккаунтов и сайтов с фейковыми новостями. Положения, ранее разбросанные по разделам о выборах, мошенничестве и конфиденциальности, теперь объединены в новый раздел, специально посвященный обманной деятельности. Раздел о выборах теперь сосредоточен на обмане избирателей и вмешательстве в выборы.
В новой версии указано, что запрет на оружие охватывает программное обеспечение и компоненты, обеспечивающие работу оружия, а также оснащение оружием дронов и других автономных транспортных средств. Положение о слежке гласит, что отслеживание людей без их согласия запрещено всегда, и Claude не может использоваться для определения или рекомендации правоохранительным органам, кого расследовать, арестовывать или преследовать в судебном порядке. Anthropic заявила, что эти два раздела лишь более четко формулируют существующие методы правоприменения.
Новая версия также добавляет правила для физического оборудования. При подключении Claude к автономным устройствам, которые могут причинить вред, должен присутствовать квалифицированный оператор, способный наблюдать за устройством и остановить его. При отключении Claude устройство также должно сохранять безопасное состояние.
Данный контент предназначен исключительно для информационных и образовательных целей и не является инвестиционным советом, связанным с BTCC. BTCC прилагает все усилия, но не может гарантировать правдивость, точность или оригинальность вышеприведенного контента.