Anthropic запретила пользователям проявлять «жестокость» к своим системам ИИ
Компания заявила, что пользователи больше не могут допускать «длительного и необоснованного» оскорбительного поведения в отношении технологии.

Компания Anthropic привлекла к себе внимание после заявления о том, что она будет блокировать пользователей за «длительное и необоснованное» жестокое обращение со своими системами искусственного интеллекта.
Создатель чат-бота Claude заявил в четверг, что пересматривает правила использования, чтобы его инструменты могли прекращать разговоры, в которых люди проявляют «жестокость» — то, что, по словам компании, уже происходило в «редких» случаях ранее.
Теперь такое поведение появится в списке запрещенных действий, который также включает в себя травлю других людей, поощрение самоповреждения и создание интимных изображений без согласия.
Хотя в Anthropic заявили, что это правило будет применяться только в «крайних случаях» систематического злоупотребления, оно возобновило дискуссию о том, как людям следует общаться с инструментами ИИ.
Компания уточнила, что правило не будет распространяться на «обычные проявления разочарования пользователей, несогласие, мрачные творческие темы, а также тестирование и исследование моделей» — подразумевая, что оно будет применяться только в явно преднамеренных случаях.
Тем не менее, пока неясно, что именно Anthropic будет считать «оскорбительным или жестоким поведением» по отношению к своим моделям.
Скриншоты обновленной политики широко разошлись и обсуждаются в социальных сетях: некоторые хвалят это решение как шаг к хорошим манерам или «благополучию моделей».
Другие, однако, раскритиковали этот шаг, причем один пользователь назвал его «глубоко ошибочным, внешняя ссылка», а другой заявил, что это может ослабить внимание к насилию, направленному на людей и животных.
«Нельзя быть жестоким по отношению к цифрам и математике», — написал в LinkedIn доктор Барри Сканнелл, партнер по технологиям ирландской юридической фирмы William Fry, внешняя ссылка.
«Такой уровень антропоморфизации ИИ вреден. Это заставляет людей верить в то, чем он не является».
Директор по ИИ в Microsoft Мустафа Сулейман, который в сентябре критиковал конкурирующую фирму Anthropic за отношение к ИИ как к человеку, отреагировал на обновление Anthropic эмодзи с тающим лицом.
Anthropic также сообщила в четверг, что ее политика использования была обновлена для устранения новых или возникающих рисков в других областях, включая запрет на использование Claude для «вводящих в заблуждение кампаний» или уточнение того, что, как
заявили в Anthropic, ее предыдущая политика уже запрещала использовать ее инструменты для разработки оружия.
Но ни одно из изменений не привлекло столько внимания и пристального интереса, как решение запретить пользователям оскорблять чат-ботов.
Это также подпитало давний спор о том, должны ли люди быть резкими или вежливыми при использовании инструментов генеративного ИИ.
Некоторые эксперты утверждают, что добавление слов «пожалуйста» или «спасибо» при общении с такими инструментами, как ChatGPT, излишне и расходует токены — единицы, используемые большими языковыми моделями, лежащими в основе инструментов генеративного ИИ, для обработки запросов и ответов пользователям.
Другие утверждают, что вежливость может способствовать получению более качественных ответов.
Когда в прошлом году пользователь X спросил о затратах на электроэнергию, вызванных тем, что ChatGPT отвечает на сообщения пользователей со словами «пожалуйста» и «спасибо», глава OpenAI Сэм Альтман ответил, что это «десятки миллионов долларов, потраченные не зря — мало ли что».
Между тем, словарь Collins Dictionary в ноябре прошлого года отметил возвращение слова «clanker» (жестянка) в качестве пренебрежительного термина для обозначения инструментов ИИ.
Некоторые эксперты также предполагают, что грубость по отношению к чат-ботам с ИИ может нанести вред человеческому общению, влияя на то, как мы разговариваем с другими людьми и относимся к ним.

