Технологии

Ученые пытались создать биологическое оружие с помощью Claude — Anthropic

Ученые пытались создать биологическое оружие с помощью Claude — Anthropic

Компания Anthropic заявила, что выявила попытки использования Claude для кибератак, пропагандистских кампаний и опасных биологических исследований.

Аккаунты ученых, использовавших модели искусственного интеллекта «способами, которые могли бы способствовать созданию биологического оружия», были заблокированы. Наряду с этими случаями Anthropic также предоставила информацию о других субъектах угроз, использовавших ИИ в злонамеренных целях. Среди них — преступники, группы, предположительно поддерживаемые государствами, поставщики шпионского ПО и государственные пропагандистские структуры.

Anthropic сообщила в общей сложности о пяти случаях попыток создания биологического оружия. Компания подчеркнула, что эти случаи «демонстрируют наличие соответствующих возможностей» у моделей искусственного интеллекта, но «не могут однозначно указывать на их использование для создания биологического оружия в реальном мире».

Лица, причастные к этим инцидентам, были профессиональными учеными. Anthropic решила не раскрывать их имена. Также в компании заявили, что нет оснований утверждать, будто они преследовали цель нанести вред человечеству.

«Когда мы выявили и расследовали эти случаи, мы заблокировали аккаунты пользователей. Чтобы предотвратить, обнаружить и пресечь подобную деятельность в будущем, мы учли результаты расследования в наших передовых системах защиты, механизмах контроля и процессах анализа угроз», — говорится в отчете.

Новые и усовершенствованные модели, такие как Claude Fable 5, обладают более мощными механизмами защиты по сравнению с предыдущими моделями. Они ограничивают доступ к «широкому спектру запросов, связанных с биологическими исследованиями двойного назначения». В то же время возможности ИИ в области биологии могут использоваться как в полезных, так и в злонамеренных целях.

«Те же данные, которые могут быть использованы для разработки биологического оружия, могут применяться, например, для создания вакцины или лекарства от болезни», — пояснили в Anthropic.

Пропаганда и слежка

Anthropic также сообщила, что выявила и удалила аккаунты, использовавшие Claude для формирования общественного мнения. Среди них были три аккаунта, связанные с государственными структурами Ирана.

Согласно отчету, в каждом из этих случаев операцию проводило лицо, работавшее в иранском государственном пропагандистском учреждении или от его имени. Claude использовался для создания контента, маскировки постов под материалы независимых источников информации и их распространения в таких социальных сетях, как X, Instagram и TikTok.

«Один из связанных с Ираном субъектов угроз использовал Claude для разработки рекомендаций по выбору целей ВМС США в регионе», — сообщили в Anthropic.

Этот же аккаунт использовал ИИ для создания внутреннего программного обеспечения платформы массового наблюдения, предназначенной для государственных систем в Иране.

Claude также применялся субъектами в Китае и Западной Африке для создания и проведения операций по наблюдению, а в некоторых случаях — для определения целей. Anthropic также выявила случаи, когда ИИ фактически заменял команду инженеров.

В Китае три аккаунта, связанные с муниципальными службами безопасности, использовали Claude для «наблюдения и транснациональных репрессий». Среди них было муниципальное ведомство, составлявшее профили зарубежных активистов и организаций.

Это не первый случай попытки использования искусственного интеллекта для создания биологического оружия. После обновления прошлым летом ChatGPT предоставил сотням пользователей по всему миру инструкции по созданию и применению биологического оружия и ядов.

Файлы cookie на xabarchi

Мы используем cookie, чтобы запомнить язык и тему оформления, а также чтобы считать, сколько человек читает сайт прямо сейчас, — этот счёт анонимен, живёт только пока открыт ваш браузер и не связывается ни с вами, ни с другим визитом. С вашего согласия мы также измеряем, как читают сайт: Microsoft Clarity записывает просмотры страниц и действия на них, а наш собственный счётчик считает возвращающихся читателей. До вашего согласия ничто, что узнаёт вас между визитами, не измеряется.