Назад в ленту

Claude использовали для биологических рисков и кибератак — Anthropic опубликовала отчёт

Компания Anthropic раскрыла пять случаев использования своей модели Claude в опасных биологических исследованиях, а также кампании в киберпространстве и обвинения против китайских компаний.

Anthropic опубликовала отчёт, от которого становится не по себе. Компания, известная своей моделью Claude, призналась: её ИИ использовали для исследований, потенциально применимых к созданию биологического оружия. И это только верхушка айсберга.

Пять случаев биологических рисков. Кампании в киберпространстве. Обвинения в адрес китайских компаний. Отчёт охватывает период с декабря 2025 по август 2026 года и рисует картину, в которой искусственный интеллект всё чаще становится инструментом не только для созидания, но и для разрушения. Anthropic фиксирует, блокирует, передаёт данные властям. Но вопросы остаются.

Что именно обнаружили в компании, почему исследователи обходят защиту и при чём тут вирус чикунгунья — разбираемся в деталях.

Пять инцидентов с биологическими рисками

Двойное назначение: когда наука и оружие идут рука об руку

Модель Claude by Anthropic, оказывается, слишком хорошо разбирается в биологии. С декабря 2025 года по август 2026-го компания зафиксировала пять случаев, когда исследователи использовали её для работ, результаты которых потенциально могли лечь в основу биологического оружия. Anthropic честно признаёт: злонамеренных намерений учёных она не доказала. Но активность заблокировала — на всякий случай. И это не паранойя, а суровая реальность двойного назначения.

Проблема в том, что одни и те же знания помогают и вакцины разрабатывать, и патогены поопаснее создавать. По отдельному запросу невозможно понять, чего хочет пользователь: спасти человечество или устроить биологический апокалипсис. Anthropic называет это «невероятно сложной и неоднозначной ситуацией». Мягко сказано.

Чикунгунья, птичий грипп и ещё три тёмные истории

Первый случай — работа с вирусом чикунгунья, который переносят комары. Исследователи готовили заявку на финансирование экспериментов по усилению функций вируса. Система защиты Claude сработала и заблокировала запрос. Насторожило Anthropic то, что связанные работы предназначались для военного исследовательского учреждения. После отказа модель искать обходные пути не стала — исследователи пошли другими каналами.

Второй эпизод касается высокопатогенного птичьего гриппа. Учёный несколько недель использовал Claude для планирования экспериментов, анализа данных и научной интерпретации результатов. До самых мощных моделей компании его не допустили — пришлось довольствоваться версиями послабее. Ещё три случая связаны с ортопоксвирусами, соединениями из мира ядов и токсинами. Личности, гражданство и технические детали Anthropic не раскрывает. Скучно, но предсказуемо.

В компании уверены: дальше будет только хуже. Новые поколения моделей эффективнее помогают с научным анализом, а значит, и потенциальный ущерб от злоупотреблений растёт. Учётные записи, связанные с инцидентами, заблокированы. Информация передана властям и другим разработчикам ИИ. Ограничения для биологических запросов высокого риска усилены. Дверь закрыли — но осадочек остался.

Обход защитных механизмов и двойное назначение

Игра в кошки-мышки

Блокировка отдельного запроса — это не защита. Это просто вежливое «нет». Anthropic обнаружила посредническую платформу, которая перенаправляла отклонённые биологические запросы к ИИ-моделям с менее строгими механизмами безопасности. Исследователи не сдались — они просто пошли в обход. Классика жанра: запретный плод сладок, а запретная модель — ещё и доступна.

Двойное назначение — главная головная боль. Одни и те же знания помогают и вакцины разрабатывать, и патогены поопаснее создавать. По отдельному запросу не поймёшь, чего хочет пользователь: спасти мир или устроить биологический апокалипсис. Anthropic честно называет это «невероятно сложной и неоднозначной ситуацией». Глава отдела разведки угроз компании Джейкоб Кляйн сформулировал ещё прямее: «Вы не увидите кого-либо, кто скажет, как в комиксах: “Я хочу создать биологическое оружие, чтобы убить всех”». Логично. Злодеи из комиксов не пишут заявки на гранты.

Семь областей вреда и один отчёт

В отчёте Anthropic за сентябрь 2026 года перечислены семь областей неправомерного использования: кибероперации, операции влияния, слежка, мошенничество, биологическое неправомерное использование, разработка обычных вооружений и дистилляция. Claude Haiku, Sonnet и Opus засветились в инцидентах, а вот модели Fable и Mythos-класса в неприятности не попали — за исключением одного эпизода. Компания считает биологическое неправомерное использование одним из самых серьёзных рисков для современных моделей ИИ. И, судя по масштабу отчёта, не зря.

Агентство Bloomberg 10 сентября сообщило, что OpenAI может замедлить разработку передовых ИИ-систем из-за растущих опасений. Сотрудники крупнейших компаний в последние недели стали открыто говорить о рисках, связанных с развитием передовых технологий нейросетей. Похоже, эпоха бездумной гонки за возможностями заканчивается. Начинается эпоха осторожности, отчётов и блокировок. Скучно? Зато безопаснее.

Кибероперации Midnight Blizzard и другие угрозы

Кибероперации Midnight Blizzard

Anthropic в том же отчёте раскрыла неприятную деталь: Claude активно использовали в кибероперациях. Одну из кампаний компания связала с группировкой Midnight Blizzard, которую принято относить к российским хакерам. По данным Anthropic, ИИ применялся для автоматизации фишинга, подготовки инфраструктуры, разработки вредоносного ПО и кражи данных. В кампании засветились более 20 организаций, включая государственные, дипломатические и оборонные структуры Украины и европейских стран. Звучит как сюжет шпионского триллера, но это отчёт, опубликованный на Anthropic.com. Конкретные технические детали компания не раскрывает — и правильно, не будем давать хакерам инструкции.

Обычные вооружения и другие угрозы

Но и это не всё. Зафиксированы попытки применения Claude для разработки обычных вооружений в Китае, России и Йемене. Никаких подробностей — Anthropic хранит молчание, как партизан на допросе. Видимо, чтобы не подсказывать плохим парням, как именно их поймали. Что ж, логично. Меньше знаешь — крепче спишь, а хакеры пусть нервничают.

Дистилляция моделей и претензии к китайским компаниям

Дистилляция моделей: тонкая грань между обучением и кражей

Завершает отчёт Anthropic тема, от которой у юристов компании, вероятно, дёргается глаз. Речь о дистилляции моделей — процессе, при котором знания и поведение более мощной модели переносятся в менее ресурсоёмкую. Звучит невинно, почти как репетиторство. На практике же китайские компании используют эту технику, чтобы выкачивать наработки американских разработчиков. Anthropic сообщила подробности о кампаниях по дистилляции моделей, проводимых Alibaba, Moonshot AI и DeepSeek. В последние месяцы китайские разработчики нарастили усилия в этой области — что и стало поводом для коллективных обвинений, выдвинутых спецслужбами США.

Дистилляция позволяет переносить знания и поведение более сильных моделей в менее ресурсоёмкие, что вызывает вопросы о защите интеллектуальной собственности и безопасности. По сути, это способ получить результат, не вкладываясь в разработку. Как переписать чужую контрольную и сдать её под своим именем. Только ставки здесь куда выше, чем оценка за четверть. Эта тема вошла в общий отчёт Anthropic о неправомерном использовании ИИ наряду с кибероперациями и биологическими рисками. Похоже, эпоха наивной веры в то, что технологии не знают границ, заканчивается. Компании начинают считать не только возможности, но и убытки.

Anthropic сделала то, что редко делают корпорации: вынесла сор из избы. Отчёт — это не только признание проблем, но и попытка задать стандарт прозрачности. Другой вопрос, готовы ли к этому другие игроки рынка. OpenAI, по данным Bloomberg, уже задумалась о замедлении разработки. Возможно, это начало новой эры — не гонки за мощностью, а гонки за безопасностью. Следить за этим будет интересно. А пока — читайте отчёты внимательнее. Иногда самое важное прячется в сносках.

Справка по теме (FAQ)
Сколько случаев биологических рисков выявила Anthropic?
Пять случаев за период с декабря 2025 года по август 2026 года. Они касались работы с вирусом чикунгунья, высокопатогенным птичьим гриппом, ортопоксвирусами, соединениями, имеющими отношение к ядам, и токсинами.
Что такое дистилляция моделей?
Дистилляция — это процесс переноса знаний и поведения более мощной модели ИИ в менее ресурсоёмкую. Anthropic обвинила китайские компании Alibaba, Moonshot AI и DeepSeek в использовании этой техники для копирования наработок американских разработчиков.
Какие модели Claude использовались в инцидентах?
В инцидентах использовались модели Claude Haiku, Sonnet и Opus. Ни один из случаев неправомерного использования не касался моделей Claude Fable или Mythos-класса, за исключением одного эпизода.
Что за группировка Midnight Blizzard?
Midnight Blizzard — хакерская группировка, которую Anthropic связывает с российскими хакерами. По данным компании, ИИ применялся для автоматизации фишинга, подготовки инфраструктуры, разработки вредоносного ПО и кражи данных. В кампании фигурировали более 20 организаций.