Назад в ленту

Искусственный интеллект не умеет говорить «нет»: почему отказ моделей может обернуться катастрофой

Пока одни спорят о сознании Claude, другие пытаются собрать биологическое оружие с помощью чат-ботов — и это только верхушка новостной повестки.

Искусственный интеллект сегодня обучен отказывать на огромное количество запросов. Попросите чат-бота рассказать, как отравить коллегу или связать удавку — и он вежливо откажется. Красиво, цивилизованно, безопасно. Ровно до того момента, пока отказ не сработает так, как задумано. А он не срабатывает.

Некоторые уже пытаются использовать модели для работы с биологическими патогенами и сборки автономных дроновых роёв. Рано или поздно провалившийся отказ приведёт к катастрофе глобального масштаба. И это не сценарий дешёвого блокбастера — это реальный вызов, который индустрия пока не научилась решать.

Где ломается логика отказов

Логика проста: модель должна провести черту между тем, чему следует подчиняться, и тем, чему нельзя. Но провести эту черту — значит взять на себя ответственность за моральный выбор. А если черту рисуют правительства, это уже совсем другая история: под предлогом безопасности можно ограничить что угодно, включая свободу слова.

Парадокс в том, что возможности, делающие Artificial Intelligence полезным, делают его же и опасным. Хотите, чтобы модель помогала лечить рак? Значит, ей нужны знания в генетике — те самые, что позволяют создать биологическое оружие. Хотите эффективный ИИ в обороне? Получите того же ИИ, способного управлять автономными системами во вред. Использование Artificial Intelligence Technologies — это всегда игра на грани, где польза и риск живут в одном флаконе.

Что нового у Anthropic и OpenAI

Anthropic, тем временем, решила, что хватит терпеть грубость в адрес своих моделей. В обновлённой политике от 8 октября 2026 года компания запретила «устойчивое и ненужное жестокое или оскорбительное поведение» по отношению к Claude. Политика вступит в силу 12 ноября. Уточняется, что запрет касается только крайних случаев — обычное раздражение пользователя, мрачные творческие темы или тестирование моделей под него не попадают.

Параллельно с этим OpenAI сообщила инвесторам, что её годовая выручка приближается к 50 миллиардам долларов — на 20 миллиардов меньше, чем цифра, гулявшая по рынку ранее. Причина банальна: инвесторы сравнивали показатели с Anthropic напрямую, не учитывая, что та включает в выручку продажи через облачных партнёров, а OpenAI — нет. IPO компании отложено на начало 2027 года.

GLP-1 и их странные побочки

Пока ИИ-индустрия пересчитывает миллиарды, медицина продолжает изучать препараты для похудения на основе GLP-1. Новое исследование намекает, что они могут замедлять биологическое старение. Звучит как чудо, но дьявол, как обычно, в деталях: самые частые побочные эффекты — желудочно-кишечные, а исследователи также проверяют возможную связь с выпадением волос, нарушениями ногтей и повреждением нервов за глазом. Список, прямо скажем, не для слабонервных.

Ветер, дата-центры и одна большая сделка

Китайская Envision Energy вошла в список 10 климатических технологических компаний, за которыми стоит следить в 2026 году. Компания стала первой, кто полностью запитал дата-центр от возобновляемых источников: ветряки вырабатывают энергию, батареи запасают её на месте, а ИИ-система оптимизирует подачу, чтобы объект получал стабильное питание независимо от погоды. Теперь Envision хочет привезти этот подход в пустыни по всему миру — под растущий аппетит Artificial Intelligence к электричеству.

В общем, повестка дня насыщенная: от моральных дилемм отказа моделей до ветряков в пустыне. Искусственный интеллект продолжает влезать во все сферы — иногда аккуратно, иногда с грохотом. Мы будем следить за развитием событий и обязательно расскажем, чем всё закончится.

Справка по теме (FAQ)
Почему отказы ИИ-моделей считаются проблемой?
Модели обучены отклонять опасные запросы, но отказ срабатывает не всегда. Некоторые уже пытаются использовать ИИ для работы с биологическими патогенами и автономными дронами. Провалившийся отказ может привести к катастрофе.
Что запретила Anthropic в новой политике?
Компания запретила «устойчивое и ненужное жестокое или оскорбительное поведение» по отношению к моделям Claude. Политика вступит в силу 12 ноября 2026 года. Запрет касается только крайних случаев и не распространяется на обычное раздражение, мрачные творческие темы или тестирование.
Почему OpenAI снизила прогноз выручки?
Компания сообщила инвесторам о выручке около 50 миллиардов долларов вместо 70. Причина — некорректное сравнение с Anthropic, которая включает в выручку продажи через облачных партнёров, а OpenAI — нет.
Какие побочные эффекты есть у GLP-1 препаратов?
Самые частые — желудочно-кишечные. Исследователи также проверяют возможную связь с выпадением волос, нарушениями ногтей и повреждением нервов за глазом. При этом есть данные, что GLP-1 могут замедлять биологическое старение.