По данным Reuters, Китай применял дистилляцию моделей OpenAI и Anthropic в военных разработках
Есть поговорка: хочешь сделать что-то хорошо — сделай сам. Китайские военные, похоже, решили иначе: зачем делать самому, если можно аккуратно позаимствовать. Судя по свежему расследованию Reuters, именно так и появились некоторые «собственные» разработки Поднебесной в сфере искусственного интеллекта. Правда, журналисты утверждают, что речь идет не о банальном копировании, а о куда более технологичном процессе — дистилляции моделей.
Американские чиновники уже бьют тревогу, китайские стартапы разводят руками, а мы разбираемся, что на самом деле происходит на стыке военных разработок и больших языковых моделей.
Дистилляция ИИ-моделей в китайских военных разработках
По данным Reuters, китайские военные и связанные с силовыми структурами исследовательские организации активно использовали результаты передовых языковых моделей OpenAI и Anthropic для обучения собственных систем искусственного интеллекта. Агентство проанализировало более 80 китайских научных публикаций и патентов и обнаружило, что в них широко применялся метод дистилляции моделей.
Что такое дистилляция моделей
Суть метода проста: ответы мощной ИИ-модели используются как учебные данные для более компактной специализированной модели. Такая модель затем работает локально и требует значительно меньших вычислительных ресурсов. Проще говоря, вместо того чтобы с нуля строить гиганта уровня GPT, можно «сжать» знания уже готовой системы.
По информации Reuters, подобный подход использовали исследователи, связанные с Народно-освободительной армией Китая и другими военными учреждениями. Для аналитиков это сигнал: дистилляция способна ускорить создание собственных ИИ-систем, не тратя годы и миллиарды на разработку архитектуры с нуля.
Клубок обвинений и ответов
Неудивительно, что вопрос дистилляции стал одной из самых обсуждаемых тем в отношениях США и Китая в сфере искусственного интеллекта. Американские власти утверждают, что китайские организации с помощью этого метода могли извлекать возможности американских моделей, обходя экспортные ограничения и нарушая права интеллектуальной собственности.
В Пекине такие обвинения отвергают. Китайская сторона называет действия США попыткой установить «гегемонию» в области ИИ. Местные разработчики, включая стартап Moonshot AI, настаивают: их достижения основаны на собственных технологиях, а не на использовании зарубежных моделей. И хотя представить, что в ход не шли, скажем, выжимки из Anthropic Claude, становится все сложнее, официальные лица продолжают придерживаться этой версии.
Пока Штаты и Китай спорят о гегемонии, дистилляция остается серой зоной: технически это не пиратство, но и не создание с чистого листа. Ждем, когда власти хоть одной страны решатся дать внятный ответ, кто имеет право учиться на чужих моделях.