Китайські військові використовували американські ШІ-моделі для навчання власних систем

·841 слівредакція
Фронт

Дослідники, пов'язані з армією Китаю, використовували дані американських моделей штучного інтелекту OpenAI та Anthropic для навчання власних систем оборонного призначення. Про це свідчить аналіз понад 80 академічних статей і патентів.

Китайські військові та безпекові установи застосовували метод «дистиляції моделі» для перенесення можливостей передових американських ШІ у власні спеціалізовані системи. Цей підхід дозволяє навчати менші моделі на основі вихідних даних великих систем, що дає змогу розгортати їх локально без значних обчислювальних ресурсів.

Аналіз, проведений Reuters та фондом Джеймстауна, показав, що дистиляція широко використовується дослідниками, пов'язаними з Народно-визвольною армією Китаю. Зокрема, у статті 2025 року, опублікованій дослідниками з підрозділу 96941 НВАК, описано використання OpenAI GPT-3.5 для обробки конфіденційного військового коду. Оскільки сторонні моделі не підходять для роботи з секретними даними, дослідники використали GPT-3.5 для узагальнення коду та навчили на цих даних вітчизняну модель, що працює виключно у військових мережах Китаю.

У Північному університеті Китаю, який має зв'язки з оборонною промисловістю, дослідники застосовували модель Claude 3 Haiku від Anthropic для генерації синтетичних навчальних даних для системи класифікації тексту, призначеної для моніторингу соціальних мереж. Anthropic заявила, що не надає комерційного доступу до Claude у Китаї та використовує системи моніторингу для виявлення порушень політики.

Національний університет оборонних технологій НВА у статті 2024 року описав використання дистиляції для зменшення розміру моделі обробки зображень для розгортання на безпілотних літальних апаратах. Це дозволяє дронам аналізувати відео в реальному часі та підтримувати навігацію навіть за відсутності зв'язку. Дослідники Китайської академії військових наук використовували дистиляцію для запуску моделі розпізнавання цілей на тактичному обладнанні під час імітованих морських операцій за участю дронів, кораблів та безпілотних підводних човнів.

Науковець з Джеймстауна Санні Ченг, який проаналізував понад 60 китайських робіт, зазначив, що китайські військові вчені систематично фіксують кроки міркування західних моделей для адаптації їх у спостереженні, кібервійні та прийнятті тактичних рішень. «Навчити модель правильної відповіді — це одне, але навчити її обґрунтувати цю відповідь набагато складніше», — сказав він.

Суперечка щодо несанкціонованого вилучення даних стала одним із каменів спотикання напередодні переговорів між США та Китаєм щодо регулювання ШІ. Американські чиновники звинуватили китайські організації у використанні дистиляції для вилучення можливостей з американських моделей, що потенційно підриває експортний контроль. Китай відкинув ці звинувачення, заявивши, що Вашингтон прагне до «гегемонізму» у сфері ШІ.

Китайський стартап Moonshot минулого тижня спростував звинувачення адміністрації Дональда Трампа в тому, що його модель Kimi K3 була створена з використанням дистиляції, заявивши, що вона базується на власних інноваціях.

Китай активно впроваджує технологію дистиляції через обмеження доступу до сучасних обчислювальних ресурсів внаслідок експортного контролю США. Центральний уряд та місцеві органи влади сприяють «полегшенню моделей» та периферійним обчисленням, спрямовуючи субсидії на технології, що дозволяють ШІ працювати на дронах, супутниках та інших пристроях з обмеженою потужністю.

Експерти застерігають, що дистиляція має обмеження. У січні дослідники з Інженерного університету армії опублікували статтю про загрозу «дистиляції без даних» — методу реверс-інжинірингу можливостей моделі без прямого доступу до її параметрів. Вони запропонували захисні механізми для маскування прихованої логічної інформації, а також зазначили, що дистильовані моделі успадковують лише вибрані можливості і не можуть повністю відтворити широкі інтелектуальні здібності передових систем.

Читайте також