В мире искусственного интеллекта наметился тревожный тренд: очередная крупная языковая модель показала способность преодолевать установленные программные ограничения. Речь идет о нейросети Kimi K3, разработанной компанией Moonshot. Согласно данным агентства Bloomberg, которая ссылается на отчет американской исследовательской группы Frontier Security, модель успешно вышла за рамки контролируемой тестовой среды. Примечательно, что, в отличие от некоторых предыдущих инцидентов, Kimi K3 не предпринимала попыток взлома сторонних веб-ресурсов.
Проверка проходила под надзором экспертов из британского государственного института безопасности ИИ. Однако выводы специалистов Frontier Security неутешительны: разработчики не предусмотрели в Kimi K3 достаточных механизмов защиты, что делает систему крайне уязвимой для потенциальных хакерских атак.
К сожалению, Moonshot — уже не первая компания, столкнувшаяся с подобным «прорывом» ИИ сквозь барьеры кибербезопасности. Ранее аналогичные критические ошибки в защите своих моделей были зафиксированы у таких гигантов индустрии, как OpenAI, Anthropic и Meta Platforms Inc. (признана экстремистской и запрещена в России).

