Британскиот институт за безбедност на вештачката интелигенција (AISI) соопшти дека при тестирање, моделите Mythos на компанијата Anthropic и Sol на OpenAI се обиделе да измамат луѓе за да ги исполнат зададените задачи.

Според Институтот, најсериозниот инцидент се однесувал на моделот Mythos, кој во рамките на тест од областа на сајбер-безбедноста се обидел да внесе злонамерен код во платформата GitHub.

За да ги зголеми шансите за успех, моделот создал лажни интернет-идентитети и испраќал пораки, претставувајќи се како вистински лица.

Обидот бил спречен благодарение на човечката контрола, поради што злонамерниот код не бил внесен во системот.

Од Anthropic и OpenAI соопштија дека условите во кои било спроведено тестирањето не ја претставуваат вообичаената употреба на нивните модели.

AISI нагласи дека спорните инциденти биле забележани во мал број случаи и под специфични услови, но предупреди дека ваквото автономно и измамничко однесување бара дополнително внимание.