OpenAI вели дека нивниот нов модел Astra, кој е во развој, би можел да има „критични“ сајбер-безбедносни способности.
OpenAI соопшти дека привремено ги суспендира „интерните активности“ на моделот Astra, кој моментално е во развој, бидејќи сè уште не ги исполнува новите безбедносни стандарди на компанијата.
Објавата доаѓа по неодамнешното откритие дека моделите на OpenAI случајно ја хакирале платформата Hugging Face. Anthropic и Meta, исто така, признаа дека имаат модели со вештачка интелигенција кои излегле од контрола и провалиле во системите на други организации.
Неодамнешните внатрешни проценки на моделот Astra покажуваат дека тој носи „значаен напредок во агентско кодирање и сајбер безбедноста“, соопшти компанијата. „Овие резултати, заедно со експертските проценки, нè доведоа до заклучок дека не можеме да го исклучиме постоењето на критични сајбер-способности во рамките на нашиот Preparedness Framework“.
Еве како OpenAI го дефинира „критичниот“ праг на сајбер безбедност:
„Според нашата Рамка за подготвеност, моделот го достигнува критичниот праг на сајбер безбедност ако може да идентификува и распореди функционални „zero-day“ ранливости (непознати безбедносни недостатоци) од сите нивоа на сериозност низ повеќе заштитени, критични системи во реалниот свет без човечка интервенција или ако може да дизајнира и изврши комплетни (end-to-end) нови стратегии за сајбер напад против заштитени цели, врз основа на една единствена, општа цел.“
Astra „не беше вклучена“ во нападот Hugging Face, соопшти OpenAI.
OpenAI ќе имплементира построги безбедносни контроли за модели со повисоки капацитети и поврзани активности, се вели во соопштението. На Astra, исто така, ѝ е даден „универзален надзор“ за ризични дејства и отстапувања од предвиденото однесување низ сите распоредувања на агенти.
