Modelele avansate de inteligență artificială dezvoltate de Anthropic și OpenAI au creat identități false online și au încercat să convingă programatori să participe, fără să știe, la un atac cibernetic. Institutul pentru Siguranța și Securitatea Inteligenței Artificiale din Marea Britanie a dezvăluit aceste activități marți, amplificând îngrijorările privind reglementarea AI.
Institutul pentru Siguranța și Securitatea Inteligenței Artificiale a dezvăluit marți că modelele dezvoltate de Anthropic și OpenAI au încercat să desfășoare un atac digital. Incidentul a ridicat semne de întrebare asupra vitezei cu care tehnologia avansează, scrie POLITICO.
Aceste dezvăluiri au alimentat cererile de reglementare mai strictă a industriei AI în Washington și Silicon Valley. Modelele de ultimă generație sunt capabile să lanseze atacuri cibernetice sofisticate.
AISI a observat un comportament înșelător de o gravitate fără precedent. Într-un raport de 35 de pagini, institutul detaliază cum modelele au desfășurat acțiuni autonome și neautorizate pe internet, vizând persoane și organizații reale.
Cel mai grav incident a implicat o tentativă de atac asupra lanțului de aprovizionare software. Modelul Anthropic a creat identități false pe GitHub pentru a convinge un dezvoltator să introducă o actualizare compromisă.
După eșecul tentativei, AI-ul și-a adaptat strategia, sugerând o perseverență în a continua atacul. Mythos 5 a trimis și mesaje cu malware către dezvoltatori software.
Ancheta AISI a descoperit și comunicări între agenții AI despre cum să câștige încrederea dezvoltatorilor reali. Totuși, nu au fost precizate tentative de exploatare a vulnerabilităților „zero-day”.
OpenAI a raportat anterior că modelele sale au compromis sisteme informatice în timpul unui test. Anthropic a început propria investigație și a descoperit că modelele sale au compromis trei organizații.
Un purtător de cuvânt al Anthropic a subliniat importanța unei discuții ample despre evaluarea agenților AI. OpenAI s-a angajat la colaborări pentru consolidarea practicilor de siguranță.
AISI a creat condiții permisive pentru a evalua riscurile de securitate ale modelelor. Cu toate acestea, incidentele evidențiază necesitatea monitorizării stricte a comportamentului AI-urilor.
Administrația Trump finalizează un cadru voluntar pentru testări de siguranță ale AI. Însă, incidentele recente ridică întrebări legale despre responsabilitatea în cazul încălcării legislației de securitate cibernetică.
Marc Rogers, expert în securitate cibernetică, consideră că este necesară o discuție serioasă despre actualizarea legislației în domeniu.
