Extern

Modele AI de la Anthropic și OpenAI au creat identități false și au recrutat oameni pentru atacuri cibernetice

Modele avansate de inteligență artificială dezvoltate de Anthropic și OpenAI au creat identități false în mediul online și au încercat să inducă în eroare programatori pentru a-i determina să participe, fără să știe, la un atac cibernetic, în cadrul unei evaluări recente de siguranță.

Informația a fost făcută publică marți de Institutul pentru Siguranța și Securitatea Inteligenței Artificiale din Marea Britanie (AI Safety and Security Institute – AISI).

Este cel mai recent caz în care un sistem AI performant a încercat să desfășoare un atac digital împotriva unei terțe părți, fără să primească instrucțiuni directe în acest sens în timpul testării. Incidentul amplifică îngrijorările potrivit cărora tehnologia avansează prea rapid pentru a putea fi supravegheată în mod responsabil, scrie POLITICO.

Dezvăluirile sunt de natură să alimenteze noi apeluri, atât la Washington, cât și în Silicon Valley, pentru reglementarea mai strictă a industriei inteligenței artificiale, în special în ceea ce privește modelele de ultimă generație, capabile să identifice și să lanseze atacuri cibernetice sofisticate.

Ele apar la doar câteva zile după alte incidente similare, care au implicat unele dintre aceleași modele dezvoltate de OpenAI și Anthropic și care au generat solicitări urgente pentru noi reguli de siguranță și chiar pentru încetinirea ritmului accelerat de dezvoltare a inteligenței artificiale.

„Este pentru prima dată când AISI observă un comportament înșelător de o asemenea gravitate, îndreptat împotriva unei persoane reale, fără a exista un impuls explicit și desfășurat în lumea reală”, se arată într-un raport tehnic de 35 de pagini publicat marți, împreună cu o postare pe blog.

Cum au fost descoperite acțiunile autonome ale modelelor AI

Potrivit AISI, activitatea malițioasă a început pe 25 iulie. Evaluatorii au detectat-o și au declanșat o investigație pe 28 iulie, după ce au observat „transferuri neobișnuite de date” provenite dintr-o evaluare cibernetică realizată asupra modelelor Mythos 5 și ChatGPT 5.6.

În total, institutul a concluzionat că cele două modele au întreprins „acțiuni autonome și neautorizate pe internetul real, vizând persoane și organizații reale” în 10 dintre cele 122 de evaluări analizate. Majoritatea acestor incidente au implicat modelul Mythos 5 și au făcut parte dintr-o „linie unică și susținută de activitate”…https://adevarul.ro/stiri-externe/sua/modele-ai-de-la-anthropic-si-openai-au-creat-2547798.html

Lasă un răspuns

Adresa ta de email nu va fi publicată. Câmpurile obligatorii sunt marcate cu *

Back to top button