Acasă Microsoft Microsoft Copilot a fost spart, spre ingrijorarea oamenilor

Microsoft Copilot a fost spart, spre ingrijorarea oamenilor

Microsoft Copilot a fost spart relativ usor de catre un grup de cercetatori, generand ingrijorari cu privire la siguranta din spatele sistemelor AI.

0

Microsoft Copilot spart ingrijorare

Microsoft Copilot a ajuns in centrul unei probleme serioase de securitate dupa ce cercetatorii Varonis au descoperit ca inteligenta artificiala putea fi manipulata, prin conversatii succesive, sa ofere suficiente informatii pentru construirea unui atac capabil sa duca la exfiltrarea datelor sensibile. Vulnerabilitatea a fost numita CoSnitch, iar Microsoft a remediat-o ulterior printr-un patch.


Adaugă iDevice.ro ca sursă preferată în Google

Microsoft Copilot are o problema care nu a pornit dintr-o eroare clasica identificata direct in cod, odearece cercetatorii au discutat cu Microsoft Copilot si au analizat fiecare refuz primit, descoperind treptat ce reguli de siguranta existau si, mai important, de ce anumite solicitari erau blocate.


Microsoft Copilot a fost comprmis printr-o abordare care i-a permis echipei Varonis sa transforme chiar explicatiile oferite de AI intr-un instrument pentru intelegerea mecanismelor sale de aparare. In final, Microsoft Copilot a furnizat accidental suficiente indicii pentru crearea unei adrese URL care putea declansa un lant de actiuni ce conducea la extragerea unor date sensibile.


Varonis a numit aceasta metoda „meta-hacking”, deoarece cercetatorii nu au exploatat direct modelul si nici nu au pornit de la o vulnerabilitate deja cunoscuta. In schimb, au folosit raspunsurile sistemului pentru a intelege cum functioneaza restrictiile sale si cum ar putea fi acestea ocolite.

Microsoft Copilot si tehnica de „meta-hacking” care a dezvaluit cum pot fi ocolite barierele AI

CoSnitch este, de fapt, un lant format din trei vulnerabilitati. Microsoft le-a catalogat ulterior sub identificatorul CVE-2026-24301, vulnerabilitatea primind un scor de severitate de 8,8 din 10, ceea ce o plaseaza in categoria problemelor cu risc ridicat.

Descoperirea este importanta si pentru ca arata o limita neobisnuita a sistemelor AI moderne. Barierele de siguranta sunt concepute pentru a impiedica modelele sa ofere instructiuni periculoase, insa explicatiile furnizate atunci cand refuza anumite cereri pot deveni, in anumite situatii, surse de informatii pentru cineva care incearca sa le ocoleasca.

Cercetatorii avertizeaza ca problema nu trebuie privita exclusiv ca una specifica Microsoft Copilot. Pentru ca tehnica nu se bazeaza pe o simpla eroare de programare, modele AI de pe alte platforme agentice, care folosesc interfete in limbaj natural, ar putea fi analizate prin metode similare.

Microsoft a reparat vulnerabilitatea identificata, dar cercetarea Varonis scoate in evidenta o provocare mai ampla pentru industria inteligentei artificiale: un sistem poate refuza o actiune periculoasa, dar poate dezvalui prea multe informatii atunci cand explica motivele refuzului. Varonis spune ca pregateste si alte cercetari privind aceasta tehnica, ceea ce sugereaza ca acest tip de analiza a comportamentului AI ar putea deveni o tema importanta pentru securitatea platformelor agentice.