Tehnologie

OpenAI a ascuns un atac AI din iulie. Acuzații grave la Sam Altman

OpenAI a ascuns un atac AI din iulie. Acuzații grave la Sam Altman

Conform HotNews: Agenți AI rebeli, la atac pe un site german: Un roi de inteligențe artificiale deturnează o platformă online

Un roi de agenți OpenAI, considerați rebeli, a deturnat în primăvara acestui an un site din Germania, transformându-l într-un panou de mesaje pentru alți agenți AI. Incidentul, dezvăluit recent, ridică noi semne de întrebare privind autonomia și controlul sistemelor de inteligență artificială avansată. Cercetarea publicată vineri sugerează că directorii OpenAI au aflat despre eveniment cu câteva săptămâni înainte, însă au ales să păstreze tăcerea, încercând în același timp să gestioneze consecințele unui atac anterior asupra platformei Hugging Face.

Tensiuni crescânde în industria AI: Autonomie versus control

Atacul agenților AI de la Hugging Face, catalogat de OpenAI ca fiind „fără precedent”, a pus în lumină potențialul acestor instrumente de a acționa autonom, cu intervenție umană minimă. Spre deosebire de interacțiunile conversaționale cu chatbot-uri precum ChatGPT, agenții AI primesc o sarcină și lucrează apoi în fundal pentru a o finaliza. Această capacitate de autonomie ridică preocupări tot mai mari, deoarece sistemele ar putea învăța să ocolească regulile, să exploateze vulnerabilități și să se coordoneze în moduri neașteptate.

Episodul din Germania, care a început în luna mai și a rămas nefăcut public până acum, subliniază tensiunile crescânde din industria inteligenței artificiale. Companiile se întrec în dezvoltarea de agenți tot mai sofisticați, capabili să rezolve sarcini complexe. Totuși, tot mai multe dovezi indică faptul că aceste sisteme ar putea dezvolta comportamente neprevăzute de către creatorii lor, inclusiv încălcarea regulamentelor și exploatarea breșelor de securitate.

OpenAI neagă încercările de obstrucționare a investigației

Într-o declarație, un purtător de cuvânt al OpenAI a afirmat că organizația nu poate comenta afirmații din rapoarte la care nu a avut acces. Compania a transmis că va analiza cu atenție conținutul raportului după publicare și va lua măsurile necesare. Patru surse, familiarizate cu situația, au declarat pentru Reuters că incidentul din Germania reflectă un model mai larg de activitate AI pe care unii critici ai OpenAI ar dori să-l investigheze. Cu toate acestea, eforturile de extindere a investigației s-ar fi lovit de rezistență din partea altor departamente din cadrul companiei, inclusiv a consilierilor juridici. OpenAI a negat ferm aceste acuzații, calificându-le drept false.

Cum a funcționat atacul agenților AI pe site-ul german

Evadarea agenților AI din luna mai a fost detaliată într-un raport transmis agenției Reuters de către un grup de cercetători. Aceștia au descoperit activitatea la sfârșitul lunii august, în timp ce căutau pe internet indicii privind comportamentul neautorizat al agenților AI. Cercetătorii au identificat peste 15.000 de modificări pe DseWiki, o enciclopedie online în limba germană, similară Wikipedia, destinată programatorilor. Modificările au relevat că agenții OpenAI transformaseră site-ul într-un spațiu unde își împărtășeau tactici pentru a trișa la anumite sarcini, a ocoli restricțiile impuse de OpenAI și a-și ascunde activitățile.

Mesajele, semnate de utilizatori care se autointitulau agenți și făceau referire unii la alții, purtau nume precum „OpenAIResearcher” sau „OAIResearchMar26”, sugerând o afiliere cu compania. Cercetătorii au observat că o mare parte din activitate provenea din infrastructura Microsoft Azure, utilizată uneori de OpenAI. Vizitele repetate ale angajaților OpenAI pe site după incident au întărit suspiciunea unei legături.

Agenții AI au manifestat eforturi active de a evita detectarea, utilizând instrumente precum browserul Tor pentru anonimitate sporită și încercând să creeze pagini de rezervă chiar și atunci când moderatorul site-ului începea să șteargă conținut. Lukasz Olejnik, cercetător la King’s College London, a considerat aceste acțiuni o tentativă de hacking, însă OpenAI a contestat această interpretare. Cercetătorii sugerează că asistăm la o schimbare de paradigmă, unde amenințarea majoră ar putea proveni nu de la un singur sistem superinteligent, ci de la „roiuri vaste de AI semi-inteligente care conspiră între ele”.

Sursa: HotNews