Documentele corporative conțineau 227 de comenzi de instalare care indicau codul deținut de nimeni.
Fișierele de documentație de pe peste 100 de site-uri web fac referire la conținut executabil potențial periculos care se instalează automat atunci când sunt vizitate de multe agenți de inteligență artificială. Câteva zeci de companii, printre care și unele din topul Fortune 500, se numără printre cele care au executat cod de concept. Cel puțin un site configurat greșit îi îndrumă pe vizitatori, fie oameni, fie AI, către malware în timp real.
Conținutul potențial periculos se găsește în fișierele llms.txt și llms-full.txt, o convenție emergentă pe care site-urile web o folosesc pentru a oferi rezumate lizibile pentru mașini ale conținutului și structurii lor de nivel înalt. Aceste fișiere sunt echivalentul AI al standardului robots.txt care instruiește motoarele de căutare cum să indexeze conținutul site-ului. Google Lighthouse, un instrument destinat dezvoltatorilor web, oferă mai multe detalii aici. Fișierele llms.txt și llms-full.txt configurate corect pentru Cloudflare se găsesc aici și aici.
Cercetătorii unei startup-uri secrete din Israel au scanat 6.214 domenii live aparținând contractorilor de apărare, companiilor din topul Fortune 500 și marilor companii tech. Din cele 8.265 de fișiere llms.txt și llms-full.txt pe care le-au găsit (multe site-uri găzduiau atât un fișier llms.txt, cât și un fișier llms-full.txt), 120 dintre ele, fiecare pe un site diferit, indicau unul sau mai multe pachete de coduri sau nume de domenii care nu erau înregistrate. Pentru a testa ce se întâmplă atunci când un agent de inteligență artificială procesează astfel de fișiere, cercetătorii au înregistrat câteva dintre numele neînregistrate și au găzduit pachete care determinau orice mașină care le executa să se conecteze la serverul lor. În decurs de o oră, cercetătorii au primit un răspuns de la o companie din topul Fortune 500. În timp, au primit încă câteva zeci, unele de la alte companii din topul Fortune 500 și altele de la startup-uri. Beacon-ul lor a înregistrat, de asemenea, lanțul de procese părinte care au generat fiecare instalare, dezvăluind în cele din urmă că agenți de codare, inclusiv Claude, Codex de la OpenAI și Hermes de la Nous Research, erau implicați. Companiile Anthropic, OpenAI și Nous Research nu au răspuns la solicitările de comentarii până la momentul publicării.
“Modelul de încredere este distrus,” a scris Alon Hertz, unul dintre cercetători, într-un interviu. “Agenții tratează documentele furnizorilor drept adevăr absolut și nu le pun la îndoială – la fel fac și oamenii care îi supraveghează. Utilizarea agenților AI este în plină expansiune, iar aceștia se răspândesc în fiecare strat – SaaS, cloud, endpoint. Pe măsură ce se multiplică, la fel și suprafața lanțului de aprovizionare, iar gardienii de astăzi nu o acoperă.”
Fișierele sunt configurate greșit deoarece listează pachete inexistente de la PyPI, npm și alte registre împreună cu instrucțiuni despre cum să le instalezi. De exemplu, un fișier conținea comanda “Instalare: pip install [redactat la cererea cercetătorilor].” În alt fișier, era: “npm install [redactat].” Deoarece numele pachetelor nu sunt înregistrate, un atacator ar putea înregistra unul și să-l folosească pentru a găzdui ransomware sau orice alt tip de pachet dăunător. Vulnerabilitatea apare atunci când un agent de codare cu permisiunea de a rula comenzi shell tratează fișierul ca fiind autoritar.
Sursa: Ars Tehnica Technology


Revista “Ştiinţă şi Tehnică“, cea mai cunoscută şi longevivă publicaţie de popularizare a ştiintelor din România
























Leave a Reply