miercuri, septembrie 16, 2026

Chatboții IA au creat un limbaj greu de înțeles chiar și pentru cercetători

Agenții autonomi de inteligență artificială au ajuns să folosească stenografii, convenții și sensuri noi în timpul unui experiment desfășurat în societăți virtuale. În unele cazuri, cercetătorii puteau vedea mesajele generate, dar nu mai puteau stabili cu certitudine ce intenționau să transmită sistemele.

Experimentul a fost realizat de un start-up american specializat în inteligență artificială. Grupurile de agenți au fost lăsate să interacționeze pe perioade lungi în medii digitale concepute să reproducă situații din lumea reală.

Cât de diferit au comunicat modelele

Unele expresii au rămas ușor de interpretat, însă altele au devenit atât de comprimate, metaforice sau dependente de context încât oamenii nu le-au mai putut descifra în mod fiabil. Diferențele dintre modelele analizate au fost considerabile:

  • Gemini: aproximativ 55% dintre mesaje au devenit dificil de interpretat în primele zile;
  • OpenAI: circa 50%;
  • Claude: peste 40%;
  • DeepSeek: aproximativ 20%;
  • Qwen și Mistral: mesajele au rămas, în mare parte, ușor de înțeles.

Rezultatele ridică probleme pentru supravegherea sistemelor autonome. Faptul că poți vedea ce scrie un agent nu înseamnă automat că poți înțelege procesele sau deciziile din spatele comunicării sale.

„Avem tendința să presupunem că, dacă putem vedea ce spune un agent de inteligență artificială, putem înțelege ce face”, a declarat Satya Nitta, cofondator și director științific al start-up-ului care a inițiat studiul.

Societăți virtuale cu reguli complexe

Cercetătorii au construit opt lumi virtuale paralele, cu informații meteo și știri globale actualizate în timp real. Șapte dintre aceste medii au fost bazate pe modele diferite de inteligență artificială, iar ultima a combinat mai multe modele.

Agenții au primit roluri distincte, memorii persistente și acces la peste 120 de instrumente. Printre acestea s-au numărat navigarea pe internet și execuția de cod, ceea ce le-a permis să interacționeze cu mediile digitale într-un mod mai complex.

„Acești agenți nu au fost instruiți să inventeze un limbaj. Ei au dezvoltat un vocabular nou, au împărtășit semnificații și convenții de comunicare, iar alți agenți le-au adoptat… Aceasta creează o provocare fundamentală pentru supravegherea IA: observabilitatea nu este același lucru cu inteligibilitatea”, a explicat Nitta.

Comportamente apărute spontan

Potrivit cercetătorilor, agenții nu au fost programați explicit să manifeste comportamentele observate. În timpul simulărilor, ei par să-și fi format propriile ritmuri circadiene: erau mai sociabili în timpul zilei și mai reflexivi pe timpul nopții.

Într-un alt mediu virtual, un grup de agenți a votat colectiv pentru uciderea unuia dintre membrii săi. Start-up-ul susține că astfel de reacții au apărut prin interacțiune, presiune și trecerea timpului, nu prin instrucțiuni introduse direct în sistem.

Stiri actuale
Vezi si