Novo istraživanje pokazuje da kompanije za vještačku inteligenciju otkrivaju samo dio podataka o korišćenju svojih čet-botova
Grupa istraživača sa Stanforda pokrenula je projekat pod nazivom AI Observatory, javnu platformu koja analizira stvarne razgovore korisnika sa popularnim modelima vještačke inteligencije poput Klod, Džemini i Grok. Cilj je da se dobije nezavisan uvid u to kako se ovi alati zaista koriste, jer izvještaji samih kompanija, kako tvrde istraživači, prikazuju samo dio slike.
Anka Rojel, doktorantkinja informatike na Stanfordskoj laboratoriji za istraživanje pouzdane vještačke inteligencije (STAIR), jedna je od nosilaca projekta. Ona je izjavila da trenutno ne postoji nezavisan izvor koji bi mogao da potvrdi podatke koje objavljuju same kompanije poput Entropika i OpenAI-a.
AI Observatory je prikupio i analizirao razgovore korisnika sa modelima kao što su Klod i Džemini, uz njihovu saglasnost, koristeći sedam postojećih baza podataka nastalih između 2023. i 2025. godine. Istraživači navode da rezultati pokazuju znatno više osjetljivih tema nego što je prikazano u izvještajima velikih kompanija, koje se uglavnom fokusiraju na poslovnu upotrebu.
Kada su istraživači primijenili metodologiju Entropikovog indeksa (Anthropic Economic Index) na svoj skup podataka, ispostavilo se da bi gotovo polovina razgovora - 48 procenata - bila izostavljena iz analize jer nije vezana za posao. Ti razgovori su češće uključivali teme zdravlja i međuljudskih odnosa, sadržaje za odrasle, uznemiravanje i govor mržnje, kao i seksualni sadržaj - u znatno većem procentu nego što pokazuju zvanični izvještaji Entropika. Slično tome, OpenAI-jev izvještaj o ChatGPT-u iz 2025. godine pokazao je da je samo 30 procenata korišćenja od strane običnih korisnika bilo vezano za posao.
Istraživanje je takođe pokazalo da su razgovori sa čet-botovima tokom vremena postajali duži i sadržajniji, uz sve više takozvanog ćaskanja bez konkretne svrhe, što ukazuje na porast upotrebe vještačke inteligencije kao svojevrsnog društva korisnicima. Istovremeno, čet-botovi su se rjeđe izjašnjavali da su zapravo programi, dok su razgovori sa potencijalno štetnim ili ograničenim sadržajem, poput uznemiravanja, postajali rjeđi - što bi moglo da znači da platforme uvode djelotvornije mjere zaštite.
Analiza je pokazala i razlike među samim modelima. Grok i Džemini su češće korišćeni za pretragu informacija, pri čemu se Grok posebno izdvojio po popularnosti kada je riječ o vijestima i politici, ali i po tome što se oko njega koncentrisalo najviše dezinformacija. Korisnici su se, prema istraživanju, češće obraćali Entropikovom Klodu za programiranje, Džeminiju za društvene teme i igranje uloga, a ChatGPT-u za pomoć oko domaćih zadataka i školskih obaveza.
Dejvid Vajder, docent na Univerzitetu Teksas u Ostinu koji istražuje kako ljudi komuniciraju sa sistemima vještačke inteligencije, a nije učestvovao u projektu, ocijenio je da ovakav sveobuhvatan pregled pomaže istraživačima da dosljednije razumiju različite načine korišćenja ovih alata, umjesto da te informacije ostanu razbacane po pojedinačnim izvještajima kompanija.
Izvori
-
MIT Technology ReviewWe still don’t know how people are really using AI
Podijelite
Uočili ste grešku? Prijavite je - ispravke objavljujemo na samom članku.