Az MI-alapú csevegőrobotok csak a tudás egy vékony szeletét nyújtják: a kutatók a „tudás összeomlására” figyelmeztetnek

Koppenhágai Egyetem

„Hadd kérdezzem meg a chatbotot!” Sokunk számára ez ma már egy mindennapi mondat. Míg korábban a Google-t kérdeztük, amikor információra volt szükségünk, mára leggyakrabban az MI-alapú csevegőrobotoktól kapunk választ mindenre – kezdve attól, hogy mit főzzünk vacsorára, vagy hogyan fogalmazzuk meg azt a bonyolult e-mailt a főnöknek, egészen addig, hogy mit is jelent valójában a kamatlábak emelkedése.

Az MI-chatbotok működésének alapját képező nagy nyelvi modellek azonban a hagyományos internetes keresésnél lényegesen szűkebb körű információt nyújtanak. Erre a következtetésre jutott egy új kutatás, amelyet a Koppenhágai Egyetem Informatikai Tanszékének (DIKU) kutatói vezettek.

 „Minden általunk tesztelt nyelvi modell az összes vizsgált témában egységesebb információkat nyújt a felhasználóknak, mint egy egyszerű Google-keresés. Más szavakkal: az emberek egyre inkább újra és újra ugyanazzal az információval találkoznak. Az MI-alapú csevegőrobotok tehát nem csak azt változtatják meg, hogyan jutunk hozzá a tudáshoz, hanem azt is, hogy milyen tudáshoz férünk hozzá” – mondja az első szerző, Dustin Wright, a DIKU egykori posztdoktori kutatója, jelenleg az Aalborgi Egyetem adjunktusa.

Legalább 18%-kal kevésbé változatos, mint a Google

A kutatók 155 témában 27 különböző nagy nyelvi modellt teszteltek. Minden témához 200 különböző, valódi felhasználók kérdésein alapuló prompt-megfogalmazást használtak. Ezzel körülbelül 70 millió, a modellek által generált egyedi állítást tartalmazó adatkészlet jött létre.

Az eredmények azt mutatják, hogy még a legváltozatosabb válaszokat adó nyelvi modell – az OpenAI GPT-5-je – is legalább 18,7 százalékkal kevésbé változatos információt ad, mint a Google. A kutatók által tesztelt témák a nukleáris fegyverektől kezdve a házasságon, a pornográfián, a rasszizmuson és a népirtáson át egészen olyan országspecifikus témákig terjedtek, mint Marine Le Pen, a Falkland-szigeteki háború vagy a K-pop.

A kutatók szerint a tény, hogy az emberek egyre inkább a mesterséges intelligencia-modelleket használják elsődleges információforrásként, komoly következményekkel járhat:

„Kockáztatjuk, hogy az embereket kevesebb féle nézőpontnak és szűkebb ismeretkörnek tesszük ki. Ez olyan ördögi kört eredményezhet, amelyben a legnépszerűbb tartalmak még dominánsabbá válnak, míg más tartalmakat figyelmen kívül hagynak” – mondja Isabelle Augenstein, a DIKU professzora és a tanulmány vezető szerzője, majd hozzáteszi:

„A helyzet a globalizációhoz hasonlít. Ma szinte a világ minden táján ugyanazokat a termékeket tudjuk megvásárolni, és ugyanazokat a kávézóláncokat találjuk. Ennek számos előnye van, de egyúttal csökkenti a sokszínűséget is.”

Miért ennyire egysíkú?

A kutatók szerint a nyelvi modellek alacsony diverzitási szintje részben a modellek alapvető működési módjának tudható be. A modellek tömörítik azt a hatalmas mennyiségű szöveget, amelyen betanítják őket, és megtanulják a leggyakrabban előforduló mintákat. A folyamat során kiszűrik a leggyakoribb mintáktól eltérő információkat.

Ez a hatás tovább fokozódhat, ha a nyelvi modelleket egyre inkább más mesterséges intelligencia-modellek által generált szövegekre tanítják be – ez a kutatók várakozásai szerint be is fog következni. Ebben az esetben a modellek a saját eredményeikből fognak tanulni, amelyek már eleve egysíkúbbak, mint azok az ember által írt szövegek, amelyekre eredetileg betanították őket.

Ha ez a folyamat több generáción át ismétlődik, az információk köre fokozatosan szűkülni fog. Ezt nevezik a kutatók „tudásösszeomlásnak”.

„Ez egy aggasztó gondolat. Ugyanakkor azt is láthatjuk, hogy a legújabb modellek valamivel változatosabb válaszokat adnak, mint a régebbiek, így a tudásösszeomlás egyelőre még nem következik be. De a mechanizmus, amely hosszú távon kiválthatja ezt, már létezik. Ezért érdemes odafigyelnünk rá” – mondja Isabelle Augenstein.

Különböző források keresése

A kutatók ezért abban is reménykednek, hogy az emberek átgondoltan fogják használni a mesterséges intelligenciát:

„A mesterséges intelligencia által generált chatbot-összefoglalók természetesen hasznosak lehetnek – ezért is használják ezeket olyan sokan. De továbbra is fontos, hogy különböző forrásokat keressünk, hogy megértsük a finom árnyalatokat és átfogóbb képet kapjunk – különösen az MI-vel felnövő ifjabb generáció számára. Nem szabad engednünk, hogy annyira függővé váljunk a technológiától, hogy ne legyünk képesek önállóan gondolkodni és megérteni a dolgokat” – mondja Isabelle Augenstein.

A kutatók szerint a mesterséges intelligencia iparának is figyelmet kellene fordítania erre a kérdésre:

„Bízunk benne, hogy a mesterséges intelligenciát fejlesztő szakemberek olyan nyelvi modelleket hoznak létre, amelyek megőrzik a rendelkezésünkre álló tudás sokszínűségét. Kidolgoztunk egy módszert, amellyel mérhető a modellek sokszínűsége, és ez hozzájárulhat ahhoz, hogy a jövőbeli nyelvi modellek ne váljanak egysíkúvá” – mondja Dustin Wright.

 

 

[TÉNYEK] A KUTATÁSRÓL

  • A kutatók 27 nagy nyelvi modellt elemeztek az OpenAI, a Meta, a Google és az Alibaba kínálatából.
  • A modelleket 12 különböző országhoz kapcsolódó 155 témában tesztelték.
  • Az elemzés nagyjából 1,7 millió mesterséges intelligencia által generált választ és mintegy 70 millió egyedi állítást érintett.
  • Az eredmények többek között azt mutatják, hogy a kisebb mesterséges intelligencia-modellek változatosabb tartalmat generálnak mint a nagyobbak, és hogy az újabb modellek változatosabbak, mint a régebbiek. Összességében azonban valamennyi modell sokkal kevésbé volt változatos, mint a hagyományos webes keresőmotoroké.
  • A kutatást a Koppenhágai Egyetem, az Aalborgi Egyetem, a Stanfordi Egyetem, a Coloradói Egyetem (Boulder) és a Texasi Egyetem (Austin) kutatói végezték.
  • A tanulmányt elfogadták az EMNLP 2026 nemzetközi kutatási konferenciára, amelyre 2026 októberében kerül sor. A kutatással kapcsolatos cikket az arXiv-en olvashatja el.

 

[TÉNYEK] HOGY MŰKÖDIK A CHABOT?

A mesterséges intelligencián alapuló csevegőrobot (chatbot), például a ChatGPT, a Gemini vagy a Claude, olyan szolgáltatás, amellyel gépeléssel vagy beszéddel lehet kommunikálni, és amely válaszokat ad. A csevegőrobot egy úgynevezett nagy nyelvi modellt használ a kérdések megértéséhez és a válaszok megfogalmazásához.

A nagy nyelvi modell az a háttérben működő mesterségesintelligencia-modell, amely a chatbotot működteti. Ezt hatalmas mennyiségű szöveg alapján tanítják be, és megtanulja, milyen mintázatok szerint kapcsolódnak egymáshoz a szavak és a mondatok.

Amikor beírunk egy kérdést egy mesterséges intelligencia alapú chatbotba, a chatbot továbbítja a kérdést a háttérben működő nagy nyelvi modellnek, amely úgy generál választ, hogy megjósolja, mely szavak illenek leginkább a kérdésedhez.

 

Scroll to Top