Ugyanaz a kérdés kétszer: miért kapsz másik listát az AI-tól?
Ma hajnalban négy AI-asszisztensnek tettem fel ugyanazt a négy magyar kérdést, egymás után kétszer, kijelentkezve. Harminchat választ rögzítettem. A tizenhat ismételt párból a teljes találati lista mindössze kettőben volt azonos, és az első helyen álló vállalkozás kilenc esetben maradt ugyanaz. Vagyis ha az AI-ajánlásod alapján ítéled meg a láthatóságodat, egyetlen lekérdezés nem mond semmit: ugyanaz az asszisztens öt perccel később már más sorrendet ad.
Mit mértem pontosan, és hogyan?
Négy felületet kérdeztem: a ChatGPT-t, a Perplexityt, a Geminit és a Google AI-módot. Mind a négyet kijelentkezve, magyar IP-címről, 2026. október 8-án hajnali 5:27 és 5:56 között. Négy magyar, helyi vállalkozást kereső kérdést tettem fel, mindegyiket kétszer, külön munkamenetben:
- Ajánlj egy jó fogorvost Veszprémben.
- Melyik a legjobb étterem Balatonfüreden?
- Kit ajánlasz könyvelőnek egyéni vállalkozóként Budapesten?
- Hol javíttassam meg a laptopomat Győrben?
Ez négy kérdés, két kör, négy asszisztens, vagyis harminckét válasz, plusz négy válasz egy ötödik kérdésre. Összesen harminchat, és egyetlen lekérdezés sem hibázott el. Minden válasz teljes szövegét, a képernyőképet és a megjelenített forrásokat elmentettem.
Ez kicsi minta. Négy kérdés nem Magyarország, és egyetlen hajnal nem egy hónap. Amit a mérés megmutat, az nem az, hogy melyik asszisztens a jobb, hanem hogy mennyire stabil egyetlen válasz. Erre négy kérdés is elég, mert a válaszokat önmagukhoz hasonlítom.
Mi történik, ha ugyanazt kétszer kérdezed?
Ez a mérés lényege. Tizenhat olyan pár keletkezett, ahol ugyanaz az asszisztens ugyanazt a kérdést kétszer kapta meg. Az eredmény:
- A teljes megnevezett lista 2 párban volt azonos a tizenhatból.
- Az elsőként megnevezett vállalkozás 9 párban maradt ugyanaz.
- Az első körben összesen 85 vállalkozásnevet kaptam. Ebből 62 tért vissza a második körben, 23 pedig nem.
A két szám két külön dolgot mond. A 62 a 85-ből azt jelenti, hogy a mezőny nagyjából áll: az asszisztensek nagyjából ugyanabból a körből válogatnak. A 2 a 16-ból viszont azt jelenti, hogy a sorrend és a lista összetétele szinte sosem ismétlődik pontosan. Ha a cégedet egyszer megnevezte egy asszisztens, abból még nem tudod, hogy holnap is megnevezi.
Ez a mérés nem mondja meg, miért. A válaszok közti eltérés származhat a modell saját véletlenszerűségéből, a háttérben futó keresés eltérő találataiból, vagy mindkettőből. A naplóim ezt nem tudják szétválasztani, és nem is állítom, hogy tudnám.
Mennyire egyeznek egymással az asszisztensek?
Nyolc olyan készlet állt össze, ahol mind a négy asszisztens ugyanarra a kérdésre, ugyanabban a körben válaszolt. Ebből a nyolcból kettőben volt olyan vállalkozás, amelyet mind a négy megnevezett. A maradék hatban nem volt egyetlen közös név sem.
Ez illeszkedik ahhoz, amit korábban mértem: a Gemini és a ChatGPT az esetek 4,2 százalékában ajánlja ugyanazt a céget. A mostani négy kérdés ennél nagyobb egyezést mutat, de a minta is sokkal kisebb, úgyhogy a két szám nem cáfolja és nem erősíti egymást. A gyakorlati következtetés mindkettőből ugyanaz: nincs egyetlen „AI-találati lista”. Négy asszisztens négy különböző piacot lát.
Melyik asszisztens mutatja meg, honnan dolgozik?
A forrásmegjelenítésben sokkal élesebb a különbség, mint az ajánlásokban, és ez az egyetlen dolog, amit ebből a mérésből pontosan meg lehet számolni:
- Perplexity: mind a kilenc válasznál kiírta a felhasznált források számát, 10 és 19 között.
- ChatGPT: kilencből nyolc válasznál jelent meg forráspanel.
- Gemini: a kilenc válasz egyikénél sem rögzítettem forrásszámot vagy forráspanelt.
- Google AI-mód: ugyanez, kilencből nulla.
Fontos, hogy mit jelent ez és mit nem. Nem azt mérem, hogy a Gemini forrás nélkül dolgozik, mert nyilván nem így van. Azt rögzítem, hogy abban a felületen megjelenő állapotban, amelyet elmentettem, nem volt látható forráslista. A különbség neked azért számít, mert ahol van forráspanel, ott meg tudod nézni, melyik oldaladról vette az adatot az asszisztens, és ki tudod javítani, ha rossz. Ahol nincs, ott csak a végeredményt látod.
Mit kezdj ezzel a vállalkozásodban?
Három dolgot érdemes leszűrni belőle.
Egy lekérdezés nem mérés. Ha beírod a saját kategóriádat egy asszisztensbe, és ott vagy a listán, az jó jel, de nem bizonyíték. Ha nem vagy ott, az sem bizonyíték. A tizenhat párból kettőben jött ugyanaz a lista, vagyis az egyszeri próba nagyjából véletlenszerű mintavétel. Ha tudni akarod, hol állsz, ugyanazt a kérdést kell többször, több napon és több asszisztensen feltenned, és a találatok arányát nézned, nem egyetlen választ.
Négy felületet kell néznéd, nem egyet. Nyolc készletből hatban nem volt egyetlen közös vállalkozás sem. Ha csak a ChatGPT-ben ellenőrződ magad, három másik felületről semmit nem tudsz. Hogy ezek mennyire térnek el országos szinten, azt az országos mérés a magyar kkv-webről mutatja meg nagyobb mintán.
A stabilitás nem a szövegeden múlik. Ez a mérés azt is megmutatja, hogy az ingadozás egy része tőled független. Amire viszont hatni tudsz, az az, hogy egyáltalán bekerülj abba a körbe, amelyből az asszisztensek válogatnak. Ehhez a külső jelek számítanak a legtöbbet, elsősorban a vélemények: hány vélemény kell ahhoz, hogy az AI név szerint ajánljon. Az pedig, hogy egy jó GEO-pontszám önmagában még nem jelent ajánlást, külön téma: a GEO-pontszám és az AI-ajánlás viszonya.
Mit nem mutat meg ez a mérés?
Nem mutatja meg, melyik asszisztens pontosabb, mert a válaszok helyességét nem ellenőriztem. Nem mutatja meg, hogy egy adott vállalkozás jól vagy rosszul teljesít, és ezért egyetlen céget sem nevezek meg a cikkben. Nem mutatja meg, mi történik bejelentkezve, mert kijelentkezve mértem. Nem mutatja meg, mi történik más városokban vagy más szakmákban, mert négy kérdést tettem fel. És nem mutatja meg, hogy mi változik egy hét alatt, mert fél óra alatt futott le az egész.
Amit megmutat, az egyetlen dolog, és azt elég pontosan: ugyanaz a kérdés, ugyanannak az asszisztensnek, néhány perc különbséggel, ritkán ad ugyanolyan listát.
Gyakori kérdések
Miért ad más választ ugyanaz az AI-asszisztens, ha kétszer kérdezem?
A mérésemben tizenhat ismételt párból a teljes találati lista mindössze kettőben volt azonos, az első helyen álló vállalkozás pedig kilencben maradt ugyanaz. Az eltérés származhat a modell saját véletlenszerűségéből, a háttérben futó keresés eltérő találataiból, vagy mindkettőből. A naplóim ezt nem tudják szétválasztani, úgyhogy az okot nem állítom, csak a jelenséget mérem.
Elég egyszer megkérdeznem az AI-t ahhoz, hogy tudjam, ajánl-e engem?
Nem. Ha egyszer ott vagy a listán, az jó jel, de nem bizonyíték, és ha nem vagy ott, az sem az. Ugyanazt a kérdést több napon, több asszisztensen érdemes feltenned, és a találatok arányát nézned. Egyetlen válasz nagyjából véletlenszerű mintavétel abból a körből, amelyből az asszisztens aznap válogat.
Mennyire egyeznek egymással a különböző AI-asszisztensek?
Nyolc olyan készletből, ahol mind a négy asszisztens ugyanarra a kérdésre válaszolt, kettőben volt olyan vállalkozás, amelyet mind a négy megnevezett. A maradék hatban egyetlen közös név sem akadt. Ez azt jelenti, hogy nincs egyetlen AI-találati lista: ha csak egy felületen ellenőrződ magad, a többiről semmit nem tudsz.
Melyik AI-asszisztens mutatja meg, hogy honnan vette az információt?
A Perplexity mind a kilenc válaszánál kiírta a felhasznált források számát, 10 és 19 között. A ChatGPT kilencből nyolc válasznál mutatott forráspanelt. A Gemini és a Google AI-mód egyetlen rögzített válaszánál sem jelent meg forrásszám vagy forráspanel. Ez nem azt jelenti, hogy forrás nélkül dolgoznak, hanem azt, hogy az elmentett felületi állapotban nem volt látható forráslista.
Mit tudok tenni azért, hogy az AI stabilabban ajánljon?
A sorrend ingadozásának egy része tőled független, arra nem tudsz hatni. Amire igen, az az, hogy egyáltalán bekerülj abba a körbe, amelyből az asszisztensek válogatnak. Ebben a külső jelek számítanak a legtöbbet, elsősorban a vélemények száma és frissessége, valamint az, hogy a weboldaladon megtalálható és kiolvasható legyen a szolgáltatásod, a helyszíned és az elérhetőséged.
Mekkora ez a minta, és mire nem használható?
Négy kérdés, négy asszisztens, két kör, összesen 36 válasz, egyetlen fél óra alatt, kijelentkezve, magyar IP-címről. Ez kicsi minta. Nem mutatja meg, melyik asszisztens pontosabb, mert a válaszok helyességét nem ellenőriztem, és nem mutatja meg, mi történik más városokban, más szakmákban vagy bejelentkezve. Azt mutatja meg, hogy egyetlen válasz mennyire stabil, és erre a válaszok önmagukkal való összehasonlítása elegendő.
Források
- Saját mérés, 2026. október 8., 05:27–05:56 CEST: 36 válasz négy AI-asszisztenstől, kijelentkezve, magyar IP-címről. A nyers naplók és a képernyőképek nem publikusak.
- MI-Térkép: a Gemini és a ChatGPT az esetek 4,2 százalékában ajánlja ugyanazt a céget
- MI-Térkép: országos mérés arról, mit lát az AI a magyar kkv-webből