A ChatGPT név szerint keresi az egyes subredditeket

Peter

Itt van egy keresősor, amelyet a ChatGPT írt magának a héten, egyenesen a forgalomból.

fast|site:reddit.com/r/whatnotapp seller tips Whatnot live selling|3650|reddit.com

Nézd meg az utat. Ez olvasható r/whatnotappegy subreddit, név szerint kiválasztott, mielőtt bármit is lekértek volna.

A 21-én közzétett lebontásban dokumentáltam, hogy a ChatGPT domain szinten kéri a Reddit szolgáltatást, reddit.com a célzási helyen 365 napos ablakkal.

Ez egy szinttel mélyebbre megy.

A modell a közösséget választotta, nem az oldalt, és 3650 napot, egy évtizednyi szálat adott neki.

A beszélgetés során 71 eredményből 48 Reddit szál jött vissza. Minden letöltött 68%-a.

reddit.com/r/whatnotapp/comments/1vqdlaq/tips_for_a_new_seller/
reddit.com/r/whatnotapp/comments/1r6mws8/advice_on_selling_on_whatnot/
reddit.com/r/whatnotapp/comments/1tzv075/new_to_whatnot_best_tips_for_selling_smocked/

Aztán hivatkozott rájuk.

A válaszban szereplő nyolc idézet közül hat a címre ment r/whatnotapp szálak. Az egyik a Whatnot saját súgóközpontjába ment.

A Reddit chip mellett az értékes tárgyakat ne kezdje 1 dollárral, a stream szórakoztatásként való kezelésével kapcsolatos tanács mellett, valamint a műsorok előre ütemezésére vonatkozó tanács mellett.

A Reddit idézet lekérdezésfüggő, nincs kikapcsolva

Ez azért számít, mert négy nappal korábban az ellenkezőjét rögzítettem ugyanabban a fiókban.

Lekérdezés Az oldalak lekérve Redditről Idézetek A Reddit nyerte
Micsoda eladó tippek 71 48 8 6
legjobb AI élő chat támogató szoftver 221 84 11 0

Négy nap különbséggel, ugyanaz a fiók, mindkettő kereskedelmi kérdés. Az egyik a Redditnek adta a látható hitel háromnegyedét. A másik 84 szálat vett le, és egyiket sem írta jóvá.

A másodikat 21-én publikáltam, és úgy olvastam, hogy a Reddit láthatatlan bemenetté vált, és táplálja az ítéleteket, miközben a gyártói oldalak gyűjtik az idézeteket.

Ez a rögzítés azt mondja, hogy az olvasás túl tág. Erre a beszélgetésre vonatkozik. Általános szabályként nem állja meg a helyét.

Hogy mi választja el őket, érdemes találgatni, és ez csak találgatás. A Whatnot egy szűk piactér, és a gyakorlati eladói tudás egyetlen subredditben található, és sehol máshol. Az élő csevegőszoftver olyan szállítói kategória, ahol az árképzési oldalak, a dokumentáció és az összehasonlító oldalak ugyanazokért az állításokért versengenek. Ha az őszinte legjobb forrás egy fórum, akkor is a fórum nyeri az idézetet.

Múlt héten írtam, hogy a Reddit inkább kiesett a ChatGPT idézeteiből, mintsem a modellből, és minden máshoz még egy kísérletre volt szükség.

Ez a rögzítés az a kísérlet, és következményei vannak a két kört megtevő magyarázatra.

Ryan Jones a Bingen

Ryan úgy találta, hogy a Bing felhagyott a Reddit rangsorolásával a szokásos kereskedelmi lekérdezések esetében, és úgy érvelt, hogy mivel a Bing a ChatGPT lekérése mögött áll, a Reddit is vele ment.

Megfigyelése beválik, és szélesebb, mint a négy példája. Ezeket plusz két sajátomat futtattam a Bingen keresztül, és nem API-t, hanem a renderelt SERP-t olvastam.

Lekérdezés Reddit a Bing eredményeiben
a legjobb TV sportoláshoz egyik sem
legjobb fogkefe egyik sem
Micsoda eladó tippek egyik sem
transzformátorok filmkritika egyik sem
legjobb futócipő egyik sem
legjobb crm kisvállalkozások számára egyik sem

Nem „nem a top 10-ben”. A húr reddit.com nulla alkalommal jelenik meg mind a hat oldal HTML-kódjában, míg a Google kettőnél a Reddit 2-es pozícióba helyezi.

Bármi is történt a Bingnél, valóságos, és önmagában is érdemes tudni.

A nem túlélő lépés egy olyan feltételezés, amelyet az egész iparág 2023 óta hajt, hogy a ChatGPT webes eredményei a Bing eredményei.

Magam is megismételtem a beszélgetéseken. A készlet nem tartalmazhat olyasmit, amivel az index nem rendelkezik, tehát ha a készlet 68%-a Reddit, és a Bing ugyanazon lekérdezéshez tartozó oldalán nincs ilyen, a kettő nem egy forrás.

Valami más módon éri el a Redditet, legyen az OpenAI saját indexe vagy a Reddit-ügyletből származó licencelt hírfolyam.

Ryan Bing-lelete mindkét irányban megállja a helyét. Lehetséges, hogy ugyanaz a döntés két helyen játszódik le, nem pedig az egyik okozza a másikat.

Jenny Halasz On Access

Jenny a Reddit fizetős hozzáférésű falára mutatott, és megkérdezte, hogy az OpenAI felhasználói ügynökei megkapják-e a korlátozott robots.txt fájlt, és elveszítik-e a hozzáférést a tartalomhoz.

Igaza van az építészettel kapcsolatban. Megnéztem. A Reddit nyilvános robots.txt fájlja az Disallow: / mindenki számára, és a megengedő verzió az ellenőrzött partnereknek kiszolgált, tehát a nyitott fájl a álcázott.

Meghamisítottam a GPTBotot és a Googlebotot, és mindkettő 403-ast kap, nem pedig robots.txt-t.

Ez a 403 az érdekes, mert az igazi Googlebot nyilvánvalóan nincs letiltva a Reddit elől.

Azt mondja, hogy a Reddit ellenőrzi a kérelmező IP-címet a közzétett bejáró-tartományok alapján, ahelyett, hogy megbízna a felhasználói ügynök karakterláncában. Az OpenAI és a Google is közzéteszi ezeket a tartományokat, ami lehetővé teszi az ellenőrzést.

Ennek az a következménye, hogy az OpenAI IP-tartományain kívül senki sem láthatja, mit kapnak az ellenőrzött OpenAI-ügynökök. Jenny annyit mond a saját bejegyzésében, hogy tud hamisítani egy felhasználói ügynököt, de nem egy IP-t. Tehát egy felhasználói ügynök teszt megmutatja a kívülálló véleményét, függetlenül attól, hogy ki futtatja.

Amikor ezt feltettem neki, jó kérdést tett fel. Még mindig gond nélkül megkapja a felhasználó felé néző robots.txt fájlt, szóval a tesztem egyesült államokbeli IP-címről futott?

Nem volt az. Lakossági kapcsolatban vagyok az Egyesült Arab Emírségekben. Ebből kiderül, hogy az eredmény tisztább, semmint sárosabb, mivel minden kérés ugyanarról a címről érkezett ugyanabban a percben, és csak a felhasználói ügynök változott.

Kért mint Válasz
Chrome macOS rendszeren 200, a nyilvános robots.txt
OAI-SearchBot 200
GPTBot 403
ChatGPT-Felhasználó 403
Googlebot 403

Ezek mind ugyanarról a címről érkeztek egy percen belül, szóval a földrajz nem lehet a változó. Az ő eredménye és az enyém is egyetért, mivel egy normál böngésző UA nálam is 200-at ad vissza, így valószínűleg különböző dolgokat teszteltünk.

A sor, amelyre érdemes odafigyelni, az OAI-SearchBot 200 közben GPTBot és ChatGPT-User get 403. A Reddit az OpenAI saját ügynökeit egymástól eltérően kezeli, ami egy földrajzi magyarázat sem fér el.

Bármilyen robots.txt fájlt is kapjon az egyes ügynökök, az a tartalom elérte a modellt, aktuálisan és tömegesen, egy ezen a héten feltett lekérdezésre. Érdemes hozzátenni, hogy a robots.txt egyébként is szabályozza a feltérképezést, és a licencelt adattáblázat nem térképez fel.

Auth az Old.reddit.com webhelyen

A hozzáférési ötlet harmadik verziója is körbejárt, a Reddit bejelentkezési falat helyezett el old.reddit.com és megnehezítette a kaparást. Ez a rész igaz. A r/whatnotapp A ChatGPT által hivatkozott szál átirányítások ide /login/ -on old.reddit.commiközben ugyanaz a szál www.reddit.com 200-at ad vissza és rendesen szolgál.

Ezt azonban nem éri el, mert a lekérési készletben minden Reddit URL www.reddit.com. A soha nem kért ChatGPT gazdagépnév fala nincs az útvonalon. Az OpenAI licencszerződése egyébként is megkérdőjelezheti az egész kérdést, és nem tudom megmondani a hasznos terhelésből, hogy ezek a szálak a Data API-n, az OpenAI saját indexén vagy egy www. A gazdagépnevet meg tudom mondani, és nem a bezárt.

Akárhogy is, hat idézett szál válaszol a hozzáférési kérdésre a másik végről. Nem idézhetsz olyat, amit nem tudsz elérni.

Időzítési probléma is van az okként való hozzáféréssel kapcsolatban. A Jenny által leírt kapu körülbelül két éve működik. Az idézettségi csepp három hetes.

Az élő csevegési lekérdezésben a visszaesés a lekérés után jött

Mindkét magyarázat a lehívásról szól, és a lehívás működik minden felvett lekérdezésnél.

A lebontás során egy élő chat-lekérdezés 84 Reddit-szálat húzott ki a 221 eredményből, és egyiket sem idézte. Az oldalak erre a kérdésre érkeztek, majd hiteltelenné váltak, ami még mindig magyarázatra szorul. Ez az is, amely itt nem ismétlődik, tehát bármi is szabályozza a jóváírást, lekérdezésenként változik, nem pedig egyirányú.

Ez az a lépés, amelyet nem láthat egy SERP-ből vagy egy robots.txt fájlból. A szükséges kísérlet megint más. Tartsa a lekérdezési állandót, rögzítse a készletet, és ellenőrizze, hogy a válasz megfogalmazása követi-e azokat a Reddit-töredékeket, amelyeket lekértek és soha nem írtak jóvá. Ez közvetlenül tesztelné a befolyást, amit jelenleg egyikünk sem tud bizonyítani.

Csökkenő idézett részvény és nyerő Subreddit

A Reddit szándékosan keresik, egészen az egyéni közösségig, a legszélesebb frissességi ablakokkal, amelyeket a ChatGPT bármit is biztosít. Sokat hivatkoztak arra a kérdésre, hogy hol a subreddit a legjobb elérhető forrás, és egyáltalán nem az általam ellenőrzött szállítói kategóriára vonatkozó kérdésnél, ahol az árképzési oldalak és az összehasonlító oldalak ugyanazt a választ adják.

Ez más probléma, mint a tárgyalt. Az összesített hivatkozási arány meredeken csökkenhet, miközben a Reddit folyamatosan nyeri azokat a lekérdezéseket, amelyeket megérdemel, és mindkettő egyszerre igaz lehet.

Amit nem állítok

Négy lekérdezés, egy fiók, egy hét. A négy közül kettő nem húzta le a Reddit-et, és egy nem indított keresést. Az a tágabb pont, hogy a Reddit a korábbinál kevesebbet jeleníti meg, nem vitatott, és nem tudom megmondani, hol húzódik a határ a Reddit-hivatkozásokat kiváltó lekérdezések és egy olyan lekérdezések között, amelyek nem.

Jenny igen-és helyzetnek nevezte, több tényezővel, és azt hiszem, ez közelebb áll a helyeshez, mint önmagában egy magyarázat, beleértve az enyémet is. A Bing rangsorai, a Reddit hozzáférési szabályai és bármi, ami a jóváírást szabályozza, egyszerre történhet meg.

A forgalom változtat, hova kell nézni. Az ajtó nyitva áll, így a kérdés arra irányul, hogy mi döntött úgy, hogy 84 lekért szálat érdemes elolvasni, és nem érdemes jóváírni az élő chat-lekérdezésnél, amikor az itt letöltött 48 a nyolcból hatot vett át.

Hogy ezek a hiteltelen szálak alkotják-e még a választ, azt a forgalomból nem tudom bizonyítani, mert az idézés nélküli befolyásolás nem hagy nyomot az élő vezetéken.


Ezt a bejegyzést eredetileg a Suganthan oldalon tették közzé.


A szerzőről

Peter, az eOldal.hu tapasztalt SEO szakértője és tartalomgyártója. Több mint 10 éve foglalkozik keresőoptimalizálással és online marketinggel, amelyek révén számos magyar vállalkozás sikerét segítette elő. Cikkeiben részletes és naprakész információkat nyújt az olvasóknak a legfrissebb SEO trendekről és stratégiákról.