A Resoneo szerint az OpenAI házon belüli keresési indexe az OpenAI-tartalommal nem rendelkező üzletek százait szolgálta ki pontosan úgy, ahogyan a licencelt partnerei. Ingyenes fiókos adataiban ez az index kezelte a legtöbb ChatGPT keresési eredményt.
A francia SEO tanácsadó cég 1249 ChatGPT-választ olvasott fel júliusban. A Resoneo SEO-tanácsadást értékesít, és odaadja az adatokat rögzítő Chrome-bővítményt.
A megállapítás egy korrekciót támaszt alá, amelyet Suganthan Mohanadasan júliusban tett közzé, miután kezdetben úgy olvasta, hogy az index nagyrészt zárva van a kisebb oldalak előtt.
Amit Resoneo mért
A ChatGPT szerveradatfolyama minden webes eredményt az azt lekérő folyamat nevével jelölt meg, és a négy érték egyike a „labrador”, az OpenAI saját indexe volt. Az ebből a folyamatból származó oldalak összehasonlításakor a Resoneo úgy találta, hogy egy licencszerződés nem változtatta meg az oldalak megjelenítését. Ugyanolyan formátum, azonos hosszúságú és frissesség volt mind a partnerek, mind a nem partnerek számára.
Resoneo a labradort sajtóhírekkel és nyílt tudományos archívumokkal kiegészített indexként írja le. Megemlítik, hogy az OpenAI közvetlenül hozzáférhet anélkül, hogy harmadik félnek kellene fizetnie, ami megkülönbözteti.
A Resoneo ingyenes számlás adatai között szinte minden alkalommal megjelentek megoldott válaszú kérdések, helyi vállalkozások és termékek ezen az indexen keresztül. A hírek eredményei meglehetősen egyenletesen oszlottak meg az index és a Google-tól lekapart adatok között. A gondolkodó módban működő fizetős fiókok esetében a Google scraping a Resoneo által rögzített 16 407 keresési eredmény körülbelül 75%-át biztosította, míg a házon belüli index körülbelül 24%-ot tett ki.
Keresési eredmények a Resoneo fizetett gondolkodásmódú mintájában
16 407 keresési eredmény. Az értékek kerekítettek.
Kikapart Google · körülbelül 75%
OpenAI házon belüli index · körülbelül 24%
Forrás: Resoneo. A csővezetékek besorolása a ChatGPT hálózati forgalom visszafejtése alapján történik.
Hogyan változott a korábbi olvasás
Mohanadasan júniusban ugyanezt az indexet a bevezetett kiadók engedélyezési listájának írta le, miután megvizsgálta a ChatGPT hálózati forgalmát. Megemlítette, hogy „engedélyezett szintnek tűnik”, beleértve az olyan domaineket, mint a Reuters, a The Guardian, a WSJ és a Wikipedia.
Július 14-én ezt visszavette. Egy olasz olvasó egy ingyenes fiókot használva küldött neki felvételeket, amelyek azt mutatják, hogy minden kiadói idézet ugyanazon a csatornán ment keresztül, beleértve a kis olasz oldalakat is. Mohanadasan újra lefuttatta a teszteket, összefoglaló táblázatában elismerte, hogy „túlteljesítette” a szintigényt, és megemlítette, hogy a licencszerződések valódiak, de a szint olvasata azon alapult, hogy egyetlen fiók szemszögéből tekintik az egész helyzetet.
Mindketten különféle teszteket végeztek, mindegyik más-más mérettel. A Resoneo adatkészlete ingyenes és fizetős fiókokat, több országot és kijelentkezett munkameneteket egyaránt tartalmaz, és ugyanazok az üzenetek jelennek meg a különböző fióktípusokon. Mohanadasan számolásai egy beszámolóból származnak, és ő irányítónak nevezi őket, bár korrekciója két másik olvasó beszámolójából is származik. Resoneo Mohanadasan munkáját tekinti saját erőfeszítéseik alapjának.
A Resoneo szerint július 21-e körül az OpenAI leállította az egyes keresési eredmények címkézését az azt lekérő rendszer nevével, amely az a címke, amelyet mindkét vizsgálat olvasott.
Amit a modell lát az oldaladon
A Resoneo 534 ChatGPT által hivatkozott oldalt nézett át, és mindegyiket összehasonlította az OpenAI indexében tárolt kivonatokkal. A 463 H1 fejlécet tartalmazó oldalból 387 részlet tartalmazta, ez 83,6%. A kódrészletet 200 karakter után levágják, általában az oldal tartalmának elejétől, nem pedig a metaleírástól, amit a Google-scrape folyamat továbbra is nagyjából háromból egyet rögzít.
A H1 medián 51 karakter hosszú volt, ami nagyjából 150 karakternyi oldaltartalmat hagy maga után. Az oldalak 29%-án a H1 előtt jelenik meg egy szakaszváltó, és 18 karaktert foglal el. A megjelenés dátuma az oldalak 11%-án jelenik meg, 25 karaktert használva, az első kép alternatív szövege pedig az oldalak 9%-án jelenik meg, és önmagában 50 karakterből állhat.
A mintában minden hetedik oldalon nem volt H1 jelölés. A Resoneo megemlíti, hogy ezekben az esetekben a részlet a sablon által biztosított alcímekkel kezdődik.
Miért számít ez?
Az OpenAI tartalomszerződéssel nem rendelkező webhelyek továbbra is megjelennek abban az indexben, amely a legtöbb ingyenes fiókos ChatGPT-eredményt kezeli. Resoneo megállapításai ezt támasztják alá, akárcsak Mohanadasan saját frissítése. Az újratesztelés után azt javasolta, hogy több fiókkal is ellenőrizze, hogy tisztább képet kapjon, mivel egyetlen fiók csak azt mutatja meg, hogy a ChatGPT hogyan kommunikált az adott fiókkal.
Az index egy címet és körülbelül 200 karaktert tárol az oldalról. Bármi, amit egy sablon az első bekezdés fölé nyomtat, annak egy részét felhasználja. A Resoneo nem tesztelte, hogy a módosítás növeli-e az oldal hivatkozásának valószínűségét.
Előre tekintve
A kiadók több okból is kötnek tartalomszerződéseket az OpenAI-val. A ChatGPT ingyenes felhasználóknak adott válaszaiban való megjelenés gyengének tűnik, mivel az üzlettel nem rendelkező webhelyek már szerepeltek abban az indexben, amely a legtöbb választ kezeli.
Az, hogy egy ügylet elősegíti-e az oldal gyakrabban történő idézését, más kérdés, és egyik vizsgálat sem vizsgálta. A Resoneo az oldalak tárolására és kiszolgálására összpontosított. A közzététel időpontja óta az OpenAI bejáró oldala nem részletezi a házon belüli indexét, és nem határozza meg, hogy mit tartalmaznak a kiadói szerződései. A Resoneo megjegyzi, hogy a partnercikkek feeden, nem pedig feltérképezésen keresztül jutnak el az OpenAI-hoz, így az üzlet megváltoztathatja a tartalom odajutását.
