OkosHír: Egy amerikai weboptimalizációs és biztonsági szolgáltató cég, a Cloudflare elemzésében azt állítja, hogy a Perplexity nevű mesterséges intelligencia alapú kereső a tiltások ellenére is botokat alkalmaz weboldalak átvizsgálására, információk és tartalmak megszerzése céljából.
Az interneten számos bot működik, amelyek weboldalakat vizsgálnak át tartalomgyűjtés céljából, például keresőmotorok indexeléséhez. Ezeket a botokat „crawlereknek” nevezik. A weboldal-tulajdonosok nem minden esetben engedélyezik az összes bot számára az oldalaik átvizsgálását. Ennek szabályozására a fejlesztők egy robots.txt fájlt helyeznek el a weblapjukon, amely meghatározza, hogy az adott crawler milyen tartalmakat vizsgálhat meg vagy indexálhat.
A Cloudflare magyarázata szerint a robots.txt fájl működése ahhoz hasonló, mint egy viselkedési szabályokat tartalmazó plakát egy nyilvános helyen: önmagában nincs kényszerítő ereje, de a szabályokat betartó entitások figyelembe veszik, míg a szabályszegők azonosíthatók és kizárhatók. Amennyiben egy bot nem tartja be a robots.txt fájlban foglalt utasításokat, az negatívan befolyásolja a botot működtető entitás megítélését.
Számos weboldal-üzemeltető nem kívánja, hogy mesterséges intelligencia (MI) cégek crawlerekkel vizsgálják át oldalaikat. Ennek következtében több Cloudflare ügyfél jelezte meglepetten, hogy a tiltások ellenére a Perplexity hozzáfér az oldalaik tartalmához. A Cloudflare tesztelés céljából több új weboldalt hozott létre. A tesztek eredményei megerősítették, hogy a Perplexity a tiltások ellenére is képes volt hozzáférni és megjeleníteni az oldalak tartalmát.
Politikai kvízHol állsz a politikai palettán?15 kérdés, kb. 5 perc — kiderül, melyik politikai irányvonalhoz állsz a legközelebb, és melyik ismert politikussal gondolkodsz hasonlóan.Kvíz indításaA Cloudflare vezérigazgatója szerint a Perplexity módszerei az észak-koreai hackerek által alkalmazottakhoz hasonlóak. A Cloudflare elemzése azt állítja, hogy amennyiben a Perplexity ismert, regisztrált botjai tiltásba ütköznek, a cég egy azonosítatlan crawlert alkalmaz az oldalak átvizsgálására. Ennek következtében a Cloudflare eltávolította a Perplexity crawlereit a hitelesített botok listájáról, és új rendszereket fejlesztenek működésük megakadályozására.
A Perplexity reagált az elemzésre, és állítása szerint az eset csupán a Cloudflare PR-fogása, és nekik nincs közük a szabályokat áthágó crawlerekhez. A Perplexity nézete szerint az MI-asszisztenseket nem szabadna ugyanúgy kezelni, mint a hagyományos botokat. Nem ez az első alkalom, hogy a Perplexityt hasonló vádak érik: korábban több médium, köztük a Wired is arról számolt be, hogy a Perplexity plágiumot követ el cikkeikkel szemben. Ezen esetek során az MI-cég vezérigazgatója állítólag nem tudta definiálni a plágium fogalmát.
Tiszta.AI elemzés: Az eredeti cikk értékelése
- Az eredeti cikk narratívája és célja: Az eredeti cikk célja egyértelműen a Perplexity mesterséges intelligencia alapú kereső negatív színben való feltüntetése, mint olyan entitás, amely szándékosan figyelmen kívül hagyja a webes protokollokat és potenciálisan károsítja az internetet. A szöveg narratívája a Cloudflare álláspontját hangsúlyozza, és a Perplexityt felelőtlen, szabályszegő szereplőként mutatja be. A cikk célja a Perplexityvel, és tágabb értelemben a webes tartalmakat gyűjtő MI-cégekkel szembeni bizalmatlanság és aggodalom felkeltése az olvasóban.
- Főbb manipulatív eszközök: Az eredeti cikk több nyelvi és retorikai eszközt is alkalmaz a célzott narratíva megerősítésére:
- Érzelmileg túlfűtött és negatív konnotációjú szavak használata: A „lelopják” kifejezés az „információt, tartalmakat” megszerzésére vonatkozóan egyértelműen pejoratív, lopásra utaló értelmezést sugall, ami bűncselekményre asszociál.
- Dramatizáló és leegyszerűsítő hasonlat: A robots.txt fájl működését a „kocsmába egy plakát” analógiával magyarázza. Bár a hasonlat a technikai működést próbálja szemléltetni, a „jófej emberek” és „rosszak” megkülönböztetése morális síkra tereli a technikai szabályszegést, és érzelmileg befolyásolja az olvasó megítélését.
- Lejárató és inflamatív összehasonlítás: A Cloudflare vezérigazgatójának azon állítása, miszerint a Perplexity „észak-koreai hekkerekhez hasonló módszereket használ”, rendkívül erős és manipulatív kijelentés. Ez a hasonlat szándékosan a Perplexityt egy rosszindulatú, állami támogatású kiberbűnöző csoporthoz köti, ami súlyosan rombolja a cég hitelességét és morális megítélését az olvasó szemében.
- Sugalló és informális kifejezések: Az „simán megmondta” kifejezés a Perplexity adatgyűjtési képességére vonatkozóan azt sugallja, hogy a cég könnyedén és felületesen, a szabályokat figyelmen kívül hagyva jutott információhoz.
- Tényként kezelt, nem alátámasztott állítás: Az utolsó mondatban szereplő állítás, miszerint a Perplexity vezérigazgatója „nem is tudta megmondani, hogy mi is az a plágium”, tényként van bemutatva, holott a cikk nem hivatkozik konkrét forrásra vagy bizonyítékra. Ez az állítás a vezérigazgató szakmai inkompetenciáját vagy etikátlan magatartását sugallja, tovább erősítve a Perplexity negatív képét.
- A téma társadalmi relevanciája: A cikkben tárgyalt téma, az MI-cégek adatgyűjtési gyakorlata és a webes protokollok betartása kiemelten fontos társadalmi és médiaipari relevanciával bír. Az MI-modellek képzéséhez szükséges hatalmas adatmennyiség gyűjtése etikai, jogi és gazdasági vitákat generál. A „crawler” botok viselkedésének szabályozása, a szerzői jogok védelme, valamint a weboldal-tulajdonosok kontrollja a saját tartalmaik felett kulcsfontosságú kérdések. A téma befolyásolja a tartalomgyártók üzleti modelljeit, a média jövőjét, és felveti az MI-fejlesztések átláthatóságának és felelősségre vonhatóságának szükségességét. A vita arról is szól, hogy az MI-asszisztenseket milyen kategóriába soroljuk, és milyen szabályok vonatkozzanak rájuk a hagyományos keresőmotorokhoz képest.