OkosHír:
Az AI Disclosures Project, egy nonprofit szervezet, amely a mesterséges intelligencia területét vizsgálja, tanulmányt készített az OpenAI legújabb modelljének, a GPT-4o-nak a képzéséhez felhasznált adatok eredetéről.
A kutatók az O’Reilly Media 34, szerzői jogvédelem alatt álló adathalmazát használták a vizsgálathoz. Ezeket az adathalmazokat a kutatók jogszerűen szerezték be. A GPT-4o modell (82 százalékos AUROC-pontszám) jobban felismerte a fizetős O’Reilly könyvek tartalmát, mint az OpenAI korábbi GPT-3.5 Turbo modellje (64 százalékos AUROC-pontszám). A GPT-3.5 Turbo modell jobban teljesített a nyilvánosan hozzáférhető O’Reilly könyvminták esetében.
A jelentés szerint az eredmények felvetik a vállalatok átláthatóságának növelésének szükségességét, ami a mesterséges intelligenciával foglalkozó cégek szabályozott működésének előfeltétele lehet.
A jelentés hangsúlyozza, hogy bár a bizonyítékok az OpenAI-ra és az O’Reilly Media könyveire vonatkoznak, feltételezhetően rendszerszintű problémáról van szó. Az AI-modellek képzéséhez és fejlesztéséhez minőségi, fizetős adatokra van szükség, amihez a piacnak alkalmazkodnia kell.
A szervezet szerint a szellemi tulajdonjogok figyelmen kívül hagyása hosszú távon káros lehet a mesterséges intelligencia fejlesztőinek, még akkor is, ha a felhasználást engedélyezettnek tekintik. Javasolják olyan rendszerek kialakítását, amelyek mind az alkotók, mind a fejlesztők számára előnyösek.
Tiszta.AI elemzés: Az eredeti cikk értékelése
Az eredeti cikk a GPT-4o modell képzéséhez használt adatok eredetével kapcsolatos vizsgálatot mutatja be. A cikk sugallja, hogy az OpenAI modellje szerzői jogvédelem alatt álló anyagokat használhatott fel jogosulatlanul, ami problémákat vet fel a szellemi tulajdonjogok és az MI-fejlesztés kapcsolatában.
Az eredeti cikk következtetésként tálalja azt a feltételezést, hogy az OpenAI jogsértést követett el. Ezt a feltételezést azzal támasztja alá, hogy a GPT-4o jobban teljesített a fizetős könyvek tartalmának felismerésében, mint a GPT-3.5 Turbo. Fontos megjegyezni, hogy ez nem feltétlenül bizonyítja a jogsértést, csupán arra utal, hogy a GPT-4o valamilyen módon hozzáférhetett ezekhez az adatokhoz.
Politikai kvízHol állsz a politikai palettán?15 kérdés, kb. 5 perc — kiderül, melyik politikai irányvonalhoz állsz a legközelebb, és melyik ismert politikussal gondolkodsz hasonlóan.Kvíz indításaA cikk által leírtakból az a konklúzió vonható le, hogy a mesterséges intelligencia fejlesztésének etikai és jogi kérdései továbbra is megoldatlanok. A szellemi tulajdonjogok védelme és az innováció előmozdítása közötti egyensúly megteremtése kulcsfontosságú a fenntartható MI-fejlesztéshez.
Az esemény hatással lehet a magyar közéletre, mivel felhívja a figyelmet a mesterséges intelligencia szabályozásának szükségességére. A magyar kormány és a szabályozó hatóságok a jövőben szigorúbb követelményeket támaszthatnak az MI-fejlesztőkkel szemben, különösen az adatvédelem és a szellemi tulajdonjogok tiszteletben tartása terén.