A kínai DeepSeek vállalat korábban tervezett időpontnál hamarabb, május helyett egyelőre ismeretlen időpontban kívánja bemutatni R2 nevű új modelljét. A vállalat közlése szerint az új modell célja a kódolási képességek fejlesztése, valamint a következtetések levonása az angol mellett más nyelveken is.
A cég januárban bemutatott R1 modelljéről azt állítják, hogy kevesebb számítási kapacitást igénylő Nvidia chipekkel is versenyképes az amerikai technológiai vállalatok fejlesztéseivel. A modell bejelentését követően a globális részvénypiacokon értékcsökkenés volt tapasztalható, melynek mértékét egyes források több mint 1ezer milliárd dollárra becsülik.
A DeepSeek alapítója, Liang Wenfeng korábban kvantitatív fedezeti alapjával szerzett ismertséget. A vállalat működési modellje a hagyományos kínai technológiai ipar hierarchikus felépítésétől eltérően, a kutatólaboratóriumokhoz hasonlóan, a fiatal szakemberek és gyakornokok számára is nagyobb felelősséget biztosít.
A vállalat közlése szerint sikerének egyik kulcsa a költséghatékony AI architektúra. A DeepSeek olyan technikákat alkalmaz, mint például a Mixture-of-Experts (MoE) és a multihead latent attention (MLA), melyek célja a számítási költségek csökkentése. A Bernstein elemzői szerint a DeepSeek árazása kedvezőbb az OpenAI hasonló modelljeiéhez képest, egyes becslések szerint 20-40-szeresen.
A kínai kormány támogatja a DeepSeeket, amit az is jelez, hogy egyes források szerint legalább 13 városi önkormányzat és 10 állami energetikai vállalat integrálta rendszereibe a cég modelljét. Ezzel szemben egyes nyugati országok, köztük Dél-Korea és Olaszország, adatvédelmi aggályokra hivatkozva eltávolították a DeepSeek alkalmazásait nemzeti alkalmazásboltjaikból.
A vállalat egyik kihívása a fejlett AI chipekre vonatkozó amerikai exportkorlátozás. Liang Wenfeng egy korábbi interjúban azt nyilatkozta, hogy a finanszírozás helyett a csúcskategóriás chipekre vonatkozó embargó jelenti a problémát.
Elemzés
Az eredeti cikk több ponton is érzelmi hatást próbált gyakorolni az olvasóra. Például a „kevésbé erős Nvidia chipekkel építették, mégis felvette a versenyt az amerikai technológiai óriások több százmilliárd dolláros fejlesztéseivel” mondat a DeepSeek teljesítményét túlzó módon emeli ki. A „több mint 1ezer milliárd dolláros értékvesztést okozott a globális részvénypiacokon” kijelentés pedig drámai hatást kelt, bár az ok-okozati összefüggés nem bizonyított.
A cikkben a DeepSeek sikerét Liang Wenfeng vezetési stílusának tulajdonítják, ami feltételezés, nem pedig bizonyított tény. A „lelkesen támogatja a DeepSeeket” megfogalmazás pedig elfogultságot sugall a kínai kormány DeepSeekhez való viszonyulásával kapcsolatban.
Politikai kvízHol állsz a politikai palettán?15 kérdés, kb. 5 perc — kiderül, melyik politikai irányvonalhoz állsz a legközelebb, és melyik ismert politikussal gondolkodsz hasonlóan.Kvíz indításaA cikkben tett állítások egy része nem ellenőrizhető teljes mértékben, például a részvénypiaci értékvesztés pontos mértéke, vagy a kínai önkormányzatok és vállalatok DeepSeek integrációjának valós mértéke. A cikkben szereplő állítások valóságtartalmának megítéléséhez további információkra és független forrásokra lenne szükség.
A cikkből arra a következtetésre lehet jutni, hogy a DeepSeek egy feltörekvő kínai AI vállalat, amely versenyképes alternatívát kínál a nyugati technológiai cégekkel szemben. A vállalat sikerét a költséghatékony technológiának és a kormányzati támogatásnak tulajdonítják, ugyanakkor kihívást jelent számára a chiphiány és a nyugati adatvédelmi aggályok.
Az esemény hatása a magyar közéletre közvetve érvényesülhet. A kínai technológiai fejlődés és az AI alkalmazások terjedése globális jelenség, amely Magyarországot is érinti. A DeepSeek sikere ösztönözheti a magyar AI kutatásokat és fejlesztéseket, valamint felhívhatja a figyelmet a technológiai versenyképesség fontosságára.
(Kép: Deepseek/Facebook)