PewDiePie-t kétszer kitiltotta az OpenAI, mert az ő modelljüket használta a saját AI modellje tanításához
Cikk meghallgatása
PewDiePie (valódi nevén Felix Kjellberg) a világ egyik legismertebb YouTube-sztárja, aki a 2010-es években vált legendává gaming- és humorvideóival. Az utóbbi években egyre inkább a technológia és a decentralizáció irányába fordult: nemcsak kriptovalutákkal foglalkozott, hanem saját, helyi gépen futó, cenzúrázatlan MI-rendszereket is fejleszt – pontosan azért, hogy az adatok ne big tech cégek szerverein landoljanak.
PewDiePie most azt állítja, hogy az OpenAI kétszer is felfüggesztette a fiókját, miközben az Ajaxot építette – egy kisméretű, cenzúrázatlan MI-modellt, amely saját számítógépen futtatható, és képes helyetted böngészni a webet. A történetet egy új YouTube-videójában mesélte el:
A YouTuber az Ajaxot finomhangolt modellként írja le: egy már létező alapmodellt további tanítással egy meghatározott feladatra optimalizálnak. A cél, hogy az Odysseusban működjön, abban az ingyenes, saját üzemeltetésű MI-alkalmazásban, amelyet PewDiePie júniusban indított. Egy ilyen, helyi gépen futó modellnél az e-mailek és a naptár adatai helyben maradnak, nem vállalati szervereken tárolódnak, és nincs előfizetési díj – a számítási terhelést viszont a saját hardvernek kell elbírnia.
A modell állítólag 9 milliárd paraméteres, és az Alibaba nyílt forráskódú Qwen 3.5-ére épül. A paraméterek a modell agyát alkotó módosítható számértékek; általában minél több van belőlük, annál erősebb a teljesítmény. Az Ajax még nem jelent meg, de PewDiePie weboldalán lesz elérhető, amint készen áll. A letöltési oldalon eredetileg egy visszaszámláló szerepelt, amely japán idő szerint október 3-án hajnali 1:25 perckor járt volna le; a visszaszámláló azóta eltűnt.
Az OpenAI-nak nem annyira tetszett PewDiePie kezdeményezése
PewDiePie elmondása szerint a GPT-5.6 Solból akart desztillálni. A Sol az OpenAI július 9-én kiadott csúcsmodellje. A desztilláció lényege, hogy egy kisebb MI-t egy nagyobb modell válaszain tanítanak – mintha egy diák a zseniális osztálytársa házi feladataiból tanulna. A cél az volt, hogy megszerezze a Sol rejtett következtetési tokenjeit. Ezek azok a belső, titkosított szövegtöredékek, amelyeket a modell egyfajta privát jegyzetfüzetként használ, miközben lépésről lépésre végiggondolja és megoldja a feladatot.
PewDiePie szerint talált egy tanulmányt, amely leírja ahogy az OpenAI saját API-ján keresztül töri fel ezt a védelmet. Ő maga állítása szerint soha nem támadta meg a rendszert, az OpenAI mégis kitiltotta. A tiltást igazságtalannak tartotta, vitatta a jogosságát, és a fiókját később visszaállították.
Ezután ismét a Solt használta tanítási adatok létrehozására, mire az OpenAI másodszor is felfüggesztette. A vállalat felhasználási feltételei tiltják, hogy a modelljeinek kimeneteit konkurens rendszerek fejlesztésére használják – PewDiePie szerint emiatt történt a második kitiltás. Augusztusban kutatók bebizonyították, hogy az OpenAI, az Anthropic és a Google modelljeinek titkosított következtetési blokkjai (azok a rejtett, belső gondolkodási lépések, amelyeket a modell a válasz megadása előtt generál, de a felhasználó elől elrejt) visszajátszhatók egy gyengébb, rokon modellnek. Ez a gyengébb modell aztán egyszerű, olvasható szövegként kiírja ezeket a titkos blokkokat. A kutatók összesen 315 320 ilyen blokkot fejtettek meg nyilvános kódtárakból.
Szeptember 30-án az OpenAI bejelentette, hogy meghiúsított egy kampányt, amelyet a kínai Moonshot AI (a Kimi nevű chatbotról ismert cég) köréhez kötődő személyek indítottak. A céljuk az volt, hogy kinyerjék a modellek rejtett gondolkodási folyamatait. Az OpenAI emellett megszüntetett egy olyan technikai lehetőséget is, amellyel valaki más felhasználó titkosított következtetési blokkjait visszajátszhatta és visszaolvashatta.
A cél egy cenzúrázatlan helyi modell létrehozása
Hogy az Ajax cenzúrázatlan legyen – vagyis olyan kérésekre is válaszoljon, amelyeket a ChatGPT-szerű asszisztensek elutasítanak –, PewDiePie a Heretic nevű nyílt forráskódú eszközt használta. Ez összehasonlítja, hogyan reagál a modell káros és ártalmatlan kérésekre, azonosítja a visszautasítások mögötti mintázatot, majd eltávolítja azt. Ezt a módszert ablációnak hívják. Lényegében kivágják a modellből azokat a részeket, amelyek miatt visszautasít bizonyos kéréseket. Így nem kell trükközni vagy speciális trükköket alkalmazni – a modell egyszerűen mindig válaszol, és nem mond nemet.
A beavatkozás nem sikerült tökéletesen. PewDiePie szerint az Ajax egy kis „agykárosodást” szenvedett, de a feladatait – például a beérkező levelek rendszerezését és a böngészést – körülbelül tízből kilenc alkalommal helyesen kezeli. A modellt továbbra is a GRPO módszerrel tanítja: a rendszer ugyanazt a feladatot 16-szor próbálja meg, majd a sikeres kísérletekből tanul. PewDiePie maga döntötte el, mely visszautasításokat távolítsák el, és a határt ott húzta meg, hogy a modell ne segítsen másoknak vagy önmagának kárt okozni. Ügyvédje azt tanácsolta, egyértelműen közölje: az Ajaxot nem veszélyes, végrehajtható utasítások megadására tervezték.
A kis modellek mellett szóló fő érve a költség és az energiafelhasználás. A YouTuber hozzávetőleges számítása szerint egy állítólagos, billió paraméteres csúcsmodell egyetlen példányának futtatásához körülbelül 27 darab, az övéhez hasonló számítógépre és nagyjából 150 háztartásnyi áramra lenne szükség. Már van több hasonló, már kész és népszerű helyi MI-modell is. A legismertebbek közé tartozik a Dolphin 3.0, ami könnyen futtatható akár átlagos gépen is, és szinte semmit nem utasít vissza. Emellett nagyon népszerűek a Qwen cenzúramentes verziók is – pont olyan alapból készültek, mint az Ajax –, valamint a Hermes modellek. Ezek mind letölthetők, otthoni számítógépen futnak, és már eléggé széles körben használják őket.
Az Ajaxot PewDiePie az első próbaverziónak nevezi. Még egyszer végig kell futtatnia az ablációs folyamatot, aztán kisebbé és gyorsabbá kell tennie a modellt, végül pedig alaposan le kell tesztelnie, hogy semmi nem romlott-e el közben.
Költs kriptóból közvetlenül a Kraken Krak Mastercarddal!
MI A TEENDŐD?- Regisztrálj a Krakenre a linkünkkel.
- Igényeld meg ingyenesen a Krak Cardot.
- Add hozzá Apple Payhez vagy Google Payhez.
- Vásárolj közvetlenül Kraken egyenlegedről akár 400+ kripto- és fiat eszközzel.
- Élvezd a 2% cashback-et a vásárlások után, havi vagy éves kártyadíj nélkül!
