A kínai DeepSeek AI laboratórium nyilvánosságra hozta a DeepSeek-R1 nevű „érvelési” modelljét, amely állításuk szerint bizonyos mesterségesintelligencia-mércék alapján jobban teljesít, mint az OpenAI o1 modellje.
Az R1 a Hugging Face AI-fejlesztői platformon érhető el MIT licenc alatt, ami azt jelenti, hogy kereskedelmi célokra is korlátozás nélkül felhasználható. A DeepSeek közlése szerint az R1 jobban teljesít az AIME, MATH-500 és SWE-bench Verified teszteken, mint az o1. Az AIME más modelleket használ egy adott modell teljesítményének értékelésére, a MATH-500 szöveges matematikai feladatokat tartalmaz, míg a SWE-bench Verified programozási problémák megoldására összpontosít.

Mivel az R1 egy érvelési modell, képes bizonyos fokig önmaga ellenőrzésére, így elkerülhet olyan hibákat, amelyek más modelleknél gyakoriak. Az érvelési modellek általában hosszabb idő alatt – másodpercek vagy akár percek alatt – jutnak el a megoldásokhoz a hagyományos modellekhez képest, de ennek előnye, hogy megbízhatóbbak például a fizika, a természettudományok és a matematika területén.
Erős és olcsó?
A DeepSeek egy technikai jelentésében felfedte, hogy az R1 modell 671 milliárd paramétert tartalmaz. A paraméterek a modell problémamegoldó képességét határozzák meg, és a nagyobb paraméterszámmal rendelkező modellek általában jobban teljesítenek, mint a kisebbek. A 671 milliárd paraméter óriási szám, de a DeepSeek emellett „desztillált” változatokat is kiadott az R1-ből, amelyek 1,5 milliárdtól 70 milliárd paraméterig terjednek. A legkisebb változat akár egy laptopon is futtatható. A teljes R1 azonban erősebb hardvert igényel, viszont a DeepSeek API-ján keresztül 90-95 százalékkal olcsóbban érhető el, mint az OpenAI o1 modellje.
Az R1-nek ugyanakkor van egy jelentős hátránya. Mivel egy kínai modellről van szó, alá van vetve Kína internetes szabályozó hatóságainak, amelyek biztosítják, hogy válaszai „megtestesítsék az alapvető szocialista értékeket.” Ennek eredményeként például nem ad választ a Tienanmen téri eseményekre vagy Tajvan autonómiájára vonatkozó kérdésekre. Számos más kínai MI-rendszer, beleértve más érvelési modelleket is, szintén megtagadja az olyan politikailag érzékeny témákra adott válaszokat, amelyek esetleg kiválthatnák az ország szabályozó hatóságainak rosszallását – például a Hszi Csin-ping rezsimjével kapcsolatos spekulációkat.
Trump támogatását várják az USA-ban
Az R1 megjelenése mindössze néhány nappal azután történt, hogy a leköszönő Biden-adminisztráció szigorúbb exportkorlátozásokat javasolt a kínai MI-technológiák számára. Kínai vállalatok eddig sem vásárolhattak fejlett MI-chipeket, de ha az új szabályok érvénybe lépnek, a félvezető-technológia és a kifinomult MI-rendszerek fejlesztéséhez szükséges modellek elérhetősége is tovább szigorodhat.
A múlt héten az OpenAI egy szakpolitikai dokumentumban sürgette az amerikai kormányt, hogy támogassa az Egyesült Államok MI-fejlesztését, nehogy a kínai modellek utolérjék vagy meghaladják őket képességek tekintetében. Az OpenAI szakpolitikai alelnöke, Chris Lehane az The Information című lapnak adott interjújában külön is kiemelte a DeepSeek anyavállalatát, a High Flyer Capital Managementet mint különösen aggályos szereplőt.
Eddig legalább három kínai laboratórium – a DeepSeek, az Alibaba és a Moonshot AI tulajdonában lévő Kimi – állította, hogy olyan modelleket készített, amelyek vetekednek az OpenAI o1 modelljével. Érdemes megjegyezni, hogy a DeepSeek volt az első, amely még november végén bejelentette az R1 előzetes verzióját.







