2026. július 23., csütörtök · Modellek

Kínai nyílt AI-modellek kihívást jelentenek a Szilícium-völgy zárt fejlesztési megközelítésének

Több kínai AI-startup és technológiai óriáscég nyílt súlyú modelleket adott ki, amelyek a harmadik féltől származó teljesítménytesztek szerint megközelítik a legjobb nyugati modellek szintjét, különösen az ágens alapú kódolási feladatokban. A WIRED beszámolója szerint a Fehér Ház tudománypolitikai irodájának igazgatója, Michael Kratsios azt állította, hogy a Moonshot AI az Anthropic Fable modelljének desztillálásával fejlesztette saját K3 modelljét, amit amerikai technológia ellopásának minősített – a Moonshot AI a cikk megjelenéséig nem reagált. A kínai és az amerikai AI-szcéna közötti szakadék mélyül: míg Kínában a nyílt forráskódú megközelítés erősödik, addig az amerikai laborok – részben kormányzati nyomásra – egyre zártabbá válnak. Az Anthropic és az OpenAI is késleltette vagy korlátozta modelljeinek kiadását exportkorlátozások és fehér házi kérések nyomán.

Miért fontos?

A kínai nyílt modellek megkérdőjelezik az amerikai zárt fejlesztési dominanciát, miközben a két ország AI-stratégiája egyre jobban eltér egymástól.

Források

Említve a tudásbázisban

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. július 23., csütörtök napi AI összefoglaló része.

Kapcsolódó hírek

Tudósok értékelik a Kimi K3-at: fordulópontnak tartják a kínai AI-modellt

A Nature cikke szerint kutatók körében komoly visszhangot keltett a Moonshot AI múlt héten bemutatott Kimi K3 modellje. Joel Pearson, az UNSW Sydney kognitív idegtudósa szerint a modell "fordulópontot" jelent, egyesek pedig "Szputnyik-pillanatnak" nevezik. A cég saját tesztjei alapján a K3 kódolásban és táblázatkezelésben felveszi a versenyt amerikai riválisaival. A kereslet miatt a Moonshot AI három nappal a megjelenés után felfüggesztette az új regisztrációkat. Mehwish Nasim, a University of Western Australia AI-kutatója szerint a modell megjelenésének időzítése – az Anthropic Claude Fable 5 és az OpenAI GPT-5.6 debütálása után – azt jelzi, hogy Kína nemcsak élvonalbeli AI-rendszereket kíván építeni, hanem a nemzetközi AI-ökoszisztéma és szabályozás alakításában is részt akar venni.

Kínai startup kiadta a világ legnagyobb nyílt AI-modelljét, szűkítve a lemaradást az Egyesült Államokkal szemben

Egy kínai startup bemutatta a világ eddigi legnagyobb nyílt forráskódú mesterségesintelligencia-modelljét – a Reuters és a Gizmodo beszámolói szerint a modell egyes Anthropic- és OpenAI-modellekkel versenyképes teljesítményt nyújt. A bejelentés hatására az AI- és félvezetőipari részvények esésnek indultak a Bloomberg tudósítása alapján. A lépés illeszkedik Kína nyílt forráskódú AI-stratégiájába, amelyről a MIT Technology Review korábban részletesen írt. Emellett a South China Morning Post szerint a kínai Nvidia-alternatívák is egyre nagyobb teret nyernek, Hszi Csin-ping pedig a fejlődő országok felé pozicionálta Kínát mint AI-partnert a CNBC szerint. A fejlemények összességében arra utalnak, hogy a kínai–amerikai AI-szakadék szűkülhet.

DeepSeek kísérleti vizuális modellt adott ki ügynöki feladatokra

A kínai DeepSeek nyilvánosságra hozta a V4-Flash-Vision-Exp nevű kísérleti, multimodális modellt, amely a szöveges V4-Flash alapmodellt képfeldolgozási képességgel bővíti. A cég saját belső benchmarkjai szerint – ezt fontos hangsúlyozni, mivel független ellenőrzés nem történt – a vizuális változat ügynöki feladatokban közelít az Anthropic Opus 4.8 teljesítményéhez, miközben megőrzi az alapmodell szövegértési és világtudás-képességeit. A modell DeepSeek állítása szerint képeket ír le, szöveget nyer ki képernyőképekből, és diagramokat elemez, valamint kompatibilis az OpenAI és az Anthropic API-formátumaival. A vállalat egyúttal frissítette Harness nevű keretrendszerét is, amely a cikk szerint alapból támogatja az új modellt. A képfeldolgozás technikai részletei – például a fájlformátum-felismerés vagy a tokenköltség – szintén a DeepSeek saját dokumentációjából származó állítások.

Meta bemutatta a Muse Spark 1.2 multimodális képességeit

A Meta AI Research a nyílt súlyú kiadás előtt új értékelési eredményeket és demókat tett közzé a kódolásra fókuszáló Muse Spark 1.2 modellről, amelynek vizuális megértési és következtetési képességeit korábban már előzetesen bemutatták. A vállalat állítása szerint a modell képekből vagy videókból működő weboldalakat és játékokat tud generálni, ahol a helyesség mércéje az, hogy az eredmény megjelenik és a szándékolt módon viselkedik. Ezt egyelőre csak a Meta saját demonstrációi és értékelései támasztják alá, független megerősítés nincs. A cég szerint egy speciális modellváltozat robotvezérlőként működhet egy kétszintű rendszerben, ahol a magas szintű tervező részfeladatokra bontja a célt, ezeket pedig egy alacsony szintű Vision-Language-Action szabályzat hajtja végre.