Sztori-szál · Üzlet · ellenőrizve 5 napja
A globális AI-chip verseny: Nvidia, gyártók és exportkorlátozások
A fejlett AI-chipek gyártása, elosztása és exportja körüli globális verseny, amely geopolitikai, gazdasági és technológiai tétekkel jár.
A mesterséges intelligencia fejlesztésének kulcsa ma a számítási kapacitás: a nagy nyelvi modellek betanításához és futtatásához szükséges speciális chipek gyártása és elosztása stratégiai jelentőségű iparággá vált. A szál középpontjában az Nvidia áll, amely jelenleg meghatározó szereplője a piacnak, de követi a versenytársak (AMD, Intel, valamint kínai és egyéb ázsiai gyártók) próbálkozásait is, hogy csökkentsék a függőséget egyetlen beszállítótól. Emellett kiemelt szerepet kap a gyártási lánc, elsősorban a tajvani TSMC, amelynek geopolitikai kitettsége önmagában is biztonsági kockázatot jelent.
A tét nem csupán üzleti: az Egyesült Államok és szövetségesei egyre szigorúbb exportkorlátozásokat vezetnek be a legfejlettebb chipek és gyártástechnológiák Kínába irányuló szállítására, félve attól, hogy ezek katonai vagy stratégiai célokra hasznosulnak. Kína válaszul saját chipipar kiépítésébe fektet, miközben megpróbálja megkerülni a korlátozásokat. Ez a dinamika alakítja, hogy mely országok és cégek férnek hozzá a legkorszerűbb AI-infrastruktúrához, ami közvetlenül befolyásolja a globális AI-fejlesztés ütemét és egyenlőtlenségeit.
Érdemes követni ezt a szálat, mert a chipgyártás és -export szabályozása közvetlenül meghatározza, mely szereplők tudnak versenyképes AI-modelleket építeni, és hogyan alakul át a technológiai hatalmi egyensúly az USA, Kína és a chipgyártó országok (elsősorban Tajvan és Dél-Korea) között.
Kapcsolódó szálak és fogalmak
- TSMC és tajvani chipgyártás
- USA-Kína technológiai verseny
- AI-infrastruktúra és adatközpontok
- CHIPS Act és iparpolitika
-
Nvidia piaci dominanciája
A szál fejleményei időrendben
-
2026. június 24., szerda Üzlet
400 millió dolláros gép formálja a chipgyártás jövőjét – és az Anthropic összeütközése a kormánnyal
Az MIT Technology Review napi hírlevelének mai száma két kiemelt témát tárgyal. Az egyik az ASML legújabb, rendkívül bonyolult és hatalmas méretű chipgyártó gépéről szól, amelynek ára eléri a 400 millió dollárt, és amely meghatározhatja a félvezetőipar jövőjét. A másik téma az Anthropic mesterségesintelligencia-vállalat és az amerikai kormány közötti nézeteltérésről számol be, amelynek részletei egyelőre korlátozottan ismertek a nyilvánosság számára.
-
2026. június 24., szerda Üzlet
Nvidia: az MI újraírja az orvosi munkát
A Nvidia egészségügyi részlegének vezetője, Kimberly Powell szerint a mesterséges intelligencia alapvetően átalakíthatja az orvosok mindennapi munkáját. Az MI képes csökkenteni az egészségügyi dolgozók adminisztratív terheit, ezzel több időt hagyva a betegellátásra. Powell kiemeli, hogy a technológia segíthet megoldani a képzett egészségügyi személyzet globális hiányát is. A Nvidia aktívan dolgozik olyan eszközökön, amelyek a klinikai folyamatokba integrálva javítják a hatékonyságot.
-
2026. június 25., csütörtök Üzlet
Az OpenAI és a Broadcom bemutatta a Jalapeño nevű egyedi AI-chipet
Az OpenAI együttműködve a Broadcommal kifejlesztette saját, egyedi tervezésű mesterséges intelligencia processzorát, amelynek neve Jalapeño. A chip kifejezetten az OpenAI nagy nyelvi modelljeinek (LLM) következtetési (inference) feladataira lett optimalizálva, célja a teljesítmény, a hatékonyság és a skálázhatóság javítása. A vállalat eddig elsősorban Nvidia GPU-kra támaszkodott, az új chip révén azonban csökkenthetné külső beszállítóktól való függőségét. A bejelentés a chipszektort egyébként is mozgásban lévő időszakban érkezett, amelyet a befektetői bizonytalanság és részvényárfolyam-ingadozások jellemeznek.
-
2026. június 25., csütörtök Szabályozás
AI-biztonsági aggodalmak: titkos rendszerek sérülékenységei és tiltott chipek feketepiaca
Az Anthropic Mythos nevű AI-modellje sebezhetőségeket talált az amerikai kormány titkosított rendszereiben, ami komoly biztonsági kérdéseket vet fel. Az Egyesült Államok nyomást gyakorol a Metára, hogy fogadja el az AI-rendszereinek független biztonsági felülvizsgálatát, miután aggodalmak merültek fel a technológia kockázataival kapcsolatban. Kínában az Nvidia tiltott AI-chipjeinek feketepiaci ára megduplázódott az exportkorlátozások következtében. A Wall Street eközben esett, miután a befektetők kételkedni kezdtek az AI-infrastruktúrára fordított hatalmas kiadások megtérülésében, különösen a félvezető szektorban.
-
2026. június 25., csütörtök Szabályozás
Megduplázódott a tiltott Nvidia-chipek feketepiaci ára Kínában
Az amerikai exportkorlátozások következtében a Kínában tiltott Nvidia mesterséges intelligencia processzorok feketepiaci ára megkétszereződött. Az Egyesült Államok szigorú intézkedései kockázatosabbá, nehezebbé és drágábbá tették az illegális chipbeszerzést. A fokozott ellenőrzés ellenére a tiltott chipek iránti kereslet Kínában továbbra is erős, mivel a fejlett AI-hardver hozzáférése stratégiai fontossággal bír. A magasabb ár és a nagyobb kockázat dacára a fekete piac aktív maradt, ami jelzi, hogy a korlátozások nem tudták teljesen elvágni a kínai szereplőket a fejlett AI-chiptől.
-
2026. június 26., péntek Üzlet
Chipverseny és tőzsdei nyomás: az OpenAI és riválisai új kihívásokkal szembesülnek
Az OpenAI a Broadcommal közösen bejelentett egy új, nagy nyelvi modellek következtetési feladataira optimalizált egyedi chipet, amellyel csökkenteni kívánják a növekvő számítási kapacitásigénytől való függőséget. Eközben az Anthropic és az OpenAI egyre erősebb versennyel néz szembe a nyílt forráskódú AI-modellek részéről, amelyek olcsóbb és szabadabban elérhető alternatívát kínálnak. A verseny kiéleződése különösen kritikus, mivel mindkét vállalat tőzsdei bevezetés előtt áll, és a befektetőknek be kell bizonyítaniuk üzleti modelljük fenntarthatóságát. A saját chip fejlesztése stratégiai lépés az OpenAI részéről, hogy csökkentse az Nvidia-függőséget és hosszú távon költségeit.
-
2026. június 26., péntek Üzlet
400 milliárd dolláros chippiaci rally a Micron és Qualcomm erős előrejelzései nyomán
A Micron és a Qualcomm várakozásokat felülmúló pénzügyi eredményei és előrejelzései globális chippiaci rallyt váltottak ki, amelynek értéke megközelíti a 400 milliárd dollárt. A Micron kiemelkedő negyedéves számai az AI-alapú memóriaigény robbanásszerű növekedését tükrözik. A befektetők reakciója világszerte érintette a félvezető-szektort, és újraélesztette az AI-vezérelt technológiai részvények iránti lelkesedést. Az eredmények megerősítik, hogy az AI infrastruktúra iránti kereslet továbbra is rendkívül erős marad.
-
2026. június 27., szombat Üzlet
OpenAI saját chipet mutat be, az Alibaba pedig az Anthropic adatait lopta el – az AI-verseny új szintre lép
Az OpenAI bemutatta saját mesterséges intelligencia chipjét, amellyel csökkenteni kívánja függőségét az Nvidia-tól és erősíteni piaci pozícióját. Ezzel párhuzamosan kiderült, hogy az Alibaba kínai AI-modelljét részben az Anthropic Claude válaszainak engedély nélküli felhasználásával tanították be, ami komoly etikai és jogi kérdéseket vet fel. Az AI-láz a technológiai eszközök árait is felfelé hajtja globálisan, miközben az Apple is átírta chipfejlesztési ütemtervét: az M6 Pro és M6 Max sorozatot lemondták, hogy az AI-ra optimalizált M7 generációra összpontosíthassanak. Egy friss tanulmány szerint az AI negatívan befolyásolja a videojátékok eladásait is, jelezve, hogy a technológia hatása már a szórakoztatóiparra is kiterjed.
-
2026. június 27., szombat Üzlet
Az Nvidia uralmának vége felé? Az AI-óriások saját chipeket fejlesztenek
Az Nvidia évek óta dominálja az AI-chipek piacát, de ez az egyeduralom most megrendülni látszik. Az OpenAI bejelentette saját egyedi következtetési chipjét, a Jalapeñót, amelyet a Broadcommal közösen fejleszt. Az OpenAI mellett a Google, az Apple és a SpaceX is saját chipek gyártásába fogott, jelezve, hogy a nagyvállalatok csökkenteni kívánják az Nvidia-függőségüket. Ez a tendencia alapjaiban alakíthatja át az AI-hardverpiac erőviszonyait.
-
2026. június 27., szombat Üzlet
Az OpenAI bemutatja a Jalapeño AI-chipet – Broadcommal közösen épít Nvidia-alternatívát
Az OpenAI bejelentette saját fejlesztésű AI inferencia chipjét, amelyet Jalapeñónak neveztek el, és a Broadcommal közösen gyártanak. A lépéssel az OpenAI csatlakozik a Google, az Apple és a SpaceX sorához, amelyek szintén saját egyedi chipeket fejlesztenek. Az Nvidia évek óta dominálja az AI chipek piacát, ám egyre több nagyvállalat dönt az önálló chipfejlesztés mellett, hogy csökkentse az Nvidiától való függőséget.
-
2026. június 27., szombat Üzlet
Kínai AI- és chipvállalatok hajtják a belföldi tőzsdei bevezetések visszatérését
Kínában az AI- és félvezető-iparági cégek egyre nagyobb szerepet játszanak a hazai tőzsdei bevezetések (IPO) fellendülésében. A szektor növekvő befektetői érdeklődést vonz, miközben Kína igyekszik erősíteni technológiai önállóságát. Az onshore IPO-piac élénkülése részben az állami támogatásoknak és a technológiai szektorba irányuló tőkebefektetések növekedésének köszönhető. A Reuters szerint ez a tendencia a kínai tech-ipar strukturális átrendeződésére utal.
-
2026. június 29., hétfő Üzlet
A Micron piaci értéke megközelítette a Metáét és a Tesláét az AI-vezérelt memóriachip-kereslet miatt
A Micron részvényárfolyama egy hónap alatt több mint 236%-ot emelkedett, pénteken 1,27 billió dolláros piaci kapitalizációval zárt – megközelítve a Meta (1,39 billió) és a Tesla (1,42 billió) értékelését. A TechCrunch beszámolója szerint a felfutás mögött az AI-adatközpontok építési hulláma áll, amely súlyos hiányt okozott a DRAM-, NAND- és különösen a nagy sávszélességű memóriachipekből (HBM). Az Nvidia és a nagy felhőszolgáltatók – Microsoft, Amazon AWS, Google, Meta, Oracle – hatalmas mennyiségben vásárolják a memóriát, ami a RAMageddon.
-
2026. június 29., hétfő Üzlet
Ausztrál nyugdíjalapok: a megtakarítások akár 12%-a AI- és tech-részvényekben van
Az ausztrál szuperannuációs alapok portfólióinak becslések szerint átlagosan 12%-a mesterséges intelligenciához kötődő vállalatokba – köztük az Nvidia, Apple, Microsoft, Alphabet, Amazon, Meta és Tesla részvényeibe – van fektetve, mivel a globális indexek erősen az amerikai tech-szektor felé tolódtak. Az Asfa szerint sok alap a SpaceX-ben is érdekelt, amely június 12-én a világ eddigi legnagyobb tőzsdei bevezetésével debütált. A Morningstar szakértője szerint a SpaceX közvetlen hatása az ausztrál portfóliókra szerény: az átlagos kitettség tagonként mintegy 50 ausztrál dollár. A tech-túlsúly ugyanakkor etikai és kockázati kérdéseket is felvet.
-
2026. június 30., kedd Modellek
A kínai Zhipu AI azt állítja, hogy nyílt súlyú GLM-5.2 modellje egyes kiberbiztonsági feladatokban felveszi a versenyt a Mythosszal
A kínai Zhipu AI (Z.ai) kiadta nyílt súlyú GLM-5.2 modelljét, amelyről egyes kutatók a The Verge beszámolója szerint azt állítják, hogy bizonyos sebezhetőség-keresési és kiberbiztonsági forgatókönyvekben az Anthropic Mythos modelljéhez hasonló teljesítményt nyújt. A forrás hangsúlyozza, hogy általánosabb feladatokban a GLM továbbra is elmarad az Anthropic és az OpenAI modelljeitől, ugyanakkor a kínai modellek képességbeli lemaradása jelentősen csökkent. Az amerikai kormányzat a fejlett, sebezhetőségeket felismerni képes MI-modelleket nemzetbiztonsági kockázatnak tekinti, és korlátozni igyekszik Kína hozzáférését az ilyen technológiákhoz és a betanításukhoz szükséges hardverekhez. Mivel a GLM nyílt súlyú, bárki letöltheti és futtathatja, ami rugalmasságot ad, de egyben visszaélési kockázatot is jelent, mivel a felügyelet nehezen biztosítható.
-
2026. június 30., kedd Kutatás
A Flexion Robotics humanoid robotja önállóan navigál irodai környezetben, szimulációban tanult készségek kombinálásával
A svájci Flexion Robotics – amelyet volt Nvidia-robotikai kutatók alapítottak – egy módosított Unitree humanoid robotot mutatott be, amely szöveges utasítás alapján önállóan hajt végre összetett irodai feladatokat: lépcsőzik, lifttel közlekedik, ajtót nyit, csomagot bont és polcra pakol. A cég állítása szerint a rendszer lényege, hogy az egyes készségeket (járás, egyensúlyozás, tárgyak kezelése) szimulációban tanítják be megerősítéses tanulással, majd egy fő AI-modell – amely emberekről készült videókból tanulja meg a cselekvések sorrendjét – valós időben kombinálja ezeket. A megközelítés a Flexion szerint hatékonyabb a szokásos teleoperált betanításnál, mert kevesebb emberi beavatkozást igényel, és ismeretlen környezetben is működik. A bemutató egyetlen videón alapul, így a rendszer megbízhatóságáról és általánosíthatóságáról egyelőre nem áll rendelkezésre független értékelés.
-
2026. július 1., szerda Üzlet
Zürich a világ egyik legsűrűbb AI-kutatási központjává vált – a Silicon Valley kihívója
A MIT Technology Review beszámolója szerint Zürich és a Nagy-Zürichi Régió az elmúlt két évtizedben a világ egyik legkoncentráltabb technológiai K+F központjává nőtte ki magát: az Apple, Anthropic, Google, Meta, Microsoft, NVIDIA és OpenAI egyaránt működtet ott kutatóbázist. A cikk szerint Svájc több mint tíz éve vezeti a Globális Innovációs Indexet, a világ élén áll az egy főre jutó szabadalmak terén, és GDP-je 3,3%-át fordítja K+F-re. A kockázati tőke több mint 60%-a deep tech területre irányul, ami globálisan a legmagasabb arány. A google.org idén egymillió dolláros támogatást ígért a Svájci Nemzeti AI Intézetnek. A cikk ugyanakkor megjegyzi, hogy a tehetségbázis kis méretű, és a csapatok gyors bővítése nehezebb, mint más európai központokban.
-
2026. július 2., csütörtök Kutatás
Megerősítéses tanulás az AI-ágensek finomhangolásában: NVIDIA útmutató és új kutatási keretrendszerek
Az NVIDIA technikai blogján részletes útmutatót tett közzé arról, hogyan alkalmazható a megerősítéses tanulás (RL) – különösen a verifikálható jutalmakkal történő RL (RLVR) és a GRPO módszer – vállalati AI-ágensek domain-specifikus finomhangolására. A cég szerint a Nemotron 3 Super modellt 21 verifikáló környezetben, mintegy 1,2 millió rollout segítségével képezték, a NeMo RL ökoszisztéma pedig nyílt modellekhez kínál skálázható RL-eszközöket. Emellett két nem lektorált kutatási munka is megjelent: a HyPOLE keretrendszer formális logikával (HyperLTL) vezérli a többágenses RL-t részleges megfigyelhetőség mellett, míg egy másik tanulmány elektromos járművek flottáinak intelligens töltését vizsgálja független többágenses RL-megközelítésekkel. Mindhárom forrás azt jelzi, hogy az RL túllépett az általános modellképzésen, és egyre inkább gyakorlati, specializált feladatokban alkalmazzák.
-
2026. július 4., szombat Eszközök
Az NVIDIA bizalmas számítástechnikája a Blackwell GPU-kon 98%-os teljesítményt nyújt hardveres AI-biztonság mellett
Az NVIDIA műszaki blogján közzétett benchmarkok szerint a Blackwell GPU-kra épülő Confidential Computing (CC) technológia minimális teljesítményveszteséggel biztosít hardverszintű védelmet az AI-inferencia során. A vállalat állítása alapján a HGX B300-on futtatott Qwen 3.5-397B modellel végzett tesztek azt mutatták, hogy a CC bekapcsolása jellemzően 8% alatti áteresztőképesség- és késleltetés-többletet okoz, vagyis a teljesítmény eléri a védelem nélküli megoldás 98%-át. A biztonság alapja a gyártáskor a chipbe égetett privát aláírókulcs, az NVLink titkosítás és a távoli hitelesítés (NRAS). Az NVIDIA kiemeli, hogy optimalizálásokkal – CC-safe autotuning, aszinkron D2H másolás, CUDA-gráf támogatás – sikerült a biztonságos munkabeadás és a titkosított sávszélesség korlátait kompenzálni, így a rendszer termelési szintű, szabályozásnak megfelelő telepítésekre is alkalmas.
-
2026. július 5., vasárnap Üzlet
Az OpenAI láthatóan meg sem látogatta a brit Stargate UK projekt kulcshelyszínét
A Guardian oknyomozása szerint az OpenAI nem látogatta meg a Stargate UK projekt egyik kiemelt helyszínét, a North Tyneside-i Cobalt Parkot, és a brit kormány által beharangozott 30 milliárd fontos beruházási ígéretből mintegy 20 milliárd font pusztán hipotetikus volt. Közérdekű adatigénylés alapján sem az OpenAI, sem partnere, az Nscale nem egyeztetett az érintett helyi hatóságokkal; egyedül az Nvidia tett látogatást 2026 februárjában. A lap forrásai szerint a kormány Trump londoni látogatása előtt sürgősen keresett nagyszabású bejelentést, és az Nscale-t gyakorlatilag utasították a projekt támogatására. Az OpenAI áprilisban szabályozási aggályokra és magas energiaköltségekre hivatkozva felfüggesztette a terveket. A feltárt részletek alapján a Stargate UK az egyik legjelentősebb brit AI-fejlesztési bejelentés helyett inkább sajtóközleménynek tűnik.
-
2026. július 8., szerda Kutatás
Az NVIDIA nemegyenletes tenzorpárhuzamossága csökkenti a GPU-kiesések hatását az LLM-tréningben
Az NVIDIA műszaki blogján bemutatott Nonuniform Tensor Parallelism (NTP) keretrendszer lehetővé teszi, hogy nagy léptékű LLM-tréningek dinamikusan alkalmazkodjanak az átmenetileg elérhetetlenné váló GPU-khoz. Az NVIDIA állítása szerint az NTP az aktív GPU-k órajelének ideiglenes növelésével (dinamikus teljesítménynöveléssel) kompenzálja a kiesést, miközben a tenzor-újrafelosztás okozta többletterhelés 1% alatt marad. A módszer a Blackwell és Blackwell Ultra rendszerek NVLink összeköttetésein akár 72 GPU-s tartományokra is skálázható. Az NTP kísérleti jellegű megközelítés, amely a meglévő rugalmas skálázási technikákat – mint az adatreplikák eldobása vagy gyors ellenőrzőpont-újraindítás – egészíti ki azzal, hogy az áteresztőképesség-veszteséget minimalizálja a csökkentett rendelkezésre állás időszakában.
-
2026. július 8., szerda Eszközök
Az NVIDIA bemutatta a Vera CPU-t, amely 1,8-szoros teljesítménynövekedést ígér az ágens AI munkaterhelésekhez
Az NVIDIA saját közleménye szerint a Vera CPU architektúra 1,8-szoros fenntartott magteljesítményt nyújt teljes foglalatterhelés mellett a hagyományos x86-os adatközponti processzorokhoz képest. A monolitikus chipkialakítás 88 Olympus magot, egységes gyorsítótárat és Scalable Coherency Fabric technológiát tartalmaz, amellyel az NVIDIA állítása szerint 40%-kal alacsonyabb késleltetést és háromszoros magonkénti memória-sávszélességet érnek el a korábbi CPU-k felénél kisebb energiafogyasztás mellett. A cég kiemeli, hogy a Vera CPU csökkenti a GPU-k várakozási idejét az ágens AI rendszerek többlépéses munkafolyamataiban – sandbox-futtatások, eszközhívások, KV-cache koordináció terén –, ezáltal javítva a megerősítéses tanulás áteresztőképességét és a rendszerszintű hatékonyságot.
-
2026. július 9., csütörtök Üzlet
A SambaNova 1 milliárd dolláros tőkét vont be 11 milliárd dolláros értékeléssel
A SambaNova Systems AI-chipgyártó startup 1 milliárd dolláros befektetést zárt le Series F körében, 11 milliárd dolláros vállalati értékelés mellett, a General Atlantic vezetésével – közölte a TechCrunch. A kör még nem zárult le teljesen: a cég vezérigazgatója, Rodrigo Liang szerint heteken belül további befektetők csatlakoznak. Az új forduló mindössze öt hónappal a 350 millió dolláros Series E után érkezett. A vállalat az Intel-lel többéves partnerséget épít az AI-inferencia területén, és bejelentette, hogy a JPMorganChase inferencia-infrastruktúra-partnernek választotta a SambaNovát, SN40L és SN50 rendszereivel. Liang szerint az akvizíció lehetősége nyitott, de a növekedés inkább a tőzsdei bevezetés irányába terelheti a céget.
-
2026. július 9., csütörtök Üzlet
A Prime Intellect 130 millió dolláros A sorozatú befektetést kapott, egymilliárd dolláros értékeléssel
A Prime Intellect startup 130 millió dolláros Series A finanszírozási kört zárt le egymilliárd dolláros vállalatértékelés mellett. A kört a Radical Ventures vezette, és többek között az Nvidia Ventures, az Intel Capital és a Dell Technologies Capital is részt vett benne. A 2024-ben alapított vállalat célja, hogy a szervezetek a nagy AI-laboroktól függetlenül fejleszthessenek saját AI-ágenseket, ehhez számítási kapacitást, megerősítéses tanulási keretrendszert és kiértékelő eszközöket kínál egyetlen platformon. A TechCrunch beszámolója szerint a cég ügyfelei között szerepel a Ramp, a Zapier és más vállalatok, éves bevételi üteme pedig elérte a 100 millió dollárt – utóbbi adat a cég saját közlésén alapul.
-
2026. július 10., péntek Eszközök
NVIDIA Nemotron 3 Ultra teljesítménye javítható LangChain harness profilok segítségével, finomhangolás nélkül
Az NVIDIA technikai blogja bemutatja, hogyan lehet a Nemotron 3 Ultra nyílt forráskódú modell ágensalapú rendszerekben elért pontosságát a LangChain Deep Agents harness profilok testre szabásával növelni, anélkül hogy finomhangolásra lenne szükség. A módszer lényege egy iteratív fejlesztési ciklus: kiértékelés futtatása, hibaelemzés, harness profil módosítások (például promptváltoztatások, middleware beillesztése), javítás ellenőrzése, majd újrafuttatás. Az NVIDIA szerint ez lehetővé teszi, hogy a modell megközelítse a zárt, drágább frontier modellek pontosságát. Az automatizálást az úgynevezett agentic proposer.
-
2026. július 11., szombat Eszközök
NVIDIA NeMo pipeline fél millió szintetikus pénzügyi hírfőcímet generált iteratív deduplikációval
Az NVIDIA technikai blogján bemutatott pipeline a NeMo Data Designer, NeMo Curator és Nemotron-3-Nano-30B-A3B modellek kombinálásával 82 iterációban 502 536 egyedi pénzügyi hírfőcímet állított elő 13 kategóriában egyetlen 8×B200 GPU-csomóponton. A munkafolyamat kulcsa a globális szemantikus deduplikáció (90%-os koszinusz-hasonlósági küszöb, 500 K-means klaszter), a centroidtól legtávolabbi példák kiválasztásán alapuló few-shot stratégia és a dinamikus kategória-eloszlás korrekció, amelyek együttesen ~82%-os kumulatív deduplikációs arányt értek el. Az NVIDIA szerint a keletkező FinHeadlineMix adatkészlet ritka pénzügyi események lefedésére is alkalmas, és kompakt tanulómodellek desztillációját, valamint klasszifikációját támogatja, amelyek megközelíthetik a tanármodell F1-teljesítményét pénzügyi NLP-benchmarkokon.
-
2026. július 11., szombat Kutatás
NVIDIA: JAX host offloading akár 57%-kal javítja a nagy nyelvi modellek tanítási átvitelét Blackwell GPU-kon
Az NVIDIA technikai blogja szerint a JAX keretrendszerben alkalmazott host offloading technika jelentősen csökkenti a GPU HBM-szűk keresztmetszetét LLM-tanítás során: a forward pass közben kiválasztott aktivációkat hoszt memóriába mozgatja, majd a backward passnál visszatölti. Az NVIDIA GB200 NVL72 rendszeren végzett MaxText kísérletekben a DeepSeek-V3 671B és Llama 3.1 405B modellekkel az aktiváció-újraszámításhoz képest akár 57%-os átviteli javulást mértek, különösen ritka MoE modellek esetén. A megoldás a Grace Blackwell NVLink-C2C 900 GB/s kétirányú sávszélességére épít, és az optimális eredményhez XLA ütemezési beállítások és Nsight Systems profilozás szükséges.
-
2026. július 13., hétfő Kutatás
NVIDIA RoboLab: új értékelési platform az általános célú robotirányítási modellek tesztelésére
Az NVIDIA Research bemutatta a RoboLab nevű platformot, amely a robotikában használt általános célú irányítási modellek (policy-k) szisztematikus értékelésére szolgál szimulált környezetben. A rendszer az NVIDIA szerint megoldja a korábbi benchmarkok fő problémáit: a vizuális és feladatbeli átfedést a tréning- és tesztadatok között, a benchmarkok telítődését, valamint a magas beállítási költséget, miközben robotfüggetlen, gyorsan skálázható feladat- és jelenetgenerálást kínál. A platform részletes diagnosztikai eszközöket integrál, köztük részleges pontszámítást, SPARC-alapú mozgásminőség-elemzést és hibaeseménynaplózást. Az NVIDIA tervei szerint a RoboLab funkcionalitása 2026 augusztusától beépül az NVIDIA Isaac Lab-Arena rendszerébe.
-
2026. július 15., szerda Eszközök
Az NVIDIA Cosmos 3 modell egyetlen nap alatt 93%-os pontosságra finomhangolható automatizált ágensalapú munkafolyamattal
Az NVIDIA technikai blogján bemutatott munkafolyamat szerint a Cosmos 3 Nano alapmodellt az NVIDIA TAO ágensképességeivel és LoRA-adaptációval kombinálva a videókérdés-válaszolási pontosság 54,41%-ról 93,35%-ra emelkedett a Woven Traffic Safety adathalmazon, kevesebb mint egy nap alatt, minimális manuális beavatkozással. Az NVIDIA állítása szerint a TAO ágensképességek automatizálják az adatkezelést, a kiindulási értékelést, a LoRA-konfigurálást és a hiperparaméter-optimalizálást, ami jelentősen csökkenti a mérnöki ráfordítást. A Cosmos 3 mixture-of-transformers architektúrája egyesíti a többféle modalitás – szöveg, kép, videó, hang – feldolgozását. Az éles üzembe helyezést a Cosmos 3 Reasoner NIM mikroszolgáltatás egyszerűsíti, amely OpenAI-kompatibilis végpontként szolgálja ki a finomhangolt LoRA-adaptereket, kiküszöbölve a hagyományos infrastrukturális komplexitást.
-
2026. július 15., szerda Kutatás
Ötezer Kaggle-versenyző tanulságai az AI-következtetés javításáról az NVIDIA Nemotron kihívásban
Az NVIDIA Nemotron Model Reasoning Challenge keretében több mint 5000 résztvevő dolgozott azon, hogyan javítható egy nyílt modell következtetési pontossága azonos infrastruktúra és korlátok mellett. Az NVIDIA technikai blogja szerint a legsikeresebb megoldások a következtetési lépések ellenőrzésére, a gondolati láncok tömörítésére a tokenkorláthoz, valamint célzott megoldók építésére összpontosítottak a legnehezebb feladattípusokhoz. A versenyzők LoRA-adaptereket tanítottak a Nemotron-3-Nano-30B modellhez, szintetikus gondolati lánc adatkészleteket építettek, és több mint ezer közösségi fórumbejegyzésben osztották meg tapasztalataikat. A szervezők kiemelik, hogy a közösségi tudásmegosztás és a teljes munkafolyamat-szemléletű mérnöki megközelítés bizonyult fontosabbnak, mint pusztán a végső válaszok finomhangolása.
-
2026. július 16., csütörtök Szabályozás
Kínában életbe léptek az MI-avatarok fejlesztését és használatát szabályozó új rendelkezések
Kínában ma léptek hatályba a kibertér-szabályozó hatóság (Cyberspace Administration of China) által kiadott új előírások, amelyek a virtuális digitális avatarok fejlesztésére és alkalmazására vonatkoznak. A Nature beszámolója szerint az országban több mint 1,3 millió vállalat kínál digitális avatar-szolgáltatásokat egy 2024-es kormányzati jelentés alapján, és az MI-avatarok az egészségügytől az oktatáson át a társas társaságig terjedő területeken jelennek meg. A guangzhoui Hongkongi Tudományos és Technológiai Egyetemen például Einstein és John Nash kinézetű és hangú avatarok tartanak előadásokat, amelyek a diákok kérdéseire is válaszolnak. A Tsinghua Egyetem kutatója, Jang Liu szerint a digitális avatarok mélyrehatóan átalakíthatják a mindennapi életet, ugyanakkor az etikai standardok kidolgozására is ugyanannyi figyelmet kell fordítani.
-
2026. július 17., péntek Eszközök
A BlueField-4 DPU infrastruktúra-tehermentesítéssel skálázza az ágens AI-gyárakat
Az NVIDIA műszaki blogja részletezi, hogyan oldja meg a BlueField-4 DPU és a Vera BlueField-4 STX tárolóprocesszor az ágens AI munkafolyamatok infrastrukturális szűk keresztmetszeteit. A korábban bemutatott Vera CPU architektúrára épülő BlueField-4 akár 800 Gb/s hálózati kapcsolatot, 64 magos Grace CPU-t, PCIe Gen6-ot és LPDDR5X memóriát integrál, a hálózati, tárolási és biztonsági feladatokat a gazdagép processzoráról átterhelve. A DOCA szoftverplatform kontextus-újrafelhasználást, zero-trust biztonságot és többbérlős életciklus-kezelést biztosít. Az NVIDIA állítása szerint mindez magasabb GPU-kihasználtságot, kiszámíthatóbb késleltetést és alacsonyabb tokenenkénti költséget eredményez.
-
2026. július 18., szombat Modellek
Kínai startup kiadta a világ legnagyobb nyílt AI-modelljét, szűkítve a lemaradást az Egyesült Államokkal szemben
Egy kínai startup bemutatta a világ eddigi legnagyobb nyílt forráskódú mesterségesintelligencia-modelljét – a Reuters és a Gizmodo beszámolói szerint a modell egyes Anthropic- és OpenAI-modellekkel versenyképes teljesítményt nyújt. A bejelentés hatására az AI- és félvezetőipari részvények esésnek indultak a Bloomberg tudósítása alapján. A lépés illeszkedik Kína nyílt forráskódú AI-stratégiájába, amelyről a MIT Technology Review korábban részletesen írt. Emellett a South China Morning Post szerint a kínai Nvidia-alternatívák is egyre nagyobb teret nyernek, Hszi Csin-ping pedig a fejlődő országok felé pozicionálta Kínát mint AI-partnert a CNBC szerint. A fejlemények összességében arra utalnak, hogy a kínai–amerikai AI-szakadék szűkülhet.
-
2026. július 21., kedd Üzlet
A Microsoft kiterjeszti AMD-partnerségét, az Nvidia chipmonopóliuma gyengül az AI-piacon
A Microsoft hivatalosan bejelentette, hogy az Azure felhőinfrastruktúráját az AMD legújabb Helios AI-platformjával és következő generációs EPYC processzoraival bővíti. Az együttműködés keretében három új virtuálisgép-típus érkezik: HDv2 adatfeldolgozásra, HXv2 elektronikai tervezésautomatizálásra és ND MI455X v7 AI-következtetési feladatokra. A The Decoder szerint az AMD egy másik nagy ügyfelet is megszerezhet: egy nyilvános GitHub-profil arra utal, hogy az Anthropic teszteli az AMD hardverét, de ez egyelőre nem megerősített. Satya Nadella szerint az ügyfeleknek több választási lehetőségre van szükségük az AI-infrastruktúrában, míg Lisa Su mérföldkőnek nevezte a partnerséget. Az Nvidia továbbra is erős árképzési pozícióban van, de az AMD és más egyedi chipgyártók egyre komolyabb versenyt támasztanak.
-
2026. július 21., kedd Üzlet
Jeff Bezos és a brit kormány 450 millió dollárt fektet a mesterséges anyagkutatással foglalkozó CuspAI startupba
A cambridge-i székhelyű CuspAI 450 millió dolláros B sorozatú tőkebevonást zárt le, amelyben többek között Jeff Bezos és a brit kormány szuverén AI-alapja is részt vett – a The Guardian beszámolója szerint a kétéves vállalat értékeltségét ezzel 2,6 milliárd dollárra taksálják. A cég az AI Materials Foundry nevű koalíciót indította el, amelyhez saját állítása szerint több mint 48 technológiai és ipari szereplő – köztük az Nvidia, a Meta és a Hyundai – csatlakozott. A CuspAI célja, hogy mesterséges intelligenciára épülő szoftverrel gyorsítsa új anyagok felfedezését, különösen a chipgyártásban használt ritka fémek kiváltására. Az alapítók szerint a következő évtizedek ipari haladását az eddig ismeretlen anyagok hiánya korlátozhatja, és ezt a problémát kívánják megoldani. A bevont tőkét nemzetközi terjeszkedésre, többek között szingapúri iroda nyitására és létszámbővítésre fordítják.
-
2026. július 21., kedd Eszközök
Az NVIDIA bemutatta a hatodik generációs NVLink hálózati technológiát az AI-gyárak számára
Az NVIDIA technikai blogján ismertette a hatodik generációs NVLink skálázási hálózatot, amelyet kifejezetten AI-gyárak számára terveztek. A vállalat szerint a technológia GPU-nként akár 3,6 TB/s sávszélességet, rack-szinten 260 TB/s összesített sávszélességet és 130 TFLOPS hálózaton belüli számítási kapacitást biztosít, jelentősen felülmúlva a hagyományos Ethernet-megoldásokat nagy méretű nyelvi modellek és MoE-architektúrák esetén. Az NVIDIA állítása alapján a Hopper-ről Blackwell-generációra való áttérés ötvenszeres javulást hozott a tokenek per watt mutatóban. A platform szoftveres integráció (Dynamo, TensorRT-LLM, NCCL, NIXL) mellett üzembiztonsági funkciókat is kínál, mint a menet közbeni frissítés, dinamikus útválasztás és melegtárolócserélhető kapcsolók. A jövőbeli bővíthetőséget az NVLink Fusion és az NVLink-C2C technológiák szolgálják.
-
2026. július 21., kedd Eszközök
Az NVIDIA Omniverse ovrtx szenzorszimuláció mostantól modulárisan integrálható meglévő alkalmazásokba
Az NVIDIA bejelentette, hogy az Omniverse könyvtárak – amelyek immár az NVIDIA Agent Toolkit részét képezik – moduláris API-kat kínálnak meglévő alkalmazások bővítéséhez. Az ovrtx nevű, előzetes kiadásként GitHubon elérhető könnyűsúlyú C/Python SDK kamera-, lidar- és radarszenzor-szimulációt valósít meg RTX technológiával, OpenUSD-jelenetekből valós idejű, fizikailag megalapozott kimeneteket állítva elő. A cég szerint a rendszer integrálható CAD-, Blender-, robotikai és felhőalapú tervezési munkafolyamatokba, például a PTC Onshape Render Studióba. Az ovrtx az Omniverse többi könyvtárával – fizikai szimuláció (ovphysx), streamelés (ovstream), adatkezelés (ovstorage) és megosztott USD-jelenetkezelés (ovstage) – együttműködve többmodális szimulációs csővezetékeket támogat szintetikus adatgyártáshoz, digitális ikrekhez és fizikai AI-validációhoz.
-
2026. július 21., kedd Eszközök
Az Amazon Quick és az NVIDIA NeMo Agent Toolkit együttműködése ellátásilánc-kezelő ügynökfolyamatokat kínál
Az AWS hivatalos blogján bemutatott megoldás az Amazon Quick és az NVIDIA NeMo Agent Toolkit összekapcsolásával specializált, ügynökalapú munkafolyamatokat épít ellátásilánc-kockázatok kezelésére. Az Amazon Quick egységes, beszélgetésalapú felületet biztosít strukturált és strukturálatlan vállalati adatokhoz, több mint száz előre elkészített csatlakozóval és MCP-protokollon keresztül elérhető ügynökfolyamatokkal. Az NVIDIA NeMo Agent Toolkit nyílt forráskódú, keretrendszer-független könyvtárként működik, amely LangChain, LlamaIndex, CrewAI és más eszközökkel is kompatibilis. A bemutatott példában egy ellátásilánc-elemző az irányítópult kontextusából kiindulva, a csevegőügynökön keresztül automatikusan vizsgálja a zavarokat, hívja meg az eszközöket, validálja a javaslatot, és rangsorolt kockázatcsökkentési tervet ad vissza a tervezőnek.
-
2026. július 22., szerda Üzlet
Az Egyesült Államoknak nem kellene meglepődnie a kínai MI-modellek térnyerésén
A The Verge elemzése szerint az elmúlt héten két kínai mesterségesintelligencia-cég mutatott be olyan modelleket, amelyek állításuk szerint felveszik a versenyt az OpenAI és az Anthropic legjobb rendszereivel. A piacok megingtak, és számos kommentátor az amerikai technológiai szektor megrázkódtatásáról beszélt: az AP meglepetésként értékelte az eseményt, a Bloomberg áttörésként jellemezte. A cikk szerint azonban a meglepetés indokolatlan, mert a kínai modellek teljesítménybeli hátránya évek óta folyamatosan csökken – az OpenRouter rangsorában a tíz legtöbbet használt MI-eszközből hat kínai. A kínai modellek emellett jóval olcsóbbak, és egyes jelentések szerint amerikai cégek is egyre inkább ezekhez fordulnak a hazai szolgáltatók emelkedő árai miatt.
-
2026. július 22., szerda Eszközök
Az NVIDIA GB300 NVL72 világrekordot állított a DeepSeek-V3 671B MoE-modell előtanításában
Az NVIDIA saját technikai blogján jelentette be, hogy a GB300 NVL72 rendszer GPU-nként 1 648 TFLOPS teljesítménnyel világrekordot ért el a DeepSeek-V3 671B paraméteres Mixture of Experts (MoE) modell előtanításában. A vállalat szerint a teljesítmény kulcsa a teljes rack-szintű együttervezés: az ötödik generációs NVLink GPU-nként 1,8 TB/s sávszélességet és összesen 130 TB/s nem blokkoló all-to-all kommunikációt biztosít. Az NVIDIA állítása alapján szoftveres optimalizálásokkal – a Megatron Core, a TorchTitan és a JAX keretrendszerek révén – 3–10-szeres teljesítménynövekedést értek el az előző generációhoz képest, miközben a GPU-nkénti áteresztőképesség 256-ról 1 024 GPU-ra skálázva is 97% felett maradt. A MoE-architektúrák hatékonyságának lényege, hogy a tokenek csak a paraméterek kis részhalmazát aktiválják, ami viszont fokozott kommunikációs igényt támaszt a GPU-k között.
-
2026. július 22., szerda Modellek
Tudósok értékelik a Kimi K3-at: fordulópontnak tartják a kínai AI-modellt
A Nature cikke szerint kutatók körében komoly visszhangot keltett a Moonshot AI múlt héten bemutatott Kimi K3 modellje. Joel Pearson, az UNSW Sydney kognitív idegtudósa szerint a modell "fordulópontot" jelent, egyesek pedig "Szputnyik-pillanatnak" nevezik. A cég saját tesztjei alapján a K3 kódolásban és táblázatkezelésben felveszi a versenyt amerikai riválisaival. A kereslet miatt a Moonshot AI három nappal a megjelenés után felfüggesztette az új regisztrációkat. Mehwish Nasim, a University of Western Australia AI-kutatója szerint a modell megjelenésének időzítése – az Anthropic Claude Fable 5 és az OpenAI GPT-5.6 debütálása után – azt jelzi, hogy Kína nemcsak élvonalbeli AI-rendszereket kíván építeni, hanem a nemzetközi AI-ökoszisztéma és szabályozás alakításában is részt akar venni.
-
2026. július 22., szerda Üzlet
Az Nvidia a Vera Rubin platformmal a teljes adatközponti chippiacot célozza meg
Az Nvidia a Vera Rubin rendszerrel nemcsak GPU-, hanem CPU-szállítóként is pozicionálni kívánja magát az AI-adatközpontok piacán – derül ki a WIRED beszámolójából egy Santa Clara-i műhelybeszélgetésről. A Vera Rubin NVL72 rack 36 Vera CPU-t és 72 Rubin GPU-t integrál egyetlen folyadékhűtéses egységbe, és az Nvidia állítása szerint wattonként tízszer annyi tokent képes feldolgozni, mint az előző generációs Blackwell. Ian Buck, az Nvidia gyorsított számítástechnikáért felelős alelnöke szerint a cég párhuzamosan fejleszt új CPU- és GPU-architektúrákat. A WIRED szerint az OpenAI már használatba vett egy Vera Rubin rackot. Az Nvidia műszaki blogja részletezi, hogy a Rubin GPU 336 milliárd tranzisztort, 288 GB HBM4 memóriát és harmadik generációs Transformer Engine-t tartalmaz, amelyet kifejezetten az ágens jellegű, többlépéses AI-feladatokra optimalizáltak.
-
2026. július 23., csütörtök Üzlet
Az AMD akár 5 milliárd dollárt fektet az Anthropicba, cserébe a Claude-fejlesztő az AMD chipjeit választja
Az AMD bejelentette, hogy akár 5 milliárd dolláros befektetést hajt végre az Anthropicban – a The Verge beszámolója szerint az ügylet részeként az Anthropic akár 2 gigawattnyi kapacitásban telepíti az AMD Instinct MI450 AI-gyorsítóit a chipgyártó új Helios rack-szintű rendszerében. Az első gigawattnyi kapacitást 2027 első felében tervezik üzembe helyezni. A partnerség emellett többéves mérnöki együttműködést is tartalmaz: az AMD saját szoftverfejlesztésében és terméktervezésében is alkalmazza majd az Anthropic Claude modelljét. Az Anthropic korábban a Google-lal, az Amazonnal, a SpaceX-szel és a TeraWulffal is kötött infrastrukturális megállapodásokat. A korábbi hírekhez képest – amelyek egy nem megerősített GitHub-profil alapján jelezték, hogy az Anthropic tesztelheti az AMD hardverét – most hivatalos, nagyszabású stratégiai megállapodás született a két cég között.
-
2026. július 23., csütörtök Eszközök
A TensorRT motorépítés immár valós időben nyomon követhető és megszakítható
Az NVIDIA technikai blogján bemutatta, hogyan használható a TensorRT-ben több kiadás óta elérhető IProgressMonitor API a motorépítés valós idejű követésére és megszakítására Python és C++ környezetben. A cég szerint nagy modellek és mély taktikakeresés akár percekig tartó építést eredményezhet, ami felügyelet nélkül elvesztegetett GPU-órákat okozhat. Az API három metódus felülírásával fa struktúrájú fáziskövetést és Ctrl-C vagy programozott leállítási jelekre való reagálást tesz lehetővé. Az integráció révén a haladási információ terminálba, IDE-be, HTTP-szolgáltatásba vagy ügynök-futtatókörnyezetbe továbbítható, de szálbiztonság és megszakítási késleltetés gondos kezelését igényli.
-
2026. július 24., péntek Kutatás
Bizalmas GPU-inferencia teljesítményvizsgálata NVIDIA H100-on Intel TDX környezetben
Kutatók összehasonlító mérést végeztek az NVIDIA H100 GPU-n futó nagy nyelvi modellek hagyományos és bizalmas számítástechnikai módú inferenciája között Intel TDX környezetben. A nem lektorált tanulmány a Mistral-7B és a Qwen3-30B-A3B modelleket vizsgálta. A szerzők szerint a bizalmas mód 21,8–27,8%-kal növelte az első token előállítási idejét, a globális áteresztőképesség pedig 17,7–21,1%-kal csökkent. Zárt hurkú tesztekben a veszteség 11,5–20,2% maradt, de a nagyobb modell hamarabb telítődött. Az eredmények szerint a bizalmas inferencia használható marad, de a kapacitástervezésnek számolnia kell a többletköltséggel.
-
2026. július 24., péntek Eszközök
Az NVIDIA bemutatta a Vera CPU-t: Olympus magokkal az ágens AI munkaterhelésekre tervezve
Az NVIDIA technikai blogján ismertette a Vera CPU architektúráját, amelyet az Olympus processzormag köré épített, kifejezetten ágens AI munkaterhelésekre. A vállalat szerint a processzor az egyszálú teljesítmény maximalizálására fókuszál, mivel az ágens rendszerek szekvenciális, elágazás-intenzív és késleltetés-érzékeny programutakat futtatnak, amelyek eltérnek a hagyományos felhős CPU-k terhelésétől. Az NVIDIA állítása alapján a chip 3,4 TB/s sávszélességű koherenciafabrikot és akár 1,2 TB/s összesített sávszélességű LPDDR5X memóriát tartalmaz. A skálázhatóságot koherens NVLink-C2C, PCIe 6.4, CXL 3.1 és bizalmas számítástechnikai megoldások támogatják.
-
2026. július 24., péntek Eszközök
Az NVIDIA Nemotron 3 Nano modell testreszabása percek alatt elvégezhető a Prime Intellect Lab platformon
Az NVIDIA technikai blogján közzétett útmutató szerint a Nemotron 3 Nano nyílt modell testreszabása a Prime Intellect Lab platformmal mindössze öt perc helyi beállítást igényel. A bemutatott munkafolyamat három lépésből áll: kiindulási teljesítmény mérése, megerősítéses tanulás (reinforcement learning) futtatása egy Python matematikai környezetben, majd az eredmények kiértékelése – a folyamat végén letölthető LoRA adapter jön létre. Az NVIDIA szerint a testreszabás után jelentős pontosságjavulás érhető el. A blogbejegyzés kiemeli, hogy ugyanez a folyamat alkalmazható a nagyobb Nemotron 3 Super és Ultra modellekre is, a nyílt súlyok, adatok és tanítási receptek pedig a reprodukálhatóságot és az átláthatóságot szolgálják. A megoldás lényege, hogy az infrastrukturális és szaktudásbeli akadályokat a felhőalapú platform nagymértékben csökkenti.
-
2026. július 25., szombat Eszközök
NVIDIA ModelExpress: modellsúlyok villámgyors elosztása GPU-k között a klaszterben
Az NVIDIA bemutatta a ModelExpress (MX) nevű platformot, amely a nagy nyelvi modellek súlyainak klaszteren belüli mozgatását gyorsítja fel. A rendszer a betöltés előtt megkeresi, hol található már kompatibilis súlymásolat, és a leggyorsabb elérhető útvonalat választja: ha egy kiszolgáló társgépen megvannak a súlyok, azokat közvetlenül GPU-ról GPU-ra másolja RDMA-n keresztül az NIXL könyvtár segítségével, elkerülve az objektumtárolót, a lemezt és a gazdagép memóriáját. Az NVIDIA szerint az MX a DeepSeek-V4 Pro súlyait és a JIT kernelgyorsítótárat kevesebb mint 10 másodperc alatt képes átvinni egy új replikába. A platform többszálú streamelést, elosztott atomi gyorsítótárazást és GPUDirect Storage támogatást alkalmaz, valamint integrálódik a vLLM, SGLang, Dynamo és llm-d keretrendszerekkel, így az éles LLM-telepítések hidegindítási és skálázási idejét jelentősen csökkenti.
-
2026. július 28., kedd Modellek
Az NVIDIA Nemotron 3 Ultra vezeti a nyílt modellek mezőnyét chiptervezési kódolásban
Az NVIDIA saját közleménye szerint az ACE-RTL nevű ágens és a Nemotron 3 Ultra modell kombinációja élen jár a regiszter-transzfer szintű (RTL) chiptervezési feladatokban. A vállalat állítása szerint az iteratív generálás-tesztelés-visszacsatolás munkafolyamatot alkalmazó rendszer a CVDP benchmarkon 97,1 százalékos átlagos sikerarányt ért el kilenc feladatkategóriában, megelőzve a GLM 5.2 és a Kimi K2.6 modelleket, akár 71 százalékkal kevesebb tokenfelhasználás mellett. Az NVIDIA szerint a Nemotron 3 Ultra hibrid Mamba-Attention keverék-szakértői architektúrája és szintetikus RTL-adatokon végzett tanítása teszi lehetővé az olcsó, hosszú kontextusú következtetést, amely alapot adhat a Cadence, Siemens és Synopsys tervezőeszközeivel való integrációhoz. Az állítások a gyártó saját mérésein alapulnak, független megerősítés egyelőre nem ismert.
-
2026. július 28., kedd Modellek
NVIDIA nyílt AI-modellje kvantumszámítógépeket kalibrálna
Az NVIDIA saját blogbejegyzése szerint megjelent az Ising Calibration 1.5, egy 31 milliárd paraméteres, nyílt forráskódú vizuális-nyelvi modell, amely kvantumprocesszorok diagnosztikai kimeneteit értelmezi és javaslatot ad a hangolásukra. A vállalat állítása szerint a modell BF16 pontosságnál 11,4 százalékkal kisebb az előző verziónál, és most először NVFP4-kvantált formában is elérhető, ami egyetlen GPU-n vagy NVIDIA DGX Spark eszközön futtatható. Az NVIDIA a QCalEval nevű benchmarkon mért eredmények alapján azt közli, hogy a modell minden nyílt modellnél jobban teljesít, és felveszi a versenyt a vezető zárt rendszerekkel is. A modellt több kubitmodalitás – szupravezető kubitok, kvantumpöttyök, ionok, neutrális atomok – partneradatain tanították, és a teljes csomag, beleértve a súlyokat és az adatkészleteket, OpenMDW licenc alatt válik elérhetővé.
-
2026. július 28., kedd Szabályozás
Szétforgácsolt AI-politika: kik irányítják Trump kormányzatában a Kína elleni versenyt
A WIRED cikke szerint Donald Trump kormányzatában nincs egységes AI-stratégia: a döntéshozatal több hivatal között oszlik meg, egy magas rangú fehér házi tisztviselő szerint „nem kétpólusú vita, hanem tíz irányba húzó vita” zajlik. A lap szerint Howard Lutnick kereskedelmi miniszter befolyásos szereplő az exportkorlátozásokon keresztül: nyilvánosan gyengébbnek minősítette a kínai Moonshot AI Kimi K3 modelljét a vezető amerikai modellekhez képest, ugyanakkor korábban exportkorlátozást vezetett be az Anthropic ellen is. Arvind Raman a hét elején vette át a CAISI ügynökség irányítását, miután elődje az Anthropic Fable 5 modelljének jailbreak elleni védelmét érintő heteken át tartó egyeztetés után lemondott. Sean Cairncross nemzeti kiberbiztonsági igazgató a cikk szerint keményebb vonalat képvisel a kínai AI-labokkal szemben, és részt vett Trump június 2-i AI-rendeletének kidolgozásában.
-
2026. július 28., kedd Eszközök
Az NVIDIA nyílt forráskódú NOOA ügynökkeretet mutatott be
Az NVIDIA Labs technikai blogján jelentette be a NOOA (NVIDIA Labs Object-Oriented Agents) nevű, nyílt forráskódú, objektumorientált AI-ügynökkeretet. A vállalat közlése szerint a rendszer minden ügynököt egyetlen Python osztályként kezel, ahol a metódusok a képességeket, a mezők az állapotot, a docstringek pedig a promptokat testesítik meg, a típusannotációk pedig kikényszerített szerződésként működnek. A keretrendszer típusos, kapcsolati memóriát tart fenn egy emberi szemmel is olvasható SQLite-adatbázisban, ami az NVIDIA szerint feleslegessé teszi a kontextus-tömörítést. A cég állítása alapján a NOOA a SWE-bench Verified, a CyberGym L1 és az ARC-AGI-3 benchmarkokon jobb pontosságot és alacsonyabb tokenköltséget ér el a korábbi keretrendszerekhez képest, a kódot és kiértékeléseket pedig nyilvánosan elérhetővé tették.
-
2026. július 30., csütörtök Eszközök
NVIDIA útmutató: önhosztolt, ellenőrzött AI kódolóasszisztens NeMo Guardrails-szal
Az NVIDIA hivatalos technikai blogja útmutatót közöl, amellyel saját infrastruktúrán, StarCoder2-7B NIM végponttal futtatható AI kódolóasszisztens építhető ki. A vállalat állítása szerint ez megoldja három tipikus problémát: a forráskód nem hagyhatja el a hálózatot, a modell időnként kitalált csomagneveket javasol, ami ellátásilánc-kockázatot jelent, és nincs auditnyom, ha egy generált módosítás hibát okoz. A megoldás NeMo Guardrails házirend-réteget használ, amely megtagadja a hozzáférést emberi jóváhagyáshoz kötött fájlokhoz, egy CI-lépés kiszűri a hallucinált csomagokat, Prometheus/Grafana metrikák pedig mérik a hibaarányra gyakorolt hatást. Az NVIDIA szerint a validáció a modellen kívül történik, ami fokozatos bevezetést és auditálható munkafolyamatot tesz lehetővé, legalább 24 GB memóriájú GPU-t igénylő környezetben.
-
2026. július 30., csütörtök Eszközök
NVIDIA GPU-alapú fizikai szimulációt épít egészségügyi robotokhoz
Az NVIDIA saját blogbejegyzésében bemutatta a Medical Physics Simulation keretrendszert, amely az Isaac for Healthcare platform része, és GPU-natív, moduláris szimulációs környezeteket kínál orvosi robotok fejlesztéséhez. A vállalat állítása szerint az endoluminális és sebészeti modulok valós idejű, nagy pontosságú eszköz-anatómia modellezést tesznek lehetővé Warp, Newton Physics és CUDA felhasználásával, célként a klinikai adathiány pótlását megjelölve, mivel a valós demonstrációk száma jellemzően csak néhány száz. Az NVIDIA szerint a Cosmos-H generatív világmodell integrálásával szintetikus adatok és akció-feltételes videó-előrejelzés is előállítható. A leírás kizárólag vállalati technikai blogbejegyzésen alapul, független megerősítés vagy klinikai validáció nem szerepel a forrásban.
-
2026. július 31., péntek Eszközök
NVIDIA: rejtett konfigurációs hibák lassíthatják az AI-klasztereket
Az NVIDIA technikai blogja szerint azonos H100, GB200 NVL72 vagy GB300 NVL72 hardverből épített AI-klaszterek betanítási teljesítménye jelentősen eltérhet egymástól, akár 8-12 százalékos réssel a referenciaarchitektúrához képest ugyanazon munkaterhelés mellett. A vállalat állítása szerint ennek oka nem a hardver, hanem a kernel, a hypervisor, a BIOS és az NCCL könyvtár beállításaiban felhalmozódó apró hibák, amelyek együtt az Exemplar Cloud minősítéshez szükséges 95 százalékos küszöb elmulasztásához vezethetnek. Négy valós esetet mutatnak be: hiányzó SMMU-képességek Grace CPU-kon, hibás CPU C-state és NUMA beállítások, elégtelen NCCL sor-pár párhuzamosság ConnectX-8 hálón, és a topológiafájlok konténerekbe nem továbbítása.
-
2026. augusztus 1., szombat Kutatás
AI-ügynökök biztonsági kockázatai: NVIDIA-teszt és kutatói ütemterv
Az NVIDIA AI Red Team fél éven át tesztelt vállalati AI-ügynököket, és állítása szerint visszatérő hibákat talált: hiányos hozzáférés-szabályozást, tetszőleges kódfuttatást lehetővé tevő eszközöket, kontrollálatlan hálózati kimenetet és nyílt szövegű titkok tárolását. Az NVIDIA szerint a prompt-alapú és LLM-bíróra épülő védelmek megbízhatatlanok social engineering és „frog-boiling” támadásokkal szemben, ezért determinisztikus, a modell irányítási körén kívüli architektúrai kontrollokat javasol: hozzáférés-korlátozást, sandboxolt futtatást, alapértelmezetten tiltó hálózati szabályokat és a tartós titkok kizárását. Egy különálló, lektorálatlan arXiv-preprint iparági és kormányzati szakértők bevonásával négy prioritási témát azonosít az AI-biztonság fejlesztésére, köztük az agentikus AI ellenséges nyomás alatti irányítását.
-
2026. augusztus 2., vasárnap Eszközök
Az NVIDIA gyakorlati tervezési útmutatót ad a hosszú kontextusú AI-modellek gyorsításához
Az NVIDIA hivatalos technikai blogja szerint a mesterséges intelligencia modellek figyelem-mechanizmusának teljesítményét a lekérdezés-fejek és kulcs-érték fejek aránya, a fejdimenzió és a szekvenciahossz határozza meg, ezek eltérően hatnak a feltöltési és a dekódolási fázisra. A cég szerint a dekódolás hatékonysága a csoportmérettel skálázódik, míg a feltöltést a szekvenciahossz uralja, ezért 128 vagy 256 fejdimenziót ajánlanak a GPU-memória illesztéséhez. Az NVIDIA négy gyakorlati irányelvet fogalmaz meg fejlesztőknek, köztük a KV-gyorsítótár tömörítését és a párhuzamosítási stratégia megválasztását a KV-fejek száma alapján, a TensorRT-LLM keretrendszerben implementálva. Az elemzés saját mérési adatokra és matematikai számításokra épül, tehát vállalati, gyártófüggő technikai ajánlás.
-
2026. augusztus 3., hétfő Üzlet
Kínai chipfejlesztések rengették meg a globális AI-részvénypiacot
A kínai CXMT memóriachip-gyártó sanghaji tőzsdei debütálása 466 százalékos árfolyamemelkedést hozott, ugyanaznap pedig arról érkezett hír, hogy Kína saját mélyultraibolya litográfiai eszközöket fejlesztett, amely technológia korábban a holland ASML monopóliuma volt. A hírek nyomán világszerte estek az AI-hoz kötődő részvények: a Kospi kedden 11,5, szerdán további 6 százalékot zuhant, a Nasdaq korrekcióba süllyedt, az Nvidia pedig több mint 5 százalékot vesztett, és az Apple átvette tőle a legnagyobb tőzsdei vállalat címet. Pénteken az Amazon és a Microsoft erős eredményei nyomán a piacok visszapattantak, de a hónap így is 2008 óta a legrosszabb volt a Kospi számára. A cikk értelmezése szerint a CXMT DRAM-chipeket gyárt, nem GPU-kat, ezért nem az Nvidia, hanem inkább az SK Hynix és a Micron versenytársa lehet.
-
2026. augusztus 3., hétfő Szabályozás
Kínai nyílt AI-modellek szítanak vitát Washingtonban és Szilícium-völgyben
A Guardian szerint az elmúlt hetekben kínai fejlesztésű, ingyenesen letölthető, nyílt súlyú AI-modellek – például a Moonshot AI Kimi K3 nevű rendszere – piaci zavart okoztak, mivel egyes alkalmazásokban felveszik a versenyt az OpenAI és az Anthropic drágább, zárt termékeivel. A lap állítása szerint ez megosztotta mind a Fehér Házat, mind a techipart: egyes chipgyártók és cégek az olcsó nyílt modellek mellett állnak, míg az OpenAI és az Anthropic biztonsági kockázatokra hivatkozva óvna tőlük. Bessent pénzügyminiszter kínai cégek elleni szankciókat helyezett kilátásba állítólagos szellemitulajdon-lopás miatt, míg Lutnick kereskedelmi miniszter startupalapítóktól kapott leveleket a nyílt modellek megtartása mellett. A cikk szerint a Microsoft, az Nvidia, a Palantir és a Meta közös levélben kérte a törvényhozókat, ne korlátozzák a nyílt modellek használatát.
-
2026. augusztus 4., kedd Eszközök
NVIDIA szerint Vera storage-processzora akár 3,7-szer gyorsabb titkosítási feladatokban
Az NVIDIA saját technikai blogján közölt benchmarkeredményei szerint a Vera BlueField-4 STX storage-processzor – amely 88 Olympus Armv9.2 magot, Spatial Multithreading technológiát és SOCAMM2 LPDDR5X memóriát integrál – felülmúlja az x86 CPU-kat AI-natív adatplatformok tárolási feladataiban. A vállalat állítása szerint a chip titkosításnál 1,43-szoros, dekódolásnál 1,29-szoros, Reed-Solomon hibajavításnál 3,26-szoros, CRC32C integritásellenőrzésnél 3,67-szoros, tömörítésnél 3,29-szoros sebességtöbbletet ér el. Az NVIDIA szerint ez lehetővé teszi, hogy az agentikus AI-munkafolyamatok alacsonyabb energia- és hűtési igény mellett skálázódjanak. Az adatok kizárólag a vállalat saját, független megerősítés nélküli mérésén alapulnak.
-
2026. augusztus 5., szerda Modellek
NVIDIA bemutatta az Alpamayo 2 Super önvezető AI-modellt
Az NVIDIA hivatalos bejelentése szerint az Alpamayo 2 Super egy 34 milliárd paraméteres, nyíltan elérhető vizuális-nyelvi-cselekvési modell, amely önvezető autók fejlesztését hivatott egységesíteni. A rendszer a 32 milliárd paraméteres Cosmos 3 Super Reasoner nevű okfejtő komponenst és egy 2 milliárd paraméteres, diffúzió-alapú Action Expert modult kapcsolja össze, megerősítő tanulással utótanítva. A vállalat állítása szerint akár hét kamerából 360 fokos érzékelést biztosít, és egyetlen modellből ad jövőbeli pályát, okfejtési láncot, magas szintű cselekvési predikciót, jelenet-alapú kérdésválaszolást és automatikus adatannotálást. Az NVIDIA saját méréseket közölt, amelyek szerint a modell több benchmarkon – köztük pályaelőrejelzésben és LingoQA teszten – felülmúlja a korábbi megoldásokat, ezek az adatok azonban független validálás nélkül a vállalat saját közlésén alapulnak.
-
2026. augusztus 5., szerda Modellek
NVIDIA: a World Action Modellek felváltják a robotikai VLA-kat
Az NVIDIA technikai blogja szerint a robotpolitikák új generációja, az úgynevezett World Action Model (WAM) videó-alapú világmodellekre épül, nem a megszokott nyelv-látás (VLM) alapú vision-language-action (VLA) rendszerekre. A cég állítása szerint a WAM-ok jobban általánosítanak új feladatokra, robotokra és környezetekre, mert a tanult fizikai dinamikát használják, nem csak szemantikus leképezést. Az NVIDIA saját, nyílt Cosmos 3 modelljét mutatja be alapként, amely Mixture-of-Transformers architektúrára épül, és rendkívül nagy, több száz millió kép-, videó- és akciómintát tartalmazó adathalmazon tanult. A vállalat szerint a Cosmos 3 munkaállomásos és Jetson-alapú, valós idejű futtatást is lehetővé tesz, kevesebb feladatspecifikus adattal érve el jobb teljesítményt. Az állítások az NVIDIA saját blogbejegyzéséből származnak, független megerősítés nélkül.
-
2026. augusztus 5., szerda Szabályozás
Amerikai importtilalom sújtja a fejlett robotokat
A MIT Technology Review beszámolója szerint az amerikai Szövetségi Kereskedelmi Bizottság (FTC) a múlt héten kiterjedt tilalmat rendelt el fejlett robotok külföldi importjára, beleértve a humanoid, négylábú és kerekes robotokat is. A lap elemzése szerint a lépés nem a megszokott Kína-kereskedelmi vitákat folytatja, hanem azt jelzi, hogy a Trump-adminisztráció az AI-ipar védelmét a ma vezető laboratóriumokon túl a még gyerekcipőben járó robotikai szektorra is kiterjeszti. Ez az értelmezés a cikk szerzőitől származik, nem hivatalos kormányzati indoklás. A robotikai ágazat egyelőre inkább vírusvideókról, mint valós munkahelyi vagy otthoni alkalmazásokról ismert, ami rávilágít arra, hogy a szabályozás egy még kiforratlan technológiai területet érint.
-
2026. augusztus 8., szombat Üzlet
AMD felvásárolta a Taalas AI-chipfejlesztőt
Az AMD bejelentette, hogy megvásárolja a 2023-ban Torontóban alapított Taalas nevű startupot, amely különleges inferencia-chipeket fejleszt. A Taalas technológiája egy AI-modell architektúráját és betanított paramétereit közvetlenül a szilíciumba égeti, ami rendkívül gyors futtatást tesz lehetővé, viszont minden chipet egyetlen konkrét modellhez köt. A cég állítása szerint egy demó chip Llama 3.1-8B modellel felhasználónként 16 000 token/másodperc feletti sebességet ért el, ami sokszorosa a versenytárs hardvereknek. Az AMD a technológiát a jövőbeli gyorsítói közé illeszti, és az Instinct GPU-k mellett rendszerszintű megoldásként kínálja majd. A felvásárlás a szokásos hatósági jóváhagyásoktól függ.
-
2026. augusztus 10., hétfő Modellek
Google DeepMind diffúziós nyelvmodellé alakította a Gemma 4-et
A Google DeepMind technikai jelentést tett közzé a júniusban kiadott DiffusionGemma modellről. A vállalat állítása szerint nem nulláról építették: a meglévő Gemma-4-26B-A4B modellt alakították diffúziós architektúrává, az eredeti tanítási tokenmennyiség kevesebb mint tíz százalékának felhasználásával. A hagyományos, soronként tokeneket generáló modellekkel szemben a DiffusionGemma 256 tokenes blokkokat párhuzamosan finomít, ami Nvidia H100 gyorsítón a cég szerint mintegy 1500 token másodpercenkénti sebességet ad. A jelentés szerint a kétlépéses tanítás, benne az SD·RL nevű megerősítéses tanulás és mintavevő-desztilláció kombinációja, átlagosan tíz ponttal javította a teljesítményt érvelési benchmarkokon, a válaszok pedig mintegy 50 százalékkal rövidebbek lettek.
-
2026. augusztus 10., hétfő Üzlet
Nvidia és Amazon milliárdokat fektet AI-energiaellátásba
A The Information szerint az Nvidia akár 3 milliárd dollárt fektethet a texasi Lancium energiafejlesztőbe, amely az OpenAI és az Oracle közös adatközpontját is ellátja; egy 2 milliárd dolláros részesedés a cég kb. 20 százalékát jelentené a 10 milliárd dollárra becsült vállalatban. A Lancium már 4 gigawattra kötött szerződést Texasban, és további 15 gigawattnyi kapacitást fejleszt. A New York Times szerint az Amazon egy Pecos megyei gázüzemű erőmű mögé állt be, amely évi akár 33 millió tonna CO2-t bocsáthatna ki, ami az ország legszennyezőbb erőművévé tenné; a 35 turbina akár 7,65 gigawattot termelhetne egy Amazon-adatközpont számára. Az Amazon szóvivője szerint a klímacélok érvényben vannak, de az AI-adatközpontok nehezítik elérésüket.
-
2026. augusztus 11., kedd Modellek
Meta megjelentette a Muse Glimmer nyílt súlyú AI-ügynökmodellt
Meta kiadta a Muse Glimmer nevű 30 milliárd paraméteres, sűrű architektúrájú modellt, amelynek súlyait Apache 2.0 licenc alatt, nyíltan tette elérhetővé a Hugging Face-en. A vállalat szerint a modellt kifejezetten helyi, folyamatosan futó AI-ügynökök számára optimalizálták: egyetlen fogyasztói GPU-n, akár internetkapcsolat nélkül is képes futni, és több mint 100 nyelven, szöveget és képet is kezel. A The Decoder szerint Meta saját benchmarkjai alapján a Glimmer a Google Gemma és az Alibaba Qwen hasonló méretű nyílt modelljeivel versenyképes ügynöki feladatokban, ám a mérés a vállalat saját, nem független tesztkörnyezetében történt. Ez Meta első nyílt modellje a 2025 tavaszi Llama 4 óta, amelyet gyenge fogadtatás és manipulált benchmarkok miatti kritika ért. NVIDIA és Hugging Face már nap-nulla támogatást biztosít a modellhez több futtatókörnyezetben.
-
2026. augusztus 11., kedd Eszközök
NVIDIA kiterjesztette a nyílt súlyú Magpie TTS beszédszintetizátor nyelvi támogatását
Az NVIDIA a Hugging Face blogján bemutatta a Magpie Multilingual TTS legújabb kiadását, egy 364 millió paraméteres, nyílt súlyú szövegfelolvasó modellt, amely kaszkádolt beszéd-AI architektúrába illeszthető. A vállalat állítása szerint a modell mostantól 12 nyelvet támogat, a legújabb frissítés három új nyelvvel – modern standard arabbal, koreaival és brazíliai portugállal – bővítette a palettát, és javította több meglévő nyelv minőségét is frissített tréningadatokkal. Az NVIDIA azzal érvel, hogy a nyílt súlyok és a saját infrastruktúrán futtatás lehetővé teszi a késleltetés finomhangolását és a testreszabást, szemben a zárt, „egy API-hívásos” beszéd-megoldásokkal. A cikk elsősorban vállalati termékbejelentés, amely a Magpie NVIDIA NIM-integrációját hangsúlyozza.
-
2026. augusztus 12., szerda Modellek
Nvidia bemutatta a gyors, nyílt Nemotron 3.5 Lightning modellt
Az Nvidia kiadta a Nemotron 3.5 Lightning nevű nyílt súlyozású modellt, amely a vállalat közlése szerint 30 milliárd paraméteres Mixture-of-Experts architektúrát használ, de csak 3 milliárd paraméter aktív egyszerre, és az önműködő AI-ügynökök gyors, nagy volumenű végrehajtási feladataira optimalizálták. A modell a Nemotron 3 Nano 30B A3B utódja, megtartva a hibrid Mamba-Transformer felépítést. A független Artificial Analysis benchmarkplatform szerint a Lightning az Intelligence Indexen 24 pontot ér el, ami megegyezik az OpenAI gpt-oss-120b eredményével, negyedannyi paraméterből, és mintegy 670 token/másodperces sebességgel a mért modellek közül a leggyorsabbnak számít. Az Nvidia engedékeny licenc alatt, súlyokkal és tréningreceptekkel együtt adta ki a modellt.
-
2026. augusztus 12., szerda Üzlet
Nvidia 500 milliárd dolláros AI-infrastruktúra finanszírozási terve
Az Nvidia szándéknyilatkozatot írt alá hat nagy pénzügyi céggel – Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs és KKR –, hogy évek alatt több mint 500 milliárd dollár külső tőkét mozgósítsanak adatközpontok, chipgyárak és erőművek építésére. A Financial Times szerint a hír nyilvánosságra kerülése után az Nvidia részvénye kb. 1,4 százalékot esett, ami több mint 70 milliárd dollár piaci értéket törölt el. A megállapodás kulcseleme, hogy az Nvidia maga garantálja a beépített chipek maradványértékének akár 25 százalékát, ha azok az elvárt szint alá esnek, így átvállal egy részt az amortizációs kockázatból. Jensen Huang szerint ez az arány jóval alacsonyabb, mint más finanszírozási konstrukciókban, és a hardver hosszú élettartamára, illetve az emelkedő bérleti díjakra hivatkozva cáfolja a lufi-aggodalmakat, amelyeket kritikusok, például Michael Burry, hangoztatnak.
-
2026. augusztus 12., szerda Eszközök
NVIDIA NeMo Switchyard: modellek közötti terheléselosztó AI-ügynökökhöz
Az NVIDIA a NeMo Switchyard nevű eszközt ismertette, amely az AI-ügynökök feladatait dinamikusan osztja el különböző méretű és képességű nyelvi modellek között, a feladat jellege, a költség és az infrastruktúra alapján. A vállalat közlése szerint a rendszer szolgáltatófüggetlen SDK-t biztosít, automatikus és testre szabható útválasztási algoritmusokat támogat, és elválasztja az útválasztási logikát a konkrét modellszolgáltatóktól. Az NVIDIA saját tesztjei és a LangChain, illetve a Cognition partnerekkel végzett kipróbálás szerint az útválasztás jelentősen csökkentheti a költségeket a pontosság megtartása mellett, ám ezek az adatok a vállalat saját közléséből származnak, független megerősítés nélkül. A cél, hogy egyetlen nagy, drága modell helyett feladatonként a legmegfelelőbb modellt használják.
-
2026. augusztus 13., csütörtök Modellek
Alibaba 2,4 billió paraméteres Qwen-modellje NVIDIA GB300 chipeken fut
Az NVIDIA technikai blogja szerint az Alibaba nyílt súlyokkal publikálta a Qwen3.8-2.4T-A95B (Qwen3.8-Max) modellt, eddigi legnagyobb nyílt modelljét: 2,4 billió összparaméterrel, tokenenként 95 milliárd aktivált paraméterrel, finomszemcsés MoE-architektúrával és teljes, illetve lineáris figyelmet vegyítő megoldással, amely akár egymillió tokenes kontextust és 128 ezer tokenes kimenetet kezel. Az NVIDIA saját mérése szerint a modell külön finomhangolás nélkül, FP8 pontosságon már az első napon GPU-nkánt 4000, felhasználónkénti pedig 350 tokent másodpercenként ér el GB300 NVL72 rendszeren. A cég szerint a jövőben tervezett NVFP4 pontosság további teljesítménynövekedést hozhat, ez azonban még csak kilátás, nem mért eredmény.
-
2026. augusztus 15., szombat Üzlet
Francia startup szoftveres trükkökkel gyorsítaná a GPU-alapú AI-következtetést
A francia Kog startup azt állítja, hogy szoftveres optimalizálással jelentősen felgyorsítható az AI-következtetés meglévő adatközponti GPU-kon, például AMD MI300X és Nvidia H200 kártyákon. Májusi technológiai bemutatójuk a Hacker News címlapjára is felkerült, és a vezérigazgató, Gaël Delalleau szerint azóta mintegy 200 konkrét üzleti érdeklődő jelentkezett. A demóban 3000 token/másodperc sebességet értek el, de ezt egy célzottan épített, mindössze 2 milliárd paraméteres kis modellel, a Laneformer 2B-vel mutatták be, amelyet azóta nyílt forráskódúvá tettek. A cég szerint ugyanez a módszer nagy nyelvi modelleknél is működne, ez azonban egyelőre igazolatlan ígéret, mivel az erre optimalizált verzió még fejlesztés alatt áll. Az összefoglaló kizárólag a Kog és vezetője állításain alapul, független mérés nem szerepel a forrásban.
-
2026. augusztus 17., hétfő Üzlet
Az agentikus AI miatt visszatér a CPU-hiány a felhőben
Az IEEE Spectrum cikke szerint az Amazon Web Services idén arra utasította mérnökeit, hogy takarékoskodjanak a CPU-kapacitással, mivel állítólag jelentősen megnőttek a szerverek várakozási idői. A GPU- és memóriaigény után most a processzorok kerülnek a középpontba, mert az önállóan működő, más ügynököket is indító AI-rendszerek rengeteg eszközhívást, API-kommunikációt és feladatelosztást végeznek, ezek pedig jellemzően CPU-n futnak. Matt Kimball (Moor Insights & Strategy) szerint 2026-ban ugrásszerűen nőtt a CPU-kereslet az agentikus AI miatt, míg Intel és AMD szakértői azt állítják, hogy egy tipikus agentikus AI-folyamat lépéseinek nagy része, akár hét a nyolcból, kifejezetten CPU-n zajlik. Ezek a cégek és elemzők saját tapasztalataikra és teszteredményeikre hivatkoznak, függetlenül igazolt, széles körű mérés egyelőre nem áll mögöttük.
-
2026. augusztus 18., kedd Üzlet
Nvidia 1,5 milliárd dollárt fektet az OpenAI ohiói adatközpontjába
A Nvidia hétfőn bejelentette, hogy 1,5 milliárd dollárt fektet az SB Energybe, amely a SoftBankhoz és az OpenAI-hoz köthető adatközpont-fejlesztő. A TechCrunch által ismertetett SEC-dokumentumok szerint a befektetés biztosítja, hogy a Nvidia legyen a kizárólagos infrastruktúra-beszállító az OpenAI Cincinnati melletti Ports-Pike adatközpontjában, amelyhez akár 105 milliárd dollár hitelkeretet is nyújt, és amely 4,25 gigawattról 8 gigawattra bővülhet. A telephelyen egy 9,2 gigawattos, 33 milliárd dolláros földgáz erőmű is épül olyan területen, amely korábban az amerikai atomfegyver-programhoz szolgáltatott dúsított uránt. Az OpenAI saját közleménye csak azt erősíti meg, hogy csatlakozott a Ports-Pike projekthez, bővítve közösségi beruházásait és több ezer dél-ohiói munkahelyet támogatva.
-
2026. augusztus 18., kedd Üzlet
A Groq 350 millió dollárt vont be neocloud-átállásához, felére csökkent értékeltség mellett
A Groq startup 350 millió dollár friss tőkét szerzett, miközben tovább folytatja átalakulását saját AI-chipeket gyártó cégből Nvidia-alapú GPU-kat kínáló, úgynevezett neocloud-szolgáltatóvá. A kört a Disruptive vezette, Nvidia tervezett részvételével, és a Groq-ot 3,5 milliárd dollárra értékelte, ami jóval elmarad a tavaly szeptemberi 6,9 milliárd dollártól. A cég szóvivője a TechCrunch-nak azt állította, ez nem down round, hanem az Nvidia-licencszerződés utáni új Groq értékelése. A vállalat júniusban már bevont 650 millió dollárt a pivot elindítására, és jelenleg 13 adatközpontot üzemeltet, több millió fejlesztőt kiszolgálva. A cikk szerint nyitott kérdés, hogy a neocloud-modell hosszú távon elég jövedelmező lesz-e a hatalmas beruházások megtérüléséhez.
-
2026. augusztus 18., kedd Modellek
NVIDIA NVFP4-re tömöríti a Nemotron 3.5 Lightning modellt, elérhető AWS-en is
Az NVIDIA technikai blogja szerint kvantálás-tudatos disztillációval (QAD) készült el a Nemotron 3.5 Lightning NVFP4 verziója, amely a teljes pontosságú, 66 GB-os BF16 modellhez képest 22 GB-ra zsugorodik, és a vállalat állítása szerint akár négyszeres áteresztőképességet ér el, közel a BF16 pontosságával. A módszer PTQ-val indul, majd a diákmodellt a fagyasztott tanárhoz igazítja KL-divergencia veszteséggel, ami a cég mérései szerint jobb pontosságmegtartást ad, mint a puszta PTQ. Az AWS bejegyzése szerint a Nemotron 3.5 Lightning – egy 30 milliárd paraméteres, de csak 3 milliárd aktív paramétert használó MoE modell – az Amazon SageMaker JumpStartban is elérhető, nagy volumenű AI-ágensekhez optimalizálva.
-
2026. augusztus 19., szerda Üzlet
SemiAnalysis elemzése: a chipgyártástól a token-gazdaságtanig ível az AI-piac
Jordan Nanos, a SemiAnalysis technikai munkatársa a QCon AI konferencián tartott előadásában bemutatta, hogyan hatnak a félvezető-kapacitás korlátai, az adatközpont-bővítések és a hálózati szűk keresztmetszetek az AI-szoftverek architektúrájára. Az előadó szerint a cég GPU-benchmarkokat, felhőszolgáltatói teljesítménymérést és tokenomikai elemzéseket készít, hogy összekösse a chipgyártás és a modellfuttatás közötti láncszemeket, a ClusterMAX nevű projektjükön keresztül is. A SemiAnalysis saját közlése alapján a technológiai szektor legnagyobb Substack-hírlevele, 280 ezer feliratkozóval és 85 fős csapattal rendelkezik. Az előadás iparági piacelemzési szemléletet közvetít a hardveres korlátok és a szoftverfejlesztés összefüggéseiről, konkrét új kutatási eredményt a kivonat nem tartalmaz.
-
2026. augusztus 19., szerda Eszközök
NVIDIA: több GPU-s UMAP-számítás 870 GB-os adathalmazon 8 perc alatt
Az NVIDIA saját technikai blogja szerint a cuML és cuVS könyvtárak 25.06-os verziója már több GPU-n is támogatja az UMAP dimenziócsökkentő algoritmus legköltségesebb lépését, az összes szomszédot kereső kNN-gráf felépítését. A vállalat állítása szerint a módszer az adathalmazt kiegyensúlyozott klaszterekre osztja, ezekhez külön-külön számol lokális kNN-gráfot, majd ezeket globális gráffá egyesíti, elkerülve a teljes körű GPU-k közötti kommunikációt. Az NVIDIA mérései alapján a MIRACL és Wiki adathalmazokon nyolc H100 GPU-val akár 74-szeres gyorsulást értek el a becsült CPU-s futásidőkhöz képest, és 870 GB-nyi vektort mindössze 8 perc alatt dolgoztak fel, az elmondásuk szerint a beágyazások pontosságának megőrzése mellett. A korábbi megoldásban csak a transzformációs lépés futhatott több GPU-n, a tanítás egyetlen GPU-ra korlátozódott.
-
2026. augusztus 19., szerda Üzlet
Nvidia 1,5 milliárd dollárt fektet az OpenAI ohiói adatközpontjába
A TechCrunch által ismertetett SEC-dokumentumok szerint a Nvidia bejelentette, hogy 1,5 milliárd dollárt fektet az SB Energybe, a SoftBankhoz és az OpenAI-hoz köthető adatközpont-fejlesztőbe. A befektetés biztosítja, hogy a Nvidia legyen a kizárólagos infrastruktúra-beszállító az OpenAI Cincinnati melletti Ports-Pike adatközpontjában, amelyhez a chipgyártó akár 105 milliárd dollár hitelkeretet is nyújt. A létesítmény 4,25 gigawattról 8 gigawattra bővülhet, a helyszínen pedig egy 9,2 gigawattos, 33 milliárd dollár értékű földgáz erőmű is épül egy korábban katonai uránjátás területén. A TechCrunch szerint a földgázerőmű-építés költsége két év alatt 66 százalékkal nőtt, ami a beruházás árát is felhajtja. Az OpenAI saját közleménye csupán azt erősíti meg, hogy csatlakozott a Ports-Pike projekthez, amely dél-ohiói munkahelyeket és közösségi fejlesztéseket is támogat.
-
2026. augusztus 20., csütörtök Eszközök
NVIDIA nyílt eszközzel méri, mennyit javítanak az AI-ügynökökön a beépített skillek
Az NVIDIA saját közlése szerint nyílt forráskódú SkillEvaluator eszközt épített, amely három lépésben – statikus ellenőrzés, megkülönböztethetőségi elemzés és élő feladatvégrehajtás izolált környezetben – méri, hogy az úgynevezett verified skillek mennyit javítanak az AI-ügynökök teljesítményén. A vállalat állítása szerint több mint 300 hitelesített skillt teszteltek 30-nál több NVIDIA terméken, két ügynök-keretrendszerben, és a skillek használatával átlagosan 31 pontos javulást mértek a helyesség, felfedezhetőség, hatékonyság és eredményesség terén, a biztonsági kategóriát kihagyva pedig 39 pontosat. Az NVIDIA szerint a javulást inkább a termékdomén és az értékelési módszertan befolyásolja, mint az ügynök-keretrendszer. Az eredmények kizárólag a vállalat saját méréséből származnak, független validálásról a közlemény nem szól.
-
2026. augusztus 20., csütörtök Kutatás
Föderált tanulás vizuális-nyelvi modellekhez: NVIDIA FLARE és FedUMM
Az NVIDIA hivatalos blogbejegyzése bemutatja, hogyan koordinálja a FLARE keretrendszer a vizuális-nyelvi modellek föderált tanítását olyan esetekben, ahol az adatok nem centralizálhatók intézmények között. A megoldás nagyméretű objektumok kiszervezésével, tenzor-streameléssel és lemezalapú aggregációval kezeli a hálózati és memóriakorlátokat. A William & Mary egyetemmel közösen fejlesztett FedUMM csak könnyű LoRA-adaptereket cserél egy fixen tartott BLIP-háttérmodell felett, ami a vállalat állítása szerint kísérleteiben 28,6 GB-ról 0,094 GB-ra csökkentette a kliensenkénti kommunikációt, miközben a teljesítmény közel maradt a centralizált alapmodellekhez. A FedUMM-ot az NVIDIA akadémiai grantprogramja támogatta, és díjat kapott egy szakmai workshopon.
-
2026. augusztus 20., csütörtök Üzlet
Kína kis tételben engedélyezi az Nvidia H200 chipek beszerzését
A Financial Times értesülése szerint Peking kis mennyiségben engedélyezi az Nvidia H200 chipjeinek behozatalát a szárazföldre, hogy a hazai AI-cégek lépést tarthassanak az amerikai versennyel. A The Decoder cikke szerint a ByteDance és a Tencent egyenként mintegy 10 000 H200 processzort kapott, és további vállalatok is követhetik őket, bár a vásárláshoz az NDRC tervhivatal jóváhagyása is szükséges. A H200 már legalább két generációval elmarad az Nvidia legerősebb, exportkorlátozás alá eső chipjeitől, az USA pedig cégenként legfeljebb 100 000 darabot engedélyez. Kína eközben inkább saját gyártóit, például a Huaweit igyekszik erősíteni, a Hongkongba irányuló szállítást pedig a helyi adatközpont- és energiahiány korlátozza. A cikk szerint a kínai AI-laborok technikailag közelítenek az amerikai szinthez, de a rendelkezésre álló inferencia-kapacitásban jelentősen lemaradnak riválisaiktól.
-
2026. augusztus 22., szombat Kutatás
Nvidia: a szoftveres keret dönti el az AI-ügynök sikerét, nem a modell
Az Nvidia péntek óta ismert kutatása szerint hosszú távú, sok lépésből álló feladatoknál nem a modell, hanem a köré épített szoftveres keret (harness) a döntő tényező. A cég állítása szerint egy egyedi, memóriakezelésre optimalizált és „felügyelő” komponenssel ellátott keretben a Claude Opus 5 modell 100%-os eredményt ért el az ARC-AGI-3 benchmarkon, amely instrukció nélküli 2D-s játékokból áll. Ugyanez a modell harness nélkül csak 30%-ot ért el, ami így is a legjobb eredmény volt a tesztelt modellek között. Az Nvidia szakembere szerint az ügynök valójában nem csak a modellből áll, hanem az eszközökből, a futásidőből és a hozzáférhető könyvtárakból is, amelyek együtt adják a tényleges teljesítményt. A cikk kontrasztként megemlíti a Microsoft áprilisi kutatását is, amely szerint 19 nagy nyelvi modell mindegyike hibázott hosszú dokumentumszerkesztési feladatoknál.
-
2026. augusztus 23., vasárnap Üzlet
Ulanqab: Belső-Mongólia lett Kína AI-adatközpont-fővárosa
A WIRED cikke szerint egy Goldman Sachs kutatási jegyzet alapján a mindössze 1,5 milliós lakosú Ulanqabban 2016 óta közel 100 adatközpont épült vagy van építés alatt, a bejelentett kapacitás összesen 12,5 gigawattra rúg, ennek több mint 70 százalékát az elmúlt egy évben jelentették be. Összehasonlításképp az OpenAI 500 milliárd dolláros Stargate projektje készen is csak 10 gigawattot ér el. A várost a hideg, magasan fekvő klíma, a Pekinghez közeli helyzet és az olcsó, szél-, nap- és szénenergiára épülő áramellátás teszi vonzóvá. A cikk szerint első ízben kínai AI-cégek, köztük a DeepSeek, a ByteDance, az Alibaba és a Xiaohongshu is saját infrastruktúrába fektetnek bérelt felhőkapacitás helyett. A projektek azonban komoly vízhiányba ütközhetnek, mivel a szárazságra hajlamos térségben a helyi vízművek már most is éjszakai korlátozásokra kényszerülnek.