Sztori-szál · Üzlet · ellenőrizve 5 napja
AI-adatközpontok és az energiaigény robbanása
A nagy AI-modellek betanítása és futtatása olyan mennyiségű számítási kapacitást és energiát igényel, amely alapjaiban alakítja át az energiapiacokat és az infrastruktúra-fejlesztést.
Az elmúlt években a mesterséges intelligencia fejlődésének egyik legszűkebb keresztmetszete nem a szoftver, hanem a fizikai infrastruktúra: a chipek, az adatközpontok és az őket tápláló energiaellátás. A nagy nyelvi modellek betanítása és futtatása (inference) olyan GPU-klasztereket igényel, amelyek energiafogyasztása egyes becslések szerint egész országokéval mérhető össze. Ez a szál azokat a fejleményeket követi, amelyek a számítási kapacitás bővítéséhez, az adatközpontok építéséhez és az energiaellátás biztosításához kapcsolódnak.
A tét nem csak technológiai, hanem geopolitikai és környezeti is: a vezető techcégek (Microsoft, Google, Amazon, Meta) versenyt futnak egymással az adatközpont-kapacitás bővítéséért, miközben egyre gyakrabban fordulnak atomenergiához, gázhoz vagy saját erőműfejlesztéshez, hogy biztosítsák a szükséges áramot. Ez helyi közösségekkel, energiapiacokkal és klímacélokkal is konfliktusba kerülhet, miközben a chiphiány és az exportkorlátozások (különösen Nvidia-eszközök esetén) tovább szűkítik a kapacitást.
Érdemes követni ezt a szálat, mert az AI-fejlesztés üteme és költsége egyre inkább attól függ, hogy a szükséges hardver és energia mennyire áll rendelkezésre — ez pedig közvetlenül befolyásolja, mely cégek és országok tudnak versenyképesek maradni az AI-versenyben.
Kapcsolódó szálak és fogalmak
-
Nvidia chipexport-korlátozások
- atomenergia és techcégek
- hiperskálázó felhőszolgáltatók
- AI-modellek betanítási költségei
- klímahatás és AI
A szál fejleményei időrendben
-
2026. június 24., szerda Üzlet
Nvidia: az MI újraírja az orvosi munkát
A Nvidia egészségügyi részlegének vezetője, Kimberly Powell szerint a mesterséges intelligencia alapvetően átalakíthatja az orvosok mindennapi munkáját. Az MI képes csökkenteni az egészségügyi dolgozók adminisztratív terheit, ezzel több időt hagyva a betegellátásra. Powell kiemeli, hogy a technológia segíthet megoldani a képzett egészségügyi személyzet globális hiányát is. A Nvidia aktívan dolgozik olyan eszközökön, amelyek a klinikai folyamatokba integrálva javítják a hatékonyságot.
-
2026. június 25., csütörtök Üzlet
Az OpenAI és a Broadcom bemutatta a Jalapeño nevű egyedi AI-chipet
Az OpenAI együttműködve a Broadcommal kifejlesztette saját, egyedi tervezésű mesterséges intelligencia processzorát, amelynek neve Jalapeño. A chip kifejezetten az OpenAI nagy nyelvi modelljeinek (LLM) következtetési (inference) feladataira lett optimalizálva, célja a teljesítmény, a hatékonyság és a skálázhatóság javítása. A vállalat eddig elsősorban Nvidia GPU-kra támaszkodott, az új chip révén azonban csökkenthetné külső beszállítóktól való függőségét. A bejelentés a chipszektort egyébként is mozgásban lévő időszakban érkezett, amelyet a befektetői bizonytalanság és részvényárfolyam-ingadozások jellemeznek.
-
2026. június 25., csütörtök Szabályozás
AI-biztonsági aggodalmak: titkos rendszerek sérülékenységei és tiltott chipek feketepiaca
Az Anthropic Mythos nevű AI-modellje sebezhetőségeket talált az amerikai kormány titkosított rendszereiben, ami komoly biztonsági kérdéseket vet fel. Az Egyesült Államok nyomást gyakorol a Metára, hogy fogadja el az AI-rendszereinek független biztonsági felülvizsgálatát, miután aggodalmak merültek fel a technológia kockázataival kapcsolatban. Kínában az Nvidia tiltott AI-chipjeinek feketepiaci ára megduplázódott az exportkorlátozások következtében. A Wall Street eközben esett, miután a befektetők kételkedni kezdtek az AI-infrastruktúrára fordított hatalmas kiadások megtérülésében, különösen a félvezető szektorban.
-
2026. június 25., csütörtök Szabályozás
Megduplázódott a tiltott Nvidia-chipek feketepiaci ára Kínában
Az amerikai exportkorlátozások következtében a Kínában tiltott Nvidia mesterséges intelligencia processzorok feketepiaci ára megkétszereződött. Az Egyesült Államok szigorú intézkedései kockázatosabbá, nehezebbé és drágábbá tették az illegális chipbeszerzést. A fokozott ellenőrzés ellenére a tiltott chipek iránti kereslet Kínában továbbra is erős, mivel a fejlett AI-hardver hozzáférése stratégiai fontossággal bír. A magasabb ár és a nagyobb kockázat dacára a fekete piac aktív maradt, ami jelzi, hogy a korlátozások nem tudták teljesen elvágni a kínai szereplőket a fejlett AI-chiptől.
-
2026. június 26., péntek Üzlet
Chipverseny és tőzsdei nyomás: az OpenAI és riválisai új kihívásokkal szembesülnek
Az OpenAI a Broadcommal közösen bejelentett egy új, nagy nyelvi modellek következtetési feladataira optimalizált egyedi chipet, amellyel csökkenteni kívánják a növekvő számítási kapacitásigénytől való függőséget. Eközben az Anthropic és az OpenAI egyre erősebb versennyel néz szembe a nyílt forráskódú AI-modellek részéről, amelyek olcsóbb és szabadabban elérhető alternatívát kínálnak. A verseny kiéleződése különösen kritikus, mivel mindkét vállalat tőzsdei bevezetés előtt áll, és a befektetőknek be kell bizonyítaniuk üzleti modelljük fenntarthatóságát. A saját chip fejlesztése stratégiai lépés az OpenAI részéről, hogy csökkentse az Nvidia-függőséget és hosszú távon költségeit.
-
2026. június 27., szombat Üzlet
OpenAI saját chipet mutat be, az Alibaba pedig az Anthropic adatait lopta el – az AI-verseny új szintre lép
Az OpenAI bemutatta saját mesterséges intelligencia chipjét, amellyel csökkenteni kívánja függőségét az Nvidia-tól és erősíteni piaci pozícióját. Ezzel párhuzamosan kiderült, hogy az Alibaba kínai AI-modelljét részben az Anthropic Claude válaszainak engedély nélküli felhasználásával tanították be, ami komoly etikai és jogi kérdéseket vet fel. Az AI-láz a technológiai eszközök árait is felfelé hajtja globálisan, miközben az Apple is átírta chipfejlesztési ütemtervét: az M6 Pro és M6 Max sorozatot lemondták, hogy az AI-ra optimalizált M7 generációra összpontosíthassanak. Egy friss tanulmány szerint az AI negatívan befolyásolja a videojátékok eladásait is, jelezve, hogy a technológia hatása már a szórakoztatóiparra is kiterjed.
-
2026. június 27., szombat Üzlet
Az Nvidia uralmának vége felé? Az AI-óriások saját chipeket fejlesztenek
Az Nvidia évek óta dominálja az AI-chipek piacát, de ez az egyeduralom most megrendülni látszik. Az OpenAI bejelentette saját egyedi következtetési chipjét, a Jalapeñót, amelyet a Broadcommal közösen fejleszt. Az OpenAI mellett a Google, az Apple és a SpaceX is saját chipek gyártásába fogott, jelezve, hogy a nagyvállalatok csökkenteni kívánják az Nvidia-függőségüket. Ez a tendencia alapjaiban alakíthatja át az AI-hardverpiac erőviszonyait.
-
2026. június 27., szombat Üzlet
Az OpenAI bemutatja a Jalapeño AI-chipet – Broadcommal közösen épít Nvidia-alternatívát
Az OpenAI bejelentette saját fejlesztésű AI inferencia chipjét, amelyet Jalapeñónak neveztek el, és a Broadcommal közösen gyártanak. A lépéssel az OpenAI csatlakozik a Google, az Apple és a SpaceX sorához, amelyek szintén saját egyedi chipeket fejlesztenek. Az Nvidia évek óta dominálja az AI chipek piacát, ám egyre több nagyvállalat dönt az önálló chipfejlesztés mellett, hogy csökkentse az Nvidiától való függőséget.
-
2026. június 28., vasárnap Üzlet
Az AI-adatközpontok miatti RAM-drágulás hajtja fel az Apple és más techcégek fogyasztói árait
Tim Cook az Apple közelmúltbeli áremeléseit – a MacBook Pro 300, az iPad Air 150, a HomePod Mini 30 dolláros drágulását – "elkerülhetetlennek" nevezte, és az AI-iparágra hivatkozott. A The Verge cikke szerint a memóriagyártók átállították termelésüket az AI-adatközpontoknak szánt HBM-chipekre, ami a fogyasztói DDR5 RAM árának megugrásához vezetett. Carnegie Mellon és NYU Stern üzleti iskolák szakértői szerint ez nem átmeneti jelenség, hanem évekig tarthat, mert az AI-szerverek jövedelmezőbbek a gyártóknak. A cikk ugyanakkor kiemeli, hogy az Apple legalább négy egymást követő negyedévben rekorderedményeket ért el, hardveres árrése pedig 30-40 százalékos, egyes becslések szerint az iPhone 17 Pro esetében akár 47 százalékos lehet.
-
2026. június 29., hétfő Üzlet
A Micron piaci értéke megközelítette a Metáét és a Tesláét az AI-vezérelt memóriachip-kereslet miatt
A Micron részvényárfolyama egy hónap alatt több mint 236%-ot emelkedett, pénteken 1,27 billió dolláros piaci kapitalizációval zárt – megközelítve a Meta (1,39 billió) és a Tesla (1,42 billió) értékelését. A TechCrunch beszámolója szerint a felfutás mögött az AI-adatközpontok építési hulláma áll, amely súlyos hiányt okozott a DRAM-, NAND- és különösen a nagy sávszélességű memóriachipekből (HBM). Az Nvidia és a nagy felhőszolgáltatók – Microsoft, Amazon AWS, Google, Meta, Oracle – hatalmas mennyiségben vásárolják a memóriát, ami a RAMageddon.
-
2026. június 29., hétfő Üzlet
Ausztrál nyugdíjalapok: a megtakarítások akár 12%-a AI- és tech-részvényekben van
Az ausztrál szuperannuációs alapok portfólióinak becslések szerint átlagosan 12%-a mesterséges intelligenciához kötődő vállalatokba – köztük az Nvidia, Apple, Microsoft, Alphabet, Amazon, Meta és Tesla részvényeibe – van fektetve, mivel a globális indexek erősen az amerikai tech-szektor felé tolódtak. Az Asfa szerint sok alap a SpaceX-ben is érdekelt, amely június 12-én a világ eddigi legnagyobb tőzsdei bevezetésével debütált. A Morningstar szakértője szerint a SpaceX közvetlen hatása az ausztrál portfóliókra szerény: az átlagos kitettség tagonként mintegy 50 ausztrál dollár. A tech-túlsúly ugyanakkor etikai és kockázati kérdéseket is felvet.
-
2026. június 30., kedd Kutatás
A Flexion Robotics humanoid robotja önállóan navigál irodai környezetben, szimulációban tanult készségek kombinálásával
A svájci Flexion Robotics – amelyet volt Nvidia-robotikai kutatók alapítottak – egy módosított Unitree humanoid robotot mutatott be, amely szöveges utasítás alapján önállóan hajt végre összetett irodai feladatokat: lépcsőzik, lifttel közlekedik, ajtót nyit, csomagot bont és polcra pakol. A cég állítása szerint a rendszer lényege, hogy az egyes készségeket (járás, egyensúlyozás, tárgyak kezelése) szimulációban tanítják be megerősítéses tanulással, majd egy fő AI-modell – amely emberekről készült videókból tanulja meg a cselekvések sorrendjét – valós időben kombinálja ezeket. A megközelítés a Flexion szerint hatékonyabb a szokásos teleoperált betanításnál, mert kevesebb emberi beavatkozást igényel, és ismeretlen környezetben is működik. A bemutató egyetlen videón alapul, így a rendszer megbízhatóságáról és általánosíthatóságáról egyelőre nem áll rendelkezésre független értékelés.
-
2026. július 1., szerda Üzlet
Zürich a világ egyik legsűrűbb AI-kutatási központjává vált – a Silicon Valley kihívója
A MIT Technology Review beszámolója szerint Zürich és a Nagy-Zürichi Régió az elmúlt két évtizedben a világ egyik legkoncentráltabb technológiai K+F központjává nőtte ki magát: az Apple, Anthropic, Google, Meta, Microsoft, NVIDIA és OpenAI egyaránt működtet ott kutatóbázist. A cikk szerint Svájc több mint tíz éve vezeti a Globális Innovációs Indexet, a világ élén áll az egy főre jutó szabadalmak terén, és GDP-je 3,3%-át fordítja K+F-re. A kockázati tőke több mint 60%-a deep tech területre irányul, ami globálisan a legmagasabb arány. A google.org idén egymillió dolláros támogatást ígért a Svájci Nemzeti AI Intézetnek. A cikk ugyanakkor megjegyzi, hogy a tehetségbázis kis méretű, és a csapatok gyors bővítése nehezebb, mint más európai központokban.
-
2026. július 2., csütörtök Kutatás
Megerősítéses tanulás az AI-ágensek finomhangolásában: NVIDIA útmutató és új kutatási keretrendszerek
Az NVIDIA technikai blogján részletes útmutatót tett közzé arról, hogyan alkalmazható a megerősítéses tanulás (RL) – különösen a verifikálható jutalmakkal történő RL (RLVR) és a GRPO módszer – vállalati AI-ágensek domain-specifikus finomhangolására. A cég szerint a Nemotron 3 Super modellt 21 verifikáló környezetben, mintegy 1,2 millió rollout segítségével képezték, a NeMo RL ökoszisztéma pedig nyílt modellekhez kínál skálázható RL-eszközöket. Emellett két nem lektorált kutatási munka is megjelent: a HyPOLE keretrendszer formális logikával (HyperLTL) vezérli a többágenses RL-t részleges megfigyelhetőség mellett, míg egy másik tanulmány elektromos járművek flottáinak intelligens töltését vizsgálja független többágenses RL-megközelítésekkel. Mindhárom forrás azt jelzi, hogy az RL túllépett az általános modellképzésen, és egyre inkább gyakorlati, specializált feladatokban alkalmazzák.
-
2026. július 4., szombat Üzlet
Az OpenAI 5%-os részesedést ajánlana a Trump-kormánynak az AI-boom hasznából
A Financial Times értesülése szerint Sam Altman, az OpenAI vezérigazgatója korai stádiumú tárgyalásokat folytat a Trump-kormányzattal arról, hogy az Egyesült Államok 5 százalékos tulajdonrészt kapjon a cégben. Altman állítása szerint ez a legjobb módja annak, hogy a köz is részesüljön az AI gazdasági előnyeiből; az ötletet először tavaly vetette fel Trumpnak. A cég legutóbbi, 852 milliárd dolláros értékelése alapján ez a részesedés mintegy 42,6 milliárd dollárt érne. A kormányzat más AI-cégektől – köztük a Google-tól és a Metától – is hasonló ajánlatot kért, de egyikük sem reagált nyilvánosan. A javaslatot a növekvő AI-ellenes közhangulat és a szabályozási nyomás is motiválhatja: friss közvélemény-kutatások szerint az amerikaiak 70%-a ellenzi az AI-adatközpontok építését a lakóhelyén, Bernie Sanders szenátor pedig jóval nagyobb, 50%-os egyszeri adót javasolt.
-
2026. július 4., szombat Eszközök
Az NVIDIA bizalmas számítástechnikája a Blackwell GPU-kon 98%-os teljesítményt nyújt hardveres AI-biztonság mellett
Az NVIDIA műszaki blogján közzétett benchmarkok szerint a Blackwell GPU-kra épülő Confidential Computing (CC) technológia minimális teljesítményveszteséggel biztosít hardverszintű védelmet az AI-inferencia során. A vállalat állítása alapján a HGX B300-on futtatott Qwen 3.5-397B modellel végzett tesztek azt mutatták, hogy a CC bekapcsolása jellemzően 8% alatti áteresztőképesség- és késleltetés-többletet okoz, vagyis a teljesítmény eléri a védelem nélküli megoldás 98%-át. A biztonság alapja a gyártáskor a chipbe égetett privát aláírókulcs, az NVLink titkosítás és a távoli hitelesítés (NRAS). Az NVIDIA kiemeli, hogy optimalizálásokkal – CC-safe autotuning, aszinkron D2H másolás, CUDA-gráf támogatás – sikerült a biztonságos munkabeadás és a titkosított sávszélesség korlátait kompenzálni, így a rendszer termelési szintű, szabályozásnak megfelelő telepítésekre is alkalmas.
-
2026. július 5., vasárnap Üzlet
Az OpenAI láthatóan meg sem látogatta a brit Stargate UK projekt kulcshelyszínét
A Guardian oknyomozása szerint az OpenAI nem látogatta meg a Stargate UK projekt egyik kiemelt helyszínét, a North Tyneside-i Cobalt Parkot, és a brit kormány által beharangozott 30 milliárd fontos beruházási ígéretből mintegy 20 milliárd font pusztán hipotetikus volt. Közérdekű adatigénylés alapján sem az OpenAI, sem partnere, az Nscale nem egyeztetett az érintett helyi hatóságokkal; egyedül az Nvidia tett látogatást 2026 februárjában. A lap forrásai szerint a kormány Trump londoni látogatása előtt sürgősen keresett nagyszabású bejelentést, és az Nscale-t gyakorlatilag utasították a projekt támogatására. Az OpenAI áprilisban szabályozási aggályokra és magas energiaköltségekre hivatkozva felfüggesztette a terveket. A feltárt részletek alapján a Stargate UK az egyik legjelentősebb brit AI-fejlesztési bejelentés helyett inkább sajtóközleménynek tűnik.
-
2026. július 7., kedd Társadalom
Félelem és kiábrándulás egy skót faluban, amelyet AI-adatközpont helyszínéül választottak
A The Guardian beszámolója szerint a skót Lanarkshire-ben található Newarthill lakói egyre inkább úgy érzik, félrevezették őket az AI-adatközpont fejlesztés ígért előnyeivel kapcsolatban. Az Oakes Energy Services képviselői tavaly késő ősszel házról házra járva ajánlottak ingyenes napelemeket, fákat vagy készpénzt az ingatlanokért – a helyiek szerint ezek nem kikényszeríthető, írásos ígéretek. Két hónappal később a brit kormány Lanarkshire-t jelölte ki az egyik AI növekedési övezetnek.
-
2026. július 7., kedd Üzlet
A skóciai AI-adatközpont megújuló energiával való működtetése megvalósíthatatlannak tűnik a Guardian vizsgálata szerint
A Guardian oknyomozása szerint a brit kormány által januárban bejelentett, 8,2 milliárd fontos skóciai (Lanarkshire) AI-adatközpont – amelyet a CoreWeave és a DataVita épít – nem tudja teljesíteni azt az ígéretet, hogy 2030-ra kizárólag helyszíni megújuló energiaforrásokból működjön. Információszabadság-kérelmekkel beszerzett belső levelezésből kiderült, hogy a kormány és a fejlesztők a nyilvános ígéretek idején is tudták, hogy a telephelynek energiaellátási problémája.
-
2026. július 8., szerda Kutatás
Az NVIDIA nemegyenletes tenzorpárhuzamossága csökkenti a GPU-kiesések hatását az LLM-tréningben
Az NVIDIA műszaki blogján bemutatott Nonuniform Tensor Parallelism (NTP) keretrendszer lehetővé teszi, hogy nagy léptékű LLM-tréningek dinamikusan alkalmazkodjanak az átmenetileg elérhetetlenné váló GPU-khoz. Az NVIDIA állítása szerint az NTP az aktív GPU-k órajelének ideiglenes növelésével (dinamikus teljesítménynöveléssel) kompenzálja a kiesést, miközben a tenzor-újrafelosztás okozta többletterhelés 1% alatt marad. A módszer a Blackwell és Blackwell Ultra rendszerek NVLink összeköttetésein akár 72 GPU-s tartományokra is skálázható. Az NTP kísérleti jellegű megközelítés, amely a meglévő rugalmas skálázási technikákat – mint az adatreplikák eldobása vagy gyors ellenőrzőpont-újraindítás – egészíti ki azzal, hogy az áteresztőképesség-veszteséget minimalizálja a csökkentett rendelkezésre állás időszakában.
-
2026. július 8., szerda Eszközök
Az NVIDIA bemutatta a Vera CPU-t, amely 1,8-szoros teljesítménynövekedést ígér az ágens AI munkaterhelésekhez
Az NVIDIA saját közleménye szerint a Vera CPU architektúra 1,8-szoros fenntartott magteljesítményt nyújt teljes foglalatterhelés mellett a hagyományos x86-os adatközponti processzorokhoz képest. A monolitikus chipkialakítás 88 Olympus magot, egységes gyorsítótárat és Scalable Coherency Fabric technológiát tartalmaz, amellyel az NVIDIA állítása szerint 40%-kal alacsonyabb késleltetést és háromszoros magonkénti memória-sávszélességet érnek el a korábbi CPU-k felénél kisebb energiafogyasztás mellett. A cég kiemeli, hogy a Vera CPU csökkenti a GPU-k várakozási idejét az ágens AI rendszerek többlépéses munkafolyamataiban – sandbox-futtatások, eszközhívások, KV-cache koordináció terén –, ezáltal javítva a megerősítéses tanulás áteresztőképességét és a rendszerszintű hatékonyságot.
-
2026. július 9., csütörtök Üzlet
A SambaNova 1 milliárd dolláros tőkét vont be 11 milliárd dolláros értékeléssel
A SambaNova Systems AI-chipgyártó startup 1 milliárd dolláros befektetést zárt le Series F körében, 11 milliárd dolláros vállalati értékelés mellett, a General Atlantic vezetésével – közölte a TechCrunch. A kör még nem zárult le teljesen: a cég vezérigazgatója, Rodrigo Liang szerint heteken belül további befektetők csatlakoznak. Az új forduló mindössze öt hónappal a 350 millió dolláros Series E után érkezett. A vállalat az Intel-lel többéves partnerséget épít az AI-inferencia területén, és bejelentette, hogy a JPMorganChase inferencia-infrastruktúra-partnernek választotta a SambaNovát, SN40L és SN50 rendszereivel. Liang szerint az akvizíció lehetősége nyitott, de a növekedés inkább a tőzsdei bevezetés irányába terelheti a céget.
-
2026. július 9., csütörtök Üzlet
A Prime Intellect 130 millió dolláros A sorozatú befektetést kapott, egymilliárd dolláros értékeléssel
A Prime Intellect startup 130 millió dolláros Series A finanszírozási kört zárt le egymilliárd dolláros vállalatértékelés mellett. A kört a Radical Ventures vezette, és többek között az Nvidia Ventures, az Intel Capital és a Dell Technologies Capital is részt vett benne. A 2024-ben alapított vállalat célja, hogy a szervezetek a nagy AI-laboroktól függetlenül fejleszthessenek saját AI-ágenseket, ehhez számítási kapacitást, megerősítéses tanulási keretrendszert és kiértékelő eszközöket kínál egyetlen platformon. A TechCrunch beszámolója szerint a cég ügyfelei között szerepel a Ramp, a Zapier és más vállalatok, éves bevételi üteme pedig elérte a 100 millió dollárt – utóbbi adat a cég saját közlésén alapul.
-
2026. július 9., csütörtök Társadalom
Adatközpontok mint időzített bomba: az AI-boom környezeti és társadalmi ára
A The Guardian véleménycikkében Nicki Hutley közgazdász arra figyelmeztet, hogy az AI-vezérelt adatközpont-boom súlyos környezeti és gazdasági következményekkel jár. A cikk szerint világszerte több mint 10 000 aktív adatközpont működik, számuk becslések szerint 3,5-szeresére nőhet, mintegy 7 billió dolláros beruházással. Ausztráliában 286 aktív vagy tervezett központ van. Hutley amellett érvel, hogy bár az AI-nak vannak előnyei – például orvosi képalkotás javítása –, az adatközpont-beruházásokat ugyanolyan költség-haszon elemzésnek kellene alávetni, mint bármely infrastrukturális projektet, a kormányok mégis passzívak.
-
2026. július 10., péntek Eszközök
NVIDIA Nemotron 3 Ultra teljesítménye javítható LangChain harness profilok segítségével, finomhangolás nélkül
Az NVIDIA technikai blogja bemutatja, hogyan lehet a Nemotron 3 Ultra nyílt forráskódú modell ágensalapú rendszerekben elért pontosságát a LangChain Deep Agents harness profilok testre szabásával növelni, anélkül hogy finomhangolásra lenne szükség. A módszer lényege egy iteratív fejlesztési ciklus: kiértékelés futtatása, hibaelemzés, harness profil módosítások (például promptváltoztatások, middleware beillesztése), javítás ellenőrzése, majd újrafuttatás. Az NVIDIA szerint ez lehetővé teszi, hogy a modell megközelítse a zárt, drágább frontier modellek pontosságát. Az automatizálást az úgynevezett agentic proposer.
-
2026. július 11., szombat Eszközök
NVIDIA NeMo pipeline fél millió szintetikus pénzügyi hírfőcímet generált iteratív deduplikációval
Az NVIDIA technikai blogján bemutatott pipeline a NeMo Data Designer, NeMo Curator és Nemotron-3-Nano-30B-A3B modellek kombinálásával 82 iterációban 502 536 egyedi pénzügyi hírfőcímet állított elő 13 kategóriában egyetlen 8×B200 GPU-csomóponton. A munkafolyamat kulcsa a globális szemantikus deduplikáció (90%-os koszinusz-hasonlósági küszöb, 500 K-means klaszter), a centroidtól legtávolabbi példák kiválasztásán alapuló few-shot stratégia és a dinamikus kategória-eloszlás korrekció, amelyek együttesen ~82%-os kumulatív deduplikációs arányt értek el. Az NVIDIA szerint a keletkező FinHeadlineMix adatkészlet ritka pénzügyi események lefedésére is alkalmas, és kompakt tanulómodellek desztillációját, valamint klasszifikációját támogatja, amelyek megközelíthetik a tanármodell F1-teljesítményét pénzügyi NLP-benchmarkokon.
-
2026. július 11., szombat Kutatás
NVIDIA: JAX host offloading akár 57%-kal javítja a nagy nyelvi modellek tanítási átvitelét Blackwell GPU-kon
Az NVIDIA technikai blogja szerint a JAX keretrendszerben alkalmazott host offloading technika jelentősen csökkenti a GPU HBM-szűk keresztmetszetét LLM-tanítás során: a forward pass közben kiválasztott aktivációkat hoszt memóriába mozgatja, majd a backward passnál visszatölti. Az NVIDIA GB200 NVL72 rendszeren végzett MaxText kísérletekben a DeepSeek-V3 671B és Llama 3.1 405B modellekkel az aktiváció-újraszámításhoz képest akár 57%-os átviteli javulást mértek, különösen ritka MoE modellek esetén. A megoldás a Grace Blackwell NVLink-C2C 900 GB/s kétirányú sávszélességére épít, és az optimális eredményhez XLA ütemezési beállítások és Nsight Systems profilozás szükséges.
-
2026. július 13., hétfő Társadalom
A Guardian feltárta: egy skóciai, 8,2 milliárd fontos AI-adatközpont félrevezette a közvéleményt a megújuló energiával kapcsolatban
A Guardian oknyomozó cikke szerint egy vidéki Skóciában tervezett, 8,2 milliárd font értékű AI-adatközpont-komplexum félrevezető módon állította, hogy teljes egészében helyszíni megújuló energiával fog működni. Az újságírók helyszíni riportja – köziratok vizsgálata és belső dokumentumok beszerzése révén – kimutatta, hogy a technológiai óriások infrastrukturális ígéretei gyakran nem állják ki a valóság próbáját. A lap munkatársai szerint az AI-boomot fizikai korlátok, energia- és vízellátási kérdések, valamint a helyi közösségekre gyakorolt hatás határozza meg, nem csupán a digitális fejlesztések. A Guardian szerkesztősége hangsúlyozza, hogy a technológiai újságírás egyre inkább a terepmunkára és a fizikai világ vizsgálatára épül, mivel az adatközpontok a környezetvédelmi és energiapolitikai témákkal fonódnak össze.
-
2026. július 13., hétfő Kutatás
NVIDIA RoboLab: új értékelési platform az általános célú robotirányítási modellek tesztelésére
Az NVIDIA Research bemutatta a RoboLab nevű platformot, amely a robotikában használt általános célú irányítási modellek (policy-k) szisztematikus értékelésére szolgál szimulált környezetben. A rendszer az NVIDIA szerint megoldja a korábbi benchmarkok fő problémáit: a vizuális és feladatbeli átfedést a tréning- és tesztadatok között, a benchmarkok telítődését, valamint a magas beállítási költséget, miközben robotfüggetlen, gyorsan skálázható feladat- és jelenetgenerálást kínál. A platform részletes diagnosztikai eszközöket integrál, köztük részleges pontszámítást, SPARC-alapú mozgásminőség-elemzést és hibaeseménynaplózást. Az NVIDIA tervei szerint a RoboLab funkcionalitása 2026 augusztusától beépül az NVIDIA Isaac Lab-Arena rendszerébe.
-
2026. július 13., hétfő Szabályozás
Ausztrália szerzői jogi vitája: az AI-cégek lobbiznak, a művészek tiltakoznak, a kormánypárt megosztott
Az ausztrál kormány tavaly kizárta, hogy szerzői jogi mentességet adjon az AI-cégeknek a tartalmak felhasználására modelljeik betanításához, ám a The Guardian cikke szerint a technológiai óriások folyamatos lobbija és egy belső kiszivárogtatás újra felszínre hozta a kérdést. A Labor párton belül megosztottság alakult ki: egyes miniszterek az AI-befektetések és adatközpontok vonzását szorgalmazzák, míg mások a szerzői jogok védelmét tartják elsődlegesnek. Anthony Albanese miniszterelnök a héten várhatóan egy nagyszabású beszédben vázolja fel az AI-szabályozás kormányzati irányát, bár a The Guardian szerint ez inkább vízió lesz, mint részletes szakpolitikai bejelentés. Írók és művészek – köztük Anna Funder írónő – felháborodásukat fejezték ki amiatt, hogy műveik engedély nélkül kerülhettek felhasználásra az AI-modellek betanításához.
-
2026. július 13., hétfő Társadalom
Egyre élesebb küzdelem bontakozik ki az AI-adatközpontok ellen a helyi közösségekben
A The Verge beszámolója szerint az AI-adatközpontok elleni közösségi ellenállás egyre erőteljesebbé válik világszerte. A jelenség előzménye, hogy már 2015-ben ír lakosok évekig tartó jogi csatában akadályozták meg az Apple egymilliárd dolláros adatközpontjának megépítését az írországi Athenryben – a cég végül 2018-ban feladta a projektet. 2026-ra az AI-adatközpontok energiaigénye olyan mértékűvé nőtt, hogy a lap szerint egyes létesítmények teljes amerikai tagállamok fogyasztásával vetekednek. Az Egyesült Államok Energiainformációs Hivatala (EIA) közlése alapján az idei évben a kereskedelmi energiafogyasztás – elsősorban az adatközpont-építkezések miatt – először haladja meg a lakossági fogyasztást. A közelben élő lakosok emelkedő energiaköltségekről, vízszennyezésről, zaj- és fényszennyezésről, valamint üvegházgáz-kibocsátási aggályokról számolnak be.
-
2026. július 14., kedd Üzlet
Altman és Musk szópárbaja rávilágít az űradatközpontok megvalósíthatóságának kérdéseire
Sam Altman és Elon Musk a hétvégén közösségi médiában csapott össze: Altman szerint Musk rövid távú űradatközpontokat ad el a nyilvános piaci befektetőknek, miközben a koncepció nem valósítható meg hamar. A TechCrunch szerint a szakértők – más űradatközpont-startupok vezetői, a Google orbitális számítástechnikai projektjének csapata és független mérnökök – egyetértenek abban, hogy a technológia addig nem lesz komoly üzletág, amíg sokkal olcsóbb rakéták és tömeggyártható, nagy teljesítményű műholdak nem állnak rendelkezésre. A SpaceX kétbillió dolláros értékelésének fő hajtóereje az orbitális adatközpont-terv, ám a cég IPO-bemutatóján elismerte, hogy a Starship rövid távon nem lesz teljesen újrafelhasználható. Musk szerint jövőre indulnak az első ilyen műholdak, a cikk azonban arra mutat rá, hogy a nagyüzemi gyártás és indítás valószínűleg csak a 2030-as években válhat realitássá.
-
2026. július 14., kedd Szabályozás
Albanese az AI-t a megújuló energiás átmenethez hasonlítja, és kormányzati szabályozási kereteket ígér
Anthony Albanese ausztrál miniszterelnök szerdán Sydneyben tart beszédet, amelyben a The Guardian forrásai szerint az AI fejlődését a megújuló energiára való átmenethez hasonló társadalmi fordulópontként mutatja be. A beszéd középpontjában a biztonság, a megfelelőség és a közösségi bizalom építése áll, különös tekintettel a munkaerőpiaci változásokra, a védelmi vonatkozásokra és az energiaigényes adatközpontok fejlesztésére. Munkapárti források szerint ugyanakkor a szerzői jogi reformokról, amelyek a kreatív iparágakat védenék a nagy techcégek szellemi tulajdont érintő profitszerzésével szemben, nem várható konkrét bejelentés. A háttérben az Anthropic MI-cég nyilvánosan hivatkozott ausztrál szabályozási bizonytalanságra, amely akadályozza új beruházásait. Közvélemény-kutatás szerint az ausztrálok megosztottak: 36% szerint az AI több kockázatot, 22% szerint több lehetőséget hordoz.
-
2026. július 15., szerda Eszközök
Az NVIDIA Cosmos 3 modell egyetlen nap alatt 93%-os pontosságra finomhangolható automatizált ágensalapú munkafolyamattal
Az NVIDIA technikai blogján bemutatott munkafolyamat szerint a Cosmos 3 Nano alapmodellt az NVIDIA TAO ágensképességeivel és LoRA-adaptációval kombinálva a videókérdés-válaszolási pontosság 54,41%-ról 93,35%-ra emelkedett a Woven Traffic Safety adathalmazon, kevesebb mint egy nap alatt, minimális manuális beavatkozással. Az NVIDIA állítása szerint a TAO ágensképességek automatizálják az adatkezelést, a kiindulási értékelést, a LoRA-konfigurálást és a hiperparaméter-optimalizálást, ami jelentősen csökkenti a mérnöki ráfordítást. A Cosmos 3 mixture-of-transformers architektúrája egyesíti a többféle modalitás – szöveg, kép, videó, hang – feldolgozását. Az éles üzembe helyezést a Cosmos 3 Reasoner NIM mikroszolgáltatás egyszerűsíti, amely OpenAI-kompatibilis végpontként szolgálja ki a finomhangolt LoRA-adaptereket, kiküszöbölve a hagyományos infrastrukturális komplexitást.
-
2026. július 15., szerda Kutatás
Ötezer Kaggle-versenyző tanulságai az AI-következtetés javításáról az NVIDIA Nemotron kihívásban
Az NVIDIA Nemotron Model Reasoning Challenge keretében több mint 5000 résztvevő dolgozott azon, hogyan javítható egy nyílt modell következtetési pontossága azonos infrastruktúra és korlátok mellett. Az NVIDIA technikai blogja szerint a legsikeresebb megoldások a következtetési lépések ellenőrzésére, a gondolati láncok tömörítésére a tokenkorláthoz, valamint célzott megoldók építésére összpontosítottak a legnehezebb feladattípusokhoz. A versenyzők LoRA-adaptereket tanítottak a Nemotron-3-Nano-30B modellhez, szintetikus gondolati lánc adatkészleteket építettek, és több mint ezer közösségi fórumbejegyzésben osztották meg tapasztalataikat. A szervezők kiemelik, hogy a közösségi tudásmegosztás és a teljes munkafolyamat-szemléletű mérnöki megközelítés bizonyult fontosabbnak, mint pusztán a végső válaszok finomhangolása.
-
2026. július 15., szerda Szabályozás
New York állam elsőként vezetett be moratóriumot a nagy adatközpontok építésére
New York lett az első amerikai tagállam, amely moratóriumot hirdetett a nagy adatközpontok építésére. A Wall Street Journal és a The Verge beszámolói szerint a kormányzó akár egyéves tilalmat rendelt el a nagyszabású adatközpont-beruházásokra, az állami törvényhozás által elfogadott törvényjavaslat pedig ennél is tovább mehet. Az MIT Technology Review megjegyzi, hogy az adatközpontok egyre szélesebb körű ellenérzést váltanak ki a helyi közösségekben. A lépés fontos precedenst teremthet más államok számára is, különösen a mesterséges intelligencia terjedésével járó infrastrukturális nyomás fényében, bár a moratórium hosszabb távú hatásai egyelőre nem ismertek.
-
2026. július 17., péntek Üzlet
Energiaipari tőzsdei bevezetések rekordszintre ugrottak az AI-adatközpontok energiaigénye miatt
Az energiaipari cégek tőzsdei bevezetései 2026 első felében 12,6 milliárd dollárt gyűjtöttek a Dealogic adatai szerint – ez a legmagasabb félévenkénti összeg a dotkombuborék 1999-es csúcsa óta, és jóval meghaladja a 2025-ös teljes évi 4,3 milliárd dollárt. A felfutás mögött az AI-adatközpontok hatalmas energiaigénye áll: az ICF előrejelzése szerint az amerikai áramkereslet 2026 és 2035 között 39 százalékkal nőhet. A befektetők a chipgyártókról egyre inkább az infrastruktúra-építő cégek felé fordulnak. A Forgent Power Solutions 1,7 milliárd dollárt gyűjtött februári IPO-ján, a Standard Nuclear pedig júliusban tervez amerikai debütálást.
-
2026. július 17., péntek Eszközök
A BlueField-4 DPU infrastruktúra-tehermentesítéssel skálázza az ágens AI-gyárakat
Az NVIDIA műszaki blogja részletezi, hogyan oldja meg a BlueField-4 DPU és a Vera BlueField-4 STX tárolóprocesszor az ágens AI munkafolyamatok infrastrukturális szűk keresztmetszeteit. A korábban bemutatott Vera CPU architektúrára épülő BlueField-4 akár 800 Gb/s hálózati kapcsolatot, 64 magos Grace CPU-t, PCIe Gen6-ot és LPDDR5X memóriát integrál, a hálózati, tárolási és biztonsági feladatokat a gazdagép processzoráról átterhelve. A DOCA szoftverplatform kontextus-újrafelhasználást, zero-trust biztonságot és többbérlős életciklus-kezelést biztosít. Az NVIDIA állítása szerint mindez magasabb GPU-kihasználtságot, kiszámíthatóbb késleltetést és alacsonyabb tokenenkénti költséget eredményez.
-
2026. július 17., péntek Szabályozás
New York kormányzója mesterséges intelligenciával elemzi az állam összes szabályozását
Kathy Hochul, New York állam kormányzója a Bloomberg Odd Lots podcastjában elmondta, hogy csapata mesterséges intelligenciát használ az állam minden egyes jogszabályának, rendeletének és szakpolitikájának átvizsgálására, hogy kiszűrjék az elavult előírásokat. Hochul szerint a munka hagyományos módszerekkel mintegy öt évig tartott volna, az MI segítségével viszont néhány hónap alatt végeztek. Példaként olyan régies szabályokat említett, mint a kutyás vadászathoz szükséges huszonöt dolláros díj vagy az éjfél utáni munkavégzéshez szükséges engedély terhes személyek számára. A kormányzó hozzátette, hogy az eredmények alapján az elavult szabályokat el kívánják törölni. Mindezt annak kontextusában jelentette be, hogy New York elsőként az Egyesült Államokban nemrég moratóriumot rendelt el az új, nagy méretű MI-adatközpontok építésére.
-
2026. július 18., szombat Modellek
Kínai startup kiadta a világ legnagyobb nyílt AI-modelljét, szűkítve a lemaradást az Egyesült Államokkal szemben
Egy kínai startup bemutatta a világ eddigi legnagyobb nyílt forráskódú mesterségesintelligencia-modelljét – a Reuters és a Gizmodo beszámolói szerint a modell egyes Anthropic- és OpenAI-modellekkel versenyképes teljesítményt nyújt. A bejelentés hatására az AI- és félvezetőipari részvények esésnek indultak a Bloomberg tudósítása alapján. A lépés illeszkedik Kína nyílt forráskódú AI-stratégiájába, amelyről a MIT Technology Review korábban részletesen írt. Emellett a South China Morning Post szerint a kínai Nvidia-alternatívák is egyre nagyobb teret nyernek, Hszi Csin-ping pedig a fejlődő országok felé pozicionálta Kínát mint AI-partnert a CNBC szerint. A fejlemények összességében arra utalnak, hogy a kínai–amerikai AI-szakadék szűkülhet.
-
2026. július 18., szombat Üzlet
Az Apple beperelte az OpenAI-t állítólagos hardvertitkok ellopása miatt, OpenAI-alkalmazottak rivális szuperPAC-ot hoztak létre
A WIRED beszámolója szerint az Apple múlt pénteken keresetet nyújtott be az OpenAI ellen, azt állítva, hogy a cég bizalmas hardverinformációkat – köztük ki nem adott iPhone-alkatrészekre vonatkozó adatokat – tulajdonított el jogtalanul. Emellett a WIRED értesülése alapján egyes OpenAI-alkalmazottak egy rivális szuperPAC-ot alapítottak, amelynek célja a mesterséges intelligencia szabályozásának erősítése, akár saját vezérigazgatójukkal szemben is. A két fejlemény együttesen tovább ronthatja az OpenAI hírnevét, különösen az Anthropickal folytatott versenyben. Ugyanezen héten New York állam elfogadta az első tagállami szintű adatközpont-moratóriumot, ami precedenst teremthet más államok számára is.
-
2026. július 20., hétfő Üzlet
Az Anthropic és a Meta akár 10 milliárd dolláros számítási kapacitás bérleti megállapodásról tárgyal
A New York Times információira hivatkozva a The Decoder arról számolt be, hogy a Meta tárgyalásokat folytat az Anthropic-kal adatközponti számítási kapacitás bérbeadásáról; az üzlet két év alatt akár 10 milliárd dollárt is elérhet. Az Anthropic júniusban terjesztette elő az ajánlatot, a Meta még vizsgálja azt, és bármelyik fél visszaléphet. Mark Zuckerberg korábban jelezte a befektetőknek, hogy a felesleges kapacitást értékesíthetik, ha a Meta saját AI-igénye nem nő elég gyorsan – a vállalat idén akár 145 milliárd dollárt is költhet, nagyrészt mesterséges intelligenciára. Az Anthropic oldalán a Claude Code iránti megnövekedett kereslet indokolja a többletkapacitás szükségességét, bár hosszú távon saját adatközpontokat kíván építeni, amelyek irányítására korábbi Google-vezetőket szerződtetett.
-
2026. július 21., kedd Üzlet
A Microsoft kiterjeszti AMD-partnerségét, az Nvidia chipmonopóliuma gyengül az AI-piacon
A Microsoft hivatalosan bejelentette, hogy az Azure felhőinfrastruktúráját az AMD legújabb Helios AI-platformjával és következő generációs EPYC processzoraival bővíti. Az együttműködés keretében három új virtuálisgép-típus érkezik: HDv2 adatfeldolgozásra, HXv2 elektronikai tervezésautomatizálásra és ND MI455X v7 AI-következtetési feladatokra. A The Decoder szerint az AMD egy másik nagy ügyfelet is megszerezhet: egy nyilvános GitHub-profil arra utal, hogy az Anthropic teszteli az AMD hardverét, de ez egyelőre nem megerősített. Satya Nadella szerint az ügyfeleknek több választási lehetőségre van szükségük az AI-infrastruktúrában, míg Lisa Su mérföldkőnek nevezte a partnerséget. Az Nvidia továbbra is erős árképzési pozícióban van, de az AMD és más egyedi chipgyártók egyre komolyabb versenyt támasztanak.
-
2026. július 21., kedd Üzlet
Jeff Bezos és a brit kormány 450 millió dollárt fektet a mesterséges anyagkutatással foglalkozó CuspAI startupba
A cambridge-i székhelyű CuspAI 450 millió dolláros B sorozatú tőkebevonást zárt le, amelyben többek között Jeff Bezos és a brit kormány szuverén AI-alapja is részt vett – a The Guardian beszámolója szerint a kétéves vállalat értékeltségét ezzel 2,6 milliárd dollárra taksálják. A cég az AI Materials Foundry nevű koalíciót indította el, amelyhez saját állítása szerint több mint 48 technológiai és ipari szereplő – köztük az Nvidia, a Meta és a Hyundai – csatlakozott. A CuspAI célja, hogy mesterséges intelligenciára épülő szoftverrel gyorsítsa új anyagok felfedezését, különösen a chipgyártásban használt ritka fémek kiváltására. Az alapítók szerint a következő évtizedek ipari haladását az eddig ismeretlen anyagok hiánya korlátozhatja, és ezt a problémát kívánják megoldani. A bevont tőkét nemzetközi terjeszkedésre, többek között szingapúri iroda nyitására és létszámbővítésre fordítják.
-
2026. július 21., kedd Eszközök
Az NVIDIA bemutatta a hatodik generációs NVLink hálózati technológiát az AI-gyárak számára
Az NVIDIA technikai blogján ismertette a hatodik generációs NVLink skálázási hálózatot, amelyet kifejezetten AI-gyárak számára terveztek. A vállalat szerint a technológia GPU-nként akár 3,6 TB/s sávszélességet, rack-szinten 260 TB/s összesített sávszélességet és 130 TFLOPS hálózaton belüli számítási kapacitást biztosít, jelentősen felülmúlva a hagyományos Ethernet-megoldásokat nagy méretű nyelvi modellek és MoE-architektúrák esetén. Az NVIDIA állítása alapján a Hopper-ről Blackwell-generációra való áttérés ötvenszeres javulást hozott a tokenek per watt mutatóban. A platform szoftveres integráció (Dynamo, TensorRT-LLM, NCCL, NIXL) mellett üzembiztonsági funkciókat is kínál, mint a menet közbeni frissítés, dinamikus útválasztás és melegtárolócserélhető kapcsolók. A jövőbeli bővíthetőséget az NVLink Fusion és az NVLink-C2C technológiák szolgálják.
-
2026. július 21., kedd Eszközök
Az NVIDIA Omniverse ovrtx szenzorszimuláció mostantól modulárisan integrálható meglévő alkalmazásokba
Az NVIDIA bejelentette, hogy az Omniverse könyvtárak – amelyek immár az NVIDIA Agent Toolkit részét képezik – moduláris API-kat kínálnak meglévő alkalmazások bővítéséhez. Az ovrtx nevű, előzetes kiadásként GitHubon elérhető könnyűsúlyú C/Python SDK kamera-, lidar- és radarszenzor-szimulációt valósít meg RTX technológiával, OpenUSD-jelenetekből valós idejű, fizikailag megalapozott kimeneteket állítva elő. A cég szerint a rendszer integrálható CAD-, Blender-, robotikai és felhőalapú tervezési munkafolyamatokba, például a PTC Onshape Render Studióba. Az ovrtx az Omniverse többi könyvtárával – fizikai szimuláció (ovphysx), streamelés (ovstream), adatkezelés (ovstorage) és megosztott USD-jelenetkezelés (ovstage) – együttműködve többmodális szimulációs csővezetékeket támogat szintetikus adatgyártáshoz, digitális ikrekhez és fizikai AI-validációhoz.
-
2026. július 21., kedd Eszközök
Az Amazon Quick és az NVIDIA NeMo Agent Toolkit együttműködése ellátásilánc-kezelő ügynökfolyamatokat kínál
Az AWS hivatalos blogján bemutatott megoldás az Amazon Quick és az NVIDIA NeMo Agent Toolkit összekapcsolásával specializált, ügynökalapú munkafolyamatokat épít ellátásilánc-kockázatok kezelésére. Az Amazon Quick egységes, beszélgetésalapú felületet biztosít strukturált és strukturálatlan vállalati adatokhoz, több mint száz előre elkészített csatlakozóval és MCP-protokollon keresztül elérhető ügynökfolyamatokkal. Az NVIDIA NeMo Agent Toolkit nyílt forráskódú, keretrendszer-független könyvtárként működik, amely LangChain, LlamaIndex, CrewAI és más eszközökkel is kompatibilis. A bemutatott példában egy ellátásilánc-elemző az irányítópult kontextusából kiindulva, a csevegőügynökön keresztül automatikusan vizsgálja a zavarokat, hívja meg az eszközöket, validálja a javaslatot, és rangsorolt kockázatcsökkentési tervet ad vissza a tervezőnek.
-
2026. július 22., szerda Eszközök
Az NVIDIA GB300 NVL72 világrekordot állított a DeepSeek-V3 671B MoE-modell előtanításában
Az NVIDIA saját technikai blogján jelentette be, hogy a GB300 NVL72 rendszer GPU-nként 1 648 TFLOPS teljesítménnyel világrekordot ért el a DeepSeek-V3 671B paraméteres Mixture of Experts (MoE) modell előtanításában. A vállalat szerint a teljesítmény kulcsa a teljes rack-szintű együttervezés: az ötödik generációs NVLink GPU-nként 1,8 TB/s sávszélességet és összesen 130 TB/s nem blokkoló all-to-all kommunikációt biztosít. Az NVIDIA állítása alapján szoftveres optimalizálásokkal – a Megatron Core, a TorchTitan és a JAX keretrendszerek révén – 3–10-szeres teljesítménynövekedést értek el az előző generációhoz képest, miközben a GPU-nkénti áteresztőképesség 256-ról 1 024 GPU-ra skálázva is 97% felett maradt. A MoE-architektúrák hatékonyságának lényege, hogy a tokenek csak a paraméterek kis részhalmazát aktiválják, ami viszont fokozott kommunikációs igényt támaszt a GPU-k között.
-
2026. július 22., szerda Kutatás
Az anyagtudomány fejlődése kulcsfontosságú a következő generációs mesterséges intelligencia fenntartásához
A félvezetők és adatközpontok egyre szélsőségesebb fizikai követelményeinek kielégítése az anyagtudomány folyamatos fejlődését igényli – állítja az MIT Technology Review elemzése. A cikk szerint a mesterséges intelligencia teljesítménynövekedése nemcsak a chipek tervezésétől és a rendszerarchitektúrától függ, hanem az azokat működtető anyagoktól: polimerektől, elasztomerektől és speciális folyadékoktól. A modern félvezetőgyártás több ezer, szorosan szabályozott lépést foglal magában, ahol a hőmérséklet vagy a kémiai instabilitás minimális eltérései is hibákat okozhatnak és növelhetik a költségeket. Az anyaginnovációs cégek feladata, hogy az egyre nagyobb tisztaságot, kémiai és plazmaállóságot, valamint stabilitást biztosító anyagokat fejlesszenek, amelyek nélkül az AI-fejlődés fizikai korlátokba ütközne.
-
2026. július 22., szerda Üzlet
Az Nvidia a Vera Rubin platformmal a teljes adatközponti chippiacot célozza meg
Az Nvidia a Vera Rubin rendszerrel nemcsak GPU-, hanem CPU-szállítóként is pozicionálni kívánja magát az AI-adatközpontok piacán – derül ki a WIRED beszámolójából egy Santa Clara-i műhelybeszélgetésről. A Vera Rubin NVL72 rack 36 Vera CPU-t és 72 Rubin GPU-t integrál egyetlen folyadékhűtéses egységbe, és az Nvidia állítása szerint wattonként tízszer annyi tokent képes feldolgozni, mint az előző generációs Blackwell. Ian Buck, az Nvidia gyorsított számítástechnikáért felelős alelnöke szerint a cég párhuzamosan fejleszt új CPU- és GPU-architektúrákat. A WIRED szerint az OpenAI már használatba vett egy Vera Rubin rackot. Az Nvidia műszaki blogja részletezi, hogy a Rubin GPU 336 milliárd tranzisztort, 288 GB HBM4 memóriát és harmadik generációs Transformer Engine-t tartalmaz, amelyet kifejezetten az ágens jellegű, többlépéses AI-feladatokra optimalizáltak.
-
2026. július 23., csütörtök Üzlet
Az AMD akár 5 milliárd dollárt fektet az Anthropicba, cserébe a Claude-fejlesztő az AMD chipjeit választja
Az AMD bejelentette, hogy akár 5 milliárd dolláros befektetést hajt végre az Anthropicban – a The Verge beszámolója szerint az ügylet részeként az Anthropic akár 2 gigawattnyi kapacitásban telepíti az AMD Instinct MI450 AI-gyorsítóit a chipgyártó új Helios rack-szintű rendszerében. Az első gigawattnyi kapacitást 2027 első felében tervezik üzembe helyezni. A partnerség emellett többéves mérnöki együttműködést is tartalmaz: az AMD saját szoftverfejlesztésében és terméktervezésében is alkalmazza majd az Anthropic Claude modelljét. Az Anthropic korábban a Google-lal, az Amazonnal, a SpaceX-szel és a TeraWulffal is kötött infrastrukturális megállapodásokat. A korábbi hírekhez képest – amelyek egy nem megerősített GitHub-profil alapján jelezték, hogy az Anthropic tesztelheti az AMD hardverét – most hivatalos, nagyszabású stratégiai megállapodás született a két cég között.
-
2026. július 23., csütörtök Eszközök
A TensorRT motorépítés immár valós időben nyomon követhető és megszakítható
Az NVIDIA technikai blogján bemutatta, hogyan használható a TensorRT-ben több kiadás óta elérhető IProgressMonitor API a motorépítés valós idejű követésére és megszakítására Python és C++ környezetben. A cég szerint nagy modellek és mély taktikakeresés akár percekig tartó építést eredményezhet, ami felügyelet nélkül elvesztegetett GPU-órákat okozhat. Az API három metódus felülírásával fa struktúrájú fáziskövetést és Ctrl-C vagy programozott leállítási jelekre való reagálást tesz lehetővé. Az integráció révén a haladási információ terminálba, IDE-be, HTTP-szolgáltatásba vagy ügynök-futtatókörnyezetbe továbbítható, de szálbiztonság és megszakítási késleltetés gondos kezelését igényli.
-
2026. július 24., péntek Kutatás
Bizalmas GPU-inferencia teljesítményvizsgálata NVIDIA H100-on Intel TDX környezetben
Kutatók összehasonlító mérést végeztek az NVIDIA H100 GPU-n futó nagy nyelvi modellek hagyományos és bizalmas számítástechnikai módú inferenciája között Intel TDX környezetben. A nem lektorált tanulmány a Mistral-7B és a Qwen3-30B-A3B modelleket vizsgálta. A szerzők szerint a bizalmas mód 21,8–27,8%-kal növelte az első token előállítási idejét, a globális áteresztőképesség pedig 17,7–21,1%-kal csökkent. Zárt hurkú tesztekben a veszteség 11,5–20,2% maradt, de a nagyobb modell hamarabb telítődött. Az eredmények szerint a bizalmas inferencia használható marad, de a kapacitástervezésnek számolnia kell a többletköltséggel.
-
2026. július 24., péntek Eszközök
Az NVIDIA bemutatta a Vera CPU-t: Olympus magokkal az ágens AI munkaterhelésekre tervezve
Az NVIDIA technikai blogján ismertette a Vera CPU architektúráját, amelyet az Olympus processzormag köré épített, kifejezetten ágens AI munkaterhelésekre. A vállalat szerint a processzor az egyszálú teljesítmény maximalizálására fókuszál, mivel az ágens rendszerek szekvenciális, elágazás-intenzív és késleltetés-érzékeny programutakat futtatnak, amelyek eltérnek a hagyományos felhős CPU-k terhelésétől. Az NVIDIA állítása alapján a chip 3,4 TB/s sávszélességű koherenciafabrikot és akár 1,2 TB/s összesített sávszélességű LPDDR5X memóriát tartalmaz. A skálázhatóságot koherens NVLink-C2C, PCIe 6.4, CXL 3.1 és bizalmas számítástechnikai megoldások támogatják.
-
2026. július 24., péntek Eszközök
Az NVIDIA Nemotron 3 Nano modell testreszabása percek alatt elvégezhető a Prime Intellect Lab platformon
Az NVIDIA technikai blogján közzétett útmutató szerint a Nemotron 3 Nano nyílt modell testreszabása a Prime Intellect Lab platformmal mindössze öt perc helyi beállítást igényel. A bemutatott munkafolyamat három lépésből áll: kiindulási teljesítmény mérése, megerősítéses tanulás (reinforcement learning) futtatása egy Python matematikai környezetben, majd az eredmények kiértékelése – a folyamat végén letölthető LoRA adapter jön létre. Az NVIDIA szerint a testreszabás után jelentős pontosságjavulás érhető el. A blogbejegyzés kiemeli, hogy ugyanez a folyamat alkalmazható a nagyobb Nemotron 3 Super és Ultra modellekre is, a nyílt súlyok, adatok és tanítási receptek pedig a reprodukálhatóságot és az átláthatóságot szolgálják. A megoldás lényege, hogy az infrastrukturális és szaktudásbeli akadályokat a felhőalapú platform nagymértékben csökkenti.
-
2026. július 25., szombat Eszközök
NVIDIA ModelExpress: modellsúlyok villámgyors elosztása GPU-k között a klaszterben
Az NVIDIA bemutatta a ModelExpress (MX) nevű platformot, amely a nagy nyelvi modellek súlyainak klaszteren belüli mozgatását gyorsítja fel. A rendszer a betöltés előtt megkeresi, hol található már kompatibilis súlymásolat, és a leggyorsabb elérhető útvonalat választja: ha egy kiszolgáló társgépen megvannak a súlyok, azokat közvetlenül GPU-ról GPU-ra másolja RDMA-n keresztül az NIXL könyvtár segítségével, elkerülve az objektumtárolót, a lemezt és a gazdagép memóriáját. Az NVIDIA szerint az MX a DeepSeek-V4 Pro súlyait és a JIT kernelgyorsítótárat kevesebb mint 10 másodperc alatt képes átvinni egy új replikába. A platform többszálú streamelést, elosztott atomi gyorsítótárazást és GPUDirect Storage támogatást alkalmaz, valamint integrálódik a vLLM, SGLang, Dynamo és llm-d keretrendszerekkel, így az éles LLM-telepítések hidegindítási és skálázási idejét jelentősen csökkenti.
-
2026. július 26., vasárnap Társadalom
Óriási AI adatközpont tervei riasztják Melbourne lakóit
A Syncline Energy nevű vállalat egy 350 hektáros, korábban üres legelőn tervez adatközpontot építeni Melbourne külvárosában, Plumptonban. A cég közlése szerint a terület 40 százalékán, azaz 140 hektáron négy épületet emelnének, amelyek együttes kapacitása elérheti a 2,4 gigawattot – ez a Guardian szerint többet fogyasztana, mint Victoria legnagyobb erőműve, a Loy Yang A. Az építkezés a tervek szerint legalább két évig nem indul, mivel előbb a tervezési és környezetvédelmi engedélyeztetés zajlik. A projekt a lakosság körében komoly ellenállást váltott ki: több mint 3600-an írtak alá petíciót az alapos vizsgálat érdekében, ami a Guardian szerint az ausztráliai adatközpont-építési hullám elleni tiltakozás egyik gócpontjává vált.
-
2026. július 26., vasárnap Üzlet
Leszakadt vezeték világított rá az amerikai adatközpontok hálózati kockázatára
A Washington DC melletti PJM-hálózaton egy leszakadt vezeték miatt több mint 3 gigawattnyi adatközponti terhelés kapcsolt egyidejűleg tartalék áramforrásra, ami a PJM saját adatai szerint 3,1 gigawattos terheléskiesést okozott mintegy 30 másodperc alatt, majd további esések után a hálózatnak 11 percre volt szüksége a stabilizálódáshoz, szemben a megszokott néhány másodperccel. A Ting Labs IoT-szenzorhálózatának mérései szerint a feszültségingadozás Észak-Virginiától Chicagóig terjedt, bár áramkimaradás nem történt, csak a világítás vibrált. A Reuters szerint a leválasztott adatközpontok a PJM aznapi teljes terhelésének körülbelül 3 százalékát tették ki. Az ON.Energy technológiai vezetője, Ricardo de Azevedo szerint ez a szénbányász kanárija: figyelmeztető jel arra, hogy az ilyen, nagy terhelésű incidensek egyre gyakoribbá válnak, hasonlóan egy két évvel korábbi PJM-hálózati esethez.
-
2026. július 27., hétfő Kutatás
Fénnyel frissítenék az AI-chipek memóriáját energiatakarékosan
A Cornell Tech kutatói új optikai vevőt mutattak be, amely fénnyel közvetlenül az AI-processzor memóriáját írja át, elkerülve az energiaigényes elektromos adatátvitelt. A rendszer QR-kódszerű fényminták formájában küldi el a modellparamétereket, amelyeket a chip a fotoáramok segítségével közvetlenül digitális formában dolgoz fel, analóg átalakító áramkörök nélkül. A kutatók szerint ez csökkentheti az adatközpontok, önvezető autók és peremhálózati AI-eszközök energiaigényét, mivel az optikai kapcsolatok kevesebb veszteséggel mozgatnak adatot, mint a fémvezetékek. A fejlesztést a VLSI Technology & Circuits szimpóziumon mutatták be júliusban, egyelőre laboratóriumi demonstráció szintjén.
-
2026. július 27., hétfő Társadalom
Doctorow: az AI-buborék kipukkanásakor eltűnt szaktudás nehezen pótolható
Cory Doctorow sci-fi író és újságíró új könyvében azt állítja, hogy nem az a kérdés, kialakult-e AI-buborék, hanem az, mikor pukkan ki. Szerinte a lufit öböl-menti állami vagyonalapok és milliárdosok adatközpont-beruházásai, valamint a chipgyártók, AI-cégek és tech vállalatok közötti körkörös befektetések tartják életben, és ezek megingása indíthatja el az összeomlást. Doctorow úgy véli, azok a vezetők, akik dolgozóikat AI-eszközökkel váltották le, nehezen szerzik majd vissza az elvesztett üzleti szaktudást, mert az elbocsátott munkavállalók fejében lévő tapasztalat nem pótolható gyorsan. A kreatív szakmákat is arra figyelmezteti, hogy ne kizárólag a szerzői jogban bízzanak védelemként az AI-cégekkel szemben.
-
2026. július 28., kedd Modellek
Az NVIDIA Nemotron 3 Ultra vezeti a nyílt modellek mezőnyét chiptervezési kódolásban
Az NVIDIA saját közleménye szerint az ACE-RTL nevű ágens és a Nemotron 3 Ultra modell kombinációja élen jár a regiszter-transzfer szintű (RTL) chiptervezési feladatokban. A vállalat állítása szerint az iteratív generálás-tesztelés-visszacsatolás munkafolyamatot alkalmazó rendszer a CVDP benchmarkon 97,1 százalékos átlagos sikerarányt ért el kilenc feladatkategóriában, megelőzve a GLM 5.2 és a Kimi K2.6 modelleket, akár 71 százalékkal kevesebb tokenfelhasználás mellett. Az NVIDIA szerint a Nemotron 3 Ultra hibrid Mamba-Attention keverék-szakértői architektúrája és szintetikus RTL-adatokon végzett tanítása teszi lehetővé az olcsó, hosszú kontextusú következtetést, amely alapot adhat a Cadence, Siemens és Synopsys tervezőeszközeivel való integrációhoz. Az állítások a gyártó saját mérésein alapulnak, független megerősítés egyelőre nem ismert.
-
2026. július 28., kedd Modellek
NVIDIA nyílt AI-modellje kvantumszámítógépeket kalibrálna
Az NVIDIA saját blogbejegyzése szerint megjelent az Ising Calibration 1.5, egy 31 milliárd paraméteres, nyílt forráskódú vizuális-nyelvi modell, amely kvantumprocesszorok diagnosztikai kimeneteit értelmezi és javaslatot ad a hangolásukra. A vállalat állítása szerint a modell BF16 pontosságnál 11,4 százalékkal kisebb az előző verziónál, és most először NVFP4-kvantált formában is elérhető, ami egyetlen GPU-n vagy NVIDIA DGX Spark eszközön futtatható. Az NVIDIA a QCalEval nevű benchmarkon mért eredmények alapján azt közli, hogy a modell minden nyílt modellnél jobban teljesít, és felveszi a versenyt a vezető zárt rendszerekkel is. A modellt több kubitmodalitás – szupravezető kubitok, kvantumpöttyök, ionok, neutrális atomok – partneradatain tanították, és a teljes csomag, beleértve a súlyokat és az adatkészleteket, OpenMDW licenc alatt válik elérhetővé.
-
2026. július 28., kedd Eszközök
Az NVIDIA nyílt forráskódú NOOA ügynökkeretet mutatott be
Az NVIDIA Labs technikai blogján jelentette be a NOOA (NVIDIA Labs Object-Oriented Agents) nevű, nyílt forráskódú, objektumorientált AI-ügynökkeretet. A vállalat közlése szerint a rendszer minden ügynököt egyetlen Python osztályként kezel, ahol a metódusok a képességeket, a mezők az állapotot, a docstringek pedig a promptokat testesítik meg, a típusannotációk pedig kikényszerített szerződésként működnek. A keretrendszer típusos, kapcsolati memóriát tart fenn egy emberi szemmel is olvasható SQLite-adatbázisban, ami az NVIDIA szerint feleslegessé teszi a kontextus-tömörítést. A cég állítása alapján a NOOA a SWE-bench Verified, a CyberGym L1 és az ARC-AGI-3 benchmarkokon jobb pontosságot és alacsonyabb tokenköltséget ér el a korábbi keretrendszerekhez képest, a kódot és kiértékeléseket pedig nyilvánosan elérhetővé tették.
-
2026. július 30., csütörtök Eszközök
NVIDIA útmutató: önhosztolt, ellenőrzött AI kódolóasszisztens NeMo Guardrails-szal
Az NVIDIA hivatalos technikai blogja útmutatót közöl, amellyel saját infrastruktúrán, StarCoder2-7B NIM végponttal futtatható AI kódolóasszisztens építhető ki. A vállalat állítása szerint ez megoldja három tipikus problémát: a forráskód nem hagyhatja el a hálózatot, a modell időnként kitalált csomagneveket javasol, ami ellátásilánc-kockázatot jelent, és nincs auditnyom, ha egy generált módosítás hibát okoz. A megoldás NeMo Guardrails házirend-réteget használ, amely megtagadja a hozzáférést emberi jóváhagyáshoz kötött fájlokhoz, egy CI-lépés kiszűri a hallucinált csomagokat, Prometheus/Grafana metrikák pedig mérik a hibaarányra gyakorolt hatást. Az NVIDIA szerint a validáció a modellen kívül történik, ami fokozatos bevezetést és auditálható munkafolyamatot tesz lehetővé, legalább 24 GB memóriájú GPU-t igénylő környezetben.
-
2026. július 30., csütörtök Eszközök
NVIDIA GPU-alapú fizikai szimulációt épít egészségügyi robotokhoz
Az NVIDIA saját blogbejegyzésében bemutatta a Medical Physics Simulation keretrendszert, amely az Isaac for Healthcare platform része, és GPU-natív, moduláris szimulációs környezeteket kínál orvosi robotok fejlesztéséhez. A vállalat állítása szerint az endoluminális és sebészeti modulok valós idejű, nagy pontosságú eszköz-anatómia modellezést tesznek lehetővé Warp, Newton Physics és CUDA felhasználásával, célként a klinikai adathiány pótlását megjelölve, mivel a valós demonstrációk száma jellemzően csak néhány száz. Az NVIDIA szerint a Cosmos-H generatív világmodell integrálásával szintetikus adatok és akció-feltételes videó-előrejelzés is előállítható. A leírás kizárólag vállalati technikai blogbejegyzésen alapul, független megerősítés vagy klinikai validáció nem szerepel a forrásban.
-
2026. július 31., péntek Eszközök
NVIDIA: rejtett konfigurációs hibák lassíthatják az AI-klasztereket
Az NVIDIA technikai blogja szerint azonos H100, GB200 NVL72 vagy GB300 NVL72 hardverből épített AI-klaszterek betanítási teljesítménye jelentősen eltérhet egymástól, akár 8-12 százalékos réssel a referenciaarchitektúrához képest ugyanazon munkaterhelés mellett. A vállalat állítása szerint ennek oka nem a hardver, hanem a kernel, a hypervisor, a BIOS és az NCCL könyvtár beállításaiban felhalmozódó apró hibák, amelyek együtt az Exemplar Cloud minősítéshez szükséges 95 százalékos küszöb elmulasztásához vezethetnek. Négy valós esetet mutatnak be: hiányzó SMMU-képességek Grace CPU-kon, hibás CPU C-state és NUMA beállítások, elégtelen NCCL sor-pár párhuzamosság ConnectX-8 hálón, és a topológiafájlok konténerekbe nem továbbítása.
-
2026. augusztus 1., szombat Kutatás
AI-ügynökök biztonsági kockázatai: NVIDIA-teszt és kutatói ütemterv
Az NVIDIA AI Red Team fél éven át tesztelt vállalati AI-ügynököket, és állítása szerint visszatérő hibákat talált: hiányos hozzáférés-szabályozást, tetszőleges kódfuttatást lehetővé tevő eszközöket, kontrollálatlan hálózati kimenetet és nyílt szövegű titkok tárolását. Az NVIDIA szerint a prompt-alapú és LLM-bíróra épülő védelmek megbízhatatlanok social engineering és „frog-boiling” támadásokkal szemben, ezért determinisztikus, a modell irányítási körén kívüli architektúrai kontrollokat javasol: hozzáférés-korlátozást, sandboxolt futtatást, alapértelmezetten tiltó hálózati szabályokat és a tartós titkok kizárását. Egy különálló, lektorálatlan arXiv-preprint iparági és kormányzati szakértők bevonásával négy prioritási témát azonosít az AI-biztonság fejlesztésére, köztük az agentikus AI ellenséges nyomás alatti irányítását.
-
2026. augusztus 2., vasárnap Eszközök
Az NVIDIA gyakorlati tervezési útmutatót ad a hosszú kontextusú AI-modellek gyorsításához
Az NVIDIA hivatalos technikai blogja szerint a mesterséges intelligencia modellek figyelem-mechanizmusának teljesítményét a lekérdezés-fejek és kulcs-érték fejek aránya, a fejdimenzió és a szekvenciahossz határozza meg, ezek eltérően hatnak a feltöltési és a dekódolási fázisra. A cég szerint a dekódolás hatékonysága a csoportmérettel skálázódik, míg a feltöltést a szekvenciahossz uralja, ezért 128 vagy 256 fejdimenziót ajánlanak a GPU-memória illesztéséhez. Az NVIDIA négy gyakorlati irányelvet fogalmaz meg fejlesztőknek, köztük a KV-gyorsítótár tömörítését és a párhuzamosítási stratégia megválasztását a KV-fejek száma alapján, a TensorRT-LLM keretrendszerben implementálva. Az elemzés saját mérési adatokra és matematikai számításokra épül, tehát vállalati, gyártófüggő technikai ajánlás.
-
2026. augusztus 3., hétfő Üzlet
Kínai chipfejlesztések rengették meg a globális AI-részvénypiacot
A kínai CXMT memóriachip-gyártó sanghaji tőzsdei debütálása 466 százalékos árfolyamemelkedést hozott, ugyanaznap pedig arról érkezett hír, hogy Kína saját mélyultraibolya litográfiai eszközöket fejlesztett, amely technológia korábban a holland ASML monopóliuma volt. A hírek nyomán világszerte estek az AI-hoz kötődő részvények: a Kospi kedden 11,5, szerdán további 6 százalékot zuhant, a Nasdaq korrekcióba süllyedt, az Nvidia pedig több mint 5 százalékot vesztett, és az Apple átvette tőle a legnagyobb tőzsdei vállalat címet. Pénteken az Amazon és a Microsoft erős eredményei nyomán a piacok visszapattantak, de a hónap így is 2008 óta a legrosszabb volt a Kospi számára. A cikk értelmezése szerint a CXMT DRAM-chipeket gyárt, nem GPU-kat, ezért nem az Nvidia, hanem inkább az SK Hynix és a Micron versenytársa lehet.
-
2026. augusztus 3., hétfő Szabályozás
Kínai nyílt AI-modellek szítanak vitát Washingtonban és Szilícium-völgyben
A Guardian szerint az elmúlt hetekben kínai fejlesztésű, ingyenesen letölthető, nyílt súlyú AI-modellek – például a Moonshot AI Kimi K3 nevű rendszere – piaci zavart okoztak, mivel egyes alkalmazásokban felveszik a versenyt az OpenAI és az Anthropic drágább, zárt termékeivel. A lap állítása szerint ez megosztotta mind a Fehér Házat, mind a techipart: egyes chipgyártók és cégek az olcsó nyílt modellek mellett állnak, míg az OpenAI és az Anthropic biztonsági kockázatokra hivatkozva óvna tőlük. Bessent pénzügyminiszter kínai cégek elleni szankciókat helyezett kilátásba állítólagos szellemitulajdon-lopás miatt, míg Lutnick kereskedelmi miniszter startupalapítóktól kapott leveleket a nyílt modellek megtartása mellett. A cikk szerint a Microsoft, az Nvidia, a Palantir és a Meta közös levélben kérte a törvényhozókat, ne korlátozzák a nyílt modellek használatát.
-
2026. augusztus 4., kedd Eszközök
NVIDIA szerint Vera storage-processzora akár 3,7-szer gyorsabb titkosítási feladatokban
Az NVIDIA saját technikai blogján közölt benchmarkeredményei szerint a Vera BlueField-4 STX storage-processzor – amely 88 Olympus Armv9.2 magot, Spatial Multithreading technológiát és SOCAMM2 LPDDR5X memóriát integrál – felülmúlja az x86 CPU-kat AI-natív adatplatformok tárolási feladataiban. A vállalat állítása szerint a chip titkosításnál 1,43-szoros, dekódolásnál 1,29-szoros, Reed-Solomon hibajavításnál 3,26-szoros, CRC32C integritásellenőrzésnél 3,67-szoros, tömörítésnél 3,29-szoros sebességtöbbletet ér el. Az NVIDIA szerint ez lehetővé teszi, hogy az agentikus AI-munkafolyamatok alacsonyabb energia- és hűtési igény mellett skálázódjanak. Az adatok kizárólag a vállalat saját, független megerősítés nélküli mérésén alapulnak.
-
2026. augusztus 5., szerda Modellek
NVIDIA bemutatta az Alpamayo 2 Super önvezető AI-modellt
Az NVIDIA hivatalos bejelentése szerint az Alpamayo 2 Super egy 34 milliárd paraméteres, nyíltan elérhető vizuális-nyelvi-cselekvési modell, amely önvezető autók fejlesztését hivatott egységesíteni. A rendszer a 32 milliárd paraméteres Cosmos 3 Super Reasoner nevű okfejtő komponenst és egy 2 milliárd paraméteres, diffúzió-alapú Action Expert modult kapcsolja össze, megerősítő tanulással utótanítva. A vállalat állítása szerint akár hét kamerából 360 fokos érzékelést biztosít, és egyetlen modellből ad jövőbeli pályát, okfejtési láncot, magas szintű cselekvési predikciót, jelenet-alapú kérdésválaszolást és automatikus adatannotálást. Az NVIDIA saját méréseket közölt, amelyek szerint a modell több benchmarkon – köztük pályaelőrejelzésben és LingoQA teszten – felülmúlja a korábbi megoldásokat, ezek az adatok azonban független validálás nélkül a vállalat saját közlésén alapulnak.
-
2026. augusztus 5., szerda Modellek
NVIDIA: a World Action Modellek felváltják a robotikai VLA-kat
Az NVIDIA technikai blogja szerint a robotpolitikák új generációja, az úgynevezett World Action Model (WAM) videó-alapú világmodellekre épül, nem a megszokott nyelv-látás (VLM) alapú vision-language-action (VLA) rendszerekre. A cég állítása szerint a WAM-ok jobban általánosítanak új feladatokra, robotokra és környezetekre, mert a tanult fizikai dinamikát használják, nem csak szemantikus leképezést. Az NVIDIA saját, nyílt Cosmos 3 modelljét mutatja be alapként, amely Mixture-of-Transformers architektúrára épül, és rendkívül nagy, több száz millió kép-, videó- és akciómintát tartalmazó adathalmazon tanult. A vállalat szerint a Cosmos 3 munkaállomásos és Jetson-alapú, valós idejű futtatást is lehetővé tesz, kevesebb feladatspecifikus adattal érve el jobb teljesítményt. Az állítások az NVIDIA saját blogbejegyzéséből származnak, független megerősítés nélkül.
-
2026. augusztus 5., szerda Társadalom
Influenszer-út miatt kapott bírálatot az OpenAI
Az OpenAI a hétvégén tartotta első „brand trip”-jét, egy New York állambeli, természetközeli üdülőhelyen, ahová elsősorban karrier- és üzleti témákkal foglalkozó influenszereket hívott meg. A meghívottak Instagramon és TikTokon posztoltak márkás ajándékokról, monogramos pizsamáról és a szálláshelyről, ám a videók komment szekciója élesen kritikus hangvételű lett. A hozzászólók az AI-fejlesztés környezeti hatásaira, az adatközpont-építések vitatott következményeire és az AI okozta munkahelyi elbocsátásokra hivatkozva bírálták az utat, egyesek pedig szóvá tették, hogy a meghívottak túlnyomó többsége fiatal nő volt. Bár az eredeti videók nézettsége viszonylag alacsony maradt, a rájuk reagáló tartalmak együttesen több százezer megtekintést gyűjtöttek, így az esemény online botránnyá nőtte ki magát.
-
2026. augusztus 6., csütörtök Üzlet
Texas felfüggeszti az adatközpontok új hálózati csatlakozásait
Greg Abbott texasi kormányzó augusztus 3-i bejelentésével moratóriumot rendelt el minden új adatközpont hálózati csatlakozására, amíg a fejlesztők nem adnak részletesebb tájékoztatást projektjeik hálózatra és közösségekre gyakorolt hatásáról. Az intézkedés a Texasi Közüzemi Bizottságot és az ERCOT hálózatüzemeltetőt érinti, akiknek átfogó auditot kell végezniük a csatlakozási folyamatban lévő adatközpontokon. Az ERCOT sorban jelenleg több mint 1800 projekt, összesen 474 gigawattnyi igény vár, ami a texasi csúcsfogyasztás ötszöröse, és ezek 90 százaléka adatközpontoktól érkezik. A kormányzói hivatal szerint ez a növekedés veszélyeztetheti a hálózat megbízhatóságát. Az ERCOT előrejelzése szerint az igények 2032-ig a jelenlegi rekord kétszeresére is nőhetnek, miközben egy 2014-es adókedvezmény évi több mint egymilliárd dollár kiesést jelent az államnak a Texas Tribune szerint.
-
2026. augusztus 10., hétfő Modellek
Google DeepMind diffúziós nyelvmodellé alakította a Gemma 4-et
A Google DeepMind technikai jelentést tett közzé a júniusban kiadott DiffusionGemma modellről. A vállalat állítása szerint nem nulláról építették: a meglévő Gemma-4-26B-A4B modellt alakították diffúziós architektúrává, az eredeti tanítási tokenmennyiség kevesebb mint tíz százalékának felhasználásával. A hagyományos, soronként tokeneket generáló modellekkel szemben a DiffusionGemma 256 tokenes blokkokat párhuzamosan finomít, ami Nvidia H100 gyorsítón a cég szerint mintegy 1500 token másodpercenkénti sebességet ad. A jelentés szerint a kétlépéses tanítás, benne az SD·RL nevű megerősítéses tanulás és mintavevő-desztilláció kombinációja, átlagosan tíz ponttal javította a teljesítményt érvelési benchmarkokon, a válaszok pedig mintegy 50 százalékkal rövidebbek lettek.
-
2026. augusztus 10., hétfő Társadalom
Adatközpontok vagy otthonok: Slough az AI vízlábnyomának ütközőpontja
A Guardian riportja szerint a londoni külvárosi Slough Trading Estate az AI-boom egyik fő brit adatközpont-központjává vált, ahol óriási, kaliforniai Equinix által üzemeltetett létesítmények is működnek. A cikk szerzője, John Harris helyszíni bejárása alapján a hőségben és aszályban szenvedő Nagy-Britanniában az adatközpontok hűtése hatalmas mennyiségű vizet és villamos energiát igényel, amit fosszilis forrásokból biztosítanak. A cikk idéz egy közösségi médiában terjedő állítást is, mely szerint hőség idején a hűtőrendszerek túlterheltek, ami tovább növeli a víz- és energiaigényt – ez azonban lakossági forrásból származó, nem ellenőrzött állítás. A brit kormány emellett a datacentrumok számának megháromszorozását tervezi, ami a szerző szerint egyenesen szembeállítja a digitális infrastruktúra bővítését a lakosság vízellátásával és energiaellátásával.
-
2026. augusztus 10., hétfő Üzlet
Nvidia és Amazon milliárdokat fektet AI-energiaellátásba
A The Information szerint az Nvidia akár 3 milliárd dollárt fektethet a texasi Lancium energiafejlesztőbe, amely az OpenAI és az Oracle közös adatközpontját is ellátja; egy 2 milliárd dolláros részesedés a cég kb. 20 százalékát jelentené a 10 milliárd dollárra becsült vállalatban. A Lancium már 4 gigawattra kötött szerződést Texasban, és további 15 gigawattnyi kapacitást fejleszt. A New York Times szerint az Amazon egy Pecos megyei gázüzemű erőmű mögé állt be, amely évi akár 33 millió tonna CO2-t bocsáthatna ki, ami az ország legszennyezőbb erőművévé tenné; a 35 turbina akár 7,65 gigawattot termelhetne egy Amazon-adatközpont számára. Az Amazon szóvivője szerint a klímacélok érvényben vannak, de az AI-adatközpontok nehezítik elérésüket.
-
2026. augusztus 11., kedd Modellek
Meta megjelentette a Muse Glimmer nyílt súlyú AI-ügynökmodellt
Meta kiadta a Muse Glimmer nevű 30 milliárd paraméteres, sűrű architektúrájú modellt, amelynek súlyait Apache 2.0 licenc alatt, nyíltan tette elérhetővé a Hugging Face-en. A vállalat szerint a modellt kifejezetten helyi, folyamatosan futó AI-ügynökök számára optimalizálták: egyetlen fogyasztói GPU-n, akár internetkapcsolat nélkül is képes futni, és több mint 100 nyelven, szöveget és képet is kezel. A The Decoder szerint Meta saját benchmarkjai alapján a Glimmer a Google Gemma és az Alibaba Qwen hasonló méretű nyílt modelljeivel versenyképes ügynöki feladatokban, ám a mérés a vállalat saját, nem független tesztkörnyezetében történt. Ez Meta első nyílt modellje a 2025 tavaszi Llama 4 óta, amelyet gyenge fogadtatás és manipulált benchmarkok miatti kritika ért. NVIDIA és Hugging Face már nap-nulla támogatást biztosít a modellhez több futtatókörnyezetben.
-
2026. augusztus 11., kedd Üzlet
Zuckerberg új AI-kiáltványban támadja a „zárt” versenytársakat
Mark Zuckerberg több mint 6500 szavas esszét tett közzé „The Future is for Everyone” címmel, amelyben Meta jövőbeli AI-stratégiáját vázolja fel. A Financial Times szerint Zuckerberg nyíltan bírálja az OpenAI-t és az Anthropicot mint „zárt” modelleket kínáló versenytársakat, miközben Meta a nyílt forráskódú, mindenki számára elérhető AI mellett áll ki. A The Verge összefoglalója szerint az esszé ígéreteket tartalmaz az adatközpontok körüli helyi közösségek kompenzálására – például energiaellátásra és vízvisszapótlásra –, valamint egy „Future Is For Everyone” alapot is bejelentenek. Zuckerberg állítása szerint a superintelligencia ingyenes vagy olcsó elérhetővé tétele gazdasági és társadalmi felemelkedést hozhat, ez azonban vállalati jövőkép, nem igazolt tény.
-
2026. augusztus 11., kedd Eszközök
NVIDIA kiterjesztette a nyílt súlyú Magpie TTS beszédszintetizátor nyelvi támogatását
Az NVIDIA a Hugging Face blogján bemutatta a Magpie Multilingual TTS legújabb kiadását, egy 364 millió paraméteres, nyílt súlyú szövegfelolvasó modellt, amely kaszkádolt beszéd-AI architektúrába illeszthető. A vállalat állítása szerint a modell mostantól 12 nyelvet támogat, a legújabb frissítés három új nyelvvel – modern standard arabbal, koreaival és brazíliai portugállal – bővítette a palettát, és javította több meglévő nyelv minőségét is frissített tréningadatokkal. Az NVIDIA azzal érvel, hogy a nyílt súlyok és a saját infrastruktúrán futtatás lehetővé teszi a késleltetés finomhangolását és a testreszabást, szemben a zárt, „egy API-hívásos” beszéd-megoldásokkal. A cikk elsősorban vállalati termékbejelentés, amely a Magpie NVIDIA NIM-integrációját hangsúlyozza.
-
2026. augusztus 12., szerda Modellek
Nvidia bemutatta a gyors, nyílt Nemotron 3.5 Lightning modellt
Az Nvidia kiadta a Nemotron 3.5 Lightning nevű nyílt súlyozású modellt, amely a vállalat közlése szerint 30 milliárd paraméteres Mixture-of-Experts architektúrát használ, de csak 3 milliárd paraméter aktív egyszerre, és az önműködő AI-ügynökök gyors, nagy volumenű végrehajtási feladataira optimalizálták. A modell a Nemotron 3 Nano 30B A3B utódja, megtartva a hibrid Mamba-Transformer felépítést. A független Artificial Analysis benchmarkplatform szerint a Lightning az Intelligence Indexen 24 pontot ér el, ami megegyezik az OpenAI gpt-oss-120b eredményével, negyedannyi paraméterből, és mintegy 670 token/másodperces sebességgel a mért modellek közül a leggyorsabbnak számít. Az Nvidia engedékeny licenc alatt, súlyokkal és tréningreceptekkel együtt adta ki a modellt.
-
2026. augusztus 12., szerda Üzlet
Nvidia 500 milliárd dolláros AI-infrastruktúra finanszírozási terve
Az Nvidia szándéknyilatkozatot írt alá hat nagy pénzügyi céggel – Apollo, BlackRock, Blackstone, Brookfield, Goldman Sachs és KKR –, hogy évek alatt több mint 500 milliárd dollár külső tőkét mozgósítsanak adatközpontok, chipgyárak és erőművek építésére. A Financial Times szerint a hír nyilvánosságra kerülése után az Nvidia részvénye kb. 1,4 százalékot esett, ami több mint 70 milliárd dollár piaci értéket törölt el. A megállapodás kulcseleme, hogy az Nvidia maga garantálja a beépített chipek maradványértékének akár 25 százalékát, ha azok az elvárt szint alá esnek, így átvállal egy részt az amortizációs kockázatból. Jensen Huang szerint ez az arány jóval alacsonyabb, mint más finanszírozási konstrukciókban, és a hardver hosszú élettartamára, illetve az emelkedő bérleti díjakra hivatkozva cáfolja a lufi-aggodalmakat, amelyeket kritikusok, például Michael Burry, hangoztatnak.
-
2026. augusztus 12., szerda Eszközök
NVIDIA NeMo Switchyard: modellek közötti terheléselosztó AI-ügynökökhöz
Az NVIDIA a NeMo Switchyard nevű eszközt ismertette, amely az AI-ügynökök feladatait dinamikusan osztja el különböző méretű és képességű nyelvi modellek között, a feladat jellege, a költség és az infrastruktúra alapján. A vállalat közlése szerint a rendszer szolgáltatófüggetlen SDK-t biztosít, automatikus és testre szabható útválasztási algoritmusokat támogat, és elválasztja az útválasztási logikát a konkrét modellszolgáltatóktól. Az NVIDIA saját tesztjei és a LangChain, illetve a Cognition partnerekkel végzett kipróbálás szerint az útválasztás jelentősen csökkentheti a költségeket a pontosság megtartása mellett, ám ezek az adatok a vállalat saját közléséből származnak, független megerősítés nélkül. A cél, hogy egyetlen nagy, drága modell helyett feladatonként a legmegfelelőbb modellt használják.
-
2026. augusztus 13., csütörtök Modellek
Alibaba 2,4 billió paraméteres Qwen-modellje NVIDIA GB300 chipeken fut
Az NVIDIA technikai blogja szerint az Alibaba nyílt súlyokkal publikálta a Qwen3.8-2.4T-A95B (Qwen3.8-Max) modellt, eddigi legnagyobb nyílt modelljét: 2,4 billió összparaméterrel, tokenenként 95 milliárd aktivált paraméterrel, finomszemcsés MoE-architektúrával és teljes, illetve lineáris figyelmet vegyítő megoldással, amely akár egymillió tokenes kontextust és 128 ezer tokenes kimenetet kezel. Az NVIDIA saját mérése szerint a modell külön finomhangolás nélkül, FP8 pontosságon már az első napon GPU-nkánt 4000, felhasználónkénti pedig 350 tokent másodpercenként ér el GB300 NVL72 rendszeren. A cég szerint a jövőben tervezett NVFP4 pontosság további teljesítménynövekedést hozhat, ez azonban még csak kilátás, nem mért eredmény.
-
2026. augusztus 13., csütörtök Üzlet
Meta és amerikai építőipari szakszervezetek szakképzésbe fektetnek az AI-infrastruktúráért
A Meta hivatalos közleménye szerint partnerséget kötött a North America's Building Trades Unions (NABTU) szövetséggel, amely 14 szakszervezetet és több mint 3,2 millió szakképzett munkást tömörít az USA-ban és Kanadában. Az együttműködés a korábban bejelentett Future Is For Everyone Fund alapra épül, célja pedig, hogy az AI-infrastruktúra építéséhez szükséges szakmákban képzést, minősítést és teljes munkaidős állásokat biztosítson. A cég szerint az America's Workforce Academy a NABTU akkreditált gyakornoki programjaival dolgozik együtt a karrierutak kialakításán. A NABTU elnöke, Sean McGarvey a közösségi beruházás fontosságát hangsúlyozta, míg a Meta elnöke, Dina Powell McCormick szerint a szakképzett munkások építik az AI-versenyhez szükséges amerikai infrastruktúrát. A hír kizárólag a Meta saját közleményén alapul, független megerősítés nem szerepel a forrásban.
-
2026. augusztus 15., szombat Üzlet
Francia startup szoftveres trükkökkel gyorsítaná a GPU-alapú AI-következtetést
A francia Kog startup azt állítja, hogy szoftveres optimalizálással jelentősen felgyorsítható az AI-következtetés meglévő adatközponti GPU-kon, például AMD MI300X és Nvidia H200 kártyákon. Májusi technológiai bemutatójuk a Hacker News címlapjára is felkerült, és a vezérigazgató, Gaël Delalleau szerint azóta mintegy 200 konkrét üzleti érdeklődő jelentkezett. A demóban 3000 token/másodperc sebességet értek el, de ezt egy célzottan épített, mindössze 2 milliárd paraméteres kis modellel, a Laneformer 2B-vel mutatták be, amelyet azóta nyílt forráskódúvá tettek. A cég szerint ugyanez a módszer nagy nyelvi modelleknél is működne, ez azonban egyelőre igazolatlan ígéret, mivel az erre optimalizált verzió még fejlesztés alatt áll. Az összefoglaló kizárólag a Kog és vezetője állításain alapul, független mérés nem szerepel a forrásban.
-
2026. augusztus 18., kedd Üzlet
Nvidia 1,5 milliárd dollárt fektet az OpenAI ohiói adatközpontjába
A Nvidia hétfőn bejelentette, hogy 1,5 milliárd dollárt fektet az SB Energybe, amely a SoftBankhoz és az OpenAI-hoz köthető adatközpont-fejlesztő. A TechCrunch által ismertetett SEC-dokumentumok szerint a befektetés biztosítja, hogy a Nvidia legyen a kizárólagos infrastruktúra-beszállító az OpenAI Cincinnati melletti Ports-Pike adatközpontjában, amelyhez akár 105 milliárd dollár hitelkeretet is nyújt, és amely 4,25 gigawattról 8 gigawattra bővülhet. A telephelyen egy 9,2 gigawattos, 33 milliárd dolláros földgáz erőmű is épül olyan területen, amely korábban az amerikai atomfegyver-programhoz szolgáltatott dúsított uránt. Az OpenAI saját közleménye csak azt erősíti meg, hogy csatlakozott a Ports-Pike projekthez, bővítve közösségi beruházásait és több ezer dél-ohiói munkahelyet támogatva.
-
2026. augusztus 18., kedd Üzlet
A Groq 350 millió dollárt vont be neocloud-átállásához, felére csökkent értékeltség mellett
A Groq startup 350 millió dollár friss tőkét szerzett, miközben tovább folytatja átalakulását saját AI-chipeket gyártó cégből Nvidia-alapú GPU-kat kínáló, úgynevezett neocloud-szolgáltatóvá. A kört a Disruptive vezette, Nvidia tervezett részvételével, és a Groq-ot 3,5 milliárd dollárra értékelte, ami jóval elmarad a tavaly szeptemberi 6,9 milliárd dollártól. A cég szóvivője a TechCrunch-nak azt állította, ez nem down round, hanem az Nvidia-licencszerződés utáni új Groq értékelése. A vállalat júniusban már bevont 650 millió dollárt a pivot elindítására, és jelenleg 13 adatközpontot üzemeltet, több millió fejlesztőt kiszolgálva. A cikk szerint nyitott kérdés, hogy a neocloud-modell hosszú távon elég jövedelmező lesz-e a hatalmas beruházások megtérüléséhez.
-
2026. augusztus 18., kedd Modellek
NVIDIA NVFP4-re tömöríti a Nemotron 3.5 Lightning modellt, elérhető AWS-en is
Az NVIDIA technikai blogja szerint kvantálás-tudatos disztillációval (QAD) készült el a Nemotron 3.5 Lightning NVFP4 verziója, amely a teljes pontosságú, 66 GB-os BF16 modellhez képest 22 GB-ra zsugorodik, és a vállalat állítása szerint akár négyszeres áteresztőképességet ér el, közel a BF16 pontosságával. A módszer PTQ-val indul, majd a diákmodellt a fagyasztott tanárhoz igazítja KL-divergencia veszteséggel, ami a cég mérései szerint jobb pontosságmegtartást ad, mint a puszta PTQ. Az AWS bejegyzése szerint a Nemotron 3.5 Lightning – egy 30 milliárd paraméteres, de csak 3 milliárd aktív paramétert használó MoE modell – az Amazon SageMaker JumpStartban is elérhető, nagy volumenű AI-ágensekhez optimalizálva.
-
2026. augusztus 19., szerda Üzlet
SemiAnalysis elemzése: a chipgyártástól a token-gazdaságtanig ível az AI-piac
Jordan Nanos, a SemiAnalysis technikai munkatársa a QCon AI konferencián tartott előadásában bemutatta, hogyan hatnak a félvezető-kapacitás korlátai, az adatközpont-bővítések és a hálózati szűk keresztmetszetek az AI-szoftverek architektúrájára. Az előadó szerint a cég GPU-benchmarkokat, felhőszolgáltatói teljesítménymérést és tokenomikai elemzéseket készít, hogy összekösse a chipgyártás és a modellfuttatás közötti láncszemeket, a ClusterMAX nevű projektjükön keresztül is. A SemiAnalysis saját közlése alapján a technológiai szektor legnagyobb Substack-hírlevele, 280 ezer feliratkozóval és 85 fős csapattal rendelkezik. Az előadás iparági piacelemzési szemléletet közvetít a hardveres korlátok és a szoftverfejlesztés összefüggéseiről, konkrét új kutatási eredményt a kivonat nem tartalmaz.
-
2026. augusztus 19., szerda Eszközök
NVIDIA: több GPU-s UMAP-számítás 870 GB-os adathalmazon 8 perc alatt
Az NVIDIA saját technikai blogja szerint a cuML és cuVS könyvtárak 25.06-os verziója már több GPU-n is támogatja az UMAP dimenziócsökkentő algoritmus legköltségesebb lépését, az összes szomszédot kereső kNN-gráf felépítését. A vállalat állítása szerint a módszer az adathalmazt kiegyensúlyozott klaszterekre osztja, ezekhez külön-külön számol lokális kNN-gráfot, majd ezeket globális gráffá egyesíti, elkerülve a teljes körű GPU-k közötti kommunikációt. Az NVIDIA mérései alapján a MIRACL és Wiki adathalmazokon nyolc H100 GPU-val akár 74-szeres gyorsulást értek el a becsült CPU-s futásidőkhöz képest, és 870 GB-nyi vektort mindössze 8 perc alatt dolgoztak fel, az elmondásuk szerint a beágyazások pontosságának megőrzése mellett. A korábbi megoldásban csak a transzformációs lépés futhatott több GPU-n, a tanítás egyetlen GPU-ra korlátozódott.
-
2026. augusztus 19., szerda Üzlet
Nvidia 1,5 milliárd dollárt fektet az OpenAI ohiói adatközpontjába
A TechCrunch által ismertetett SEC-dokumentumok szerint a Nvidia bejelentette, hogy 1,5 milliárd dollárt fektet az SB Energybe, a SoftBankhoz és az OpenAI-hoz köthető adatközpont-fejlesztőbe. A befektetés biztosítja, hogy a Nvidia legyen a kizárólagos infrastruktúra-beszállító az OpenAI Cincinnati melletti Ports-Pike adatközpontjában, amelyhez a chipgyártó akár 105 milliárd dollár hitelkeretet is nyújt. A létesítmény 4,25 gigawattról 8 gigawattra bővülhet, a helyszínen pedig egy 9,2 gigawattos, 33 milliárd dollár értékű földgáz erőmű is épül egy korábban katonai uránjátás területén. A TechCrunch szerint a földgázerőmű-építés költsége két év alatt 66 százalékkal nőtt, ami a beruházás árát is felhajtja. Az OpenAI saját közleménye csupán azt erősíti meg, hogy csatlakozott a Ports-Pike projekthez, amely dél-ohiói munkahelyeket és közösségi fejlesztéseket is támogat.
-
2026. augusztus 20., csütörtök Eszközök
NVIDIA nyílt eszközzel méri, mennyit javítanak az AI-ügynökökön a beépített skillek
Az NVIDIA saját közlése szerint nyílt forráskódú SkillEvaluator eszközt épített, amely három lépésben – statikus ellenőrzés, megkülönböztethetőségi elemzés és élő feladatvégrehajtás izolált környezetben – méri, hogy az úgynevezett verified skillek mennyit javítanak az AI-ügynökök teljesítményén. A vállalat állítása szerint több mint 300 hitelesített skillt teszteltek 30-nál több NVIDIA terméken, két ügynök-keretrendszerben, és a skillek használatával átlagosan 31 pontos javulást mértek a helyesség, felfedezhetőség, hatékonyság és eredményesség terén, a biztonsági kategóriát kihagyva pedig 39 pontosat. Az NVIDIA szerint a javulást inkább a termékdomén és az értékelési módszertan befolyásolja, mint az ügynök-keretrendszer. Az eredmények kizárólag a vállalat saját méréséből származnak, független validálásról a közlemény nem szól.
-
2026. augusztus 20., csütörtök Kutatás
Föderált tanulás vizuális-nyelvi modellekhez: NVIDIA FLARE és FedUMM
Az NVIDIA hivatalos blogbejegyzése bemutatja, hogyan koordinálja a FLARE keretrendszer a vizuális-nyelvi modellek föderált tanítását olyan esetekben, ahol az adatok nem centralizálhatók intézmények között. A megoldás nagyméretű objektumok kiszervezésével, tenzor-streameléssel és lemezalapú aggregációval kezeli a hálózati és memóriakorlátokat. A William & Mary egyetemmel közösen fejlesztett FedUMM csak könnyű LoRA-adaptereket cserél egy fixen tartott BLIP-háttérmodell felett, ami a vállalat állítása szerint kísérleteiben 28,6 GB-ról 0,094 GB-ra csökkentette a kliensenkénti kommunikációt, miközben a teljesítmény közel maradt a centralizált alapmodellekhez. A FedUMM-ot az NVIDIA akadémiai grantprogramja támogatta, és díjat kapott egy szakmai workshopon.
-
2026. augusztus 20., csütörtök Üzlet
Kína kis tételben engedélyezi az Nvidia H200 chipek beszerzését
A Financial Times értesülése szerint Peking kis mennyiségben engedélyezi az Nvidia H200 chipjeinek behozatalát a szárazföldre, hogy a hazai AI-cégek lépést tarthassanak az amerikai versennyel. A The Decoder cikke szerint a ByteDance és a Tencent egyenként mintegy 10 000 H200 processzort kapott, és további vállalatok is követhetik őket, bár a vásárláshoz az NDRC tervhivatal jóváhagyása is szükséges. A H200 már legalább két generációval elmarad az Nvidia legerősebb, exportkorlátozás alá eső chipjeitől, az USA pedig cégenként legfeljebb 100 000 darabot engedélyez. Kína eközben inkább saját gyártóit, például a Huaweit igyekszik erősíteni, a Hongkongba irányuló szállítást pedig a helyi adatközpont- és energiahiány korlátozza. A cikk szerint a kínai AI-laborok technikailag közelítenek az amerikai szinthez, de a rendelkezésre álló inferencia-kapacitásban jelentősen lemaradnak riválisaiktól.
-
2026. augusztus 22., szombat Kutatás
Nvidia: a szoftveres keret dönti el az AI-ügynök sikerét, nem a modell
Az Nvidia péntek óta ismert kutatása szerint hosszú távú, sok lépésből álló feladatoknál nem a modell, hanem a köré épített szoftveres keret (harness) a döntő tényező. A cég állítása szerint egy egyedi, memóriakezelésre optimalizált és „felügyelő” komponenssel ellátott keretben a Claude Opus 5 modell 100%-os eredményt ért el az ARC-AGI-3 benchmarkon, amely instrukció nélküli 2D-s játékokból áll. Ugyanez a modell harness nélkül csak 30%-ot ért el, ami így is a legjobb eredmény volt a tesztelt modellek között. Az Nvidia szakembere szerint az ügynök valójában nem csak a modellből áll, hanem az eszközökből, a futásidőből és a hozzáférhető könyvtárakból is, amelyek együtt adják a tényleges teljesítményt. A cikk kontrasztként megemlíti a Microsoft áprilisi kutatását is, amely szerint 19 nagy nyelvi modell mindegyike hibázott hosszú dokumentumszerkesztési feladatoknál.
-
2026. augusztus 22., szombat Társadalom
Egy év alatt megugrott az amerikaiak adatközpont-ellenessége
A Heatmap News ismételt felmérése szerint az amerikaiak 75 százaléka ellenzi, hogy adatközpontot építsenek a lakóhelye közelében, ezen belül 61 százalék „határozottan” ellenzi azt. Egy évvel korábban a vélemények szinte kiegyenlítettek voltak: 43 százalék támogatta, 42 százalék ellenezte az építkezéseket, a fordulat idén februárban kezdődött. A Heatmap News újságírója, Robinson Meyer szerint ez „gyors és masszív elmozdulás” a közvéleményben. A tendenciát egy májusi Gallup-felmérés is megerősíti, amely 71 százalékos ellenzést mért, ebből 48 százalék volt „határozottan” ellenző. A felmérések szerint a legfőbb aggályok a helyi áramárak emelkedése, a vízfelhasználás és a földhasználat körül összpontosulnak, és a téma a kampányban már olyan kérdéseket is megelőz népszerűségben, mint a rasszizmus vagy Izrael.
-
2026. augusztus 23., vasárnap Üzlet
Ulanqab: Belső-Mongólia lett Kína AI-adatközpont-fővárosa
A WIRED cikke szerint egy Goldman Sachs kutatási jegyzet alapján a mindössze 1,5 milliós lakosú Ulanqabban 2016 óta közel 100 adatközpont épült vagy van építés alatt, a bejelentett kapacitás összesen 12,5 gigawattra rúg, ennek több mint 70 százalékát az elmúlt egy évben jelentették be. Összehasonlításképp az OpenAI 500 milliárd dolláros Stargate projektje készen is csak 10 gigawattot ér el. A várost a hideg, magasan fekvő klíma, a Pekinghez közeli helyzet és az olcsó, szél-, nap- és szénenergiára épülő áramellátás teszi vonzóvá. A cikk szerint első ízben kínai AI-cégek, köztük a DeepSeek, a ByteDance, az Alibaba és a Xiaohongshu is saját infrastruktúrába fektetnek bérelt felhőkapacitás helyett. A projektek azonban komoly vízhiányba ütközhetnek, mivel a szárazságra hajlamos térségben a helyi vízművek már most is éjszakai korlátozásokra kényszerülnek.