2026. augusztus 2., vasárnap · Eszközök

AI-ügynökök felturbózzák a tudományos szoftvereket, de a hibákat nem tudják kiszűrni

Az OpenAI és akadémiai partnerei közös terepjelentése nyolc esettanulmányt mutat be, amelyekben kutatócsoportok Codex és Claude Code kódoló ügynökökkel modernizítottak elavult, kutatásokhoz készült szoftvereket, főként biológiai területen. A projektek egyszerű build-frissítésektől (cyvcf2) teljes átírásokig terjedtek: a MHCflurry immunológiai modellt TensorFlow-ból PyTorch-ra portálták, a STAR szekvenciaillesztő programot Rust nyelven építették újjá, a RustQC pedig 15 minőségellenőrző eszközt vont egyetlen programba, akár 60-szoros sebességnövekedést elérve. A jelentés szerint a rustar-aligner az eredeti STAR eredményeivel 99,8 százalék felett egyezett a tesztelt szekvenciaadatokon. A beszámoló hangsúlyozza: a munka nagy része nem a kódírásból, hanem az eredmények emberi ellenőrzéséből áll, mivel az ügynökök nem tudják megítélni, hogy a tudományos következtetés helyes-e.

Miért fontos?

A tanulmány szerint az AI-ügynökök meggyorsíthatják a kutatási infrastruktúra karbantartását, de a tudományos helyesség ellenőrzése továbbra is emberi feladat marad.

Források

Említve a tudásbázisban

Kapcsolódó témák

Napi összefoglaló

Ez a hír a 2026. augusztus 2., vasárnap napi AI összefoglaló része.

Kapcsolódó hírek

OpenAI: AI-ügynökök tartják gyorsan a ChatGPT-t

Martin Spier, az OpenAI ChatGPT teljesítményoptimalizálásáért felelős csapatának vezetője egy QCon AI-előadásán arról beszélt, hogy két egyidejű felgyorsulás nehezíti a termék sebességének fenntartását: a felhasználói bázis eddig nem látott ütemű növekedése, valamint az agentikus kódolás miatt megugró kódváltozás-mennyiség. Állítása szerint a gyors fejlesztési tempó rejtett, rendszerszintű teljesítménykockázatokat hordoz, amelyek túlmutatnak a puszta GPU-kapacitás kérdésén. Az OpenAI ezekre válaszul saját elmondása szerint állandóan futó AI-ügynököket vet be, amelyek automatizálják a profilalkotást, a teljesítményregressziók észlelését és a folyamatos optimalizálást globális léptékben. Spier korábban a Netflixnél, a Snowflake-nél és más cégeknél is teljesítménymérnökként dolgozott, mielőtt az OpenAI-hoz csatlakozott.

Az OpenAI minden amerikai felhasználó számára elérhetővé tette a ChatGPT Health egészségügyi funkcióját

Az OpenAI csütörtökön az Egyesült Államokban minden 18 éven felüli, bejelentkezett ChatGPT-felhasználó számára megnyitotta a ChatGPT Health funkciót, amely lehetővé teszi egészségügyi adatok – többek között orvosi dokumentumok, laboreredmények, gyógyszerlisták, valamint az Apple Health, a MyFitnessPal és más szolgáltatások adatainak – összekapcsolását a chatbottal. A The Verge beszámolója szerint az OpenAI egészségügyi alelnöke azt állította, hogy modelljeik a klinikusok szintjét meghaladó következtetési képességgel rendelkeznek, ugyanakkor a cég egészségügyi vezetője ezt árnyalta, mondván, hogy egyes tanulmányok mutatnak ebbe az irányba. A funkció bevezetésével egy időben egy floridai lelkész pert indított az OpenAI ellen, azt állítva, hogy a ChatGPT veszélyes orvosi tanácsot adott neki. Az OpenAI hangsúlyozza, hogy a szolgáltatás a szakorvosi ellátást támogatja, nem helyettesíti.

Az OpenAI bemutatta a GPT-Red nevű kibervédelmi mesterséges intelligenciát

Az OpenAI kifejlesztett egy GPT-Red nevű nagy nyelvi modellt, amelyet a vállalat saját rendszereinek biztonsági tesztelésére használ. A rendszer automatizálja az úgynevezett red-teaming folyamatot, amelyet korábban emberi tesztelőcsapatok végeztek: célja, hogy minél többféle módon feltárja a szoftverrendszerek sebezhetőségeit és támadási felületeit. Az MIT Technology Review exkluzív betekintést kapott a rendszerbe, amely az OpenAI szerint segíthet a vállalatnak a kibertámadókkal szembeni előnye megőrzésében. A GPT-Red lényegében egyfajta automatizált szuperhackerként működik, amely küzdőtársként edzi a cég többi modelljét a védekezésben.

Az OpenAI első hardverterméke egy 230 dolláros programozó-billentyűzet, a Codex Micro

Az OpenAI a Work Louder billentyűzetgyártóval közösen bemutatta első márkázott hardvereszközét, a Codex Micro nevű mini billentyűzetet, amely 230 dollárba kerül és korlátozott példányszámban érhető el. A The Verge és az Ars Technica beszámolói szerint az eszköz hat áttetsző, RGB-világítású gombot tartalmaz, amelyek színkódokkal jelzik a Codex kódolóplatform párhuzamosan futó ágens-szálainak állapotát – fehér az inaktív, kék a gondolkodás, zöld a kész, sárga az emberi beavatkozást igénylő, piros a hibás feladatot jelöli. A készülék emellett hat programozható parancsgombot, joysticket, tárcsát és érintésérzékelőt kínál, valamint 32 cserélhető billentyűsapkát tartalmaz. Az eszköz a ChatGPT asztali alkalmazásból konfigurálható, és elkülönül az OpenAI Jony Ive-vel közösen fejlesztett, eddig be nem mutatott okoshangszóró-projektjétől.