Anthropic bejelentése szerint legerősebb modelljét, a Claude Mythos 5-öt beépítették a Claude Security nevű szkennerbe, amely nyilvános bétaként érhető el vállalati ügyfeleknek. A cég állítása szerint az eszköz kódbázisokat vizsgál sebezhetőségek után, minden találathoz CWE-kategóriát, súlyossági besorolást és javasolt javítást rendel, de a patch-eket embernek kell jóváhagynia. Anthropic emellett partnerei biztonsági termékeibe is integrálja a modellt, amelyeket kórházak, közművek és bankok védelmére használnak; a végfelhasználók itt csak az eredményt látják. A korábban Claude Opust használó partnerek várhatóan átállnak Mythos 5-re. A vállalat szerint a modell kiemelkedő kiberképességei miatt nem érhető el szélesebb körben, a cél a védekezők megerősítése új támadói eszközök nélkül.
Martin Spier, az OpenAI ChatGPT teljesítményoptimalizálásáért felelős csapatának vezetője egy QCon AI-előadásán arról beszélt, hogy két egyidejű felgyorsulás nehezíti a termék sebességének fenntartását: a felhasználói bázis eddig nem látott ütemű növekedése, valamint az agentikus kódolás miatt megugró kódváltozás-mennyiség. Állítása szerint a gyors fejlesztési tempó rejtett, rendszerszintű teljesítménykockázatokat hordoz, amelyek túlmutatnak a puszta GPU-kapacitás kérdésén. Az OpenAI ezekre válaszul saját elmondása szerint állandóan futó AI-ügynököket vet be, amelyek automatizálják a profilalkotást, a teljesítményregressziók észlelését és a folyamatos optimalizálást globális léptékben. Spier korábban a Netflixnél, a Snowflake-nél és más cégeknél is teljesítménymérnökként dolgozott, mielőtt az OpenAI-hoz csatlakozott.
Az OpenAI és akadémiai partnerei közös terepjelentése nyolc esettanulmányt mutat be, amelyekben kutatócsoportok Codex és Claude Code kódoló ügynökökkel modernizítottak elavult, kutatásokhoz készült szoftvereket, főként biológiai területen. A projektek egyszerű build-frissítésektől (cyvcf2) teljes átírásokig terjedtek: a MHCflurry immunológiai modellt TensorFlow-ból PyTorch-ra portálták, a STAR szekvenciaillesztő programot Rust nyelven építették újjá, a RustQC pedig 15 minőségellenőrző eszközt vont egyetlen programba, akár 60-szoros sebességnövekedést elérve. A jelentés szerint a rustar-aligner az eredeti STAR eredményeivel 99,8 százalék felett egyezett a tesztelt szekvenciaadatokon. A beszámoló hangsúlyozza: a munka nagy része nem a kódírásból, hanem az eredmények emberi ellenőrzéséből áll, mivel az ügynökök nem tudják megítélni, hogy a tudományos következtetés helyes-e.
Az OpenAI csütörtökön az Egyesült Államokban minden 18 éven felüli, bejelentkezett ChatGPT-felhasználó számára megnyitotta a ChatGPT Health funkciót, amely lehetővé teszi egészségügyi adatok – többek között orvosi dokumentumok, laboreredmények, gyógyszerlisták, valamint az Apple Health, a MyFitnessPal és más szolgáltatások adatainak – összekapcsolását a chatbottal. A The Verge beszámolója szerint az OpenAI egészségügyi alelnöke azt állította, hogy modelljeik a klinikusok szintjét meghaladó következtetési képességgel rendelkeznek, ugyanakkor a cég egészségügyi vezetője ezt árnyalta, mondván, hogy egyes tanulmányok mutatnak ebbe az irányba. A funkció bevezetésével egy időben egy floridai lelkész pert indított az OpenAI ellen, azt állítva, hogy a ChatGPT veszélyes orvosi tanácsot adott neki. Az OpenAI hangsúlyozza, hogy a szolgáltatás a szakorvosi ellátást támogatja, nem helyettesíti.