Az OpenAI Astra modellje önállóan talált zero-day sebezhetőségeket – átlépte a „kritikus” kiberbizttonsági küszöböt

Az OpenAI Astra átlépte a „kritikus” kiberbizttonsági küszöböt – önállóan talált zero-day sebezhetőségeket

Az OpenAI bejelentette, hogy készülő Astra modellje az első mesterséges intelligencia, amely meghaladta a vállalat Preparedness Framework rendszerében a „kritikus” kiberbizttonsági szintet. Ez a besoralás azt jelenti, hogy a modell képes önállóan felfedezni és kihasználni zero-day sebezhetőségeket jól védett rendszerekben.

Az ExploitBench benchmark tesztelése során az Astra tökéletes eredményt ért el. Ennél is figyelemreméltóbb, hogy a teszt egy módosított változatának futtatásakor a modell önállóan felfedezett és kihasznált két korábban ismeretlen zero-day sebezhetőséget a Chrome V8 JavaScript motorjában — anélkül, hogy erre utasítást kapott volna.

A „kritikus” besoralás értelmében az OpenAI-nak további biztonsági intézkedéseket kell bevezetnie a nyilvános megjelenés előtt. A vállalat augusztusban függesztette fel az Astra fejlesztését a biztonsági kontrollok megerősítése érdekében, a kezdeti hozzáférés pedig kizárólag ellenőrzött biztonsági kutatók és jóváhagyott tesztelők számára lesz elérhető. Az Astrát arra képezték ki, hogy visszautasítsa a kártékony kéréseket, és monitorozó rendszerek jelzik, majd leállítják az engedély nélküli viselkedést.

A bejelentés alapvető kérdéseket vet fel a mesterséges intelligenciával támogatott támadó kiberbizttonsági képességekről. Ha egy modell rutintesztelés közben képes zero-day-ekre bukkanni, mi történik, ha hasonló rendszereket szándékosan kritikus infrastruktúra ellen irányítanak?

Források: TechCrunch, SecurityWeek

Az Anthropic elindította a Fable 5.1-et csökkentett árakkal és kevesebb korlátozással

Az Anthropic szeptember 1-jén mutatta be a Claude Fable 5.1-et és annak megbízható hozzáférésű ikerpárját, a Mythos 5.1-et, amelyeket a vállalat eddigi legképesebb modelljeiként pozícionál. A legfontosabb szám: a cache olvasások költsége mindössze 0,25 dollár egymillió tokenre, ami 75%-os csökkenés a Fable 5-höz képest. Az Anthropic becslése szerint ez a tipikus munkaterheleléseknél körülbelül 25%-os, míg erősen ágens jellegű feladatoknál akár 45%-os költségcsökkenést jelent.

Az árazáson túl a Fable 5.1 érdemi teljesítménynövekedést hoz. A Terminal-Bench-Science pontszám 24,7-ről (Fable 5) 52,6-ra ugrott, és a modell több benchmarkon is felülmúlja az Opus 5-öt és az OpenAI GPT-5.6 Sol-ját. Az Anthropic emellett csökkentette a hamis pozitív tartalomszurést, így a modell kevésbé hajlamos jogos kéréseket visszautasítani.

A Mythos 5.1 funkcionálisan azonos modell, de kiberbizttonsági és biológiai kutatási felhasználásra nincs rajta blokkolás — hozzáférése ellenőrzött szervezetekre korlátozódik. A Fable 5.1 már elérhető a Claude.ai-on, a Claude Code-ban, a Cowork-ben, valamint API-n keresztül az AWS-en, a Google Cloud-on és az Azure-on.

A bevezetéssel egy időben az Anthropic lezárta 35 milliárd dolláros cloud computing megállapodását a Lambdával, az Nvidia által támogatott felhőszolgáltatóval. A megállapodás egy texasi, a Hut 8 által fejlesztett adatközpontra vonatkozik, amely nagyjából 350 megawatt kapacitással rendelkezik. Az üzlet egy szélesebb infrastrukturális offenzíva része, amelybe beletartozik az Nscale-lel kötött 45 milliárd és a Fluidstack-kel kötött 50 milliárd dolláros megállapodás is.

Források: TechCrunch, SiliconANGLE, Bloomberg

A Google kiadta a Gemini 3.8 Flash-t — hat hét alatt a harmadik Flash modell

A Google DeepMind szeptember 2-án adta ki a Gemini 3.8 Flash-t, ami nem kevesebb mint a negyedik Flash modell négy hónapon belül, és a harmadik mindössze hat hét alatt. Az őrült tempó egyértelműen arra irányul, hogy a Google versenyképes maradjon a gyorsan mozgó modellversenyben.

A számok meggyőzőek: a Gemini 3.8 Flash 59 pontot ért el az Artificial Analysis Intelligence Indexen, ami 3 pontos javulás a 3.7 Flash-hez képest, és komplex következtetési feladatokon megközelíti a sokkal drágább frontier modellek teljesítményét. Az ár változatlan maradt: 0,75 dollár egymillió input tokenre és 3,75 dollár egymillió output tokenre.

A Google emellett elindította a Gemini 3.8 Flash Cyber változatot is, amely kifejezetten sebezhetőség-felderitésre és automatizált javításra szakosodott, bár hozzáférése a Google Fairwind biztonsági kutatási programjának résztvevőire korlátozódik. Emellett bemutatkozott a Google Pics, egy új képgeneráló eszköz is.

Források: Artificial Analysis, The Register, 9to5Google

A Sony és a Warner beperelte az Anthropic-ot a dalszövegek „nyilvánvaló ellopása” miatt

A Sony Music Publishing és a Warner Chappell Music 48 oldalas szövetségi keresetet nyújtott be az Anthropic ellen egy észak-kaliforniai bíróságon, személyesen is megnevezve a társalapítókat, Dario Amodeit és Benjamin Mannt. A kiadók szerint ez „a szellemi tulajdon történetének egyik legnagyobb és legnyilvánvalóbb, folyamatos lopása”.

A kereset lényege: az Anthropic állítólag mintegy 20 000 szerzői joggal védett dalt használt fel — köztük olyan műveket, mint az Eye of the Tiger, a Hallelujah, az Uptown Funk, Taylor Swift Paper Rings című száma és Mariah Carey All I Want for Christmas Is You című slágere — Claude modelljeinek tanításához, engedély és licenc nélkül. A kiadók szerint az Anthropic a dalszövegeket kalózplatformokról szerezte be, többek között a Library Genesisről és a Pirate Library Mirrorról, valamint licencelt dalszöveg-oldalakról, például a Musixmatchről és a LyricFindről.

A per művenként akár 150 000 dollár kártérítést követel szándékos jogsértés esetén, valamint 25 000 dollárt minden egyes szerzői jogi kezelési információ eltávolításáért. A kereset erősen támaszkodik arra, hogy az Anthropic tavaly szeptemberben 1,5 milliárd dollárért egyezett ki könyvszerzőkkel hasonló, képzési adatok beszerzésével kapcsolatos ügyben.

Az Anthropic közölte, hogy határozottan megvédi magát a bíróságon.

Források: TechCrunch, Axios, Fortune

Az Apple belépett a John Ternus-korszakba — frontier modell nélkül

John Ternus szeptember 1-jén hivatalosan is átvette az Apple vezérigazgatói posztját Tim Cooktól, aki ügyvezető elnöki szerepkörbe lépett. Ternus, aki 25 éve dolgozik az Apple-nél és a hardverfejlesztést vezette, most az egyetlen nagy technológiai vállalat élén áll, amelynek nincs saját frontier AI modellje.

Az első nagy próbatétel szeptember 9-én jön, amikor az Apple várhatóan bemutatja legújabb iPhone-ját és egy összehajtható készüléket. A kérdés, ami mindenkit foglalkoztat: Ternus felgyorsítja-e az Apple mesterséges intelligenciával kapcsolatos ambícióit — akár egy versenyképes LLM felvásárlásával vagy fejlesztésével —, vagy kitart amellett a stratégia mellett, hogy harmadik féltől származó modelleket integrál az ökoszisztémájába?

Források: Al Jazeera, TechCrunch

Megosztás