Az Nvidia AVO agense minden ARC-AGI-3 szintet teljesített – az AI-benchmarkok egymás után dőlnek meg

Az Nvidia AVO agense tökéletes pontszámot ért el az ARC-AGI-3-on

Az év talán legjelentősebb AI-benchmark eredményeként az Nvidia Agentic Variation Operators (AVO) rendszere teljesítette az ARC-AGI-3 benchmark mind a 183 szintjét — elsőként az általános következtetési képességet mérő teszten, amely túlmutat az egyszerű mintafelismerésen.

Az eredményt még figyelemreméltóbbá teszi a hatékonyság: az AVO körülbelül 12%-kal kevesebb műveletet használt, mint azok a versenyző rendszerek, amelyek csak részleges teljesítményt értek el. Az architektúra tartós memóriát kombinál egy felügyeleti ciklussal, amely érzékeli és átirányítja az elakadt stratégiákat — lényegében felismeri, ha zsákutcába jutott, és alapvetően más megközelítést próbál.

A François Chollet által létrehozott ARC-AGI benchmarksorozatot régóta az általános intelligencia egyik legértelmesebb mérőeszközének tartják, mivel valódi absztrakciót igényel a memorizálás helyett. A tökéletes pontszám nem jelenti azt, hogy elérkeztünk az AGI-hoz — a benchmark egy adott típusú gondolkodást tesztel —, de azt jelzi, hogy az önfelügyeleti képességgel rendelkező ágens-architektúrák áttörik azokat a korlátokat, amelyeken a korábbi modellgenerációk elakadtak.

A DeepSeek kiadta a V4-Flash-Vision modellt: a multimodális AI olcsóbb és jobb lesz

A DeepSeek bemutatta a V4-Flash-Vision-Exp modellt, amely képértelmezéssel bővíti a népszerű mixture-of-experts modellcsaládot. Az eredmények figyelemre méltók: a rendszer felülmúlta a Claude Opus 4.8-at vizuális következtetési benchmarkokon, miközben a feldolgozási költségeket 73%-kal csökkentette.

A DeepSeek ezzel folytatja azt a tendenciáját, hogy a nyugati AI-laborok árainak töredékéért nyújt élvonalbeli teljesítményt. A multimodális képesség azt jelenti, hogy a modell mostantól képeket és szöveget együttesen tud feldolgozni és értelmezni, így alkalmas dokumentumelemzéstől a vizuális kérdés-válasz feladatokig mindenre.

A megjelenés tovább fokozza az iparági árnyomást: csak 2026 augusztusában mintegy 50%-kal csökkent az intelligenciaegységre jutó költség több modellszinten is.

Nevada ezrével engedélyezi a robotaxikat Las Vegasban

Nevada közlekedési hatósága egyhangúlag jóváhagyta a Tesla, a Waymo és az Uber engedélyeit fizetős robotaxi-szolgáltatásokra Clark megyében, Las Vegas otthonában. Az engedélyek összesen akár 7000 teljesen autonóm járművet is lehetővé tesznek — drámai lépés a Tesla korábbi ideiglenes engedélyéhez képest, amely mindössze 10 járműre korlátozta a flottáját.

A Tesla kapta a legnagyobb keretszámot, legfeljebb 5000 robotaxival, míg a Waymo és az Uber egyenként 1000 járműre kapott jogosultságot. Az Uber a Hyundai leányvállalata, a Motional, valamint az Amazon Zoox egysége révén tervezi a szolgáltatást.

A döntéssel Las Vegas a világ egyik legnagyobb autonóm jármű telepítésévé válik, és mindössze hetekkel azután született, hogy az Amazon Zoox megkezdte fizetős kereskedelmi szolgáltatását a szállodanegyedben — az NHTSA történetében első alkalommal megadott kereskedelmi felmentés nyomán, célépítésű autonóm robotaxira.

A helyi taxitársaságok és platform-alapú sofőrök aggodalmuknak adtak hangot a hosszú távú munkahelyvesztés miatt, különösen a forgalmas Strip–belváros–repülőtér háromszögben.

Az Nvidia 7 milliárd dollárért szerzi meg a Poolside-ot

Az Nvidia 7 milliárd dollárt költ a Poolside Model Factory platformjának megszerzésére — 6 milliárd dollár licencdíj és 1 milliárd dollár tőkebefektetés formájában —, miközben mind a 109 alkalmazottnak munkalehetőséget ajánl. Az üzlet az Nvidia eddigi legagresszívebb lépése az AI-szoftverek területén, a hardveres dominancián túl a kódolási modellfejlesztés irányába bővítve.

A Poolside technológiája kódfókuszú AI-modellek generálására és fine-tuningjára specializálódott. Az Nvidia számára a felvásárlás vertikálisan integrált stacket teremt: a modelleket tanító GPU-któl a modellek építéséhez használt szoftverplatformon át a deploy-hoz szükséges fejlesztői eszközökig.

A tranzakció olyan időszakban történik, amikor az Nvidia az új generációs Vera Rubin és Grace Blackwell rendszereinek árát is több mint 15%-kal emeli 2027 elejétől, a növekvő memóriachip-költségek miatt — ez az első jelentős áremelés, amit a nagy felhőszolgáltatók az új hardvergenerációban tapasztalnak.

A Google A2A protokollja csatlakozott az Agentic AI Foundation-höz

A Google Agent-to-Agent (A2A) protokollja hivatalosan is csatlakozott a Linux Foundation által irányított Agentic AI Foundation-höz (AAIF), konszolidálva az AI-ágensek közötti kommunikáció kialakuló szabványait. Az alapítványnak immár több mint 250 tagja van, köztük a legnagyobb felhőszolgáltatók és AI-laborok.

Ez fontos lépés a többszállítós ágens-architektúrák integrációs súrlódásának csökkentése felé. Ahogy a vállalatok különböző szolgáltatóktól telepítenek ágenseket — kódolási, kutatási, munkafolyamat-ágenseket —, szükségük van egy közös nyelvre, amelyen ezek a rendszerek együttműködhetnek. Az A2A a Linux Foundation irányítása alatt megkapja azt a semlegességet és szervezeti struktúrát, amelyet a saját fejlesztésű protokollok nem tudnak biztosítani.

A lépés egy olyan héten történik, amikor az ágens-alapú AI egyértelműen felgyorsult: a Salesforce bemutatta a Slack Code-ot ágens-támogatott kollaboratív kódoláshoz, a Cloudflare Kitesurf böngésző-runtime ágensekhez bétába lépett, a Binance pedig elindította az Agent OS-t AI-alapú kereskedéshez — mind annak jelei, hogy az autonóm AI-rendszerek infrastruktúra-rétege rohamosan érik.

Megosztás