Az OpenAI bemutatta az Ultrafast módot: a GPT-5.6 Sol 14-szeres sebességre kapcsol
Az OpenAI augusztus 13-án bemutatta az Ultrafast módot, egy új, prémium API szintet, amely a GPT-5.6 Sol modellt másodpercenként akár 750 kimeneti token sebességgel futtatja — ez nagyjából 14-szer gyorsabb, mint az alap feldolgozás ~53 token/másodperc sebessége. A titok a Cerebras wafer-scale hardver, amely a hagyományos GPU-klasztereket célzottan tervezett, masszívan párhuzamos következtetésre optimalizált szilíciumra cseréli.
Az Ultrafast az OpenAI meglévő Fast módja fölé pozicionálja magát (utóbbit július végén jelentették be, 2,5-szörös sebességgel, dupla áron, GPU infrastruktúrán). Az új szint egyelőre csak várólistán érhető el, az első hozzáférést válogatott nagyvállalati ügyfelek kapják a kódolás, kereskedelem, pénzügyi kutatás és ügyfélszolgálat területéről. Az árazást még nem hozták nyilvánosságra, az OpenAI csak annyit közölt, hogy prémium szintről van szó a Fast módhoz képest.
A lépés egy szélesebb iparági váltást jelez: ahogy a frontier modellek képességei konvergálnak, a sebesség és a késleltetés válik az új versenyelőnnyé — különösen a valós idejű, ágens alapú munkafolyamatoknál, ahol minden ezredmásodperc számít.
A Google piacra dobta a Gemini 3.7 Flash-t 50%-os árengedménnyel
Alig néhány órával az OpenAI bejelentése előtt a Google augusztus 13-án elindította a Gemini 3.7 Flash modellt — egy gyors, hatékony multimodális modellt, amelyet kódolásra, webfejlesztésre és autonóm ágens munkafolyamatokra terveztek.
A számok meggyőzőek: a DeepSWE v1.1 benchmark teszten, amely hibafelderítést és kódjavítást mér, a Gemini 3.7 Flash 49,0%-ról 65,3%-ra ugrott az elődjéhez képest. A Google szerint a modell kilenc benchmark teszten felülmúlja az Anthropic és az OpenAI hasonló modelljeit.
Talán még figyelemreméltóbb az árazás: 0,75 dollár egymillió bemeneti tokenért és 3,75 dollár egymillió kimeneti tokenért — a Google 50%-kal csökkentette az árakat 2026 végéig. A modell elérhető a Gemini API-n, a Google AI Studióban, az Android Studióban és a Google Antigravity ágens platformján.
A megjelenés mindössze három héttel a Gemini 3.6 Flash után érkezett, és figyelemre méltó, hogy a régóta várt Gemini 3.5 Pro továbbra is késik — ami arra utal, hogy a Google a munkamodellek gyors iterációját helyezi előtérbe a zászlóshajó modellel szemben.
A Google nyílt forráskódúvá tette a HEIR-t: AI következtetés titkosított adatokon
Egy csendesebb, de potenciálisan nagyobb horderejű bejelentésben a Google augusztus 15-én kiadta a HEIR-t (Homomorphic Encryption Intermediate Representation) — egy nyílt forráskódú fordítóeszköz-láncot, amely a betanított AI modelleket titkosított bemeneteken történő következtetésre alakítja át.
A technológia homomorf titkosítást alkalmaz, amely egy olyan kriptográfiai eljárás, ami lehetővé teszi a számítások elvégzését titkosított szövegeken anélkül, hogy az alapadatokat bármikor visszafejtenék. Gyakorlatban ez azt jelenti, hogy egy szerver úgy futtathat AI modellt az adatainkon, hogy közben soha nem látja, valójában mit tartalmaznak.
A Google célja, hogy a HEIR-ből "egykattintásos megoldást" csináljon olyan fejlesztők számára, akik nem kriptográfiai szakértők. A kiadás tartalmaz demókat, amelyek egy szálon futó CPU-s késleltetést mutatnak ajánlórendszereknél és kulcsszófelismerőknél. A projekt a Google szélesebb Private Computing Toolkit részét képezi.
Bár a technológia sok éles rendszernél még túl számításigényes, a megjelenés intenzív vitát váltott ki a Hacker News-on és a közösségi médiában arról, hogy végre elérhető közelségbe került-e a gyakorlati titkosított AI következtetés — ami hatalmas jelentőséggel bírhat az egészségügy, a pénzügyi szektor és minden olyan terület számára, ahol az adatvédelem kiemelten fontos.
Az xAI szállítja a Grok 4.6-ot: frontier teljesítmény versenyképes áron
Elon Musk mesterséges intelligencia vállalata, az xAI (ma már SpaceXAI néven) augusztus 12-én adta ki a Grok 4.6-ot, mindössze 35 nappal a Grok 4.5 után. Az új modell az Artificial Analysis Intelligence Indexen utolérte a GPT-5.6 Sol-t, miközben megtartotta korábbi árazását: 2 dollár egymillió bemeneti tokenért és 6 dollár egymillió kimeneti tokenért, gyorsítótárazott bemenettel mindössze 0,50 dollárért.
A főbb fejlesztések között szerepel egy új xhigh reasoning szint, javított hosszan futó ágens képességek, valamint az 500K tokenes kontextusablak megtartása. A Grok 4.6 1753 ELO-t ér el és a 4. helyen áll az AI Intelligence Indexen, a Claude Opus 5 mögött, de a többi frontier modellel versenyképesen.
A modell egyszerre jelent meg a Cursor-ban, a Grok Build-ban és az API-n, a megjelenéshez kapcsolódóan egy hétig 2× felhasználási keretet kínálva a Grok Build-ban és a Cursor-ban. Az xAI pedig nem lassít: a Grok 4.7, amely egy nagyobb, 2,1 billió paraméteres architektúrára épül, állítólag néhány héten belül érkezik.
Hatályba léptek az EU AI Act átláthatósági szabályai
Miközben a techóriások a sebességen és a benchmark eredményeken versenyeznek, a szabályozási környezet augusztus 2-án megváltozott: az EU AI Act átláthatósági kötelezettségei hivatalosan hatályba léptek — egy mérföldkő, amelynek hatása két héttel később is végiggyűrűzik az iparágon.
Az új szabályok megkövetelik, hogy az AI rendszerek egyértelműen jelezzék, ha a felhasználó mesterséges intelligenciával kommunikál ember helyett, előírják a deepfake-ek és az AI által generált tartalmak géppel olvasható jelöléssel való ellátását, valamint átláthatósági követelményeket támasztanak az érzelemfelismerő és biometrikus kategorizáló rendszerekkel szemben.
A végrehajtás a nemzeti piacfelügyeleti hatóságokra és az Európai AI Hivatalra hárul, a bírságok elérik a 15 millió eurót vagy a globális éves forgalom 3%-át. Ahogy jogi elemzők megjegyezték, ezek a kötelezettségek „nem halasztottak, nem elnapoltak” — az EU-ban működő vállalatoknak azonnal meg kell felelniük.
Az időzítés figyelemre méltó: ahogy az AI modellek egyre gyorsabbak, olcsóbbak és szélesebb körben elterjedtek, az EU megalapozta az első átfogó végrehajtási keretrendszert arra vonatkozóan, hogyan kell tájékoztatni a használatukról és szabályozni a bevetésüket.