A Moonshot AI 2,8 billió paraméteres Kimi K3 modellje holnap nyílt súlyokkal érkezik, miközben a Google küzd a Gemini 3.5 Pro-val

Kimi K3: a világ legnagyobb nyílt súlyú modellje holnap érkezik

A pekingi székhelyű, Alibaba által támogatott Moonshot AI holnap, július 27-én 00:00 UTC-kor teszi közzé a Kimi K3 nyílt súlyait. A 2,8 billió paraméteres modell a valaha kiadott legnagyobb nyílt súlyú LLM, és már a július 16-i, sanghaji World AI Conference-en bemutatott API-s debütálása óta komoly figyelmet kap.

A K3 ritka mixture-of-experts architektúrát használ: a 896 expert közül token-enként mindössze 16 aktiválódik, ami azt jelenti, hogy egyszerre körülbelül 50 milliárd paraméter dolgozik. Az elegáns kialakítás ellenére a modell az első helyre ugrott a Frontend Code Arena benchmark-on 1679 ponttal, megelőzve a Claude Fable 5-öt is a fejlesztők vaktesztjében.

Aki helyben szeretné futtatni, annak van egy rossz híre: MXFP4 négy bites pontossággal a súlyok nagyjából 1,4 terabájtot foglalnak — ehhez komoly hardver vagy cloud cluster kell. A súlyok a Hugging Face-en lesznek elérhetők, módosított MIT licenc alatt. Az API árazás 3 dollár egymillió input token-re és 15 dollár egymillió output token-re.

A megjelenés jól mutatja, hogy Kína egyre versenyképesebb a frontier mesterséges intelligencia terén, különösen a nyílt súlyú modellekben, ahol a kínai laborok rendkívül agresszívan nyomulnak előre. (Források: VentureBeat, Tom's Hardware, TechTimes)

A Google halasztja a Gemini 3.5 Pro-t a gyenge kódolási teljesítmény miatt

A Google határozatlan időre elhalasztotta a Gemini 3.5 Pro szélesebb körű megjelenését, miután belső tesztek kimutatták, hogy a modell kódolási képességei elmaradnak a várakozásoktól. Az eredetileg júniusra, majd júliusra tervezett launch-nak továbbra sincs megerősített dátuma.

A Bloomberg információi szerint a Google a múlt hónapban frissítette a modell tanítási adatait a kódolási teljesítmény javítása érdekében, de az eredmények csalódást keltőek voltak. A késés különösen rossz időpontban jön: az OpenAI GPT-5.6-ja és az Anthropic Claude modelljei továbbra is uralják a coding benchmark-okat.

A helyzet állítólag feszültséget okozott a Google mesterségesintelligencia-csapatain belül, ahol sokan attól tartanak, hogy a vállalat lemarad a versenytársakhoz képest. Az Alphabet részvényei közel 3%-ot estek a késésről szóló első jelentések után. A Gemini 3.5 Pro egyelőre csak korlátozott Vertex AI enterprise preview-ban érhető el.

(Források: Search Engine Journal, 9to5Google, WinBuzzer)

Az Apple beperelte az OpenAI-t üzleti titkok állítólagos ellopása miatt

Az év egyik legdrámaibb jogi lépéseként az Apple keresetet nyújtott be az OpenAI ellen a kaliforniai északi kerületi szövetségi bíróságon, azzal vádolva az AI-labort, hogy volt Apple-alkalmazottakon keresztül hardveres üzleti titkokat lopott.

A per középpontjában két személy áll: Tang Tan, az OpenAI hardveres vezetője és az Apple korábbi terméktervezési alelnöke, valamint Chang Liu, az Apple egykori rendszermérnöke, aki 2026-ban csatlakozott az OpenAI-hoz. Az Apple állítása szerint Tan még a távozása előtt bizalmas információkat küldött el magának e-mailben az Apple beszállítóiról, és belső Apple kódneveket használt, amikor az OpenAI-hoz Apple-alkalmazottakat toborzott, hogy további információkat szerezzen.

A legkomolyabb vád: az Apple szerint Liu nem adta vissza a céges laptopját távozásakor, bizalmas dokumentumokat töltött le róla, és felfedezett egy hibát, amellyel már az OpenAI alkalmazottjaként is hozzáfért az Apple felhőalapú fájltárolójához. Az állítólag eltulajdonított anyagok között be nem jelentett termékek specifikációi, mérnöki prezentációk és szabadalmazott projektadatok szerepelnek.

Az OpenAI egyelőre nem reagált nyilvánosan a kereset részleteire. Az ügynek komoly következményei lehetnek a techcégek közötti munkaerő-mobilitásra és a bizalmas információk kezelésére az AI hardver-versenyben.

(Források: TechCrunch, CNBC, Fortune)

A Meta kilép a csak nyílt modell stratégiából: itt a Muse Spark 1.1 fizetős API

A Meta hivatalosan is belépett a fizetős AI API piacra. A vállalat július 9-én mutatta be a Muse Spark 1.1 modellt a Meta Model API nyilvános preview-jával együtt — ami jelentős stratégiai váltást jelent a korábban kizárólag nyílt forráskódú megközelítéshez képest.

A Muse Spark 1.1 a Meta Superintelligence Labs második modellje, amelyet agentic feladatokra terveztek, egymillió token-es kontextusablakkal. A nyílt Llama családdal ellentétben a Muse Spark 1.1 zárt súlyú, tulajdonosi modell. Mark Zuckerberg az árazást — 1,25 dollár egymillió input token-re és 4,25 dollár egymillió output token-re — az Anthropic és az OpenAI hasonló modelljeinek körülbelül 25%-ára pozícionálta.

Az új fejlesztők 20 dollár értékű ingyenes kreditet kapnak. Az API jelenleg nyilvános preview-ban érhető el az amerikai fejlesztők számára, a nemzetközi bevezetés az év második felében várható. A lépéssel a Meta közvetlen versenytársa lett az OpenAI-nak, az Anthropic-nak és a Google-nek a fejlesztői API-bevételekért folyó harcban.

(Források: Quartz, TechTimes, DataCamp)

Az Anthropic 19 milliárd dolláros, 20 éves adatközpont-megállapodást kötött a TeraWulf-fal

Az Anthropic az egyik eddigi legnagyobb AI-infrastruktúra-megállapodást kötötte meg: 19 milliárd dolláros, 20 éves bérleti szerződést írt alá a TeraWulf-fal egy célzottan épített AI campus-ért a kentucky-i Hawesville-ben. A július 6-án bejelentett létesítmény körülbelül 401 megawatt kritikus IT-terhelést fog kiszolgálni.

Az első kapacitások 2027 második felében állnak üzembe, a teljes kiépítés 2028 elejére várható. A TeraWulf 3-4 milliárd dollárt tervez a létesítménybe fektetni — a bérlet teljes értékének kevesebb mint egyötödét. A bejelentés hatására a TeraWulf részvényei több mint 10%-ot emelkedtek.

A megállapodás az Anthropic rendkívüli növekedési időszakában jön: az évesített bevétel 2026 májusában átlépte a 47 milliárd dollárt, a vállalat pedig bizalmas S-1 nyilatkozatot nyújtott be az SEC-hez, jelezve a közelgő tőzsdei bevezetést. Az infrastrukturális elköteleződés mértéke azt mutatja, hogy az Anthropic hosszú távon számít a Claude modellek iránti tartós keresletre.

(Források: SiliconANGLE, Data Center Dynamics, Yahoo Finance)

Megosztás