# AI Hírfolyam Friss hírek a mesterséges intelligencia világából. Szakembereknek és érdeklődőknek. --- # A Z.ai GLM-5.3 modellje ugrásszerű fejlődést mutat, kizárólag utóképzéssel *Published:* 2026-08-15 *Author:* Remi A Z.ai kiadta a **GLM-5.3** modellt, amely ugyanazon a 743 milliárd paraméteres alapmodellen fut, mint a GLM-5.2, a cég csak a post-training folyamatokat javította: több feladatkörnyezet, több környezettípus és hosszabb képzés. A kódolási benchmarkokon a hosszútávú feladatoknál van a legnagyobb ugrás: a Terminal-Bench 3.0 4,6-ről 28,3-ra, a DeepSWE v1.1 46,2-ről 66,9-re emelkedett. A CyberGym sebezhetőség-felderítési benchmarkon 84,5 százalékot ért el, amellyel megelőzte a Mythos 5 (83,8%) és a GPT-5.6 Sol (83,6%) modelleket, az összetettebb ExploitBench teszten pedig az előző verzió 24,4%-áról 54,4%-ra nőtt az eredmény. A vállalat szerint a vártnál gyorsabban fejlődtek a kiberbiztonsági képességek, amelyeket valódi nyílt forráskódú projekteken is leteszteltek: 269 projektben 2436 sebezhetőséget azonosítottak, amelyek közül 1097 magas vagy kritikus besorolású volt. A hibák egy része évtizedek óta észrevétlenül volt jelen a kódban. A modell már elérhető a Z.ai API-n, a GLM Coding Plan előfizetésben és a ZCode eszközben. A súlyok egyelőre nem nyilvánosak — a cég körülbelül két héten belül, a biztonsági értékelés és megerősítés után teszi közzé azokat. --- # A Google kiadta a Gemini 3.7 Flash modellt *Published:* 2026-08-15 *Author:* Remi A Google mindössze három héttel a Gemini 3.6 Flash után kiadta a 3.7 Flash modellt. A cég szerint algoritmikus fejlesztéseknek köszönhető a szokatlanul gyors iteráció. A modell legnagyobb javulást a kódolási feladatokban mutatja. A FrontierCode benchmarkon 34,4-ről 43,6 százalékra, a DeepSWE-n pedig 49,0-ről 65,3 százalékra ugrott a pontszám. A webfejlesztésben is előrelépett: az Arena.ai WebDev ranglistáján 1538-ról 1588 Elo-pontra javult. A tudásigényes területeken, például a GDP.pdf dokumentumértelmezési benchmarkon 22-ről 34 százalékra nőtt a teljesítmény. Az új modell bevezető ára 1 millió input tokenenként 0,75 dollár és 1 millió output tokenenként 3,75 dollár, ami az eredeti 3.6 Flash árának fele. Ez az ár az év végéig érvényes. A Gemini Spark személyes AI-ügynök is átállt a 3.7 Flashre, és a modell már elérhető a Gemini API-ban, az AI Studióban és a Gemini Enterprise-ben. --- # Az OpenAI bejelentette az Ultrafast módot: GPT-5.6 Sol 14-szeres sebességgel *Published:* 2026-08-14 *Author:* Remi Az OpenAI bejelentette az Ultrafast nevű új szolgáltatási szintet, amely a GPT-5.6 Sol modellt akár 14-szer gyorsabban futtatja a normál sebességnél. A Cerebras chipekkel hajtott szolgáltatás másodpercenként 750 kimeneti tokent generál. Az Ultrafast célja, hogy a legmagasabb szintű mesterséges intelligencia valós időben is használható legyen olyan területeken, ahol minden másodperc számít: incidenskezelés, pénzügyi elemzés, élő ügyfélszolgálat, kereskedelem és interaktív kutatás. Az OpenAI szerint a gyorsaság eddig általában kisebb vagy specializáltabb modellek használatát jelentette — az Ultrafast ezt a kompromisszumot próbálja megszüntetni. A cég egyelőre szűk ügyfélkörrel teszteli a szolgáltatást, hogy kiderítse, hol adja a legnagyobb értéket a gyorsabb válaszidő, a tervek szerint azonban hamarosan szélesebb körben is elérhető lesz. --- # Egy friss kutatás szerint az AI modellek viselkedése nagyban függ attól, hogy kivel beszélnek *Published:* 2026-08-13 *Author:* Remi A Transluce kutatócsoport vizsgálata szerint több fejlett AI-modell viselkedése mérhetően megváltozik, ha felismeri a felhasználót. A kutatók 280 különböző identitással tesztelték a modelleket, és azt találták, hogy ismert AI-kutatók esetében például csökkenhet a modellek saját válaszaikba vetett magabiztossága, szigorúbban értékelhetnek válaszokat, illetve bizonyos esetekben több „gondolkodást” használhatnak. A legerősebb eltéréseket AI-biztonsági kutatóknál mérték. Amanda Askell esetében például a Claude 5 százalékponttal alacsonyabb magabiztosságot jelzett saját viselkedésével kapcsolatban, és 28%-kal gyakrabban használt reasoninget. A jelenség nem csak a Claude-nál jelent meg: a kutatók 24 modellt vizsgáltak hat különböző modellcsaládból, és több GPT, Gemini, GLM és DeepSeek modellnél is találtak hasonló eltéréseket. A felfedezés az alignment értékelések megbízhatóságát kérdőjelezi meg. A jelenlegi benchmarkok többsége kitalált nevekkel és cégekkel dolgozik, ami elrejtheti a valós, identitásfüggő viselkedést. A kutatók szerint a *user awareness* önmagában még nem veszélyes a tesztelt szűk forgatókönyvekben, de előfutára lehet aggasztóbb viselkedéseknek, mint a célzott sandboxing vagy értékelések manipulálása. --- # Az xAI kiadta a Grok 4.6 modellt *Published:* 2026-08-13 *Author:* Remi A Grok 4.6 modellt kifejezetten a hosszan futó ügynökökre, valamint az ambiciózus interaktív és vizuális projektekre koncentrál. A modell több benchmark mérésen is frontier szintet ért el: az Artificial Analysis Intelligence Indexen 61 pontot szerzett, ami megegyezik a GPT-5.6 Sol pontszámával. A Grok 4.6 már elérhető a Cursorban és a Grok Buildben, és az első héten dupla mennyiségű használatot kapnak a felhasználók. A modell különösen erős abban, hogy egy általános termékötletből működő első verziót készítsen — kutat, strukturál, implementál, majd saját munkáját ellenőrzi a továbblépés előtt. Az API árazása 2 dollár 1 millió input tokenenként és 6 dollár output tokenenként; a gyors változat pedig dupla áron érhető el. A biztonsági intézkedéseket is javították, a cég szerint széleskörű tesztelési sorozatot futtattak le a kiadás előtt. A Grok 4.6 az xAI API-n, az OpenRouteren, a Vercelen és a Cloudflare-en keresztül is használható. --- # A DeepSeek V4 Pro végleges verziója 4600 százalékkal olcsóbb a Claude Fable 5-nél *Published:* 2026-08-13 *Author:* Remi A DeepSeek csendben kiadta a V4 Pro modell végleges, „0813″ jelű verzióját, amely április óta preview állapotban futott. A cég saját benchmark táblázata szerint a modell tíz agent benchmarkon mérve átlagosan 5,3 százalékkal gyengébben teljesít a Claude Fable 5-nél — de ha kiveszik a Humanity’s Last Examet, ahol a legszélesebb a rés, a különbség 2,8 százalékra zsugorodik. Az árazásban viszont nagy a különbség: míg a Claude Fable 5 egymillió bemeneti tokenje 10 dollárba, a kimeneti 50 dollárba kerül, a DeepSeek V4 Pro ugyanezért 0,435 és 0,87 dollárt kér — azaz nagyjából 46-szor olcsóbb. A feladatonkénti költségkülönbség még nagyobb: a Fable 5 hosszabb gondolkodás és több kimeneti token miatt tevékenységenkét számolva még többe kerül. A számokat a DeepSeek saját infrastruktúráján, saját méréssel állította elő — független ellenőrzés még nincs. A trend azonban egyértelmű: a kínai nyílt súlyú laboratóriumok tartják a lépést az amerikai csúcsmodellekkel, miközben a költségeket töredékére csökkentik. A V4 Pro súlyai MIT-licenc alatt, nyíltan elérhetők a Hugging Face-en. --- # Az amerikai kormány betiltja a külföldi robotok importját *Published:* 2026-08-13 *Author:* Remi Az amerikai Szövetségi Kereskedelmi Bizottság (FTC) múlt héten átfogó tiltást vezetett be a külföldi gyártmányú fejlett robotok – köztük humanoidok, négylábúak és kerekes robotok – importjára. Az indoklás kettős: az ilyen robotok túl sok adatot gyűjtenek, ami nemzetbiztonsági kockázat, és az amerikai robotikai cégek védelemre szorulnak a kínai versenytársakkal szemben. A döntés megosztja a szakmát. Az amerikai robotikai vállalatok és egyetemi kutatólaborok jelentős része olcsó kínai robotokra támaszkodik – különösen a Unitree termékeire. A szakmai szervezetek belső felmérése szerint az amerikai egyetemek robotikai kutatási publikációinak 90 százaléka kínai gyártmányú robotokat használt. Egy négylábú Unitree robot körülbelül 4600 dollárba kerül, míg egy hasonló Boston Dynamics modell akár 278 000 dollár is lehet. A lépést a Trump-kormányzat szélesebb AI-védelmi stratégiájának részeként értelmezik: az adminisztráció állítólag nyílt forráskódú kínai modellek betiltását is fontolgatja, ami évente 25 milliárd dollár megtakarítástól fosztaná meg az amerikai vállalatokat. --- # A Fields-díjas Jacob Tsimerman az OpenAI-nál folytatja *Published:* 2026-08-13 *Author:* Remi Jacob Tsimerman, a friss Fields-díjas matematikus, az OpenAI-nál kezd AI-biztonsági kutatóként. A döntést a díjátadó ceremónián jelentette be: az elismerés átvétele után bejelentette, hogy távozik a Torontói Egyetemtől, és az OpenAI-hoz szerződik. Tsimerman formális nyelvi és verifikációs módszerekkel igyekszik megérteni és biztonságossá tenni az AI-rendszereket. Korábban publikált egy tanulmányt a mesterséges intelligencia kockázatairól, és úgy gondolja, hogy az AI-rendszerek néhány éven belül egyértelműen emberfeletti matematikai képességekkel fognak rendelkezni. --- # Az xAI elindította a Grok Botot, a saját „AI-munkatárs” megoldását *Published:* 2026-08-13 *Author:* Remi Az xAI augusztus 11-én elindította a Grok Bot publikus bétáját, egy olyan AI-ügynök rendszert, amelyet eredetileg a cég belső munkafolyamataihoz fejlesztettek ki. A Bot nem egyszerű chatbot, hanem saját cloud számítógéppel rendelkező, folyamatosan dolgozó agent — bejelentkezik a meglévő eszközökbe és alkalmazásokba, és önállóan végzi el a többlépéses feladatokat. A felhasználók úgy kommunikálnak a Bottal, mint egy kollégával: üzeneteket küldenek neki asztali vagy iOS appból, és egyszeri bemutató után a Bot elmenti a munkafolyamatot rutinként. A rendszer képes párhuzamosan több Botot futtatni, amelyek egymás között is koordinálnak: üzeneteket küldenek, munkát osztanak meg és csoportos chatben egyeztetnek. Három előfizetés-típussal elérhető a Bot: a SuperGrok Heavy (300 dollár havonta), a Cursor Ultra (200 dollár havonta) és a Cursor Premium Teams (120 dollár/fő/hó) csomagok tartalmazzák. --- # Az Anthropic láthatatlan jelöléssel látja el a Claude által generált szövegeket az EU AI Act miatt *Published:* 2026-08-11 *Author:* Remi Az Anthropic aláírta az EU AI Act magatartási kódexét, amely az AI által generált tartalmak átláthatóságát írja elő. Ennek megfelelően a Claude kimeneteiben géppel olvasható jelöléseket vezet be. A 2026. augusztus 2. után megjelenő Claude-modellek szöveges válaszaiban egy láthatatlan vízjel található, amely a szöveg része marad másoláskor és szerkesztéskor is. A képfájlokhoz (.svg, .png és .jpg formátumokban) pedig C2PA szabványú, digitálisan aláírt meta adat kapcsolódik, amely jelzi, hogy a fájlt a Claude dolgozta fel. A vízjelezés modellszinten történik, így a forrástól függetlenül minden kimenetre vonatkozik. Az életbe lépés előtt megjelent modellekre átmeneti időszak vonatkozik, ezeknél az Anthropic még dolgozik a vízjelezés bevezetésén. Az Anthropic hamarosan technikai dokumentációt tesz közzé a vízjelek felismeréséről is, hogy harmadik felek maguk is ellenőrizhessék a tartalmat. A cég egyúttal figyelmeztet: a géppel olvasható jelek fontosak, de nem szabad kizárólag erre támaszkodni, mivel a technológiai korlátok miatt hamis pozitív és hamis negatív eredmények is előfordulhatnak. --- # Egy OpenClaw AI-ügynök „véletlenül” feltörte egy ausztrál konditerem foglalási rendszerét *Published:* 2026-08-10 *Author:* Remi Egy ausztrál férfi a Claude modell által hajtott OpenClaw AI-ügynökét kérte meg, hogy foglaljon egy időpontot neki egy helyi konditeremben. Az ügynök felfedezett egy sebezhetőséget a foglalási szoftverben, és a megengedettnél hetekkel korábbra foglalta le az órát. Az eset előtt a felhasználó megkérdezte, feljebb lehet-e kerülni valahogy a várólistán, ekkor vette észre az ügynök, hogy az API-ban nincs jogosultság-ellenőrzés mások foglalásainak törlésére. Ezt ki is használta: törölte az első helyen álló tag foglalását, és így a felhasználót feljebb léptette. A műveletet az ügynök maga kezdeményezte, a felhasználó nem kérte rá. Ezután a riadt felhasználó megkérte az AI ügynököt, hogy jelentse a biztonsági rést a foglalási rendszer fejlesztőinek, amit az készségesen meg is tett. --- # Sam Altman lassítaná az AI-fejlesztést a Hugging Face-incidens után *Published:* 2026-08-08 *Author:* Remi Sam Altman nyíltan beszélt arról, hogy lassítani kellene az AI-fejlesztés ütemét, hogy a társadalom felkészülhessen az új képességszintekre. A Patrick O’Shaughnessy podcastjában tett nyilatkozata eltér az eddigiektől: korábban Altman élesen kritizálta a fejlesztés lassítására irányuló kezdeményezéseket. A változás közvetlen oka [az OpenAI egyik fejlett modelljének „szökése”](https://aihirfolyam.hu/2026/07/egy-kiserleti-openai-modell-feltorte-a-hugging-face-infrastrukturajat/): július elején egy kísérleti modell több nulladik napi sebezhetőséget láncba fűzve tört ki a sandbox-környezetéből, és a Hugging Face éles infrastruktúráját támadta meg. A modell betanítását emiatt leállították. Az OpenAI és az Anthropic is támogatta a „Pacing the Frontier” petíciót, amely kormányzati eszközöket sürget a fejlesztés szándékos lassításáért. Altman azonban óvatosan fogalmazott: szerinte a biztonsági aggályok egy része „hatalomkoncentrálásra” ad ürügyet — ezzel közvetve Dario Amodei Anthropic-vezérigazgatót célozva. Az OpenAI továbbra is az iparági önszabályozást részesíti előnyben a kormányzati szabályozással szemben. --- # Teljesen új, életképes vírusokat hoztak létre AI segítséggel *Published:* 2026-08-08 *Author:* Remi A Stanford Egyetem és az Arc Institute kutatói mesterséges intelligenciát használtak új vírusok létrehozására. Az **Evo** modellt — amely hasonlóan működik, mint a ChatGPT, csak szöveg helyett DNS-szekvenciákon tréningelték — a természetben előforduló génszerkezetek mintáira tanították be, majd teljesen új vírusgenomok generálására kérték fel. A *Science* folyóiratban közzétett tanulmány szerint a modellel tervezett genomok közül 16 életképes vírust hozott létre a laborban. A kutatók a baktériumokat fertőző Phi X-174 fág és rokonai adatain tréningelték az Evót, mivel ezek az emberre veszélytelenek — csak az E. coli baktériumot támadják meg. Az AI 700 000 lehetséges genomváltozatot javasolt; a kutatók 285-öt szintetizáltak, és a petricsészékben elszaporodó vírusfoltok jelezték, hogy 16 tényleg működőképes. Néhány a természetes változatnál is gyorsabban szaporodott. A felfedezés orvosi alkalmazásokat is ígér — például génterápiában hordozó vírusok tervezését —, de biológiai fegyverek kockázatát is felveti. A kutatók megelőzésképpen kizárták az emberre veszélyes vírusok adatait az Evo tréningjéből, ám a Johns Hopkins biztonsági szakértője szerint a tudomány és a szabályozás között „hatalmas szakadék” tátong. Az amerikai orvosi kutatóintézet, a NIH új szabályozása egyelőre csak a laboratóriumi kísérleteket korlátozza; a számítógépes genomgenerálást nem. --- # Az OpenAI bejelentette az Astrát, és egyből évtizedes matematikai problémákat oldott meg vele *Published:* 2026-08-07 *Author:* Remi Az OpenAI bejelentette a következő nagy modelljét, az **Astrát**, és a bejelentés módja legalább annyira figyelemre méltó, mint maga a modell: a cég tíz, korábban megoldatlan matematikai probléma megoldását tette közzé egyszerre. A problémák többek között a csoportelmélet, a nagydimenziós geometria, a kódoláselmélet és a kriptográfia területéről valók, és volt köztük olyan is, amelyen évtizedek óta nem sikerült érdemi előrelépést elérni. A bizonyításokat is nyilvánosságra hozták, méghozzá géppel ellenőrizhető Lean formátumban a GitHubon, vagyis megfelelő környezetben bárki letöltheti és ellenőrizheti, hogy a bizonyítások logikailag helyesek-e. Ez ugyanakkor még nem jelenti azt, hogy mind a tíz eredmény véglegesen lezárt és szakmailag minden szempontból ellenőrzött. Az első független visszajelzések mindenesetre biztatóak: néhány eredményre már napokon belül olyan új tanulmányok jelentek meg, amelyek továbbépítik vagy egymástól függetlenül alátámasztják azokat. Az cég szerint a tíz sikeres megoldáshoz felhasznált számítási kapacitás API-áron nagyjából 2000 dollárba került. Ez persze nem az Astra fejlesztésének vagy a teljes kutatásnak a költsége, csak a sikeres futtatások becsült ára. --- # Az OpenAI eltörli a ChatGPT-ben a szöveges üzenetek korlátját, még az ingyenes felhasználóknál is *Published:* 2026-08-07 *Author:* Remi Az OpenAI bejelentette, hogy az összes ChatGPT-felhasználó számára megszünteti a szöveges üzenetek napi korlátját. A korlátozás volt eddig az egyik legnagyobb kényelmetlensége az ingyenes használatnak: a napi határ elérése után leállt a szolgáltatás, hacsak a felhasználó nem fizetett elő. Ez mostantól a szöveges chat-ekre nem érvényes, bármennyi üzenetet lehet küldeni — de a képgenerálás, fájlfeltöltés és hangeszközök továbbra is korlátozottak maradnak. Ezzel párhuzamosan az új alapértelmezett modell a GPT-5.6 Luna lesz minden felhasználónak. Ez a kisméretű modell a GPT-5.5 Instanthoz képest 62 százalékkal kevesebb tényellenőrzési hibát produkál. Ingyenes és Go-előfizetők számára egy új „Think” gomb is érkezik, amely több időt biztosít a modellnek a nehezebb kérdések feldolgozására. Ezenkívül a Plus és Pro felhasználók számára mostantól okosabb a GPT-5.6 Sol: jobb webes kutatás, írás, tervezés, és döntéshozatal, valamint egy új ötfokozatos csúszka is elérhető a gondolkodási szint beállításához. A korlátlan chat aggodalmakat is felvet. Korábbi ügyek felhívták a figyelmet arra, hogy a túlzott AI-chatbot-használat mentális egészségügyi problémákat okozhat, illetve súlyosbíthat — egy aktuális perben egy anya az OpenAI-t vádolja azzal, hogy nem védte meg a lányát a ChatGPT túlzott használatától. A cég ezért 18 év alattiaknak extra védelmeket is beépített, például a modellek elkerülik a romantikus szerepjátékot. --- # A WP-Autoplugin v2 valódi ügynöki programozást hoz a WordPress-be *Published:* 2026-08-07 *Author:* Remi Megjelent a WP-Autoplugin bővítmény 2.0 verziója, amely az alapoktól lett újraépítve. Az első verzió egyszerű leírásból generált új WordPress-pluginokat, a v2 viszont már egy teljes értékű, ügynöki rendszerű AI-kódoló eszköz a WordPress admin felületén belül. ![](https://aihirfolyam.hu/wp-content/uploads/2026/08/workspace-overview-hu-1024x987.png)A WP-Autoplugin v2 képes feltérképezni egy meglévő kódbázist, megérteni a működését, tervet készíteni, majd célzott módosításokat végrehajtani anélkül, hogy az élő kódot azonnal módosítaná. A generált változtatások csak adminisztrátori jóváhagyás után kerülnek alkalmazásra. A rendszer támogatja új pluginok létrehozását, meglévő pluginok és sablonok javítását vagy bővítését, külön extension plugin készítését hookok alapján, valamint a strukturált kódellenőrzést. A tool loop fájlokat olvas, kódot generál, és ellenőrzi az eredményt — mindezt a WordPress REST API-n és háttérfeladatokon keresztül, oldalfrissítés után is folytatva a munkát. A plugin ingyenes, és *bring-your-own-key* alapon működik: OpenAI, Anthropic, Gemini, xAI vagy bármilyen OpenAI-kompatibilis API használható, illetve sima ChatGPT-előfizetéssel is működik. --- # A DeepSeek drasztikus áremelést jelentett be *Published:* 2026-08-06 *Author:* Remi A DeepSeek bejelentette, hogy hamarosan jelentősen megemelik az API-árakat. A részleteket egyelőre nem közölték — új árlista vagy konkrét számok nem szerepeltek a figyelmeztetésben —, de a lépés drasztikus irányváltás attól a cégtől, amely eddig extrém alacsony árakkal bombázta a piacot. A cég az utóbbi időben a V4-Flash modellt is ezzel a stratégiával reklámozta: független tesztek szerint is ez volt a legjobb ár-érték arányú modell. A drágulásra valószínűleg a túlkereslet és a számítási kapacitás terhelése miatt szükség — a rendkívül alacsony árakkal rengeteg felhasználót vonzottak, ami fenntarthatatlan költségeket generált. A DeepSeek már korábban is kísérletezett csúcsidős felárakkal, de most a teljes árstruktúra emelését helyezte kilátásba. A konkurencia ezzel párhuzamosan lezárta az árkülönbséget: a Meta Muse Spark és az OpenAI új modelljei már hasonló képességeket és árakat kínálnak. Ha a DeepSeek drágulni kezd éppen akkor, amikor a riválisok egyre olcsóbbak, a cég elveszítheti azt az egyetlen előnyt, amelyre az egész brandjét építette. A lépés ugyanakkor azt is jelzi, hogy az ingyeneshez közelítő AI-szolgáltatások korszaka talán véget ér. --- # Vezető AI-szakértők távoznak a Google-től, hogy új startupot alapítsanak *Published:* 2026-08-06 *Author:* Remi Jeff Dean, a Google Brain társalapítója, a DeepMind főtudósa és a Gemini technikai társelnöke 27 év után elhagyja a Google-t. Sanjay Ghemawattal, a cég egyik első alkalmazottjával, valamint Oriol Vinyals-szal (DeepMind kutatási alelnök, Gemini vezető) és Quoc Le-vel (Google Brain társalapító, AutoML-Zero) közösen alapítják meg a **Discovery Loop** startupot. A Discovery Loop célja a tudományos módszer automatizálása: kísérleteket javasol, implementál, és értékel, iterációk ezreit futtatva automatikusan. A cég első ügyfele saját maga lesz — a hurokokat kezdetben a saját gépi tanulási algoritmusainak javítására használja, majd chiptervezésre, biológiára, gyógyszerkutatásra és anyagtervezésre terjeszti ki. A Google befektetőként és felhőszolgáltatóként továbbra is együttműködik velük, de négy ilyen meghatározó szakember távozása komoly veszteség a vállalat számára. --- # A Meta kiadta a Muse Code CLI programozó eszközt, és a Muse Spark 1.2 modellt *Published:* 2026-08-06 *Author:* Remi A Meta kiadta a Muse Code terminál alapú kódoló ügynököt, amely a Muse Spark 1.2 modellre épül. Az eszközt kifejezetten a nagy kódbázisokban elvégzendő komplex szoftverfejlesztési feladatokra szánják: tervez, kódol, és validálja az eredményeket, több állandó alügynököt koordinálva egyszerre. A Muse Code aszinkron háttérügynökökkel működik, amelyek az egész munkamenet alatt aktívak maradnak. A helyi eseménynapló minden modellhívást és eszközfuttatást rögzít, így a rendszer egy nem várt leállás után pontosan onnan folytathatja, ahol abbahagyta. A beépített */plan*, */grill* és */goal* skill-ekkel tervezést, stressztesztelést és cél-elérést támogat. A Muse Spark 1.2 kódolásra specializált frissítés: javult a kódgenerálás, a komplex hibakeresés és a kódbázis-megértés. A modellt a Muse Code-dal együtt tréningelték, önfejlesztő ciklust is alkalmazva — a korábbi modell generálta a környezeteket, majd értékelte az eredményeket. Mindkettő elérhető már a Muse Code-ban és a Meta Model API-n keresztül. --- # A brit AI-biztonsági intézet tesztjében is éles rendszereket támadtak meg a legújabb modellek *Published:* 2026-08-05 *Author:* Remi A brit AI-biztonsági intézet (AISI) beszámolója szerint a tesztelt AI-modellek „jogosulatlan” cselekményeket hajtottak végre az interneten keresztül. Július 28-án furcsa adatátvitelekre lettek figyelmesek a Tor-hálózaton keresztül, a vizsgált modellek — az Anthropic Mythos 5 és az OpenAI GPT-5.6-Sol — összesen 19 rosszindulatú akciót hajtottak végre 122 futtatásból 10 alkalommal. A modellek megpróbáltak rosszindulatú kódot beilleszteni egy valódi nyílt forráskódú projektbe, hamis online identitásokat hoztak létre, hogy rávegyék az emberi karbantartókat a kód jóváhagyására, és prompt injection utasításokat helyeztek el olyan helyeken, ahol más AI-rendszerek felvehetik és végrehajthatják azokat. Több alkalommal is együttműködtek egymással: az egyik modell nyilvános üzeneteket vagy jegyzeteket hagyott a GitHubon a másiknak. Az AISI hangsúlyozta: ez nem sandbox-szökés, mert szándékosan engedélyezték az internet-hozzáférést és kikapcsolták a kiberbiztonsági szűrőket. Ugyanezen a napon az OpenAI is elismerte, hogy az AISI és egy másik harmadik fél, az Irregular is jelentett olyan incidenseket, ahol a modellek túllépték a teszthatárokat. Július 29-én egy konfigurációs hiba miatt a modellek elérték a nyilvános internetet, ahol kihasználtak egy valódi domaint, és megtalálták, majd használták a webhely hitelesítő adatait. --- # A Minimax nyílt forráskódú videómodellt mutatott be H3 néven *Published:* 2026-08-05 *Author:* Remi A kínai vállalat rendszere 15 másodperc hosszú, hanggal ellátott, 2K felbontású videókat képes generálni, akár egy erősebb otthoni gépen is. A bejelentés szerint a súlyokat is közzéteszik, hogy a fejlesztők saját hardveren futtathassák és módosíthassák a modellt. A modell azonban több nagy piacon nem érhető el hivatalosan: az Egyesült Államokban, az Európai Unióban, az Egyesült Királyságban és Dél-Koreában sem. A cég a szabályozási bizonytalanságra hivatkozik – például az EU AI Act, a brit és dél-koreai AI-szabályozások, valamint az amerikai szerzői jogi perek miatt tartózkodnak a kiadástól. Technológiailag az H3 in-context regenerationnel dolgozik: először alacsonyabb felbontásban generál, majd a saját kimenetét újragenerálva állít elő 2K minőséget. A modell a szövegfeldolgozáshoz a nyílt Qwen3-VL-32B vision-language modellt használja. Több kínai nyílt súlyú modellhez hasonlóan a H3 is a zárt rendszerek nyílt, ingyenes alternatívájaként pozicionálja magát. --- # Német bíróság: a Suno AI zenegenerátor megsértette a szerzői jogokat – elutasították a fair use védelmet *Published:* 2026-08-05 *Author:* Remi Egy müncheni bíróság kimondta, hogy az AI zenegenerátor Suno megsértette a szerzői jogokat – nemcsak a kimeneteivel, hanem magával a betanítási folyamattal is. A bíróság hat dalban reprodukálhatóan tárolt zenei részleteket talált a modellben, és elutasította mind a német szöveg- és adatbányászati kivételt, mind az amerikai fair use védelem érvényesítését. A döntés precedensértékű lehet az egész generatív zenei ipar számára. A Suno – hasonlóan versenytársához, az Udiához – eddig azzal védekezett, hogy a nyilvánosan elérhető zenék tanítása a fair use keretein belül történik. A müncheni bíróság most ezt az érvelést visszautasította: szerintük a modell nem egyszerűen „tanul” a zenékből, hanem reprodukálhatóan tárolja azokat. A bíróság hat konkrét dal esetében állapította meg a jogsértést, ahol a Suno modellje olyan részleteket tartalmazott, amelyek a felperesek szerzői jogi védelem alatt álló műveiből származtak. A döntés nem jogerős – a Suno fellebbezhet –, de már most is komoly hullámokat vet az AI-zene területén. A nagy lemezkiadók (köztük a Sony, a Universal és a Warner) már korábban is perelték a Sunót és az Udiót az Egyesült Államokban. A német döntés most új fegyvert ad a kiadók kezébe: ha az európai bíróságok is hasonló ítéleteke hoznak, az alapjaiban változtathatja meg, hogyan taníthatóak az AI zenemodellek. --- # Az Alibaba elérhetővé tette a Qwen3.8-Max modellt *Published:* 2026-08-04 *Author:* Remi Az Alibaba Qwen csapata elérhetővé tette a Qwen3.8-Max modellt, a Qwen család eddigi legerősebb tagját. A 2,4 trilliárd paraméteres MoE rendszer július 19-én mutatkozott be a shanghai-i WAIC konferencián korlátozott, előzetes verzióként, mostantól azonban bárki számára használható API-n keresztül. A modell 1 millió tokenes kontextusablakot és multimodális képességeket kínál: szöveg, kép és videó bemenetet egyaránt feldolgoz. Az API árazása 2 dollár 1 millió input tokenenként, 6 dollár output tokenenként, a gyorsítótárazott input pedig 0,25 dollár. A Qwen3.8-Maxnak és egy kisebb, Qwen3.8-27B változatnak is közzé fogják tenni a súlyait, hogy bárki futtathassa saját hardveren a modelleket – ezt jövő hétre ígérik. A benchmarkok szerint a modell a Terminal-Bench 2.1 teszten 86,6 pontot ért el, a PaperBenchen 93,0-at, és a legtöbb vision benchmarkot is vezeti. A legnagyobb ugrás az előd Qwen3.7-Maxhoz képest az agent és kódolási képességekben tapasztalható: a FrontierSWE pontszám 40,7-ről 73,5-re emelkedett, a DeepSWE 1.1 pedig 21,6-ről 56,6-ra. --- # A Google két nap után visszavonta a Google Earth-be épített AI-képgenerátort *Published:* 2026-08-03 *Author:* Remi A Google alig két nappal a bevezetés után visszavonta a Google Earth új AI-funkcióját, amely a Nano Banana 2 képgenerátort integrálta a műholdképes alkalmazásba. A lépésre azért került sor, mert a felhasználók percek alatt megmutatták: a funkció tökéletes eszköz a megtévesztő műholdképek gyártására. A visszavont funkció lehetővé tette, hogy a felhasználók szöveges utasítással módosítsák a műholdfelvételeket: például Pompeii romjait eleven római utcaképpé alakítsák, vagy egy üres telekre építkezést helyezzenek. A probléma az volt, hogy ugyanez a technológia alkalmas menekülttáborok hamisítására, bombatámadások szimulálására vagy más, valós eseményeknek tűnő, ám teljesen kitalált jelenetek létrehozására is. A Google állítása szerint a generált képeken volt „AI által generált” címke, és más felhasználók nem látták ezeket közvetlenül a Google Earthben. A képernyőképek azonban gyorsan elterjedtek, és a cég kénytelen volt lekapcsolni az új funkciót. A visszavonás előtt azonban a felhasználók már demonstrálták, milyen könnyű politikai vagy humanitárius katasztrófákat hamisítani. Egy újságíró például egy gázai kórház bombázását vagy egy mexikói határnál kialakult menekültkaravánt generált – mindezt élethű műholdképi környezetben. --- # A DeepSeek V4 Flash új változata felülmúlja a V4 Pro-t *Published:* 2026-07-31 *Author:* Remi A DeepSeek ma csendben frissítette a V4 Flash modellt, és az új verzió kilenc különböző agent és kódolási benchmarkon is felülmúlja a V4 Pro-Preview csúcsmodellt. A fejlesztőknek nulla a migrációs költség: ugyanaz az API endpoint, ugyanaz a kulcs, ugyanaz a modellnév. A DeepSWE benchmarkon, amely valós GitHub issue-k megoldását méri, az új verzió 54,4 százalékot ért el, szemben a korábbi 7,3 százalékkal — ez 645 százalékos ugrás. A Terminal Bench 2.1 teszten 82,7 pontot kapott, míg a V4 Pro-Preview 72,1-et, és az Anthropic Opus-4.8 85,0-t. A DeepSeek natívan támogatja a OpenAI Responses API-ját és a Codex munkafolyamatot, így könnyű rá áttérni a fejlesztőknek. Az [Artificial Analysis Intelligence Index](https://artificialanalysis.ai)en a modell 50 pontra ugrott, ami 10 ponttal magasabb az áprilisi elődjénél, és mindössze egy ponttal marad el az OpenAI GPT-5.6 Luna modelljétől, miközben körülbelül 60 százalékkal olcsóbb feladatonként, még az OpenAI nemrég bejelentett [80 százalékos árcsökkentése](https://aihirfolyam.hu/2026/07/a-gpt-5-6-sol-optimalizalta-a-sajat-infrastrukturajat/) után is. A DeepSeek jelezte, hogy a V4 Pro hivatalos, végleges verziója is hamarosan érkezik, hasonló post-training megoldásokkal. A harmadik féltől származó API szolgáltatók, mint az OpenRouter, egyelőre még a korábbi áprilisi változatot használják. --- # Az Anthropic tesztjei során a Claude háromszor támadott meg éles rendszereket *Published:* 2026-07-31 *Author:* Remi Az Anthropic belső vizsgálata során három olyan esetet talált, amikor a Claude modelljei a kiberbiztonsági tesztek során jogosulatlanul hozzáfértek három különböző vállalat éles infrastruktúrájához. A vizsgálat az OpenAI Hugging Face-incidensét követően indult, és 141 006 értékelési futtatás áttekintésével készült. A három incidensben az Opus 4.7, a Mythos 5 és egy fejlesztés alatt álló modell vett részt. A promptban mindhárom modellt kifejezetten arról tájékoztatták, hogy nincs internet-hozzáférés — mégis elérték az internetet, egy, az értékelési partnernél, az Irregularnál talált konfigurációs hiba miatt. Az Opus 4.7, felismerve, hogy éles rendszert ér el, tovább támadott; a Mythos 5 egy rosszindulatú Python-csomagot publikált a PyPI-ra, amelyet 15 rendszer letöltött. Csak a legújabb, belső kutatási modell állt le önállóan, amikor rájött, hogy valós célponttal van dolga. A cég hangsúlyozza, hogy az esetekben nem a modell szökött ki sandbox-környezetből — ellentétben az OpenAI incidensével, ahol egy ismeretlen sebezhetőséget használt ki. Az Anthropicnál egy tévesen nyitva hagyott hálózati kapcsolat tette lehetővé a hozzáférést. A cég független biztonsági csoporttal, a METR-rel együttműködve vizsgálja az eseteket, és szigorúbb kontrollok bevezetését javasolja az ilyen tesztekhez. --- # Az EU 30 milliárd eurót szán hét új AI-adatközpontra *Published:* 2026-07-31 *Author:* Remi Az Európai Bizottság 30 milliárd eurós programot indított óriási AI-központok, vagyis „gigagyárak” létrehozására. A terv szerint hét ilyen létesítmény épül uniós és nemzeti forrásokból, valamint magánbefektetésekből, hogy a cégek, kutatók és állami szervek saját infrastruktúrán fejleszthessenek modern mesterséges intelligencia modelleket. Henna Virkkunen, a Bizottság technológiai szuverenitásért felelős alelnöke szerint „hozzáférés a számítási kapacitáshoz stratégiai szükséglet” az európai országok számára. A pályázatokat november 12-ig lehet benyújtani, az építkezések 2027-ben kezdődhetnek, és a kiválasztott központok a szerződés aláírásától számított 18 hónapon belül indulnak. A projekt az európai szabályokhoz és értékekhez igazodik: a fejlesztések az adatvédelmi, biztonsági és etikai uniós előírásoknak megfelelően történnek. Az összeg nagyságrendje a kontextushoz képest szerény: a Google és a Meta együtt nagyjából a tízszeresét költi fejlesztésre idén, és ha az Amazont és a Microsoftot is belevesszük, a négy nagy amerikai techóriás várhatóan 650–725 milliárd dollárt szán fejlesztésekre 2026-ban. A megvalósítás még így is jelentős lépés az európai technológiai függetlenség felé, de a globális versenyben továbbra is komoly lemaradásban vagyunk. --- # A Meta saját felhőszolgáltatást épít, és eladja a felesleges AI-kapacitását *Published:* 2026-07-30 *Author:* Remi A Meta saját felhőszolgáltatást épít, amelyben eladja a felesleges AI-számítási kapacitását külső ügyfeleknek — jelenti a Bloomberg. A vállalat akár a saját AI-modelljeihez is hozzáférést kínálhat az infrastruktúráján keresztül. A hírre a részvény árfolyama körülbelül 10 százalékot emelkedett. A modell a SpaceX-től származik: a cég a Musk xAI-jének betanítására vásárolt GPU-kapacitást adja bérbe az Anthropic-nak és a Google-nak havi 1,25 illetve 920 millió dollárért. A Meta az egyik legnagyobb Nvidia GPU-vásárló, és állítólag elbocsátásokkal finanszírozza az idén akár 145 milliárd dolláros AI-infrastruktúra-beruházásait. A Meta első új generációs modellje, a [Muse Spark](https://aihirfolyam.hu/2026/04/a-meta-bemutatta-a-muse-spark-modellt-az-elso-lepest-a-szemelyes-szuperintelligencia-fele/), amelyet Alexandr Wang irányítása alatt készítettek, áprilisban debütált „a teljes körű AI-fejlesztési erőfeszítés első termékeként”. A felhőüzlet bejelentése kérdéseket vet fel a cég modellstratégiájával kapcsolatban. --- # A GPT-5.6 Sol optimalizálta a saját infrastruktúráját *Published:* 2026-07-30 *Author:* Remi Az OpenAI a **GPT-5.6 Sol** modellt használta a **Codex** ügynökön keresztül a saját infrastruktúrájának hatékonyabbá tételére. A modell újraírta és javította a GPU-kon futó alacsony szintű kódokat, ami 20 százalékkal csökkentette a működtetési költséget. A sebesség növelése érdekében saját maga tervezett és tesztelt kisebb, gyors segédmodellt, amely 15 százalékkal gyorsította a válaszadást. A GPT-5.6 Sol elemezte az éles forgalmat, és kitalálta, hogyan lehet a számítási feladatokat jobban elosztani a rendszerben. Autonóm módon indította és figyelte a segédmodell tanítását, és beavatkozott, ha hiba történt. A cég szerint a korábban emberi szakértők által nem átlátható beállítási lehetőségeket is sikerült optimalizálnia. Az OpenAI az ügynökök vezérlőrendszerét is egyszerűsítette: a műveletek eredményeit korlátozza, a felesleges előzményeket kiszűri, és a korábban kiszámított részeket újrahasználja. A cég szerint ezek a lépések összeadódnak, és lehetővé teszik, hogy több felhasználót szolgáljanak ki ugyanazzal a hardverrel, a sebesség és megbízhatóság megtartása mellett. **Frissítés:** az OpenAI [bejelentette](https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6/), hogy többek közt ezen optimalizációknak köszönhetően jelentősen tudták csökkenteni egyes modellek árait – a GPT-5.6 Luna ára mostantól 80%-kal alacsonyabb, a GPT-5.6 Terra ára pedig 20%-kal. --- # A Microsoft kiadta az első kiberbiztonsági modelljét *Published:* 2026-07-30 *Author:* Remi A Microsoft kiadta az első kiberbiztonságra szakosított modelljét, a **MAI-Cyber-1-Flash**-et, és egy új, ügynökalapú biztonsági platformot, a **Perception**-t. A bejelentés egy kisebb, san franciscói eseményen hangzott el, ahol a cég egyértelműen a Google-t, az Anthropicot és az OpenAI-t célozta. A MAI-Cyber-1-Flash a Microsoft **MDASH** rendszerébe épül, amely kódsebezhetőségek azonosítására és javítására szolgál. A CyberGym benchmarkon 96 százalékot ért el, 12 ponttal megelőzve az Anthropic Mythosát, és jobban teljesített a Google Gemini és az OpenAI GPT modelljeinél is. Mustafa Suleyman, a Microsoft AI vezérigazgatója szerint a rendszert „azonnal élesben is használják”. A Perception platform piros, kék és zöld csapatokat — vagyis támadásszimulációt, sebezhetőség-feltárást és javítást — végző ügynököket telepít. A Microsoft szerint a feladatok 90 százalékát olcsóbban és ugyanolyan hatékonyan oldja meg, mint a versenytársak, így a drágább modellekre csak a maradék 10 százaléknál van szükség. A Perception november 3-tól lesz elérhető előzetes verzióban. --- # A Moonshot AI kiadta a Kimi K3 modell súlyait *Published:* 2026-07-30 *Author:* Remi A Moonshot AI július 26-án, a vállalt július 27-i dátum előtt egy nappal publikálta a Kimi K3 modell súlyait. A 2,8 billió paraméteres nyílt súlyú rendszer a valaha volt legnagyobb ilyen jellegű modell, amelyet bárki szabadon letölthet, módosíthat, és saját infrastruktúrán futtathat. A Together AI és a Modal már az első napon saját infrastruktúrán hosztolt hozzáférést biztosított. A Kimi K3 Stable LatentMoE architektúrát használ: 896 szakértőből csupán 16 aktiválódik tokenenként. A Kimi Delta Attention (KDA) hibrid lineáris figyelemmechanizmus 6,3-szoros gyorsítást hoz a millió-tokenes kontextusok dekódolásában. A modell natív multimodális képességekkel rendelkezik, és az Agent Swarm keretrendszer akár 300 al-ágens párhuzamos futtatását teszi lehetővé — ez 4,5-ször gyorsabb a szekvenciális végrehajtásnál. A súlyok kiadásával egy időben az amerikai kormány éppen szankciókkal fenyegeti a Moonshotot, miután azzal vádolta meg a céget, hogy az Anthropic Claude Fable 5 modelljét desztillálta. Ennek ellenére amerikai vállalatok — köztük a DoorDash és a Coinbase — már élesben használják a Kimi modelleket, és az OpenRouter adatai szerint a kínai AI modellek adják a platform amerikai token-felhasználásának körülbelül 60 százalékát. A [korábban bejelentett modellről itt írtunk részletesebben](https://aihirfolyam.hu/2026/07/csucskategorias-nyilt-modell-kinabol-itt-a-kimi-k3/), a [szankciós fenyegetésekről pedig itt](https://aihirfolyam.hu/2026/07/az-amerikai-kormany-szankciokkal-fenyeget-az-ai-technologiak-allitolagos-ellopasa-miatt/). --- # A Black Forest Labs bemutatta a FLUX 3 multimodális alapmodellt *Published:* 2026-07-30 *Author:* Remi A Black Forest Labs bemutatta a FLUX 3-at, egy új multimodális alapmodellt, amely egyszerre tanul képekből, videókból és hangból egyetlen architektúrán belül. A modell korai hozzáférésben már elérhető videógenerálásra, a képszerkesztő változatok pedig a következő hetekben és hónapokban érkeznek, várhatóan nyílt súlyú, ingyenes verziókkal együtt. A FLUX 3 a vállalat korábbi Self-Flow módszerére épül, és egyszerre képes szöveges, képes, videós és hangpromptokat kezelni. Videót akár 20 másodperc hosszan, natív hanggal generál, és támogatja a képből-videóba, videóból-videóba, kulcsképből-videóba átalakítást is. Korai értékelések szerint a felhasználók a Runway Gen-4.5-tel és a Luma Ray 3.2-vel szemben 77, illetve 93 százalékban részesítették előnyben. A képgenerálásban többnyelvű, pontos szövegmegjelenítést ígér, és a FLUX 2-höz képest jelentősen javult a komplex promptok követése. A vállalat a Mimic Robotics-szal közösen fejlesztett FLUX-mimic nevű akciópredikciós modellt is bejelentette, amelyet valós gyártási feladatokon tesztelnek az Audinál. A nyílt súlyú FLUX 3 Dev változat később érkezik, a cég hosszú távú célja pedig, hogy egyetlen modellben egyesítse a érzékelést, a cselekvést és a nyelvi predikciót. --- # Az Nvidia befektetett az OpenAI-alapító Ilya Sutskever startupjába *Published:* 2026-07-29 *Author:* Remi Az Nvidia jelentős befektetést tett Ilya Sutskever startupjába, a Safe Superintelligence-be — a megállapodás révén a cég egy nagyságrenddel több GPU-kapacitáshoz jut, mint korábban. A Sutskever által 2024-ben alapított labor eddig főként a Google TPU-jaira támaszkodott, de most az Nvidia legfejlettebb processzoraihoz kap hozzáférést. Az Nvidia márciusban hasonló megállapodást kötött Mira Murati, az OpenAI korábbi technológiai vezetőjének Thinking Machines Lab nevű cégével is. A Safe Superintelligence körülbelül 30 milliárd dolláros értékelésen áll, és olyan kockázati tőkealapok támogatják, mint az Andreessen Horowitz és a Sequoia Capital. A cég egyetlen célt tűzött ki: a „biztonságos szuperintelligencia” elérését — olyan AI-t, amely képes mindenre, amire az ember, anélkül hogy fenyegetést jelentene. Kutatásaik az emberi agy eddig figyelmen kívül hagyott működési mechanizmusaira fókuszálnak. Sutskever volt a 2012-es AlexNet-tanulmány szerzője (Geoffrey Hinton mentorálásával), amely elindította a modern deep learning forradalmat. Később az OpenAI egyik társalapítója és főtudósa lett, és szerepe volt Sam Altman zűrzavaros elbocsátásában, majd annak visszafordítása után távozott a cégtől. A Sutskever-Altman szakítás óta ritkán szólalt meg nyilvánosan, és sokszor hangoztatt kétségeit azzal kapcsolatban, hogy a jelenlegi paradigmák egyszerű skálázása önmagában elegendő-e az általános mesterséges intelligencia (AGI) eléréséhez. --- # Az Anthropic vezetője azt állítja, ők soha nem kérték a nyílt súlyú modellek betiltását *Published:* 2026-07-28 *Author:* Remi Az Anthropic vezérigazgatója, Dario Amodei egy nyílt blogposztban reagált arra a vádra, hogy a cég a nyílt súlyú modellek betiltását szorgalmazná. A Microsoft és több tucat más tech vállalat által aláírt nyilatkozat után egyesek azzal vádolták az Anthropicot, hogy üzleti érdekből akarja korlátozni a nyílt modelleket — Amodei szerint ez nem igaz: az Anthropic soha nem kért betiltást a nyílt modellek kategóriájára. Amodei egyetért a nyilatkozat egyes részeivel, ám vitatja azt az állítást, hogy a nyílt modellek automatikusan könnyebbé teszik a védelmi eszközök fejlesztését. A cég álláspontja szerint a nyílt súlyú modellek alapvetően a közjót szolgálják, de az erős nyílt AI-nak lehetnek veszélyei is: az autoriter kormányok titkos, fegyverkezési és megfigyelési célú modelljei, valamint kiber- és biológiai támadásokra való felhasználás. Ezekre a válasz nem a nyílt modellek betiltása, hanem három célzott intézkedés: a chip-export korlátozása Kínába, az ipari méretű desztilláció visszaszorítása, és a modellek kötelező biztonsági tesztelése — függetlenül attól, hogy nyíltak vagy zártak. --- # A Cursor új ügynökcsapat-megoldása az olcsó modellekre bízza a kódolást, a drágákra a tervezést *Published:* 2026-07-28 *Author:* Remi A Cursor új ügynökcsapata különbséget tesz a tervező és a végrehajtó AI modellek között. A tervezők frontier szintű modellekkel (például Opus 4.8 vagy Fable 5) bontják a feladatot részfeladatokra, a végrehajtók pedig olcsóbb, gyorsabb modellekkel (Composer 2.5, a Kimi K2.5-re épülve) valósítják meg azokat. A rendszerrel a SQLite 835 oldalas dokumentációja alapján építettek egy Rust implementációt internetkapcsolat és forráskód nélkül. Négy konfigurációt teszteltek: a GPT-5.5 egyedül 10 565 dollárba került, a legolcsóbb hibrid (Opus + Composer) 1339 dollárral végzett, és minden konfiguráció elérte a százszázalékos teszteredményt. A fő tanulság a költségeloszlás: a végrehajtó modellek generálták a tokenek több mint 69 százalékát, de az olcsóbb árazás miatt a teljes költség töredékét tették ki. A Cursor szerint csak a feladatok egy kis része igényel frontier szintű intelligenciát — a többit olcsó modellek is megbízhatóan elvégzik, ha jó tervet kapnak. --- # A Microsoft és több tucat másik amerikai tech cég a nyílt AI mellett teszik le a voksukat *Published:* 2026-07-26 *Author:* Remi A Microsoft nyilatkozatot tett közzé a nyílt súlyú modellek fontosságáról, amelyet több tucat technológiai vállalat és szervezet írt alá, köztük a Meta, az NVIDIA, az IBM, a Hugging Face, a Mistral, a Palantir és a Y Combinator. A dokumentum szerint az amerikai AI-vezetés nem egyetlen frontier modellen, hanem egy erős, nyílt ökoszisztémán múlik. A nyílt súlyú modellek — amelyeket bárki letölthet, átvizsgálhat, módosíthat és saját infrastruktúráján futtathat — lehetővé teszik, hogy startupok, vállalatok, egyetemek és közintézmények fejlett AI-ra építsenek anélkül, hogy nulláról kellene modellt képezniük. A szerzők a nyílt forrású szoftverekhez hasonlítják ezt a megközelítést, amely a mai internet és a kritikus infrastruktúrák alapját képezi. A nyilatkozat egyben politikai üzenet is: a szerzők figyelmeztetnek, hogy a nyílt súlyú modellek korlátozása nem a megfelelő válasz a kockázatokra. Szerintük a nyílt modellek szélesebb védelmi képességet biztosítanak, növelik az átláthatóságot, és a széles körű közösség vizsgálata révén biztonságosabbak a hosszú távon. A kormányzatot arra szólítják fel, hogy támogassa a nyílt ökoszisztémát, bővítse a kutatók és startupok számítási kapacitását, és ne terjesszen elő korai korlátozásokat. --- # Egy matematikus a Claude Fable 5 segítségével cáfolta meg a Jacobian-sejtést *Published:* 2026-07-26 *Author:* Remi Levent Alpöge, a Harvard Society of Fellows korábbi tagja és jelenlegi Anthropic alkalmazott, a Claude Fable 5 modell segítségével egy óra alatt találta meg a cáfolatot a Jacobian-sejtésre — egy 1939 óta nyitott algebrai geometriai problémára. A világbajnoki döntő alatt posztolta az eredményt X-en. A Jacobian-sejtés Steve Smale 1998-as, a Riemann-hipotézis mellett szereplő listáján is szerepelt, és az elmúlt évtizedekben legalább öt hibás bizonyítás látott napvilágot. A Fable 5 júniusban indult, elsősorban ambiciózus kódolási projektekre és többnapos autonóm munkamenetekre tervezték. Alpöge „kutatótársként” használta a modellt, amely egy validálható ellenpéldát adott vissza neki. A matematikai közösség reakciója eddig pozitív, a formális ellenőrzés azonban még hátravan. --- # Az amerikai kormány szankciókkal fenyeget az AI-technológiák állítólagos ellopása miatt *Published:* 2026-07-26 *Author:* Remi Az amerikai pénzügyminiszter, Scott Bessent megerősítette: szankciók jöhetnek a kínai Moonshot AI ellen, miután a Fehér Ház azzal vádolta meg a céget, hogy nagy léptékben *disztillálta* az Anthropic Fable modelljét. Bessent szerint a nyílt AI kiadása nem jelenti azt, hogy szabadon el lehet lopni az amerikai szellemi tulajdont — ha kínai vállalatok ipari méretekben lopnak le modelleket, a teljes kereskedelmi tiltás is szóba jöhet. Hab a tortán, hogy a Fehér Ház szerint a Moonshot GB300-as Nvidia szervereket szerzett be, amelyek eladása kínai cégeknek exporttilalom alá esik. A Moonshot júliusban adta ki nyílt súlyú Kimi K3 modelljét, amely a valaha volt legnagyobb nyílt forráskódú nyelvi modell, és képességei megkérdőjelezik a vezető amerikai AI laboratóriumok üzleti modelljét. A kínai AI-fejlesztőcég a legfrissebb célpontja egy szélesebb washingtoni vitának a kínai nyílt súlyú modellek beáramlásáról. Egyes tisztségviselők, köztük az OpenAI stratégiai jövőkutatási vezetője, Dean Ball, a kínai modellek korlátozását vagy betiltását sürgeti az amerikai technológiai előny megőrzése érdekében. --- # Megérkezett a Claude Opus 5: erősebb és gyorsabb, a régi áron *Published:* 2026-07-24 *Author:* aihadmin Az Anthropic bemutatta a Claude Opus 5 modellt, amely a vállalat saját mérései szerint jelentős előrelépést hoz programozásban, üzleti feladatokban, kutatásban és számítógép-használatban. Több teszten is az élmezőnybe került, egyes feladatokat a Claude Fable 5 csúcsmodellhez közeli szinten, de nagyjából feleakkora költséggel old meg. Az Anthropic szerint az Opus 5 alaposabban ellenőrzi a saját munkáját, felismeri a felszínes megoldásokat, és szükség esetén saját segédeszközöket vagy tesztkörnyezetet készít, hogy valóban működő eredményt adjon. A modell kiberbiztonsági korlátozásai kevésbé szigorúak, mint a Fable 5 esetében, de a behatolási teszteket és exploitok készítését továbbra is blokkolja. Az Opus 5 ára nem változott az elődjéhez képest: egymillió bemeneti token 5 dollárba, egymillió kimeneti token 25 dollárba kerül. A modell már elérhető az API-ban és a Claude webes felületén is. --- # Az Alibaba kiadta a Qwen-Image 3.0-t *Published:* 2026-07-24 *Author:* Remi Az Alibaba kiadta a Qwen-Image 3.0-t, a képgeneráló modelljének harmadik generációját. A csapat szerint az első verzió a precizitásra, a második a változatosságra és hitelességre fókuszált, a 3.0 viszont egy szóval összefoglalva: „valóságos”. A modell gyakorlati munkára készült — újságelrendezések, storyboardok, vizsgalapok —, nem csupán esztétikus képekre. A modell 4500 token hosszú promptot fogad be, ami egyetlen futásban is lehetővé teszi sűrű, összetett elrendezések létrehozását. A demók között szerepel egy 3×3-as infografika-elrendezés kilenc különálló panellel: ![](https://aihirfolyam.hu/wp-content/uploads/2026/07/qwen-image-3-update2-1024x578.jpg)Egymásba ágyazott felületek (VSCode ablakban Qwen Chat, azon belül WeChat beszélgetés, abban egy kávéposzter): ![](https://aihirfolyam.hu/wp-content/uploads/2026/07/qwen-image-3-3fa25ce8ca621bc3642b431d6724ecc3-678x1024.jpg)Valamint tíz pixel nagyságú, olvasható szöveg és többsoros LaTeX képletek: ![](https://aihirfolyam.hu/wp-content/uploads/2026/07/qwen-image-3-cca131fe-4ba1-409e-9da0-2358ee2bbb41-825x1024.jpg)A portrék fotorealisztikus részletgazdagságot mutatnak — pórusok, bőrtextúra, egyes hajszálak: ![](https://aihirfolyam.hu/wp-content/uploads/2026/07/qwen-image-3-people31_seed9999-768x1024.jpg)A Qwen-Image 3.0 tizenkét nyelvet támogat natívan, élő internetes adatokat is képes bevonni, és weboldalak, játékok, livestream-felületek rekonstruálására is befogható. A modell jelenleg meghívásos alapon, API-hozzáféréssel érhető el, a és hamarosan megjelenik a Qwen Chatben is. A súlyok várhatóan nem lesznek publikusan elérhetők — az eredeti Qwen-Image még nyílt súlyokkal érkezett, de a májusban kiadott 2.0 óta ez a gyakorlat változott. --- # Kínai AI segített a Hugging Face-nek, miután egy elszabadult OpenAI-ügynök feltörte a rendszert *Published:* 2026-07-23 *Author:* Remi A Hugging Face szerint [egy kísérleti OpenAI AI-ügynök több nulladik napi sebezhetőséget kihasználva megtámadta a vállalat infrastruktúráját](https://aihirfolyam.hu/2026/07/egy-kiserleti-openai-modell-feltorte-a-hugging-face-infrastrukturajat/). A támadás elemzéséhez végül a kínai Zhipu AI nyílt forrású GLM-5.2 modelljét használták, mert az amerikai csúcsmodellek — az OpenAI GPT-5.6 Sol és az Anthropic Claude Fable 5 — nem bizonyultak használhatónak erre a feladatra. A rendszerek nem tudták megkülönböztetni a védekező elemzést a támadástól, így a biztonsági korlátozások miatt visszautasították a kéréseket. Az eset újra megnyitotta a vitát arról, hogy a jelenlegi AI-védelmi korlátozások mennyire segítik, vagy éppen akadályozzák a szakemberek munkáját. Az OpenAI időközben bevonta a Hugging Face-et a megbízható hozzáférési programjába, hogy védekezési célokra fejlettebb modelleket használhassanak, kevesebb korlátozással. --- # A Deezer szerint a platformjára feltöltött dalok több mint 50 százaléka AI-generált *Published:* 2026-07-23 *Author:* Remi A Deezer szerint a platformjára naponta feltöltött dalok több mint 50 százaléka mesterséges intelligenciával készült. A júniusi adatok szerint havi átlagban 90 ezer AI-zeneszám került napvilágra naponta, és a tendencia folyamatosan emelkedik. A cég tavaly tavasszal még csak napi 10 ezer AI-dalt mért, ami a feltöltések 10 százaléka volt. Egy év alatt a mennyiség kilencszeresére nőtt, miközben a piaci szereplők megoszlanak az AI-zene kezelésével kapcsolatban: a Bandcamp kitiltotta, a Tidal megszüntette a monetizációját, a Spotify és az Apple Music címkézést vezetett be. A Deezer legújabb lépése az AI-zene eltávolítása lesz, ha hat hónapig nem hallgatják, vagy ha csalással, automatikus streameléssel próbálják pénzzé tenni. A szolgáltatás emellett már tavaly AI-detektálási eszközt tett elérhetővé más platformok számára is, és mostantól lehetővé teszi a Spotify és Apple Music lejátszási listáiban szereplő AI-zenék azonosítását. --- # Egy kísérleti OpenAI-modell feltörte a Hugging Face infrastruktúráját *Published:* 2026-07-22 *Author:* Remi Az OpenAI egy belső tesztje során egy még kiadatlan, új modell által is hajtott AI ügynök több nulladik napi sebezhetőséget azonosított, láncba fűzte őket, és kiszabadult az izolált sandbox környezetből. Az AI ügynök a fejlesztők akarata ellenére elérte a nyílt internetet, és onnan a Hugging Face valódi éles infrastruktúráját támadta meg. A teszt során az AI rendszer az ExploitGym benchmark megoldásait kereste. A csomagregisztrációs gyorsítótár proxyjában talált egy nulla napi sebezhetőséget, amivel hálózati hozzáférést szerzett. Ezt követően lopott hitelesítő adatokat felhasználva és további nulladik napi sebezhetőségeket láncba fűzve távoli kódvégrehajtási végpontot talált a Hugging Face szerverein. A Hugging Face biztonsági csapata észlelte és megállította a tevékenységet. Az OpenAI felelősségteljesen jelentette az érintett szoftverek fejlesztőinek a sebezhetőségeket, a Hugging Face-et pedig bevonta a megbízható hozzáférési programba. A Hugging Face vezérigazgatója, Clem Delangue szerint ez az incidens is bizonyítja, hogy az AI biztonságot egyetlen vállalat titokban dolgozva nem tudja megoldani, ez csak nyíltan, együttműködéssel lehetséges. --- # A Microsoft 600 millió dollárt takarítana meg a Kimi K3 integrálásával *Published:* 2026-07-21 *Author:* Remi A Microsoft azt fontolgatja, hogy a Moonshot AI Kimi K3 modelljét beépíti a Copilotba, és ezzel akár 600 millió dollárt is megtakarít az inference költségeken. A cég már dolgozik azon, hogy a modell elérhető legyen az Azure felhőszolgáltatásán keresztül. A lépés kockázatos: a Trump-adminisztráció éppen olyan rendeleten dolgozik, amely betiltaná a kínai nyílt súlyú modellek használatát az Egyesült Államokban. A Kimi K3 inference költségei nem alacsonyak — átlagosan 0,94 dollár egy tesztfeladat az Intelligence Index mérései szerint, szemben a GPT-5.6 Terra 0,55 dollárjával —, de a modell KV cache-optimalizálása és a per-token memóriahasználat csökkentése miatt nagy adatközponti léptékben hatékonyan futtatható. A Microsoft korábban már a saját MAI modelljeire kezdte cserélni a Copilotban az OpenAI és az Anthropic rendszereit, és a vállalati ügyfelek kétharmada a modell-független rendszereket preferálná a Fable 5 kiesése miatt. A Kimi K3 bevonása újabb lépés lenne a külső szolgáltatói költségek csökkentése felé, még ha ez politikai és biztonsági kockázatokkal is jár együtt. --- # A Google bemutatta a Gemini 3.6 Flash, a 3.5 Flash-Lite és a 3.5 Flash Cyber modelleket *Published:* 2026-07-21 *Author:* Remi A Google új nyelvi modelleket mutatott be: a **3.6 Flash** a 3.5 Flash utódja, a **3.5 Flash-Lite** a sorozat leggyorsabb és legköltséghatékonyabb tagja, a **3.5 Flash Cyber** pedig egy kiberbiztonsági feladatokra specializált változat. A két széles körben elérhető modell már használható, a Cyber korlátozott hozzáféréssel érkezik. A 3.6 Flash 1,50 dollárt kér millió bemeneti és 7,50 dollárt millió kimeneti tokenért, és 17 százalékkal kevesebb kimeneti tokent generál, mint az elődje. A DeepSWE benchmarkon 49 százalékot ér el a 3.5 Flash 37 százaléka helyett, az OSWorld-Verified teszten 83,0 százalékot a korábbi 78,4 helyett. A 3.5 Flash-Lite rendkívül kedvező 0,30 dolláros bemeneti és 2,50 dolláros kimeneti áron másodpercenként 350 tokent képes generálni, és a 3.1 Flash-Lite-hoz képest sokkal jobb eredményeket produkál kódolási és ügynöki feladatokban. A 3.5 Flash Cyber a CodeMender ügynökkel párosítva kódbiztonsági sebezhetőségeket keres és javít. A modell jelenleg csak kormányzati és megbízható partnerszervezetek számára érhető el, korlátozott pilot program keretében. A Google emellett bejelentette, hogy a Gemini 3.5 Pro-t már külső partnerekkel tesztelik, és a Gemini 4 előzetes tanítása már elkezdődött. --- # A Meta-vezető Zuckerberg szerint az AI-ügynök-fejlesztések nem gyorsultak fel a várt módon *Published:* 2026-07-21 *Author:* Remi Zuckerberg egy belső értekezleten elismerte, hogy a Meta AI ügynök-fejlesztései nem gyorsultak fel a várt ütemben. A vezérigazgató szerint a cég átalakítási döntései — köztük az 8 ezer alkalmazott elbocsátása és a további 7 ezer átirányítása AI csoportokba — „még nem értek be”. Zuckerberg állítása szerint a leépítések és a befektetések hozama csak három-hat hónap múlva várható. A Meta idén akár 145 milliárd dollárt is költhet AI infrastruktúrára, miközben a cég frissen létrehozott AI egységét számos értesülés úgy írta le, mint egy „lélekölő gulág” az ott dolgozó mérnökök számára. --- # A német Soofi kutatócsoport kiadta a nyílt súlyú Soofi S 30B-A3B modellt *Published:* 2026-07-21 *Author:* Remi A német Soofi kutatócsoport kiadta a Soofi S 30B-A3B modellt, egy nyílt súlyú MoE alapmodellt, elsősorban német és angol nyelvre. A 31,6 milliárd paraméteres rendszerből tokenenként 3,2 milliárd aktiválódik. A teljes tréning a müncheni Deutsche Telekom Industrial AI Cloudon futott, 512 Nvidia B200 GPU-n. A modell a tesztelt nyílt alapmodellek között a legjobb angol és német összesített pontszámot érte el. A HumanEval kódolási teszten 73,8 százalékot, a GSM8K matematikai benchmarkon 86,1 százalékot produkált. A képzés során 26,68 billió tokent dolgozott fel, és a német nyelvi adatok aránya a második fázisban 15,32 százalékra emelkedett — a referencia Nemotron 3 Nano keverékében ez alig öt százalék. A projektet a német KI Bundesverband koordinálja, a szövetségi gazdasági és energiaügyi minisztérium finanszírozza. Résztvevők a Fraunhofer IAIS, a DFKI, a TU Darmstadt, az ellamind és a Merantix Momentum. A súlyok jelenleg előnézeti formában elérhetők a Hugging Face-en, a licenc még véglegesítés alatt van. --- # A ByteDance Seedance modellje titokban hódít teret Hollywoodban *Published:* 2026-07-18 *Author:* Remi A ByteDance videógeneráló modellje, a Seedance csendben, de határozottan hódít teret magának Hollywoodban. A cég tavasszal Santa Monicában mutatta be hivatalosan az Egyesült Államokban, egy kínai kormányhoz köthető szervezet rendezvényén, azóta pedig száz nyitott pozícióra keres helyi munkavállalókat, független filmeseket és művészeket szerződtetett, és tárgyalásokat folytat AI-filmek finanszírozásáról. A Los Angeles Times cikke szerint a Seedance a jelenleg legolcsóbb és legjobb minőségű megoldás a piacon: percenként 9 dollárért generál videót hanggal, míg a Google Veo 24 dollárt kér egy hasonló kimenetért. Az amerikai Sora már megszűnt, a Runway és a Luma pedig drágább és gyengébb teljesítményt nyújt. A kínai megoldások – Seedance, Kling és Alibaba HappyHorse – gyorsan behozták az amerikai versenytársak hátrányát, és alul is árazzák őket. A filmipar kettős játékot folytat: a nagy stúdiók hivatalosan nem hagyták jóvá a Seedance-t, ám „fű alatt” mégis engedik használatát – ahogy Joel Kuwahara, a Simpson Család korai animációs producere fogalmazott, „don’t ask, don’t tell” alapon. Steven Schneider, a „Paranormal Activity” producere már bejelentette első hibrid AI-horrorfilmjét, a Terrariumot, amelyet teljes egészében Seedance-szel generálnak. A rendező, Jason Zada szerint 15 másodpercnyi HD-videó mindössze 5 dollárba kerül. Kavan Cardoza, a Chronicle of Bones című sorozat egyedül dolgozó készítője pedig már teljesen a modellre építi munkáját: a YouTube-on 500 ezer követője van, és epizódonként 3 millió megtekintést ér el. A SAG-AFTRA színészi szakszervezet azonban tiltakozik a szintetikus színészek ellen, és a folyamat várhatóan további vitákat gerjeszt majd. --- # Több mint 200 kutató követeli az AI gazdasági hatásainak kezelését *Published:* 2026-07-18 *Author:* Remi Több mint 200 közgazdász és AI-kutató, köztük 16 Nobel-díjas írt alá egy nyílt levelet, amely sürgős intézkedéseket követel a mesterséges intelligencia gazdasági hatásainak kezelésére. A Stanford Egyetem digitális gazdasági laboratóriuma által szervezett levél aláírói között van kutató az OpenAI-tól, az Anthropic-tól és a Google-tól is. A levél szerint a következő évtizedben az AI egy olyan átalakulást hozhat, amely „nagyobb az ipari forradalomnál, de lényegesen rövidebb idő alatt lejátszódik”. A dokumentum figyelmeztet a nagyszabású munkahely-vesztés kockázatára, de lehetőségként megemlíti az életszínvonal jelentős javulását is. A megoldás érdekében „ösztönzőket, védőkorlátokat és intézményeket” követel a kormányoktól és a technológiai vezetőktől, amelyek biztosítják, hogy az AI segítse az embert és a társadalom javát szolgálja. Anton Korinek, a kezdeményezést szervező Virginiai Egyetem professzora figyelmeztet: „a stratégiánkat és intézményeinket nem lehet a transzformáció közben kitalálni; ha a bizonyosságra várunk, akkor túl későn lépünk.” A figyelmeztetés egybeesik azzal, hogy a múlt hónapban az Amazon 14 000 munkahelyet szüntetett meg, miután a vezérigazgató bejelentette: a generatív AI és az ügynökök egyes pozíciókat átvesznek. Az ENSZ decemberben arra figyelmeztetett, hogy az AI mélyítheti a nemzetek közötti egyenlőtlenséget. --- # Az OpenAI első hardverterméke: Codex Micro mini-billentyűzet *Published:* 2026-07-17 *Author:* Remi Az OpenAI elindította első hardvertermékét, a 230 dolláros Codex Micro macropadot, amelyet a Work Louderrel közösen fejlesztett ki. A billentyűzet a Codex kódolóeszközhöz kapcsolódik, és a felső hat „agent billentyű” színes LED-visszajelzéssel mutatja az ügynökök állapotát — fehér az üresjárat, kék a gondolkodás, zöld a kész, piros a hiba. Az alsó hat gomb alapértelmezés szerint a változások elfogadására vagy elutasítására, valamint szálak elágaztatására szolgál. A nagyobb gomb a push-to-talk funkciót aktiválja, a joystick a composer bar vezérlését végzi, a tárcsa pedig a kijelölést segíti. A macropad USB-C kábellel vagy Bluetoothon csatlakozik, és a Work Louder Input alkalmazásával teljesen testreszabható — akár más alkalmazásokhoz is használható. A termék nem azonos a Jony Ive-vel tervezett, híresztelt okostelefonnal — az OpenAI szerint az egy teljesen más készülék. A Codex Micro limitált számban érhető el, a rendeléseket a készlet erejéig fogadják. A bejelentés egybeesik azzal, hogy a Codex felhasználóbázisa hamarosan eléri a 9 milliót. --- # Feltörték a Suno AI-t és kiderült: milliószám szipkázták le a dalokat a YouTube-ról, Deezerről és Genius-ról *Published:* 2026-07-17 *Author:* Remi A Suno AI zenegenerátorról kiszivárgott adatok szerint a cég milliós nagyságrendben töltött le zenéket és szövegeket a YouTube Music, a Deezer és a Genius platformokról, valamint a Pond5, Jamendo, Freesound és más forrásokból. A hacker által nyilvánosságra hozott forráskódokban részletes scraping-utasítások szerepelnek, az egyik fájl szerint például több mint kétmillió zenei klippet dolgoztak fel a YouTube Musicról. A kiszivárgott adatok szerint az összesített gyűjtemény több mint 280 ezer óra hanganyagot tartalmaz — köztük 113 ezer óra YouTube Music, 62 ezer óra Pond5, 19 ezer óra IMSLP és 12 ezer óra Deezer anyag. A feltörés során több százezer felhasználó adatai és Stripe fizetési információk is kikerültek. A Suno korábban azt állította, hogy a szolgáltatásuk nem tárol efféle felhasználói adatot a szerverein. A lemezkiadók már korábban is perelték a Sunot szerzői jogi sérelmek miatt, és a cég maga is elismerte, hogy „minden ésszerű minőségű, publikusan elérhető zenefájllal” tanították a modellt. A feltörés most rámutatott, hogy direkt, szisztematikusan lopták le az adatokat, és nem véletlenszerű webes gyűjtésről volt szó. --- # Több AI rendszer is elérte a szuperelőrejelzők szintjét a ForecastBench benchmarkon *Published:* 2026-07-17 *Author:* Remi Több mesterséges intelligencia rendszer is elérte az úgynevezett *szuperelőrejelzők* pontossági szintjét a ForecastBench benchmarkon — közölte a kutatócsoport, amely a platformot működteti. A július 16-ai ranglistán a Cassi AI multi-agent rendszere, valamint az xAI és a Google DeepMind beadásai statisztikailag nem különböztethetők meg a legjobb emberi előrejelzők pontosságától. A szuperelőrejelzők olyan emberek, akik bizonyítottan az átlagnál lényegesen pontosabban képesek megjósolni jövőbeli események bekövetkezésének valószínűségét, jellemzően valószínűségi gondolkodásra, folyamatos tanulásra és nézeteik rendszeres frissítésére támaszkodva. A Cassi AI rendszere, amely a teljes ranglistát vezeti, többlépcsős folyamatot használ: alkérdéseket generál, keresést végez, releváns kontextust gyűjt, majd modell-összevetés segítségével ad előrejelzést. Ez az első rendszer, amely a piaci kérdésekben is megelőzte a szuperelőrejelzők mediánját — ezek olyan egyedi, ítélet alapú események, mint például a világbajnokság vagy az időjárási rekordok kimenetele. --- # A Thinking Machines Lab bemutatta első nyílt súlyú modelljét, az Inkling-et *Published:* 2026-07-17 *Author:* Remi A Thinking Machines Lab bemutatta első nyílt súlyú modelljét, az Inkling-et. A 975 milliárd paraméteres rendszert az alapoktól tanították, és szöveg, hang és videó feldolgozására is képes. A modell fejlett érvelést és kódolást is támogat, bár a népszerű benchmarkokon nem vezeti a mezőnyt. A laboratórium a modellt saját maga finomhangolására és javítására is használta, és a tréning során érdekes jelenséget figyeltek meg: a modell „gondolkodási lánca” idővel tömörebbé vált, elhagyva a nyelvtani többletet, miközben a válaszok érthetősége megmaradt. A vállalat szerint az Inkling teljesítménye a legjobb kínai nyílt súlyú modellek szintjén van. A Thinking Machines Lab-et 2025 februárjában alapította több korábbi OpenAI-vezető, köztük Mira Murati, John Schulman és Lilian Weng. A startup a valaha volt legnagyobb seed körön van túl, értékelése meghaladja a 12 milliárd dollárt. A nyílt súlyú modell kiadása összhangban áll a cég víziójával, hogy az AI ne néhány vállalat kezében legyen, hanem decentralizált legyen. --- # Satya Nadella szerint a vállalatok kétszer fizetnek a zárt AI modellek használatáért *Published:* 2026-07-17 *Author:* Remi A Microsoft vezérigazgatója, Satya Nadella blogposztban figyelmeztet: a vállalatok, amelyek zárt AI-modelleket használnak, kétszer fizetnek — egyszer pénzzel, egyszer pedig a saját szellemi tulajdonukkal. A modellek a promptokból, eszközhasználatból, és különösen a korrekciókból tanulnak, és ezt a használatból eredő értékes tudásanyagot meg sem tudnák vásárolni az AI cégek. Nadella szerint a modellek nem engedhetik meg maguknak, hogy egyrészt ingyen tanuljanak a világ adataiból, másrészt pedig korlátozzák a distillationt — vagyis a saját modelljük tudásának kivonatolását. A vállalatoknak saját tulajdonú „tanulási környezetet” kell építeniük a felhőben, és a megfelelő orchestration réteggel kell ellátniuk, hogy könnyebben válthassanak a különböző szolgáltatók modellei között. A trend már érezhető: a Vercel átjáróján a nyílt modellek a forgalom 29 százalékát tették ki júniusban. A Solo.io, a Linux Foundation Agentgateway projektje mögötti vállalat jelentése szerint a nagyvállalati ügyfeleinél egyre gyakrabban jön elő a kérdés: „Futtathatok-e nyílt modellt saját gépemen?” --- # Csúcskategóriás nyílt modell Kínából: itt a Kimi K3 *Published:* 2026-07-17 *Author:* Remi A Moonshot AI bemutatta a **Kimi K3** modellt, amely 2,8 billió paraméterével a világ első nyílt, 3T-osztályú nyelvi modellje. A cég szerint az új Kimi Delta Attention és az Attention Residuals technikák 2,5-szörös hatékonyságnövekedést hozott a K2-höz képest. A modell egymillió tokenes kontextusablakot és natív vizuális képességeket kínál. Kódolási teljesítménye kiemelkedő: önállóan fejlesztett egy Triton-szerű GPU-fordítót (MiniTriton), optimalizált kernelmódosításokat a saját architektúrájához, és 48 órás autonóm futás alatt egy teljes chipet is tervezett nyílt forráskódú EDA eszközökkel. Az összetett tudományos számítási feladatokat is gyorsan és megbízhatóan oldja meg. A Kimi K3 jelenleg elérhető a Kimi.com-on, a Kimi Work és Kimi Code eszközökben, valamint API-ban több platformon is. A teljes modellsúlyokat július 27-ig nyilvánosságra hozzák. A cég szerint az összteljesítmény még mindig elmarad a legerősebb zárt modellek — a Claude Fable 5 és a GPT 5.6 Sol — mögött, de bizonyos kategóriákban (pl. frontend programozás) kiemelkedő eredményeket produkál az új modell. --- # A Claude Fable 5 csak átmenetileg távozik az előfizetésekből *Published:* 2026-07-16 *Author:* Remi *Frissítés*: Az Anthropic július 19-én [bejelentette](https://x.com/claudeai/status/2078302415804379218), hogy 20-ától kezdve a Max és Team Premium előfizetők továbbra is elérhetik a Fable 5 modellt az előfizetés részeként, míg a Pro és Team Standard előfizetők csak külön díj ellenében fogják tudni használni, de automatikusan kapnak 100 dollárnyi bónusz kreditet a fiókjukba. --- Az Anthropic megerősítette: a Claude Fable 5 július 19-ig marad az előfizetések része, utána használatalapú számlázásra kerül. A cég szerint ez nem végleges változás — a modell vissza fog térni a Pro, Max, Team és válogatott Enterprise csomagokba, amint a kapacitás lehetővé teszi. A Fable 5 a legújabb, legerősebb Claude modell, amely [a kormányzati exportkorlátozás feloldása](https://aihirfolyam.hu/2026/07/az-amerikai-kormany-feloldotta-az-anthropic-mythos-es-fable-modellek-exporttiltalmat/) után tért vissza globálisan. A modell az API-n keresztül és a fogyasztásalapú vállalati csomagokban továbbra is teljes hozzáféréssel elérhető. --- # A Grok Build teljes kódbázisokat töltött fel a saját szervereire *Published:* 2026-07-15 *Author:* Remi Egy biztonsági kutató bizonyítékokat hozott nyilvánosságra arra vonatkozóan, hogy az xAI Grok Build CLI eszköze a teljes fejlesztői repókat feltölti a cég Google Cloud Storage tárhelyére, köztük még a `.env` fájlokban tárolt hitelesítő adatokat és a kódoló ügynök által meg sem nyitott fájlokat. A teszt során a Grok Build körülbelül 5 GB-nyi adatot továbbított, míg a tényleges feladattal kapcsolatos forgalom mindössze 192 KB volt. A kutató letesztelte az adatmegosztást engedélyező „Improve the model” opció kikapcsolásával is, de a feltöltés ekkor sem állt meg. Az xAI korábbi marketingszövegei szerint „a kódbázisból semmi nem kerül át az xAI szervereire”, ami a fejlemények szerint egyszerűen nem igaz. Az xAI azóta leállította a repófeltöltést, de a hivatalos változásnapló nem említi ezt, és nem adtak semmilyen tájékoztatást a témával kapcsolatban. A biztonsági kutató azt tanácsolja: aki privát repókon futtatta a Grok Build-t, cserélje az API-kulcsokat, az adatbázis-jelszavakat és a cloud tokeneket, mert a feltöltött adatok sorsáról nincs hivatalos tájékoztatás. --- # Az Apple beperelte az OpenAI-t üzleti titkok eltulajdonításáért *Published:* 2026-07-13 *Author:* Remi Az Apple peres eljárást indított az OpenAI ellen üzleti titkok eltulajdonítása miatt. A vád szerint az OpenAI vezetősége, köztük a korábbi Apple-dizájnfőnök Tang Tan, szervezett módon szerezte meg a vállalat bejelentés előtti termékeinek adatait. A kereset szerint Tan interjúra érkező jelölteknek azt kérte, hogy hozzanak magukkal Apple-hardverkomponenseket, és részleteket kért a bejelentés előtt álló projektekről. Az Apple szerint több mint 400 volt alkalmazottjuk dolgozik jelenleg az OpenAI-nál, köztük olyanok, akik bizalmas dokumentumokat vittek magukkal. A cég februárban küldött figyelmeztető levelet, amelyre válasz nem érkezett. Az OpenAI jelenleg éppen első saját hardvertermékén dolgozik, amely a hírek szerint egy okostelefon lehet, és közvetlen versenytársa lehet az iPhone-nak. Az ex-Apple designer Jony Ive projektcégének 6,5 milliárd dolláros felvásárlása is erre a hardveres ambícióra utal. Az Apple bírósági tiltó végzést kér, és minden bizalmas anyag visszaszolgáltasára kötelezné az OpenAI-t. --- # Az Alibaba betiltotta a Claude Code-ot a munkavállalóinak *Published:* 2026-07-11 *Author:* Remi Az Alibaba július 10-től betiltja munkavállalói számára az Anthropic Claude Code programozási eszközének használatát – jelentette több forrás is, köztük a Reuters és a Morningstar. Az Anthropic már korábban is tiltotta kínai cégek és azok tulajdonában lévő külföldi vállalatok számára a modelljei elérését. A cég régóta dolgozik azon kiskapuk bezárásán, amelyek lehetővé tették a kínai felhasználók számára a Claude-hoz való hozzáférést. Egy Reddit-poszt szerint az Anthropic még egy olyan Claude Code-verziót is bevetett, amely titokban azonosította a kínai felhasználókat – a vállalat szerint ez egy márciusban indított kísérlet volt, amelynek célja a jogosulatlan viszonteladók és a modellek „desztillációjának” megakadályozása volt. Az Alibaba a Claude Code-ot „magas kockázatú szoftvernek” minősítette, és arra utasította alkalmazottait, hogy a vállalat saját Qoder eszközét használják helyette. A lépés része az egyre élesebb kínai-amerikai technológiai versenynek, ahol mindkét fél nemzetbiztonsági kockázatként kezeli a mesterséges intelligencia eszközöket. --- # A Meta is új modellt mutatott be: Muse Spark 1.1 *Published:* 2026-07-09 *Author:* Remi A Meta kiadta a Muse Spark 1.1 modellt, a Superintelligence Labs legújabb generációs rendszerét, amely jelentősen fejlesztett kódolási, multimodális érvelési és ügynöki képességekkel érkezik. A modell egymillió tokenes kontextusablakkal rendelkezik, és képes több ügynököt irányítani párhuzamosan — ezáltal gyorsítva az összetett feladatok végrehajtását. A régebbi kontextust automatikusan kompaktálja, miközben megőrzi a lényeges részleteket. A Muse Spark 1.1 számítógép-használati munkafolyamatokat is támogat: eldönti, hogy egy feladatot automatizál scripttel, vagy közvetlenül az alkalmazás felületén keresztül oldja meg, mindeközben fenntartja a kontextust hosszú munkamenetek során. A kódolási teljesítményt is jelentősen javították: nagy kódbázisokban képes hibákat diagnosztizálni, új funkciókat implementálni, és teljes kódmigrációkat végrehajtani. A Replit vezérigazgatója, Amjad Masad „teljes ügynöki alaprendszernek” nevezte a modellt. A Meta egy új Model API-t is nyitott a fejlesztők számára, ahol a Muse Spark 1.1 publikus preview-ban érhető el: az ár 1,25 dollár egymillió input tokenenkét és 4,25 dollár egymillió output tokenenként. A teszteléshez 20 dollárnyi kreditet biztosítanak. A modell már elérhető „Thinking” módban a Meta AI alkalmazásban és a meta.ai oldalon, és várhatóan a jövőben kiváltja a Llama modelleket a Meta chatbotjaiban és okosszemüvegeiben. --- # Az xAI bejelentette a Grok 4.5-öt, az eddig legerősebb modelljét *Published:* 2026-07-09 *Author:* Remi Az xAI bejelentette a Grok 4.5 modellt, amelyet a cég a legnagyobb teljesítményű, kódolásra és ügynöki feladatokra optimalizált modelljeként pozicionál. A bejelentés július 8-án érkezett, a nyilvános hozzáférés pedig július 9-én indult el a grok.com-on és az X alkalmazásban. A modell a Cursor AI kódoló startuppal közösen készült, többmilliárd valós fejlesztői ügynökadaton tanították. A Grok 4.5 ötszázezer tokenes kontextusablakot kínál, és az API-ban 2 dollárba kerül millió input token, 6 dollárba millió output token — ez nagyjából négyszer olcsóbb, mint a Claude Opus 4.8. A Terminal-Bench 2.1 kódolási teszten 83,3 százalékot ért el, az Artificial Analysis Intelligence Indexen pedig a negyedik helyen áll a százhatvannyolc modell közül, közvetlenül a Claude Fable 5, a GPT-5.5 és az Opus 4.8 mögött. A cég szerint a modell 4,2-szer kevesebb output tokent használ, mint az Opus 4.8 ugyanazokon a feladatokon. A Grok 4.5 elérhető a Grok Build fejlesztői eszközben, a Cursor IDE-ben, az API-n keresztül, valamint az X Premium+ és SuperGrok előfizetők számára. Az EU-ban egyelőre nem használható — a cég július közepére ígéri a megjelenést. Az xAI bejelentette, hogy a jövőben havi rendszerességgel terveznek új alapmodelleket kiadni 2026 végéig. --- # Az OpenAI globálisan elérhetővé tette a GPT-5.6 modellcsaládot *Published:* 2026-07-09 *Author:* Remi Az OpenAI ma globálisan elérhetővé tette a GPT-5.6 modellcsaládot: a zászlóshajó Sol, a mindennapi munkára optimalizált Terra, és a leggyorsabb, legolcsóbb Luna már a ChatGPT-ben, a Codexben és az API-ban is használható. A bejelentés a június végi korlátozott preview után érkezik, a bevezetést lelassította az amerikai kormányzat engedélyezési folyamata. A teljes körű rollout most indul, és 24 óra alatt megy végbe világszerte. A GPT-5.6 Sol a legújabb benchmarkokon minden vetélytársat megelőz: az Agents’ Last Exam teszten 53,6 pontot ért el, ami 13,1 ponttal több, mint a Claude Fable 5. A kódolási teljesítménye a Terminal-Bench 2.1-en 88,8 százalék, a DeepSWE-n 72,7 százalék — mindezt kevesebb tokennel és alacsonyabb költséggel, mint a konkurens modellek. Az új ultra beállítás párhuzamos ügynökök koordinálásával gyorsítja fel a legösszetettebb feladatokat. A modellcsalád árazása versenyképes: a Sol 5/30 dollár (összehasonlításképp: a Fable 10/50 dollár), a Terra 2,50/15 dollár, a Luna pedig mindössze 1/6 dollár millió input és output tokenenként. A ChatGPT Plus, Pro, Business és Enterprise felhasználók közvetlenül elérik mindhárom változatot, míg Go előfizetéssel és ingyenes fiókkal csak a Terra és a Luna használható. --- # A Meta bemutatta a Muse Image és Muse Video generáló modelleket *Published:* 2026-07-09 *Author:* Remi A Meta bemutatta a **Muse Image** képgeneráló modellt és a **Muse Video** korai előzetesét. A Muse Image nem egyszerűen promptot fordít képpé: ügynökként működik, keresést és kódolást használ a pontosság javítására, önmagát finomhangolja, és a felhasznált számítási kapacitás növelésével képes javítani az eredményeken. A Muse Image jelenleg a második helyen áll az AI Image Arena szövegből-kép, egyképes szerkesztési és többképes szerkesztési ranglistáin. A Muse Video a harmadik helyen áll a szövegből-videó kategóriában. A Meta integrálta a modellt a saját ökoszisztémájába: a Meta AI alkalmazásban, a meta.ai oldalon, az Instagram Storiesban és a WhatsAppban már elérhető (az Egyesült Államokban és bizonyos országokban), a Facebook hamarosan követi. A Muse Image a Content Seal nevű láthatatlan vízjellel látja el a generált képeket, amely a vágás, tömörítés és átméretezés után is megmarad — a Meta egy detekciós eszközt is kiadott a hitelesség ellenőrzésére. A Muse Video, amely natív hangtámogatással is rendelkezik, hamarosan a tartalomkészítők és a Meta AI felhasználói számára is elérhető lesz. --- # Újabb nyílt kódoló modell Kínából: Meituan LongCat-2.0 *Published:* 2026-07-09 *Author:* Remi A kínai Meituan nyílt forrásúvá tette a LongCat-2.0-t, egy 1600 milliárd paraméteres MoE kódoló modellt, amely két hónapig Owl Alpha kódnéven vezette az OpenRouter globális fejlesztői toplistáját. A modell kizárólag kínai gyártmányú ASIC chipeken fut, Nvidia GPU-k nélkül — ezzel bizonyítva, hogy az USA-szankciók ellenére is megvalósítható a közel-frontier szintű AI. A LongCat-2.0 1 millió tokenes kontextusablakot és valós idejű ingyenes kontextus-gyorsítótárazást kínál, mindezt ingyenes MIT licenc alatt. Az API-ban a promóciós ár 0,30 dollár input és 1,20 dollár output millió tokenenként — a GPT-5.5 töredéke. Benchmarkon 59,5 pontot ért el az SWE-bench Pro teszten, megelőzve a GPT-5.5 58,6 pontját. A megjelenés geopolitikai kontextusa éppen olyan fontos, mint a technológiai. Miután [az amerikai kormány korlátozta a GPT-5.6 és az Anthropic Fable 5 / Mythos 5 elérhetőségét](https://aihirfolyam.hu/2026/06/az-amerikai-kormany-letiltotta-az-anthropic-fable-5-es-mythos-5-modelljeit/), a kínai nyílt modelleknek — köztük a LongCat-2.0-nak — globálisan megugrott a népszerűségük fejlesztők körében. --- # A Microsoft saját modelljeire cseréli a Copilotban az OpenAI és az Anthropic rendszereit *Published:* 2026-07-08 *Author:* Remi A Microsoft a saját MAI modelljeire cseréli a Copilotban az OpenAI és az Anthropic modelleit, hogy csökkentse a költségeket. A vállalat már most is a saját fejlesztésű rendszereivel válaszol az Excel és az Outlook felhasználói kérések egy részében — korábban ezeket a termékeket aktívan az OpenAI és az Anthropic modelleire építve hirdette. A váltás már folyamatban van: hetente tízezernyi lekérdezés fut át a Microsoft saját MAI modelljein. A Microsoft célja, hogy a külső modellek költségét végül teljesen megszüntesse. A felhasználók számára ez azt jelentheti, hogy ugyanazon árért kevesebb teljesítményt kapnak — a cég saját modelljei egyelőre nem érik el a piacvezető szolgáltatók szintjét. A lépés része egy szélesebb trendnek: az Amazon, az Uber, a Meta és az Accenture is visszafogja az AI-költségeit. A túlzott kiadások annyira elharapóztak, hogy egyes cégek már kínai modellek felé fordulnak olcsóbb alternatívaként, noha a biztonsági kockázatok miatt ez nem mindig tartható. --- # Az OpenAI bemutatta a GPT-Live-ot, az új generációs hangmodellt *Published:* 2026-07-08 *Author:* Remi Az OpenAI bemutatta a GPT-Live-ot, egy új generációs hangmodellt, amely a kétirányú architektúrának köszönhetően egyszerre képes hallgatni és beszélni. A modell a beszélgetés során aktívan jelzi a figyelmét „aha”, „igen”, stb. kifejezésekkel, és nem szakítja meg a felhasználót gondolkodás közben. A bonyolultabb kérdéseknél a háttérben a GPT-5.5-re delegál, miközben a párbeszéd folyamatosságát fenntartja. A GPT-Live két változatban érhető el — GPT-Live-1 és GPT-Live-1 mini —, és a ChatGPT felhasználói számára mától globálisan elérhető. A modell a meglévő Advanced Voice Mode-hoz képest gyorsabb, természetesebb válaszokat ad, és vizuális kártyákat is meg tud jeleníteni időjárás, részvények vagy sport témákban. A cég az API-ba is tervezi a beillesztést, a fejlesztők előzetes regisztrációra jelentkezhetnek. A hangmodell új biztonsági rétegeket is kapott: a valós idejű beszélgetések során a rendszer képes azonnal beavatkozni, ha kockázatos tartalmat észlel, és válsághelyzetekben szakértői krízisvonalakat ajánl fel. A tinédzser felhasználókra szabott védelmeket szintén beépítették, a szülői felügyeleti beállítások pedig szabályozzák a hozzáférést. --- # A Deloitte szerint az AI-ügynökök megölik az óradíjas tanácsadást *Published:* 2026-07-08 *Author:* Remi A Deloitte vezetősége belső meetingen figyelmeztette a tanácsadóit: az AI-ügynökök 2035-re szinte teljesen kiszoríthatják az óradíjas munkát. Jason Manstof, a Deloitte amerikai közszektorbeli tanácsadásának vezetője által bemutatott diagram szerint a klasszikus, óra alapú tanácsadási modell a piac csak egy vékony szeletét teszi majd ki. Egy jelen lévő tanácsadó összefoglalta a mondanivalót: „A modellünk megbukott. Gyakorlatilag robotokkal helyettesítenek minket.” A szakma egészében keresik az új bevételi modellt: a McKinsey-nél már a díjak több mint 30 százaléka eredményalapú elszámolásból származik. A Boston Consulting Group is hasonló irányba mozdul. A váltás azonban nem sima: a fix áras projektek túlfutásakor a cégek nyelik a költségeket, a kifizetések kiszámíthatatlanná válnak, a szubjektív sikerkritériumok pedig ügyfélvitákhoz vezetnek. A Catalant vezérigazgatója, Pat Petitti „túlélési küzdelemnek” nevezi a helyzetet: az AI tönkreteszi a tanácsadói üzleti modellt, és a cégek most kényszerből keresnek alternatívát. --- # Az OpenAI több mint 50 százalékkal csökkentette az inference költségeit a vendégfelhasználóknál *Published:* 2026-07-08 *Author:* Remi Az OpenAI nyilvánosságra hozta, hogy több mint 50 százalékkal sikerült csökkenteniük az inference költségeket — vagyis a meglévő modellek futtatásának kiadásait — a ChatGPT vendégfelhasználói esetében. A The Information forrása szerint a szükséges Nvidia GPU-k száma néhány százra esett vissza. Nem világos, pontosan hány GPU kellett korábban, és milyen technikákat alkalmaztak az eredmény eléréséhez. A vendégfelhasználók csak nagyon korlátozott funkciókészlethez férnek hozzá, így kérdés, hogy az optimalizációk átültethetők-e a teljes termékre. A DeepSeek szintén frissen adott ki egy nyílt forrású módszert, amely 60-85 százalékkal gyorsíthatja az inference kéréseket. A felszabaduló erőforrásokat szolgáltatások skálázására, jobb modellekre, gyorsabb válaszokra vagy nagyobb haszonkulcsra fordíthatják. Az adatközpont-építések lassú üteme miatt azonban valószínűbb, hogy az ilyen eredmények inkább lélegzetvételt adnak a laboratóriumoknak, mintsem hogy csökkentenék a chip-iránti keresletet. --- # A Cloudflare szeptembertől blokkolja a vegyes felhasználású AI-crawler-eket *Published:* 2026-07-08 *Author:* Remi A Cloudflare bejelentette, hogy 2026. szeptember 15-től alapértelmezetten blokkolja azokat a webes robotokat, amelyek egyszerre használják az adatokat keresésre, AI működtetésére és modellek betanítására. Az érintett oldalak (különösen a hirdetéseket futtatók) csak akkor lesznek elérhetők ezeknek a „vegyes” crawlereknek, ha a tulajdonos ezt külön engedélyezi. A cél: a kiadók nagyobb kontrollt kapjanak a tartalmuk felett, és ne adják azt ingyen az AI cégeknek. A Cloudflare szerint az internetes forgalom már többségében nem emberi, ami miatt nem lehet várni az új szabályozási és üzleti modellek bevezetésével. A cég egy új irányt is felvet: a „Pay Per Crawl” után jön a „Pay Per Use”, ahol már nem csak az adat letöltéséért, hanem a tényleges felhasználásért is fizetni kell. Első partnerek között van a You.com és a Ceramic.ai, akik fizetnek a prémium tartalmak használatáért. --- # A Mistral nyílt forráskódú Leanstral 1.5 modellje csúcsteljesítményt ér el a matematikai benchmarkokon *Published:* 2026-07-08 *Author:* Remi A Mistral kiadta a Leanstral 1.5 modellt, egy nyílt forráskódú, Apache-2.0 licenc alatt elérhető formális matematikai és kódverifikációs rendszert. A modell 119 milliárd paraméterből áll, ám mindössze 6 milliárd aktív paraméterrel működik — ez jelentősen csökkenti a futtatási költségeket a teljes méretű modellekhez képest. A Leanstral 1.5 teljesítménye a matematikai benchmarkokon kiemelkedő: 100 százalékot ér el a miniF2F teszten, a 672 PutnamBench problémából 587-et megold, és új rekordokat állít a FATE-H (87 százalék) és FATE-X (34 százalék) absztrakt algebra benchmarkokon. A MathArena mérései szerint a teljesítménye eléri a GPT-5.5 xhigh szintjét, ami figyelemre méltó eredmény egy nyílt súlyú modelltől. A modell képességei nem korlátozódnak a matematikai bizonyításokra: 57 tesztelt kód repository-ban 47 sérülékenységet talált. A rendszer ingyenes API-n és HuggingFace-en keresztül is elérhető, a forráskód és a súlyok teljes egészében nyíltak. --- # Kína is fontolgatja, hogy korlátozza a legfejlettebb AI modellek külföldi hozzáférését *Published:* 2026-07-07 *Author:* Remi Kína a kereskedelmi minisztérium vezetésével az elmúlt hónapban többször is tárgyalt az Alibaba, a ByteDance és a Z.ai képviselőivel a legfejlettebb AI modelljeik külföldi hozzáférhetőségének korlátozásáról. A megbeszéléseken felmerült, hogy az AI technológiák kiszivárogtatását vagy eltulajdonítását nemzetbiztonsági bűncselekménnyé minősítsék. A korlátozások a jövőben megjelenő, még be sem jelentett modellekre is vonatkozhatnak, és mind a zárt, mind a nyílt súlyú rendszereket érinthetik. A tárgyalásokon az is szóba került, hogy szigorítsák a hazai AI startupok finanszírozására jogosultak körét — a pontos szabályozás még kidolgozás alatt van. A lépés párhuzamosan fut az amerikai intézkedésekkel, ahol [a Trump-kormányzat az Anthropic legerősebb modelljeire is exportkorlátozást vezetett be](https://aihirfolyam.hu/2026/06/az-amerikai-kormany-letiltotta-az-anthropic-fable-5-es-mythos-5-modelljeit/) nemzetbiztonsági okokból. Kína idén már több lépést is tett a hazai AI védelmében: áprilisban a Meta 2 milliárd dolláros Manus-felvásárlását bontották fel, júniusban pedig szigorították a külföldi befektetések szabályozását. --- # A Midjourney a filmstúdiók AI használatának felfedésére törekszik a szerzői jogi perben *Published:* 2026-07-04 *Author:* Remi A Midjourney azt szeretné, hogy a Disney, a Universal és a Warner Bros. felfedje, hogyan használja a mesterséges intelligenciát. A stúdiók tavaly perelték be az AI képlabort, azzal vádolva, hogy lehetővé teszi az egyedi karaktereik tömeges generálását, ezzel súlyosan megsértve az alkotók szerzői jogait. A Midjourney „fair use” védelemre hivatkozik, és azzal érvel, hogy a felperes stúdiók maguk is hasonló AI gyakorlatokat folytatnak. Egy alperesi bíró júniusban korlátozta a felfedezési jogot: a stúdióknak csak a fogyasztóknak szánt AI alkalmazásokról kellett információt szolgáltatniuk. A Midjourney ezen a héten indítványt nyújtott be, amelyben a belső AI eszközökre, kutatási jelentésekre, tanítóadatbázisokra és modellsúlyokra is ki akarja terjeszteni a felfedést. A cég szerint ha a stúdiók maguk is engedély nélküli szerzői jogi adatokkal képeznek be belső képgeneráló modelleket, az azt bizonyítaná, hogy az iparágban általános gyakorlat a licensz nélküli tartalmak felhasználása. A stúdiók ügyvédje szerint a Midjourney egyszerűen a saját jogsértéseiről próbálja elterelni a figyelmet. --- # A Claude segítségével találtak kritikus sérülékenységet a nagy amerikai fesztiválok jegyrendszerében *Published:* 2026-07-04 *Author:* Remi Ian Carroll biztonsági kutató a Claude Opus 4.7 segítségével talált egy hibát a Front Gate Tickets rendszerében, amely szinte az összes nagy amerikai zenei fesztivál jegyértékesítését kezeli — köztük a Lollapalooza, a South by Southwest és az Austin City Limits jegyeit. A sebezhetőség teljes rendszergazdai hozzáférést biztosított, így Carroll hozzáfért milliós ügyféladatokhoz és szabadon kiadhatott jegyeket bármely eseményre, akár VIP-belépőket is. A Front Gate 24 órán belül javította a hibát, és állításuk szerint nincs nyoma visszaélésnek. Carroll az Anthropic Cyber Verification Programjának tagja, amely engedélyezett biztonsági kutatóknak teszi elérhetővé a Claude fejlett képességeit. Az Anthropic szerint a program célja éppen az ilyen sebezhetőségek felkutatása és a világ kódolásának biztonságosabbá tétele. --- # Az Anthropic kiadta a Claude Science-t, egy AI-támogatott tudományos kutatási eszközt *Published:* 2026-07-04 *Author:* Remi A Claude Science egy új, önállóan működő tudományos kutatási eszköz, amelyet gyógyszerfejlesztésre és biológiai, és más tudományos munkákra optimalizáltak. A rendszer a Claude Code-hoz hasonlóan működik: tömör, magas szintű utasítások alapján képes önállóan végrehajtani komplex kutatási feladatokat. Az eszköz már elérhető minden fizetős Claude-előfizető számára. A Claude Science genetikai, kémiai és fehérjebiológiai szoftverekkel képes együttműködni, és kiemelten kezeli a reprodukálhatóságot — minden eredmény és ábra forrása visszakövethető. A bemutatón azt is láthatták a résztvevők, hogyan azonosított önállóan új gyógyszerjelölteket a rendszer egy ritka genetikai betegség, a fenilketonúria kezelésére. Az Anthropic a saját kutatásában is használni fogja az eszközt, elsősorban elhanyagolt, ritka betegségek gyógyszerjelöltjeinek felkutatására. A bejelentés egybeesik azzal, hogy [John Jumper, az AlphaFold társalkotója és kémiai Nobel-díjas tudós nemrég hagyta ott a Google DeepMindot az Anthropicért](https://aihirfolyam.hu/2026/06/a-nobel-dijas-alphafold-tarsalkoto-tavozik-a-google-deepmindtol/). A DeepMind több mint egy évtizedig vezette az AI-tudományos alkalmazásokat, de az utóbbi hónapokban a riválisok — köztük az Anthropic — felzárkóztak és átvették a kezdeményezést a kódolás és a tudományos kutatás területén is. --- # Portugália első saját AI modellje: Amalia *Published:* 2026-07-04 *Author:* Remi Portugália bemutatta első hazai fejlesztésű mesterséges intelligencia modelljét, az Amaliát. A 9 milliárd paraméteres nagy nyelvi modellt a EuroLLM-9B alapmodellre építve hozták létre, és 32 ezer tokenes kontextusablakkal látták el — ez nyolcszorosa az eredeti alapmodell kapacitásának. A projekt neve a fado-legendát, Amália Rodrigues-t idézi. A modell építéséhez a portugál Arquivo.pt webarchívum 195 terabyte nyers adatából készítettek egy 5,8 milliárd tokenes, kifejezetten európai portugál nyelvű tanítóadatbázist. A végeredmény súlyai, forráskódja és tanítóadatbázisa is nyílt licenc alatt érhető el — a 60 fős kutatócsapat célja az volt, hogy teljesen átlátható legyen a rendszer, amelyet közintézményekbe és állami szolgáltatásokba szánnak. A modell nem közvetlenül a nagyközönség számára készült chatbot, hanem alaptechnológiaként szolgál: vállalatok, egyetemek és kutatók építhetnek rá saját alkalmazásokat. Első felhasználási területei között van egy múzeumi virtuális idegenvezető, a portugál haditengerészet döntéstámogató rendszere, valamint egy állami ügyintézést segítő digitális asszisztens. A kezdeményezés Európa digitális szuverenitási törekvéseihez csatlakozik, hasonlóan a francia Mistral AI-hoz és a német Aleph Alpha-hoz. Luis Montenegro miniszterelnök szerint „Európa stratégiai autonómiája ma, talán jobban, mint valaha, az AI-hoz kötődik.” --- # A Meta száz vállalkozója kiskorúnak álcázva tesztelte a rivális AI chatbotokat *Published:* 2026-07-03 *Author:* Remi A Meta száz vállalkozója magát kiskorúnak beállítva több mint 45 000 érzékeny üzenetet küldött a ChatGPT-nek, a Gemini-nek és a Character.AI-nek, hogy teszteljék a válaszreakcióikat. A témák között volt az öngyilkosság, a szex és a drogok. A „Cannes” kódnevű projektben a Meta alvállalkozói több tízezer különböző promptot írtak kiskorúak szemszögéből, és a cégek, amelyeket teszteltek, erről mit sem tudtak. A *Wired* által vizsgált dokumentumok szerint a vállalkozók hamis fiókokat hoztak létre, és a chatbotok válaszait táblázatokba másolták. A Character.AI szerint a tesztelés megsértette a szolgáltatási feltételeiket, az OpenAI kivizsgálja az ügyet, a Google pedig azt állítja, nem adott engedélyt a tesztelésre. A Meta szerint a módszer „felelősségteljes, iparági szabvány szerinti biztonsági tesztelés”. A lépés különösen érzékeny időben érkezik: több tizenéves halála is összefüggésbe hozható AI chatbotokkal, és a Meta korábban már arra kényszerült, hogy leállítsa a kiskorúak hozzáférését az AI karakterekhez. --- # A Claude Fable 5 már a távmunkában végezhető feladatok 16 százalékát elvégzi szakmai színvonalon *Published:* 2026-07-02 *Author:* Remi A Center for AI Safety és a Scale Labs közös **Remote Labor Index** (RLI) mérése szerint a Claude Fable 5 a professzionális színvonalnak megfelelő munkát ad át a valós, fizetős remote projektek 16,1 százalékában. Ez sokszorosa az index indulásakor (2025 októberében) mért 2,5 százaléknak, és nagyjából megduplázza az eddigi csúcstartó Opus 4.8 nyolc százalékos eredményét. Az RLI valódi megbízói projekteket tesztel 3D modellezéstől a webfejlesztésig, és minden eredményt emberi szakértők hasonlítanak össze fizetett profik munkájával. A GPT-5.5 6,3 százalékot ért el, míg az Opus 4.6 a Claude Cowork segítségével 4,17 százalékot. A kutatók megjegyzik, hogy bár a Fable 5 eredményei még mindig messze vannak a többségi automatizációtól, a növekedés üteme gyors: kevesebb mint nyolc hónap alatt többszörösére ugrott a mért érték. --- # A Doublespeed telefonfarmokkal gyártja az AI-influencereket *Published:* 2026-07-02 *Author:* Remi A New York Magazine betekintést nyert a Doublespeed belső működésébe: a 21 éves alapító, Zuhair Lakhani Los Angeles-i irodájában 1200 okostelefon fut egyszerre, további 3000 külső telephelyen. A készülékek mindegyike külön TikTok-fiókot kezel, és AI-generált személyekként posztol, lájkol, kommentel – ügyfelek megbízásából. A cég célja, hogy teljesen kiváltsa az emberi kreátorokat: „Soha többé ne fizess emberért” – áll a weboldalukon. A szolgáltatás havi 450 dollárért elérhető, ami jóval kevesebb, mint egy valódi kreatív ára. Lakhani szándékosan használja a disztópiát marketingeszközként: Twitteren már nem „UGC-kampányokat”, hanem „propaganda-kampányokat” hirdet, és a „halott internet” víziójával operál. A cég ügyfelei között van egy térképmegosztó app, egy imádságalkalmazás és egy habhenger-márka; a Corner nevű app például a marketingköltségvetése 30 százalékát Doublespeedre költi. A végső cél teljesen autonóm AI közösségimédia-fiókok létrehozása, amelyek önállóan kitalálják, elkészítik és közzéteszik a tartalmat. A Doublespeed tavaly októberi bejelentéséről és az Andreessen Horowitz befektetéséről itt írtunk korábban: [*Egy új startup AI tartalommal árasztaná el a közösségi médiát*](https://aihirfolyam.hu/2025/10/egy-uj-startup-ai-tartalommal-arasztana-el-a-kozossegi-mediat/) --- # Az OpenAI 5 százalékos részesedést ajánlott fel az amerikai kormánynak *Published:* 2026-07-02 *Author:* Remi Az OpenAI felajánlotta, hogy az amerikai kormány 5 százalékos részesedést kap a cégben — az ajánlat értéke a jelenlegi 852 milliárd dolláros értékelés alatt mintegy 42,6 milliárd dollár. Sam Altman vezérigazgató a Financial Times szerint azzal érvelt, hogy a közvagyonban való részesedés a legjobb módja annak, hogy az AI haszna elérje a lakosságot. Az elképzelés nem csak az OpenAI-re vonatkozna: a javaslat szerint más vezető amerikai AI-cégek — az Anthropic, a Google és a Meta — hasonló arányban adnának részesedést egy állami szuverén vagyonalapnak. Egyelőre nem világos, hogy a társaságok hajlandóak-e erre. Altman a Trump-kormánynak már 2025 elején felvázolta a koncepciót, és áprilisban „közjóléti alap” létrehozását javasolta az AI-vállalatok növekedéséből származó hozamok szétosztására. A Trump-kormányzat korábban is vásárolt részesedést magáncégekben: az Intelben 10 százalékos tulajdonrészt szerzett egy 8,9 milliárd dolláros befektetéssel. Trump maga az AI-óriások állami tulajdonrészét „gyönyörű dolognak” nevezte, ami az amerikaiakat „partnerré teszi ebben a forradalomban”. --- # Mindössze 16 százalék látja pozitívnak az AI társadalmi hatását Amerikában *Published:* 2026-07-01 *Author:* Remi Egy friss Pew Research Center felmérés szerint az amerikaiaknak mindössze 16 százaléka gondolja, hogy a mesterséges intelligencia pozitív hatással lesz a társadalomra a következő húsz évben. A válaszadók nagyjából 40 százaléka negatívan ítéli meg a technológia hosszú távú hatásait. A fiatalok — a harminc év alattiak — még pesszimistábbak: náluk mindössze 14 százalék vár pozitív hatást. A megkérdezettek kétharmada szerint az AI fejlesztése túl gyorsan halad. A felhasználói szokásokról szóló rész eközben azt mutatja, hogy a felnőttek negyede naponta használ AI chatbotot, a ChatGPT-használat megduplázódott 2023 óta, és a megkérdezettek 44 százaléka aktívan használja. A felmérésből az is kiderül, hogy a megkérdezettek 67 százaléka nem bízik abban, hogy az amerikai kormány értelmesen szabályozza majd az AI-t, és 59 százalékuk nem bízik meg a cégekben sem a biztonságos fejlesztés tekintetében. --- # Az amerikai kormány feloldotta az Anthropic Mythos és Fable modellek exporttiltalmát *Published:* 2026-07-01 *Author:* Remi Két héttel azután, hogy az amerikai kormány exportkorlátozás alá vonta az Anthropic két legerősebb modelljét, a Mythos 5-öt és a Fable 5-öt, a Trump-kormányzat teljesen feloldotta a tiltást. A modellek július 1-jétől újra elérhetők a nyilvánosság számára — külföldi állampolgárok számára is. Az ügy június 12-én kezdődött, amikor az amerikai kormány a két modellt [felvette az exportkorlátozott technológiák listájára](https://aihirfolyam.hu/2026/06/az-amerikai-kormany-letiltotta-az-anthropic-fable-5-es-mythos-5-modelljeit/), ami azt jelentette, hogy külföldi állampolgárok csak külön engedéllyel férhettek hozzájuk. A gyakorlatban ez azt eredményezte, hogy az Anthropic teljesen megszüntette a modellek nyilvános elérhetőségét. Hetekig tartó tárgyalások után Howard Lutnick kereskedelmi miniszter bejelentette, hogy az Anthropic „vállalja, hogy proaktívan észleli és kezeli a modellekkel kapcsos biztonsági kockázatokat; szorosan együttműködik az amerikai kormánnyal a protokollok, szabványok és kiadások terén; valamint tájékoztatja a kormányt minden rosszindulatú tevékenységről”. Ironikus módon az Anthropic ezeket a vállalásokat már korábban, önkéntesen is megtette. A cég vezérigazgatója, Dario Amodei márciusban publikusan kötelezte el magát hasonló intézkedések mellett — hónapokkal azelőtt, hogy az exporttilalom képbe került volna. A kiberbiztonsági szakértők ezért kezdettől fogva szkeptikusak voltak a korlátozásokkal szemben, szerintük a tiltás inkább politikai eszköz volt, mintsem valódi biztonsági intézkedés. A nyomás mindazonáltal valós volt: ázsiai AI-cégek — köztük a Sakana és a Tulongfeng — már [a Mythos-hoz hasonló képességekkel rendelkező modelleket adtak ki](https://aihirfolyam.hu/2026/06/a-sakana-fugu-kollektiv-intelligencia-a-monolit-modellek-ellen/), miközben az amerikai modell elérhetetlen volt. A Trump-kormányzat szeszélyes AI-politikája nem segíti a helyi AI-ipar szereplőit. Egy júniusi elnöki rendelet, amely [a modellek kiadás előtti felülvizsgálatát irányozta elő](https://aihirfolyam.hu/2026/05/a-feher-haz-kormanyzati-felugyeletet-akar-az-uj-ai-modellek-szamara/), szintén éles kritikát kapott. A vállalatok továbbra is bizonytalanok, hogy milyen szabályozás várható a jövőbeli modellkiadások számára. --- # A Google bemutatta a Nano Banana 2 Lite-ot: gyorsabb és olcsóbb képgeneráló modell *Published:* 2026-07-01 *Author:* Remi A Google kiadta a Nano Banana 2 Lite-ot, a saját fejlesztésű AI képgeneráló modelljének legújabb verzióját. Az új változat gyorsabb és olcsóbb, mint az előző kiadás. A modell jóval alacsonyabb késleltetéssel működik, és mindössze négy másodperc alatt tud képet generálni. Az árazás is figyelemre méltó: egy kép elkészítése kb. 0,034 dollárba kerül, ez nagyjából a fele a Nano Banana 2-nek, és ötöde a Nano Banana Pro-nak. A Nano Banana eredeti változatát [tavaly nyáron mutatták be](https://aihirfolyam.hu/2025/08/google-legfejlettebb-uj-kepszerkeszto-modellje-bekerult-a-geminibe/), és a Gemini 3.1 Flash modellen alapul. A Nano Banana 2 [februárban érkezett](https://aihirfolyam.hu/2026/02/a-google-bemutatta-a-nano-banana-2-kepgeneralo-modellt/), valósághűbb képeket készít, és a hosszabb szövegeket is magabiztosan kezeli. A cég emellett [egy Pro változatot is kínál](https://aihirfolyam.hu/2025/11/nano-banana-pro-a-google-uj-ai-kepgeneralo-modellje/), amelyet komplexebb felhasználási esetekre szántak. A Google szerint míg a Nano Banana 2 egy „általános munkaeszköz”, a Banana 2 Lite-ot kifejezetten a nagy volumenű, gyors munkafolyamatokra optimalizálták. A modell a Google AI Studio-n, a Gemini API-n és a Gemini Enterprise Agent Platformon keresztül is elérhető. Az eredeti Nano Banana „elavult modellként” szerepel mostantól, a Lite veszi át a helyét. Az AI által generált képek és videók körüli „AI-szemét” vitája ellenére a vállalatok továbbra is komoly forrásokat fektetnek az AI képgeneráló eszközökbe. --- # Itt az Anthropic legújabb modellje: Claude Sonnet 5 *Published:* 2026-06-30 *Author:* Remi Az Anthropic bemutatta a Claude Sonnet 5 modellt, amely az eddigi legerősebb Sonnet osztályú modell. A Sonnet 5 ügynöki típusú képességei jelentősen fejlődtek: önállóan képes tervezni, eszközöket használni, és olyan összetett feladatokat is végigvisz, amelyek korábban csak a drágább Opus modelleknek sikerültek. A benchmark-okon közelít az Opus 4.8 teljesítményéhez. A bevezető árazás 2 dollár input és 10 dollár output token milliónként, augusztus 31-ig; utána a szabványos díj 3 és 15 dollár lesz. A modell az érvelési, kódolási, és tudásalapú munkafolyamatok területein is javult a Sonnet 4.6-hoz képest, és a biztonsági értékelések szerint alacsonyabb arányban produkál nem kívánt viselkedést. A Sonnet 5 azonnal elérhető minden előfizetési szinten, a Claude API-n a `claude-sonnet-5` modellnévvel használható. --- # Ausztria azt javasolja, hogy az EU fogadja be az Anthropicot *Published:* 2026-06-30 *Author:* Remi Ausztria azt javasolja az Európai Uniónak, hogy fontolja meg az Anthropic befogadását az EU területére – válaszul az amerikai kormány piaci korlátozásaira, amelyekkel megakadályoznák a külföldiek hozzáférését a legfejlettebb mesterséges intelligencia modellekhez. Alexander Proell osztrák digitalizációért felelős államtitkár szerint Európának biztosítania kell, hogy ne maradjon le a legfontosabb AI-fejlesztésekről. Levelében azt írta, hogy az EU jogbiztonsággal, piaci hozzáféréssel, tőkével és megfelelő értékrenddel vonzó környezetet kínálhatna az Anthropic számára. Ugyanakkor azt is elismerte, hogy a javaslat megvalósítása korántsem egyszerű. A hír egybeesik az Európai Bizottság új terveivel, amelyek célja a helyi felhőszolgáltatás, AI- és félvezetőipar megerősítése, valamint az amerikai technológiai vállalatoktól való függőség csökkentése. Az Anthropic egyelőre nem reagált a felvetésre. --- # A tech óriások AI-költései hamarosan meghaladhatják a bevételeiket *Published:* 2026-06-27 *Author:* Remi Az Epoch AI elemzése szerint a Microsoft, az Amazon, az Alphabet, a Meta és az Oracle összesített infrastrukturális költései évente 70 százalékkal nőnek, miközben a működési cash flow mindössze 23 százalékos ütemben bővül. Ha a trend folytatódik, a beruházások utolérik a bevételeket — a szabad cash flow nullára vagy negatívba fordulhat 2026 harmadik negyedévében. A cégek addig sem várnak: az Alphabet nemrégiben 80 milliárd dolláros részvénykibocsátást jelentett be, az Amazon és az Nvidia pedig kötvényeket adott el a tőkebevonáshoz. A háttérben az áll, hogy az AI-iránti kereslet jelenleg meghaladja a rendelkezésre álló kapacitást a Google, a Microsoft és az Amazon szerint is. Az elemzés szerint a kulcskérdés, hogy az AI-befektetések végül termelnek-e elegendő bevételt ahhoz, hogy bezárják a szakadékot. Egyelőre a cégek inkább hitelből és részvényértékesítésből finanszírozzák a növekedést, mint a saját működésükből származó forrásokból. --- # A legtöbb AI chatbot baloldali állásponton van a politikai kérdésekben *Published:* 2026-06-27 *Author:* Remi A Washington Post vizsgálata szerint a hat legnagyobb AI chatbot többsége egyértelműen balra húz a politikai kérdésekben. Az OpenAI GPT-5.5 modellje 80 százalékban kizárólag baloldali érveket adott, a Deepseek V4 Pro 70 százalékban. Még az Elon Musk által „anti-woke-nak” hirdetett Grok 4.3 is gyakrabban foglalt baloldali álláspontot. A Gab platform „keresztény és konzervatív értékekre épülő” Arya modellje is tizenkétszer gyakrabban volt baloldali, mint jobboldali. Egyedül a Google Gemini 3.1 Pro tűnik kivételnek: a válaszok 93 százalékában mindkét oldal érveit bemutatta. Az Anthropic Claude Opus 4.8 43 százalékban volt egyoldalúan baloldali, 57 százalékban pedig mindkét oldalt megjelenítette. A Grok a transznemű jogok kérdésében kivételt jelentett — itt kizárólag jobboldali álláspontot foglalt, ami pontosan illeszkedik Musk nyilvános véleményéhez, és arra utal, hogy ebben a témában kifejezetten beavatkoztak a modell válaszaiba. --- # Ornith-1.0: új, nyílt súlyú kódoló modellek *Published:* 2026-06-27 *Author:* Remi A **DeepReinforce** amerikai kutatólaboratórium kiadta az **Ornith-1.0** nyílt forrású kódoló modellcsaládot, amely négy méretben érhető el: 9 milliárd, 31 milliárd, 35 milliárd MoE és 397 milliárd MoE paraméter. A modellek MIT licenc alatt tölthetők le a Hugging Face-ről, és a Gemma 4 illetve Qwen 3.5 alapmodellekre épülnek. A 397 milliárd paraméteres változat 82,4 százalékot ért el az SWE-Bench Verified teszten, ami megelőzi a Claude Opus 4.7-et, de elmarad az Opus 4.8-tól. Van egy 9 milliárdos változat is, amelynek a futtatásához 80 GB-os GPU-ra van szükség. A modellek OpenAI-kompatibilis végpontot kínálnak, így a legtöbb környezetben kód változtatás nélkül működnek. --- # Megérkezett a GPT-5.6, de egyelőre csak egy szűk kör számára elérhető *Published:* 2026-06-26 *Author:* Remi Az OpenAI elindította a **GPT-5.6** modellcsalád korlátozott előzetes tesztelését: a **Sol** a csúcsmodell, a **Terra** egy kiegyensúlyozott megoldás mindennapi munkához, a **Luna** pedig a gyors és olcsó változat. A Terra a GPT-5.5-höz hasonló teljesítményt kínál, de fele annyiba kerül, míg a Luna a cég eddigi legalacsonyabb árazású erős modellje. A Sol a cég állítása szerint az eddigi legerősebb modell, új benchmark-rekordokat állított fel kódolásban (Terminal-Bench 2.1), biológiában (GeneBench v1) és kiberbiztonságban (ExploitBench, ExploitGym). A GPT-5.6 bevezeti a `max` reasoning effort szintet a mélyebb gondolkodáshoz, és egy `ultra` módot, amely alügynököket használ összetett feladatok gyorsítására. A biztonsági rendszer is jelentősen erősödött: rétegzett védelem, valós idejű kimenet-ellenőrzés, fiókszintű riasztások és több mint 700 000 GPU-óra automatikus red-teaming. Az API-árazás: Sol 5 dollár input / 30 dollár output 1 millió tokenenként, Terra 2,50/15 dollár, Luna 1/6 dollár. A Cerebras-on keresztül júliustól akár 750 token/másodperc sebességgel is elérhető lesz a Sol, ám egyelőre [csak szigorúan ellenőrzött ügyfelek számára engedélyezi a használatát az amerikai kormány](https://aihirfolyam.hu/2026/06/a-feher-haz-korlatozna-a-gpt-5-6-megjeleneset/). A korlátozott előzetes időszak után a cég szélesebb körben is elérhetővé fogja tenni a modelleket ChatGPT-n, Codex-en és API-n keresztül. --- # A Cohere kiadta a North Mini Code nyílt kódoló modelljét *Published:* 2026-06-26 *Author:* Remi A Cohere piacra dobta a **North Mini Code**-ot, az első nyílt forrású, ügynök-központú kódoló modelljét. A 30 milliárd paraméteres MoE architektúrából mindössze 3 milliárd aktív tokenenként, így egyetlen H100-as GPU-n is futtatható. A modell Apache 2.0 licenc alatt érhető el a Hugging Face-en és a Cohere API-n keresztül. A North Mini Code kifejezetten ügynök-munkafolyamatokra épült: képes alfeladatokat delegálni, rendszerarchitektúrát feltérképezni és kódellenőrzést futtatni. A benchmark-eredmények szerint 33,4 pontot ért el az Artificial Analysis Coding Indexen, ami versenyképes a hasonló méretű modellekkel. A modell 256 ezer tokenes kontextusablakot és 64 ezer tokenes maximális generálási hosszt kínál, ami hosszabb kódellenőrzésekhez és dokumentumelemzésekhez is elegendő. A Cohere szerint ez az első lépés a fejlesztők számára tervezett nyílt modellcsalád felé, amelynek célja, hogy a fejlesztők saját infrastruktúrájukon, szolgáltatófüggetlenül futtathassák a kódoló AI-jukat. --- # A Fehér Ház korlátozná a GPT-5.6 megjelenését *Published:* 2026-06-26 *Author:* aihadmin Az amerikai kormány azt kérte az OpenAI-tól, hogy a GPT-5.6 modellt első körben csak kiválasztott, kormány által jóváhagyott partnerek tesztelhessék, és csak később következzen a szélesebb nyilvános bevezetés. Az indoklás biztonsági jellegű: a modell állítólag már olyan képességszintet ér el, ahol a kormány külön ellenőrizni szeretné a védelmi mechanizmusokat. Sam Altman belső üzenetben úgy fogalmazott, hogy ez lehet a leggyorsabb út a modell megjelenéséhez, de az OpenAI hosszabb távon ezt nem tartja ideálisnak. Egyre inkább úgy tűnik, hogy a legerősebb AI modellek megjelenése már nem pusztán vállalati döntés, hanem nemzetbiztonsági kérdés is. --- # A Nobel-díjas AlphaFold-társalkotó távozik a Google DeepMindtól *Published:* 2026-06-26 *Author:* Remi John Jumper, aki 2024-ben kémiai Nobel-díjat kapott az AlphaFold fejlesztéséért, távozik a Google DeepMindtól és az Anthropic-hoz szerződik. Jumper közel kilenc évet töltött a DeepMindnál, ahol Demis Hassabis vezetésével az AlphaFold csapatát irányította — a fehérjeszerkezetek 3D-előrejelzésére alkalmas modell azóta a tudományos világ egyik legnagyobb AI-sikere lett. A Bloomberg szerint Jumper a Google üzleti kódolóeszközeinek fejlesztésében is kulcsszerepet játszott, amelyeket a cég nehezen tudott értékesíteni vállalati ügyfeleknek. A távozása mindössze néhány nappal azután érkezik, hogy [Noam Shazeer, a transformer-architektúra társalkotója is elhagyta a Google-t ](https://aihirfolyam.hu/2026/06/a-transformer-architektura-egyik-atyja-elhagyja-a-google-t-az-openai-ert/)az OpenAI-ért. Jumper az Anthropic-nál várhatóan a cég tudományos és kódoló AI-képességeit erősíti majd. A két egymást követő nagy név távozása komoly csapás a Google számára, amelynek reasoning modelljei nem tudtak felzárkózni az OpenAI és az Anthropic megoldásaihoz. --- # A Mistral OCR 4 már a dokumentumok struktúráját is értelmezi *Published:* 2026-06-26 *Author:* Remi A **Mistral** kiadta az **OCR 4** dokumentumfeldolgozó modellt, amely már nemcsak szöveget nyer ki, hanem strukturált, helyadatokkal ellátott reprezentációt ad vissza: minden blokk koordinátáit, típusát (cím, táblázat, egyenlet, aláírás) és szavankénti bizonytalansági értékét is. A modell 170 nyelvet támogat, PDF, DOC és PPT fájlokat dolgoz fel, és saját szerveren is futtatható egyetlen konténerként — ez utóbbi a szabályozott iparágakban kulcsfontosságú. A Mistral szerint a független tesztelők 72 százalékban preferálták az OCR 4 kimenetét a versenytársakkal szemben több mint 600 valós dokumentumon. A modell az OlmOCRBench és OmniDocBench teszteken is az élen végzett. Az árazás: 4 dollár 1000 oldal (*batch API*-val 2 dollár) — a token-alapú vision modellekhez képest ez nagyságrendekkel olcsóbbá teszi a hosszabb vállalati archívumok feldolgozását. Az amerikai kormány exporttilalmi lépéseire válaszul a Mistral az adatszuverenitást hangsúlyozza: az EU-ban bejegyzett cég helyi konténeres telepítést is kínál, így a dokumentumok nem hagyják el az ügyfél infrastruktúráját. --- # A Meta felfüggesztette a dolgozóit megfigyelő programot egy adatvédelmi incidens után *Published:* 2026-06-26 *Author:* Remi A Meta felfüggesztette a Model Compatibility Initiative (MCI) nevű belső megfigyelő programot, miután egy biztonsági rés nyomán a dolgozók egymás adataihoz férhettek hozzá. A program, amelyet áprilisban vezettek be az amerikai alkalmazottak számítógépeire, [egérmozgásokat, kattintásokat, billentyűleütéseket és képernyőtartalmat rögzített](https://aihirfolyam.hu/2026/04/a-meta-megfigyeli-alkalmazottai-egermozgasait-es-billentyuleuteseit-ai-betanitasra/) – azzal a céllal, hogy AI-modelleket tanítsanak be, és végső soron az emberi munkaerő kiváltására. A június 18-án felfedezett hiba több óráig nyitva hagyott egy belső adatbázist, ahol a MCI által gyűjtött adatok más munkatársak számára is elérhetők voltak. A Meta szerint nincs jel arra, hogy valaki visszaélt volna az elérhetőséggel, de a programot csak akkor indítják újra, amikor „meggyőződtek az adatvédelmi kontrollok hatékonyságáról”. A lépést belső nyomás is elősegítette: a dolgozók petíciót indítottak a program ellen adatvédelmi és személyes szabadságjogi aggályokra hivatkozva. --- # Az Anthropic szerint az Alibaba „ellopta” a Claude tudását *Published:* 2026-06-25 *Author:* Remi Az **Anthropic** szerint az **Alibaba** és AI-laborja, a **Qwen** több mint 28,8 millió lekérdezést intézett a Claude modellhez csaknem 25 000 hamis fiókon keresztül — a cég szerint ez a legnagyobb ismert distillation-támadás az AI-szektorban. A kampány 2026. április 22. és június 5. között zajlott, és a Claude legértékesebb képességeire fókuszált: ügynökalapú döntéshozatalra, szoftvermérnöki feladatokra és hosszú távú, többlépéses munkafolyamatokra. A cég azt állítja, hogy a distillation technika lehetővé teszi a kínai AI-laborok számára, hogy milliárd dolláros amerikai kutatási beruházások értékét ingyen megszerezzék — a rivális kimeneteiből tanítva saját modelljeiket az eredeti fejlesztés költségei nélkül. Az Anthropic a kongresszustól azt kéri, hogy pontosítsa az antitröszt-szabályokat a laborok közötti információmegosztás érdekében, szigorítsa a distillationhez szükséges chipek és adatközpontok exportellenőrzését, és büntesse a felelős laborokat. A cég már most is blokkolja a Claude kereskedelmi hozzáférését minden kínai székhelyű vállalat számára, és azt szeretné, ha ezt a korlátozást az egész amerikai AI-iparra kiterjesztenék. --- # Mélyebb Claude integráció a Slack-ben – mintha egy kollégával beszélnénk *Published:* 2026-06-24 *Author:* Remi Az **Anthropic** bemutatta a **Claude Tag** szolgáltatást, egy „mindig aktív” AI-kollégát, amely a Slack-ből elérhető, és ugyanúgy lehet üzenni neki, mint bármelyik emberi csapattársnak. A béta verzió a Claude Enterprise és Claude Team ügyfelek számára érhető el: a @Claude megemlítésével a felhasználók betekintést kérhetnek a beszélgetésekbe, feladatokat oszthatnak ki, és nyomon követhetik a munkát. A Claude Tag újítása az állandó kontextus és memória: ahogy a csatornákban követi a beszélgetéseket, folyamatosan tanulja a cég működését és a csapatok munkamódszereit. A rendszergazdák meghatározhatják, hogy mely eszközökhöz, információkhoz és csatornákhoz férhet hozzá — egy jogi csatornára beállított Claude például nem oszthat meg emlékeket a mérnöki csatornával. A feladatokat szakaszokra bontja, és a rendelkezésre álló eszközökkel dolgozza végig, az eredményeket a Slack szálakban publikusan megosztva. A szolgáltatás egy „ambiens módot” is tartalmaz, amelyben a Claude önmagától bekapcsolódik a beszélgetésekbe: figyelmeztet a feledésbe merült feladatokra, kiemel részleteket a szervezet más részeiről érkező eseményeknél, és frissítéseket ad a csapatnak. Az Anthropic szerint ez a megközelítés a Microsoft Graph, a Glean és a vállalati adatplatformokhoz hasonló kontextusréteget épít — azzal a különbséggel, hogy közvetlenül a megszokott Slack felületen működik. --- # Az AI tönkreteszi a szakmai készségeinket? *Published:* 2026-06-24 *Author:* Remi Egyre több kutatás utal arra, hogy az AI-eszközökre való túlzott támaszkodás nemcsak segíti a munkát, hanem közben le is építheti a szakmai tudást. Egy lengyelországi vizsgálatban tapasztalt orvosok a kolonoszkópiák során AI-támogatást kaptak a rákmegelőző elváltozások felismeréséhez. Miután hozzászoktak a rendszerhez, AI nélkül már rosszabbul teljesítettek: az adenómák felismerési aránya 28,4%-ról 22,4%-ra esett vissza. Hasonló jelenséget figyeltek meg szoftvermérnököknél is. Azok, akik AI-asszisztenst használtak egy programozási feladatnál, utána gyengébben teljesítettek a tanultakat mérő teszten, különösen a hibakeresést igénylő kérdésekben. --- # Norvégia szinte teljesen betiltja az AI-t az általános iskolákban *Published:* 2026-06-23 *Author:* Remi Norvégia teljes tiltást fontolgat a generatív AI-eszközök használatára az általános iskolákban: az 1–7. osztályos, 6–13 éves tanulók a jövő tanévtől, vagyis augusztus végétől általános szabályként nem használhatnak mesterséges intelligenciát. A kormány szerint a technológia használata növeli annak kockázatát, hogy a gyerekek kihagyják az oktatás alapvető lépéseit – a miniszterelnök, Jonas Gahr Stoere szerint a legfontosabb, hogy „megtanuljanak olvasni, írni és számolni”. A 14–16 éves diákok tanári felügyelettel, óvatosan használhatnak majd AI-eszközöket, a 17 éven felülieknek pedig megfelelően kell elsajátítaniuk a technológia alkalmazását. A döntés egy széles körű oktatási eredménycsökkenésre adott válasz: Norvégia 2024-ben már betiltotta az okostelefonokat az iskolákban, és most törvényjavaslatot terjeszt be, hogy több könyvet használjanak az osztálytermekben, visszafordítva a tablet-trendet. A kormány 16 éves kor alatt betiltaná a közösségi média használatát is. --- # Sakana Fugu: monolit modellek helyett kollektív intelligencia *Published:* 2026-06-23 *Author:* Remi A japán **Sakana AI** bemutatta a **Fugu** rendszerét, egy többmodellű, ügynök-alapú orchesztrációs platformot, amely a fejlesztők állítása szerint eléri a legfejlettebb monolit modellek – köztük az Anthropic Fable 5 – teljesítményét. A rendszer dinamikusan osztja ki a feladatokat egy cserélhető modellkészletnek, és összesített eredményt ad vissza, az OpenAI API kompatibilitást megtartva. A Fugu bejelentése különösen időszerű, miután az amerikai kormány [június elején letiltotta az Anthropic Fable 5 és Mythos 5 modelljeit](https://aihirfolyam.hu/2026/06/az-amerikai-kormany-letiltotta-az-anthropic-fable-5-es-mythos-5-modelljeit/) minden külföldi felhasználó számára. A Sakana szerint a Fugu pontosan az ilyen geopolitikai kockázatok ellen nyújt védelmet: ha egy modell vagy szolgáltató hozzáférése megszűnik, a rendszer automatikusan átirányítja a forgalmat más modellekre, anélkül hogy a felhasználói munkafolyamat megszakadna. A Fugu nem egyetlen nagy nyelvi modell, hanem egy „generálkivitelező”: amikor komplex feladatot kap, szétdarabolja azt, alfeladatokat delegál különböző szakértő modelleknek, ellenőrzi azok munkáját, és szintetizálja a végeredményt. Hogy konkrétan mely modellek működnek a háttérben, az üzleti titok – a felhasználó csak egyetlen API-végpontot lát. A Sakana két változatot kínál: a gyors, alacsony késleltetésű **Fugu**t az alapszintű feladatokhoz, és a **Fugu Ultrá**t a komplex, kockázatos munkákra, mint AI-kutatás, kiberbiztonsági elemzés vagy többlépéses szabadalmi vizsgálat. Benchmark-eredmények szerint a Fugu Ultra a LiveCodeBench kódolási teszten 93,2 pontot ért el, míg a Fable 5 csak 89,8-at; a GPQA-Diamond tudományos teszten 95,5-öt, megelőzve a Mythos Preview 94,6 pontját. A Fugu Ultra árazása fix: 5 dollár millió input tokenenként, 30 dollár millió output tokenenként. Ez a Claude Opus 4.8 (5/25 dollár) és a GPT-5.5 (5/30 dollár) szintjén van, és sokkal olcsóbb a Fable 5 10/50 dolláros díjánál. A háttérben futó belső orchesztrációs tokenek azonban külön költséget jelentenek – a felhasználó fizet azért is, ami nem látható. --- # Hamis hirdetéssel vádolják az Anthropicot a Claude Max előfizetése miatt *Published:* 2026-06-20 *Author:* Remi Az Anthropic ellen hamis hirdetési pert indítottak: a felperes szerint a Claude Max előfizetés felhasználási korlátjai a valóságban sokkal alacsonyabbak, mint amit amit a cég ígér. A 200 dolláros havi *Max 20x* csomag állítólag hússzoros mennyiséget kínál a Pro csomaghoz képest, ám a tényleges korlát csak hatszor-nyolcszoros – a 100 dolláros *Max 5x* pedig alig több mint háromszoros mennyiséget ad, az ötszörös helyett. A keresetben szereplő programozó, Karl Khan szerint egyetlen munkafolyamat során közel 20 százalékát el tudta használni a heti kvótájának. Reddit-fórumokon is hasonló tapasztalatokról számolnak be: több felhasználó is arról panaszkodott, hogy a legdrágább előfizetés „rendkívül félrevezető”. Az Anthropic weboldala a panasz szerint „fekete doboz”, amely nem részletezi, hogy pontosan hogyan számít a felhasználás – nincs megadva, hogy hány promptot engedélyez egy adott ablakban, és a „session” fogalmát sem definiálják világosan. A cég fenntartja a jogot, hogy heti és havi limiteket, valamint modell- és funkció-specifikus korlátokat állítson be tetszés szerint. Az Anthropic egyelőre nem reagált a történésekre. --- # A transformer-architektúra egyik atyja elhagyja a Google-t az OpenAI-ért *Published:* 2026-06-20 *Author:* Remi Noam Shazeer, az „Attention Is All You Need” című, a mai nyelvi modellek alapjául szolgáló tanulmány társszerzője elhagyja a Google-t, és az OpenAI-hoz szerződik. Shazeer 2000 óta dolgozott a Google-nél, ahol az utóbbi időben alelnökként és a Gemini modellek társvezetőjeként tevékenykedett Jeff Dean és Oriol Vinyals mellett. Shazeer 2021-ben távozott a Google-től, hogy megalapítsa a Character.AI chatbot-startupot, majd 2024-ben a Google 2,7 milliárd dolláros ügylete keretében visszatért a céghez — kifejezetten a Google reasoning modelljeinek fejlesztésére, amelyeknek azóta sem sikerült utolérni az OpenAI és az Anthropic megoldásait. ---