WebBrain: nyílt forrású böngészőügynök
A WebBrain egy nyílt forrású, helyben futó AI-böngészőügynök Chrome-hoz és Firefoxhoz, amely úgy olvas oldalakat és automatizál feladatokat, hogy közben egyetlen adat sem hagyja el a gépet.
A WebBrain egy nyílt forrású, helyben futó AI-böngészőügynök Chrome-hoz és Firefoxhoz, amely úgy olvas oldalakat és automatizál feladatokat, hogy közben egyetlen adat sem hagyja el a gépet.
Az Anthropic bemutatta a Claude Science alkalmazást, amely a kutatók számára készült, több mint 60 tudományos adatbázissal, natív tudományos vizualizációval és a Claude Opus 4.8 modell erejével.
A Google natívan beépítette a számítógép-vezérlést a Gemini 3.5 Flash modellbe: egyetlen ágens képes böngészőn, mobilon és asztali gépen is látni, gondolkodni és cselekedni.
Az Anthropic kiadta a Claude Sonnet 5 modellt, amely közel Opus-szintű teljesítményt nyújt lényegesen alacsonyabb áron, kifejezetten az autonóm AI-ágensek költséghatékony futtatására.
A Google bemutatta a Nano Banana 2 Lite modellt, amely körülbelül négy másodperc alatt, 1000 képenként mindössze 0,034 dollárért készít képeket – a nagy volumenű, gyors munkafolyamatokra hegyezve.
Az OpenAI korlátozott előzetesben mutatta be a GPT-5.6 Sol, Terra és Luna modelleket, amelyeket egyelőre csak mintegy húsz, az amerikai kormány által jóváhagyott partner érhet el.
A Google megkezdte a Gemini 3.5 Pro bevezetését a Vertex AI vállalati ügyfeleinek: kétmillió tokenes kontextus és Deep Think gondolkodási mód jellemzi, általános elérhetősége júniusra várható.
Az OpenAI gyakorlati útmutatót adott ki, amely megmutatja, hogyan használható a Codex tartós munkafelületként: a kulcs a feladatok lebontása ellenőrizhető lépésekre és a folyamatos kontextus megőrzése.
Az OpenAI kibővítette Daybreak kiberbiztonsági programját egy erősebb GPT-5.5-Cyber modellel, a Codex Security bővítménnyel és a nyílt forráskódot foltozó Patch the Planet kezdeményezéssel.
A Z.ai (korábban Zhipu) MIT-licenc alatt nyílttá tette GLM-5.2 modelljét, amely kódolásban megelőzi a GPT-5.5-öt, és egymillió tokenes kontextusablakkal érkezik.
Az xAI új videógeneráló modellje gyorsabb, és jobb hangot, mozgást ad.
Az Anthropic bemutatja a Claude Fable 5-öt – a Mythos modell első nyilvánosan elérhető verzióját –, és a korlátozott hozzáférésű Mythos 5-öt, amelyek együtt egy teljesen új képességi szintet képviselnek.
A Luma bemutatta a Ray3.2 modellt és API-t, amely kockánként irányítható, profi minőségű AI-videógenerálást kínál.
Az OpenAI elindítja a Dreaming V3 architektúrát: a ChatGPT mostantól automatikusan, háttérben szintetizálja az összes korábbi beszélgetést, és önállóan frissíti az emlékeit.
A Google DeepMind nyílt Gemma 4 12B modellje 16 GB memóriájú laptopon is helyben fut, natív hang- és képfeldolgozással, encoder nélküli új architektúrával.
A Microsoft Build 2026-on hét házilagos MAI-modellt mutatott be – szövegtől képen és hangon át átírásig –, hogy csökkentse az OpenAI-tól való függőségét.
A Majorana 2 nevű kvantumchip kvbitjei akár egy percig is megtartják állapotukat a korábbi ezredmásodperces értékek helyett, és a Microsoft szerint ez 2029-re elérhetővé tehet egy hasznosítható kvantumszámítógépet.
A sanghaji MiniMax kiadta nyílt súlyú M3 modelljét, amely több kulcsmércén megelőzi a GPT-5.5-öt és a Gemini 3.1 Prót – a költségek mindössze töredékéért.
Az Anthropic rekordsebességgel adta ki Opus modelljének új verzióját, amely jobb ítélőképességgel, olcsóbb gyors móddal és egy új 'dinamikus munkafolyamat' funkcióval érkezett.
A Google I/O 2026 legnagyobb bejelentése a Gemini Omni, amely szöveget, képet, hangot és videót egyszerre tud felhasználni, valamint a Gemini 3.5 Flash, az új ügynöki és kódolási modell.
Az Alibaba Qwen 3.7 Max nevű modellje egy GPU-kód optimalizálásán dolgozott majdnem két napig, több mint ezer egymást követő lépésben, és a végén tízszeres sebességnövekedést ért el.
A Pika bemutatta a PikaStream1.0-t, amely lehetővé teszi, hogy bármely AI-ágensssel élő videóhívást folytassunk – mindössze 1,5 másodperces késleltetéssel, egyetlen GPU-n.
Az ElevenLabs új Lip Sync eszköze fotókat alakít beszélő videókká AI hang és szájmozgás-szinkronizálás segítségével.
A Luma új Concepts technológiája pár példából tanulja meg és kombinálja a kameramozgásokat a Ray2 videógeneráló modellben.