ModellbevezetésAlibaba bemutatja a Qwen 3.7-Max modellt az ügynökökre optimalizált, hosszú távú munkamenetekhezAz Alibaba Qwen Team bemutatta a Qwen 3.7-Max modellt, amelyet kifejezetten az ügynökök korszakára terveztek, és amely képes teljesen autonóm, hosszú futású feladatokra.3 perc olvasás
ModellbevezetésThinking Machines Lab bemutatja a valós idejű, párhuzamos multimodális interakcióra alkalmas TML-Interaction-Small modelltA főszereplő a Thinking Machines Lab startup és annak TML-Interaction-Small nevű multimodális rendszere, amely egyszerre dolgoz fel hangot, videót és szöveget, majd párhuzamosan ad visszajelzést.4 perc olvasás
ModellbevezetésA Google átalakítja a keresést, munkát és vásárlást állandóan aktív AI-ügynökökkel és egységesített kereskedelmi protokollokkalA Google a 2026-os I/O fejlesztői konferencián bemutatta a kereső 25 éves történetének meghatározó átalakítását, amely a linklisták helyett összegzett válaszokat és multimodális bemenetek (szöveg, kép, videó, böngészőlapok, dokumentumok) feldolgozását kínálja.5 perc olvasás
ModellbevezetésA Google 25 év után átalakítja a keresést a Gemini 3.5 Flash mesterséges intelligenciávalA Google a kaliforniai Mountain View-ban tartott Google I/O konferencián bejelentette a Search szolgáltatásának eddigi legnagyobb, 25 évre visszanyúló frissítését.3 perc olvasás
ModellbevezetésSpaceXAI-val közösen tízszer több számítással új, jelentősen nagyobb modellt építenekSpaceXAI és a közlemény szerzői bejelentették, hogy egy teljesen új, jelentősen nagyobb nyelvi modellt tanítanak írtól kezdve, tízszer több összes számítást felhasználva.1 perc olvasás
ModellbevezetésMegjelent a Composer 2.5: továbbfejlesztett nyelvi modell hosszú feladatokraA fejlesztő bemutatta a Composer 2.5 modellt, amely intelligensebb, jobban kezeli a hosszú futamidejű feladatokat és megbízhatóbban követi a bonyolult utasításokat.1 perc olvasás
ModellbevezetésOpenAI bemutatja a GPT-Realtime-2 hang–hang modellt a sebesség és a következtetés szabályozásávalAz OpenAI frissítette Realtime API-ját, és bemutatta a GPT-Realtime-2, GPT-Realtime-Translate és GPT-Realtime-Whisper modelleket, amelyek hangalapú feldolgozást céloznak.4 perc olvasás
ModellbevezetésGemini Intelligence: elsőként várhatóan Samsung összehajtható és Google Pixel készülékeken debütálA Google a keddi Android Show: I/O Edition eseményén mutatta be a Gemini Intelligence nevű mesterségesintelligencia-asszisztenst.2 perc olvasás
ModellbevezetésOpenAI és Thinking Machines formálják újra az ember-gép felületet: a billentyűzet és a prompt doboz kihívásaAz OpenAI és a Thinking Machines legújabb modelljei a felhasználói felületek átalakulását célozzák meg.2 perc olvasás
ModellbevezetésVoxtral TTS: természetes hangzásban felülmúlja az ElevenLabs Flash v2.5-öt, v3-minőség érzelemvezérlésselA főszereplő a Voxtral TTS beszédszintetizátor, amelyről az értesítés szerint emberi értékelésekben természetességben jobb teljesítményt nyújt, mint az ElevenLabs Flash v2.5, és megfelel az ElevenLabs v3 minőségének érzelemvezérlés mellett.3 perc olvasás
ModellbevezetésThinking Machines Lab bemutatja az első valós idejű interakciós modelltA Thinking Machines Lab vezetésével Mira Murati, a volt OpenAI műszaki igazgató bemutatta a szervezet első valós idejű Interaction Modeljét, amely 18 hónapos fejlesztés eredménye.2 perc olvasás
ModellbevezetésGemini Omni kiszivárgás: Google áttörés a videószöveg stabilitásábanA kiszivárgott Gemini Omni bemutató szerint a Google egy natív videómodellt és chat-alapú szerkesztő funkciókat fejleszt.2 perc olvasás