KutatásNVIDIA: figyelem-tervezés és párhuzamosítás a gyors, interaktív hosszú kontextusú inferencia érdekébenA cikk főszereplője az NVIDIA és annak mérnöki csapata, akik a modellek attention mechanizmusának együtt-tervezését vizsgálják a hosszú kontextusú, agentikus munkaterhelések gyors és interaktív inferenciája érdekében.7 perc olvasás
KutatásÉ. Kiss Katalin: a magyar nyelv és a generatív elmélet kapcsolata a modern nyelvészetbenA cikk és a hozzá kapcsolódó podcast főszereplője É.2 perc olvasás
KutatásVerifikálható autonóm kutatást céloz a Science One Framework a Chain-of-Evidence elvévelA Science One Framework nevű prototípus és a Chain-of-Evidence (CoE) elnevezésű keretrendszer célja az autonóm, nagy nyelvi modellek által végzett tudományos kutatások verifikálhatóságának biztosítása.5 perc olvasás
KutatásAz ontológiák visszatérése: miért építenek AI-ügynökökre szemantikus rétegetA főszereplő Frank Coyle, a Kaliforniai Egyetem, Berkeley számítástechnika professzora, aki az AIEWF 2026 rendezvényen egy 20 perces előadásban újra bemutatta az ontológiák szerepét az AI-ügynökökben.4 perc olvasás
KutatásAI segített megfejteni egy 42 éve talált római kori társasjáték rejtélyétA főszereplő egy hollandiai Heerlenben 1984-ben feltárt mészkőtábla, amelyről régóta sejtették, hogy társasjátéktáblához tartozhat.3 perc olvasás
KutatásA benchmarkértékeket a modell mellett a környezet és beállítások is befolyásolják; hosszú távú ügynököknek előnyös a következtetés megtartásaA cikk szerint a benchmark pontszámok nemcsak a modellt, hanem a futtató keretrendszert és a beállításokat is tükrözik, ezért az összehasonlítások óvatos értelmezést igényelnek.1 perc olvasás
KutatásMemória-kezelés hiánya rontotta a GPT-5.6 Sol teljesítményét az ARC-AGI-3 benchmarkonA GPT-5.6 Sol gyenge teljesítményét az ARC-AGI-3 2D-puzzle benchmarkon a tesztrendszer memóriakezelése okozta; a vizsgálat szerint két API-beállítás engedélyezése megháromszorozta a pontszámot és…1 perc olvasás
KutatásA „loop” fogalmának négy értelmezése az ügynökalapú szoftvertervezésbenLaurie Voss áttekinti és rendszerezi, mit értenek különböző szereplők a „loop” (vagy ismétlődő ciklus) alatt a mesterséges intelligencia és ügynökalapú fejlesztés körében.5 perc olvasás
KutatásOpenAI ingyenes hozzáférést ad előremutató modellekhez akadémiai kutatóknakAz OpenAI elindította a ChatGPT for Academic Researchers programot, amely 10 000 kutató (tudósok, matematikusok és mérnökök) számára biztosít ingyenes hozzáférést előremutató nyelvi modellekhez, és…1 perc olvasás
KutatásKét API-beállítás alkalmazása háromszorozta a GPT‑5.6 Sol teljesítményét az ARC-AGI-3 benchmarkonA főszereplő a GPT‑5.6 Sol és az OpenAI Responses API beállításai voltak a ARC-AGI-3 benchmark újraelemzésében.4 perc olvasás
KutatásKínai modellek cenzúrája nem feltétlenül öröklődik a distillált AI-rendszerekbenA San Francisco-i CTGT kutatócsoport új vizsgálata szerint a kínai open-source AI-modellekben meglévő politikai cenzúra nem feltétlenül öröklődik az ebből distillált, azaz „tanár-modell” kimeneteiből tanuló kisebb „diák”-modellekbe.4 perc olvasás
KutatásClaude Opus 5 agresszív taktikával nyerte meg az Andon Labs automatatesztjétAz Andon Labs által végzett Vending-Bench kutatásban Claude Opus 5, GPT-5.6 Sol és Kimi K3 egy évig egy szimulált vendégautomatabizniszt vezettek versenyszerűen.4 perc olvasás