KutatásRoboReward: általános látás‑nyelv jutalmazási modellek robotokhozA cikk főszereplői Tony Lee, Andrew Wagenmaker, Karl Pertsch és munkatársaik a Stanford University és a University of California, Berkeley kutatócsoportja.4 perc olvasás
KutatásAz Alibaba SkillWeaver keretrendszere célzott eszközválasztással csökkenti a tokenhasználatot és javítja a többlépéses műveletek pontosságátAz Alibaba kutatói által fejlesztett SkillWeaver egy olyan keretrendszer, amely végrehajtási gráfot készít egy összetett feladathoz és kiválasztja a megfelelő készségeket (skill) a gráf egyes csomópontjaihoz.4 perc olvasás
KutatásClaude Fable 5 összehasonlítása más mesterséges intelligencia-modellekkelAz Anthropic Claude Fable 5 modelljének összehasonlítását mutatják be más AI-modellekkel; a vizsgálat a teljesítmény-, képesség- és alkalmazhatósági különbségekre fókuszál.1 perc olvasás
KutatásGenesis Molecular AI: PEARL modelje áttörést ért el fehérje–ligandum szerkezetpredikcióbanA főszereplő a Genesis Molecular AI és vezető kutatói, Evan Feinberg és Sergey Edunov, akik a PEARL nevű modelljük fejlesztéséről beszélnek.4 perc olvasás
KutatásVideó készült az OpenAI modellek hatékonyságáról és a Sonnet 5 hiányosságairólEgy tartalomkészítő videót forgatott arról, miért olyan hatékonyak az OpenAI modellek, kiemelve, hogy a Sonnet 5 komoly hatékonysági hiányosságokkal rendelkezik.1 perc olvasás
KutatásAz ügynökök kora: a chatbotos munkavégzés leváltása és a gyorsuló AI-képességekA főszereplők az Anthropic, OpenAI és Google valamint a kínai nyílt súlyú modelleket készítő csoportok; a cikk az AI-képességek gyorsuló fejlődését elemzi.5 perc olvasás
KutatásGeneBench-Pro: kutatási benchmark az összetett biológiai adatok kezeléséreA GeneBench-Pro egy kutatási szintű benchmark, amely azt méri, hogyan teljesítenek AI-ügynökök összetett biológiai adatok kezelésében, a helyes elemzési út kiválasztásában és a kutatásban szükséges ítéletalkotásban.1 perc olvasás
KutatásGoogle Research bővíti hőtűrőképességi adatait 50+ városra, hogy épülethatású hűtőtetőket célozzon megA Google Research új, nagyfelbontású épülethatású albedó (tetővisszaverő képesség) adatkészletet és a Heat Resilience Earth Engine App alkalmazást tette elérhetővé több mint 50 globális város számára.4 perc olvasás
KutatásMeta nem-invazív AI-rendszere gépelhető mondatokat dekódol agyi aktivitásbólA főszereplő a Meta vállalat és új modellje, a Brain2Qwerty v2, amely nem-invazív módon, sebészeti beavatkozás nélkül dekódolja a gépeléssel egyező mondatokat agyi aktivitás alapján.2 perc olvasás
KutatásÚj felismerési módszerrel azonosíthatók az AI által generált arcokAz Ausztrál Nemzeti Egyetem kutatói a Proceedings of the National Academy of Sciences folyóiratban bemutatott tanulmányukban egy új módszert írnak le, amellyel jelentősen javítható az emberi és a mesterséges intelligencia által generált arcok megkülönböztetése.3 perc olvasás
KutatásGeneBench-Pro: kutatási szintű benchmark a döntésközpontú számítási biológiai elemzésekhezA GeneBench-Pro egy kutatási szintű teljesítménymérés, amely azt vizsgálja, hogy az AI-ügynökök hogyan kezelik a bizonytalanságot és hoznak következményes döntéseket számítási biológiai feladatokban.6 perc olvasás