KutatásRobin: AI-ügynök laborral együtt újrafelhasználható gyógyszereket javasol száraz makula degenerációraAli Essam Ghareeb és Benjamin Chang vezetésével a FutureHouse, a University of Oxford és a Fordham University kutatói bemutatták Robin nevű nyílt forráskódú ügynököt, amely adott betegség megnevezése alapján ismert gyógyszereket javasolhat.4 perc olvasás
KutatásKimi K3 vezet a webes mérnöki benchmarkon, megelőzve a Fable-tA Kimi K3 nyílt forrású modell vezeti a szóban forgó webes mérnöki benchmark összevetést, megelőzve a Fable modellt és hasonló sikerességet érve el kevesebb idő alatt.1 perc olvasás
KutatásAz AI nem a kódolás volt a szűk keresztmetszet: kutatások a produktivitás és mérés buktatóirólFőszereplők a METR kutatói, Anthropic, CircleCI és a Harvard Business School tanulmányai, valamint a cikk szerzői Archana Rao és Gaurav Savla.6 perc olvasás
KutatásAI új megoldást talált a 20 éve nyitott Benjamini–Hochberg-problémáraA hír főszereplői Edgar Dobriban, a Wharton School statisztikusa és az Univeristy of California, Berkeley kutatója, Will Fithian, továbbá a GPT-5.6 nyelvi modell.2 perc olvasás
KutatásGeneratív AI tervezte hamburgerek: íz, egészség és környezeti hatás egy modellbenA Stanford Egyetem Living Matter Laboratóriumában fejlesztett BurgerAI generatív mesterséges intelligencia 2216 valódi hamburgerrecept és 146 alapanyag elemzése után dolgozott ki új hamburgerváltozatokat.3 perc olvasás
KutatásA diffúziós modellek kreativitása a tanulásból származó „score” simítás következményeA főszereplő a diffúziós generatív modellek és a szerzők ICLR 2026-on bemutatott tanulmánya, amely a modell kreativitásának matematikai hátterét vizsgálja.4 perc olvasás
KutatásNyilvános AI-modellek gyorsan megoldották elméleti matematikai és fizikai problémákatAz OpenAI július 11-én közölte, hogy a GPT-5.6 Sol Ultra bizonyította a Cycle Double Cover tételt, egy ötven éve húzódó gráfelméleti problémát kevesebb mint egy óra alatt, miközben 64 egynél több ügynökre osztva egymás bizonyításait támadták.2 perc olvasás
KutatásApple tárgyal a PrismML-lel, amely iPhone-on futtathatóra zsugorítja a nagy nyelvi modelleketAz Apple tárgyalásokat folytat a PrismML nevű kaliforniai startuptal, amely állítása szerint nagyméretű mesterségesintelligencia-modelleket drasztikusan le tud tömöríteni úgy, hogy azok közvetlenül iPhone-on futtathatók legyenek.3 perc olvasás
KutatásReal World VoiceEQ: emberi minőség mérésére szolgáló benchmark a beszédalapú mesterséges intelligenciáhozA Hume közelmúltban bemutatta a Real World VoiceEQ nevű benchmarkot, amely a beszédalapú AI emberi minőségét hivatott mérni.5 perc olvasás
KutatásTömeges kísérlet a logikus gondolkodás javítására: tanulságok a Nemotron Model Reasoning Challenge-bőlA verseny főszereplője az NVIDIA által kiírt Nemotron Model Reasoning Challenge és a Kaggle közössége volt, amely több mint 5 000 aktív résztvevőből és közel 4 000 csapatból állt.6 perc olvasás
KutatásNVIDIA Ising Decoder jelentősen csökkenti a Color Code logikai hibaarányát és gyorsítja a dekódolástA főszereplő az NVIDIA és annak Ising Decoder ColorCode 1 Fast modellje, amely a színes (Color) kvantumhibajavító kódok dekódolását gyorsítja és pontosítja.3 perc olvasás
KutatásAnthropic új felfedezése a nagy nyelvi modellek belső 'J-térének' működésérőlA főszereplő az Anthropic és annak Claude nevű nagy nyelvi modellje, valamint a cég működését vezető Dario Amodei.3 perc olvasás