KutatásClaude Code sikerességének összehasonlítása foglalkozások szerintAz elemzés a Claude Code modell sikerességi arányait hasonlította össze különböző foglalkozások között; a legszigorúbb, verifikálható bizonyítékot (például commitolt kód) megkövetelő mérőszámon…1 perc olvasás
KutatásGazdasági kutatás: mérési keretrendszer a Claude Code skálázódásának követéséreA kutatást az Claude Code (AI-rendszer) skálázódásának követésére dolgozták ki; bemutatja, kik használják és milyen célra, hogyan változik a feladatok értéke, valamint milyen mértékben határozza meg a szakmai domainismeret a munkamenetek sikerét.1 perc olvasás
KutatásSzükség van új értékelési módszerekre a modellek megbízható méréséhezTejal Patwardhan, a frontier evals csapat vezetője beszélt Andrew Mayne-nel arról, hogy a hagyományos benchmarkok telítődnek vagy manipulálhatók, ezért fontos új, átfogóbb módszereket alkalmazni a modellek előrehaladásának mérésére és előrejelzésére.1 perc olvasás
KutatásGoogle és UC San Diego 2000 nyugdíjas Pixel-telefont klaszterez adatközpontnakA Google és a UC San Diego bejelentettek egy kísérleti „adatközpontot”, amely 2 000 leszerelt Pixel okostelefon alaplapjaira épül.2 perc olvasás
KutatásAI-szimuláció szerint Spanyolország a legesélyesebb a 2026-os labdarúgó‑világbajnokságonA főszereplő Achim Zeileis és az Innsbrucki Egyetem kutatócsoportja, amely a The Conversationben publikált elemzésben ismertette a 2026-os labdarúgó‑világbajnokságra készített mesterséges intelligencia alapú előrejelzését.2 perc olvasás
KutatásAI-alapú próbálkozás: egy startup megkísérli elkészíteni a GTA 6-ot a hivatalos megjelenés előttA főszereplő a Hyperecho nevű mesterségesintelligencia-startup alapítója, Hszü Ce-ven, aki egy „vibe coding” módszerrel próbálja meg lefejleszteni a Grand Theft Auto VI-ot a Rockstar Games hivatalos megjelenése előtt.2 perc olvasás
KutatásMesterséges intelligencia alapú modell a sofőrök baleseti kockázatának előrejelzéséreArab kutatók egy olyan mesterséges intelligencián alapuló modellt fejlesztenek, amely a volán mögé ülés előtt képes jelezni, mekkora a sofőr baleset okozásának valószínűsége.1 perc olvasás
KutatásAnthropic eredményei és a rekurszív önfejlesztés vitája a mesterséges intelligenciábanA főszereplő az Anthropic cég, amely a Claude nyelvi modell és a Claude Code eszköz bevezetése után azt állítja, hogy május 2026-ra a vállalat kódjának mintegy 80 százalékát Claude írta vagy társszerzős volt rajta.5 perc olvasás
KutatásÁllami média torzítja a nagy nyelvi modellek válaszait, különösen kínai nyelvenA University of Oregon, Purdue University, University of California San Diego, New York University és Princeton University kutatói, köztük Hannah Waight és Eddie Yang, azt találták, hogy a kormányokhoz kötődő állami média jelentős befolyást gyakorol a népszerű nagy nyelvi modellek (LLM) kimenetére.5 perc olvasás
KutatásMesterséges intelligencia felgyorsítja a gleccserfrontok havi nyomon követésétA kutatók a Friedrich-Alexander University (Németország) csapatával egy vezető gleccserkövető modellt tanítottak meg a calving front, vagyis a jégtörési élek leképezésére minimális új adatmennyiség mellett.3 perc olvasás
KutatásOpus wrote us a VM and then Mythos verified itOpus wrote us a VM and then Mythos verified it1 perc olvasás
KutatásClaude Fable 5 teljesítményének összehasonlítása különböző modellekkelA Claude Fable 5 nevű mesterséges intelligencia-modell összehasonlítása különböző modellekkel mutatja be teljesítmény- és viselkedéskülönbségeit; az elemzés segít a fejlesztőknek és felhasználóknak a…1 perc olvasás