KutatásClaude mesterséges intelligencia de novo fehérjekötőket tervezett 14 a 15 célpontraA Claude nevű mesterséges intelligencia de novo módon tervezett fehérjekötő molekulákat, és egy emberi szakértői prompt alapján autonóm módon sikeresen tervezett kötőket 14 a 15 vizsgált célpontra.1 perc olvasás
KutatásA fiatal felnőttek többsége aggódik az MI társadalmi és munkaerőhatásai miattA Pew Research Center június 22.2 perc olvasás
KutatásFüggetlen megfigyelő szerint hiányosak a nagy AI-vállalatok használati adataiAz AI Observatory nevű kutatási kezdeményezés vezetői, köztük Anka Reuel és Shayne Longpre, azt vizsgálták, hogyan használják valójában az emberek a népszerű nyelvi modelleket, például Claude-ot, ChatGPT-t, Geminit és Grokot 2023 és 2025 között.4 perc olvasás
KutatásTanulmány: az önfejlesztő AI megvalósulása lassabb lehet a vártnálA kutatás főszereplői Peter Kirgis és Sayash Kapoor vezetésével több intézet kutatói, akik azt vizsgálták, hogy ma elérhető AI-ügynökök képesek-e nyílt végű, kreatív AI-kutatást végezni.5 perc olvasás
KutatásQwen 3.8 27B meglepően magas, 52 pontos eredményt ért el az Artificial Analysis Intelligence IndexenA főszereplő a Qwen 3.8 27B nyelvi modell, amely 52 pontot ért el az Artificial Analysis Intelligence Indexen.1 perc olvasás
KutatásAz eszközhasználat nem pótolja a nagyobb nyelvi modelleketA szerző azt érvel, hogy bár az eszközhasználat (webböngészés, kódvégrehajtás) lehetővé teszi kisebb modellek, például 1 milliárd paraméteres „kognitív mag” számára sok feladat megoldását, ez nem elegendő: a gyors, természetes és megbízható válaszadáshoz belső tudásra van szükség.1 perc olvasás
KutatásQuantizációra érzékeny distillációval gyorsított Nemotron 3.5 Lightning NVFP4 modellA cikk főszereplője az NVIDIA és a Nemotron csapata, akik a Nemotron 3.5 Lightning modellt kvantálási és distillációs technikákkal optimalizálták.5 perc olvasás
KutatásMIT és Harvard: Role Anchor megakadályozza a moduláris AI rendszerek szerepmulasztásátA Massachusetts Institute of Technology és a Harvard kutatói a Role Anchor nevű technikát mutatták be, amely megakadályozza az úgynevezett „role drift” hibát többlépéses nagy nyelvi modell (LLM) csővezetékekben.6 perc olvasás
KutatásDiG-bench: új mérce az AI kreatív felfedezőképességének teszteléséreA DiG-bench (Discovery in Games) egy 70 rövid, szöveg alapú játékból álló benchmark, amelyet emberi szakértők terveztek az AI rendszerek környezetből történő, dokumentálatlan szabályok felfedezésének vizsgálatára.4 perc olvasás
KutatásOkostelefonos fotók alapján becsülik a testösszetételt és az inzulinrezisztencia kockázatátA tanulmány főszereplője a PhotoScan nevű mélytanuló keretrendszer, amely standard 2D okostelefonos képekből becsüli a testzsír százalékát, az Android‑to‑Gynoid (A/G) arányt és a Visceral‑to‑Subcutaneous (V/S) arányt.4 perc olvasás
KutatásAutonóm AI-k kimerítő tesztje: a gépek 82%-ig közelítik a kutatói rutint, de új ötletet nem szülnekA Prime Intellect jelentette be eddigi legnagyobb autonóm MI-kísérletét, amelyben 18 fejlett modell nyolc napon át elszigetelt, offline homokozókban 153 teljesen autonóm kutatási kísérletet futtatott a nanoGPT optimalizátor speedrun kihíváson.2 perc olvasás
KutatásOpenAI támogatásával 14 kutatási projekt vizsgálja az MI gazdasági és társadalmi hatásaitAz OpenAI bejelentette a korábban idén kiírt pályázat nyerteseit, amelyek 14 projektet indítanak a mesterséges intelligencia gazdasági és társadalmi hatásainak vizsgálatára és a zavarok kezelési javaslatainak kidolgozására.2 perc olvasás