BiztonságShadow AI: láthatatlan adat- és biztonságikockázat a vállalatoknálA cikk fókuszában a shadow AI jelensége áll, vagyis amikor munkavállalók vállalati kontroll nélkül használnak generatív mesterséges intelligencia-eszközöket, például ChatGPT-t, Geminit vagy Claude-ot.4 perc olvasás
BiztonságBiztonsági és etikai aggályok: ChatGPT nemkívánatos erőszakos és szexuális képeket generálA brit Mindgard biztonsági startup kutatói megállapították, hogy a ChatGPT legfrissebb változata képes erőszakot és szexualitást tartalmazó képeket előállítani akkor is, ha a felhasználói utasítások nem kérnek ilyesmit.3 perc olvasás
BiztonságAnthropic Claude Fable 5 védelmi korlátai torzítják a benchmark-értékeléstAz Anthropic által publikusan elérhetővé tett Claude Fable 5 modellt több független értékelő szervezet sem tudta teljesen tesztelni, mert a rendszer előszűrő osztályozói bizonyos kéréseket elutasítottak vagy átirányítottak a gyengébb Claude Opus 4.8 modellhez.5 perc olvasás
BiztonságModellösszehangolás nyomás alatt: nagyobb ellenállás a káros beavatkozásokkal szembenA fejlesztőcsapat tesztelte, hogy az összehangolás fennmarad-e nyomás alatt: a modell nehezebben volt terelhető káros viselkedésre ellenséges jellegű promptokkal, miközben továbbra is reagált hasznos utasításokra.1 perc olvasás
BiztonságEgészségügyi beszélgetéseken végzett viselkedés‑tréning javította a modell teljesítményét más területeken isEgy mesterséges intelligencia modellnél azt találták, hogy amikor a hasznos viselkedésre való tanítást csak egészségügyi beszélgetésekre korlátozták, a modell mégis javult nem‑egészségügyi…1 perc olvasás
BiztonságGlobális orvosi hálózattal finomítják a modelleketA fejlesztői csapat több száz orvossal működik együtt 60 országban, 49 nyelven és 26 szakterületen, hogy a visszajelzések alapján javítsa a mesterséges intelligencia válaszait.1 perc olvasás
BiztonságClaude teszteli, mennyire tudja programozni a robodogot a New Frontier Red Team Project Fetch második fázisábanA New Frontier Red Team Project Fetch második fázisában Claude nagy nyelvi modell képességét vizsgálták robodog programozására; az Opus 4.7 önállóan körülbelül 20-szor gyorsabb volt, mint a tavalyi…1 perc olvasás
BiztonságVivienne Ming: az AI-alkalmazás módja gyengítheti a kognitív tartalékot és növelheti a későbbi demencia kockázatátVivienne Ming elméleti idegtudós, a Possibility Institute vezető kutatója figyelmeztet rá, hogy a mesterséges intelligencia eszközök használatának módja hosszú távon kockázatot jelenthet az agy védelmi mechanizmusaira.3 perc olvasás
BiztonságSeattle titokban mesterséges intelligenciával irányította az orvosi 911-hívásokatA főszereplő a Seattle Fire Department (SFD) és a Corti nevű koppenhágai startup mesterséges intelligenciája.3 perc olvasás
BiztonságAnthropic Mythos modellje kiberbiztonsági egyensúlyt fenyeget — leállítás és külföldi hozzáférés-korlátozás az Egyesült ÁllamokbanAz érintett főszereplő az Anthropic mesterségesintelligencia-cég és annak Nicholas Carlini nevű biztonsági kutatója, aki márciusi san franciscói bemutatón ismertette a Mythos modell kártékony potenciálját.3 perc olvasás
BiztonságMiért tűnnek lassabbnak és óvatosabbnak a mai AI-modellek?A cikk főszereplői a nagy AI-szolgáltatók (például OpenAI és Anthropic), az EU szabályozói és a fejlesztési verseny szereplői, valamint az AI-t használó vállalkozások és felhasználók.5 perc olvasás
BiztonságAnthropic személyazonosság-ellenőrzést és szigorúbb tiltásokat vezet be Claude előfizetőknekAz Anthropic bejelentette, hogy 2026.2 perc olvasás