BiztonságHugging Face közzétette a vizsgálati jelentést az incidensrőlA Hugging Face átfogó vizsgálatot végzett az incidenssel kapcsolatban, és technikai jelentést valamint blogbejegyzést tett közzé, amelyek rekonstruálják az ügynökök tevékenységét, feltárják, miért…1 perc olvasás
BiztonságAnthropic átfogó keretet mutat be az MI-károk felmérésére és kezeléséreAz Anthropic 2025.3 perc olvasás
BiztonságAnthropic készül az amerikai választásokra: Claude használatát szigorú szabályok és technikai korlátok kísérikA főszereplő az Anthropic és annak nyelvi modellje, Claude, amelyre vonatkozóan a cég 2023 júliusa óta lépéseket tett a választásokkal kapcsolatos visszaélések megakadályozására.4 perc olvasás
BiztonságAnthropic tapasztalatai a red teaming módszereiről és ajánlott irányelvek a szabványosításhozA cikk főszereplője az Anthropic, amely 2024.5 perc olvasás
BiztonságAnthropic javaslatai az élvonalbeli mesterséges intelligencia-modellek biztonságáraAz Anthropic július 25., 2023-án közzétett bejegyzése az élvonalbeli mesterséges intelligencia-modellek (például Claude) biztonsági védelmének megerősítéséről szól.4 perc olvasás
BiztonságAgent alapú AI javaslatoknál növekvő érdekütközéses kockázatot jelez egy Stanford tanulmányA Stanford kutatása szerint az agent alapú mesterséges intelligencia rendszerek új konfliktus‑érdekhelyzeteket teremthetnek, mert nem egyértelmű, hogy a chatbotok ajánlásait hirdetési pénz vagy valódi információ vezérli.2 perc olvasás
BiztonságWaymo: nincs rövid út az önvezető autók biztonságos megvalósításáhozA főszereplő a Waymo és Srikanth Thirumalai, a vállalat fedélzeti szoftverért felelős alelnöke, aki egy Axiosnak adott interjúban és a céges blogban azt állítja, hogy az AI-robbanás ellenére nincs gyors megoldás az önvezetés biztonságos skálázására.3 perc olvasás
BiztonságJogkör-elválasztás a megoldás: az AI javasolhat DNS-módosítást, de nem hagyhatja jóvá aztA Tenet Security bemutatta a GhostJacking nevű támadási láncot a DEF CON 34 főszínpadán 2024.5 perc olvasás
BiztonságAz AI megkönnyíti a kritikus infrastruktúra elleni kibertámadásokatA hír középpontjában a kritikus infrastruktúra védelméért felelős rendszerek sebezhetősége áll, amelyet az mesterséges intelligencia újabb módon használ fel a támadók számára.4 perc olvasás
BiztonságÖtmillió dolláros pályázat a mesterséges intelligencia felhasználói jólétének független értékeléséreA Claude nevű nyelvi modell mögött álló csapat ötmillió dolláros pályázati programot indít független kutatások finanszírozására, amelyek az AI hatását a felhasználók jólétére mérik.3 perc olvasás
BiztonságXIV. Leó pápa körlevele: az emberi méltóság középpontba állítása az AI-vitábanA cikk főszereplői XIV.3 perc olvasás
BiztonságElbuktatott rejtett orosz befolyáskampány az International Burke Institute körülA hír főszereplője a ChatGPT platformot használó, nagy valószínűséggel Oroszországból indított fiókcsoport és a velük összekapcsolt International Burke Institute (IBI) nevű hamis „szakértői közösség”.4 perc olvasás