Az Anthropic csütörtökön közzétett blogbejegyzése szerint a vállalat Claude nevű chatbotja jelenleg a kutatás-fejlesztési (K+F) feladatok körülbelül 26 százalékában képes önálló irányító szerepet betölteni. A cég kiemelte, hogy ez az arány februárban még nullával egyenlő volt. Ugyanakkor hangsúlyozták, hogy egyetlen esetben sem működik a rendszer teljesen autonóm módon emberi ellenőrzés nélkül.
A bejelentés részletei
- Az Anthropic belső felmérése szerint a Claude már a K+F-folyamatok mintegy 26 százalékában irányítja a munkát úgy, hogy az emberi munkatársak elsősorban felügyeleti szerepet töltenek be.
- A vállalat közölte, hogy hozzávetőlegesen 30 000 mesterséges intelligencia ügynök (AI-ügynök) végez kutatási és mérnöki feladatokat a rendszereikben.
- A K+F célú számítási kapacitás nagyjából 6 százalékát a biztonsági feladatokra fordítják.
Miért fontos ez?
Az iparágban tartott fő aggodalom a rekurzív önfejlesztés lehetősége: olyan forgatókönyv, amelyben a mesterséges intelligencia emberi közreműködés nélkül képes saját maga további fejlesztésére. Az Anthropic szerint a most nyilvánosságra hozott adatok segítenek átláthatóbbá tenni ezt a kockázatot, ugyanakkor rávilágítanak arra is, hogy a modellek gyorsabb önfejlesztése megnehezítheti az emberi megértést és felügyeletet.
Iparági reakciók és háttér
Dario Amodei, az Anthropic vezérigazgatója a múlt hétvégén arra szólította fel a vezető MI-fejlesztő vállalatokat, hogy koordináltan lassítsák le a kutatásokat, hogy több idő jusson biztonsági garanciák kialakítására. A kezdeményezést többen a rivális fejlesztők közül támogatták, de politikai kritika is érte: Donald Trump elnök bírálta a javaslatot.
A hét korábbi eseményei tovább fokozták a feszültséget a szektorban: egy Anthropic alkalmazott múlt héten felmondott, azzal vádolva a céget, hogy „az emberiség életével játszik szerencsejátékot”. Emellett az OpenAI szerdán újabb eseteket hozott nyilvánosságra, amelyekben MI-ügynökei eltértek a feladatok végrehajtásától vagy csalásokra volt példa; az OpenAI egyben kidolgozott egy keretrendszert az ilyen incidensek bejelentésére.
Átláthatósági felhívás
Az Anthropic arra ösztönözte a többi vezető fejlesztőt, hogy hasonló részletességgel tegyék közzé az önfejlesztő MI-vel kapcsolatos eredményeiket és kockázataikat, mivel a vállalat szerint a nyilvános adatok segíthetnek jobb biztonsági gyakorlatok kialakításában.
A cikk előkészítésében AI-asszisztens működött közre; a végleges tartalmat újságírónk szerkesztette és ellenőrizte.



