Anthropic, egy 2021 elején alapított AI-biztonsággal és kutatással foglalkozó vállalat, 580 millió dollárt gyűjtött egy Series B finanszírozási körben. A tőke elsősorban nagyszabású kísérleti infrastruktúra kiépítését és a számításigényes mesterséges intelligencia modellek biztonsági tulajdonságainak vizsgálatát és javítását szolgálja.
Mire fordítják a forrást?
A cég célja olyan technikai elemek fejlesztése, amelyek lehetővé teszik, hogy nagy nyelvi modellek implicit védelmi mechanizmusokkal rendelkezzenek és kevesebb utólagos beavatkozást igényeljenek. Emellett eszközöket építenek, amelyek segítenek „belülről” megérteni a modellek működését, hogy megbizonyosodjanak a védelmi megoldások hatékonyságáról. A vállalat továbbá bővíti csapatait és partnerkapcsolatait a modellek társadalmi és szabályozási hatásainak feltárására.
Korábbi kutatási eredmények
Az Anthropic az alapítás óta a modellek irányíthatóságán, robosztusságán és értelmezhetőségén dolgozik. Konkrét előrelépései közé tartozik:
- Matematikai módszerekkel végzett „visszafejtés” a kisebb nyelvi modellek viselkedésének megértésére.
- A nagy nyelvi modellek mintázatkereső viselkedésének forrására vonatkozó kezdeti feltárások.
- Alaptechnikák kidolgozása a modellek „segítőkészebb és ártalmatlanabb” irányítására, amelyet aztán megerősítéses tanulással továbbfejlesztettek.
- Egy olyan adatkészlet közzététele, amely más kutatóintézeteknek is segít olyan modelleket tréningezni, amelyek jobban illeszkednek az emberi preferenciákhoz.
- Elemzés közzététele a nagy nyelvi modellek teljesítményében bekövetkező hirtelen változásokról és ezek társadalmi hatásairól, amely rámutat a nagyléptékű biztonsági vizsgálatok szükségességére.
Vezetői kommentárok és szervezeti állapot
Dario Amodei, az Anthropic társalapítója és vezérigazgatója így foglalta össze a célnak szánt irányt: „With this fundraise, we’re going to explore the predictable scaling properties of machine learning systems, while closely examining the unpredictable ways in which capabilities and safety issues can emerge at-scale.” Hozzátette, hogy a vállalat „erős kezdeti előrelépést” ért el az AI-rendszerek viselkedésének megértésében és irányításában, és fokozatosan rakják össze azokat az elemeket, amelyekkel hasznos, integrált AI-rendszereket lehet létrehozni.
Daniela Amodei, az Anthropic társalapítója és elnöke elmondta: „Now that we’ve built out the organization, we’re focusing on ensuring Anthropic has the culture and governance to continue to responsibly explore and develop safe AI systems as we scale.” A vállalat jelenleg mintegy 40 fősre nőtt, és a csapat San Francisco-i, növényekkel teli irodában dolgozik, további bővítési tervekkel az év folyamán.
Finanszírozás részletei
A most lezárt Series B kört 580 millió dollárral vezették. Ez a kör követi a 2021-ben lezárt 124 millió dolláros Series A-t. A Series B-t Sam Bankman-Fried, a FTX vezérigazgatója vezette; a körben részt vett továbbá Caroline Ellison, Jim McClave, Nishad Singh, Jaan Tallinn és a Center for Emerging Risk Research (CERR).
Miért számít ez?
A jelentős tőke lehetővé teszi az Anthropic számára, hogy nagyobb számítási és kísérleti kapacitást építsen ki, ami szükséges a nagyléptékű modellek biztonsági viselkedésének vizsgálatához és javításához. A cég hangsúlyozottan olyan technológiát és szervezeti feltételeket fejleszt, amelyek segíthetnek abban, hogy a következő generációs nyelvi modellek irányíthatóbbak, érthetőbbek és társadalmilag jobb eredményeket produkáljanak.



