A Google DeepMind beépített egy jelnyelvi szövegátalakító módot, SL2T néven, a Gboard és a Live Transcribe alkalmazásokba a Pixel 11 készüléken. A szolgáltatás kezdetben az amerikai jelnyelv (ASL) és az angol közti átalakítást támogatja: a felhasználó a telefon kamerája felé jelel, és az eszköz valós időben szöveggé alakítja a jelzéseket ott, ahol általában beírnánk valamit — például keresősávban, üzenetben vagy egy Gemini-parancs mezőjében.
Hogyan működik és miben új
A SL2T úgy viselkedik, mint a hangalapú diktálás: a bemenetet a készülék kamerája fogadja, és a rendszer valós időben írja át a jeleket szöveggé. A Google DeepMind elmondása szerint a modellt több mint 100 000 óra jelnyelvi anyagon képezték, amely több mint 50 különböző jelnyelvet fed le. A hangsúly azon van, hogy a rendszer a jelelést teljes nyelvként kezeli — nem csupán gesztusok dekódolásaként —, ami a korábbi, például jelkesztyűkre épülő megoldásoknál gyakran volt probléma.
Elérhetőség és korlátozások
Jelenleg a SL2T funkció ASL-ről angolra korlátozódik, és egyelőre csak a Pixel 11 készüléken érhető el. A bevezetés tehát kezdeti céllal és szűkített támogatással történt; a Google DeepMind nem adott részletes menetrendet a további kibővítésekre vagy más eszközökre való kiterjesztésre vonatkozóan.
Miért számít ez
Az inputmódok implicit módon meghatározzák az „átlagfelhasználót”: a billentyűzetek azt feltételezik, hogy valaki gépelni tud, a hangalapú asszisztensek pedig azt, hogy beszélni és hallhatóan kimondani a kérést. Hosszú ideje nagyjából 70 millió siket vagy nagyothalló ember számára a jelnyelv használata nem számított natív bemeneti módnak, ezért sokan második nyelvként írást vagy beszédet kényszerültek használni. A SL2T bevezetése ehelyett a jelelésnek elsőrendű, natív bemeneti lehetőséget ad a telefonok számára, azaz a készülékek az eddig feltételezett képességek listáját kiterjesztik.
Összegzés
A Google lényegében nem egy új hardverproblémát oldott meg — a kamera már korábban is rendelkezésre állt —, hanem azt a történelmi feltételezést kérdőjelezi meg, hogy a felhasználók elsősorban gépelnek vagy beszélnek. A SL2T a jelelés befogadásával egy közösséget tesz láthatóbbá a digitális interfészek számára, még ha a funkció jelenleg csak ASL és egyetlen eszköz esetén érhető el.



