SignGemma: když umělá inteligence začíná rozumět rukám, pohybu i prostoru

SignGemma – AI, která rozumí znakovému jazyku
Jedním z nejvýznamnějších kroků v oblasti vizuálně-gestikulární komunikace je nový model společnosti Google s názvem SignGemma. Jde o dosud nejpokročilejší systém umělé inteligence zaměřený na porozumění znakových jazyků, který posouvá hranice mezi lidským pohybem a digitálním světem.
„SignGemma jako symbol nové komunikační éry”
SignGemma není jen překladač znaků. Je to model, který analyzuje celé tělo jako nositele významu — tvar rukou, orientaci dlaní, dynamiku pohybu, mimiku i prostorovou gramatiku. Jinými slovy: pracuje přesně s tím, co označujeme jako chytrou řeč těla.
Primárně je model trénován na americký znakový jazyk (ASL) s překladem do angličtiny, avšak jeho architektura je otevřená pro učení dalších znakových jazyků. To je zásadní. Znamená to, že nejde o uzavřený systém pro jednu komunitu, ale o základ pro globální jazykovou inkluzi. Google již oznámil plánované rozšíření na britský znakový jazyk (BSL) a do budoucna se očekává zapojení dalších národních znakových jazyků.
Foto: Google
Technologický význam SignGemma spočívá ve třech rovinách:
- AI konečně chápe vizuální jazyk, nikoli jen text nebo zvuk.
- Vzniká most mezi Neslyšící komunitou a digitálními technologiemi v reálném čase.
- Vývojáři získávají otevřený nástroj pro tvorbu inkluzivních aplikací, vzdělávání i médií.
Pro oblast komunikace je to podobně zásadní moment, jako byl vznik hlasových asistentů pro slyšící svět. Poprvé se totiž objevuje model, který bere znakový jazyk jako plnohodnotný jazykový systém, nikoli jako doplněk nebo experiment.
SignGemma tak představuje budoucnost, kde kamera není jen nástroj pro snímání obrazu, ale stává se senzorem lidské řeči těla — řeči, která byla po staletí přehlížena technologiemi.
Podle článku na internetu
Zdroj: Google
Publikováno na: 18. ledna 2025
Optimalizace: Tomáš Wirth