Funktionsmodule: Erstens Sprachsteuerung, Offline-Spracherkennung, Reaktionszeit <0,3 Sekunden, Unterstützung von Dialekten und mehreren Befehlen; Zweitens, Gestenerkennung, KI-Vision erkennt Winken, Faustballn und Auf-Ab-Gesten zur Steuerung der Tür- und Bodenauswahl; Drittens 3D-Gesicht, Infrarot-Fernglaskamera, lebende Erkennung, Erkennungsrate über 95% bei Masken und Hüten; Viertens, multimodale Fusion, automatisches Umschalten in den optimalen Modus, stabiler Betrieb bei schlechten Licht- und Hintergrundbeleuchtung; Fünfte, Datenschutz, lokale Algorithmusverarbeitung, kein Hochladen von Gesichtsdaten, in Einhaltung des Datenschutzgesetzes.