يعتمد المشروع البحثي على الشبكات العصبية ومعالجة الصور وإنترنت الأشياء، مستخدما قاعدة تضم 62 ألف صورة للتعرف على الإيماءات وتحويلها من فيديو مباشر.