Das Ziel von Emo bestand darin, das zu erreichen, was Forscher als „Koexpression“ bezeichnen, also die gleichzeitige Nachahmung des Gesichtsausdrucks eines menschlichen Gesprächspartners. Um dies zu erreichen, entwickelten die Forscher einen Vorhersagealgorithmus, der anhand eines großen Videodatensatzes von Menschen trainiert wurde, die Gesichtsausdrücke machen. Die Forscher Die Forscher behaupten, dass der von ihnen entwickelte Algorithmus in der Lage sei, „auf Grundlage anfänglicher und subtiler Veränderungen in seinem Gesicht den Zielausdruck einer Person vorherzusagen, den sie zeigen wird“. Der Algorithmus teilt der Hardware des Roboters dann in „Echtzeit“ mit, welche Gesichtskonfiguration nachgeahmt werden soll, sagen die Forscher.