WIREFACE

Relatório Técnico: Corporificação Multivista para Entidades Artificiais

Arquitetura experimental para identidade, voz, movimento, presença espacial e observabilidade
Desenvolvida em colaboração por Prof. Luiz Velho (Laboratório VISGRAF, IMPA) e Matteo Moriconi (VFXRio).

WireFace: corporificação multivista para entidades artificiais, apresentada por três cabeças cranianas em wireframe.

Resumo Técnico

WireFace é um protótipo de pesquisa para estudar como uma entidade artificial pode manter identidade e coerência temporal ao se manifestar por voz, movimento e presença espacial.

A interface apresenta três cabeças abstratas em wireframe como vistas simultâneas da mesma entidade. As vistas compartilham resposta, voz, estado e dados de performance; não representam três entidades independentes. Essa configuração torna observáveis a conectividade, a latência, a sincronização, a expressão e a continuidade entre mensagens.

Escopo do experimento. O sistema instrumenta o percurso entre a recepção de uma resposta e sua manifestação audiovisual. A arquitetura foi concebida para comparar componentes e estudar formas digitais, holográficas, volumétricas, robóticas, projetadas ou instalativas. As aplicações descritas neste relatório são possibilidades técnicas; não constituem, por si só, validação de campo.

Pesquisa colaborativa: Prof. Luiz Velho — Laboratório VISGRAF, IMPA
Matteo Moriconi — VFXRio

Questão de Pesquisa e Hipótese Operacional

A questão central é se uma única entidade pode conservar identidade, contexto e continuidade perceptiva quando sua resposta atravessa diferentes canais e pontos de vista.

A hipótese operacional é que a corporificação faz parte da saída comunicativa. Voz, orientação, movimento, ritmo e estado visual influenciam a leitura da resposta e precisam ser tratados como componentes sincronizados, rastreáveis e mensuráveis.

WireFace torna essa transição observável ao registrar quando cada etapa começa e termina, como o estado persiste entre mensagens e onde atrasos, falhas ou desvios de sincronização alteram a manifestação.

Estado do sistema WireFace com telemetria de voz, emoção, intensidade, latência, sincronização e resposta multivista.

Arquitetura e Integração com MMSW

MMSW (Multicasting Multimodal Story Worlds) é o ambiente de orquestração em tempo real conectado ao WireFace.

O MMSW coordena entidades artificiais, participantes humanos e interfaces externas dentro de um ambiente multimodal compartilhado. Ele organiza identidade, contexto, memória, turnos de fala, eventos e destinos de saída. O WireFace atua como uma camada de corporificação e observação: recebe uma resposta identificada, prepara sua performance e apresenta o resultado em vistas sincronizadas.

UID, sessão e identificador de mensagem preservam a origem do evento ao longo do fluxo. Essa separação entre orquestração, emissão, síntese e visualização permite localizar falhas, comparar componentes e conectar novas formas de presença sem alterar todo o sistema.

Arquitetura do WireFace mostrando o fluxo MMSW, emissor, camada de performance, ElevenLabs e resposta craniana multivista.

Fluxo Operacional

O MMSW recebe ou produz um evento associado a uma entidade e conserva seus identificadores. O emissor seleciona o destino configurado e entrega o conteúdo ao WireFace. A camada de performance transforma os parâmetros disponíveis em ritmo, intensidade e temporização; a síntese gera a voz; e a interface distribui o mesmo estado para as vistas visuais. A telemetria registra o resultado de cada etapa.

Entidade no MMSW → evento identificado → emissor → camada de performance → síntese de voz → sincronização multivista → telemetria

A modularidade permite medir, substituir ou comparar componentes. Ela também separa a resposta semântica de sua execução audiovisual, o que facilita testes controlados e integração com outras formas de corporificação.

Presença multivista do WireFace apresentada simultaneamente em vistas frontal e laterais.

Modelo Multivista

As três cabeças funcionam como canais diagnósticos da mesma performance. Elas compartilham identidade, estado, áudio e referência temporal, enquanto cada câmera expõe aspectos diferentes de rotação, resposta mandibular, intensidade e sincronização.

O modelo permite verificar se uma manifestação permanece coerente quando observada de vários ângulos ou apresentada em diferentes suportes. A multiplicidade de vistas amplia a inspeção; ela não multiplica a entidade nem sua decisão.

Critérios de Avaliação

WireFace instrumenta o percurso entre a resposta de uma entidade e sua manifestação incorporada. Os itens abaixo definem o que pode ser observado e comparado; resultados científicos exigem conjuntos de dados reais, protocolo experimental e análise posterior.

  • Rastreabilidade de identidade: preserva UID, sessão e mensagem desde a origem até a apresentação.
  • Roteamento e entrega: registra emissor, receptor, destino, tentativa e resultado.
  • Latência por etapa: mede roteamento, recepção, interpretação, síntese, preparação e renderização.
  • Geração da fala: registra voz, modelo, tamanho do texto, duração do áudio e tempo de síntese.
  • Sincronização: mede o desvio entre áudio, marcas temporais e movimento visível.
  • Continuidade de estado: verifica se identidade e parâmetros persistem entre mensagens e vistas.
  • Confiabilidade: identifica perdas, duplicações, expirações, novas tentativas e falhas por componente.
  • Portabilidade: compara a mesma identidade em interfaces web, holográficas, XR, robóticas e instalativas.

Instrumentação e Observabilidade

Cada resposta é tratada como um evento mensurável. O painel aceita um arquivo JSON exportado pelo WireFace e organiza indicadores de latência, sincronização, entrega, estados de performance e síntese de voz. Os registros operacionais completos permanecem separados da visualização pública.

—
Samples0events loaded
P50 latency—ms
P95 latency—ms
Success rate—%

Latency by stage

Average routing, interpretation, synthesis, preparation and rendering time.

No telemetry dataset connected.

End-to-end latency

Total response time across the selected events.

No telemetry dataset connected.

Synchronization drift

Difference between audio timing and visible movement.

No telemetry dataset connected.

Delivery status

Successful, retried, timed-out and failed events.

No telemetry dataset connected.

Emotion and intensity

Distribution of interpreted performance states.

No telemetry dataset connected.

Text length and synthesis time

Relationship between character count and ElevenLabs generation time.

No telemetry dataset connected.

Raw events

Visible only with ?wfdebug=1
TimeSessionUIDMessageStatusTotal msRoutePerformanceTTSRenderDriftEmotionIntensityError

Voz, Movimento e Coerência Temporal

A voz integra a corporificação. Ritmo, ênfase, pausas, cadência e intensidade influenciam a percepção da resposta. A ElevenLabs é utilizada como componente de síntese, enquanto o WireFace registra os tempos de geração e execução associados ao evento.

Movimento craniano, orientação e resposta mandibular visualizam parâmetros da performance. A comparação entre áudio, marcas temporais e renderização permite detectar deriva. A interface não presume que movimento prove intenção ou compreensão; ela registra a correspondência técnica entre os canais disponíveis.

Aplicações Possíveis e Limitações

Uma identidade contínua pode ser apresentada em navegador, holograma, projeção, humano digital, entidade robótica, instalação física ou interface volumétrica. Essa portabilidade pode apoiar pesquisa em telepresença, interação humano-robô, mediação cultural, educação, artes performáticas e ambientes narrativos responsivos.

A principal vantagem da arquitetura modular é separar identidade, orquestração, síntese e forma de apresentação. Isso permite comparar interfaces, reutilizar telemetria e alterar um corpo visual ou físico sem redefinir toda a entidade.

Limites atuais. Presença visual e sincronização não demonstram compreensão, autonomia ou segurança operacional. Uso em ambiente real requer sensores apropriados, regras de atuação, tratamento de falhas, avaliação com participantes e validação específica para cada corpo e contexto.

Interface ao vivo do WireFace mostrando as três vistas cranianas, controles, estado do sistema e roteiro de performance.

De Crônicas da IA ao WireFace

Crônicas da IA investiga entidades artificiais, personificação e narrativa em ambientes multimodais. WireFace transforma parte dessa investigação em uma infraestrutura técnica de corporificação, instrumentando a relação entre identidade, voz, movimento, tempo e presença.

Na interseção entre ciência e arte, a plataforma permite que uma hipótese narrativa também se torne um experimento observável. A expressão estética propõe situações e formas de presença; a instrumentação registra como essas manifestações são produzidas, sincronizadas e distribuídas.

Pesquisa e Desenvolvimento

Prof. Luiz Velho

Laboratório VISGRAF — IMPA

Matteo Moriconi

VFXRio

WireFace integra a colaboração entre VISGRAF/IMPA e VFXRio em pesquisa sobre sistemas multimodais, entidades artificiais, corporificação, observabilidade e novas formas de presença digital e física.

Nota de escopo: o painel de telemetria identifica explicitamente dados simulados. Esses dados servem para testar a interface e não devem ser apresentados como resultados experimentais.