Uma plataforma de código aberto de última geração que une inteligência artificial generativa, interação humana e realidade estendida (VR/AR) para impulsionar a nova era dos agentes virtuais inteligentes.
Criar personagens virtuais capazes de interagir de forma natural em espaços imersivos sempre foi um desafio técnico fragmentado. Na pesquisa de Interação Humano-Computador (HCI), conectar modelos de linguagem, processamento de voz e renderização 3D em headsets de Realidade Estendida costumava exigir desenvolvimentos sob medida, rígidos e difíceis de replicar entre laboratórios. O OVARP nasce para mudar esse cenário, oferecendo uma infraestrutura aberta e flexível que separa a inteligência do agente da plataforma em que ele é executado.

No seu núcleo, a plataforma opera com um pipeline de inteligência artificial totalmente modular. Isso permite alternar em tempo real entre diferentes provedores de modelos de linguagem, reconhecimento e síntese de voz sem reiniciar o servidor nem alterar uma única linha de código. O OVARP aceita tanto serviços na nuvem quanto motores locais privados, para garantir controle sobre a latência e a privacidade dos dados. Toda a personalidade do agente, suas regras de comportamento, tom de voz e calibração de empatia são definidos em perfis declarativos em formato YAML, o que facilita a padronização e a replicabilidade dos experimentos científicos.
A arquitetura de duplo transporte, baseada em WebSockets e ZeroMQ, garante que um mesmo agente possa interagir ao mesmo tempo em navegadores web, dispositivos móveis e headsets imersivos. Para facilitar o trabalho de campo, o OVARP integra um console de controle no estilo Wizard-of-Oz que permite aos pesquisadores acompanhar a conversa, intervir ao vivo, acionar gestos ou emoções dinâmicas e registrar marcas de tempo sincronizadas com a telemetria espacial do usuário.
O ecossistema se completa com clientes de referência desenvolvidos em Unity para os headsets Meta Quest 3 e os óculos inteligentes XREAL. Nesses ambientes, os agentes ganham vida com sincronização labial automática, expressões faciais contínuas, gestos procedurais e rastreamento do olhar, mostrando o alcance da plataforma tanto em realidade virtual quanto em realidade aumentada holográfica.