← Últimos artigos
💻 computer science

Can People Distinguish Human and AI Agency in Humanoid Teleoperation? A Preliminary Study of Agency Perception

Este estudo preliminar introduz o framework "Ghost-in-the-Loop" para demonstrar que os participantes frequentemente têm dificuldade em distinguir entre agência humana e de IA em teleoperação humanoide, com seus julgamentos sendo primariamente impulsionados pela naturalidade percebida e consistência multimodal, em vez da fonte real de controle.

Autores originais: Xiang Li, Koya Dendo, Keigo Minamida, Yuto Nakamura, Per Ola Kristensson, Jun Rekimoto

Publicado 2026-09-09
📖 5 min de leitura🧠 Leitura aprofundada

Autores originais: Xiang Li, Koya Dendo, Keigo Minamida, Yuto Nakamura, Per Ola Kristensson, Jun Rekimoto

Artigo original sob licença CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta é uma explicação gerada por IA do artigo abaixo. Não foi escrita nem endossada pelos autores. Para precisão técnica, consulte o artigo original. Ler aviso legal completo

Imagine um futuro onde um robô parado em sua sala de estar não é apenas uma máquina seguindo um roteiro, mas um parceiro de conversa, capaz de sorrir, gesticular e responder com a fluidez de um ser humano. Esta visão depende da teleoperação, um método onde uma pessoa senta-se longe e controla os movimentos e a voz do robô em tempo real, usando efetivamente a máquina como um corpo remoto. Durante anos, isso exigiu que um operador humano estivesse constantemente presente, limitando quantas pessoas uma única pessoa pode ajudar ou quanto tempo uma conversa pode durar. No entanto, a rápida ascensão da inteligência artificial introduziu uma nova possibilidade: sistemas que podem gerar fala, expressões faciais e gestos por conta própria, imitando um humano tão de perto que a diferença se torna difícil de notar. Isso cria uma questão fascinante e ligeiramente inquietante para qualquer pessoa que interaja com essas máquinas: se um robô está atuando, você consegue saber se há uma pessoa real puxando as cordas ou se um algoritmo está fazendo o trabalho?

Pesquisadores dos Laboratórios de Ciência da Computação da Sony e da Universidade de Tóquio decidiram responder a essa pergunta construindo um sistema que chamam de Ghost-in-the-Loop (Fantasma no Ciclo). Este framework permite que um robô humanoide mude perfeitamente entre ser controlado por um operador humano e ser impulsionado inteiramente por inteligência artificial, tudo isso mantendo a aparência e o som exatamente iguais. O robô, um modelo Unitree G1 equipado com uma tela para o rosto e câmeras para ver seus arredores, serve como o palco. Quando um humano está no controle, ele usa um headset para ver o que o robô vê e sensores de movimento para guiar as mãos e o rosto do robô. Quando o sistema muda para o modo IA, o robô ouve a conversa e usa modelos generativos para criar sua própria voz, movimentos faciais e gestos manuais, combinando com o mesmo estilo visual e auditivo da versão controlada por humano. O objetivo não era ver qual era melhor, mas sim ver se um observador humano conseguiria sequer notar a diferença.

Para testar isso, a equipe criou uma série de clipes de vídeo curtos mostrando o robô em conversação. Eles gravaram oito interações diferentes, variando de conversas casuais a discussões orientadas a tarefas, cada uma durando entre cinco e quarenta segundos. Em metade desses clipes, um teleoperador humano estava controlando o robô. Na outra metade, o sistema de IA gerou o comportamento. Crucialmente, a voz, o rosto e o corpo do robô permaneceram consistentes em todos os clipes, de modo que a única variável era a fonte do controle. Os pesquisadores convidaram cinquenta pessoas para assistir a esses vídeos online. Após cada clipe, os participantes eram solicitados a decidir se o robvel era operado por um humano ou por um computador, avaliando sua certeza em uma escala que ia de dez negativo para uma IA definitiva a dez positivo para um humano definitivo. Eles também foram questionados sobre o porquê de se sentirem daquela maneira.

Os resultados sugerem que, nesses breves momentos, a linha entre humano e máquina é extraordinariamente tênue. Os participantes tiveram grande dificuldade em distinguir entre as duas fontes de controle. Em média, suas avaliações mal mudaram entre os clipes controlados por humanos e os controlados por IA, sendo a diferença tão pequena que era estatisticamente indistinguível de um palpite aleatório. O estudo indica que, para interações curtas, as pessoas simplesmente não conseguem distinguir de forma confiável se um robô está sendo pilotado por uma pessoa ou por um algoritmo. Quando os pesquisadores analisaram o que os participantes estavam realmente pensando, um padrão claro surgiu em suas explicações. Aqueles que sentiram que podiam fazer um julgamento basearam-se fortemente na naturalidade geral do comportamento do robô. Eles prestaram muita atenção ao tempo da conversa, ao ritmo dos movimentos e se a voz, a expressão facial e os gestos manuais pareciam trabalhar juntos em harmonia.

Quando os movimentos do robô pareciam rígidos, o tempo parecia errado ou as diferentes partes de seu corpo pareciam fora de sincronia com sua voz, os participantes eram mais propensos a supor que era uma IA. Por outro lado, quando o robô se movia com um fluxo coerente, onde os gestos e expressões combinavam perfeitamente com a fala, as pessoas eram mais propensas a acreditar que havia um humano por trás dos controles. Isso não significa que a IA fosse perfeita, mas sim que as falhas no desempenho da IA eram sutis o suficiente para serem ignoradas em um olhar rápido. O estudo sugere que nossa capacidade de detectar agência depende menos da tecnologia específica utilizada e mais da consistência da performance. Se o robô age como um todo unificado, o cérebro o aceita como um único agente, independentemente de esse agente ser carne ou código.

Este trabalho preliminar abre um novo capítulo em como podemos projetar os robôs do futuro. Isso implica que, em um futuro próximo, talvez não precisemos nos preocupar com usuários questionando constantemente se um robô é real ou falso durante trocas curtas. Em vez disso, o foco pode mudar para como esses sistemas podem misturar inteligência humana e artificial, talvez permitindo que um humano assuma o controle quando uma conversa se torna complexa, enquanto a IA lida com as partes rotineiras. Os pesquisadores observam que suas descobertas são específicas para esses clipes curtos e estruturados, e que interações mais longas e complexas podem revelar padrões diferentes. Por enquanto, o estudo confirma que, quando um robô fala, sorri e se move com coerência suficiente, a mente humana fica satisfeita em aceitá-lo como um parceiro, deixando a verdadeira natureza de sua agência como um mistério silencioso.

Afogado em artigos na sua área?

Receba digests diários dos artigos mais recentes que correspondam às suas palavras-chave de pesquisa — com resumos técnicos, no seu idioma.

Experimentar Digest →