La frontera entre lo humano y lo artificial se desdibuja cada vez más rápido. Este 2 de octubre, la startup Tavus anunció que su modelo Griffin-Lite había logrado algo sin precedentes: durante conversaciones de un minuto en videollamada, el 48% de los participantes (26 de 54) declaró creer que su interlocutora era una persona real. La empresa calificó el resultado como la primera superación de un 'test de Turing en vídeo' en tiempo real, pero la afirmación llega cargada de matices que revelan tanto el avance técnico como las complejidades éticas que trae consigo.
El experimento que confundió a la mitad
Los participantes, reclutados mediante una plataforma de investigación independiente, pensaban que conversarían con otra persona sobre sus expectativas para el año. Al otro lado estaba Griffin-Lite, generando en tiempo real rostro, voz, gestos y respuestas coherentes. La clave del sistema es su arquitectura full-duplex: no espera pasivamente a que termine el turno del humano, sino que escucha y observa continuamente, reaccionando en intervalos inferiores a un segundo. Esto le permite asentir mientras hablamos, interpretar pausas, dejarse interrumpir e incluso reaccionar a objetos mostrados ante la cámara.
En una prueba equivalente con el sistema anterior de Tavus, solo 1 de 41 participantes había creído hablar con un humano. El salto es notable, pero el planteamiento dista del test de Turing original de 1950, que exigía comunicación exclusivamente escrita para eliminar pistas físicas. 'No hay un protocolo único reconocido como "el" Video Turing Test', explica Lucas Ferreira, especialista en LLMs. 'Tavus adapta el concepto de indistinguibilidad a un escenario conversacional audiovisual, lo que técnicamente es impresionante, pero metodológicamente diferente'.
Comparaciones y benchmarks externos
Un estudio publicado en PNAS en mayo de 2026 ya había mostrado capacidades similares en modalidad escrita. GPT-4.5, con instrucciones para adoptar personalidad humana, fue elegido como la persona el 73% de las veces en conversaciones simultáneas de cinco minutos. Los protocolos no son directamente comparables, pero muestran la tendencia.
NVIDIA incluye a Griffin-Lite en VideoFDB, un benchmark con 237 fragmentos de videollamadas reales. El modelo lidera las tablas de percepción (3,73/5 frente a 4,20 humano) y generación (3,83/5 frente a 3,92 humano), aunque la propia NVIDIA subraya que todos los sistemas evaluados siguen por debajo de la referencia humana en naturalidad conversacional.
Disponibilidad limitada y dilemas éticos
Griffin-Lite sigue siendo una versión de investigación disponible solo para testers seleccionados. Tavus comercializa actualmente PALs (agentes audiovisuales) para ventas, formación y atención al cliente, pero no ofrece aún esta tecnología avanzada a clientes generales.
La empresa reconoce explícitamente el riesgo: las mismas características que permiten interacción natural pueden engañar a usuarios sobre la naturaleza de su interlocutor. Tavus afirma trabajar en funciones de aviso y exige consentimiento informado para crear réplicas de personas. Coincide con el AI Act de la UE, vigente desde el 2 de agosto de 2026, que obliga a informar cuando se interactúa con IA, salvo cuando sea evidente por el contexto.
El avance técnico es innegable, pero la discusión ya no es solo sobre si una máquina puede parecer humana, sino sobre qué responsabilidades conlleva crear sistemas que borran esa distinción a simple vista.
