En un movimiento que redefine la interacción humano-máquina, DeepSeek ha iniciado pruebas discretas de su función de chat de voz nativa dentro de su aplicación de consumo. Este avance, que ya está siendo experimentado por un grupo selecto de usuarios, permite que las respuestas de la IA sean leídas en voz alta directamente en la interfaz de chat, eliminando la necesidad de abandonar la conversación para escuchar la información.
Voces con Personalidad: El Toque Oriental de DeepSeek
La novedad no se detiene en la funcionalidad; la personalización es clave. Dentro de la configuración, los usuarios pueden elegir entre cuatro perfiles de síntesis de voz (TTS) integrados, cada uno con una descripción evocadora. ‘Beike’, descrito como versátil y animado; ‘Bailang’, brillante y firme; ‘Haixing’, juguetón y dulce; y ‘Anchao’, profundo y resonante. Estos nombres, de origen chino, reflejan la rica herencia cultural que DeepSeek integra en su tecnología, ofreciendo una experiencia auditiva distintiva y cautivadora. Es importante destacar que esta innovación se centra en la entrega hablada y la elección de timbre, no en la arquitectura o capacidad del modelo subyacente, diferenciándose claramente de los anuncios recientes sobre sus modelos V4.1-Flash y la transición de tráfico de Pro a Flash.
Este experimento de voz se sitúa un nivel por encima de la reciente disponibilidad general de Flash y la optimización de costos. Mientras que el chat de voz ya existía en formato ‘push-to-talk’ a principios de 2026, esta nueva fase de prueba gris extiende la interacción hacia una salida continua y hablada, con voces seleccionables. Se trata de una superficie de producto distinta a la narrativa de disponibilidad general de Flash o a la redirección de API de Pro a Flash, y debe ser considerada como una característica de la interfaz de usuario más que como un nuevo lanzamiento de modelo.
Hasta que DeepSeek publique notas de lanzamiento formales, los operadores y socios deben tratar este botón de altavoz como un experimento de experiencia de usuario en fase de prueba, no como una característica contractual. Para aquellos que siguen de cerca la evolución de la compañía, la verdadera noticia reside en el empaquetado: un modo de voz nativo acompañado de cuatro opciones de TTS con nombre propio, que llega después de la disponibilidad general de Flash y la redirección del alias Pro, marcando un capítulo diferente en el calendario de desarrollo de la IA, centrado en la experiencia del usuario.
Fuente: Pandaily (China AI)