Tras el caso Tsuda, la industria vocal japonesa pide permiso por obra y aviso de voz sintética
La sentencia de Tokio sobre los vídeos que imitaban la voz de Kenjiro Tsuda no fijó contratos para doblaje ni una regla general sobre entrenamiento de IA. Dos documentos originales de asociaciones japonesas, publicados en 2024 y 2026, plantean consentimiento del intérprete, acuerdos separados por proyecto y señalización de las voces generadas. Examinamos qué solicitan exactamente y qué sigue sin haber decidido el tribunal.

El fallo del Tribunal de Distrito de Tokio sobre los vídeos con una voz parecida a la de Kenjiro Tsuda dejó una pregunta abierta para quienes producen anime, doblaje y audio: ¿qué autorización se necesita antes de convertir la interpretación de una persona en material para generar otra voz? La resolución del 30 de septiembre de 2026 rechazó la retirada solicitada porque los 188 vídeos ya habían sido eliminados. El tribunal explicó que una voz puede tener valor comercial protegido, pero no convirtió el caso en un reglamento de producción ni determinó cómo se había entrenado el sistema que creó la narración.
La industria japonesa había formulado peticiones concretas antes de esa sentencia. En un documento conjunto del 13 de noviembre de 2024, la unión de intérpretes Nippon Haiyu Renmei, la asociación de representantes artísticos y la asociación de agencias de actores de voz pidieron que no se utilizara voz generada por IA para interpretar en animación y doblaje de películas extranjeras. También exigieron autorización de la persona cuya voz se aprende o utiliza y una indicación expresa de que el audio fue generado. Son propuestas de estas organizaciones; el fallo de Tsuda no impuso esos tres requisitos a toda productora.
El texto de 2024 distingue la mera adquisición de grabaciones del permiso para explotarlas. Para usos que excedan la esfera privada, incluida la publicación en redes sociales, las entidades solicitan el consentimiento del intérprete. Cuando una empresa quiera comercializar voces generadas, proponen contratos separados para cada proyecto en lugar de una cesión pagada una sola vez y sin plazo de uso. El documento cita un modelo de acuerdo de la asociación de agencias que excluye aplicaciones como el doblaje japonés y la grabación de voces para animación. Esa cláusula es un ejemplo de su propuesta contractual, no una condición que ya figure en todos los contratos japoneses.
En abril de 2026, cuatro organizaciones presentaron a legisladores una explicación más amplia. Separaron tres participantes de la cadena: quien desarrolla el modelo con datos vocales, quien ofrece un servicio para producir audio y quien publica el contenido resultante. Sostuvieron que las vías actuales para reclamar frente a cada uno son limitadas. Esa descripción expresa la evaluación y la petición política de las asociaciones; por sí sola no prueba que un desarrollador concreto haya infringido una ley ni que el tribunal se haya pronunciado sobre los tres actores.
La diferencia importa al leer el expediente Tsuda. El escrito judicial recoge la afirmación de una página enlazada desde la cuenta: el audio se habría creado entrenando la voz de un amigo que imitaba bien a Tsuda, no con grabaciones del actor sin permiso. También reproduce comentarios de usuarios que creían reconocer su voz. Ambas cosas forman parte de las alegaciones y del contexto probatorio, pero no equivalen a una verificación judicial del origen del conjunto de entrenamiento. El tribunal terminó la petición de eliminación por la ausencia de vídeos que retirar, sin resolver cada hipótesis técnica sobre el audio.
Para un lector de doblaje en español, los documentos japoneses permiten separar tres decisiones de producción. Una es obtener permiso para aprender o sintetizar la voz; otra es delimitar qué obra, soporte, duración y nueva utilización cubre el contrato; la tercera es informar a la audiencia cuando oye una voz generada. Las entidades japonesas defienden esos límites desde la protección del trabajo interpretativo. Trasladarlos automáticamente a una obligación vigente en España sería incorrecto: aquí se describen posiciones de organizaciones japonesas y el alcance de un litigio japonés, no una regla española.
El caso ya tenía una noticia en español centrada en el rechazo de la demanda y un borrador normativo español. Esta lectura aporta otro documento y otra pregunta: qué cambios piden los propios representantes de intérpretes y agencias para el trabajo cotidiano de audio. La respuesta verificable hoy es la distancia entre sus propuestas escritas y la resolución judicial. La foto de un micrófono de 2023 es ilustrativa y no muestra a Tsuda, su voz ni el tribunal.
프리즘코리아 편집국 > Lucía Serrano



