Voces clonadas en pantalla: el caso Tsuda coincide con un nuevo proyecto español
El fallo de Tokio rechazó retirar los vídeos sobre la supuesta imitación de Kenjiro Tsuda porque ya habían desaparecido, sin resolver si la voz fue copiada. Para el sector audiovisual español, la novedad inmediata es otra: Trabajo somete a consulta hasta el 8 de octubre un proyecto sobre el uso de voces e imágenes de artistas mediante IA.

La sentencia sobre la voz de Kenjiro Tsuda ha llegado mientras España discute cómo regular la reutilización de voces de intérpretes mediante inteligencia artificial. El 30 de septiembre, el Tribunal de Distrito de Tokio rechazó su solicitud de que TikTok eliminara 188 vídeos. La razón decisiva fue que el contenido ya se había borrado del servidor antes de concluir el juicio. En España, el Ministerio de Trabajo mantiene abierta hasta el 8 de octubre una consulta sobre un proyecto que aborda el empleo de voces e imágenes de artistas en la producción escénica, audiovisual y musical. Son procesos de distinto país y alcance; leerlos juntos permite separar el resultado de un pleito concreto de una propuesta de reglas para futuros contratos de producción.
El texto judicial japonés identifica a Tsuda como actor, narrador y voz del personaje Kento Nanami en «Jujutsu Kaisen». Los 188 vídeos, publicados entre julio de 2024 y septiembre de 2025, reunían imagen, subtítulos y narraciones sobre leyendas urbanas y fenómenos paranormales. Según la sentencia, el titular de la cuenta la eliminó el 29 de mayo de 2026 y los datos se borraron el 28 de junio. El tribunal dijo que una voz puede recibir protección por su capacidad de atraer público cuando se explota precisamente ese valor comercial. Pero no decidió si la narración impugnada era una copia de la voz de Tsuda, si se había entrenado con grabaciones suyas o si TikTok tenía responsabilidad por mantener los vídeos. Rechazó la petición de retirada porque ya no quedaba ese contenido por eliminar.
La pregunta para una producción audiovisual española es más práctica: ¿qué se pacta antes de convertir una interpretación vocal en material para generar nuevos contenidos? El proyecto de anteproyecto publicado por Trabajo el 17 de septiembre se refiere a personas artistas dentro de una relación laboral especial, no a todo usuario de una plataforma de vídeo. Su exposición de motivos propone limitar los usos de réplicas digitales o contenidos reconocibles al objeto del contrato y a la obra para la que se firmó. También plantea que, fuera de los supuestos previstos, el uso de la voz o imagen mediante IA requiera un acuerdo expreso por escrito y una compensación económica diferenciada. Estas condiciones figuran en un borrador sometido a audiencia pública: todavía no son una ley aprobada.
El propio borrador explica por qué esta materia quedó fuera del Real Decreto 607/2026, aprobado en julio. El Consejo de Estado consideró que una regulación sobre voz, imagen y derechos fundamentales excedía lo que podía fijarse mediante reglamento y exigía una norma con rango de ley orgánica. La consulta que ahora aparece en el portal de Trabajo admite aportaciones desde el 18 de septiembre hasta el 8 de octubre. Para un intérprete o una productora, esa fecha señala un trámite abierto, no el inicio de vigencia de las cláusulas propuestas. Tampoco hay base para afirmar que el litigio japonés haya creado una obligación contractual española.
Existe además una capa europea distinta. La Comisión Europea explica que el artículo 50 del Reglamento de Inteligencia Artificial se aplica desde el 2 de agosto de 2026. Los proveedores de sistemas que generan audio sintético deben facilitar marcas legibles por máquina, mientras que quienes despliegan contenidos que cumplen la definición de «ultrafalsificación» deben informar al público de forma perceptible al exponerse a ellos. En obras claramente artísticas o ficticias, la forma de informar puede adaptarse para no estorbar la experiencia de la obra. La Comisión distingue las obligaciones del proveedor de la herramienta y las de quien la utiliza profesionalmente; una etiqueta técnica incrustada no sustituye por sí sola la comunicación perceptible al espectador.
La transparencia ante la audiencia y la autorización del intérprete responden, por tanto, a preguntas diferentes. Indicar que un audio es sintético no acredita que la persona cuya voz se parece haya consentido ese uso; disponer de un acuerdo con un artista tampoco resuelve automáticamente cómo debe informarse al público cuando el contenido entra en las condiciones del reglamento europeo. En el expediente Tsuda, la sentencia no comprobó la procedencia técnica del audio ni evaluó un contrato de producción. El proyecto español tampoco regula de forma general los vídeos publicados por cualquier usuario. Esos límites importan para evitar que una noticia judicial se convierta en una falsa guía universal para el doblaje.
Hasta que concluya la tramitación española, el dato verificable es el texto presentado a audiencia y su plazo para comentarios. El sector puede examinar en él qué usos quedarían dentro de una obra contratada, cuándo se exigiría un acuerdo escrito y cómo se separaría la remuneración adicional. La sentencia de Tokio sirve como recordatorio de que una disputa puede acabar sin respuesta sobre la clonación alegada; la consulta española muestra una discusión anterior al conflicto: qué dejar documentado antes de producir una nueva voz. La fotografía que acompaña este artículo es un archivo de una sesión de grabación ajena a Tsuda y al proceso judicial.
프리즘코리아 편집국 > Lucía Serrano
Fuentes originales
- Tribunal de Distrito de Tokio, sentencia del 30 de septiembre de 2026 ↗
- Ministerio de Trabajo de España, audiencia pública abierta ↗
- Ministerio de Trabajo de España, proyecto de anteproyecto ↗
- Consejo de Estado de España, dictamen CE-D-2026-518 ↗
- Comisión Europea, preguntas sobre transparencia del artículo 50 ↗



