Tu voz, conservada
Un clon de voz de MemoriesBox es un modelo sintético de la voz de una persona, creado a partir de sus propias grabaciones de entrevistas, que luego puede hablar con el mismo timbre y cadencia. Unos 30 minutos son suficientes para un buen clon; se crea solo cuando la persona lo solicita y se elimina cuando ella lo decide.
Datos de esta página verificados el
Qué es
Las fotografías perduran. Las voces, por lo general, no. La mayoría de las familias tiene cientos de fotos de una abuela y ni un minuto de ella hablando, y esa ausencia duele más de lo que se espera.
Un clon de voz es un modelo sintético de la voz de una persona, creado a partir de grabaciones de esa persona hablando, que luego puede reproducir el habla con el mismo timbre y cadencia. Es un archivo, producido por un software, a partir de audio. No es una persona, no es una presencia ni una continuación de nadie. Es una forma de escuchar cómo alguien decía las cosas después de que dejó de decirlas.
MemoriesBox crea uno solo a partir de grabaciones que la persona hizo ella misma, conscientemente, mientras estaba viva y participaba.
Cómo funciona
- La persona graba. Sesiones ordinarias de la entrevista guiada, en un teléfono o un ordenador, en una habitación normal. Sin estudio ni micrófono especial.
- El audio se conserva como audio. No se transcribe y se descarta. La grabación es el artefacto; la transcripción es una comodidad.
- La persona pulsa "Crear mi yo digital" en Ajustes → Voz. No se crea nada hasta que lo hace. Unos 30 minutos de habla grabada hacen un buen modelo y es la meta que muestra la página; el mínimo que acepta el proveedor es mucho menor, y un clon con pocos minutos suena a clon con pocos minutos.
- El modelo lo crea y guarda ElevenLabs, en Estados Unidos, usando su método de clonación instantánea de voz: un modelo por cuenta, a partir de las grabaciones de esa cuenta, reemplazado si se reconstruye, eliminado cuando la persona lo retira o borra la cuenta. Es lo único del archivo almacenado fuera de la UE, y se indica en /trust/where-your-data-lives. El proveedor trabaja bajo términos que excluyen nuestras grabaciones de entrenar sus modelos generales. Tampoco se licencia, vende ni usa para entrenar nada nuestro.
- Después, el modelo habla en los cinco idiomas del sitio. Un único modelo multilingüe lee las respuestas del yo digital y las preguntas de la entrevista en voz alta; no hay modelos separados por idioma. Cada conversación muestra en pantalla qué es.
El umbral de los treinta minutos
Treinta minutos es poco tiempo para hablar. Son dos tazas de té. Es aproximadamente la duración de un capítulo de televisión, y menos de lo que la mayoría pasa al teléfono hablando de un paquete.
La consecuencia práctica es que la voz se asegura pronto. Cuando una familia se preocupa por si habrá suficiente material, normalmente ya lo hay. El resto de la grabación es para la historia, no para la voz.
Esto es especialmente importante en la situación que nadie quiere planear. En 2026, 7,4 millones de estadounidenses de 65 años o más viven con Alzheimer, y se proyecta que serán unos 13,8 millones en 2060 (Alzheimer's Association, 2026 Facts and Figures). Tras un diagnóstico, la primera media hora es el momento para hacerlo esta semana. Qué grabar y en qué orden está explicado en /guides/before-dementia.
De qué se crea y de qué nunca se crea
| Se crea a partir de | Nunca se crea a partir de |
|---|---|
| Sesiones que la persona grabó ella misma | Fotografías |
| Grabaciones hechas en vida, sabiendo para qué eran | Mensajes de texto, cartas o correos electrónicos |
| Solo se crea cuando la persona pulsa el botón | Publicaciones en redes sociales o vídeos encontrados en internet |
| Guardado para una cuenta, eliminado si se solicita | La descripción de un familiar sobre cómo sonaba |
| Usado solo para el archivo de una familia | Grabaciones hechas sin que la persona lo supiera |
La columna de la derecha no es hipotética. Seance AI crea sus simulaciones a partir de la descripción que la persona superviviente hace del fallecido, y en su propio sitio dice que es para entretenimiento. En Arizona, en mayo de 2025, un vídeo con IA de Chris Pelkey, víctima de un asesinato, presentó su propia declaración de impacto en el juicio. Son reconstrucciones de alguien a quien no se puede preguntar si está de acuerdo.
Qué no hará
Esta es la sección más importante de la página, y es breve a propósito.
- No inventará opiniones que la persona nunca expresó. El archivo responde con lo que realmente se grabó. Si una familia pregunta qué habría pensado sobre algo ocurrido tras su muerte, la respuesta honesta es que nunca lo dijo, y esa es la respuesta que reciben. Un sistema que adivina está escribiendo fan fiction sobre el padre de alguien.
- No creará una voz a partir de fotos, mensajes o la descripción de otra persona. Si no hay grabaciones hechas por la persona, no hay base para trabajar y no inventaremos nada para rellenar el vacío. Ver /trust/consent.
- Requiere la participación grabada y consentida de la persona. No basta el permiso de un familiar. No vale una casilla marcada en los Términos por quien tenga la tarjeta de crédito. La persona debe estar grabada, participando, mientras está viva.
- No ocultará qué es. Cada conversación muestra en pantalla que es una imitación digital creada solo con las grabaciones propias de la persona, en los cinco idiomas, como exige el Artículo 50 de la Ley de IA de la UE desde el 2 de agosto de 2026. El audio generado se almacena con metadatos que lo marcan como generado por IA, que es la marca legible por máquinas que exige la Ley. La versión en lenguaje claro está en /trust/eu-ai-act-article-50.
- No se venderá, licenciará ni usará para entrenar un modelo general. Las grabaciones existen para crear el archivo de una familia. No hay un segundo uso. Está escrito en los Términos, y el proveedor está obligado por contrato a lo mismo.
- No sonará perfecto. Un clon hecho con treinta minutos de una persona con resfriado, en una cocina con la radio encendida, sonará así. Más grabación lo mejora. Nada lo hace impecable.
- No se entregará como archivo de recuerdo. Un modelo no es un documento, y puede estar guardado con un proveedor externo bajo términos que no permiten transferirlo. La herencia duradera es el audio y las transcripciones, por eso /features/export importa más que esta página.
- No perseguirá a nadie. Sin rachas, sin notificaciones push. Como mucho, una pregunta por correo a la semana a quien dejó de grabar, con opción de darse de baja con un clic. Ver /features/companion.
- No sobrevivirá a tu decisión. Ajustes → Voz → "Retirar mi yo digital" borra el modelo en el proveedor y el resumen del personaje. Las grabaciones permanecen.
Para qué sirve
La razón que dan casi nunca es la que mencionan al principio. Dicen que quieren las historias. Lo que describen después es un buzón de voz que no pueden borrar, o un vídeo donde alguien se ríe fuera de cámara dos segundos.
El 47 % de los estadounidenses lamenta no haber grabado o documentado una conversación con alguien que ya falleció, y el 59 % nunca lo ha hecho (YouGov, junio 2022, n=6,090). Esa encuesta cubre grabar o documentar, así que no mide la voz específicamente. Sigue siendo la declaración más clara del problema: la intención es casi universal y el seguimiento no.
De los once servicios de historias de vida que comparamos en agosto de 2026, ninguno clona la voz real del narrador. Varios conservan audio, que es bueno y valioso por sí solo. Dos productos de legado con IA crean clones: Avataari, una empresa de Melbourne que no revela su región de alojamiento, y Afterlife AI, operada desde Nueva Gales del Sur. MemoriesBox es el único alojado en la Unión Europea. La comparación que lo demuestra, con precios verificados el 17 de agosto de 2026, está en /compare.
Preguntas frecuentes
¿Cuánto tiempo de grabación se necesita para clonar una voz?
Unos 30 minutos para un buen clon, que suelen ser dos o tres sesiones ordinarias y se alcanza mucho antes de terminar la historia de vida. El proveedor puede crear un clon aproximado con mucho menos; la página de ajustes muestra el objetivo de 30 minutos porque es cuando empieza a sonar como la persona y no como un clon.
¿Se puede clonar la voz de alguien que ya ha fallecido?
No, salvo que grabara con MemoriesBox mientras estaba vivo. No creamos una voz a partir de fotos, mensajes, vídeos encontrados en internet o la descripción de un familiar. Si no hay grabaciones hechas por la persona, la respuesta es no.
¿Es legal clonar voces en Europa?
Sí, con condiciones, y esas condiciones son lo interesante. Una voz usada para identificar a una persona puede estar bajo el Artículo 9 del RGPD, que exige consentimiento explícito, y el Artículo 50 de la Ley de IA de la UE exige desde el 2 de agosto de 2026 la divulgación y el marcado legible por máquinas. El detalle está en /trust/is-voice-cloning-legal-in-europe.
¿Quién es el propietario del clon de voz?
Nadie es dueño de una voz. Tú tienes las grabaciones y puedes exportarlas cuando quieras, decides quién tiene acceso, y el modelo creado a partir de ellas se guarda para tu cuenta y no se licencia a nadie.
Relacionado: Qué hace MemoriesBox · Qué hace el avatar con la voz · Consentimiento y quién aceptó ser grabado · Dónde viven tus grabaciones · ¿Es legal clonar voces en Europa? · La tabla comparativa completa
Treinta minutos es todo el umbral. Empieza aquí. 139 $ al año, primeros 14 días gratis, cancela cuando quieras.