Saltar al contenido principal
Vantaige
LOVO AI (Genny) screenshot
LOVO AI (Genny) logo

LOVO AI (Genny)

Freemium

LOVO AI (comercializado como Genny) es un estudio integral de generación de voz y producción de contenido. Reúne más de 500 voces en más de 100 idiomas, clonación de voz a partir de muestras de audio cortas, un editor de video basado en línea de tiempo, subtítulos automáticos y un redactor de guiones con IA en un único espacio de trabajo en el navegador.

Funciones:API

LOVO AI es una empresa de generación de voz con IA con sede en Los Ángeles que comercializa su producto bajo el nombre de Genny: un estudio basado en el navegador donde la conversión de texto a voz, la clonación de voz, la edición de video, los subtítulos automáticos y la redacción de guiones con IA conviven en un solo espacio de trabajo. Fundada en 2019 por Charlie Choi y Tom Lee, la empresa recaudó una ronda Pre-Serie A de $4.5 millones en agosto de 2021 liderada por Kakao Entertainment y LG CNS, y ha crecido hasta prestar servicio a más de 2 millones de profesionales. Su propuesta principal es sencilla: en lugar de generar audio en una herramienta, editar video en otra y escribir guiones en una tercera, Genny se encarga de las tres, lo que elimina la fricción de transferir archivos que ralentiza a los creadores independientes y a los pequeños equipos de producción.

La biblioteca de voces cuenta con más de 500 voces de IA que abarcan más de 100 idiomas y más de 30 estilos emocionales, con derechos de uso comercial incluidos en todos los planes de pago. La clonación de voz funciona con tan solo un minuto de audio grabado. El lanzamiento en mayo de 2025 de las voces Pro V2 añadió indicaciones en lenguaje natural: envuelve las instrucciones entre corchetes directamente en tu guion (algo como [habla con calidez, como si tranquilizaras a un cliente nervioso]) y el modelo ajusta la entrega en consecuencia, abarcando la emoción, el ritmo, el acento y señales no verbales como la risa. El editor de video integrado de Genny utiliza un diseño de línea de tiempo con pistas de voz, video y música, extrae recursos de archivo de Pixabay y Unsplash, y genera subtítulos en más de 20 idiomas automáticamente. Hay una API para desarrolladores disponible a $0.03 por cada 1,000 caracteres para los equipos que deseen integrar TTS en sus propios productos.

Lo que produce Genny a mediados de 2026

El motor TTS de Genny ofrece actualmente dos modos de voz. Las voces estándar cubren la biblioteca de más de 500 opciones con acentos regionales, variedad de género y etiquetas de emoción preestablecidas. Las voces Pro V2, lanzadas el 23 de mayo de 2025, aceptan indicaciones de lenguaje natural de forma libre dentro del propio guion en lugar de requerir controles deslizantes de parámetros separados. El modelo puede interpretar comandos de vergüenza, urgencia, susurro, llanto o indicaciones complejas de personajes, y genera múltiples tomas para que los editores puedan elegir la mejor lectura. La cobertura lingüística alcanza más de 100 idiomas en más de 30 países, siendo las voces en inglés las que obtienen las mejores calificaciones de calidad por parte de los críticos, mientras que algunas voces que no son en inglés aún muestran una calidad sintética detectable en este momento.

El editor de video dentro de Genny utiliza una línea de tiempo multipista estándar: una pista para la voz en off generada, una para el video de fondo o grabaciones de pantalla, y una para la música. La generación de subtítulos es automática y se exporta en formato SRT o integrados en el video. El redactor de guiones con IA acepta un tema y una indicación de longitud y devuelve un borrador estructurado, que puedes pegar directamente en el editor TTS. Se incluye un generador de arte con IA que produce imágenes de fondo para proyectos de video sin salir de la pestaña del navegador. Las exportaciones de video alcanzan hasta 1080p; el audio se exporta en WAV y MP3. La velocidad de renderizado depende de la nube y los críticos señalan que los videos de 10 minutos a 1080p pueden tardar de 10 a 15 minutos durante las horas pico.

"Los controles de emoción fueron mejores de lo que esperaba. Usé los tonos 'cálido' y 'profesional' para videos de capacitación y los resultados fueron sólidos para ese caso de uso." - crítico, FahimAI.com, febrero de 2026

Dónde se sitúa Genny frente a ElevenLabs y Murf

Estas tres herramientas comparten la categoría de generación de voz con IA, pero atienden a diferentes flujos de trabajo principales, y las diferencias mecánicas son importantes antes de elegir una.

ElevenLabs es el líder en calidad de voz. Su modelo Eleven v3 produce un habla que los críticos califican constantemente como más humana que la de Genny, con un mejor manejo de los matices emocionales y patrones de respiración naturales. La diferencia estructural crítica es el alcance: ElevenLabs es únicamente una herramienta de voz y audio. No tiene editor de video, ni generador de subtítulos, ni redactor de guiones. Su función de doblaje cubre 29 idiomas con sincronización labial, algo que Genny no ofrece en absoluto. La clonación de voz en ElevenLabs comienza en el plan Starter ($5/mes); en Genny requiere el plan Basic a $25/mes o superior. Para un creador cuyo flujo de trabajo es solo de audio, ElevenLabs ofrece una mejor fidelidad a un precio de entrada más bajo. Para alguien que crea videos de YouTube sin mostrar el rostro, la edición integrada de Genny vale la pena porque elimina una herramienta de video separada del conjunto de aplicaciones.

Murf ocupa un carril diferente. Se dirige a casos de uso de presentaciones corporativas y empresariales, con una profunda integración con Google Slides, controles deslizantes de tono y una biblioteca de voces ajustada para la claridad profesional en lugar de la expresividad del creador. El recuento de voces de Murf se sitúa en más de 120 en 20 idiomas en comparación con las más de 500 en más de 100 idiomas de Genny. Murf no tiene un editor de línea de tiempo de video; su salida es audio integrado para diapositivas y documentos. La división fundamental es: Murf para capacitación corporativa interna y narración de diapositivas, Genny para contenido de creadores externos que necesita entregarse como un video terminado. También vale la pena comparar: PlayHT y WellSaid Labs ofrecen sólidas alternativas exclusivas de TTS para equipos que desean acceso a la API sin las herramientas de video integradas.

La realidad de las licencias y los derechos de autor

En mayo de 2024, los actores de doblaje Paul Skye Lehrman y Linnea Sage presentaron una demanda colectiva federal contra LOVO Inc. en Manhattan (caso n.º 1:24-cv-03770). La demanda alegaba que en 2019 y 2020, los empleados de LOVO los contrataron a través de Fiverr bajo la premisa de que las grabaciones eran solo para "investigación interna", y luego usaron esas grabaciones para entrenar el motor de voz de Genny y clonaron sus voces para productos comerciales: la voz de Lehrman se comercializó como "Kyle Snow", la de Sage como "Sally Coleman". LOVO presentó una moción de desestimación, caracterizando la demanda como un enfoque de "cajón de sastre". A finales de 2025, el tribunal permitió el reclamo directo de derechos de autor de Sage en relación con el uso por parte de LOVO de su grabación real en presentaciones para inversores y videos de YouTube, al determinar que el uso excedía el alcance de la licencia de Fiverr. Las reclamaciones más amplias de la demanda colectiva siguen en curso. El caso representa uno de los primeros reclamos de derecho de publicidad contra una empresa de voz con IA en sobrevivir en parte a una moción de desestimación, y destaca la exposición legal que conlleva el sector de la voz con IA en torno a la obtención de datos de entrenamiento.

Para los usuarios, la posición práctica de las licencias es más clara: todos los planes de pago de Genny incluyen derechos comerciales sobre el audio y el video generados, lo que significa que puedes publicar contenido de YouTube con publicidad o usar los resultados en proyectos de clientes de pago. Los términos de la API también otorgan uso comercial a la tarifa de facturación por carácter. LOVO no proporciona credenciales de contenido ni marcas de agua de forma predeterminada, por lo que no existe un mecanismo de divulgación integrado si necesitas indicar que el audio fue generado por IA a audiencias o plataformas que lo requieran.

Dónde Genny se queda corto de manera constante

La queja más documentada en Trustpilot, Capterra y sitios de reseñas es la inestabilidad de la biblioteca de voces. Las voces se eliminan de la biblioteca sin previo aviso, sin explicación y sin advertencia a los usuarios que ya han creado proyectos en torno a ellas. Un equipo de producción que graba una serie de podcasts de 20 episodios utilizando una voz específica puede descubrir que esa voz desapareció en el episodio 10, lo que requiere reconstruir el flujo de trabajo o renegociar el entregable con el cliente. Esto no es una hipótesis: múltiples críticos de Capterra en 2024 y 2025 describieron exactamente este escenario en detalle.

"ELIMINAN voces sin previo aviso, sin explicación y sin ninguna disculpa en absoluto. Usamos voces para personajes específicos en nuestros estudios de caso, pero luego Lovo elimina las voces." - crítico verificado, Capterra, 2024

Trustpilot agrava este panorama. LOVO tiene una puntuación general de 2.3 estrellas a pesar de que el 69% de los críticos le otorgan cinco estrellas, lo que indica una larga lista de quejas graves que reducen drásticamente el promedio. El caso documentado más grave a principios de 2026 involucró a un usuario que pagó $449.86 por una suscripción Lifetime Pro en enero de 2025, fue degradado silenciosamente al plan gratuito a fines de abril de 2026 sin previo aviso, no recibió respuesta a las solicitudes de soporte y, en última instancia, presentó una queja formal ante la Comisión Federal de Comercio de EE. UU. (Informe de la FTC n.º 201182578). El resumen del usuario: "Si estás considerando un plan de por vida (Lifetime) con LOVO, piénsalo dos veces. Aparentemente, 'de por vida' tiene fecha de caducidad".

Patrones adicionales que vale la pena señalar: no existe la acumulación de créditos, lo que significa que los minutos no utilizados caducan al final de cada período de facturación en lugar de transferirse. La calidad de la voz en idiomas distintos al inglés es inconsistente, y los acentos regionales del español de México se señalan específicamente por sonar robóticos en comparación con la biblioteca en inglés. Las colas de renderizado durante las horas pico añaden latencia que interrumpe los flujos de trabajo creativos en tiempo real. Los tiempos de respuesta de atención al cliente promedian de una a dos semanas según las cuentas de múltiples críticos, lo cual es lento en relación con los acuerdos de nivel de servicio (SLA) de soporte que anuncian competidores como ElevenLabs y Murf.

Para quién es Genny

Genny se gana su lugar más claramente entre los creadores independientes que construyen canales de YouTube sin mostrar el rostro, contenido para TikTok o módulos de aprendizaje electrónico (e-learning) donde el beneficio en el flujo de trabajo de tener guion, voz, video y subtítulos en una sola pestaña del navegador supera la brecha de calidad frente a ElevenLabs. Un creador que de otro modo pagaría por Descript o CapCut por separado, y luego exportaría el audio a una herramienta TTS independiente, ahorra tiempo real y costos de suscripción al consolidarlo todo en Genny. Los canales de automatización de YouTube en particular suelen citar a Genny como su principal herramienta de producción porque el redactor con IA se encarga del guion, el TTS de la narración y el editor de video del montaje sin tener que cambiar de aplicación.

La API a $0.03 por cada 1,000 caracteres es competitiva para los desarrolladores que desean una amplia cobertura de idiomas y no necesitan el realismo del nivel de ElevenLabs. Al ser aproximadamente 10 veces más barata que ElevenLabs por carácter (según la propia comparación de marketing de LOVO), se adapta a escenarios de volumen de producción como la localización masiva o las descripciones de productos generadas automáticamente en más de 100 idiomas, donde los costos por carácter importan más que las sutiles diferencias en la calidad de la voz.

Evita Genny cuando tu caso de uso dependa de que una voz específica esté disponible dentro de seis meses: el problema de estabilidad de la biblioteca es real y está documentado. Evítalo para la producción de podcasts profesionales donde el realismo de la voz debe ser indistinguible de una grabación humana; ElevenLabs es la herramienta correcta para ese nivel. Evítalo si tu presupuesto comienza en cero: la prueba de 14 días con 20 minutos de generación no es suficiente para validar un flujo de trabajo a largo plazo, y no hay un nivel gratuito permanente una vez que finaliza la prueba. Las agencias de marketing con múltiples cuentas de clientes activas también deben tener en cuenta el retraso en la respuesta de atención al cliente antes de comprometerse con Genny como una dependencia de producción.

Para los equipos que comparan opciones más amplias en el espacio de la voz con IA, PlayHT ofrece una sólida alternativa centrada en la API, y vale la pena evaluar WellSaid Labs para las necesidades de cumplimiento y consistencia de voz a nivel empresarial.

Reseñas de usuarios

Aún no hay reseñas. ¡Sé el primero en compartir tu experiencia!

Inicia sesión para escribir una reseña.

Artículos relacionados

Guías y artículos relacionados con LOVO AI (Genny).