Saltar al contenido principal
IA

Avataar AI lanza modelo de video con comprensión cultural y precios veinte veces menores a la competencia global

12 de junio de 20264 min de lectura
Avataar AI lanza modelo de video con comprensión cultural y precios veinte veces menores a la competencia global

Qué pasó

La empresa india Avataar AI presentó oficialmente a Varya, un modelo de inteligencia artificial orientado a la generación de video con énfasis en el contexto cultural del mercado local. La firma, que cuenta con el respaldo del fondo Peak XV, no desarrolló el modelo desde cero, sino que tomó como base Wan 2.2, una alternativa de código abierto publicada por Alibaba, y aplicó una técnica de destilación que permite comprimir las capacidades del sistema original en una versión más ágil y específica para casos de uso de comercio electrónico.

Los resultados de la optimización fueron evidentes. Varya ejecuta el proceso de generación en cuatro pasos, en comparación con los cincuenta requeridos por Wan 2.2, lo que se traduce en una velocidad diez veces superior. En pruebas concretas realizadas sobre una unidad de procesamiento gráfico Nvidia H200, el modelo genera un clip de cinco segundos en resolución 720p en 45 segundos, frente a los 1.230 segundos que demanda el modelo de Alibaba.

El componente más destacado de la propuesta es la estructura de precios. Avataar proyecta cobrar 0,48 rupias, equivalentes a aproximadamente 0,005 dólares, por cada segundo de video generado en su servicio alojado, una cifra hasta veinte veces inferior a la de competidores como Veo, Kling, Luma y Runway, que en promedio cobran desde 0,10 dólares por segundo.

Avataar es una de las doce startups seleccionadas en el marco de la India AI Mission, una iniciativa gubernamental dotada con cerca de 1.200 millones de dólares que entrega acceso subsidiado a infraestructura de cómputo a cambio de la publicación abierta de los modelos. En línea con este compromiso, Varya se distribuirá como modelo de pesos abiertos en el portal AIKosh, junto con sus datos de entrenamiento, lo que permitirá a desarrolladores implementarlo de manera autónoma o modificarlo según sus requerimientos.

La compañía aseguró que el modelo fue entrenado con datos curados para reconocer matices culturales específicos, incluyendo alimentos, vestimenta, arquitectura y festividades locales, un aspecto en el que los modelos de imagen y video de propósito general suelen presentar limitaciones.

Contexto

El desarrollo de modelos de inteligencia artificial en India ha presentado un ritmo más pausado respecto de Estados Unidos, Europa y China, concentrándose principalmente en modelos de lenguaje y de voz. La India AI Mission, lanzada por el gobierno federal, busca revertir esta tendencia mediante incentivos directos a la investigación y el acceso preferente a capacidad de cómputo, con el objetivo de consolidar un ecosistema local soberano en materia de inteligencia artificial.

La selección de Avataar dentro de este programa refleja el interés estratégico del gobierno indio por fortalecer aplicaciones de video, considerando que India se caracteriza por ser un mercado donde el contenido audiovisual supera al texto en términos de adopción y consumo digital. Rajan Anandan, director gerente de Peak XV, señaló a TechCrunch que los modelos de video disponibles en la actualidad resultan demasiado costosos para un uso a escala poblacional y que la reducción de precios constituye el principal habilitador para la adopción masiva.

La técnica de destilación empleada por Avataar representa una tendencia creciente en la industria global, ya que permite a empresas con recursos computacionales limitados adaptar modelos de gran tamaño a necesidades específicas sin reconstruir la infraestructura subyacente. Este enfoque se posiciona como una alternativa viable frente al entrenamiento desde cero, que exige inversiones de capital significativamente mayores.

En el plano regional, la disponibilidad de modelos abiertos con comprensión cultural incorporada podría modificar las dinámicas de producción de contenido para mercados emergentes, donde los sistemas de propósito global tienden a producir resultados genéricos o estereotipados. La decisión de publicar los datos de entrenamiento junto con el modelo refuerza una lógica de transparencia y construcción colectiva que ha ganado tracción en distintos ecosistemas de inteligencia artificial.

Impacto para empresas chilenas

Para el ecosistema empresarial chileno, la aparición de modelos de video con costos operativos hasta veinte veces inferiores a los de proveedores tradicionales abre oportunidades concretas en sectores como comercio electrónico, marketing digital, educación y servicios financieros. Empresas nacionales que actualmentePostergan proyectos de contenido audiovisual por restricciones presupuestarias podrían evaluar la incorporación de estas herramientas en estrategias de comunicación y ventas.

Las pequeñas y medianas empresas chilenas, que enfrentan limitaciones estructurales para producir material audiovisual de alta calidad, podrían verse particularmente favorecidas por la democratización de precios en generación de video. La posibilidad de generar contenido para redes sociales, catálogos digitales o campañas promocionales a costos marginales representa un cambio relevante en la ecuación económica del marketing digital.

En el ámbito de la educación y la capacitación corporativa, la disponibilidad de modelos abiertos permitiría a instituciones locales experimentar con material audiovisual generado por inteligencia artificial sin depender exclusivamente de proveedores internacionales, ajustando los contenidos a la realidad cultural y lingüística del país. Esta capacidad resulta especialmente relevante para regiones con alta diversidad territorial y cultural.

No obstante, la adopción efectiva en Chile dependerá de factores como la latencia de los servicios alojados en el extranjero, los costos de transferencia de datos y la disponibilidad de infraestructura local de cómputo. Asimismo, la eventual liberación del modelo en régimen de pesos abiertos permitiría a empresas y desarrolladores chilenos desplegar la solución en servidores propios, reduciendo la dependencia de proveedores externos y mejorando el control sobre los datos procesados.

Qué sigue

La liberación de Varya en el portal AIKosh durante las próximas semanas permitirá evaluar con precisión su desempeño en condiciones reales de uso por parte de desarrolladores externos. Los resultados de estas pruebas serán determinantes para validar la promesa de reducción de costos y para dimensionar el alcance real de la comprensión cultural incorporada en el modelo.

En un horizonte más amplio, la estrategia de Avataar podría incentivar a otros actores del ecosistema indio y global a desarrollar modelos regionales optimizados, acelerando la fragmentación del mercado de inteligencia artificial generativa en propuestas especializadas por geografía, idioma y contexto cultural. Esta tendencia, de consolidarse, modificaría profundamente las dinámicas competitivas de una industria actualmente dominada por un número reducido de proveedores.

Artículos Relacionados

Reelful: aplicación móvil utiliza inteligencia artificial para transformar archivos fotográficos en videos cortos para redes sociales
IA

Reelful: aplicación móvil utiliza inteligencia artificial para transformar archivos fotográficos en videos cortos para redes sociales

La aplicación Reelful, recientemente lanzada para dispositivos iOS, emplea inteligencia artificial para convertir de manera automática fotografías y clips de video almacenados en el teléfono del usuario en piezas audiovisuales cortas optimizadas para plataformas como TikTok e Instagram Reels. La plataforma fue desarrollada por Kate Deyneka, ex ingeniera de aprendizaje automático en la compañía Snapchat, y actualmente participa en el programa de aceleración Speedrun de la firma de capital de riesgo Andreessen Horowitz. El lanzamiento se inscribe en una tendencia creciente de soluciones basadas en inteligencia artificial orientadas a automatizar la producción de contenido digital para usuarios individuales y empresas.

15 jul 20264 min
Anthropic y Blackstone crean Ode, empresa de implementación de inteligencia artificial valorada en USD 1.500 millones
IA

Anthropic y Blackstone crean Ode, empresa de implementación de inteligencia artificial valorada en USD 1.500 millones

La nueva compañía, fruto de una alianza entre el laboratorio de inteligencia artificial Anthropic y el fondo de inversión Blackstone, busca cerrar la brecha entre el desarrollo de modelos avanzados y su adopción efectiva por grandes corporaciones. La empresa absorberá a la startup Fractional AI y proyecta posicionarse como un actor relevante en el segmento de servicios profesionales de inteligencia artificial. La iniciativa replica los pasos de OpenAI, que recientemente lanzó una propuesta equivalente.

15 jul 20263 min
Plataforma de comercio en vivo Whatnot adquiere firma de inteligencia artificial Shaped para reforzar su motor de recomendaciones
IA

Plataforma de comercio en vivo Whatnot adquiere firma de inteligencia artificial Shaped para reforzar su motor de recomendaciones

Whatnot, aplicación de comercio en vivo, anunció la adquisición de Shaped, empresa especializada en sistemas de recomendación y búsqueda en tiempo real basados en inteligencia artificial. La operación busca fortalecer las capacidades de personalización de la plataforma, que procesa más de 500.000 horas de video en vivo cada semana. La adquisición coincide con un ciclo de fuerte crecimiento para Whatnot, que superó los mil millones de pedidos por parte de vendedores y fue recientemente valorizada en más de 11.000 millones de dólares.

15 jul 20263 min