Saltar al contenido
cassi.aiVideo Lab
Solicitar acceso

00:00:00 · Automatización del análisis de videos etnográficos

Todos los videos del estudio, leídos a fondo por IA. La prueba en cada conclusión.

Un lote entero de grabaciones de test en el hogar entra de una vez y sale leído escena por escena: habla transcrita, objetos, envases y gestos identificados, y lo que cada persona dice puesto al lado de lo que hace. La participante dice una tapa y vierte una tapa y media. Toda conclusión lleva la marca de tiempo y el fotograma.

Datos ilustrativos. Las escenas avanzan solas.

00:01:00 · El trabajo

Cincuenta participantes graban tres momentos de uso. Alguien tiene que verlo todo.

El video es lo más cerca que el investigador llega del momento real de uso. También es el material que más tarda en convertirse en número.

Tema

Video etnográfico y test de producto en el hogar

Tests de uso en el hogar (IHUT), diarios de consumo, unboxings. El participante graba el momento real de uso, y la grabación muestra lo que ningún cuestionario captura: la mano, el envase, la dosis, la duda.

Cómo se hace hoy

Ver a 1,5x y llenar una planilla

Un estudio con 50 participantes que graban 3 momentos de uso genera más de 25 horas de video en bruto. El equipo lo ve acelerado y registra cada comportamiento a mano. Entre el cierre del campo y el informe ejecutivo suelen pasar más de 20 días hábiles.

El dolor

Nadie tiene tiempo de medir lo dicho frente a lo hecho

Como el registro humano es pesado, la muestra se queda pequeña, de 10 a 15 personas. Y la lectura más valiosa del estudio, la distancia entre el comportamiento declarado en el cuestionario y el comportamiento grabado en video, queda en la impresión de quien lo vio.

Dónde entra Cassi.ai

Cada video leído escena por escena, con evidencia

Video Lab descompone cada grabación escena por escena, transcribe el habla con marcas de tiempo, identifica objetos, envases y gestos, y cruza habla con acción. El resultado son KPIs de comportamiento en los que toda conclusión apunta a la marca de tiempo y al fotograma.

El cuestionario registra lo que la persona declara. El video registra lo que hace. El hallazgo vive en la distancia entre los dos.

00:02:00 · Qué responde

Lo que responden las grabaciones cuando todas fueron vistas.

Cada parte de la plataforma existe porque el investigador le hace esta pregunta a un estudio en video antes de firmar el informe.

"¿Usan el producto como dicen que lo usan?"

Dicho frente a hechodeclarado y observado

El autorreporte y la evidencia física quedan en la misma tabla, comportamiento por comportamiento, con el tamaño del desvío. La distancia entre cuestionario y video se vuelve un número medido.

"¿En qué punto del video pasa eso?"

Marca de tiempo y fotogramapor conclusión

Toda conclusión lleva al segundo de la grabación y al fotograma que la sostiene. Cualquier persona en la reunión puede abrir la evidencia y comprobarla.

"¿Qué tomó de verdad el participante?"

Objetos, envases, gestospor segmento

La visión computacional describe cada segmento: el envase en la mesada, la tapa dosificadora, la mano que da vuelta la ropa. La identificación de marca y de producto pasa por revisión humana antes de darse por cierta.

"¿Y si la cámara no lo mostró?"

Desconocido, no visibleregla de escepticismo

El campo que el video no sostiene se marca como desconocido, no visible o no aplicable. La plataforma deja el vacío en la base y envía el ítem incierto a una persona.

"¿Puedo cortarlo por perfil?"

Dashboard y baseCSV, Excel, SPSS

La base consolidada alimenta un dashboard con varios proyectos y filtros por perfil, y sale tabulada en CSV, Excel y SPSS para los cruces que tu equipo corre por su cuenta.

"¿Puedo mostrarle el fragmento a la dirección?"

Biblioteca de clipsrostros bajo mosaico

Los momentos principales se convierten en una biblioteca de clips anonimizados, con los rostros protegidos por mosaico, listos para la presentación ejecutiva.

00:03:00 · Método

Seis pasos del archivo en bruto al informe, con una persona revisando lo incierto.

La misma secuencia corre en todos los videos, así que el participante 3 y el participante 47 se leen con el mismo criterio. Para un lote típico de 50 participantes, la meta de procesamiento es de menos de 2 horas.

  1. 01

    Inventario de los videos

    Cada archivo se lista y recibe una huella digital, una firma única calculada a partir de su contenido, junto con el audio y los metadatos técnicos.

    Ningún video se procesa dos veces ni queda afuera.

  2. 02

    Fotogramas clave y hoja de contactos

    La plataforma extrae los fotogramas clave de cada grabación y arma una hoja de contactos, el video entero de un vistazo.

    Cada fotograma conserva su marca de tiempo.

  3. 03

    Transcribir y observar

    El habla se transcribe con marcas de tiempo. Cada segmento recibe una observación visual: objetos, envases, gestos y el orden en que ocurren las cosas.

    Habla y acción en la misma línea de tiempo.

  4. 04

    Extraer los KPIs

    Cada video se convierte en la misma estructura fija de KPIs de comportamiento, para que los participantes puedan compararse y tabularse.

    Lo que no aparece se marca como no visible.

  5. 05

    Validar y revisar

    Estructura y confianza se comprueban en cada salida. Los ítems inciertos van a una cola de revisión humana antes de entrar en la base.

    Regla: el 95% de las salidas de KPI debe pasar la validación de estructura.

  6. 06

    Consolidar y entregar

    Las salidas revisadas forman una base consolidada, de la que salen los insights, las citas, los fotogramas y el informe.

    Ninguna conclusión sin marca de tiempo y fotograma.

00:04:00 · Los números

Dos números del flujo manual, una meta y una regla.

Los dos primeros describen cómo se hace el trabajo hoy. Los dos últimos dicen cómo fue construido Video Lab para funcionar. Ninguno es una promesa sobre tu estudio.

25+ hde video en bruto en un estudio típico con 50 participantes que graban 3 momentos de uso
20+ díashábiles entre el cierre del campo y el informe ejecutivo en el flujo manual
< 2 hes la meta de procesamiento de ese mismo lote en Video Lab
95%de las salidas de KPI debe pasar la validación de estructura, la regla técnica de aceptación del producto

Lo que nunca hace

  • Nunca inventa lo que no está visible. El campo se marca como desconocido, no visible o no aplicable.
  • Nunca da por perfecta una identificación de marca o de producto sin revisión humana.
  • Nunca infiere datos sensibles que no estén visibles en el video.
  • Nunca muestra una conclusión sin marca de tiempo y fotograma.
  • Nunca publica un clip sin protección de rostro.

Para quién es

  • Direcciones de insights
  • Gerentes y analistas de investigación
  • Institutos de investigación
  • Agencias con estudios cualitativos en video

Para equipos que ya recogen video y quieren la muestra entera leída con el mismo criterio, con la evidencia a un clic.

00:05:00 · Preguntas

Preguntas y respuestas

¿Qué es Video Lab?

Video Lab es una plataforma de Cassi.ai que analiza videos etnográficos y tests de producto en el hogar con visión computacional y modelos de lenguaje multimodales. Descompone el video escena por escena, transcribe el habla con marcas de tiempo, identifica objetos, envases y gestos, y cruza lo que la persona dice con lo que la persona hace.

¿Qué tipo de video analiza?

Grabaciones hechas por los participantes en casa o en contexto: tests de uso en el hogar (IHUT), diarios de consumo, unboxings y videos etnográficos en general. El caso típico es el estudio en el que cada participante graba varios momentos de uso de un producto.

¿Cómo compara lo que la persona dice con lo que hace?

La transcripción y la observación visual comparten la misma línea de tiempo. Para cada comportamiento, la plataforma registra lo declarado, en el habla o en el cuestionario, y lo que el video muestra físicamente, e informa el desvío entre los dos con la marca de tiempo y el fotograma de la evidencia.

¿Qué pasa cuando algo no se ve en el video?

El campo se marca como desconocido, no visible o no aplicable. Video Lab nunca llena un vacío con una suposición. Los ítems con baja confianza van a una cola de revisión humana antes de entrar en la base consolidada.

¿Identifica marcas y productos por su cuenta?

Detecta envases y objetos en la escena y sugiere qué son. Una identificación de marca o de producto nunca se da por perfecta sin revisión humana, así que esos ítems pasan por una persona antes de llegar al informe.

¿Cuánto tarda el procesamiento?

Un estudio típico con 50 participantes que graban 3 momentos de uso genera más de 25 horas de video en bruto, y el flujo manual suele tardar más de 20 días hábiles hasta el informe ejecutivo. La meta de procesamiento de ese mismo lote en Video Lab es de menos de 2 horas, seguida de la revisión humana de los ítems inciertos.

¿Cómo se cuida la privacidad de los participantes?

Los clips que salen de la plataforma llevan los rostros protegidos por mosaico, y ningún clip se publica sin esa protección. Video Lab tampoco infiere datos sensibles que no estén visibles en el video.

¿Qué recibo al final?

Una presentación ejecutiva interactiva en la web con fotogramas de los videos, un dashboard con varios proyectos y filtros por perfil, una base tabulada exportable a CSV, Excel y SPSS, un informe estratégico y una biblioteca de clips anonimizados.

Trae un estudio en video que conozcas bien.

Cuéntanos de un estudio en curso, o de uno que tu equipo ya leyó a mano. Mostramos cómo Video Lab trata ese tipo de lote y recorremos una presentación de resultados, con la marca de tiempo y el fotograma detrás de cada conclusión.

Llega directo al equipo de Cassi.ai y no entra en ninguna lista de envío.