# Video Lab: análise de vídeo etnográfico e IHUT com IA

O Video Lab é uma plataforma da [Cassi.ai](https://www.cassiai.com) que analisa vídeos etnográficos e testes de produto em casa, como testes de uso em casa (IHUT), diários de consumo e unboxings, com visão computacional e modelos de linguagem multimodais. Decompõe o vídeo cena a cena, transcreve a fala com minutagem, identifica objetos, embalagens e gestos, e cruza o que a pessoa diz com o que a pessoa faz. A saída é um conjunto de KPIs comportamentais em que toda conclusão traz a minutagem e o frame como evidência.

## Cinquenta participantes gravam três momentos de uso. Alguém precisa assistir a tudo.

O vídeo é o mais perto que o pesquisador chega do momento real de uso. É também o material que mais demora para virar número.

- Tema: Vídeo etnográfico e teste de produto em casa. Testes de uso em casa (IHUT), diários de consumo, unboxings. O participante grava o momento real de uso, e a gravação mostra o que nenhum questionário captura: a mão, a embalagem, a dose, a hesitação.
- Como é feito hoje: Assistir em 1,5x e preencher planilha. Um estudo com 50 participantes gravando 3 momentos de uso gera mais de 25 horas de vídeo bruto. A equipe assiste acelerado e registra cada comportamento à mão. Entre o fim do campo e o relatório executivo costumam passar mais de 20 dias úteis.
- A dor: Ninguém tem tempo de medir o dito contra o feito. Como o registro humano é pesado, a amostra fica pequena, de 10 a 15 pessoas. E a leitura mais valiosa do estudo, a distância entre o comportamento declarado no questionário e o comportamento gravado em vídeo, fica na impressão de quem assistiu.
- Onde a Cassi.ai entra: Todo vídeo lido cena a cena, com evidência. O Video Lab decompõe cada gravação cena a cena, transcreve a fala com minutagem, identifica objetos, embalagens e gestos, e cruza fala com ação. O resultado são KPIs comportamentais em que toda conclusão aponta para a minutagem e o frame.

## O que as gravações respondem quando todas foram assistidas.

- Dito contra feito ("Eles usam o produto do jeito que dizem usar?"): O autorrelato e a evidência física ficam na mesma tabela, comportamento por comportamento, com o tamanho do desvio. A distância entre questionário e vídeo vira número medido.
- Minutagem e frame ("Em que ponto do vídeo isso acontece?"): Toda conclusão leva ao segundo da gravação e ao frame que a sustenta. Qualquer pessoa na reunião consegue abrir a evidência e conferir.
- Objetos, embalagens, gestos ("O que o participante pegou de fato?"): A visão computacional descreve cada segmento: a embalagem na bancada, a tampa dosadora, a mão virando a roupa do avesso. Identificação de marca e de produto passa por revisão humana antes de ser dada como certa.
- Desconhecido, não visível ("E se a câmera não mostrou?"): O campo que o vídeo não sustenta é marcado como desconhecido, não visível ou não aplicável. A plataforma deixa a lacuna na base e manda o item incerto para uma pessoa.
- Dashboard e base ("Dá para cortar por perfil?"): A base consolidada alimenta um dashboard com vários projetos e filtros por perfil, e sai tabulada em CSV, Excel e SPSS para os cruzamentos que a sua equipe roda por conta própria.
- Biblioteca de clipes ("Posso mostrar o trecho para a diretoria?"): Os momentos principais viram uma biblioteca de clipes anonimizados, com os rostos protegidos por mosaico, prontos para a apresentação executiva.

## Seis passos do arquivo bruto ao relatório, com uma pessoa revisando o que é incerto.

1. Inventário dos vídeos. Todo arquivo é listado e recebe uma impressão digital, uma assinatura única calculada a partir do conteúdo, junto com o áudio e os metadados técnicos. Nenhum vídeo é processado duas vezes nem fica de fora.
2. Quadros-chave e folha de contato. A plataforma extrai os quadros-chave de cada gravação e monta uma folha de contato, o vídeo inteiro num relance. Todo quadro mantém a sua minutagem.
3. Transcrever e observar. A fala é transcrita com minutagem. Cada segmento recebe uma observação visual: objetos, embalagens, gestos e a ordem em que as coisas acontecem. Fala e ação na mesma linha do tempo.
4. Extrair os KPIs. Cada vídeo é convertido na mesma estrutura fixa de KPIs comportamentais, para que os participantes possam ser comparados e tabulados. O que não aparece é marcado como não visível.
5. Validar e revisar. Estrutura e confiança são conferidas em toda saída. Os itens incertos vão para uma fila de revisão humana antes de entrar na base. Regra: 95% das saídas de KPI precisam passar na validação de estrutura.
6. Consolidar e entregar. As saídas revisadas formam uma base consolidada, de onde saem os insights, as citações, os frames e o relatório. Nenhuma conclusão sem minutagem e frame.

## Dois números do fluxo manual, uma meta e uma regra.

- 25+ h: de vídeo bruto num estudo típico com 50 participantes gravando 3 momentos de uso
- 20+ dias: úteis entre o fim do campo e o relatório executivo no fluxo manual
- < 2 h: é a meta de processamento desse mesmo lote no Video Lab
- 95%: das saídas de KPI precisam passar na validação de estrutura, a regra técnica de aceite do produto

## O que ele nunca faz

- Nunca inventa o que não está visível. O campo é marcado como desconhecido, não visível ou não aplicável.
- Nunca dá uma identificação de marca ou de produto como perfeita sem revisão humana.
- Nunca infere dado sensível que não esteja visível no vídeo.
- Nunca mostra uma conclusão sem minutagem e frame.
- Nunca publica um clipe sem proteção de rosto.

## Para quem é

Diretorias de insights, Gerentes e analistas de pesquisa, Institutos de pesquisa, Agências com estudos qualitativos em vídeo. Para equipes que já coletam vídeo e querem a amostra inteira lida com o mesmo critério, com a evidência a um clique.

## Perguntas e respostas

### O que é o Video Lab?

O Video Lab é uma plataforma da Cassi.ai que analisa vídeos etnográficos e testes de produto em casa com visão computacional e modelos de linguagem multimodais. Decompõe o vídeo cena a cena, transcreve a fala com minutagem, identifica objetos, embalagens e gestos, e cruza o que a pessoa diz com o que a pessoa faz.

### Que tipo de vídeo ele analisa?

Gravações feitas pelos participantes em casa ou em contexto: testes de uso em casa (IHUT), diários de consumo, unboxings e vídeos etnográficos em geral. O caso típico é o estudo em que cada participante grava vários momentos de uso de um produto.

### Como ele compara o que a pessoa diz com o que ela faz?

A transcrição e a observação visual dividem a mesma linha do tempo. Para cada comportamento, a plataforma registra o que foi declarado, na fala ou no questionário, e o que o vídeo mostra fisicamente, e informa o desvio entre os dois com a minutagem e o frame da evidência.

### O que acontece quando algo não aparece no vídeo?

O campo é marcado como desconhecido, não visível ou não aplicável. O Video Lab nunca preenche uma lacuna com palpite. Os itens com baixa confiança vão para uma fila de revisão humana antes de entrar na base consolidada.

### Ele identifica marcas e produtos sozinho?

Ele detecta embalagens e objetos na cena e sugere o que são. Uma identificação de marca ou de produto nunca é dada como perfeita sem revisão humana, então esses itens passam por uma pessoa antes de chegar ao relatório.

### Quanto tempo leva o processamento?

Um estudo típico com 50 participantes gravando 3 momentos de uso gera mais de 25 horas de vídeo bruto, e o fluxo manual costuma levar mais de 20 dias úteis até o relatório executivo. A meta de processamento desse mesmo lote no Video Lab é de menos de 2 horas, seguida da revisão humana dos itens incertos.

### Como fica a privacidade dos participantes?

Os clipes que saem da plataforma têm os rostos protegidos por mosaico, e nenhum clipe é publicado sem essa proteção. O Video Lab também nunca infere dado sensível que não esteja visível no vídeo.

### O que eu recebo no final?

Uma apresentação executiva interativa na web com frames dos vídeos, um dashboard com vários projetos e filtros por perfil, uma base tabulada exportável para CSV, Excel e SPSS, um relatório estratégico e uma biblioteca de clipes anonimizados.

## Traga um estudo em vídeo que você conhece bem.

Conte sobre um estudo em andamento, ou um que a sua equipe já leu à mão. Mostramos como o Video Lab trata esse tipo de lote e percorremos uma apresentação de resultados, com a minutagem e o frame por trás de cada conclusão. https://videolab.cassiai.com/pt/#acesso
