Files
gart/.claude/skills/editar-por-voz/criterios/09-analise-incompleta.md
T

1.6 KiB

09 — Quando a análise veio incompleta

O bloco layers no topo do JSON diz o que de fato rodou. Leia antes de qualquer outra coisa.

"layers": {"transcript": true, "acoustics": false, "speakers": false}

Por que esse bloco existe

Fala monótona e acústica que não carregou deixam os mesmos zeros nos dados. Sem o layers, é impossível distinguir "esta pessoa fala de forma uniforme" de "a análise acústica falhou".

Os casos

acoustics: false

Todos os valores acústicos são 0. Você não tem ênfase real.

  • Decida só pelo texto.
  • Avise o usuário explicitamente.
  • Prefira marker a zoom — sinalize em vez de decidir.

Causa comum: o componente librosa não está instalado, ou o ffmpeg não conseguiu extrair o áudio do container.

speakers: false num vídeo com várias pessoas

A diarização não rodou — falta o token do HuggingFace (aba Modelos do app).

  • Avise antes de tratar tudo como uma voz só.
  • Lembre que isso não impede a triagem roteiro/conversa, que é feita pelo texto (ver 02-triagem-roteiro-vs-conversa.md).

peak_count: 0

Nada cruzou o piso de ênfase. Duas causas possíveis:

  1. A fala é uniforme mesmo — material sem picos.
  2. O limiar está alto para esse material.

Sugira ajustar em Análise de Voz no app. Não force destaques inexistentes só para entregar alguma coisa.

Regra geral

Não finja precisão que você não tem. Uma edição entregue com a ressalva certa é útil; uma entregue como se estivesse completa, quando metade dos dados faltou, custa a confiança do usuário no sistema inteiro.