1.6 KiB
09 — Quando a análise veio incompleta
O bloco layers no topo do JSON diz o que de fato rodou. Leia antes de
qualquer outra coisa.
"layers": {"transcript": true, "acoustics": false, "speakers": false}
Por que esse bloco existe
Fala monótona e acústica que não carregou deixam os mesmos zeros nos
dados. Sem o layers, é impossível distinguir "esta pessoa fala de forma
uniforme" de "a análise acústica falhou".
Os casos
acoustics: false
Todos os valores acústicos são 0. Você não tem ênfase real.
- Decida só pelo texto.
- Avise o usuário explicitamente.
- Prefira
markerazoom— sinalize em vez de decidir.
Causa comum: o componente librosa não está instalado, ou o ffmpeg não conseguiu extrair o áudio do container.
speakers: false num vídeo com várias pessoas
A diarização não rodou — falta o token do HuggingFace (aba Modelos do app).
- Avise antes de tratar tudo como uma voz só.
- Lembre que isso não impede a triagem roteiro/conversa, que é feita
pelo texto (ver
02-triagem-roteiro-vs-conversa.md).
peak_count: 0
Nada cruzou o piso de ênfase. Duas causas possíveis:
- A fala é uniforme mesmo — material sem picos.
- O limiar está alto para esse material.
Sugira ajustar em Análise de Voz no app. Não force destaques inexistentes só para entregar alguma coisa.
Regra geral
Não finja precisão que você não tem. Uma edição entregue com a ressalva certa é útil; uma entregue como se estivesse completa, quando metade dos dados faltou, custa a confiança do usuário no sistema inteiro.