49 lines
1.6 KiB
Markdown
49 lines
1.6 KiB
Markdown
# 09 — Quando a análise veio incompleta
|
|
|
|
O bloco `layers` no topo do JSON diz **o que de fato rodou**. Leia antes de
|
|
qualquer outra coisa.
|
|
|
|
```json
|
|
"layers": {"transcript": true, "acoustics": false, "speakers": false}
|
|
```
|
|
|
|
## Por que esse bloco existe
|
|
|
|
Fala monótona e acústica que não carregou deixam **os mesmos zeros** nos
|
|
dados. Sem o `layers`, é impossível distinguir "esta pessoa fala de forma
|
|
uniforme" de "a análise acústica falhou".
|
|
|
|
## Os casos
|
|
|
|
### `acoustics: false`
|
|
Todos os valores acústicos são 0. **Você não tem ênfase real.**
|
|
|
|
- Decida só pelo texto.
|
|
- **Avise o usuário** explicitamente.
|
|
- Prefira `marker` a `zoom` — sinalize em vez de decidir.
|
|
|
|
Causa comum: o componente librosa não está instalado, ou o ffmpeg não
|
|
conseguiu extrair o áudio do container.
|
|
|
|
### `speakers: false` num vídeo com várias pessoas
|
|
A diarização não rodou — falta o token do HuggingFace (aba Modelos do app).
|
|
|
|
- Avise antes de tratar tudo como uma voz só.
|
|
- Lembre que isso **não impede** a triagem roteiro/conversa, que é feita
|
|
pelo texto (ver `02-triagem-roteiro-vs-conversa.md`).
|
|
|
|
### `peak_count: 0`
|
|
Nada cruzou o piso de ênfase. Duas causas possíveis:
|
|
|
|
1. A fala é uniforme mesmo — material sem picos.
|
|
2. O limiar está alto para esse material.
|
|
|
|
Sugira ajustar em **Análise de Voz** no app. **Não force destaques
|
|
inexistentes** só para entregar alguma coisa.
|
|
|
|
## Regra geral
|
|
|
|
Não finja precisão que você não tem. Uma edição entregue com a ressalva
|
|
certa é útil; uma entregue como se estivesse completa, quando metade dos
|
|
dados faltou, custa a confiança do usuário no sistema inteiro.
|