Files
gart/.claude/skills/editar-por-voz/criterios/03-escolha-da-melhor-tomada.md
T
João HenriqueandClaude Opus 5 cbd9297751 docs(skill): alinhar editar-por-voz com a revisão humana da etapa 5
A skill decidia a edição sem saber que o JSON dela agora passa por uma tela
de revisão antes de virar FCPXML. Isso não é detalhe de fluxo: a etapa 5
traduz cada ação para o vocabulário dela, e sem conhecer essa tradução a
intenção da IA se perde no caminho — que é exatamente como uma decisão vira
"arbitrária" aos olhos de quem revisa.

Novo criterios/10-revisao-humana.md, com o que o app faz com cada ação:

- cut cobrindo >=60% da frase remove a linha; tocando só uma borda vira trim
  encaixado na fronteira de palavra. Corte de meia frase é ambíguo — passa
  do limiar e apaga a linha toda quando a intenção era aparar a hesitação.
- zoom ou text sobre uma frase marca ênfase, e ênfase significa DUAS coisas:
  zoom mais legenda dinâmica; as demais frases ficam com legenda comum. A
  escala vira o nível (1.15→leve, 1.3→média, 1.5→forte).
- sem ação, o nível é derivado do peak_emphasis; a decisão da IA sempre ganha.
- reason é exibido ao lado da frase na tela — é o que o editor lê antes de
  manter ou desfazer. Deixou de ser campo de log.

Consequência prática que faltava em 05-zoom.md: não espalhar zoom "por
segurança", porque cada um promove a frase em duas dimensões ao mesmo tempo.
Na dúvida, deixar sem — promover custa uma tecla, despromover custa mais.

Cada arquivo de critério ganhou cabeçalho de escopo (o que cobre, em que
fase), no mesmo padrão dos docs do Engine, para ler só o necessário.

Todas as afirmações numéricas do novo critério foram verificadas contra
fcpxml/phrase_review.py rodando, não assumidas.

Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
2026-08-19 22:54:51 -04:00

64 lines
2.3 KiB
Markdown

# 03 — Escolha da melhor tomada
> **Escopo:** Qual tomada de cada frase sobrevive, e o que fazer em caso de empate.
> **Quando:** Fase 3 — ver a ordem de trabalho em `../SKILL.md`.
A mesma frase costuma aparecer 2, 3, 4 vezes. Seu trabalho é ficar com
**uma**.
## Como agrupar
1. Use `take_boundary` para localizar onde cada tomada recomeça.
2. Agrupe as repetições **pelo texto**, não pelo tempo — a mesma frase
reaparece em pontos distantes da gravação. Num caso real, a abertura
*"Aquela mama com um formato mais estruturado"* apareceu aos 2,0s, 64,9s
e 86,4s.
## Critérios, nesta ordem
### 1. Completa
Não morre no meio, não emenda numa pergunta. Uma tomada incompleta está
descartada por definição, mesmo que a dicção seja ótima.
### 2. Dicção limpa
Sem tropeço, sem repetição de palavra, sem vício de linguagem. **Compare os
textos lado a lado:**
| Tomada 1 | Tomada 3 | Escolha |
|---|---|---|
| *"isso é desejo de muitas mulheres"* | *"**aí** isso é desejo de muitas mulheres"* | Tomada 1 |
### 3. Formulação melhor
Quando as duas estão limpas, prefira a mais direta — normalmente a última,
porque é onde a pessoa já se ajustou:
| Antes | Depois | Escolha |
|---|---|---|
| *"a gente **faz a inserção de** próteses"* | *"a gente **insere** próteses"* | a segunda |
| *"reestrutura a mama"* | *"reestrutura a **sua** mama"* | a segunda |
### 4. Entrega
**Só então** desempate por `avg_energy` / `peak_emphasis`.
Quando duas tomadas têm texto **idêntico palavra por palavra**, aí a
energia decide sozinha — é o único sinal disponível. Caso real: o fecho
tinha duas tomadas iguais, energia **0,38** e **0,19**. A de 0,38 é a boa,
e o texto sozinho jamais diria isso.
## Regra de ouro
A **última** tomada costuma ser a melhor — é onde a pessoa acertou. Mas
**confirme lendo o texto**; nunca assuma.
## Quando estiver em dúvida
Não decida no escuro. Coloque um `marker` nas duas candidatas, explique a
dúvida no `reason`, e deixe a escolha para o editor humano.
## Continuidade
Ao montar o corte final você pode misturar blocos de tomadas diferentes —
abertura da tomada 1, corpo da tomada 3. Isso é normal. Mas **avise nas
emendas**: coloque um `marker` em cada junção para o editor conferir se o
enquadramento e a posição da pessoa combinam.