criado repositório jhonny-editor no Gitea adicionado script admin/deploy.command com commit automático atualizado admin/DEV-NOTES.md com template limpo Resumo: - 32 arquivos alterados - 16 novos - 15 modificados - 0 removidos 16 files changed, 638 insertions(+), 61 deletions(-) Arquivos: - code/engine/skills/boas-praticas-oo.md -> .agents/skills/boas-praticas-oo/SKILL.md - AGENTS.md - code/cep-plugin/index.html - code/cep-plugin/main.js - code/cep-plugin/styles.css - code/engine/integracoes/visual/apple_vision.py - code/engine/integracoes/visual/apple_vision_runner.swift - code/engine/integracoes/visual/extrator_ffmpeg.py - code/engine/scanner/__init__.py - code/engine/scanner/configuracao_visual.py - code/engine/scanner/coordenacao/__init__.py - code/engine/scanner/retakes/adaptador_de_falas.py - code/engine/scanner/retakes/agrupador_de_takes.py - code/engine/scanner/retakes/detector_de_reinicios.py - code/engine/scanner/retakes/modelos_de_retakes.py - code/engine/scanner/visual.py - .jhonny/ - .retakes/ - CODING_STANDARDS.md - code/engine/executar_retakes.py - code/engine/persistencia/ - code/engine/scanner/retakes/__init__.py - code/engine/scanner/retakes/carregador_de_artefatos.py - code/engine/scanner/retakes/classificador_de_retakes.py - code/engine/scanner/retakes/coordenador_de_retakes.py - code/engine/scanner/retakes/deteccao_de_retakes.py - code/engine/scanner/retakes/gerador_de_evidencias.py - code/engine/scanner/retakes/repositorio_de_retakes.py - code/engine/testes/test_consultas_de_persistencia.py - code/engine/testes/test_deteccao_de_retakes.py - code/engine/testes/test_persistencia_sqlite.py - code/relatorios/audio/arquivos/92f97877259a86a8095b1eecafdefe357212a12247d04b78df60e0c0ae38b2ea/
146 lines
7.2 KiB
Python
146 lines
7.2 KiB
Python
"""Persistência SQLite de metadados de arquivo, transcrição e evidências visuais.
|
|
|
|
Complementa ``RepositorioDeRetakesSQLite`` gravando o restante do que o
|
|
``ContextoDeAnalise`` do pipeline produz e que hoje só vive em memória
|
|
(metadados técnicos) ou em cache JSON por arquivo (transcrição).
|
|
"""
|
|
|
|
from __future__ import annotations
|
|
|
|
import json
|
|
import sqlite3
|
|
from pathlib import Path
|
|
from typing import Iterable
|
|
|
|
from ..integracoes.midia.extracao_de_metadados import MetadadosDoArquivo
|
|
from ..scanner.modelos import Cena, EvidenciaVisual, PalavraDeTranscricao, SegmentoDeTranscricao
|
|
from ..scanner.transcricao_da_timeline import TranscricaoDoClipe
|
|
from .conexao import abrir_banco
|
|
|
|
|
|
class RepositorioDeAnalisesSQLite:
|
|
"""Grava metadados de arquivo, transcrição e evidências/cenas visuais."""
|
|
|
|
def __init__(self, banco: str | Path | sqlite3.Connection = ".jhonny/analises.db") -> None:
|
|
self.conexao = banco if isinstance(banco, sqlite3.Connection) else abrir_banco(banco)
|
|
|
|
def _garantir_video(self, video_id: str) -> None:
|
|
self.conexao.execute("INSERT OR IGNORE INTO videos (id) VALUES (?)", (video_id,))
|
|
|
|
def registrar_metadados_de_arquivo(
|
|
self, video_id: str, metadados: MetadadosDoArquivo, hash_do_conteudo: str | None = None,
|
|
) -> None:
|
|
with self.conexao:
|
|
self._garantir_video(video_id)
|
|
self.conexao.execute(
|
|
"""INSERT INTO arquivos
|
|
(video_id, caminho, formato, duracao, codec_de_video, codec_de_audio,
|
|
largura, altura, taxa_de_quadros, canais_de_audio, taxa_de_amostragem,
|
|
tamanho_em_bytes, orientacao, timecode, hash_do_conteudo)
|
|
VALUES (?, ?, ?, ?, ?, ?, ?, ?, ?, ?, ?, ?, ?, ?, ?)
|
|
ON CONFLICT (video_id, caminho) DO UPDATE SET
|
|
formato = excluded.formato, duracao = excluded.duracao,
|
|
codec_de_video = excluded.codec_de_video,
|
|
codec_de_audio = excluded.codec_de_audio,
|
|
largura = excluded.largura, altura = excluded.altura,
|
|
taxa_de_quadros = excluded.taxa_de_quadros,
|
|
canais_de_audio = excluded.canais_de_audio,
|
|
taxa_de_amostragem = excluded.taxa_de_amostragem,
|
|
tamanho_em_bytes = excluded.tamanho_em_bytes,
|
|
orientacao = excluded.orientacao, timecode = excluded.timecode,
|
|
hash_do_conteudo = excluded.hash_do_conteudo""",
|
|
(video_id, str(metadados.caminho), metadados.formato, metadados.duracao,
|
|
metadados.codec_de_video, metadados.codec_de_audio, metadados.largura,
|
|
metadados.altura, metadados.taxa_de_quadros, metadados.canais_de_audio,
|
|
metadados.taxa_de_amostragem, metadados.tamanho_em_bytes,
|
|
metadados.orientacao, metadados.timecode, hash_do_conteudo),
|
|
)
|
|
|
|
def registrar_transcricoes(
|
|
self, video_id: str, transcricoes: Iterable[TranscricaoDoClipe],
|
|
) -> None:
|
|
with self.conexao:
|
|
self._garantir_video(video_id)
|
|
for transcricao in transcricoes:
|
|
for segmento in transcricao.segmentos:
|
|
self._inserir_segmento(video_id, transcricao.identificador_do_clipe, segmento)
|
|
|
|
def _inserir_segmento(
|
|
self, video_id: str, clipe_id: str, segmento: SegmentoDeTranscricao,
|
|
) -> int:
|
|
cursor = self.conexao.execute(
|
|
"""INSERT INTO segmentos_de_transcricao
|
|
(video_id, clipe_id, inicio, fim, texto, confianca, falante, voz_aparente,
|
|
confianca_voz, emocao, confianca_emocao, caracteristicas_acusticas)
|
|
VALUES (?, ?, ?, ?, ?, ?, ?, ?, ?, ?, ?, ?)""",
|
|
(video_id, clipe_id, segmento.inicio, segmento.fim, segmento.texto,
|
|
segmento.confianca, segmento.falante, segmento.voz_aparente,
|
|
segmento.confianca_voz, segmento.emocao, segmento.confianca_emocao,
|
|
json.dumps(segmento.caracteristicas_acusticas, ensure_ascii=False)),
|
|
)
|
|
segmento_id = cursor.lastrowid
|
|
for ordem, palavra in enumerate(segmento.palavras):
|
|
self.conexao.execute(
|
|
"""INSERT INTO palavras_de_transcricao
|
|
(segmento_id, ordem, texto, inicio, fim, confianca, falante)
|
|
VALUES (?, ?, ?, ?, ?, ?, ?)""",
|
|
(segmento_id, ordem, palavra.texto, palavra.inicio, palavra.fim,
|
|
palavra.confianca, palavra.falante),
|
|
)
|
|
return segmento_id
|
|
|
|
def carregar_transcricoes(self, video_id: str, clipe_id: str) -> list[SegmentoDeTranscricao]:
|
|
segmentos: list[SegmentoDeTranscricao] = []
|
|
for linha in self.conexao.execute(
|
|
"""SELECT * FROM segmentos_de_transcricao
|
|
WHERE video_id = ? AND clipe_id = ? ORDER BY inicio""",
|
|
(video_id, clipe_id),
|
|
).fetchall():
|
|
palavras = tuple(
|
|
PalavraDeTranscricao(
|
|
texto=item["texto"], inicio=item["inicio"], fim=item["fim"],
|
|
confianca=item["confianca"], falante=item["falante"],
|
|
)
|
|
for item in self.conexao.execute(
|
|
"SELECT * FROM palavras_de_transcricao WHERE segmento_id = ? ORDER BY ordem",
|
|
(linha["id"],),
|
|
).fetchall()
|
|
)
|
|
segmentos.append(SegmentoDeTranscricao(
|
|
inicio=linha["inicio"], fim=linha["fim"], texto=linha["texto"],
|
|
confianca=linha["confianca"], palavras=palavras,
|
|
emocao=linha["emocao"], confianca_emocao=linha["confianca_emocao"],
|
|
caracteristicas_acusticas=json.loads(linha["caracteristicas_acusticas"] or "{}"),
|
|
falante=linha["falante"], voz_aparente=linha["voz_aparente"],
|
|
confianca_voz=linha["confianca_voz"],
|
|
))
|
|
return segmentos
|
|
|
|
def registrar_evidencias_visuais(
|
|
self, video_id: str, clipe_id: str, evidencias: Iterable[EvidenciaVisual],
|
|
) -> None:
|
|
with self.conexao:
|
|
self._garantir_video(video_id)
|
|
for evidencia in evidencias:
|
|
self.conexao.execute(
|
|
"""INSERT INTO evidencias_visuais
|
|
(video_id, clipe_id, tipo, inicio, fim, valor, confianca, provider, modelo)
|
|
VALUES (?, ?, ?, ?, ?, ?, ?, ?, ?)""",
|
|
(video_id, clipe_id, evidencia.tipo, evidencia.inicio, evidencia.fim,
|
|
json.dumps(evidencia.valor, ensure_ascii=False), evidencia.confianca,
|
|
evidencia.provider, evidencia.modelo),
|
|
)
|
|
|
|
def registrar_cenas(
|
|
self, video_id: str, cenas: Iterable[Cena], clipe_id: str | None = None,
|
|
) -> None:
|
|
with self.conexao:
|
|
self._garantir_video(video_id)
|
|
for cena in cenas:
|
|
self.conexao.execute(
|
|
"""INSERT INTO cenas (video_id, clipe_id, inicio, fim, confianca, referencias)
|
|
VALUES (?, ?, ?, ?, ?, ?)""",
|
|
(video_id, clipe_id, cena.inicio, cena.fim, cena.confianca,
|
|
json.dumps(list(cena.referencias))),
|
|
)
|