536380e793
Trim silenzio iniziale/finale (VAD energia RMS, numpy+soundfile): meno audio da processare, meno allucinazioni; timestamp riallineati con offset; TRIM_SILENCE=0 per disattivare, TRIM_THRESHOLD_DB/TRIM_PADDING_MS configurabili; flag --no-trim
master
Matteo Benedetto2026-08-21 15:12:27 +02:00
0b583ab39d
initial_prompt personale + glossario: POST /transcribe accetta prompt e glossary (normalizzazione alias->canonical post-ASR, raw_text/segments[].raw), GET/PUT /glossary con GLOSSARY_FILE, glossary.example.json, --prompt/--carry-initial-prompt in transcribe.py
Matteo Benedetto2026-08-21 12:55:53 +02:00
87bcbd49b0
fix: torchaudio 2.9.1 CPU allineato a torch (pyannote tirava 2.11 da PyPI, mismatch)
enne22026-08-13 22:36:37 +02:00