Matteo Benedetto
|
536380e793
|
Trim silenzio iniziale/finale (VAD energia RMS, numpy+soundfile): meno audio da processare, meno allucinazioni; timestamp riallineati con offset; TRIM_SILENCE=0 per disattivare, TRIM_THRESHOLD_DB/TRIM_PADDING_MS configurabili; flag --no-trim
|
2026-08-21 15:12:27 +02:00 |
|
Matteo Benedetto
|
0b583ab39d
|
initial_prompt personale + glossario: POST /transcribe accetta prompt e glossary (normalizzazione alias->canonical post-ASR, raw_text/segments[].raw), GET/PUT /glossary con GLOSSARY_FILE, glossary.example.json, --prompt/--carry-initial-prompt in transcribe.py
|
2026-08-21 12:55:53 +02:00 |
|
enne2
|
87bcbd49b0
|
fix: torchaudio 2.9.1 CPU allineato a torch (pyannote tirava 2.11 da PyPI, mismatch)
|
2026-08-13 22:36:37 +02:00 |
|
enne2
|
2b9442f33e
|
stt-server: FastAPI whisper.cpp Vulkan ASR + pyannote diarization, containerizzato
|
2026-08-13 22:29:30 +02:00 |
|