logs
This commit is contained in:
+23
-23
@@ -1,4 +1,4 @@
|
||||
[Qwen] qwentts.cpp 5442c2f (2026-05-31)
|
||||
[Qwen] qwentts.cpp 199a658 (2026-05-31)
|
||||
ggml_cuda_init: found 1 CUDA devices (Total VRAM: 97247 MiB):
|
||||
Device 0: NVIDIA RTX PRO 6000 Blackwell Workstation Edition, compute capability 12.0, VMM: yes, VRAM: 97247 MiB
|
||||
load_backend: loaded CUDA backend from /mnt/workspace/qwentts.cpp/build/libggml-cuda.so
|
||||
@@ -49,7 +49,7 @@ load_backend: loaded CPU backend from /mnt/workspace/qwentts.cpp/build/libggml-c
|
||||
[Debug] talker-hidden-prefill-l21: [40, 2048] first4: -0.771866 0.171123 0.791460 1.111815
|
||||
[Debug] talker-hidden-prefill-l27: [40, 2048] first4: 7.131226 -34.471634 -7.107933 28.674021
|
||||
[Debug] talker-hidden-prefill-final: [40, 2048] first4: 0.242833 -1.225767 -0.224904 0.890000
|
||||
[Debug] talker-logits-prefill: [3072] first4: -4.249261 -6.401361 -1.000070 -3.238883
|
||||
[Debug] talker-logits-prefill: [3072] first4: -4.248304 -6.401616 -0.999174 -3.239446
|
||||
[Sample] step=0 c0=1995 u=-1.0000000000 subseq=0
|
||||
[Sample-CP] g=0 c=1159 u=-1.0000000000 subseq=1
|
||||
[Sample-CP] g=1 c=355 u=-1.0000000000 subseq=2
|
||||
@@ -68,7 +68,7 @@ load_backend: loaded CPU backend from /mnt/workspace/qwentts.cpp/build/libggml-c
|
||||
[Sample-CP] g=14 c=901 u=-1.0000000000 subseq=15
|
||||
[Debug] codes-step0: [16] first4: 1995.000000 1159.000000 355.000000 22.000000
|
||||
[Debug] next-emb-step0: [2048] first4: -0.042911 -0.033715 -0.000281 0.188977
|
||||
[Debug] talker-hidden-step1: [2048] first4: 1.686836 -2.523117 6.789655 0.738593
|
||||
[Debug] talker-hidden-step1: [2048] first4: 1.686420 -2.523936 6.789628 0.738814
|
||||
[Sample] step=1 c0=215 u=-1.0000000000 subseq=16
|
||||
[Sample-CP] g=0 c=1722 u=-1.0000000000 subseq=17
|
||||
[Sample-CP] g=1 c=355 u=-1.0000000000 subseq=18
|
||||
@@ -96,14 +96,14 @@ load_backend: loaded CPU backend from /mnt/workspace/qwentts.cpp/build/libggml-c
|
||||
[Pipeline] Generation done : 64 frames
|
||||
[Debug] codes-full: [64, 16] first4: 1995.000000 1159.000000 355.000000 22.000000
|
||||
[Debug] output-audio: [122880] first4: 0.000015 0.000017 0.000014 0.000016
|
||||
[Perf] PromptBuild 60.7 ms
|
||||
[Perf] Prefill 41.9 ms (T_ctx prefill)
|
||||
[Perf] TTFA 155.9 ms (first frame codes)
|
||||
[Perf] TalkerDecode 524.7 ms (64 frames, 8.20 ms/frame)
|
||||
[Perf] CodePredictor 2730.7 ms (42.67 ms/frame)
|
||||
[Perf] HostCompose 1.4 ms (c0 sample + next emb)
|
||||
[Perf] CodecDecode 23.9 ms
|
||||
[Perf] Total 3393.0 ms (64 frames, 50.89 ms/frame AR, audio 5.12 s, RTF 0.663)
|
||||
[Perf] PromptBuild 27.1 ms
|
||||
[Perf] Prefill 16.0 ms (T_ctx prefill)
|
||||
[Perf] TTFA 53.7 ms (first frame codes)
|
||||
[Perf] TalkerDecode 339.2 ms (64 frames, 5.30 ms/frame)
|
||||
[Perf] CodePredictor 558.2 ms (8.72 ms/frame)
|
||||
[Perf] HostCompose 1.0 ms (c0 sample + next emb)
|
||||
[Perf] CodecDecode 20.2 ms
|
||||
[Perf] Total 962.5 ms (64 frames, 14.04 ms/frame AR, audio 5.12 s, RTF 0.188)
|
||||
[WAV] Wrote cpp/base/base-cpp.wav: 122880 samples, 24000 Hz, mono S16
|
||||
[Pipeline] Wrote 122880 samples (5.12 s) -> cpp/base/base-cpp.wav
|
||||
[Input] Prompt: 100 chars: qwentts.cpp is a minimal C++17 and GGML port of Qwen3-TTS fo...
|
||||
@@ -117,18 +117,18 @@ load_backend: loaded CPU backend from /mnt/workspace/qwentts.cpp/build/libggml-c
|
||||
[GGML] Cmd: ../build/qwen-tts --model ../models/qwen-talker-1.7b-base-F32.gguf --codec ../models/qwen-tokenizer-12hz-F32.gguf --seed 42 --lang english --max-new 64 --dump cpp/base -o cpp/base/base-cpp.wav --greedy
|
||||
[GGML] Audio: 122880 samples 24000 Hz 5.12s -> cpp/base/base-cpp.wav
|
||||
[Cossim] PromptIDs exact: 100.00% (38 values)
|
||||
[Cossim] Embed cos: 1.000000 max: 1.0431e-06 mean: 6.3183e-09
|
||||
[Cossim] TrailingText cos: 1.000000 max: 1.0431e-06 mean: 9.3737e-09
|
||||
[Cossim] TTSPadEmbed cos: 1.000000 max: 1.0431e-06 mean: 9.3737e-09
|
||||
[Cossim] L0 cos: 1.000000 max: 1.5564e-03 mean: 2.7918e-05
|
||||
[Cossim] L7 cos: 1.000000 max: 6.8359e-02 mean: 1.0876e-04
|
||||
[Cossim] L14 cos: 1.000000 max: 6.8848e-02 mean: 2.8019e-04
|
||||
[Cossim] L21 cos: 1.000000 max: 7.0801e-02 mean: 9.3340e-04
|
||||
[Cossim] L27 cos: 1.000000 max: 6.8030e-01 mean: 3.4462e-03
|
||||
[Cossim] Final cos: 1.000000 max: 2.0235e-02 mean: 2.3836e-04
|
||||
[Cossim] Logits cos: 1.000000 max: 1.8770e-02 mean: 2.5612e-03
|
||||
[Cossim] NextEmbStep0 cos: 1.000000 max: 1.0431e-06 mean: 9.3270e-09
|
||||
[Cossim] TalkerHiddenStep1 cos: 0.999999 max: 1.1272e-02 mean: 2.1148e-03
|
||||
[Cossim] Embed cos: 1.000000 max: 1.1921e-07 mean: 4.6085e-09
|
||||
[Cossim] TrailingText cos: 1.000000 max: 2.9802e-08 mean: 5.1686e-10
|
||||
[Cossim] TTSPadEmbed cos: 1.000000 max: 2.9802e-08 mean: 5.1686e-10
|
||||
[Cossim] L0 cos: 1.000000 max: 1.5564e-03 mean: 2.7924e-05
|
||||
[Cossim] L7 cos: 1.000000 max: 6.8359e-02 mean: 1.0849e-04
|
||||
[Cossim] L14 cos: 1.000000 max: 6.8848e-02 mean: 2.8148e-04
|
||||
[Cossim] L21 cos: 1.000000 max: 7.0801e-02 mean: 9.6293e-04
|
||||
[Cossim] L27 cos: 1.000000 max: 1.4590e+00 mean: 3.9858e-03
|
||||
[Cossim] Final cos: 1.000000 max: 2.0059e-02 mean: 2.4742e-04
|
||||
[Cossim] Logits cos: 1.000000 max: 2.0794e-02 mean: 2.7992e-03
|
||||
[Cossim] NextEmbStep0 cos: 1.000000 max: 5.9605e-08 mean: 5.2131e-10
|
||||
[Cossim] TalkerHiddenStep1 cos: 0.999999 max: 1.1174e-02 mean: 2.0668e-03
|
||||
[Cossim] CodesFull exact: 100.00% (1008 values)
|
||||
[Cossim] Audio cos: 0.981624
|
||||
[Cossim] WAV stft_cos: 0.989090 samples: 120960
|
||||
|
||||
Reference in New Issue
Block a user