This commit is contained in:
Pascal
2026-06-21 17:30:21 +02:00
parent 26fcea5468
commit 4536dcdce2
2 changed files with 19 additions and 29 deletions
-2
View File
@@ -42,7 +42,6 @@ struct CodePredictorWeights {
int num_key_value_heads; int num_key_value_heads;
int head_dim; int head_dim;
int vocab_size; int vocab_size;
int max_position_embeddings;
int num_acoustic_codebooks; // num_code_groups - 1 int num_acoustic_codebooks; // num_code_groups - 1
float rope_theta; float rope_theta;
float rms_norm_eps; float rms_norm_eps;
@@ -75,7 +74,6 @@ static bool code_predictor_weights_load(CodePredictorWeights * cw, const GGUFMod
cw->num_key_value_heads = (int) gf_get_u32(gf, "qwen3-tts.code_pred.attention.head_count_kv"); cw->num_key_value_heads = (int) gf_get_u32(gf, "qwen3-tts.code_pred.attention.head_count_kv");
cw->head_dim = (int) gf_get_u32(gf, "qwen3-tts.code_pred.attention.key_length"); cw->head_dim = (int) gf_get_u32(gf, "qwen3-tts.code_pred.attention.key_length");
cw->vocab_size = (int) gf_get_u32(gf, "qwen3-tts.code_pred.vocab_size"); cw->vocab_size = (int) gf_get_u32(gf, "qwen3-tts.code_pred.vocab_size");
cw->max_position_embeddings = (int) gf_get_u32(gf, "qwen3-tts.code_pred.context_length");
cw->rope_theta = gf_get_f32(gf, "qwen3-tts.code_pred.rope.freq_base"); cw->rope_theta = gf_get_f32(gf, "qwen3-tts.code_pred.rope.freq_base");
cw->rms_norm_eps = gf_get_f32(gf, "qwen3-tts.code_pred.attention.layer_norm_rms_epsilon"); cw->rms_norm_eps = gf_get_f32(gf, "qwen3-tts.code_pred.attention.layer_norm_rms_epsilon");
-8
View File
@@ -73,10 +73,6 @@ struct TalkerWeights {
int num_key_value_heads; int num_key_value_heads;
int head_dim; int head_dim;
int vocab_size; int vocab_size;
int text_vocab_size;
int text_hidden_size;
int max_position_embeddings;
int position_id_per_seconds;
float rope_theta; float rope_theta;
float rms_norm_eps; float rms_norm_eps;
int mrope_section_t; int mrope_section_t;
@@ -107,10 +103,6 @@ static bool talker_weights_load(TalkerWeights * tw, const GGUFModel & gf, ggml_b
tw->num_key_value_heads = (int) gf_get_u32(gf, "qwen3-tts.talker.attention.head_count_kv"); tw->num_key_value_heads = (int) gf_get_u32(gf, "qwen3-tts.talker.attention.head_count_kv");
tw->head_dim = (int) gf_get_u32(gf, "qwen3-tts.talker.attention.key_length"); tw->head_dim = (int) gf_get_u32(gf, "qwen3-tts.talker.attention.key_length");
tw->vocab_size = (int) gf_get_u32(gf, "qwen3-tts.talker.vocab_size"); tw->vocab_size = (int) gf_get_u32(gf, "qwen3-tts.talker.vocab_size");
tw->text_vocab_size = (int) gf_get_u32(gf, "qwen3-tts.talker.text_vocab_size");
tw->text_hidden_size = (int) gf_get_u32(gf, "qwen3-tts.talker.text_hidden_size");
tw->max_position_embeddings = (int) gf_get_u32(gf, "qwen3-tts.talker.context_length");
tw->position_id_per_seconds = (int) gf_get_u32(gf, "qwen3-tts.talker.position_id_per_seconds");
tw->rope_theta = gf_get_f32(gf, "qwen3-tts.talker.rope.freq_base"); tw->rope_theta = gf_get_f32(gf, "qwen3-tts.talker.rope.freq_base");
tw->rms_norm_eps = gf_get_f32(gf, "qwen3-tts.talker.attention.layer_norm_rms_epsilon"); tw->rms_norm_eps = gf_get_f32(gf, "qwen3-tts.talker.attention.layer_norm_rms_epsilon");
tw->mrope_interleaved = gf_get_bool(gf, "qwen3-tts.talker.rope.mrope_interleaved"); tw->mrope_interleaved = gf_get_bool(gf, "qwen3-tts.talker.rope.mrope_interleaved");