llama : set qwen3 model type sizes (#13175)

CISC · web-flow · commit e98b3692be4c · 2025-04-29T11:00:31.000+02:00
diff --git a/src/llama-model.cpp b/src/llama-model.cpp
@@ -92,6 +92,10 @@ const char * llm_type_name(llm_type type) {
         case LLM_TYPE_290B:          return "290B";
         case LLM_TYPE_17B_16E:       return "17Bx16E (Scout)";
         case LLM_TYPE_17B_128E:      return "17Bx128E (Maverick)";
+        case LLM_TYPE_0_6B:          return "0.6B";
+        case LLM_TYPE_1_7B:          return "1.7B";
+        case LLM_TYPE_30B_A3B:       return "30B.A3B";
+        case LLM_TYPE_235B_A22B:     return "235B.A22B";
         default:                     return "?B";
     }
 }
@@ -793,6 +797,10 @@ void llama_model::load_hparams(llama_model_loader & ml) {
             {
                 ml.get_key(LLM_KV_ATTENTION_LAYERNORM_RMS_EPS, hparams.f_norm_rms_eps);
                 switch (hparams.n_layer) {
+                    case 28: type = hparams.n_embd == 1024 ? LLM_TYPE_0_6B : LLM_TYPE_1_7B; break;
+                    case 36: type = hparams.n_embd == 2560 ? LLM_TYPE_4B : LLM_TYPE_8B; break;
+                    case 40: type = LLM_TYPE_14B; break;
+                    case 64: type = LLM_TYPE_32B; break;
                     default: type = LLM_TYPE_UNKNOWN;
                 }
             } break;
@@ -802,6 +810,8 @@ void llama_model::load_hparams(llama_model_loader & ml) {
 
                 ml.get_key(LLM_KV_ATTENTION_LAYERNORM_RMS_EPS, hparams.f_norm_rms_eps);
                 switch (hparams.n_layer) {
+                    case 48: type = LLM_TYPE_30B_A3B; break;
+                    case 94: type = LLM_TYPE_235B_A22B; break;
                     default: type = LLM_TYPE_UNKNOWN;
                 }
             } break;
diff --git a/src/llama-model.h b/src/llama-model.h
@@ -88,6 +88,10 @@ enum llm_type {
     LLM_TYPE_290B,
     LLM_TYPE_17B_16E, // llama4 Scout
     LLM_TYPE_17B_128E, // llama4 Maverick
+    LLM_TYPE_0_6B,
+    LLM_TYPE_1_7B,
+    LLM_TYPE_30B_A3B,
+    LLM_TYPE_235B_A22B,
 };
 
 struct llama_layer_posnet {

Original file line number	Diff line number	Diff line change
`@@ -92,6 +92,10 @@ const char * llm_type_name(llm_type type) {`
`92`	`92`	`case LLM_TYPE_290B: return "290B";`
`93`	`93`	`case LLM_TYPE_17B_16E: return "17Bx16E (Scout)";`
`94`	`94`	`case LLM_TYPE_17B_128E: return "17Bx128E (Maverick)";`
	`95`	`+ case LLM_TYPE_0_6B: return "0.6B";`
	`96`	`+ case LLM_TYPE_1_7B: return "1.7B";`
	`97`	`+ case LLM_TYPE_30B_A3B: return "30B.A3B";`
	`98`	`+ case LLM_TYPE_235B_A22B: return "235B.A22B";`
`95`	`99`	`default: return "?B";`
`96`	`100`	`}`
`97`	`101`	`}`
`@@ -793,6 +797,10 @@ void llama_model::load_hparams(llama_model_loader & ml) {`
`793`	`797`	`{`
`794`	`798`	`ml.get_key(LLM_KV_ATTENTION_LAYERNORM_RMS_EPS, hparams.f_norm_rms_eps);`
`795`	`799`	`switch (hparams.n_layer) {`
	`800`	`+ case 28: type = hparams.n_embd == 1024 ? LLM_TYPE_0_6B : LLM_TYPE_1_7B; break;`
	`801`	`+ case 36: type = hparams.n_embd == 2560 ? LLM_TYPE_4B : LLM_TYPE_8B; break;`
	`802`	`+ case 40: type = LLM_TYPE_14B; break;`
	`803`	`+ case 64: type = LLM_TYPE_32B; break;`
`796`	`804`	`default: type = LLM_TYPE_UNKNOWN;`
`797`	`805`	`}`
`798`	`806`	`} break;`
`@@ -802,6 +810,8 @@ void llama_model::load_hparams(llama_model_loader & ml) {`
`802`	`810`
`803`	`811`	`ml.get_key(LLM_KV_ATTENTION_LAYERNORM_RMS_EPS, hparams.f_norm_rms_eps);`
`804`	`812`	`switch (hparams.n_layer) {`
	`813`	`+ case 48: type = LLM_TYPE_30B_A3B; break;`
	`814`	`+ case 94: type = LLM_TYPE_235B_A22B; break;`
`805`	`815`	`default: type = LLM_TYPE_UNKNOWN;`
`806`	`816`	`}`
`807`	`817`	`} break;`