@@ -2048,7 +2048,7 @@ ggml_tensor * llm_build_context::build_output(llama_context & lctx, ggml_context
20482048}
20492049
20502050ggml_tensor * llm_build_context::build_output (llama_context & lctx, ggml_context * ctx, ggml_tensor * cur,
2051- ggml_tensor * output, ggml_tensor * output_norm, const llm_build_cb & cb) {
2051+ ggml_tensor * output, ggml_tensor * output_norm, const llm_build_cb & cb, bool add_normed_name ) {
20522052 // lm_head
20532053 if (output->extra ) {
20542054 auto split_output = (ggml_split_tensor_t *)output->extra ;
@@ -2069,7 +2069,7 @@ ggml_tensor * llm_build_context::build_output(llama_context & lctx, ggml_context
20692069 o.push_back (llm_build_context::llm_build_lora_mm (lctx, ctx, split, cur));
20702070 }
20712071 cb (o.back (), " output" , id);
2072- if (last_norm) {
2072+ if (add_normed_name && last_norm) {
20732073 cb (last_norm, " result_norm" , -1 );
20742074 }
20752075 }
@@ -2095,7 +2095,9 @@ ggml_tensor * llm_build_context::build_output(llama_context & lctx, ggml_context
20952095 }
20962096 if (output_norm) {
20972097 cur = llm_build_context::llm_build_norm (ctx, cur, lctx.model .hparams , output_norm, NULL , LLM_NORM_RMS , cb, -1 );
2098- cb (cur, " result_norm" , -1 );
2098+ if (add_normed_name) {
2099+ cb (cur, " result_norm" , -1 );
2100+ }
20992101 }
21002102 cur = llm_build_context::llm_build_lora_mm (lctx, ctx, output, cur);
21012103 }
0 commit comments