Add tokenizer longhaul cache
This commit is contained in:
@@ -1592,6 +1592,8 @@ struct llama_model_params common_model_params_to_llama(common_params & params) {
|
||||
mparams.split_mode = params.split_mode;
|
||||
mparams.load_mode = params.load_mode;
|
||||
mparams.longhaul_cache_bytes = params.longhaul_cache_bytes;
|
||||
mparams.tokenizer_longhaul = params.tokenizer_longhaul;
|
||||
mparams.tokenizer_longhaul_cache_bytes = params.tokenizer_longhaul_cache_bytes;
|
||||
mparams.tensor_split = params.tensor_split;
|
||||
mparams.check_tensors = params.check_tensors;
|
||||
mparams.use_extra_bufts = !params.no_extra_bufts;
|
||||
|
||||
Reference in New Issue
Block a user