@@ -713,6 +713,7 @@ class llama_model_tensor_buft_override(ctypes.Structure):
713713# // Keep the booleans together to avoid misalignment during copy-by-value.
714714# bool vocab_only; // only load the vocabulary, no weights
715715# bool use_mmap; // use mmap if possible
716+ # bool use_direct_io; // use direct io, takes precedence over use_mmap
716717# bool use_mlock; // force system to keep model in RAM
717718# bool check_tensors; // validate model tensor data
718719# bool use_extra_bufts; // use extra buffer types (used for weight repacking)
@@ -734,6 +735,7 @@ class llama_model_params(ctypes.Structure):
734735 kv_overrides (ctypes.Array[llama_model_kv_override]): override key-value pairs of the model meta data
735736 vocab_only (bool): only load the vocabulary, no weights
736737 use_mmap (bool): use mmap if possible
738+ use_direct_io(bool): use direct io, takes precedence over use_mmap
737739 use_mlock (bool): force system to keep model in RAM
738740 check_tensors (bool): validate model tensor data
739741 use_extra_bufts (bool): use extra buffer types (used for weight repacking)
@@ -752,6 +754,7 @@ class llama_model_params(ctypes.Structure):
752754 kv_overrides : CtypesArray [llama_model_kv_override ]
753755 vocab_only : bool
754756 use_mmap : bool
757+ use_direct_io : bool
755758 use_mlock : bool
756759 check_tensors : bool
757760 use_extra_bufts : bool
@@ -770,6 +773,7 @@ class llama_model_params(ctypes.Structure):
770773 ("kv_overrides" , ctypes .POINTER (llama_model_kv_override )),
771774 ("vocab_only" , ctypes .c_bool ),
772775 ("use_mmap" , ctypes .c_bool ),
776+ ("use_direct_io" , ctypes .c_bool ),
773777 ("use_mlock" , ctypes .c_bool ),
774778 ("check_tensors" , ctypes .c_bool ),
775779 ("use_extra_bufts" , ctypes .c_bool ),
0 commit comments