Back to Mistral Rs

Which

docs/src/content/docs/reference/python/which.md

0.9.28.1 KB
Original Source

LoraAdapter

FieldTypeDefault
aliasstrrequired
sourcestrrequired
revisionstr | NoneNone

Which

Which model to select. See the docs for the Which enum in API.md for more details. Usage:

python
>>> Which.Plain(...)

Which.Plain

FieldTypeDefault
model_idstrrequired
archArchitecture | NoneNone
tokenizer_jsonstr | NoneNone
topologystr | NoneNone
organizationIsqOrganization | NoneNone
write_uqffstr | NoneNone
from_uqffstr | list[str] | NoneNone
dtypeModelDTypeModelDType.Auto
imatrixstr | NoneNone
calibration_filestr | NoneNone
auto_map_paramsTextAutoMapParams | NoneNone
hf_cache_pathstr | NoneNone
matformer_config_pathstr | NoneNone
matformer_slice_namestr | NoneNone

Which.Embedding

FieldTypeDefault
model_idstrrequired
archEmbeddingArchitecture | NoneNone
tokenizer_jsonstr | NoneNone
topologystr | NoneNone
write_uqffstr | NoneNone
from_uqffstr | list[str] | NoneNone
dtypeModelDTypeModelDType.Auto
hf_cache_pathstr | NoneNone
imatrixstr | NoneNone
calibration_filestr | NoneNone

Which.XLora

FieldTypeDefault
xlora_model_idstrrequired
orderstrrequired
archArchitecture | NoneNone
model_idstr | NoneNone
tokenizer_jsonstr | NoneNone
tgt_non_granular_indexint | NoneNone
topologystr | NoneNone
write_uqffstr | NoneNone
from_uqffstr | list[str] | NoneNone
dtypeModelDTypeModelDType.Auto
auto_map_paramsTextAutoMapParams | NoneNone
hf_cache_pathstr | NoneNone

Which.Lora

FieldTypeDefault
model_idstrrequired
adapterslist[LoraAdapter] | NoneNone
archArchitecture | NoneNone
tokenizer_jsonstr | NoneNone
topologystr | NoneNone
write_uqffstr | NoneNone
from_uqffstr | list[str] | NoneNone
dtypeModelDTypeModelDType.Auto
auto_map_paramsTextAutoMapParams | NoneNone
hf_cache_pathstr | NoneNone
max_adaptersint16
max_rankint256
max_bytesint8589934592

Which.GGUF

Select a GGUF model.

Pass adapters=[] or set a non-default LoRA limit to enable an empty dynamic LoRA runtime. With mmproj_filename, adapters apply to the language model. Pass in_situ_quant to Runner to requantize compatible GGUF weights while loading.

FieldTypeDefault
quantized_model_idstrrequired
quantized_filenamestr | list[str]required
tok_model_idstr | NoneNone
topologystr | NoneNone
dtypeModelDTypeModelDType.Auto
auto_map_paramsTextAutoMapParams | NoneNone
tokenizer_jsonstr | NoneNone (keyword-only)
mmproj_filenamestr | list[str] | NoneNone (keyword-only)
organizationIsqOrganization | NoneNone (keyword-only)
write_uqffstr | NoneNone (keyword-only)
imatrixstr | NoneNone (keyword-only)
calibration_filestr | NoneNone (keyword-only)
max_edgeint | NoneNone (keyword-only)
multimodal_auto_map_paramsMultimodalAutoMapParams | NoneNone (keyword-only)
adapterslist[LoraAdapter] | NoneNone (keyword-only)
max_adaptersint16 (keyword-only)
max_rankint256 (keyword-only)
max_bytesint8589934592 (keyword-only)
hf_cache_pathstr | NoneNone (keyword-only)
matformer_config_pathstr | NoneNone (keyword-only)
matformer_slice_namestr | NoneNone (keyword-only)

Which.XLoraGGUF

Select X-LoRA for a Phi3 GGUF configuration.

FieldTypeDefault
quantized_model_idstrrequired
quantized_filenamestr | list[str]required
xlora_model_idstrrequired
orderstrrequired
tok_model_idstr | NoneNone
tgt_non_granular_indexint | NoneNone
topologystr | NoneNone
dtypeModelDTypeModelDType.Auto
auto_map_paramsTextAutoMapParams | NoneNone

Which.LoraGGUF

Select legacy static LoRA for a Phi3 GGUF configuration.

For dynamic adapters on a supported GGUF, pass adapters to Which.GGUF.

FieldTypeDefault
quantized_model_idstrrequired
quantized_filenamestr | list[str]required
adapters_model_idstrrequired
orderstrrequired
tok_model_idstr | NoneNone
topologystr | NoneNone
dtypeModelDTypeModelDType.Auto
auto_map_paramsTextAutoMapParams | NoneNone

Which.GGML

FieldTypeDefault
quantized_model_idstrrequired
quantized_filenamestrrequired
tok_model_idstrrequired
tokenizer_jsonstr | NoneNone
gqaint1
topologystr | NoneNone
dtypeModelDTypeModelDType.Auto
auto_map_paramsTextAutoMapParams | NoneNone

Which.XLoraGGML

FieldTypeDefault
quantized_model_idstrrequired
quantized_filenamestrrequired
xlora_model_idstrrequired
orderstrrequired
tok_model_idstr | NoneNone
tokenizer_jsonstr | NoneNone
tgt_non_granular_indexint | NoneNone
gqaint1
topologystr | NoneNone
dtypeModelDTypeModelDType.Auto
auto_map_paramsTextAutoMapParams | NoneNone

Which.LoraGGML

FieldTypeDefault
quantized_model_idstrrequired
quantized_filenamestrrequired
adapters_model_idstrrequired
orderstrrequired
tok_model_idstr | NoneNone
tokenizer_jsonstr | NoneNone
gqaint1
topologystr | NoneNone
dtypeModelDTypeModelDType.Auto
auto_map_paramsTextAutoMapParams | NoneNone

Which.MultimodalPlain

FieldTypeDefault
model_idstrrequired
archMultimodalArchitecture | NoneNone
tokenizer_jsonstr | NoneNone
topologystr | NoneNone
write_uqffstr | NoneNone
from_uqffstr | list[str] | NoneNone
dtypeModelDTypeModelDType.Auto
max_edgeint | NoneNone
calibration_filestr | NoneNone
imatrixstr | NoneNone
auto_map_paramsMultimodalAutoMapParams | NoneNone
hf_cache_pathstr | NoneNone
matformer_config_pathstr | NoneNone
matformer_slice_namestr | NoneNone
organizationIsqOrganization | NoneNone

Which.DiffusionPlain

FieldTypeDefault
model_idstrrequired
archDiffusionArchitecturerequired
dtypeModelDTypeModelDType.Auto

Which.Speech

FieldTypeDefault
model_idstrrequired
archSpeechLoaderTyperequired
dac_model_idstr | NoneNone
dtypeModelDTypeModelDType.Auto

<small>Generated from mistralrs-pyo3/mistralrs.pyi.</small>