Mila
Deep Neural Network Library
Loading...
Searching...
No Matches
Dnn.Models.QuantizationDispatch Module Reference

Functions

template<TensorDataType TPrecision, KvCachePolicy TKvCachePolicy, typename TResult, typename TAction>
TResult Mila::Dnn::dispatchWeightQuantization (WeightQuantization weight_quantization, KvCacheCompression kv_cache_compression, std::string_view caller, TAction &&action)
 Resolve a runtime quantization setting to a policy type and invoke an action.

Files

file  Mila/Src/Dnn/Models/QuantizationDispatch.ixx
 The one place a runtime quantization setting becomes a compile-time policy.