|
Mila
Deep Neural Network Library
|
Functions | |
| template<TensorDataType TPrecision, KvCachePolicy TKvCachePolicy, typename TResult, typename TAction> | |
| TResult | Mila::Dnn::dispatchWeightQuantization (WeightQuantization weight_quantization, KvCacheCompression kv_cache_compression, std::string_view caller, TAction &&action) |
| Resolve a runtime quantization setting to a policy type and invoke an action. | |
Files | |
| file | Mila/Src/Dnn/Models/QuantizationDispatch.ixx |
| The one place a runtime quantization setting becomes a compile-time policy. | |