Mila
Deep Neural Network Library
Loading...
Searching...
No Matches
Mila::Dnn::GemmaModel< TDeviceType, TPrecision > Member List

This is the complete list of members for Mila::Dnn::GemmaModel< TDeviceType, TPrecision >, including all inherited members.

awaitSampledToken()Mila::Dnn::LanguageModel< TDeviceType, TPrecision >inlineprotected
Base typedef (defined in Mila::Dnn::LanguageModel< TDeviceType, TPrecision >)Mila::Dnn::LanguageModel< TDeviceType, TPrecision >
contextLength() const noexceptMila::Dnn::GemmaModel< TDeviceType, TPrecision >inline
enqueueSampleNext(const TensorType &logits, TokenTensor &token_out, const SamplingParams &params)Mila::Dnn::LanguageModel< TDeviceType, TPrecision >inlineprotected
fingerprintPrefill(const std::vector< int32_t > &token_ids)Mila::Dnn::GemmaModel< TDeviceType, TPrecision >inline
fromPretrained(const std::filesystem::path &path, const GemmaModelConfig &model_config, DeviceId device_id=DeviceId{ TDeviceType, 0 })Mila::Dnn::GemmaModel< TDeviceType, TPrecision >inlinestatic
GemmaModel(const GemmaModel &)=delete (defined in Mila::Dnn::GemmaModel< TDeviceType, TPrecision >)Mila::Dnn::GemmaModel< TDeviceType, TPrecision >
GemmaModel(GemmaModel &&)=default (defined in Mila::Dnn::GemmaModel< TDeviceType, TPrecision >)Mila::Dnn::GemmaModel< TDeviceType, TPrecision >
GemmaSlidingKvPolicy typedefMila::Dnn::GemmaModel< TDeviceType, TPrecision >
generate(std::span< const int32_t > prompt_tokens, const std::function< void(int32_t)> &on_token, const GenerateParams &params={}, std::stop_token stop={})Mila::Dnn::LanguageModel< TDeviceType, TPrecision >inline
getDeviceId() const noexceptMila::Dnn::Model< TDeviceType, TPrecision >inline
getLanguageNetwork() noexcept (defined in Mila::Dnn::LanguageModel< TDeviceType, TPrecision >)Mila::Dnn::LanguageModel< TDeviceType, TPrecision >inlineprotected
getLanguageNetwork() const noexcept (defined in Mila::Dnn::LanguageModel< TDeviceType, TPrecision >)Mila::Dnn::LanguageModel< TDeviceType, TPrecision >inlineprotected
getMemoryStats() constMila::Dnn::Model< TDeviceType, TPrecision >inline
getModelConfig() const noexceptMila::Dnn::GemmaModel< TDeviceType, TPrecision >inline
getNetworkConfig() const noexceptMila::Dnn::GemmaModel< TDeviceType, TPrecision >inline
getRequiredMemory(const std::filesystem::path &path, const GemmaModelConfig &model_config, DeviceId device_id=DeviceId{ TDeviceType, 0 })Mila::Dnn::GemmaModel< TDeviceType, TPrecision >inlinestatic
getRuntimeMode() const noexceptMila::Dnn::Model< TDeviceType, TPrecision >inline
getScratchHighWaterBytes() constMila::Dnn::Model< TDeviceType, TPrecision >inline
isEval() const noexceptMila::Dnn::Model< TDeviceType, TPrecision >inline
isInferenceMode() const noexceptMila::Dnn::Model< TDeviceType, TPrecision >inline
isTrainingMode() const noexceptMila::Dnn::Model< TDeviceType, TPrecision >inline
LanguageModel(const LanguageModel &)=delete (defined in Mila::Dnn::LanguageModel< TDeviceType, TPrecision >)Mila::Dnn::LanguageModel< TDeviceType, TPrecision >
LanguageModel(LanguageModel &&)=default (defined in Mila::Dnn::LanguageModel< TDeviceType, TPrecision >)Mila::Dnn::LanguageModel< TDeviceType, TPrecision >
LanguageModel(std::unique_ptr< LanguageNetwork< TDeviceType, TPrecision > > network, RuntimeMode runtime_mode, Serialization::PretrainedMetadata source_metadata={}, WeightQuantization weight_quantization=WeightQuantization::None)Mila::Dnn::LanguageModel< TDeviceType, TPrecision >inlineexplicitprotected
maxSequenceLength() const noexcept override (defined in Mila::Dnn::GemmaModel< TDeviceType, TPrecision >)Mila::Dnn::GemmaModel< TDeviceType, TPrecision >inlineprotectedvirtual
Model(const Model &)=delete (defined in Mila::Dnn::Model< TDeviceType, TPrecision >)Mila::Dnn::Model< TDeviceType, TPrecision >
Model(Model &&)=default (defined in Mila::Dnn::Model< TDeviceType, TPrecision >)Mila::Dnn::Model< TDeviceType, TPrecision >
Model(std::unique_ptr< NetworkType > network, RuntimeMode runtime_mode)Mila::Dnn::Model< TDeviceType, TPrecision >inlineexplicitprotected
ModelBase typedef (defined in Mila::Dnn::GemmaModel< TDeviceType, TPrecision >)Mila::Dnn::GemmaModel< TDeviceType, TPrecision >
MR typedef (defined in Mila::Dnn::GemmaModel< TDeviceType, TPrecision >)Mila::Dnn::GemmaModel< TDeviceType, TPrecision >
network_Mila::Dnn::Model< TDeviceType, TPrecision >protected
NetworkType typedef (defined in Mila::Dnn::Model< TDeviceType, TPrecision >)Mila::Dnn::Model< TDeviceType, TPrecision >
onGenerating(std::span< const int32_t > prompt_tokens, const std::function< void(int32_t)> &on_token, const GenerateParams &params, std::stop_token stop) overrideMila::Dnn::GemmaModel< TDeviceType, TPrecision >inlineprotectedvirtual
onTraining() overrideMila::Dnn::GemmaModel< TDeviceType, TPrecision >inlineprotectedvirtual
operator=(const GemmaModel &)=delete (defined in Mila::Dnn::GemmaModel< TDeviceType, TPrecision >)Mila::Dnn::GemmaModel< TDeviceType, TPrecision >
operator=(GemmaModel &&)=default (defined in Mila::Dnn::GemmaModel< TDeviceType, TPrecision >)Mila::Dnn::GemmaModel< TDeviceType, TPrecision >
operator=(const LanguageModel &)=delete (defined in Mila::Dnn::LanguageModel< TDeviceType, TPrecision >)Mila::Dnn::LanguageModel< TDeviceType, TPrecision >
operator=(LanguageModel &&)=default (defined in Mila::Dnn::LanguageModel< TDeviceType, TPrecision >)Mila::Dnn::LanguageModel< TDeviceType, TPrecision >
operator=(const Model &)=delete (defined in Mila::Dnn::Model< TDeviceType, TPrecision >)Mila::Dnn::Model< TDeviceType, TPrecision >
operator=(Model &&)=default (defined in Mila::Dnn::Model< TDeviceType, TPrecision >)Mila::Dnn::Model< TDeviceType, TPrecision >
profilePrefill(const std::vector< int32_t > &token_ids) (defined in Mila::Dnn::GemmaModel< TDeviceType, TPrecision >)Mila::Dnn::GemmaModel< TDeviceType, TPrecision >inline
sampleNext(const TensorType &logits, TokenTensor &token_out, const SamplingParams &params)Mila::Dnn::LanguageModel< TDeviceType, TPrecision >inlineprotected
savePretrained(const std::filesystem::path &path) constMila::Dnn::LanguageModel< TDeviceType, TPrecision >inline
seedSampler(uint64_t seed)Mila::Dnn::LanguageModel< TDeviceType, TPrecision >inline
setEval(bool eval)Mila::Dnn::Model< TDeviceType, TPrecision >inline
source_metadata_Mila::Dnn::LanguageModel< TDeviceType, TPrecision >protected
StagingMR typedef (defined in Mila::Dnn::GemmaModel< TDeviceType, TPrecision >)Mila::Dnn::GemmaModel< TDeviceType, TPrecision >
TensorType typedef (defined in Mila::Dnn::GemmaModel< TDeviceType, TPrecision >)Mila::Dnn::GemmaModel< TDeviceType, TPrecision >
TokenIndexType typedef (defined in Mila::Dnn::GemmaModel< TDeviceType, TPrecision >)Mila::Dnn::GemmaModel< TDeviceType, TPrecision >
TokenTensor typedef (defined in Mila::Dnn::LanguageModel< TDeviceType, TPrecision >)Mila::Dnn::LanguageModel< TDeviceType, TPrecision >protected
toString() const overrideMila::Dnn::GemmaModel< TDeviceType, TPrecision >inlinevirtual
train()Mila::Dnn::Model< TDeviceType, TPrecision >inline
vocabSize() const noexcept override (defined in Mila::Dnn::GemmaModel< TDeviceType, TPrecision >)Mila::Dnn::GemmaModel< TDeviceType, TPrecision >inlineprotectedvirtual
weight_quantization_Mila::Dnn::LanguageModel< TDeviceType, TPrecision >protected
~GemmaModel()=default (defined in Mila::Dnn::GemmaModel< TDeviceType, TPrecision >)Mila::Dnn::GemmaModel< TDeviceType, TPrecision >
~LanguageModel()=default (defined in Mila::Dnn::LanguageModel< TDeviceType, TPrecision >)Mila::Dnn::LanguageModel< TDeviceType, TPrecision >virtual
~Model()=default (defined in Mila::Dnn::Model< TDeviceType, TPrecision >)Mila::Dnn::Model< TDeviceType, TPrecision >virtual