|
Mila
Deep Neural Network Library
|
GPT inference model. More...
#include <memory>#include <vector>#include <string>#include <sstream>#include <stdexcept>#include <filesystem>#include <format>#include <random>#include <optional>#include <chrono>#include <algorithm>#include <numeric>#include <cstring>#include <cmath>#include <functional>#include <stop_token>#include <unordered_set>import Serialization.OpenMode;import Compute.ExecutionContextFactory;import Logging.Logger;import Serialization.PretrainedReader;import Compute.DeviceTypeTraits.Cpu;import Compute.DeviceTypeTraits;import Serialization.ZipSerializer;import Compute.DeviceType;import Compute.DeviceId;import Dnn.LanguageModel;import Dnn.TensorDataTypeTraits;import Dnn.RuntimeMode;import Dnn.LanguageNetwork;import Serialization.Mode;import Dnn.Component;import Dnn.TensorTypes;import Serialization.ModelArchive;import Dnn.GenerateStatus;import Serialization.Metadata;import Dnn.Tensor;import Compute.CpuMemoryResource;import Dnn.ITensor;import Dnn.TensorDataType;import Dnn.GenerateParams;import Dnn.Components.GptTransformer;import Compute.Device;Classes | |
| class | Mila::Dnn::GptModel< TDeviceType, TPrecision > |
| GPT inference model. More... | |
Namespaces | |
| namespace | Mila |
| Mila main API namespace. | |
GPT inference model.
Inference-only wrapper around a loaded GptTransformer network. No training, no optimizer, no gradients.
Two loading paths:
fromPretrained() – third-party weights (e.g. HuggingFace GPT-2) via PretrainedModelReader. Primary path for Mila chat.
fromCheckpoint() – Mila-native artifact produced by GptTransformer::save() via ModelArchive. Round-trip path after training.