载入中...
搜索中...
未找到
OnnxCompute.h
浏览该文件的文档.
37 [[nodiscard]] virtual Result<OnnxBuffer> enqueue(const std::string& source, std::span<const OnnxBuffer> inputs,
Move-only, checked operation results for the common layer.
static Diagnostic error(DiagnosticCode code, std::string message, std::string path={}, DiagnosticDetails details={}, std::string source={})
Construct an error diagnostic with the standard error severity.
Definition Diagnostic.h:125
static Result failure(Status status)
Construct a failed result from a structured status.
Definition Result.h:175
GPU execution boundary for native ONNX; retains no model and retains compiled resources for the lifet...
Definition OnnxCompute.h:25
virtual ~OnnxCompute()=default
Release device resources after all synchronous calls have returned.
virtual OnnxTransferStats transferStats() const
Observable transfer counters for the current or most recent run.
Definition OnnxCompute.h:64
virtual void beginRun() noexcept
Start a synchronous run cache scope; invoked only by OnnxModel on the device thread.
Definition OnnxCompute.h:69
virtual Result< std::vector< uint8_t > > dispatch(const OnnxKernel &kernel)=0
Compatibility-only synchronous host-byte entry point; engine dispatch delegates to enqueue.
virtual Result< OnnxBuffer > enqueue(const std::string &source, std::span< const OnnxBuffer > inputs, size_t outputBytes, uint32_t workItems)
Queue a kernel using immutable host/device buffers; no readback is required.
Definition OnnxCompute.h:37
virtual void endRun() noexcept
Retire temporary activations/recordings; compiled resources may survive for later calls.
Definition OnnxCompute.h:71
Native ONNX import and CPU/GPU execution using tensor kernels, without ONNX Runtime.
Definition OnnxModel.h:63
Definition AffineQuant.cpp:9
EVENGINE_API_DOMAINS Result< std::unique_ptr< OnnxCompute > > createOnnxGpuCompute(uint32_t compilerWorkers=4)
Create a reusable GPU session for the active engine Gpgpu Vulkan device, or an error.
Definition OnnxGpgpu.cpp:347
@ InvalidArgument
Synchronous GPU kernel request; all inputs are borrowed only until dispatch returns.
Definition OnnxCompute.h:12
std::vector< std::span< const uint8_t > > inputs
Definition OnnxCompute.h:14
Actual transfers and submissions made during one GPU run.
Definition OnnxStorage.h:26