载入中...
搜索中...
未找到
Agent.h
浏览该文件的文档.
137 [[nodiscard]] virtual Result<Policy> train(const Policy& policy, const Observation& observation,
176[[nodiscard]] EVENGINE_API_FOUNDATION Result<Report> run(const Config& config, IEnvironment& environment);
198[[nodiscard]] EVENGINE_API_FOUNDATION Result<void> replay(const Trace& trace, IEnvironment& environment,
Move-only, checked operation results for the common layer.
Adapter for a resettable game, simulation, UI or other decision-making environment....
Definition Agent.h:36
virtual ~IEnvironment()=default
Releases IEnvironment resources.
virtual Result< Observation > reset(std::uint64_t seed)=0
Reset atomically to the injected seed; return initial state (reward zero).
virtual Result< Observation > step(std::uint32_t action, double dt)=0
Execute one legal action, advance exactly dt seconds, then inspect invariants.
Optional GPU policy service, registered independently of eager tensor CPU. @ownership Same synchronou...
Definition Agent.h:131
virtual Result< void > available() const =0
Check live device availability without executing an environment callback.
static constexpr const char * capabilityName
Definition Agent.h:133
virtual Result< Policy > train(const Policy &policy, const Observation &observation, std::uint32_t action, double rate)=0
GPU forward/backprop/update on a validated sample; publish owning weights atomically.
Optional inference service. Providers own their registration and revoke before destruction....
Definition Agent.h:114
virtual Result< std::vector< double > > evaluate(const Policy &policy, const Observation &observation)=0
Evaluate inputs validated by agent::infer; return masked probabilities or structured failure.
static constexpr const char * capabilityName
Definition Agent.h:116
virtual ~IPolicyBackend()=default
Releases IPolicyBackend resources.
virtual std::string name() const =0
Owning device/backend label; must describe the actual execution path.
Definition Agent.cpp:10
Result< std::vector< double > > infer(const Policy &policy, const Observation &observation, Backend backend)
Compute masked action probabilities with validated version-1 owning weights.
Definition Agent.cpp:112
Result< std::string > backendName(Backend backend)
Return an owning backend label, or Unsupported if Tensor is unavailable; owner thread only.
Definition Agent.cpp:93
Result< void > validatePolicy(const Policy &policy)
Validate the complete owning policy before inference/import, with no mutation or callbacks.
Definition Agent.cpp:79
Result< void > replay(const Trace &trace, IEnvironment &environment, double tolerance)
Reset and replay actual actions, checking all observations and failure evidence.
Definition Agent.cpp:258
Strategy
Explicit algorithm choice, also used for equal-budget random baselines.
Definition Agent.h:47
@ Random
@ EvolutionLearning
@ Success
@ Running
@ Failure
Backend
Explicit backend; Tensor is eager CPU, Gpu accelerates inference and SGD via agent_tensor.
Definition Agent.h:50
@ Tensor
Bounded search configuration; seed streams for environment, search and learning are separate.
Definition Agent.h:53
Owning state projection; action IDs index a fixed domain action catalogue.
Definition Agent.h:16
Owning version-1 portable network weights; import validates the entire value before use.
Definition Agent.h:99
Owning search result; reward, coverage and failures remain separate evidence.
Definition Agent.h:148
Owning executed action and resulting observation; no domain pointers are retained.
Definition Agent.h:77
In-memory versioned replay evidence, independent of learned model state.
Definition Agent.h:89