Cognition · Model asset

Policy Network

Model assetCognitionCognition & Memoryarc:DeepPolicyNetwork

Neural network weights trained on expert demonstrations to predict action probabilities for a state, used as search priors and rollout guidance.

Responsibility. Predicts expert-like action probabilities for a state.

Also known as: Manipulation policy network, RL policy, Deep Q-Network, Actor network, Policy network, Deep RL policy, Policy Network, Control Policy Model

Variant of Learned Decision Policy abstract

When to choose. Choose when states are high-dimensional (images, sensors) or actions are continuous, so tables cannot be stored or visited.

specializesis trained byis trained bydeployed onalternative toLearned Decision Policy: specializesLearned Decision PolicyPolicy/Value Network Trainer: is trained byPolicy/Value Network Tra…Continual Learning Trainer: is trained byContinual Learning TrainerAction Prior Estimator: deployed onAction Prior EstimatorTabular Value Function: alternative toTabular Value Function
Direct neighbourhood (hover for relationship types)

Relationships

deployed on structural

is trained by lifecycle

alternative to variability

Quantitative guidance

As stated by the sources; verify before use.

Classification

Patterns
Function approximationConvolutional feature extraction from pixelsFrame stackingDueling architectureContinuous action output
Quality attributes
Functional suitability: correctness and validity (ISO/IEC 25010 | NIST AI RMF: valid)Performance efficiency (ISO/IEC 25010)
Risks mitigated
Curse of dimensionality in tabular methods

Sources

  1. Ch5.5: T. Nguyen, "Monte Carlo Tree Search Fundamentals," in Mastering Agentic AI Systems: Guide for the NVIDIA NCP-AAI Exam, 1st ed. 2026, ch. 5.5. ISBN: 9798244538229.
  2. Ch5.7: T. Nguyen, "Episodic Memory," in Mastering Agentic AI Systems: Guide for the NVIDIA NCP-AAI Exam, 1st ed. 2026, ch. 5.7. ISBN: 9798244538229.
  3. Ch5.12: T. Nguyen, "Learning-Based Decision Making Fundamentals," in Mastering Agentic AI Systems: Guide for the NVIDIA NCP-AAI Exam, 1st ed. 2026, ch. 5.12. ISBN: 9798244538229.
  4. Ch5.13: T. Nguyen, "Hybrid Decision Systems Fundamentals," in Mastering Agentic AI Systems: Guide for the NVIDIA NCP-AAI Exam, 1st ed. 2026, ch. 5.13. ISBN: 9798244538229.