Loading...
Loading...
Benchmarks a trained Physical AI Studio policy in a simulation gym and reports success metrics. Use when running physicalai benchmark, editing configs under library/configs/benchmark, adding or changing a Benchmark class in physicalai.benchmark, tuning rollout/episode/env settings, recording rollout videos, or interpreting results.json / results.csv.
npx skill4agent add open-edge-platform/physical-ai-studio physicalai-train-benchmarking-a-policylibrary/src/physicalai/benchmark/gyms/benchmark.pyBenchmarkPushTBenchmarkLiberoBenchmarkbenchmark/gyms/results.pyBenchmarkResultsTaskResultlibrary/src/physicalai/eval/rollout.pyevaluate_policyphysicalai benchmarklibrary/src/physicalai/cli/benchmark.pyfrom physicalai.benchmark.gyms import PushTBenchmark
from physicalai.policies import ACT
policy = ACT.load_from_checkpoint("experiments/act/version_0/checkpoints/last.ckpt")
benchmark = PushTBenchmark(num_episodes=1)
results = benchmark.evaluate(policy)
print(results.summary())
results.to_json("results/benchmark/results.json")
results.to_csv("results/benchmark/results.csv")from physicalai.benchmark.gyms import PushTBenchmark
from physicalai.inference import InferenceModel
model = InferenceModel("./exports/act_policy")
results = PushTBenchmark(num_episodes=1).evaluate(model)physicalai benchmark \
--config configs/benchmark/pusht.yaml \
--policy physicalai.policies.ACT \
--ckpt_path experiments/act/version_0/checkpoints/last.ckpt \
--output_dir ./results/benchmark--policy--ckpt_path.ckpt--configconfigs/benchmark/pusht.yamlconfigs/benchmark/libero.yamlBenchmark--output_dir./results/benchmark--benchmark.num_episodes 10 --benchmark.num_envs 8results.summary()results.jsonresults.csv--output_dirvideo_dirrecord_modeallfailuressuccessesnonephysicalai benchmark --config configs/benchmark/<suite>.yaml --policy <ClassPath> --ckpt_path <path> --benchmark.num_episodes 1results.jsonresults.csvBenchmarkResultsTaskResultrecord_mode: failuresBenchmarkbenchmark/gyms/PushTBenchmarkLiberoBenchmarkphysicalai.gymspusht.pylibero.pylibrary/configs/benchmark/library/tests/unit/benchmark/uv run pytest tests/unit/benchmark.ckptBenchmark(...).evaluate(...)num_envsliberorobocasaphysicalai-train-training-a-policyphysicalai-train-exporting-and-validating