Benchmark

PM-Bench

What is PM-Bench?

PM-Bench evaluates prospective memory in LLM agents through a text-based simulated seven-day week. Agents must maintain user intentions, execute delayed…

Released
2026-07-14
Evaluates
General AI, Language & Knowledge, cs.AI
Openness
unknown
Importer
Claire Radar
Review status
unreviewed
Reported scores
0

Source provenance

PM-Bench paper

No reported scores are on record for this benchmark yet.

Which sources cite PM-Bench?

Related General AI, Language & Knowledge, cs.AI benchmarks