Benchmark
TimeSage-MT Benchmark
What is TimeSage-MT?
TimeSage-MT evaluates agentic time series reasoning in multi-turn dialogues, covering 240 tasks and 2,680 turns across 8 domains, with a protocol and…
- Released
- 2026-05-31
- Evaluates
- General AI, Language & Knowledge, Reasoning
- Openness
- unknown
- Importer
- Claire Radar
- Review status
- unreviewed
- Reported scores
- 0
Source provenance
- Original evidence https://arxiv.org/abs/2606.01498
TimeSage-MT paper
No reported scores are on record for this benchmark yet.