Benchmark

MSEval

What is MSEval?

MSEval evaluates multi-agent software development on authentic full-stack projects using deterministic, requirement-based grading.

Released
2026-07-30
Evaluates
Agents, General AI, Language & Knowledge
Openness
unknown
Importer
Claire Radar
Review status
ai-reviewed
Reported scores
0

Source provenance

MSEval paper and code

No reported scores are on record for this benchmark yet.

Which sources cite MSEval?

Related Agents, General AI, Language & Knowledge benchmarks