Benchmark Radar
AI BENCHMARK PROFILE

Hy-MultiTurn

General AIKnowledge & Reasoning

Hy-MultiTurn is a Chinese benchmark for deep multi-turn dialogue understanding, with six controlled evaluation modes covering constraint memory, object localization, and action suppression across 12-76 turn dialogues.

Released
2026-07-31
Readiness
Paper only
Primary field
General AI

Why it matters

Evaluates long multi-turn dialogue capabilities that existing benchmarks miss, offering controlled modes for diagnosing model failures.

Motivation

Long-running multi-turn interactions with chatbots and agents are now common, and a correct response often depends on remembering earlier details, tracking later revisions, identifying intended objects or referents, and withholding action when required conditions are unmet.

Primary resources

Benchmark Radar records only publicly supported details and links back to primary sources for verification.