Benchmark Radar
AI BENCHMARK PROFILE

CommunityFact

General AIMultimodal Perception

CommunityFact evaluates misinformation detection on 15,992 claims across five languages and two domains, using accuracy against human Community Notes ratings as the scoring metric.

Released
2026-05-28
Readiness
Paper only
Primary field
General AI

Why it matters

Static benchmarks fail to capture dynamic, multilingual misinformation settings. CommunityFact provides a refreshable benchmark to assess model reliability in real-world verification contexts.

Motivation

Misinformation verification increasingly occurs in public, fast-moving, and multilingual online settings, where static benchmarks provide an incomplete measure of model reliability.

Primary resources

Benchmark Radar records only publicly supported details and links back to primary sources for verification.