AI BENCHMARK PROFILE
MissingBench-Verified
MissingBench-Verified evaluates vision-language models on detecting missing object parts in images, covering ten leading models with consistent failure rates and probing mitigation strategies.
- Released
- 2026-07-21
- Readiness
- Paper only
- Primary field
- General AI
Why it matters
It highlights a fundamental limitation of VLMs for inspection tasks, showing that current prompting and post-hoc corrections are insufficient, which informs the need for architectural changes.
Motivation
Vision Language Models (VLMs) are well known for hallucinating non-existent objects in images.
Primary resources
Benchmark Radar records only publicly supported details and links back to primary sources for verification.