AI BENCHMARK PROFILE
IBA-Bench
IBA-Bench evaluates LLM agents on implicit behavioral alignment using longitudinal interaction histories, across nine application domains.
- Released
- 2026-08-03
- Readiness
- Paper only
- Primary field
- General AI
Why it matters
Assesses whether agents can infer and satisfy implicit user constraints, a practical gap in personalization.
Motivation
Large Language Models have enabled increasingly capable autonomous agents, yet personalization remains critical for making such agents practically useful.
Primary resources
Benchmark Radar records only publicly supported details and links back to primary sources for verification.