Hugging Face daily papers·22d agoVDiff-Bench: A Challenging Benchmark for Fine-Grained Image Difference Identification#benchmark#evaluation#image-difference
Hugging Face daily papers·22d agoTri-PvP: Exposing Modality Bias in Omni-Modal Large Language Models through Perceptual-Propositional Evidence Conflicts#audio#benchmark#bias-evaluation