multi-image

Tag

Cards List
#multi-image

Safe Alone, Unsafe Together: Safeguarding Against Implicit Toxicity When Benign Images Combine

arXiv cs.CL ↗ · 2026-07-02 Cached

This paper defines multi-image implicit toxicity (MIIT), where individually benign images become toxic when combined, and proposes MiShield, a model trained with progressively distilled reasoning supervision to detect MIIT. Experiments show MiShield-8B outperforms existing moderation services.

0 favorites 0 likes
#multi-image

ReMMD: Realistic Multilingual Multi-Image Agentic Verification for Multimodal Misinformation Detection

Hugging Face Daily Papers ↗ · 2026-06-23 Cached

ReMMD introduces a realistic multilingual multi-image agentic verification framework for multimodal misinformation detection, including a benchmark (ReMMDBench) with 500 samples and 2,756 images, and an agent (ReMMD-Agent) that achieves superior veracity performance with reduced costs.

0 favorites 0 likes
#multi-image

IndustryBench-MIPU: Benchmarking Multi-Image Attribute Value Extraction for Industrial Products

Hugging Face Daily Papers ↗ · 2026-06-12 Cached

IndustryBench-MIPU is a large-scale benchmark for multi-image industrial product understanding, evaluating 9 MLLMs and revealing a completeness gap where precision is high but attribute recovery is low.

0 favorites 0 likes
#multi-image

Stateful Visual Encoders for Vision-Language Models

Hugging Face Daily Papers ↗ · 2026-06-03 Cached

This paper introduces a stateful visual encoder for vision-language models that conditions visual representations on prior features, enabling better visual comparison in multi-image and agentic settings. The method shows consistent improvements across tasks such as cross-image spatial aggregation and longitudinal radiology.

0 favorites 0 likes
← Back to home

Submit Feedback