ETA. [ICLR 2025] PyTorch Implementation of "ETA: Evaluating Then Aligning Safety of Vision Language Models at Inference Time"
34Sherlock. [NeurIPS 2025] Official Implementation of paper "Sherlock: Self-Correcting Reasoning in Vision-Language Models"
31Octopus. [ICML 2026] Official implementation for paper: Learning Self-Correction in Vision–Language Models via Rollout Augmentation
16MIS. [ICLR 2026] Data and Code for Paper Rethinking Bottlenecks in Safety Fine-Tuning of Vision Language Models
12