共计 146 篇文章
2026
Cross-Modal Attention Calibration for LVLM Hallucination Mitigation
First Logit Boosting: Visual Grounding Method to Mitigate Object Hallucination in Large Vision-Language Models
Train Once, Reuse Everywhere:Generalizable Implicit In-Context Learning by Routing Attention
ViT³: Unlocking Test-Time Training in Vision
ShellGames: Speculative LLM-Driven SSH Deception
Automatic Layer Selection for Hallucination Detection
Zone of Proximal Policy Optimization: Teacher in Prompts, Not Gradients
VLM³: Vision Language Models Are Native 3D Learners
When is Your LLM Steerable?
Structural Graph Probing of Vision-Language Models