KVSmooth: Mitigating Hallucination in Multi-modal Large Language Models through Key-Value Smoothing (CVPR 2026) 2026-07-29 #深度学习 #大模型
HALLUCINATION-AWARE INTERMEDIATE REPRESENTATION EDIT IN LARGE VISION-LANGUAGE MODELS (ICLR 2026) 2026-07-23 #深度学习 #多模态 #大模型
Analyzing and Mitigating Object Hallucination: A Training Bias Perspective (AAAI 2026) 2026-07-22 #深度学习 #多模态 #大模型
More Tokens are Better but Not Necessary in Forensic Vision-Language Models (arxiv 2026) 为多媒体取证任务中的MLLMs设计的免训练视觉 token 压缩框架。 深大、哈工深、中山大学网安 2026-07-22 #深度学习 #多模态 #大模型
Mitigating the Object Hallucination of LVLM via Adaptive Factual-Guided Activation Editing (ICLR 2026) 又是加强版VTI。 2026-07-21 #深度学习 #多模态 #大模型
RFI: Rectified Flow Intervention for Mitigating Object Hallucination in Large Vision-Language Models (AAAI 2026) 厦门大学、华南师范大学。 2026-07-17 #深度学习 #多模态 #大模型
Toolformer:Language Models Can Teach Themselves to Use Tools (NeurIPS 2023 oral) 早期调用工具的大模型。 2026-07-09 #深度学习 #大模型