Bear
  • 首页
  • 目录
  • 标签
  • latex识别
  • 每日arxiv
  • 关于
顽石从未成金,仍愿场上留足印。

Implicit Bias Injection Attacks against Text-to-Image Diffusion Models

(CVPR 2025) 作者来自武汉大学,中大网安。
2025-11-28
#深度学习 #大模型

VASparse:通过视觉感知的 token 稀疏化实现高效视觉幻觉缓解

(CVPR 2025)
2025-11-27
#深度学习 #多模态 #大模型

Be My Eyes:通过多智能体协作将大型语言模型扩展到新模态

(arxiv 2025)2511.19417
2025-11-26
#深度学习 #多模态 #大模型

把MoE整合进LLaVA

(ICLR 2025)《LLaVA-MoD: Making LLaVA Tiny via MoE Knowledge Distillation》 (TMM 2025)《MoE-LLaVA: Mixture of Experts for Large Vision-Language Models》
2025-11-24
#深度学习 #多模态 #大模型

ARC Is a Vision Problem

何恺明出品。arxiv 2025。
2025-11-20
#深度学习

UpSafe℃: Upcycling for Controllable Safety in Large Language Models

(ICLR 2026)分数:4 4 4 6
2025-11-18
#深度学习 #大模型

Do Not Merge My Model! Safeguarding Open-Source LLMs Against Unauthorized Model Merging

(AAAI 2026) 创新性很强,理论性很强的一篇论文。是不是可以拿个Oral。
2025-11-17
#深度学习 #大模型

非文本的上下文学习

《VECTOR-ICL: IN-CONTEXT LEARNING WITH CONTINUOUS VECTOR REPRESENTATIONS》(ICLR 2025) 《Can LLMs Reason Over Non-Text Modalities in a Training-Free Manner? A Case Study with In-Context Representation Lea
2025-11-13
#深度学习 #大模型

多模态大型语言模型的幻觉概述

基于综述《多模态大型语言模型的幻觉》2404.18930。
2025-11-12
#深度学习 #多模态 #大模型

借助主动检索增强缓解大型视觉语言模型的幻觉问题

TOMM,CCF-B类,三区 方法主动触发检索置信度感知 (Confidence-aware):基于输出token的置信度 。如果置信度低于阈值则触发。实验证明这种方法不稳定 。 图像感知 (Image-aware):比较模型对“原始图像”和“加噪图像”的回答概率差异 。 问题感知 (Question-aware):(本文最终采用的方法) “问题感知”详解: 此方法的核心是评估模型在多大程度上
2025-11-11
#深度学习 #多模态 #大模型
1…1011121314…39

搜索

LJX Hexo
博客已经运行 天