Bear
  • 首页
  • 目录
  • 标签
  • latex识别
  • 每日arxiv
  • 关于
顽石从未成金,仍愿场上留足印。

ChunkLLM:A Lightweight Pluggable Framework for Accelerating LLMs Inference

(arxiv 2025)2510.02361 ChunkLLM 不仅在短文本基准上达到与基线相当的性能,同时在长上下文基准上仍保持 98.64% 的性能,并维持48.58% 的关键值缓存保留率。特别地,在处理 120K 长文本时,ChunkLLM相较于原始 Transformer 实现了最高达 4.48× 的加速比。 现有方法的局限性: 线性注意力(Linear Attention)(如Mamb
2025-10-26
#深度学习 #大模型

RoseLoRA:面向知识编辑与微调的预训练语言模型行与列稀疏低秩适配

(EMNLP 2024)
2025-10-22
#深度学习 #大模型

拒绝如坠悬崖:推理中的安全对齐为何失效?

(arxiv 2510.06036) 核心思想与摘要大型推理模型(LRMs)虽然展现了强大的多步骤推理和解决问题的能力,但它们在安全对齐方面却常常表现不佳,存在令人担忧的漏洞 。这篇论文的核心目的就是从“机理解释性”的视角出发,探究这些推理模型安全对齐失败的内部机制 。
2025-10-21
#深度学习 #大模型

LVLM幻觉幻觉思维导图

截止至25年10月3日,参考github awesome。
2025-10-16
#笔记 #多模态

Kaggle Grandmasters playbook:7 种经过实战考验的表格数据建模技术

转自nvidia的blog
2025-10-14
#笔记 #kaggle

五篇幻觉相关论文速览(二)

师兄组会所提到。 2506.04039 2509.21997 https://aclanthology.org/2025.naacl-long.75.pdf 2505.24007 2503.13107
2025-10-11
#深度学习 #多模态 #大模型

So You Want to Be an Academic?

转自《所以你想成为一名学者吗?我希望我在研究生院早点就知道什么》l。作者是是约翰霍普金斯大学计算机科学系的助理教授。担任过ICCV 2025、CVPR 2025、WACV 2025 的AC。
2025-10-06
#笔记 #演讲

一篇顶会论文的诞生:从零到一的实战经验分享

作者吴家隆,东南大学硕士生。之前曾在西湖大学和 AIWaves 实习,并且是通义实验室的DeepResearch团队的创始成员。
2025-10-05
#笔记 #演讲

通过外推一个巨大且假设的语言模型的概率来解释和改进对比解码

(EMNLP 2024 Oral)
2025-09-28
#深度学习 #大模型

五篇幻觉相关论文速览

师兄组会所提到。 2508.20181,2410.15778,2311.07362,2407.06192,2406.01920
2025-09-27
#深度学习 #多模态 #大模型
1…1213141516…39

搜索

LJX Hexo
博客已经运行 天