Zone of Proximal Policy Optimization: Teacher in Prompts, Not Gradients (arxiv 2026) 2026-06-22 #深度学习 #大模型
When is Your LLM Steerable? (arxiv 2026) 提出了一种名为 SteerBoost 的方法,通过分析大语言模型在生成最初几个 token时的内部隐藏状态变化,来提前预测激活引导(Activation Steering)的最终效果,从而大幅降低了寻找最佳引导参数所需的完整文本生成和事后评估成本。 2026-06-20 #深度学习 #大模型
When Do Hallucinations Arise? A Graph Perspective on the Evolution of Path Reuse and Path Compression ( ICML 2026) 从图结构的视角深入剖析了decoder-only Transformer架构的大型语言模型产生推理幻觉的内部机制。 2026-06-16 #深度学习 #大模型
Graph of Thoughts: Solving Elaborate Problems with Large Language Models (AAAI 2024) 2026-06-15 #深度学习 #大模型
Q-MLLM: Vector Quantization for Robust Multimodal Large Language Model Security (NDSS 2026) 2026-06-11 #深度学习 #多模态 #大模型