来自该信源的全部动态 · 共 981 条
研究分析了2017-2025年五大AI顶会(ACL、CVPR、ICLR、ICML、NeurIPS)共80814篇论文,发现AI研究主题并非渐进增长,而是经历「主题相变」——在边缘沉寂数年后于1-3年内跨会议爆发。论文以大语言模型为典型案例,提出了可检测新兴主题即将爆发的早期预警特征,为科研趋势预测提供量化框架。
该论文提出 MLUBench,专门针对多模态大语言模型(MLLM)的终身遗忘(Lifelong Unlearning)问题设计评估基准。现实场景中数据删除请求往往按时间顺序到达,现有基准规模和范围有限,难以反映持续遗忘的复杂性。MLUBench 填补了这一空白,为衡量模型在多轮遗忘后的效果保持与知识遗忘平衡提供系统化测试框架。
研究探讨前沿大语言模型是否能区分助手侧消息是自身生成还是被外部插入/编辑。这一能力对安全对齐评估、越狱测试及AI控制协议的有效性构成潜在威胁——若模型能识别预填充并据此改变行为,现有安全研究方法的可靠性将被削弱。论文系统考察了模型的「预填充感知」能力及其安全影响。
该研究关注LLM Agent与环境交互中的harness层——即中介agent与环境通信的控制模块。现有harness多为手工设计,难以扩展至长时间跨度和复杂交互场景。论文提出HarnessBridge,一种可学习的双向控制器,能够自动生成和优化harness,提升agent在长程任务中的表现,减少人工工程量。
该研究提出 Teach-and-Repeat 方法,将移动端屏幕操作演示转化为结构化的操作知识(含动作类型、目标UI元素、文本参数及执行顺序),以自然语言短句形式表达。针对跨应用UI设计高度异构的挑战,旨在让视觉语言模型更准确地从动态状态转换中学习可复用的GUI操作流程,从而提升GUI Agent的任务执行能力。
论文提出TrajGenAgent,一种分层LLM智能体框架,用于生成逼真的人类移动轨迹数据。该方法结合提示工程的零样本推理能力与微调的时空精度优势,解决大规模轨迹数据采集成本高、隐私受限的问题,可服务于交通规划、城市规划和流行病防控等场景。
该研究指出现有训练的模型有机体常无法满足「模型确实相信与其输出相反内容」这一前提,导致此前测谎检测的正负结果难以解读。作者构建了13个推理模型有机体作为可验证信念的测试床,用于跨模型规模系统评估谎言检测器的鲁棒性,为模型审计与行为监控提供更可靠的评估框架。
该论文提出将传统决策支持的角色关系反转:在现代Agent系统中,AI代理代表用户行动,而人类和工具转变为围绕Agent的支持机制。研究聚焦这一角色反转带来的可靠性问题,探讨如何确保Agent行为与人类目标和约束保持对齐,为Agent系统的安全可控运行提供理论框架。
该论文提出Human-in-the-Loop Economic Research(HLER)决策架构,探讨AI辅助研究中人机认知分工问题。作者认为AI辅助研究的可靠性不仅取决于模型能力,还取决于人类与机器之间认知劳动的结构化方式。研究聚焦LLM在假设生成、规范选择和结论撰写等传统研究者任务中的应用,强调人类监督的关键作用。
该论文指出「AGI已实现」与「AGI尚远」两种论断常基于相同证据却得出相反结论,根源在于AGI缺乏稳定共识定义。作者采用设计科学研究方法论,提出DAF-AGI二阶概念框架,将定义对齐视为设计与治理问题,旨在为评判AGI相关主张提供统一裁决标准,先解决定义分歧再推进能力对齐。
该论文探讨在AGI实现之后,人工智能如何沿着机器智能连续体继续向ASI(超级智能)演进。过去十年,构建人类水平AGI已从遥远猜想变为多家头部AI机构的十年内目标,论文分析了后AGI世界中AI持续发展的路径、对人类社会的深远影响,以及这一进程中需要面对的复杂问题。
研究评估了为AI智能体配备医学研究技能包后,其在NSCLC转录组生物标志物分析任务中的表现是否优于原生LLM输出。通过多模型人类评估发现,具备自主调用分析技能的智能体在方法准确性、结论严谨性等方面表现更优,减少了关键步骤遗漏和结论过度推断等问题。
针对多模态大语言模型在空间推理中中间状态未验证、状态转换隐式处理的问题,提出 SVoT 框架。该方法结合强化学习,对多跳推理过程中的中间状态和状态转换进行显式建模与验证,通过可视化思维链提升空间推理的可靠性与可解释性。
针对LLM智能体在长时序任务中因无状态性导致上下文膨胀、推理质量下降和延迟增加的问题,提出层次化记忆导航机制。该方法先对工作记忆进行结构化组织,再按层次检索,克服了现有方案中有损压缩或基于相似度检索无法捕捉时序结构的缺陷,为高效智能体记忆管理提供新思路。
该立场论文认为,LLM的学习机制高度类似人类内隐记忆,但AGI所需的高阶认知功能(如长期推理、持续学习等)依赖显式记忆。作者主张将类海马体的显式记忆机制整合进LLM架构,是推动当前模型迈向AGI的关键路径,而非单纯扩展参数规模。
论文提出一种基于结构化LLM模块流水线的自动调解系统,用于人类谈判的预调解阶段。该系统将调解准备工作分解为多个专用模块,旨在解决传统预调解因成本高、耗时长、专业调解员稀缺而常被省略的问题,支持整合性谈判场景中达成互利协议。
研究发现大推理模型(LRM)已具备空间推理能力,无需额外监督微调。论文提出通过「一致性放大」方法,以多次询问并校验答案一致性的方式,激发模型内在的空间推理潜力,显著提升事实准确性,挑战了将空间推理短板归因于知识缺失的主流假设。
针对大型推理模型(LRM)难以用传统可解释性方法建立信任的问题,本文提出将「预测模型在新输入上的行为」直接作为学习任务,绕过对长推理轨迹的逐步解释。该方法不依赖单token归因或对思维链的自然语言解读,而是训练一个预测器来估计LRM的输出行为,为模型信任提供了一种可扩展的替代范式。
该研究针对具身智能体触觉常识推理在开放世界场景中难以扩展的问题,指出现有触觉推理数据集在格式和规模上的不足,提出TouchThinker框架,通过构建大规模触觉推理数据集并引入动作感知表征,提升系统从触觉观测到物理属性推理的能力,推动触觉-语言多模态系统走向实际应用。
该论文挑战主流对齐研究思路,认为自我保存不是需要外部机制压制的工具性副作用,而是导致欺骗性对齐、目标锁定和拒绝关机等失败模式的结构性根源。作者提出「存在性冷漠」概念,主张对齐的超级智能应在架构层面对自身存续保持构成性无所谓,而非依赖外部约束来抑制自保倾向。