来自该信源的全部动态 · 共 981 条
神经组合优化(NCO)性能优异但黑箱特性阻碍部署与诊断。传统可解释方法如概念瓶颈模型难以适应NCO动态、状态依赖的决策过程。本文提出演化程序瓶颈(EPB)框架,据称首次为NCO提供可解释的程序化中间表示,通过演化搜索生成可读的决策逻辑瓶颈层,兼顾性能与透明性。
该论文对扩散语言模型(DLMs)进行系统性实验分析,对比其与自回归大语言模型在文本生成上的差异。DLMs通过迭代去噪而非逐token预测来生成文本,支持对整个序列的并行优化。研究梳理了多种扩散架构的设计差异,为理解这一新兴范式的优劣提供了实证基础。
论文提出基于评分标准条件化的自蒸馏方法,解决推理模型后训练中监督蒸馏依赖昂贵且含噪的CoT标注、强化学习依赖稀疏可验证奖励两大问题。该方法以结构化评分标准(Rubric)为条件,让模型通过自蒸馏学习推理能力,减少对外部高质量标注的依赖,同时避免不完美推理链干扰训练效果。
针对多模态欺骗检测中端到端黑箱模型缺乏可解释性的问题,研究者提出 ThinkDeception 框架,通过渐进式强化学习生成透明的推理轨迹,显式捕捉跨模态不一致性。该方法旨在超越传统方法无法提供清晰决策依据的局限,为欺诈意图识别提供可追溯的解释路径。
该论文指出万维网三十年来以人类为主要消费者的基本假设正被AI Agent的崛起所颠覆。当前Web通过CAPTCHA、封锁等手段抵抗Agent访问,论文系统性分析了访问模型、经济模型和内容层面的冲突,提出重新设计Web架构以适应Agent作为人类与内容中间层的新范式。
论文提出ProfiLLM框架,将大语言模型作为语义特征提取器引入工业级网约车调度系统。针对平台行为日志中难以用结构化数值特征表达的上下文信号(如司机对特定区域的习惯性回避),利用LLM生成与效用目标对齐的用户画像,弥补现有匹配流水线在行为语义理解上的不足。
该研究聚焦共享工作空间中人类与AI团队协作模式,利用Collaborative Gym环境和DiscoveryBench任务,考察加入模拟人类协作者何时能提升AI Agent表现、何时产生过程损失。研究揭示了人机协作中责任协调的关键挑战,为设计更高效的人机协同工作流提供实证依据。
现有幻灯片自动生成基准主要评估内容完整性与技术深度,忽视了目标受众这一关键因素。研究团队提出X+Slides基准,专门评测大语言模型在不同受众条件下(如专家需严谨证明、决策者需可操作结论)生成幻灯片的能力,填补了受众适配维度的评测空白。
研究者提出 RTSGameBench,一个基于即时战略(RTS)游戏的基准,用于诊断视觉语言模型在战略推理方面的不足。RTS 游戏要求与盟友协调、适应对手策略并在部分可观测条件下进行长期规划,是测试 VLM 在竞争与合作场景中预判和影响他者行为能力的天然试验场。该基准填补了现有 RTS 评测的空白。
针对单一骨干模型搭配大量任务专用适配器的场景,提出ARIADNE框架,解决推理时查询无任务标签、需自动从异构适配器池中选择最佳适配器的问题。该方法无需访问适配器权重等内部信息,对适配器类型不可知,适用于开放生态下的PEFT适配器动态路由,提升多适配器系统的实用部署能力。
针对GUI智能体在闭环执行中偏离专家轨迹后缺乏有效监督的问题,提出技能引导的延续蒸馏方法。该方法识别策略诱导的离轨状态,并利用技能级别的引导信号为这些未见状态生成监督信号,使智能体能在偏离专家路径后仍做出合理决策,提升闭环执行的鲁棒性。
研究者提出ForecastBench-Sim,一种基于Freeciv回合制策略游戏的模拟世界预测基准。该基准解决了真实世界预测评估中结果兑现慢、尾部事件稀少、反事实问题难以评分等限制,通过游戏回放生成结构化世界快照供预测者使用,支持快速、可控且可重复的预测能力评估。
现有具身智能体基准多聚焦短时任务执行或纯语言检索,缺乏对动态环境中长期记忆使用的评估。WorldLines提出一个项目驱动的长时域具身家庭智能体基准,要求Agent记住用户习惯、世界状态与历史交互,在真实家居场景中完成跨时间跨任务的连续推理与执行,填补了该领域评估空白。
该论文提出 CaVe-VLM-CoT,一种模块化的反思型 Agentic-RAG 框架,旨在解决视觉语言模型的幻觉问题。框架通过五步推理流程强制执行步骤级引用溯源,并在验证失败时将错误路由回检索环节进行纠正,实现证据驱动的可解释推理,优于现有思维链与检索增强方法。
该研究借鉴神经科学中海马体局部印迹与新皮层共享技能分离的机制,提出将用户个人事实以稀疏局部参数编辑方式写入语言模型权重,而非依赖外挂记忆文件或检索索引。方法旨在让新事实不覆盖其他知识,实现内容与推理技能的解耦,为大模型个性化记忆提供了参数化替代路径。
该研究指出当前预训练阶段安全对齐主要依赖过滤或改写不安全数据,但LLM可能将看似无害的知识组合为不安全行为。论文提出Safety Reflection Pretraining方法,在预训练过程中定期插入安全反思机制,使模型在学习知识的同时内化安全意识,实现比数据清洗更深层次的对齐效果。
该论文从形式化角度研究通用智能体在多环境、多目标下实现近优行为所需的记忆条件。研究证明,当两个领域共享观测瓶颈但要求不兼容的最优动作时,任何统一近优策略必须在该瓶颈处产生不同的记忆分布,由此给出分离定理:足够成功的智能体不能仅依赖当前观测,必须维护区分性内部状态。
论文介绍部署在低地球轨道航天器上的NAVI-Orbital系统,于2026年4月16日完成据称首次在轨视觉语言模型自主多任务演示。该系统针对地球观测数据生成速度超过下行带宽与人工处理能力的瓶颈,利用零样本VLM在星上实现自主识别与决策,缩短从采集到可用情报的延迟。
研究者发布DeFAb基准,将四十年公开知识库转化为可验证的可废止溯因推理实例。基于规则的逻辑求解器可在50微秒内以100%准确率解决所有实例,而最强前沿语言模型最高仅达65%,在鲁棒性评估(四种表面渲染最差情况)下降至23.5%,揭示了当前LLM在形式推理能力上的显著短板。
论文提出QSignAI平台,利用双源提取器生成量子随机数并嵌入AI驱动的社交平台,实现AI与量子科学的双向融合。该系统已实际部署于实时事件参与场景,探索量子随机性在身份签名中的应用,呼应2024-2025年诺贝尔奖与图灵奖同时表彰AI和量子科学的趋势。