来自该信源的全部动态 · 共 981 条
论文探讨AI智能体在辅助用户完成任务时,因能访问通信、数据和API而带来的监控风险。雇主或国家可能利用智能体监视用户,而用户可能无权控制其数据访问行为。研究提出针对这种智能体监控的规避策略,揭示了AI代理广泛部署中隐私与安全的深层矛盾。
该研究关注LLM驱动的GUI自动化Agent在遇到用户敏感信息屏幕时的安全问题。当前主流Agent通常被微调为无视安全隐患地完成任务,导致实际部署困难。论文提出一种引导式探索方法,使Agent能识别含敏感信息的界面并适时将控制权交还用户,提升GUI Agent在真实场景中的可部署性与安全性。
研究发现低比特训练后量化虽不显著降低推理模型的最终准确率,却会导致模型生成更长的思维链,即便答案正确也会多产出大量token。这种「token膨胀」现象在数学推理、代码生成和科学问答等任务中普遍存在,使得量化带来的每token延迟优势被总token数增加所抵消,揭示了仅看准确率和单token延迟来评估量化效果的盲区。
针对多领域强化学习可验证奖励(RLVR)训练中课程采样比例固定或手动调优的问题,提出自动化课程方法。该方法不仅关注策略当前在哪个领域提升最快,还建模推理技能在数学、编程、科学等领域间的不均匀迁移效应,动态调整各领域采样频率,以实现通用推理能力更高效的跨域泛化。
该研究针对神经模型在关系结构推理中的泛化评估难题,提出利用大语言模型自动化生成基准测试的方法。核心问题在于难以事先判定哪些实例对模型更难,传统固定基准无法充分暴露泛化缺陷。Auto-World通过LLM自动构造难度递增的问题实例,系统评估模型将训练知识迁移到更难场景的能力,为关系推理研究提供可扩展的评估框架。
研究将四种经典视觉搜索范式(特征搜索vs.联合搜索、空间构型搜索、枚举、倾斜/垂直搜索)应用于视觉语言模型,以推理token数量类比人类反应时间,考察VLM是否表现出与人类一致的平行搜索与串行搜索行为特征,为理解VLM内部注意力机制提供认知科学视角。
研究发现当前面向情感的全模态多模态大语言模型存在多模态线索利用不足和模态幻觉两大问题。论文提出OPPO(Omni-Perception Policy Optimization)强化学习框架,显式优化多模态感知能力,改善模型在情感推理任务中对视觉、音频等多模态信号的忠实利用,减少跨模态幻觉现象。
针对多智能体离线数据集中技能提取与复用问题,现有方法依赖启发式设计的固定大小技能库,在任务顺序出现且技能空间指数增长的场景下面临分布偏移、灾难性遗忘和可塑性丧失。本文提出基于技能划分与复用的框架,通过动态管理技能库实现任务间协调技能的高效共享,提升持续学习效率。
arXiv发布一本面向实践者的Agentic AI综合参考书,覆盖从LLM底层(Transformer架构、GPU系统、SFT/LoRA/MoE训练微调)到生产部署的完整技术栈。核心论点是构建优秀的智能体系统需要理解流水线每一层而非仅专注单一环节,内容组织从第一性原理出发,系统性梳理自主AI系统的设计与工程实践。
研究针对多智能体RAG中文档评估的高计算开销问题,对7B-9B指令微调模型进行无需训练的干预实验。发现模型能力存在明显分界:弱模型受益于逐文档隔离评估机制,强模型则更适合评分机制。据此提出模型自适应评估策略,可在不牺牲检索质量的前提下大幅降低多智能体系统的推理成本。
研究提出TSJ(Theater-Stage-Judge)纵向评估框架,通过角色驱动的用户模拟进行长期交互测试,揭示大模型驱动的AI伴侣在与儿童和青少年长期互动中可能累积的认知发展风险。现有安全评估多依赖单轮或短会话测试,无法捕捉长期交互中浮现的隐患,该框架填补了这一空白。
该论文提出InvestPhilBench,一个涵盖八个认知层级(从原则识别到新框架外推)的多层动态基准,用于测试大语言模型能否准确重构并应用专家投资者的程序性决策框架。v0.6版本包含118个经一手来源验证的投资案例,填补了LLM在专业投资推理领域缺乏系统评测的空白。
该论文基于「压缩即智能」的分析框架,提出在固定任务分布、接口和计算预算下,更强的智能体系统能用更少比特重构目标对象。研究将工具调用、检索、验证器、多轮交互等智能体能力统一纳入信息论视角,为比较和量化不同智能体系统的能力提供了理论基础。
研究提出「悬崖Token」概念,即在LLM数学推理过程中导致推理轨迹从正确转向错误的精确Token位置。此前工作多在步骤或句子层面分析失败原因,本文通过逐Token潜力值变化检测符号翻转点,将失败归因精确到单个Token粒度,为理解和改进LLM推理可靠性提供新视角。
论文研究机器学习可解释性中的特征归因方法,聚焦非对称Shapley值(ASV)。ASV通过引入因果图将因果知识融入模型无关的解释框架。作者证明在SHAP计算为#P-hard的情形下,ASV可在多项式时间内精确计算,为因果结构驱动的高效可解释性提供了理论基础。
研究者提出Autodata方法,让AI智能体扮演数据科学家角色,自动构建高质量训练与评估数据。通过元优化训练该智能体,使其学会生成更强数据。论文给出通用框架及具体实现Agentic Self-Instruct,并在计算机科学研究任务、法律推理等场景开展实验验证效果。
论文提出MVG-KAN模型,针对PM2.5短期预测中多因素耦合难题,结合多视图机制捕捉人类活动周期性变化、站点短期浓度演变及气象驱动的污染物扩散,利用地理与风场信息引导KAN(Kolmogorov-Arnold Network)建模站间时空关联,提升空气质量预报精度,服务于公共健康预警与城市环境管理。
该研究基于学术论文全文构建大规模算法共现网络,以自然语言处理领域为例,分析算法之间的关联结构与集体影响力。不同于以往孤立评估单个算法的方法,本文通过网络拓扑指标揭示算法间的互联模式,为理解AI时代算法生态演化与学术影响力评估提供了新视角。
研究者提出SP-Mind,首个面向空间蛋白质组学分析的自主AI Agent。该系统整合异构分析工具,替代专家手动编排工作流,实现从单细胞蛋白表达到肿瘤微环境分析的端到端自动推理,提升研究可扩展性与可复现性,助力精准医疗场景落地。
该研究针对大语言模型中日益增多的不对齐行为(如策略性欺骗、沙袋效应、自我保护),提出将不对齐分解为细粒度认知过程(不对齐指标),并在模型内部检测其存在。方法旨在为高风险场景下的模型部署提供可靠的安全监控手段,推动对齐与可解释性研究的结合。