来自该信源的全部动态 · 共 981 条
论文提出CO-ALIGN概念本体对齐方法,用概念图对齐缓解文本到图像扩散模型从训练数据继承的有害偏见。相比仅改文本编码器或推理引导,目标是在降低偏见的同时保持生成语义一致性。
论文提出 Oyster-II,用强化学习做「建设性安全对齐」:不只拒答有害请求,而是在识别合法意图后给出安全、可执行的替代帮助。工作聚焦同时提升安全性、有用性与可信度,为拒答式对齐过度保守提供新训练思路。
论文提出 APeB,用个性化商品搜索测试大模型智能体在原始、欠明确查询下的个性化能力。基准要求智能体从噪声交互历史中推断潜在意图、提取偏好并在候选项中决策,弥补现有评测依赖精炼查询和简化历史的不足。
论文提出 PivoARL,用于提升大模型智能体对失败轨迹的利用效率。方法识别交互过程中的关键错误节点,并围绕这些节点生成自反馈与局部重试,避免全量重试成本高、经验检索信号稀释的问题,面向长程交互任务优化决策学习。
论文探讨用模糊逻辑扩展答案集编程,将数值数据映射到高、低、昂贵、便宜等上下文相关的定性概念,以支持更贴近人类的模糊推理。研究基于另文形式化的语言,通过案例展示其在定性知识表示中的应用潜力。
论文关注长时间运行的编码智能体在开放式优化任务中易固化单一路线的问题,认为单智能体累积上下文和单一可编辑程序状态会限制探索。SwarmResearch尝试通过编排多个编码智能体与多程序状态,提升发现替代方案和更优解的能力。
论文研究多智能体系统用于事件预测时的信息分配问题。作者指出,若所有LLM智能体接收相同证据,讨论容易退化为从众,难以优于单智能体;通过让智能体掌握差异化证据,可促进真实信念修正,提升推理校准与预测质量。
论文提出OPINE-World,用LLM合成可执行代码形式的世界模型,并通过反例引导归纳综合迭代修正。方法重点优先探索本体层面的错误,以提升交互数据效率、可迁移性和对未知任务环境的适应能力,面向智能体世界模型研究。
论文提出EO-Agents,将科学假设生成约束在NASA地球观测知识图谱中:先用异构图神经网络基于历史共用关系排序候选数据集组合,再由三智能体LLM流水线生成和评估假设,面向遥感与地球科学研究。
论文提出 SemHash-LLM,用于大规模文档语义去重。框架融合字符、词元和文档级信号,结合语义投影哈希、注意力加权 MinHash、对比边界学习与选择性 LLM 判定,通过级联过滤在保持语义等价识别能力的同时提升海量语料处理效率。
论文提出 Agent4cs,用多智能体方式为大型层级代码库生成摘要。方法不再把源码视为扁平文本,而是利用仓库结构、依赖关系与层级信息,面向结构混乱、文档不足的项目提升代码理解与总结能力。
论文提出 PACE,一种神经符号反事实解释框架,将数据驱动搜索与领域知识、干预约束结合,生成既能改变模型预测又现实可行的最小输入修改,面向提升可解释 AI 在高风险决策中的可操作性。
论文提出Hawk,针对NPU内核开发中硬件约束隐性、内存层级严格导致的人工调优瓶颈,引入硬件感知知识提升大模型生成高性能内核的能力。研究指出通用LLM缺乏NPU先验,直接迁移相似代码虽可能通过编译,但难以可靠获得高性能。
论文指出,语言模型即使用标注为虚构的文档微调,仍会相信其中核心主张,正确识别虚构比例仅约9%。作者提出Goggles预训练模块,通过梯度编辑干预模型表征,以诱导更稳定的认知框架。
论文提出面向产品改进的利润型反事实解释方法,试图解决回归任务中需预设目标值和距离函数的问题。研究以日本漫画销量为案例,将解释变量变化与利润影响结合,生成更具商业可执行性的改进建议,适用于可解释机器学习和数据驱动决策场景。
论文将混合专家扩散语言模型DiffusionGemma-26B适配到医学场景,并与同规模自回归Gemma-4-26B在相同LoRA设置下对比,评估其在交互式放射报告草拟中的双向去噪生成能力与医学文本生成潜力。
论文提出「AI交通科学家」框架,用自主AI系统从异构交通观测与实验线索中生成、检验并归纳普适交通规律,减少依赖专家提出候选假设的流程,为拥堵、出行与驾驶行为建模提供自动化科研范式。
论文研究语言模型对齐中的列表式偏好优化,针对候选答案排序存在标注分歧、近似并列、反馈损失或奖励模型噪声等不确定性,提出分布鲁棒方法,将鲁棒性从成对偏好扩展到完整排序监督。
论文指出,强化学习提升LLM推理与问答正确率的同时,常忽视置信度表达,导致准确率与自评置信度失配。作者研究置信度校准方法,用于指导自适应测试时扩展,让模型在不确定时投入更多计算,在高置信场景减少开销。
论文提出COMFYCLAW,面向基于工作流的图像生成任务,让智能体从历史执行中沉淀可复用技能,记忆流程模式、约束与用户偏好,以提升重复、领域化创作流程的自动化效率。