来自该信源的全部动态 · 共 981 条
论文提出SEA架构,将自修改限制在小型 steering adapter 与版本化 harness 中,冻结基础模型;每次修改需通过随时有效检验门并生成可审计证书,试图为自进化智能体提供学习理论保证与安全约束。
论文提出「认识论AI素养」框架,将AI素养视为学生在生成式AI辅助编程中形成问题、验证输出、调节策略的过程性能力,并尝试识别共编程中的认识目标与学习过程。
论文提出MuSix框架,将MoE用于具身智能体的世界模型学习,引入显式尺度路由与分尺度更新策略,以应对现实环境中知识变化速度不同、局部尺度需定向更新的问题,目标是提升多尺度推理与适应能力。
论文提出面向软件与机器人智能体的运行时托管自治控制框架,用五档执行模式管理观察、建议、规划、执行与干预,缓解未验证动作、无限循环和错误状态导致的安全与连续性问题,覆盖单智能体和多智能体网络物理系统。
论文提出面向开放网页数据采集的受约束、可验证智能体框架,将LLM输出从自由代码改为类型化JSON采集配置,结合六类采集器、模板与工具函数约束及静态验证,缓解依赖错误、选择器失效和结构异构等问题。
论文提出Theoria验证架构,将候选答案改写为带类型的状态转移序列,用可审计的改写可接受性检查连接形式化证明的确定性与LLM评审的覆盖面,旨在提升AI答案可信度。
论文指出,传统AI对齐常把人类偏好视为固定目标,但经验研究显示偏好会在人机互动中被建构和改变。随着AI更持久、个性化并嵌入社会场景,系统本身会影响用户关注、价值与认可,因此需治理偏好动态,而非仅优化既有偏好。
论文提出OpenAgent开放世界工具使用设定,刻画用户查询、动作、观测与领域分布变化下的泛化问题。研究指出,LLM智能体在静态基准表现良好,但面对真实环境中的工具集和交互动态变化时鲁棒性不足,为评测与训练方法改进提供框架。
论文提出Agri-SAGE闭环框架,将作物生长仿真与多智能体LLM结合,把静态农艺指南转化为随季节、环境和不确定性变化的咨询建议,旨在减少看似合理但缺乏生理依据的农业推荐。
论文提出「有界道德」框架,将西蒙的有界理性扩展到道德认知,尝试用形式化方式刻画有限智能体面对道德问题时的计算需求。框架从道德广度等维度分析情境复杂度,为AI伦理决策、对齐与安全评估提供理论视角。
论文讨论前沿模型在指数级算力扩展下,是否会与小预算开发者可用模型拉开能力差距。作者延续Gundlach等人的研究,指出结论取决于能力度量方式:验证损失显示差距缩小,但其他指标可能呈现相反趋势。
论文将页面级幻灯片个性化建模为逆向规划问题,针对现有智能体方法依赖模板或冗长指令、难以捕捉细粒度设计意图的不足,提出通过结构去噪学习潜在设计意图,用于生成更符合用户偏好的主题与版式。
论文提出MMM数据模型,面向去中心化知识 commons 的互操作需求,试图突破文档中心组织对知识结构化、更新、共享与复用的限制。该规范强调在形式化表达与广泛协作贡献之间取得平衡,适合关注知识表示、语义互联与AI知识基础设施的研究者参考。
论文提出AI原生游戏的判定标准:运行时生成式AI是否构成核心循环,移除后玩法会坍塌或根本改变。综述对话、任务、角色、图像与世界生成等方向,讨论可玩性、评测与设计挑战,并给出研究路线图。
论文提出Self-GC,将长程LLM智能体运行中的工具结果、文件、计划和用户约束视为可治理状态,而非临时文本后缀。方法旨在替代简单剪枝或临界摘要,更好保留未来依赖、精确证据、定位信息与可编辑工件。
论文提出 RareDxR1,用于罕见病鉴别诊断的自主医学推理,目标是减少传统表型抽取和 RAG 在预定义本体、检索瓶颈中的信息损失。其强调从非结构化症状中识别关键表型并在大搜索空间中推理。
论文提出可指导智能体概念,面向交互式游戏中对强化学习策略进行实时控制的问题。区别于只学习单一近优行为的传统RL,研究关注让用户在任务执行过程中影响解法与行为风格,为可控游戏AI、人机协作和机器人策略调节提供思路。
论文研究AI智能体运行时的人类监督:人类私有掌握奖励函数,AI私有掌握其拟议动作质量。作者基于协作逆强化学习框架,将该场景建模为上下文赌博机监督博弈,用于分析机器人或软件代理在监督者无法直接评估情境时的决策与监督机制。
论文针对空中交通管理中路径规划算法难以被战术管制采纳的问题,提出以管制员需求为中心的解空间路径规划思路,强调可解释、计算高效与人机协同,用于支持航路阶段空中交通管制决策。
论文提出Graph-PRefLexOR,一类面向材料发现的图原生推理模型,利用强化学习与概念重组生成科学假设。其重点是让开放式材料设计问题的多步推理更可追踪,缓解大语言模型答案流畅但中间依据不清的问题。