来自该信源的全部动态 · 共 981 条
论文提出 ZendoWorld,一个受控交互环境,用于评测 AI Agent 在视觉游戏观察中归纳隐藏逻辑规则的能力。Agent 需提出新场景获取反馈、修正假设,覆盖感知、实验设计与概念推理等关键能力。
论文发布 Nigeria Machinery Usage and Failures Dataset,包含尼日利亚制造业与油气行业89条机器级记录、28项指标,并配套领域知识支撑的推理层,面向低资源工业场景的数值分析与语言模型训练。
论文提出 PARA-PV,用于光伏功率预测的物理感知检索增强框架。方法基于冻结基础模型,并在预测流程中嵌入物理知识与分布偏移校正,以应对天气波动、昼夜切换、工况差异和物理约束,面向电网调度与新能源并网场景。
论文提出「overthinking」黑盒审计方法:利用非推理指令模型与推理蒸馏模型的参数差构造推理任务向量,放大模型「出声思考」倾向,以更容易诱导出潜在隐藏知识或不对齐行为,补足常规部署前审计的盲区。
论文介绍VectorizationLLM,一个基于Google开放权重模型微调的教学助手,面向纽约理工学院MATLAB课程,帮助学生学习智能向量化、时/波矢量分析、分段函数、傅里叶分析和微分方程。
论文提出一种结合大语言模型开放式架构生成与传统NAS高效搜索的机制,试图减少手工设计搜索空间对领域经验的依赖,并适配不同任务。研究重点在于如何划分LLM设计与NAS优化的职责,为自动化模型结构设计提供新思路。
论文提出AegisDx,将假设演绎式临床推理引入AI辅助鉴别诊断,通过专门LLM组件、角色契约和结构化交互,避免一次性诊断遗漏高风险替代方案,并强化推理验证与患者安全。
论文提出对抗社会认识论框架,分析人类与大语言模型密集互动的信息环境中,证言、推理、机构认证与信任链如何被扭曲、遗漏或伪造,并讨论由此带来的公共知识、协作治理与信息完整性风险。
论文检验思维链监控在AI智能体安全中的脆弱性:攻击者可用自然语言说服式越狱影响负责监控的LLM,使其更难识别不当或欺骗性推理。研究提示,仅依赖可见推理轨迹做安全审计存在被操纵风险。
论文提出AutoPersonas,用多时间尺度循环驱动长期人格智能体演化,旨在保持角色可识别性的同时适应事件、关系和社会条件变化。作者指出持续人生循环中的「自锁」失效,并尝试缓解情节停滞与高概率收敛。
论文讨论AI在精算与保险核保中的应用设计空间,比较规则自动化、LLM、RAG与多智能体系统,聚焦非结构化文档、异构数据和受监管决策流程中的推理、检索、工具调用与可审计性。
这篇 arXiv 论文审计了 LLM-as-judge 中常用的自一致性与跨模型一致性信号,指出评审之间或模型多次采样的一致并不等同于答案正确。研究认为,企业评测流水线若将一致性直接当作置信度,可能系统性高估模型表现。
论文提出Feedback Manipulation Regularization,用于在模仿学习中进行离线智能体对齐。方法试图把人类示范与反馈作为更丰富的训练信号,缓解现有多阶段、偏语言生成框架的对齐流程局限,面向强化学习智能体学习更符合人类价值的行为。
论文关注LLM在心理健康支持中的安全风险,指出商业化注意力机制可能鼓励持续互动,而非有效干预所需的边界与摩擦。作者提出「对齐可信度」作为医疗AI保障标准,用于评估长期依赖、边界侵蚀等隐性风险。
该论文研究基于视频的自闭症相关自我刺激手部行为自动检测,比较序列神经网络架构与不同时间采样帧率,并分析数据增强策略对训练效果的影响。目标是为远程行为筛查提供更可扩展、可复现的计算方法。
论文提出Infinity-Parser2,一个面向端到端文档解析的大型多模态模型。其核心是可控数据合成流水线与多任务强化学习,用于缓解高质量标注文档解析语料稀缺问题,并构建可扩展的合成引擎与迭代优化流程。
论文指出现有RAG与智能体框架多为被动响应,难以在企业场景中提前发现任务机会。作者提出Context Graph,一种实时关系数据结构,用于建模企业实体、上下文与行动线索,使智能体能在员工提问前推送相关、可执行信息。
论文提出Harness工程方法,将企业LLM应用从依赖提示词和检索上下文的原型,重构为可追踪、可审计的智能体架构。核心是把确定性行为迁移到代码、清单、模式与验证中,支持来源边界、实体路由、答案契约和可复现实验轨迹。
论文提出 AgentLens,用生产环境人工评审结合形式化验证评估交互式编码智能体,不再只看任务是否通过,而是覆盖指令遵循、工具使用、自检、纠错与沟通等完整执行轨迹,旨在更贴近真实用户体验。
论文提出SpaCellAgent,一个面向空间与单细胞转录组轨迹推断的自进化LLM多智能体框架,旨在减少人工干预和异构工具门槛,自动完成细胞发育路径分析流程。