来自该信源的全部动态 · 共 981 条
论文提出Reliability Gating,用本地模型推理时多次采样答案的一致性判断是否交给云端LLM,无需训练路由器或协同微调,并可控制卸载比例,面向资源受限部署降低成本与延迟。
论文提出DC-Leap,用草稿引导的连续跳跃解码加速扩散大语言模型推理,无需额外训练。方法针对现有并行解码因联合概率依赖误差而阈值保守、去噪迭代冗余的问题,旨在提升dLLM生成速度并保持可靠性。
论文比较同一LLM在温度1下重复采样100次与多模型集成的差异,质疑自一致性投票能否捕捉跨问题的不确定性结构。研究指出,随机采样产生的答案波动维度较浅,难以等同于模型多样性。
论文提出一个评估大模型处理多传感器物理危险数据的实证基准,覆盖联合评估、响应比例性和模式消歧三类60个场景,调用5个模型共1800次。结果显示,在多传感器同时升高等场景中,模型普遍未给出预防性警示,暴露安全判断缺口。
论文提出PersonaTrail基准,面向需要从用户原始浏览历史中补全隐含意图的网页智能体。相比显式任务或简化历史的现有评测,它更贴近日常个性化交互场景,可用于检验代理的上下文推断与任务执行能力。
论文提出PlanE,用于构建面向特定任务的抽取式LLM,围绕数据分解、指令调优与推理流程进行元规划,目标是在减少标注成本的同时提升任务适配能力,为低成本定制化LLM提供方法参考。
论文面向配电系统拓扑记录不可靠问题,提出受约束的多源推断方法,融合电气相似性、空间记录等异构数据,以提升密集馈线和元数据不一致场景下的可扩展拓扑识别能力,服务停电定位、电压分析与电网运行。
论文关注文本属性图表示学习的可扩展性问题,尤其是结合大语言模型时的计算瓶颈。作者提出半监督图蒸馏思路,试图在压缩数据规模的同时保留图结构与文本语义之间的交互信息。
论文关注LLM安全中的意图判别难题:有害请求可能被包装成善意问题,且在多轮对话中逐步暴露。作者提出Robust Critics思路,用更稳健的批评器识别跨轮攻击,降低误拒正常用户与放行攻击者的风险。
论文提出Autonomous Topology Mutation机制,使多智能体LLM系统在运行时根据遥测识别个体过载,如动作类别混杂、工具错误累积或调用排队,并安全重构团队拓扑。方法强调能力、状态与影子不变量,以降低动态拆分、迁移或重组带来的失控风险。
论文系统研究大模型欺骗输出检测探针的泛化问题,分析谎言类型、表示层深度、探针表达能力与稀疏特征对检测效果的影响。结果指向跨场景迁移仍是主要瓶颈,有助于改进AI安全评估方法。
论文关注大模型在标准基准表现良好但未必符合真实用户期望的问题,指出现有评测依赖启发式、专家量表或用户模拟,难覆盖人类需求的多样性与细微差异,并提出首个系统化框架衡量模型与现实期望的对齐程度。
论文提出AINTMA,一种面向软件质量保障的多智能体测试管理架构,包含测试发现、风险评估、强化学习等六类专用代理,目标是在分布式云环境中实现自主测试决策、安全通信与自适应质量分析。
论文提出不完整提示越狱概念,研究开放权重大模型在句子补全场景下如何被未完成的有害提示诱导生成危险续写,并系统分析不同吸引子类型、触发条件与安全防护失效模式,为模型对齐与红队评测提供新视角。
论文关注大语言模型生成个性化消息的能力,将个性化定义为在发送方、渠道和时间不变时,针对特定接收者调整内容以促成行动。研究试图突破传统检索排序方法的有限候选约束,评估模型基于接收者特征生成连续变体的效果。
论文提出InferenceBench,用于评估AI智能体在开放式场景中优化LLM推理部署的能力。相比固定流程或窄动作空间基准,它强调真实探索、成本与性能权衡,减少套用已知配方带来的虚高成绩。
论文提出DFAH-Bench,用回放方式评估金融决策中工具型智能体的可观察行为不稳定性,关注工具调用轨迹、证据接触和决策集中度三类信号,无需访问隐藏推理文本,覆盖8127个回放片段。
论文提出一种基于注意力的经验回放框架,用于无关模型的时间序列预测持续学习。目标是在数据分布随时间变化的动态环境中,缓解神经网络对大规模静态数据的依赖,并降低灾难性遗忘对预测性能的影响。
论文提出JAXBench,一个面向Google Cloud TPU的原生基准套件,用于评测AI生成的内核优化能力。它包含50个具备实际相关性和优化空间的JAX工作负载,并从公开架构中提取17个生产级机器学习算子,填补TPU自动内核性能优化缺少共享评测目标的空白。
论文提出一款AI浏览器扩展ClickGuard,用于识别误导性标题党文章。系统结合Transformer嵌入、语言学特征、自定义baitness评分及大语言模型,对新闻标题与内容的信息量进行评估,并尝试从检测扩展到削弱标题党影响。