来自该信源的全部动态 · 共 677 条
论文指出,零样本文本转语音中Best-of-N推理常用ASR验证器挑选候选音频,但评测结果会受ASR家族对齐显著干扰。在LibriSpeech-PC与F5-TTS实验中,Whisper、wav2vec 2.0、HuBERT作为评测器会导致验证器排名反转,提示需重新设计TTS评估协议。
论文介绍面向MLC-SLM 2026挑战任务1的多语种双人对话语音识别系统:先用模块化说话人分离前端完成VAD、子段生成、CAMPPlus嵌入、双人谱聚类和RTTM切分,再接入适配后的Qwen3-ASR-1.7B识别器。
论文提出COBART,用前缀控制 tokens 结合BART微调生成广告标题,面向不断变化的广告格式和创意约束,在自动生成同时优化点击率与质量,并支持定制化控制。适合关注广告文案生成、受控文本生成和营销NLP的研究者参考。
论文研究微调用于预测的LLM为何准确但校准不足、思维链未必忠实。作者以Eternis-Forecaster 8B和OpenForesight为对象,训练基于中间激活的表征池化探针,发现内部表征能显著提升概率校准,并更直接揭示模型预测依据。
该论文讨论LLM驱动的形式化数学从解题走向前沿研究的挑战。现有定理证明系统在ITP语言下能生成规范问题证明,但在发现新定理、处理开放猜想等研究型任务上仍受限,文章梳理瓶颈并指向AI4Math下一阶段方向。
论文提出CKTN,面向越南占婆语、高棉语和岱侬语的首个语料库与基准,包含44367篇文档、2400万子词token。研究指出这些语言在文字、越南语接触和标准化程度上差异显著,常规多语适配可能学习错误信号。
论文提出面向生产环境LLM智能体的工具生成流水线,将重复SOP步骤在部署前编译为经验证、可版本化的工具,替代每次请求时临时代码生成。系统通过执行轨迹、后端模式和值观测进行接地合成,目标是降低延迟并提升可靠性。
论文提出 DeepSearch-Evolve,用于训练能从自身经验改进的网页工具智能体;其依托 DeepSearch-World,提供确定性、可复现且可验证的搜索与读页环境,缓解固定教师轨迹和稀疏奖励在长程交互中的局限。
论文提出COALA框架,用于提升语音增强语言模型在自动语音识别中的上下文偏置能力,重点解决多实体复杂场景下领域专有名词识别。方法结合对比正则化与偏置分数估计,以缓解上下文窗口限制并筛选相关目标实体。
论文提出SQuaD-SQL,通过大模型引导的知识蒸馏,让小语言模型更高效完成Text-to-SQL任务,目标是在资源受限环境中降低计算成本并保持查询生成能力。该方向关注数据库自然语言交互的轻量化部署,对企业内嵌式数据分析和私有化场景有参考价值。
论文指出自一致性等解码策略只看最终答案一致,难以发现LLM中间推理的逻辑缺陷与不忠实。作者提出基于图的评估框架,从语义、结构和因果维度量化推理不确定性、一致性与鲁棒性,用于筛选更可信的推理路径。
论文提出一种改进的大语言模型结构化剪枝方法,将自适应特征保留AFR从非结构化剪枝迁移到结构化场景。方法针对异构剪枝分数分布不匹配、符号信息丢失及离群值影响三类问题,引入幂变换与保符号分数聚合,以提升剪枝决策稳定性。
论文提出低成本人类与LLM协作标注框架,用于弥补非英语文化刻板印象评测数据不足,并构建EspanStereo。该西语数据集覆盖多个西语国家,面向更细粒度、文化特定的LLM偏见检测与安全评估。
论文关注美国上市公司8-K公告的细粒度事件抽取,指出现有SEC事项代码过粗,难以区分高影响披露。作者提出结合大模型标注、细粒度分类体系与源文本可追溯依据的方法,面向金融NLP和监管文本分析。
论文指出,无评论器强化学习常把同一优势值均匀分配给所有token,导致低概率且上下文错误的尾部token被正向强化,形成「正信用污染」。作者提出尾部感知信用校准,以改进LLM推理训练中的信用分配稳定性。
论文提出XALPHA,一个面向量化Alpha发现的记忆驱动AI研究员,试图把交易假设生成、因子代码实现、评估与迭代整合为端到端流程。其目标是缓解金融市场噪声高、非平稳和高维带来的稳健信号发现难题。
论文从理论语言学角度讨论哈里斯整合主义对计算语言学中指称主义假设的批评,并引入Barenholtz的自生成理论,试图补足其对符号如何支撑预期协同行动的机制解释。偏概念研究,工程落地价值有限。
论文提出一个基于修订版布鲁姆分类法的框架,用于衡量大模型在教育任务中的「教育控制」能力:在保留编程题教学意图的同时,将认知需求调整到指定学习目标,聚焦解题与面向学习者改写之间的差距。
论文面向语音情感识别,指出仅用音频基础模型可能难以同时捕捉声调变化与语义内容。作者提出结合生成的多语言转录文本与音频特征,通过跨模态Transformer融合并蒸馏,以提升正负情感判断的稳健性。
论文关注新题目未实测时的参数校准冷启动问题,提出用题目文本嵌入结合正则化回归预测心理测量参数,并引入信度与设计上限的评估框架,连接传统LLTM与现代表示学习。