来自该信源的全部动态 · 共 677 条
论文研究中世纪文献转录与数字化导致的字符集不一致问题,提出字母词形化框架,用字符级一对一RNN和带状RNN以自监督方式还原字符映射与缩写。实验显示少量文本行即可显著降低字符错误率,适用于历史语料规范化。
论文提出 PRecG 用于法律先例检索,将法律文书按修辞角色分段,并用图神经网络建模文档内部结构与语义关系。相比把整篇判例视为单一文本的向量相似度方法,该方法试图捕捉法律论证组织和技术细节,对法律 NLP 与检索增强法律研究有参考价值。
论文以牛津大学「Their Finest Hour」二战众包数字档案为案例,研究大规模关键词识别与分配问题,比较三种自然语言处理方法用于自动提取关键词,并讨论众包馆藏在技术、实践与伦理层面的挑战。
论文研究GPT-2式语言模型预训练中的权重谱规律,分析11个不同规模、语言和语料的检查点,尝试将反复出现的层级与组件结构转化为初始化信号,以提升预训练效率和稳定性。
论文提出一种可解释的网络框架,用于表示八种类型差异语言中的160个常规表达,多数为习语。研究以认知语言学特征进行二值标注,并用Jaccard相似度构建加权图,以分析跨语言比喻意义的结构关系。
论文关注长上下文LLM在输入变长后难以定位关键证据、准确率下降的问题,提出自引导测试时训练思路:利用测试上下文本身构造训练信号,在推理阶段适配模型,以提升长文本证据利用能力。
论文研究轻量语音识别模型在孟加拉语等非拉丁、形态丰富语言上的失效问题,指出Moonshine的英语中心字节级Tokenizer会将词拆成高繁殖率字节链,引发推理时自回归崩溃,并提出Tokenizer移植思路改善边缘ASR适配。
论文提出StickyMoE,在预训练阶段加入可微的路由一致性损失,使连续token更倾向复用相同专家,减少边缘设备上MoE模型在慢存储与快内存间频繁换权重的问题,相比缓存启发式或事后微调更直接处理根因。
论文针对 EyeBench 中眼动预测阅读理解的性能差距,提出 LEXIC:在不使用语言模型的凝视-only框架中,向 AhnCNN 基线注入预计算的词级难度信号,以探索轻量条件化能否提升眼动数据对理解结果的判别能力。
论文提出Holographic Neural PCFG,用于从原始文本中无监督诱导成分句法树。方法试图替代传统神经PCFG中黑箱网络的规则打分机制,为规则概率提供更具可解释性的数学形式,面向句法解析与可解释NLP研究。
论文提出 Hallucination Self-Play,用可演化生成器与检测器迭代对抗,合成带理由、标签和幻觉声明的训练数据,以缓解忠实性幻觉检测标注稀缺问题。方法将生成器从静态数据源变为可优化组件,旨在提升检测器鲁棒性与泛化能力。
论文提出一种基于MiniLM嵌入的多簇边界学习方法,用于人机交互中的域外意图检测。方法试图避免传统多分类随已知意图类别增加而精度下降的问题,同时相比大参数LLM嵌入更轻量,面向实际意图识别系统部署。
论文研究在固定既有Transformer骨干的前提下,为每个token分配更多计算以继续提升大模型能力,提出隐藏解码式潜在计算扩展思路,试图缓解循环深度Transformer难以规模化的问题,为推理时计算扩展提供新方向。
论文提出 MASTE,将方面情感三元组抽取拆解为边界识别、观点聚合、情感判定等子任务,由多智能体协作完成,以缓解单次生成在零样本 ASTE 中的误差耦合。
论文聚焦社交媒体场景下的情感分析,讨论如何从Twitter等平台的用户生成文本中提取公众观点与情绪信号,并比较LSTM与传统模型在文本情感识别任务中的应用价值。主题较基础,偏方法复现与综述式实证。
论文提出PLURAL,一个面向价值对齐的大规模偏好数据集,基于覆盖92国的Integrated Values Survey,将调查回答转化为合成偏好三元组,旨在缓解LLM价值观过度西方化、提升多元文化价值系统表示能力。
论文提出 TypeProbe,利用 Java 与 Python 平行代码数据探测预训练代码模型残差流中的类型表征。结果显示,即使在无类型 Python 代码中,模型也会形成跨语言类型表示,并检验隐藏状态是否线性编码类型信息。
论文研究NLP中基于预处理的刻板印象缓解方法,如用去偏语料进行训练前或训练后处理。作者发现,这类方法虽能降低目标群体的可测偏见,却常使其他人口群体出现刻板化或反刻板化上升,甚至跨越无关人口属性。
论文评估Gemini系列模型作为音频裁判的可靠性,用原始立体声波形直接为全双工语音代理对话打分。研究覆盖Gemini 2.5 Flash、3.5 Flash、3.1 Pro,并以209段会话的人类标注校准,考察8个生产维度。
论文介绍HIPE-OCRepair-2026竞赛结果,聚焦用大语言模型辅助历史文档OCR后纠错。该任务面向数字遗产中普遍存在的旧OCR错误,评估LLM在不同语言、文档类型和噪声条件下的纠错能力,为历史文献数字化质量提升提供基准。