全球大模型进展新闻浏览站
中文头版English
输入关键词,快速查找已抓取新闻。

今日版 / 2026年8月12日星期三

limbo logolimbo

数据更新时间

7月8日 17:59

启用来源

17

抓取状态

真实抓取

研究进展arXiv AI / CL

连续查询有限记忆语言模型提升知识检索效率

摘要

CO-LMLM是一种新型语言模型,它将事实知识存储在外部知识库中,而非模型权重内。生成时,模型通过连续向量查询从知识库检索文本知识,无需依赖关系型查询。在维基百科和FineWeb-Edu上预训练后,CO-LMLM在困惑度和事实准确性上优于先前模型和传统LLM。

背景解释

传统LLM将知识存储在参数中,导致更新困难且易产生幻觉。CO-LMLM通过外部知识库实现知识可控,支持灵活查询和可溯源生成。该方法在较小模型上达到甚至超越大模型性能,为高效、可更新的语言模型提供了新方向。

原文译文

以下为抓取到的原文内容译文,已统一为站内阅读格式。

阅读原文
这条新闻暂未保存可复现的原文正文,可以点击原文链接阅读。

来源地区

Global

热度分

84

分类

研究进展

语言

en