原文地址:LLM Research Papers: The 2025 List (July to December),by Sebastian Raschka, on 2025-12-30
大语言模型研究论文:2025年下半年精选(7-12月)
今年 6 月,我曾向付费订阅用户分享过一篇附赠文章,整理了我收藏标记的研究论文清单 —— 正是这些订阅者支撑着这个 Substack 专栏的运营。
本着同样的心意,为了感谢所有热心支持者,我整理了 2025 年 7 月至 12 月期间我标记归档的优质研究论文,清单如下。
这些论文我都通读了摘要,但真正全文精读的只有极少一部分。不过我依然坚持整理这类分类清单,因为在开展具体项目时,我常常会回头查阅这些资料。
顺便一提,我同时也在撰写年度大语言模型综述文章《2025 年大语言模型发展现状:进展、问题与展望》,今天也同步发布了。大家可以通过以下链接查看:
原本我打算把这份论文清单放进上面这篇综述里,但文章篇幅已经过长,因此决定单独成篇分享。希望大家不介意今天收到两封推送邮件。我的考虑是,拆分后两篇文章都更便于阅读、快速浏览和日后回顾,不用在超长的页面里费力查找。
本次论文清单分为以下类别(大家可以在网页版文章的目录中直接跳转对应章节):
-
推理模型
-
1a. 推理模型训练
-
1b. 推理阶段推理策略
-
1c. 大语言模型评估与推理解析
-
-
大语言模型的其他强化学习方法
-
其他推理阶段扩展方法
-
模型发布 / 技术报告
-
模型架构
-
高效训练
-
基于扩散的语言模型
-
多模态与视觉 – 语言模型
-
数据与预训练数据集