【转载】大语言模型研究论文:2025年下半年精选(7-12月)

原文地址:LLM Research Papers: The 2025 List (July to December),by Sebastian Raschka, on 2025-12-30

大语言模型研究论文:2025年下半年精选(7-12月)

今年 6 月,我曾向付费订阅用户分享过一篇附赠文章,整理了我收藏标记的研究论文清单 —— 正是这些订阅者支撑着这个 Substack 专栏的运营。

本着同样的心意,为了感谢所有热心支持者,我整理了 2025 年 7 月至 12 月期间我标记归档的优质研究论文,清单如下。

这些论文我都通读了摘要,但真正全文精读的只有极少一部分。不过我依然坚持整理这类分类清单,因为在开展具体项目时,我常常会回头查阅这些资料。

顺便一提,我同时也在撰写年度大语言模型综述文章《2025 年大语言模型发展现状:进展、问题与展望》,今天也同步发布了。大家可以通过以下链接查看:

《2025 年大语言模型发展现状:进展、问题与展望》

原本我打算把这份论文清单放进上面这篇综述里,但文章篇幅已经过长,因此决定单独成篇分享。希望大家不介意今天收到两封推送邮件。我的考虑是,拆分后两篇文章都更便于阅读、快速浏览和日后回顾,不用在超长的页面里费力查找。

本次论文清单分为以下类别(大家可以在网页版文章的目录中直接跳转对应章节):

  • 推理模型

    • 1a. 推理模型训练

    • 1b. 推理阶段推理策略

    • 1c. 大语言模型评估与推理解析

  • 大语言模型的其他强化学习方法

  • 其他推理阶段扩展方法

  • 模型发布 / 技术报告

  • 模型架构

  • 高效训练

  • 基于扩散的语言模型

  • 多模态与视觉 – 语言模型

  • 数据与预训练数据集


=== 以下为付费内容 ===

Leave a Reply

Your email address will not be published. Required fields are marked *

*