极长序列、极快速度：面向新一代高效大语言模型的LASP序列并行

AIGC动态2年前 (2024)发布机器之心

AIGC动态欢迎阅读

原标题：极长序列、极快速度：面向新一代高效大语言模型的LASP序列并行
关键字：序列,方法,矩阵,通信,切分
文章来源：机器之心
内容字数：8137字

内容摘要：

AIxiv专栏是机器之心发布学术、技术内容的栏目。过去数年，机器之心AIxiv专栏接收报道了2000多篇内容，覆盖全球各大高校与企业的顶级实验室，有效促进了学术交流与传播。如果您有优秀的工作想要分享，欢迎投稿或者联系报道。投稿邮箱：liyazhou@jiqizhixin.com；zhaoyunfeng@jiqizhixin.com。
从国际顶流 GPT-4 128K、Claude 200K 到国内「当红炸子鸡」支持 200 万字上下文的 Kimi Chat，大语言模型（LLM）在长上下文技术上不约而同地卷起来了。当全世界最聪明的头脑都在卷一件事的时候，这件事的重要性和难度就自然不言自明。
极长的上下文可以极大拓展大模型的生产力价值。随着 AI 的普及，用户已经不再满足于大模型几个脑筋急转弯，用户开始渴望利用大模型来真正提高生产力。毕竟从前花一周憋出来的 PPT，现在只需要喂给大模型一串提示词和几份参考文档就分分钟生成出来，打工人谁能不爱呢？
新型高效序列建模方法比如：Lightning Attention (TransNormerLLM), State Space Modeling

原文链接：极长序列、极快速度：面向新一代高效大语言模型的LASP序列并行