陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

心靈之曲

发布时间：2024-10-09 09:36:22

896人浏览过

来源于机器之心

转载

会议组织者都是 nlp 头部科学家，在语言建模方面有着相当的成果。

随着 AI 领域的快速发展，大模型逐渐成为研究的核心，为了更好地探索这一领域，2023 年，一批知名的青年学者组织了一个名为 COLM（Conference on Language Modeling）的新会议。

该会议的组织者们都是 NLP 头部科学家，在语言建模方面有着相当的成果。他们其中既有来自业界的研究人员，也有来自学术界的研究人员。

在今年的组织者中，有我们熟悉的陈丹琦、Angela Fan 等华人学者。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

COLM 是一个专注于语言建模研究的学术场所，旨在创建一个具有不同科学专业知识的研究人员社区，专注于理解、改进和评论语言模型技术的发展。这不仅是学术界的一次创新尝试，也是搭起了语言模型交流互鉴的新桥梁，进一步促进其探索和合作。

陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

接收论文链接：https://colmweb.org/AcceptedPapers.html

刚刚，大会公布了 2024 年杰出论文奖，共有 4 篇论文获奖。

值得一提的是，号称撼动 Transformer 统治地位的 Mamba 也在获奖论文中。

此前，Mamba 这项研究惨遭 ICLR 拒稿，引来学术界轩然大波。

不过，之后 Mamba 原班人马发布的 Mamba-2 顺利拿下了 ICML 2024。如今 Mamba 又获得了 COLM 杰出论文奖，很多网友都送来祝贺。

陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

Mamba 作者之一、卡内基梅隆大学机器学习系助理教授 Albert Gu 用一张表情很好的表达了自己的感受，看来「COLM 是真香」。

陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

杰出论文奖

论文 1：Dated Data: Tracing Knowledge Cutoffs in Large Language Models

机构：霍普金斯大学
作者：Jeffrey Cheng、Marc Marone、Orion Weller、Dawn Lawrie等
论文地址：https://openreview.net/pdf?id=wS7PxDjy6m

陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

大型语言模型 (LLM) 通常有「知识截止日期」，即收集训练数据的时间。该信息对于需要 LLM 提供最新信息的应用场景至关重要。

然而，训练数据中所有子资源是否共享相同的「知识截止日期」？模型响应展示出的知识是否与数据截止值一致？

陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

该论文定义了「有效截止」的概念，它与 LLM 报告的「知识截止日期」不同，并且训练数据子资源之间也有所不同。该研究提出了一种简单的方法，通过跨版本的数据探测来估计 LLM 在资源级别的有效截止点。至关重要的是，该方法不需要访问模型的预训练数据。

通过分析，该研究发现有效的截止值通常与报告的截止值有很大不同。为了了解这一观察结果的根本原因，该研究对开放的预训练数据集进行了大规模分析。

陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

分析揭示了造成这些不一致的两个主要原因：

由于新 dump 中存在大量旧数据，导致 CommonCrawl 数据出现时间错位；
LLM 重复数据删除方案的复杂性涉及语义重复和词汇近似重复。

论文 2：Mamba: Linear-Time Sequence Modeling with Selective State Spaces

机构：卡内基梅隆大学、普林斯顿大学

YOO必优科技-AI写作
智能图文创作平台，让内容创作更简单

下载
作者：Albert Gu、Tri Dao
论文地址：https://arxiv.org/pdf/2312.00752

陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

自 2017 年被提出以来，Transformer 已经成为 AI 大模型的主流架构，但随着模型规模扩大和处理序列变长，其计算效率问题凸显，特别是在长上下文中，计算量将呈平方级增长。

为解决这一问题，研究者们围绕注意力开发了多种变体，如线性注意力、门控卷积、循环模型、SSMs 等，但它们在语言等模态上的表现并不理想，无法进行基于内容的推理。

基于此，论文作者进行了几项改进。首先，让 SSM 参数成为输入的函数，解决了离散模态的弱点，使模型能根据当前 token 有选择地传播或遗忘信息。

陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

这种改动导致卷积效率降低，对模型的计算带来了挑战。论文作者设计了一种硬件感知算法，将先前的 SSM 架构设计与 Transformer 的 MLP 块合并为一个块，简化了深度序列模型架构，形成了一种包含选择性状态空间的简单、同质的架构设计（Mamba）。

陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

Mamba 可以随上下文长度的增加实现线性扩展，其性能在实际数据中可提高到百万 token 长度序列，并实现 5 倍的推理吞吐量提升。

作为通用序列模型的骨干，Mamba 在语言、音频和基因组学等多种模态中都达到了 SOTA 性能。在语言建模方面，无论是预训练还是下游评估，他们的 Mamba-3B 模型都优于同等规模的 Transformer 模型，并能与两倍于其规模的 Transformer 模型相媲美。

更多详情，可以参考本站之前的报道：五倍吞吐量，性能全面包围 Transformer：新架构 Mamba 引爆 AI 圈。

论文 3：AI-generated text boundary detection with RoFT

机构：俄罗斯 AI 基金会与算法实验室、英国伦敦玛丽女王大学、日本 Noeon 研究所、斯科尔科沃科学技术学院等
作者：Laida Kushnareva, Tatiana Gaintseva, Dmitry Abulkhanov等
论文地址：https://arxiv.org/pdf/2311.08349

陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

随着大语言模型的发展，我们越来越频繁地遇到这样的情况：一篇文章起初可能出自人类之手，但随后可能被 AI 接手加以润色。如何从这种文本中检测出人类写作与机器生成的界限？这是一个具有挑战性的问题，但还尚未得到太多关注。

论文作者试图填补这一空白。他们对最先进的检测方法进行了测试。具体而言，他们采用「真假文本」测试集，测试了在极限情况下，这些方法的表现。「真假文本」测试集包含各种语言模型生成的多个主题的短文本。

陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

他们发现，基于困惑度的边界检测方法，在处理特定领域的数据时，比对 RoBERTa 模型进行监督式的方法更加鲁棒。他们还发现了一些特定的文本特征。这些特征可能会干扰边界检测算法的判断，导致算法在处理跨领域的文本时，其性能会下降。

论文 4：Auxiliary task demands mask the capabilities of smaller language models

机构：哈佛大学、斯坦福大学
作者：Jennifer Hu、Michael Frank
论文地址：https://openreview.net/forum?id=U5BUzSn4tD#discussion

陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

发展心理学家一直在争论语言理解或心理理论等认知能力何时出现。这些争论通常取决于「任务要求」的概念 —— 与执行特定评估相关的挑战。在衡量语言模型 (LM) 的能力时，任务的性能是模型基础知识的函数，再加上模型在给定可用资源的情况下解释和执行任务的能力。

陈丹琦等人组织的COLM奖项公布：被ICLR拒稿的Mamba入选杰出论文

该研究表明，对于类比推理、反思推理、单词预测和语法判断，任务要求较高的评估方法比要求减少的评估方法产生的性能更低。对于参数较少和训练数据较少的模型，这种「需求差距」最为明显。实验结果表明，LM 的性能不应被解释为智能（或缺乏智能）的直接表现，而应被解释为通过研究人员设计选择的视角所看到的能力反映。

什么是“人形机器人”？特斯拉Optimus与产业供应链全解析

AI生成活动现场的即时新闻稿

贾跃亭：法拉第未来当前股价被严重低估目标价5美元

内存飙升成本暴涨汽车会涨价还是减配？

10家中国车企入围入围财富世界500强比亚迪进前百

相关专题

登录token无效

登录token无效解决方法：1、检查token的有效期限，如果token已经过期，需要重新获取一个新的token；2、检查token的签名，如果签名不正确，需要重新获取一个新的token；3、检查密钥的正确性，如果密钥不正确，需要重新获取一个新的token；4、使用HTTPS协议传输token，建议使用HTTPS协议进行传输；5、使用双因素认证，双因素认证可以提高账户的安全性。

6679

2023.09.14

登录token无效怎么办

登录token无效的解决办法有检查Token是否过期、检查Token是否正确、检查Token是否被篡改、检查Token是否与用户匹配、清除缓存或Cookie、检查网络连接和服务器状态、重新登录或请求新的Token、联系技术支持或开发人员等。本专题为大家提供token相关的文章、下载、课程内容，供大家免费下载体验。

845

2023.09.14

token怎么获取

获取token值的方法：1、小程序调用“wx.login()”获取临时登录凭证code，并回传到开发者服务器；2、开发者服务器以code换取，用户唯一标识openid和会话密钥“session_key”。想了解更详细的内容，可以阅读本专题下面的文章。

1092

2023.12.21

token什么意思

token是一种用于表示用户权限、记录交易信息、支付虚拟货币的数字货币。可以用来在特定的网络上进行交易，用来购买或出售特定的虚拟货币，也可以用来支付特定的服务费用。想了解更多token什么意思的相关内容可以访问本专题下面的文章。

2220

2024.03.01

页面置换算法

页面置换算法是操作系统中用来决定在内存中哪些页面应该被换出以便为新的页面提供空间的算法。本专题为大家提供页面置换算法的相关文章，大家可以免费体验。

504

2023.08.14

Python 自然语言处理（NLP）基础与实战

本专题系统讲解 Python 在自然语言处理（NLP）领域的基础方法与实战应用，涵盖文本预处理（分词、去停用词）、词性标注、命名实体识别、关键词提取、情感分析，以及常用 NLP 库（NLTK、spaCy）的核心用法。通过真实文本案例，帮助学习者掌握使用 Python 进行文本分析与语言数据处理的完整流程，适用于内容分析、舆情监测与智能文本应用场景。

420

2026.01.27

http与https有哪些区别

http与https的区别：1、协议安全性；2、连接方式；3、证书管理；4、连接状态；5、端口号；6、资源消耗；7、兼容性。本专题为大家提供相关的文章、下载、课程内容，供大家免费下载体验。

2957

2024.08.16

TypeScript类型系统进阶与大型前端项目实践

本专题围绕 TypeScript 在大型前端项目中的应用展开，深入讲解类型系统设计与工程化开发方法。内容包括泛型与高级类型、类型推断机制、声明文件编写、模块化结构设计以及代码规范管理。通过真实项目案例分析，帮助开发者构建类型安全、结构清晰、易维护的前端工程体系，提高团队协作效率与代码质量。

2026.03.13

Python异步编程与Asyncio高并发应用实践

本专题围绕 Python 异步编程模型展开，深入讲解 Asyncio 框架的核心原理与应用实践。内容包括事件循环机制、协程任务调度、异步 IO 处理以及并发任务管理策略。通过构建高并发网络请求与异步数据处理案例，帮助开发者掌握 Python 在高并发场景中的高效开发方法，并提升系统资源利用率与整体运行性能。

136

2026.03.12

热门下载

网站特效

网站源码

网站素材

前端模板