arXiv正式脱离康奈尔:全球预印本平台进入独立非营利时代

arXiv脱离康奈尔独立运营,免费开放承诺不变,但财务与AI审核压力仍待解决。

原文标题:arXiv脱离康奈尔,正式单飞

原文作者:机器之心

冷月清谈:

arXiv 官方宣布已于 7 月 1 日从康奈尔大学独立,成立非营利组织 arXiv, Inc.,并取得美国 501(c)(3) 免税资格。平台功能短期内不会变化,论文检索、提交和免费下载仍将继续开放。

独立后的 arXiv 将由最多 12 人组成的董事会治理,西蒙斯基金会与康奈尔大学作为创始成员参与前期建制。原执行总监 Ramin Zabih 将担任临时 CEO,正式 CEO 招聘已接近尾声。

arXiv 自 1991 年诞生以来,已收录超 309 万篇论文,累计下载超过 37 亿次,是物理、数学、计算机科学尤其是 AI 研究的重要基础设施。

此次独立背后有多重压力:康奈尔难以持续承担财务赤字,大学体系在人事、采购和技术响应上不够灵活,AI 生成论文激增也让审核机制承压。未来 arXiv 需要在保持免费开放、拓展资金来源、升级技术架构和应对 AI 投稿潮之间找到平衡。

怜星夜思:

1、arXiv独立后,大家最该担心的是收费,还是审核质量下降?
2、AI生成论文越来越多,arXiv应该更严格拦截,还是保持开放让社区自己筛选?
3、arXiv这种全球学术基础设施,交给大学、基金会还是独立组织管理更合适?
4、如果arXiv未来真的推出付费功能,哪些功能可以接受,哪些绝对不能碰?

原文内容

图片
编辑|Panda

靴子落地了。arXiv 官方博客发布公告,宣布平台已于 7 月 1 日正式脱离康奈尔大学,以独立非营利组织的身份开启新篇章。



  • 通告地址:https://blog.arxiv.org/2026/06/30/arxivs-next-chapter/


新组织的官方名称为 arXiv, Inc.,已依据特拉华州法律注册为非营利、无股票公司,并取得美国国税局 501(c)(3) 免税资格。


那个陪伴用户二十余年、印在页眉上的「康奈尔大学」标识,就此成为历史。



不仅如此,就连大家熟悉的 arXiv 红也已经变成了黑色。



当然,功能没啥变化。论文还在,搜索还能用,提交入口也照常开放。arXiv 团队在公告中特别说明,「未来数月内,arXiv 的作者、读者以及依赖我们的社区,几乎不会感受到任何变化。」这句话是写给那些担心平台突然收费或大变样的用户看的。相关担忧可参看我们之前的报道《》。



新的组织架构:

大学下属机构→自主治理


在康奈尔体制内,arXiv 由 Cornell Tech 院长 Greg Morrisett 负责督管,执行层面则由计算机科学教授 Ramin Zabih 担任执行总监。独立后,这套结构将被正式的公司治理框架取代。


根据 arXiv 发布的 FAQ 文件,新组织将由一个最多 12 人组成的董事会负责治理,西蒙斯基金会与康奈尔大学作为两个「创始成员」,共同主导了前期的建制工作,包括任命初始董事会、建立免税资格,以及签署一系列法律协议。这两家机构将履行「成员」职责长达五年,其代表也可在此之后继续在董事会任职。



至于 CEO 一职:康奈尔计算机科学教授 Ramin Zabih 将在过渡期担任临时 CEO,并协助未来正式 CEO 完成交接。



目前招聘流程已接近尾声。此前引发广泛讨论的约 30 万美元年薪方案依然有效。值得注意的是,arXiv 总部地址暂时不变,纽约市的员工仍将在 Cornell Tech 的 Tata 创新中心办公。全体 26 名员工均已随组织一同转入新公司。


什么是 arXiv?

它凭什么值得这么多关注


如果你从事物理、数学或计算机研究,arXiv 几乎是每天打开的网页。如果你在 AI 领域工作,那这几乎已经成为默认论文平台。


简而言之,arXiv 是一个「预印本」服务器:学者在论文正式经过同行评审、发表于期刊之前,可以先把稿件免费上传到这里,让全球同行第一时间看到。


这种模式已经从根本上改变了学术知识的传播速度。传统学术期刊从投稿到发表往往需要数月乃至数年,而 arXiv 让这个时间缩短到了数天甚至数小时。


arXiv 诞生于 1991 年,创始人是洛斯阿拉莫斯国家实验室的物理学家 Paul Ginsparg。



起初,它只是一个用来替代混乱的邮件列表的自动化脚本,预计每年接收约 100 篇论文。但首月就涌入了近百篇投稿,弦理论大师 Ed Witten 的早期加入让它迅速获得学术圈的认可。2001 年,Ginsparg 回归母校康奈尔大学任教,arXiv 也随之落户该校图书馆,开启了长达 25 年的康奈尔时代。


它对 AI 社区的价值,尤其难以替代。


几乎所有塑造了当代 AI 格局的重要论文,都最先在 arXiv 上亮相。注意力机制(Attention)、Transformer 架构、BERT、GPT 系列、扩散模型……这些名字代表的不只是论文,更是整个行业的地基。让全球 AI 圈震动的 DeepSeek 系列论文,同样是首发 arXiv。相对于传统学术出版动辄数月乃至数年的审稿周期,arXiv 的快速周转机制让这些快速迭代的领域得以大幅提速。


更重要的是,arXiv 对所有人免费,不需要机构订阅,不需要翻越付费墙。那些在东欧、东南亚、非洲从事研究的科学家,一定程度上与麻省理工的学者站在同一条起跑线上。


截至 2026 年 6 月,arXiv 累计收录论文数已超过 309 万篇,涵盖物理、数学、计算机科学、定量生物学、定量金融、统计学、电气工程与系统科学,以及经济学在内的 8 个学科门类。平台迄今已提供超 37 亿次下载。这些数字背后,是一个服务于全球超过上千万月活用户的基础设施。


自 1991 年 8 月以来的论文提交数量统计


论文下载数量统计


为什么现在独立?财务与 AI 的双重压力


独立的决定并非一时冲动。多年来,arXiv 的内部讨论一直在进行,但真正形成合力是在最近两年。



首先是财务问题


arXiv 在 2025 财年的支出约为 670 万美元,当年出现 29.7 万美元的赤字。康奈尔大学在面临联邦拨款削减和预算收紧的压力下,已无法持续为这个赤字兜底。



独立运营意味着更宽阔的融资渠道。一些位于欧洲和亚洲的机构,对于将支票开给康奈尔大学本不情愿,但如果受款方是一家直接服务于科学社区的独立非营利组织,态度就会截然不同。


其次是体制活性。大学的人事体系有其固有节奏(薪资上限、招聘周期、采购流程),这些对于需要快速响应技术浪潮的 arXiv 来说,有时是肉眼可见的阻力。Morrisett 曾直言:「我们需要比大学允许的更灵活地雇人、更有竞争力地开工资。」


然后是 AI 带来的新变量


2023 年以来,AI 生成的内容涌入学术平台,arXiv 也不例外,大量低质量或完全由 AI 写成的论文提交大幅增加。平台依赖数百名专业志愿者审核员处理提交,但面对每月几万篇的论文规模,这套体系正在承压。


2026 年 2 月,arXiv 推出了「仅接受含有英文版本的论文」新政,以减轻多语言审核的难度。而在创始人 Ginsparg 看来,这个问题更为根本:「如果 LLM 生成的计算机科学论文,质量已经超过普通研究生的水平,那么三个月后的世界该如何应对?」



能维持免费吗,CEO 会做什么?


对于大多数用户来说,最关心的问题只有一个:以后还能免费用吗?


arXiv 的回答很明确:「arXiv 始终承诺对读者和提交者免费开放,我们致力于为全球科学家提供公平获取新思想与新发现的机会。」但关于未来是否会引入付费功能,官方尚未给出明确说明。


学术界对此的普遍情绪是「谨慎乐观加持续观望」。有研究者在社交媒体上回顾了几个当年的非营利平台逐渐走向商业化的案例,表达了隐忧。也有从业者反驳说,arXiv 的收入结构(来自成员机构、基金会和个人捐赠的组合)相对健康,且已筹得足以覆盖未来三年运营需求的资金。


至于即将到任的首位 CEO,挑战清单颇长:完成从 Perl 到 Python 的代码库现代化迁移;建立一套能应对 AI 投稿潮的审核机制;扩展捐赠者基础,降低对少数大基金会的依赖;同时在国际学术社区面前重新定位 arXiv 的品牌形象。这个职位的定价,放在纽约的非营利科技组织管理圈子里,其实并不离谱。


arXiv 的独立是一次从「某所大学的附属项目」到「全球学术基础设施」的身份切换。这一切换本身不会改变它的任何功能,但会改变它在世界中的位置。


参考链接

https://news.cornell.edu/stories/2026/06/digital-research-repository-arxiv-start-new-chapter-nonprofit

https://info.arxiv.org/about/spinout_faq.html

https://blog.arxiv.org/2026/01/13/non-english-paper-submission-guidelines/

https://physicstoday.aip.org/news/arxiv-sets-out-on-its-own



© THE END 

转载请联系本公众号获得授权

投稿或寻求报道:liyazhou@jiqizhixin.com

付费皮肤我可以接受,比如把arXiv红改回来收费9.9美元,老用户含泪下单。正经说,核心知识访问不能动,其他花里胡哨功能随便折腾,别影响论文可见性就行。

2 个赞

最不能碰的是提交费。很多发展中国家的研究者、独立研究者、小实验室,本来就靠arXiv绕过期刊付费墙。如果提交也要钱,arXiv的公平性会被直接削弱。

2 个赞

说句不严肃的:以后arXiv可能需要一个“这篇论文像不像ChatGPT半夜赶出来的”评分。玩笑归玩笑,机器生成内容太多之后,平台确实需要新的过滤器,不然大家每天看论文会像逛信息垃圾场。

2 个赞

这个问题我觉得不用二选一。arXiv最珍贵的是“免费+可信+快”,三个里面掉一个都伤筋动骨。收费会影响公平性,审核差会影响可信度,速度慢又会影响AI这种快速领域。它现在难就难在三角形不能塌。

1 个赞

我比较乐观。arXiv不是普通创业公司,它的用户群里有大量学术大佬、基金会和高校,一旦方向跑偏,舆论压力会非常大。短期看,我觉得审核机制升级比收费更现实,可能会引入更多自动化筛查。

2 个赞

关于“收费还是审核质量”,我站收费这边。不是说它明天就会收费,而是基础设施一旦财政压力大,就很容易从“永远免费”变成“核心免费,高级功能收费”,再变成“机构套餐”。这条路在互联网和学术出版里都见过太多次了。

1 个赞

回应“AI生成论文要不要严格拦截”:我倾向于更严格一点。预印本不是垃圾桶,开放不等于无限接收。尤其是那种没有实验、没有证明、只是把概念拼起来的论文,放上去只会增加研究者检索成本。

1 个赞