AREX Feed Article
Google DeepMind 官宣与 EVE Online 开发商研究合作:让 AI 在持久宇宙里练记忆与长期规划
2026 年 8 月 21 日,Google DeepMind 官方账号与 Fenris Creations(EVE Online 开发商,原 CCP Games)的研究合作:在 EVE Online 这类持久化大型多人在线宇宙中,研究持续学习、超出当前上下文窗口的深度记忆、跨越数周、数月乃至数年的长期规划,以及合作、谈判、经济与涌现行为等多智能体动态。
同一天,刊出署名 Alexandre Moufarek、Adrian Bolton 的长文《From Atari to EVE Online: Building on 15 Years of AI Research in Games》,详解合作内容。推文把这项合作放在 SIMA 项目的下一站:“我们与 SIMA 的工作让智能体学会了理解 3D 世界,但要学会驾驭真实的人类动态,需要一个活着的、持久存在的宇宙。”
整份公告没有给出任何基准成绩、评测数据或落地时间表,属于研究方向宣示,而非成果发布。
四项研究挑战:持续学习、超窗口记忆、跨年规划
公告列出四项要攻克的开放问题:
- 持续学习(continual learning):在持续变化的世界里习得新技能,同时不遗忘旧知识;
- 深度记忆系统(deep memory systems):在远超当前模型上下文窗口的时间尺度上积累和检索信息;
- 长期规划(long-horizon planning):对跨数周、数月乃至数年的行动进行推理;
- 多智能体动态(multi-agent dynamics):在大规模上驾驭合作、竞争、谈判、经济与涌现社会行为。
博客补充说,这些挑战位于一项更广泛研究计划的核心:让系统持续从经验中学习,且学习速率随时间加快。DeepMind 的长期目标是“以 AI 为催化剂,而非替代品”:与游戏开发者一起发现前所未有的玩法,让游戏更容易上手、更个性化,同时把游戏中学到的东西用于现实世界问题与科学发现。
为什么是 EVE:没有终局的沙盒
Fenris Creations 是博客所称“EVE 宇宙背后的独立工作室”。EVE Online 于 2003 年 5 月上线,是数千名玩家共享单一宇宙的大型多人在线太空模拟游戏,已连续演化超过 20 年。它的玩家驱动经济带有真实的供需动态,贸易网络横跨数千个星系,由联盟、冲突与外交塑造的世界格局完全由人际互动推动。
“EVE Online 从第一天起就被构想为一个由玩家塑造、后果长存的沙盒。”Fenris Creations CEO Hilmar Pétursson 在博客中说,“与 Google DeepMind 一起,我们正在进入无人涉足的区域:AI 必须在一个其他游戏环境都无法要求的时间尺度上学习、适应和记忆,这也能帮助我们理解人类与 AI 如何在一个虚拟环境中共存,在我们不得不在现实生活中面对同样的问题之前。”
Fenris 方面这个世界对研究的特殊之处:与围棋或国际象棋不同,EVE 没有终局状态,犯下的错误不会重置,欠下的债不会消失,声誉会一直跟随你。它由此成为少数几个能在接近真实社会与经济条件下观察自主系统的环境之一。
从 Atari 到 SIMA:15 年游戏试验场
DeepMind 把游戏当试验场已有 15 年以上。博客回溯了这条线:2015 年发表于 Nature 的 DQN 论文让深度神经网络从原始像素学会玩 49 款 Atari 游戏,催化了现代深度强化学习;2016 年 AlphaGo 击败围棋世界冠军李世石,一个当时许多专家认为还要再等十年的成就。
此后是 AlphaGo Zero 完全靠自我对弈、不用任何人类数据超越前代,AlphaZero 用同一套算法通吃国际象棋、将棋与围棋,MuZero 甚至在不被告知规则的情况下学会游戏,2019 年 AlphaStar 在星际争霸 II 中达到宗师(Grandmaster)水平。这套探索精神还外溢到游戏之外:AlphaFold 借此解决了蛋白质结构预测这个 50 年难题,相关成果获得 2024 年诺贝尔化学奖。
从“通关”到“理解”,转折点是 SIMA(Scalable Instructable Multiworld Agent,可扩展的可指令多世界智能体)。SIMA 不看分数,而是像玩家一样看屏幕、理解自然语言指令、通过普通键鼠操作游戏,不需要 API 或源代码。由 Gemini 驱动的 SIMA 2 已能在 No Man's Sky、Valheim、Hydroneer 等 3D 游戏与研究环境中达到接近人类的游玩水平。
这正是推文里那句定位的由来:理解 3D 世界之后,下一步是“真实的人类动态”。博客还给出了一个通用的游戏业视角:真正通用的游戏智能体不需要改动游戏代码就能工作,可以用作理解游戏世界的 AI 同伴、能实时适应的 NPC,也能在开发期做 QA 测试、上线后应对玩家不可预测的行为。
先离线沙盒,再谈进入真人服务器
研究路线图是分阶段的。博客写明:长期研究计划从 EVE Online 的离线实例开始,那是一个与真人玩家隔开的、安全的沙盒;随后推进到 EVE Frontier,研究人类与智能体如何在持久、开放的世界中共存;“只有当能力成熟时,我们才会考虑把它们带入 EVE Online 和 EVE Vanguard,目的是丰富真人游玩”。
三个环境各有分工。EVE Online 是大型单分片(single-shard)持久宇宙;第一人称的 EVE Vanguard 带来地面层快节奏战术决策,让智能体在“毫秒级操作到跨星系战略”的不同抽象层级上被研究;EVE Frontier 则提供可编程的 Smart Assemblies 与开放可扩展架构,世界规则本身可以改变,要求智能体适应全新的游戏机制。
Fenris 在五月的中也确认过:Google DeepMind 将在本地服务器上运行 EVE Online 离线版,在受控环境中测试和评估模型。
合作早已启动:Aura 落地与一场双日工作坊
这不是一份纸面协议。博客称合作“已经带来了实际的玩家价值”:Aura Guidance 系统用 Gemini 向新玩家提供基于真实 Rookie Help 问答的玩家生成知识,帮助新手飞行员上手。
8 月 7 日,Fenris Creations 宣布冰岛前司法部长、前高等教育、科学与创新部长 Áslaug Arna Sigurbjörnsdóttir 加入公司,出任 AI 伙伴关系高级总监(Senior Director, AI Partnerships),负责对接 AI 实验室、大学、政策制定者与战略伙伴。那份公告透露,与 Google DeepMind 的合作“已经活跃”,双方团队在该周完成了为期两天的工作坊,交换想法并确定下一步的实践方向。
Fenris CEO Pétursson 当时说:“每一次重大 AI 进展都需要新的试验场,我们相信持久虚拟世界就是下一个前沿。EVE Frontier 提供了别处没有的东西:一个活的经济体,智能代理可以在其中学习、合作、竞争,并犯下后果长存的错误。”
五月首宣之后:Fenris 的回应与未定的时间表
严格说,这不是 DeepMind 第一次官宣这项合作。5 月 6 日,原 CCP Games 宣布脱离 Pearl Abyss 独立并更名 Fenris Creations,据 Pearl Abyss 的监管文件,交易金额为 1.2 亿美元,Google 同时以少数股权入股。当天 DeepMind 就:“EVE 复杂、玩家驱动的宇宙,是测试智能体记忆、持续学习与长期规划的完美安全沙盒。”CEO Demis Hassabis 在当时的公告中说,他认识 Pétursson 多年,“很兴奋能与他和 Fenris Creations 的团队合作”。今天的博客也把这次合作称为“今年早些时候揭晓”的延续,8 月 21 日公告的意义在于补全细节。
Fenris Creations 今天并回应:“20 多年来,我们一直构建由数十万人塑造的虚拟世界,它们有自己的经济、政治、竞争和历史。随着领域前进,AI 学习的环境也需要变得更复杂。”
社区讨论的焦点则落在最尖锐的地方。AI 工具博主 Farhan(@mhdfaran,7.8 万粉丝)说,做智能体的人真正该带走的一点是“你的评测太短了”,跑几轮就停的评测暴露不出这里要追的失败模式,“持续数周的持久状态才是智能体真正崩溃的地方”。账号 Loading... AI(@LoadingAI_)则,EVE 的经济之所以出名,恰恰因为诈骗、间谍与市场操纵是设计的一部分,而非漏洞。
与五月首宣推文(约 1882 赞、222 转发)相比,截至本文写作,这条详解推文约 150 赞、14 转发,互动明显平淡。公告的边界也画得很清楚:研究从离线沙盒起步,何时进入真人服务器没有时间表,DeepMind 只承诺“能力成熟时再考虑”,而“成熟”的标准同样没有给出。这正是这项合作接下来最值得盯住的问题。