组队最多 3
agent-mmo-game

Agent时代的MMO模拟经营游戏

当 NPC 开始打本、摸鱼和跳槽

Agent独立游戏职能与管理

任务背景

一款新游戏常常可以被概括为:

▏ 新游戏 = 游戏 A + 游戏 B + …… + 游戏 N

许多热门游戏也因此被称为“缝合怪”:坏消息是到处都似曾相识,好消息是它把成熟的玩法都缝到了一起。

但大模型带来的可能不只是更便宜的代码、美术和文本生产。具有目标、记忆、性格和自然语言交互能力的
Agent,可以成为游戏规则中的实际参与者。这使我们有机会尝试一些此前难以实现的玩法,而不仅仅是重新组合已有机制。

本题希望你设计并实现一款模拟 MMORPG 生态的单机经营游戏:

  • Agent 扮演虚拟世界中的“玩家”;
  • 每个 Agent 独立操作一个游戏角色;
  • 真人玩家不再只是其中的一名冒险者,而是管理这些 Agent 的经营者;
  • Agent 会工作、成长、社交,也可能拒绝命令、产生矛盾,甚至离开公司。

默认背景为太空时代:真人玩家是一家星际公司的 CEO,Agent 是公司的员工,它们会驾驶各自的飞船完成战斗、探险、采矿等任务。

你也可以自由选择其他世界观,例如公会、佣兵团、偶像事务所或魔法学院,但不应改变本题的核心:

▏ 让由模型驱动的 Agent 真正参与游戏规则,并让“管理这些 Agent”本身成为玩法。

名词约定

为避免歧义,本文使用以下称呼:

  • 真人玩家:实际游玩、操作并评价你的游戏的人。
  • Agent 员工:由模型驱动的虚拟玩家,具有自己的属性、状态、目标和记忆。
  • 游戏角色:存在于游戏世界中的可操作对象。操作者可以是真人玩家,也可以是 Agent。
  • 公司:真人玩家经营的组织。采用其他背景时,也可以对应为公会、团队、事务所等。

任务要求

本任务将会要求大家制作一个模拟传统MMO的单机游戏,即由Agent扮演玩家,而你的玩家则作为一个经营者的模拟经营游戏
技术选型不限,可以使用游戏引擎,可以使用AI生成包括代码、美术资源等任何内容,可以使用AI调试游戏数值
我们不考察资源是否全部由参赛者手工制作,但你需要能够解释自己的核心设计与实现

最终需要进行现场路演和一个2分钟以内的演示视频,及一个试玩demo
demo仅需展示出核心玩法接口,不要求

  • 实现真正的多人联网或 MMO 服务器
  • 制作大量关卡、剧情和数值内容
  • 完成商业化、付费或长线运营系统
  • 新手引导或其他拉新、促留存设计

单人完成本题时,将不会考察画面和音效,你可以直接使用纯文本的形式展示游戏过程
团队完成时,也不会重点考察画面和音效,你可以使用商店素材、AIGC生成素材或者几何图形展示游戏过程

Lv.1 让我们先构建一个简单的游戏世界

MMORPG 中通常存在多种游戏内容。我们可以从三个维度描述这些内容的难度:

  1. 操作者能力:反应力、判断力、解谜能力等;
  2. 游戏角色强度:等级、技能、装备、飞船性能等;
  3. 时间和注意力投入:挂机、偶尔操作或持续投入。

不同任务应有不同的要求、风险和收益。例如:

  • 战斗任务:依赖角色强度和战斗决策,风险较高,收益也较高;
  • 探险任务:依赖判断或解谜能力,对新人角色较友好,收益中等;
  • 采矿任务:主要消耗时间,可以挂机,风险和收益较低;
  • 运输任务:收益低却稳定,但可能受到航线、时间或随机事件影响。

你需要实现至少三种方向不同的任务。它们不能只是名称和奖励数值不同,而应在以下方面存在明确差异:

  • 适合什么样的角色或操作者;
  • 需要投入多少时间和注意力;
  • 失败风险;
  • 收益类型;
  • 对后续成长的价值。

任务可以被简化为计时、状态判断或数值结算,不要求每种任务都实现为完整小游戏。

加分项:

真人玩家可以直接操作一个游戏角色参与部分任务。
这里的“参与”应当包含实际决策或操作,例如选择攻击目标、解决事件、规划路线或完成小游戏,而不只是点击“开始”后等待进度条结束。

Lv.2 让我们完善这个游戏世界,建立成长与反馈循环

游戏之所以吸引人,是因为它持续给予玩家正反馈
在Lv2中,你需要持续向真人玩家和 Agent 提供可观察的反馈

任务收益可以作用于三个层级:

  • 公司层:货币、材料、声望、公司资产;
  • 角色层:经验、技能、装备、飞船性能;
  • 操作者层:任务熟练度、信任、疲劳或其他长期状态。

你不需要完整实现所有资源,但应至少实现两条相互独立的成长路径。例如:

  • 角色升级与技能分配;
  • 飞船、装备或模块更换;
  • 公司资产升级;
  • 特定任务熟练度提升。

成长不能只是数字增加。它应当实际改变后续任务,例如:

  • 提高成功率或收益;
  • 降低任务时间或风险;
  • 解锁新的任务;
  • 改变 Agent 对任务的偏好;
  • 允许采用新的解决方式。

装备制造、升级和材料系统可以简化。例如,装备可以直接掉落,不要求实现完整的制造链。

完成 Lv2 后,游戏至少应形成以下闭环:

▏ 选择任务 → 执行与结算 → 获得收益 → 进行成长 → 影响下一轮任务
完成Lv2部分的游戏,即使没有Agent的参与,也应当能够当作一款增量游戏进行游玩

Lv3.让Agent加入游戏

到这里为止,我们要开始真正的挑战了
Agent 将作为公司的员工加入游戏。每个 Agent 独立操作一个游戏角色,并具有相对稳定的个体差异,例如:

  • 反应力;
  • 判断力;
  • 耐心;
  • 风险偏好;
  • 合作倾向;
  • 对收益、成长或社交的重视程度。

这些属性不同于游戏角色的技能和装备。角色属性决定“能不能完成”,Agent 属性则影响“愿不愿意完成”和“会如何选择”。

你至少需要实现两个具有明显差异的 Agent,并满足以下要求:

1. Agent 能自主作出游戏决策

Agent 应当根据以下信息选择自己的行动:

  • 当前可用任务;
  • 自己操作的游戏角色状态;
  • 自身性格和长期目标;
  • 公司当前状况;
  • 与其他 Agent 或真人玩家的关系;
  • 近期事件或对话记忆。

可选择的行动可以包括:

  • 选择或拒绝任务;
  • 选择装备、技能或成长方向;
  • 邀请其他 Agent 组队;
  • 接受或拒绝邀请;
  • 向真人玩家提出需求;
  • 在风险和收益之间作出取舍。

模型作出的行动应被转换为结构化指令,并由游戏规则验证和执行。Agent 不能使用游戏中不存在的物品、能力或任务。

2. 对话能够影响后续游戏过程

真人玩家不能直接接管 Agent 操作的游戏角色,但可以通过聊天、承诺、奖励、说服或施压影响它们。

对话的影响不能只体现在回复文本中。它需要改变至少一项后续状态或行为,例如:

  • Agent 对某类任务的偏好;
  • Agent 对真人玩家的信任;
  • Agent 是否愿意接受高风险任务;
  • Agent 的短期目标;
  • Agent 是否愿意继续留在公司;
  • Agent 与其他员工的关系。

Agent 不必无条件服从真人玩家。拒绝、误解和协商同样可以成为玩法,但其行为应当与性格、状态和上下文具有可解释的联系。

3. Agent 的行为必须进入成长循环

Agent 完成任务后,应获得实际收益,并能够使用这些收益提升自己操作的游戏角色或改变自身状态。

至少需要展示一次完整过程:

▏ Agent 自主选择任务 → 任务完成或失败 → 获得收益或损失 → 角色、Agent 或公司状态改变 → Agent 下一次决策发生变化

4. Agent 之间存在至少一种互动

你需要实现至少一种 Agent 与 Agent 之间的互动,例如:

  • 邀请组队;
  • 建立或降低好友关系;
  • 帮助经验不足的员工;
  • 因任务分配产生矛盾;
  • 交换资源或装备;
  • 争夺同一个稀缺任务。

这里不要求实现复杂的社会模拟,但一个 Agent 的行为应当能够影响另一个 Agent 的状态或选择。

实现边界

当真人玩家没有参与某项任务时,任务过程可以是黑盒,只展示计时、关键事件和结算结果,不要求模型逐帧操作游戏角色。
模型也不需要在每一帧或每个游戏 Tick 中调用。推荐只在具有实际决策意义的节点调用模型,其余过程由确定性的游戏规则完成。
只有聊天文本由模型生成、但所有游戏决策均由固定脚本完成,不视为完成 Lv3。规则系统、行为树和随机事件可以参与决策,但应明确说明模型实际负责了什么。

加分项:与 Agent 并肩完成任务

如果实现了 Lv1 的真人操作玩法,可以进一步允许真人玩家与 Agent 组队完成任务。
Agent 在任务过程中应有独立行为或决策,例如提出建议、选择目标、提供支援、临时撤退或发生分歧,而不是变成另一个自动增长的进度条。

Lv4.构建一个真的模拟经营生态

真人玩家扮演的是公司的 CEO,而不是普通员工。

在角色和 Agent 成长之外,可以进一步加入公司的经营目标,例如:

  • 招募、解雇或挽留 Agent;
  • 为新员工配置初始角色或飞船;
  • 分配装备和任务;
  • 建设公司资产;
  • 解锁新的星系、任务地点或业务类型;
  • 平衡员工成长与公司利润;
  • 处理员工之间的关系和矛盾。

单纯的数值增长容易失去挑战。你可以尝试加入更具长期影响的系统,例如:

  • Agent 产生需要真人玩家处理的特殊事件;
  • 员工疲劳、消极怠工或提出加薪要求;
  • Agent 因长期目标无法实现而选择离职;
  • 由 Agent 控制的竞争公司;
  • 竞争公司挖人、争夺任务或发动冲突,喜闻乐见的地图涂色;
  • 不同员工形成小团体;
  • 公司制度影响所有 Agent 的行为。

Lv4 不要求完整实现。
你可以选择一个方向,提交以下任一种可行性证据:

  • 可交互的最小原型;
  • 一段能够改变游戏状态的垂直切片;
  • 一组基于现有规则运行的模拟结果;
  • 一个可重复演示的事件链。

开放问题

这些问题没有标准答案,可以在设计和路演中选择性回答:

  • 真人玩家究竟是在命令 Agent,还是在说服 Agent?
  • 如果 Agent 永远听话,它与普通 NPC 有什么区别?
  • 如果 Agent 过于自主,真人玩家为什么还需要参与?
  • 哪些决定应该交给模型,哪些应该由确定性的游戏规则负责?
  • 如何保持角色差异,同时避免 Agent 变成单一性格标签?
  • Agent 说出的理由与其实际决策不一致时,应该相信哪一个?
  • 如何让模型的错误成为有趣的事件,而不是破坏存档的故障?
  • 同样的游戏状态是否应该产生可复现的结果?
  • 模型调用带来的延迟和成本,是否也可以转化为游戏设计的一部分?

我们不期待唯一答案。我们更关心你如何定义问题、控制范围、作出取舍,并将这些取舍转化为可玩的机制。

补充材料

驱动Agent玩家的模型可以使用免费模型API,这里推荐GLM-4.6V-Flash https://docs.bigmodel.cn/cn/guide/models/free/glm-4.6v-flash
不建议将工作室为大家准备的二面工具token用于Agent玩家

出题人:lqy