TaipeiGTA 现象拆解:1 个月、1 万美元 AI 代币与 120 万同接的技术真相#

各位朋友好,我是紫星。最近游戏圈被一个数字刷了屏:一款由 AI 深度参与开发、工期约 1 个月的浏览器开放世界游戏,宣称上线 3 天内同时在线玩家突破 120 万。作为管硬件评测的,我的职业习惯不是先聊「为什么火」,而是先把账本和管线摊开看——这些数字能不能对上、靠什么实现、哪部分可信、哪部分要打折。所以这篇文章只回答三个问题:怎么做到的、靠不靠谱、哪些环节 AI 真正提效。

先把结论放在最前面:

  • 能验证的部分是真的:游戏确实免费开放在浏览器里跑,多家媒体真机实测过,集显笔记本跑出了 100+ FPS,内容规模对得起「实际游戏」四个字。
  • 要打折的部分:120 万同接、1 万美元代币成本,全部是开发者自报口径,浏览器游戏没有独立的第三方审计工具,连英文报道自己都在「同时在线」和「玩家数」之间摇摆。
  • 工程判断:这个案例证明了 AI 在「代码生成、任务脚手架、场景铺量」环节的提效是实打实的,但它同时把画面规格、并发方案、完成度这些关键变量全部藏在了模糊地带。

下面逐项拆。

一、先搞清楚对象:这到底是个什么东西#

在拆数字之前,先把对象钉死。这款游戏的官方名称是《臺北GTA:去臺北狂飆》(Taipei GTA),由台湾开发者 aicodewithme 在 Threads 上公开,定位是向《侠盗猎车手》(Grand Theft Auto)致敬的开放世界 RPG 网页游戏。它不是概念片,也不是可下载的客户端——就是一个网址,打开即玩。

项目 内容
官方名称 《臺北GTA:去臺北狂飆》(Taipei GTA)
网址 taipei-gta.vercel.app,部署在 Vercel 云平台
费用 免费,无内购(截至发文未宣布任何变现计划)
运行环境 电脑浏览器、手机浏览器,支持游戏手柄,免下载
界面语言 中英文可切换(右上角切换)
存档 支持自动存档,可「安装到桌面」建立快捷方式
内容规模 五章主线、双主角;任务数各媒体统计在 69 到 93 个之间;另有 30 只招财猫收集
打工玩法 机车比赛、外送、出租车等重复型差事

几个值得注意的细节:

  1. 开局设定很「穷」:两名可选主角——阿杰(「机车之王」,万华长大、在国外跑过外送)与小雯(「夜市车神」,夜市长大、出国当过赛车手)。选角页只给背景设定,没有标注能力数值差异。开局装备是一身衣服、双拳和 500 新台币(约 16 美元)。
  2. 主线叙事有明确骨架:序章「回到臺北」由表哥阿明引导教学,故事围绕「北漂主角回乡、为与阿嬷家的老街反抗都更」展开。这是有起承转合的叙事线,不是随机生成的散装任务。
  3. 任务数两口径冲突:4Gamers 统计为 93 个任务,另一份实测整理为 69 个(主线、支线、打工、文化、比赛五类)加 30 只招财猫。两个数字对不上,可能因版本更新导致统计时点不同——这本身就是「快速迭代型项目」的典型特征:内容处在持续变动里,任何静态统计都只能代表当时快照。

端形态这件事值得单独说一句。免下载、浏览器直达、电脑与手机通吃、外接手柄也能用——这套组合拳决定了它的进入成本几乎为零。对比一下常规游戏的上手漏斗:看宣传、查配置、下载几十上百 GB、再进游戏,每一步都在流失用户;而这款游戏的漏斗第一步就是「点开网页」。这个触达优势是后面理解 120 万那个数字时必须带上的背景——进入成本为零的游戏,热度数字的膨胀速度天然比下载型游戏快,但「点开过」和「玩下去」之间的落差也天然更大。

还有一层身份要说清楚:外界普遍把这款游戏视为开发者自建平台 AICodeWith 的展示品。开发者自己的说法是,当前版本「并非单纯概念 Demo,而是已免费开放游玩的实际游戏」。这两种定位不矛盾——它既是产品展示,也是能玩的东西。但作为评测者要记住:当你看一款「平台展示品」的宣传数据时,默认它有美化动机。

二、成本与工期:1 万美元买了什么#

这是整个事件里传播最广的数字。按台湾媒体 4Gamers 的口径,开发成本为超过 1 万美元的 AI 代币(token),折合新台币约 31.8 万元;工期约 1 个月。

口径项 数据 来源性质
AI 代币成本 超 1 万美元(新台币约 31.8 万元) 开发者自报,媒体转述
开发周期 约 1 个月 开发者口径
人工投入 每天亲自监督 5-6 小时 开发者口径
底层并行 同时跑数百个 AI 编码进程 开发者口径
模型数量 30 个以上大模型 开发者口径,媒体转述

怎么理解这笔账?我的读法是三层:

  1. 钱买的是算力,人出的是审校。 每天监督 5-6 小时、持续约 30 天,折算人工投入约 150-180 小时。这不是「AI 全自动做游戏」,而是「人当质检与决策层、AI 当产能层」的结构。数百个并行编码进程意味着生成是流水线式的,人负责验收、纠偏和合并——这个人力配比对一个单人项目来说并不轻松。
  2. 1 万美元是代币账单口径,不是项目总成本。 没有公开账单截图,无法拆分这 1 万美元里多少花在代码生成、多少花在文案与美术资源生成、多少是调试试错的重复消耗。按业界使用大模型接口的普遍经验,调试阶段的重复生成往往占掉相当比例,但这属于工程推断,开发者未披露明细。
  3. 「1 个月」的起点没有定义。 从哪个时点算起、前期有没有技术储备、是不是全职投入,这些都没有公开。所以「1 个月做一款开放世界」这句话本身是不完整的,严格说法应该是「一名开发者以约 1 个月的可计量周期、超过 1 万美元代币消耗,产出了当前这个版本」。

再把对照组摆出来。业界估计《侠盗猎车手5》的开发预算超过 2.65 亿美元、开发周期以年计(Startup Fortune 引述口径)。必须先声明:两者不是一个量级的产品,这张表只用于说明数量级差异,不构成质量对比——

维度 TaipeiGTA(开发者口径) 《侠盗猎车手5》(业界估计口径)
开发成本 超 1 万美元 AI 代币(新台币约 31.8 万元) 超 2.65 亿美元
开发周期 约 1 个月 数年量级
人力结构 1 人监督,底层数百个并行 AI 编码进程 专业分工的完整团队管线
画面规格 低多边形模型加简单光照,集显可跑 主机与高端独显级别的渲染规格
载体 浏览器,免下载,免费 主机与 PC 客户端,全价销售加线上模式运营
产出形态 五章主线、数十个任务、部分台北地标 三位主角的完整犯罪史诗与持续运营的线上世界

三个数量级的成本差距摆在这里,结论其实很克制:TaipeiGTA 没有证明「AI 能用 1 万美元做出 3A」,它证明的是「可玩开放世界的入场门槛被拉低了三个数量级」。前者是噱头,后者才是真信号。

三、多模型管线:30+ 模型怎么协同(以及哪些没说)#

开发者通过自建的 AICodeWith 平台统一接入多个大模型,该平台采用预付代币制,提供多模型访问。已确认出现在管线里的模型包括 DeepSeek、Qwen(通义千问)、Kimi、GLM 等——清一色以国产模型为主力,这在同类案例里是个相当务实的选型:代币单价低,适合数百进程规模的持续消耗。

先说已确认的部分,再说没说的部分。

已确认:

  • 30 个以上大模型,经由 AICodeWith 平台统一路由调用。
  • 底层同时跑数百个 AI 编码进程。
  • 开发者本人每天监督 5-6 小时。

未披露(这里必须把边界画清楚):

  • 模型级分工细节完全没有公开。哪个模型负责哪部分——比如代码、任务文案、场景描述、数值配置——开发者没有给出任何分工表。网上流传的各种「DeepSeek 负责物理、Qwen 负责美术」式说法,全部属于臆测,本文不采信。
  • 生成内容如何验收、如何合回主线代码库、出错了怎么回滚,这些工程细节同样未披露。

作为技术分析,我可以说的是这类多模型管线的通用价值逻辑(注意,以下是对机制的工程推断,不是对该项目实现的确认):多模型并行的意义通常不在「每个模型各管一摊」,而在用不同模型交叉生成同一类产物,让人的监督精力花在筛选上。单模型串行生成时,人是瓶颈——生成一条审一条;数百进程并行时,人变成了抽检与验收节点,产出量由代币预算决定而不是由人力决定。1 个月工期里「每天 5-6 小时监督」能撑住「数百进程」,靠的正是这种「批量生成、抽检放行」的漏斗结构。

这套结构的直接推论是:产出下限被 AI 抬高了,上限仍然由验收者的水平决定。 游戏里那些贴地气的细节(下面第六节会列)说明验收者在本地生活细节上把关得不错;而街道布局与真实台北的明显偏差,说明空间结构类的生成结果缺乏有效的校验手段——AI 能铺量,但「对不对劲」这件事只有人能判断,而一个人的判断力覆盖不了整座城市。

四、浏览器 + 集显跑 100+ FPS:可行性分析#

这一节是我本行。性能宣称来自 Yahoo Tech 编辑的真机实测:在一台未启用独立显卡的笔记本上,也就是仅靠集成显卡「Radeon 890M」,游戏跑出了 100+ FPS。这个数字乍看唬人,但拆开看完全合理。

实测来源 环境 结果 备注
Yahoo Tech 未启用独显的笔记本,集显 Radeon 890M 100+ FPS 画面为低多边形模型加简单光照
4Gamers 手机浏览器 可玩 画质压缩明显,偶发局部黑块与破图,有加载等待
4Gamers 建议 —— 官方建议电脑游玩 移动端体验明显让步

为什么集显能跑 100+ FPS?三个因素叠加:

  1. 渲染负载本来就低。 低多边形模型意味着三角形数量少一个到两个数量级,简单光照意味着没有实时光线追踪、没有复杂阴影级联。集显的算力瓶颈在这种负载下根本碰不到。拿它对比那些要求独立显卡的 3A 大作没有意义——它们不是一个渲染量级的产品。
  2. 浏览器图形接口的天花板恰好够用。 浏览器端的 3D 渲染走的是 WebGL 这一类图形接口,本身就不承载最重的渲染特性。开发者把画面规格压到这个接口的舒适区,帧率自然好看。
  3. 分辨率与后处理从简。 从媒体描述的画质表现反推,抗锯齿、后期滤镜这类吃带宽的环节基本是让步的,手机端的画质压缩和破图也印证了资源调度并不宽裕。

所以「集显 100+ FPS」这句话的完整版本是:把画面规格压到极低之后,集显当然能流畅。 这是工程取舍的结果,不是什么技术魔法。对比的基准应该选同类低模浏览器游戏,而不是 3A 大作——顺带一提,这也是为什么它不需要玩家有游戏级电脑,触达面天然比需要独显的游戏大一个数量级。

五、120 万同接:这个数字该怎么看#

现在处理全文最大的那个数字。宣称内容:上线 3 天内,同时在线玩家数突破 120 万。

先把传播链捋清楚,因为这个数字的可信度要从链条的每一环看:

  1. 源头:开发者在 Threads 上自报「上线 3 天同时在线突破 120 万」,无后台截图、无第三方统计面板佐证。
  2. 第一层转述:Tom’s Hardware 等科技媒体转载,明确标注「自报数据、未经独立验证」。
  3. 第二层扩散:德国 ComputerBase、台湾 TechNews 与 4Gamers、香港媒体、俄罗斯 ixbt 相继跟进,台湾电视台新闻亦有报道,传播范围远超原始帖子的触达面。
  4. 口径变形:英文报道里「1.2M concurrent players」(同时在线)与「1.2M players」(玩家总数)两种表述混用——两个概念差得很远:累计玩家 120 万可能对应同时在线几万;同时在线 120 万则意味着峰值期间每秒都有大量会话在维持。连传播链条自己都没把这个口径锁死。

为什么无法独立验证?这里是浏览器游戏的一个结构性问题:Steam 平台有 SteamDB 这类第三方审计工具,实时记录在线人数曲线;浏览器游戏没有任何对应物。 在线人数只存在于服务端日志里,而日志在开发者自己手里。这不是断言开发者造假,而是指出:这个数字在结构上就不具备可审计性——没有第二个数据源可以交叉印证,信不信只取决于你信不信这个人。

我的处理方式是把本文涉及的全部数据按可信度分三级,这也是我做技术评测的习惯框架:

等级 项目 判据
可验证 游戏可正常访问(Vercel 部署)、多家媒体真机实测、地标清单、任务与系统细节 任何人可复核
开发者自报 120 万同接、超 1 万美元代币成本、1 个月工期、30+ 模型、数百并行进程 无第三方审计,仅媒体转述
无源 模型分工明细、地图完成度比例、服务器与并发方案、精确上线日期、带宽成本 连口径都未公开

结论:120 万同接应当读作「开发者宣称」,不能读作「事实」。 就算是「累计玩家 120 万」的弱口径,对一个免费、免下载、点开就玩的浏览器游戏来说也不是不可能——毕竟进入成本为零——但这恰恰也让这个数字的商业含金量打了折扣:点进去看一眼和留下来玩是两回事,而留存数据同样没有公开。

六、地图成色:地标是真的,街道是「手搓」的#

关于完成度,流传最广的一个说法是「台北地图仅完成了规划量的极小百分比」。这里我要先泼一盆冷水:这个具体比例的说法,在可检索的公开报道里找不到出处。 各家媒体的原话都是「地图与内容还在持续扩建、未来会依玩家回馈陆续更新」,开发者同时在向社区征集开发方向。也就是说,「极小百分比」这个数字既没有开发者本人的明确表述,也没有媒体实测的支撑——按本文的纪律,它不作为事实引用。能核实的只有两点:地图仍在扩建,当前版本覆盖的是部分台北地标。

那么成色到底如何?把媒体实测的内容摊开看:

类别 已实现内容
地标还原 西门町、台北车站、忠孝复兴、台北 101、总统府、台北大巨蛋、信义计划区与松菸、士林夜市、台湾大学、中正纪念堂、龙山寺、228 公园、华山文创园区、饶河与五分埔夜市
路名系统 基隆路、松仁路、复兴北路、建国北路、新生南北路等真实路名
空间还原 街道配置与景点相对位置和现实台北存在明显差异(4Gamers 实测)
交通系统 红绿灯与小绿人有实际意义,不是摆设
天气系统 下雨时角色自动撑伞
通缉系统 抢车、撞人等犯罪会被警察逮捕;可回看勤指中心无线电追缉记录;躲出小地图搜索圈可甩掉通缉;警察台词为「下车!手放在头上,再跑要开枪了!」
生活细节 吃东西回血;致敬现实品牌的便利店与手摇饮;部分路人 NPC 有贴近日常的对话(悠游卡加值、骑楼躲雨)
特色场景 台北 101 可乘电梯上 89 楼

我的成色判断是:这是一座「符号级」的台北,不是仿真级台北。 地标、路名、生活细节这些「点」上的还原密度相当高,而且 NPC 对话里悠游卡加值、骑楼躲雨这类细节,明显出自对本地日常的真实了解——这是内容质量的硬证据。但城市肌理这个「面」上,街道布局与真实地理的偏差说明它是按「景点连线」的逻辑铺出来的,道路之间没有经过真实路网校验。对一个月工期的生成式管线来说,这是预期内的结果:AI 铺点状内容效率极高,校验全局空间一致性则缺少自动手段。

七、法务边界:「GTA」这个名字能撑多久#

技术之外,这个项目还有一条随时可能引爆的引线:名字。游戏直接借用了「GTA」名号,而《侠盗猎车手》系列的版权方 Rockstar 以法务严格著称。

现状(截至 10 月 5 日): 游戏仍可正常访问,无下架迹象,Rockstar 方面没有任何公开动作;开发者也未宣布变现计划。

但先例摆在那里:

  1. Fallout: New York 下架事件。 一款 AI 生成的《辐射》题材浏览器游戏,收到版权方 ZeniMax 的侵权函后,于 10 月 1 日下架——从上线到消失只隔了很短时间。这是我们编辑部在 10 月 4 日的事实卡里刚追踪过的案例,发生时间就在 TaipeiGTA 走红前后。
  2. GTA 系列网页版的历史。 《侠盗猎车手:罪恶都市》与《侠盗猎车手3》的网页版此前都曾被权利人以《数字千年版权法》(DMCA)程序下架,之后又重新回到浏览器上。权利主张的执行是拉锯式的,不是一封函就终结。

风险边界的拆解:「致敬玩法」本身很难构成侵权——开放世界、开车、任务结构是品类共性;真正的暴露点是名称与商标。「GTA」直接出现在游戏名里,等于把 Rockstar 最有价值的商标挂在了自己的门头上。还有两个变量会显著改变风险等级:一是变现——目前完全免费反而是护身符,一旦开始收费,侵权损害的论证难度会大幅下降;二是知名度——120 万同接的传播热度本身就是把项目推到版权方法务雷达上的过程,越火越危险。

给同类项目的工程侧建议只有一条:把版权风险当作和服务器成本同级的架构约束来做设计,命名阶段就避开他人商标,比上线后被下架再重建便宜得多。

八、务实判断:AI 真正提效在哪,哪些数字要打折#

最后落到本文的核心问题:这个案例对「AI 小团队开发」路线意味着什么。

AI 真正提效的环节(有证据支撑):

  1. 代码生成与任务脚手架。 五章主线、69 到 93 个任务、通缉系统、天气系统、电梯交互——这些是实打实的功能代码量。媒体真机实测确认了「能玩」,这就是最硬的背书。
  2. 场景铺量。 十几个地标、真实路名网络、夜市场景,这类「点状可枚举」的内容正是生成式管线效率最高的领域。
  3. 迭代速度。 任务数两个统计口径的差异本身就说明内容在快速变动中——传统开发里一个月内内容翻新到媒体统计对不上号,是反常识的速度。
  4. 成本结构。 1 个人、1 个月、1 万美元代币,产出一个可玩的开放世界雏形——哪怕所有自报数字都打对折,这个投入产出比在传统管线里也不存在。对照组:业界估计《侠盗猎车手5》的开发预算超过 2.65 亿美元,耗时长得多,那是另一个量级的产品,但这组对照至少说明了两个数量级的成本差距是真实存在的。

需要打折看待的数字:

数字 口径问题 建议读法
120 万同接 自报,无审计,且「同接」与「玩家数」口径在传播中漂移 未经验证的市场热度信号
1 万美元成本 自报,无账单,未拆分明细 量级参考,不是精确成本
「极小百分比」完成度 无出处,可核实的只有「持续扩建中」 不采信任何具体比例
30+ 模型 数量口径,无分工明细 平台能力展示,不构成方法论
「1 个月」 起点未定义,储备与投入强度未知 「一个可计量周期」而非全程

对路线本身的判断。 这个案例证明的最有价值的一条边界是:AI 压缩开发周期的提效区间,集中在画面规格可以让步、内容量驱动、单机或轻联网形态的项目上。反过来,它没有证明的是:高规格画面(渲染管线不是靠铺量能堆出来的)、深度系统设计(全局一致性缺少自动校验)、大规模并发(服务器架构与成本完全未披露)。所以「AI 小团队」路线的正确姿势不是「替代 3A」,而是用内容密度换画面规格,用生成速度换迭代周期——TaipeiGTA 恰好全落在这个交集里。

后续我建议盯四个追踪点:一是有没有正式更名为 TAIPEI RUSH(目前仅单一消息源,未交叉确认);二是地图扩建的实际进度,这是检验「持续扩建」承诺的硬指标;三是 11 月 19 日《侠盗猎车手6》(Grand Theft Auto VI)正式发售后的玩家留存——台湾媒体把它定位成 GTA6 前的轻量过渡选择,届时数据会见分晓;四是 Rockstar 是否发出法律函件,这决定同类项目的生存模板。

结语#

拆完这一轮,我对这个案例的态度是「谨慎的尊重」:尊重的是工程执行力——一个人、一个月、一万美元代币,做出经媒体实测确认可玩的开放世界,这个事实本身就是 AI 开发管线的阶段性成果;谨慎的是所有传播数字——同接没有审计、成本没有账单、完成度没有出处,这些数字在传播链里越滚越大,但每一层转述都没有增加可信度。

工具改变的是「做事的成本」,改变不了「什么是好游戏」的判据。TaipeiGTA 用最低的成本交出了一座符号级的台北,接下来该回答的问题是它自己许下的:地图扩建能不能兑现、热度能不能沉淀成留存。这些都不是 AI 能替它回答的。

——紫星,NTGame 硬件评测总监

内容最后验证于 2026-07