8 月 31 日下午三点,米哈游的 AI 陪伴游戏《林离》会关停服务器,从 Steam 下架。它 7 月 13 日才上线,不到两个月。角色设定是上海在读大学生,主修钢琴,辅修心理学,你可以看她弹琴、给她写信,还可以把她挂在桌面当动态壁纸。产品没有付费点,免费。Steam 评价是「特别好评」,好评率超过八成。
我在游戏行业待了十几年,看到这条停运公告的第一反应不是可惜,是觉得这账迟早算不明白。
问题不在产品做得好不好,在成本结构上。林离这样的 AI 陪伴产品,每一条玩家消息都对应一次模型推理。推理的 token 成本里,八成以上是算力支出;训练时 GPU 利用率能到 50% 以上,实时对话推理为了低延迟响应,每算一个 token 都要把全部参数过一遍,利用率常年只有 5% 到 10%。产品是 24 小时在线的,玩家越多越活跃,账单就越高。这不是优化能救的,是随着用户规模线性上升的烧钱速度。
我做游戏这些年,见过太多这种结构:免费玩家是绝大多数,一个社区里愿意掏钱的永远是少数。娱乐产品想让人持续付费,相当于让免费玩家突然开始开会员,大部分人是不买账的。传统免费游戏还能靠少数付费用户扛住服务器租金,AI 陪伴产品的账是另一回事:用户免费陪聊,厂商按 token 付钱,用户的热情直接等于厂商的成本。Shopify 那个 AI 助手的数据可以对照,每天 1000 万次对话就是 20 亿 token,一个月 45 万美元,那还是个干活工具,商家愿意付,因为它替商家赚回来的比 45 万美元多,算得过来账。
米哈游不是不知道。他们说 AI 投入最多一千亿,如果没成就当放烟花。蔡浩宇的 Anuttacon 做的 AI 猫娘《AnuNeKo》,7 月 30 日也永久关服了。这就是烧钱试错的心态,钱多,试得起,但账结构没变。
有意思的是,同一段时间,推理价格在跳水。GLM-5.3-Flash 定价是 Opus 4.8 的四十分之一;Qwen3.8-Flash 输入 1 元/百万 token;DeepSeek V4-Flash 输出 4.5 到 9 元/百万。看起来算力便宜了,好像能救 AI 陪伴。但便宜是便宜,按 token 计费的逻辑没变,用户量一上来,账单照样吓人。
个体做 AI 产品,多半是从一台显卡、一个窄场景开始的。有一条大厂不走的路:本地推理。设备是一次性买断,买完之后,本地模型随便跑。开源模型这几年进步不小,Qwen、GLM 都有不错的本地版本,能力不一定够顶级,但够用。我自己的 4090 跑 ComfyUI 出图,算力从来不按张收费,贵的是我的时间,不是电费。同样一张图,云上按张计费,本地只有一点电费。
但这条路有它的边界,得说清楚。大厂不走,不是因为笨,是他们做的本来就是多用户并发的生意,设备买来也是集群,跟个体一台显卡不是同一种算力。本地推理是单机生意,几十个人用是工具,一万个人用,就成了下一个林离。推演出万人在线的规模,本地算力照样扛不住,还是要回到 token 账单上去。
还有人会问:能不能让玩家自带算力?模型装在玩家自己的设备上,厂商只出软件,推理成本直接归零。这个设想卡在体验上。手机和家用电脑跑得动的,是小模型。聊个五轮八轮还行,聊久了就露馅,它接不住你上一句的梗。陪伴产品最怕这个。玩家连月费都不愿意掏,更不会为了一个接不住话的陪伴去买算力,或者忍着凑合。
所以我要说的关键点在这:算力是成本问题,掏钱是意愿问题。模型价格降得再低,也降不出一个愿意付月费的玩家。AI 陪伴死就死在付费意愿上,玩家不付钱,厂商不停付钱,算力再便宜也只是把大账单换成小账单,付钱的总还是厂商。
再往深说一层。传统免费游戏里,玩家为什么愿意掏钱?付费买的是变强,是社交场里的展示位,这些都有刻度。强度有数值,展示有排名,用户能看见自己的钱花在哪。AI 陪伴没有这种刻度,花钱买的是陪伴时长。和谁聊一小时都是聊一小时,谁也不在乎你比别人多陪了多久,时长没有比较,就没人愿意为它付钱。一个没有付费锚点的产品,靠免费玩家的人数撑着,再便宜的模型也填不了这个窟窿。
所以我的判断是:林离的停运不是产品失败,是这个定价模式下的必然结局。AI 陪伴第一个倒下不奇怪,后面还会有。这个账要算过来,要么做成低频且一次性的体验,要么找到真正愿意为聊天付费的人群,要么干脆别做陪伴,去做替玩家干活的东西。
对我来说,这件事最重要的提醒是:算力结构可以选,付费意愿不能选。买断设备、本地推理,把成本的账算到一次付清,是站在对的那一边;而任何指望用户为持续聊天持续掏钱的产品,等于把商业模式押在了一个最难变现的东西上。
米哈游百亿级的试错,和个体一台显卡的账,共用同一套账本逻辑。这笔账,我在游戏行业里见了十几年,在 AI 产品上还要再见一次。