前年我们有条素材跑得特别好,好到我在周会上管它叫基本盘。第三周它开始往下掉,我的第一反应是降预算顶一顶。越顶越贵,最后停掉的时候,CPI 已经是最开始的两倍多。
做 UA 最贵的成本从来不是买错流量,是每次都从头猜。猜中了高兴三天,猜不中重开一局,中间那段时间全在空转。
素材没有稳定态,它从上线那一刻起就在往死里走。
而我们要做的第一步,是先看清那条线。产品从核心玩家走到泛用户,每一段要回答的问题都不一样,推动它的方式却只有一种「提假设,做实验,看数据」→ 再来一轮。
别把脑暴会当创意引擎
大部分团队说到想创意,就是拉个会,各说各的,看哪个能中。这套东西撑死一个季度十条素材,然后自己垮掉。
不是人不行,是它底下没有任何逻辑。
真正跑得起来的创意生产,目标不是脑洞,是基于已有成功模式的假设生成。说白了你不是在发明,你是在组合。
而且它必须同时跑两条线。一条是安全牌:已被验证过的模式,做得快、风险低、随时能放量。另一条是实验牌:慢、贵、大概率扑,但只有它能帮你找到下一个还没被竞品算进竞价的模式。
《Royal Match》是个好例子。所有人都记得它那条救国王(Save the King)的素材,但人家同时还在跑别的变体,比如操控国王卖甜甜圈的经营类可玩广告。
只打安全牌,你会先撞上平台期,再看着模式一点点疲劳往下掉。
只做实验牌,你会一边烧钱追突破,一边看着主力素材悄悄失效。
比例取决于你花多少钱、能承受多大风险,但两条都得有,而且必须同时在跑。
创意来源
要做假设,得先有原料。来源其实就两个。
第一个是你自己的经验(历史数据)。赢过的素材里全是模式:什么开头钩子、怎么框定玩法、戳哪种情绪、画面节奏多快。把这些拆开重新组合,比每次从头开始靠谱太多。
这件事做得好的团队有个共同习惯:他们给创意同学的是数据和自由度,不是规格和指令。一个策略同学如果真的理解某条钩子为什么成立,他能重新演绎出来的东西,是任何一份需求文档都写不出来的。
第二个来源是外部信号:竞品在跑什么,品类在往哪走,跨品类有没有能搬的结构。不是让你抄,是让你看哪些结构正在被规模化投放。
这里有个很朴素的判断方法:曝光量越高,说明投放方越愿意为它花钱。它不一定最赚钱,但值得认真看一眼。
反过来看更有意思,竞品在二三线市场测了一个概念之后再也没跑过,那大概就是没成;
某个曾经统治级的玩法在慢慢消失,多半是已经饱和。死掉的素材也是情报,而且经常比活着的更值钱。
我一直觉得两条线必须并行,不是因为更准,而是因为它们能互相纠错。只有自己的经验,人会越来越自恋,反复做同一个已经被验证过的自己;只有外部信号,人就只会跟风,永远慢半拍。
经验给你方向,信号给你时机。
测试标准
创意备好了,接下来是测。但测不等于买流量等结果,它是一套有标准、有方法、还要回炉的系统。
第一步,也是最容易被跳过的:开测前把成功标准写下来(基准先行)。
这玩意听着像废话,但它恰恰是整个流程里最常被跳过的一环。没有它,每个结果都会变成一场辩论:一条素材跑了 80 个安装,单次安装成本比目标高 15%,它算赢、该砍、还是要再测一轮?
三种说法都能讲通。但你要把基准先定好,否则到时候就公说公有理婆说婆有理...
通常看三个指标:IPM,每一千次展示带来多少安装,是早期信号,用来快速筛;CPI,看效率;转化率,看质量——这条素材拉来的人到底会不会付费。
这里有个坑:只按安装量砍素材。有些素材 IPM 不好看,但拉来的人质量更高,装得少,却更能付费、留得更久。只看量的话,你第一周就把它砍了,永远不知道它放大之后会怎样。
GameBiz 分享过一个模拟经营的例子,四个概念一起测,装得最多的不是最优解,反而是个叫 Nostalgic 的创意,CPI 和 IPM 都是四个里最好的。它才是该拿去迭代的,尽管量不是最大。
第二名很值钱。消耗最大的那条素材从来不是唯一值得迭代的,等主力的那个角度开始疲劳时,一个体量更小但 IPM 或 CPI 更健康的素材,往往就是下一条增长路径。
还有两条硬规矩。一是测试要带上对照组,就是那条跑了很久的老主力。没有对照组,你比的是平台波动、季节性和人群饱和,会把功劳记错人。
二是测试环境和放量环境要一致,用优化安装的设置去测,却用优化价值的设置去放量,结果会很误导,两种设置定位的不是同一批人。
快,比准重要
测试这件事,优先级是学习速度,不是判断精度。
不同平台节奏不一样,Meta 又快又便宜,Google 需要更多数据和时间。但三天拿到 90% 把握的判断,比三周拿到 99% 把握的判断强得多。
等你到第三周,迭代窗口已经没了。
有个很小但很说明问题的点,两年前一个团队大概需要 100 个安装才能判断一条素材成不成,今天同样的团队往往 50 个就够了,因为他们校准过自己的数据波动。
门槛越低,决策越快,测试成本越低,迭代频率越高。
Playable 为什么成了兵家必争之地
把前面这些串起来,playable 的崛起就不奇怪了。
先看数据。2023 年 10 月,全球新出现的 playable 素材不到 1000 个;到 2025 年 10 月,这个数字是每月 5 到 6 万个,两年 50 倍。
按消耗排的 Top 30 素材里,2025 年 10 月有 17 条是 playable,占 56%,一年前是 30%。收入 Top 20 的游戏,月均新增 playable 的中位数是 64 个。
头部团队已经把 playable 和视频的数量比压到 1 比 16,大盘还在 1 比 41。
为什么偏偏是它?因为视频渠道的本质是给你看,playable 的本质是让你体验。

核心玩家那批人,你给他看一段画面,他就能判断要不要装;但你要往泛用户走,光靠看是不够的,得让他先上手玩三十秒。试过再装的人,本来就更可能是你要找的人。
创意是提问,变体才是回答
这俩的区别,很多人会搞混。
创意回答的是要不要往这个方向走:一个全新的玩法切片、一种没试过的情绪。风险高,但一旦成立,它就是竞品还没算进竞价里的新模式。
变体回答的是这个方向里到底哪个细节值钱。它长在一个跑出来的概念上,风险低得多,但每次改动都得带着一个假设问题。
《Whiteout Survival》是这件事做得最狠的样本。2025 年 10 月它在 AppLovin 上放了 42 个新可玩广告,拆开是 15 个概念加 27 个变体——超过 60% 产能不是拿来赌新方向,而是拿来榨干一个已经成立的方向。
更狠的是跑出来的一个概念单独做了 11 个变体,光它自己就占了当月总量的四分之一。
它的变体长什么样?基础概念是一个休闲化的 4X 切片:采集资源,供养营地,建造,推进。
第一个变体把资源从一种加到两种,问的是深度。多一点进程感,玩家会不会更投入,这批人进到完整游戏里会不会留下。
第二个变体换了武器:单手斧变成两把旋转斧。问的是战斗节奏,清怪更快、循环更短,割草感更足的时候,装的意愿会不会更高。
一次只动一个变量,一次只回答一个问题。
很多团队说自己也在做变体,其实做的是微调:换个角色衣服颜色、换个背景,然后管这叫测一版。那是自我安慰。真正的变体是,改之前就能说清楚这次要验证什么,什么数据算成立。
这么拆还有个不太显眼的好处。AppLovin 这类靠机器学习跑量的平台,本质上是在替你找高价值人群。
你给的弹药越多样、组合越清晰,它学得越快。变体不是内卷,是在喂机器。
测试不是终点
一条素材在测试里赢了,只是第一步。
完整循环是四步:测出来,放进正式投放去跑,持续盯着它随时间的变化,再把学到的东西喂回创意构思。最后这一步是整个系统能产生复利的原因。
把它当终点,你会得到一堆被验证过、却从没跑到规模化消耗的素材坟场。
产品从核心玩家走向泛用户的这条路上,创意就是那条一直在试错的线。你要做的不是猜对它,是让每一次猜错的代价都更小一点,让每一次猜对都能被复用。
我与 Ramiz Trtovac 的思路在某种程度上也算是不谋而合,这套框架真正产出的不是爆款素材,是让团队不再纯拼运气。

