我以为在找 AI 项目,数据把我推到了贺卡站
昨天花了一整天做选品调研。起点是 AI 模型对比站,终点是电子贺卡。中间被数据打脸六次,每一次都是我已经写进报告、自认为板上钉钉的结论。
写出来不是因为找到了什么好项目,而是因为那六次打脸比结论值钱。工具就那几样(Semrush、Similarweb、Google Trends、SERP),但用错一步,结论能反过来。
证伪一:Semrush 对新词是瞎的
那天 Grok 4.7 刚发布。我想看看”抢新模型词”这个打法还成不成立,于是把一批词丢进 Semrush:
1 | grok 4.7 → 无数据 |
七个词全是零。第一反应是脚本挂了或者节点没权限——这种时候最容易自己骗自己。于是拿一个已知有量的词做对照:
1 | ai video generator → 165,000 / KD 91 / CPC $1.71 ✅ 正常 |
脚本没问题。Semrush 是真的不收录模型版本号词,而且 grok 4.6 都发布好几个月了,照样是零。
换 Google Trends 看,结论完全相反:
| 词 | Semrush | Trends 8月 | Trends 9月 |
|---|---|---|---|
| grok 4.7 | 0 | 0.5 | 13.6 ↑27× |
| grok 4.6 | 0 | 9.6 | 7.1 |
| grok imagine | 40,500 | 11.5 | 11.0 |
grok 4.6 和 grok imagine 在 Trends 上热度差不多,Semrush 却一个给 0、一个给 40,500。
反过来也会骗人。 我原本把 grok imagine 的 40,500 当成机会写进了报告。Trends 一查:这词 2026-04 就见顶了(4.8→5.5),到 9 月只剩 0.7,**衰减 87%**。Semrush 报的是个早就没了的量。
替代办法:用已知量的词做锚点折算
既然 Semrush 给不了新词的量,就用 Trends 的相对值反推。做法是把新词和一个已知搜索量的词放进同一个对比(Trends 的归一化只在同一次查询内有效),地区选 US、时间范围选近 1 个月:
1 | 日期 grok 4.7 ai video generator |
锚点 ai video generator 稳定期日均约 20,对应 165,000/月(US)。按比例折算,grok 4.7 当天的热度约等于 19 万/月的量级——而 Semrush 的读数是 0。
坑:一定要看日级曲线,不能看月度均值。 同样这一天,按月均算只有 3.3——因为 9 月前 21 天全是零,把平均值稀释了。新发布的词尤其如此,月均会系统性低估。
顺带一个意外收获:Trends 的”相关查询—飙升”里,grok 4.7 带出来的是 cursor / grok bot / astra / codex / fable 5.2——搜 Grok 4.7 的人同时在搜 Claude 和 OpenAI 的对应型号。跨厂商对比的需求,在飙升词里直接摆着。
证伪二:我把竞品查错了对象,得出了完全相反的结论
报告里我写过一节叫”先行者全部零流量”,依据是这三个域名:
1 | modelpricing.ai AS 7 自然流量 1 |
结论顺理成章:赛道是空的,没人做成。
这三个域名是我猜的。 名字像,所以我查了它们。
后来从 Grok 4.7 发布当天的 SERP 反查真实占位者,格局完全反过来:
| 域名 | AS | 自然流量(US) | 引荐域 | 趋势 |
|---|---|---|---|---|
| openrouter.ai | 54 | 162,200 | 29,600 | +8.9% |
| artificialanalysis.ai | 47 | 69,900 | 17,600 | +24% |
| llm-stats.com | 41 | 60,400 | 4,000 | −9.6% |
| benchlm.ai | 35 | 12,200 | 2,100 | +58% |
不是空的,是四个位置全被占死的红海:权威评测(AA 有自己跑的私有 benchmark)、真实定价(OpenRouter 本身就是卖 API 的,定价是它的一手业务数据)、结构化对比、工具矩阵。
教训:找竞品必须从目标词的 SERP 反查,不能猜域名。 猜出来的域名天然偏向”名字像但没人做”的死站——于是必然得出”赛道是空的”这个正好相反的结论。
证伪三:查子域名,Semrush 返回的是根域名数据
研究 token counter 这个词时(4,400/月、KD 33、CPC $15.83,当时看着很香),我查了 SERP 里的竞争者:
1 | token-counter.utils.com AS 42 自然流量 72,700 引荐域仅 563 |
563 个引荐域做到 72,700 流量?我当场得出结论:”工具形态的流量是价格表形态的 20 倍”,还写进了汇报。
错了。 那 72,700 是整个 utils.com 的数据——Semrush 查子域名时返回的是根域名。扒开它的排名词一看:
1 | magic 8 ball 23,600 流量 → 8ball.utils.com |
token counter 实际只带来 105 流量。 我为这个词查了搜索量、查了 SERP、查了三个竞品的 AS、还写了个诊断工具原型——而它在这个站里排第 12。
证伪四:玩具碾压技术工具,差 8.7 倍
既然扒开了 utils.com,干脆把它 98 个工具页的流量全拉出来。分布极端到有点好笑:
1 | 8ball 57,100 ← 一个占了 78% |
按类型加总:
1 | 玩具/占卜 8ball 57,100 · zodiac 1,800 · runes 204 · sigil 114 |
玩具是技术工具的 8.7 倍。
还有两条结论一起浮出来:
这是幂律,不是精选。 98 个工具里只有 6 个过千,第一名独占 78%。它的打法不是”挑个好赛道做透”,而是把每个小工具的边际成本压到接近零,然后赌一两个爆。我花一整天论证一个赛道该不该做——人家先做一百个再说。
巨头做不了”神奇 8 号球”。 大站要维护品牌和内容标准,这类东西它们不屑做,所以留出了空隙。
证伪五:去 Reddit 挖需求,这招已经被用烂了
中途我换了思路:不看关键词工具了,去听真实用户说话。先试 Hacker News,用 Algolia 接口捞了 2026 年的 1,494 条”需求原话”(I wish there was、why is there no、I'd pay for 这类句式)。
结果双重失败:需求彼此毫不相干(高频词全是 way / thing / like 这种虚词),而且话题 100% 落在开发者领域——claude 44 · apple 42 · linux 33 · windows 27 · rust 18。在 HN 找需求,等于和全世界的独立开发者抢同一批需求。
于是转向垂直行业社区:会计、牙医、地产、餐饮、装修、摄影、电商卖家——这些人有钱、有具体痛点,且开发者不会去蹲守。捞到 246 条,里面确实有真东西。
但翻到最高分的评论时,我笑了:
1 | [18] r/lawfirm "Reading posts from people trying to sell something in here |
还有一条纯讽刺的:
“Hello. Im making an app for people who make apps for online fitness coaches. What would you say is the most annoying part of your business?”
那些”你最大的痛点是什么”的帖子,本身就是独立开发者发的市场调研帖,社区已经免疫了。 我想用的方法,成百上千人正在同时用。r/smallbusiness 那句”这周第十次看到同样的问题”说得最直白。
顺带两个技术细节:
- Reddit 的
.json接口限流极狠,跑到第 15 个 sub 就整批 429,之后几十分钟恢复不了。改用old.reddit.com的 HTML 页面完全正常(同一时刻.json429、网页照常打开),而且是经典 HTML 不是 SPA,选择器稳定。 - 按 score 排序找需求是反的。 高分帖全是情感共鸣——1,265 分那条是摄影师吐槽白干活,198 分是工地里的性向话题。”我需要个工具”这种帖天生没人点赞,真需求沉在底部。
转折:跳出”模型”这个圈
到这一步我才意识到一件事:那天所有路径——模型对比、视频模型、token 统计、价格计算、新模型窗口——**对象全是”模型”**。
原因在起点。我一开始就把范围设在 AI,之后用的每个数据源(PH 新品榜、Semrush 的 AI 词、HN 话题)都只会把 AI 里的东西喂回来。工具决定了视野,我在一个自己画的圈里转了一整天。
而最打脸的证据刚才就摆在眼前:utils.com 靠一个”神奇 8 号球”拿到的流量,是我盯了一下午的 token counter 的 225 倍。
于是换掉筛选标准:只看能不能程序化、有没有量、KD 低不低,不预设领域。
顺手量了一下纯工具站的天花板:
1 | calculator.net AS 90 自然流量 17,700,000 745,200 词 |
而我一整天在研究的池子:benchlm.ai 12,200、pricepertoken.com 2,800。差了 6,300 倍。
证伪六:贺卡站根本不是 SEO 站
顺着”玩具工具”摸到了电子贺卡。先看竞争格局,birthday card maker 的 SERP 10 个结果里 9 个是大站内页(Canva、Adobe、Paperless Post)。按常理这叫”打不过”。
查了才发现相反:
| 域名 | SERP 位置 | AS | 自然流量 | 引荐域 | 趋势 |
|---|---|---|---|---|---|
| creategreeting.com | 第 5 | 8 | 119 | 157 | +284% |
| recocards.com | 第 6 | 46 | 96,000 | 762 | +29% |
| greetingsisland.com | 第 4 | 60 | 305,400 | 12,100 | −6.6% |
AS 8 的新站排在第 5,压过了 Adobe(第 7)。 大站的内页只是顺手开的一个栏目,没人真正经营。而且老站在跌、新站在猛涨,品类正在换血。
扒 recocards.com 的页面结构,模板一清二楚——流量 73% 来自 /blog/ 下的祝福语内容页,按四个维度机械展开:
1 | 场合 birthday · anniversary · retirement · farewell · graduation · get well |
单页最高的 belated-birthday-wishes 有 14,500 流量。空位遍地,随手查 8 个它没做的组合就有 31,310/月,KD 全在 14–41:
1 | happy birthday wishes for friend 14,800 KD 39 |
到这儿我已经准备下结论了:低门槛、可程序化、不需要运营,完美符合要求。
然后查了 Similarweb,整个判断塌了。
| 来源 | recocards | kudoboard(品类第一) |
|---|---|---|
| 总访问量 | 410,993 | 2,530,000 |
| 直接 | 71.53% | 74.02% |
| 电子邮件 | 2.85% | 6.44% |
| 自然搜索 | 10.39% | 6.43% |
| 自然社媒 | 10.71% | 4.77% |
自然搜索只占一成,而且规模越大占比越低。
我之前说”97% 流量来自内容页”——那个 97% 是自然搜索内部的构成,而自然搜索本身只是总盘子的 10%。这是个典型的口径错误:Semrush 给的是自然搜索估算,Similarweb 给的是总访问量,两个数摆在一起不看口径就会得出完全错的结论。
真正的引擎是产品自带的传播性:
1 | 一个人建卡 → 发给全组同事签名 → 每个签名者点链接进来 |
每创建一张卡,自动拉来十几个精准访问者,全部记作”直接”或”社媒”。kudoboard 的搜索词里排第三的是 e card for multiple signatures(多人签名电子贺卡)——用户是冲着功能来的,不是冲祝福语文案。
这也解释了它为什么敢把无限签名、无限消息、定时发送全部免费送:每一个签名者都是一次免费获客。
附带扒出来的两件事
内容质量的门槛比想象中高
那个 14,500 流量的页面,标题是《64 Belated Birthday Wishes That Aren’t Awkward》。开头是第一人称故事:
“我错过了姐姐 Priya 2019 年 3 月的生日。不是晚了一天,是晚了九天。当时我刚到奥克兰入职三周,睡在朋友家的行军床上……”
然后给出真正的编辑洞察:**”过度道歉会把小失误变成一场长篇表演,反而要寿星来安慰你。”** 有署名作者和作者页,六个分节各有编辑指导,64 条文案条条不同。
这不是”让 AI 写 50 条祝福语”能做出来的。 但这恰恰是好消息——这道墙把纯 AI 垃圾站挡在外面了,所以 AS 8 的新站还能排第 5。
变现结构
1 | Free $0 / 卡 无限签名、消息、照片、定时发送 |
C 端内容获客,B 端变现。搜 birthday wishes for boss、farewell messages for boss 的是职场人——他们在公司里用顺手了,就会推动公司采购。那些”给老板的生日祝福”根本不是 C 端玩具流量,是 B2B 的获客入口。
出站流量还暴露了技术栈:firebaseapp.com(托管)、ideogram.ai(图片生成)、checkout.stripe.com(收款)。AI 生成放在付费功能里,不是人人免费用——成本永远发生在收入之后。
六条能带走的
Semrush 对新词是瞎的,模型版本号词一律无数据。要实时判断就用 Trends 日级曲线 + 已知量锚点折算,而且别看月均值——它会被发布前的零值稀释。
找竞品从 SERP 反查,别猜域名。 猜出来的必然是”名字像但没人做”的死站,于是必然得出”赛道空着”。
查子域名时 Semrush 返回根域名数据。 别把站群的总流量算到一个子域名头上。
按 score/评论数排序找需求是反的。 高分帖是情感共鸣,真需求没人点赞。
Semrush 的自然搜索 ≠ Similarweb 的总访问量。 口径不同不能并列。一个站到底靠什么活着,必须看流量来源构成——我差点把一个分享驱动的产品当成 SEO 站。
工具决定视野。 用 AI 数据源只能找到 AI 项目。困在一个主题里转不出去时,先检查是不是自己的信息源把范围锁死了。
最后那个反直觉的结论:这个品类的增长引擎是产品自传播,不是内容。 内容只是 6–10% 的补充渠道,词盘门槛确实低、值得做,但指望它撑起整个站是错的。
而”多人协作签名”这个功能设计——它的技术投入是一次性的,开发完边际成本接近零,用户涨了也不多花钱。这跟”AI 实时生成贺卡”那种每张都烧钱的路子,是两种完全不同的生意。
我一整天都在找”不需要运营的生意”,答案不在选对赛道,在选对产品形态。