$npx -y skills add PHY041/claude-skill-reddit --skill subreddit-deep-research深挖一组 subreddit 的"社区研究"技能。给一个品牌或项目,先摸清相关(自家品牌+竞品)的 subreddit:爬规则原文、爬高赞帖逐帖学、找共性、产出"能不能提品牌/能不能发链接/要不要披露"的逐社区政策矩阵。用于任何新品牌/新项目上 Reddit 前的社区尽调。触发词:"研究 subreddit""摸清社区规则""Reddit 社区尽调""subreddit deep research""某品牌相关的 sub"。
| 1 | # Subreddit 深度研究 |
| 2 | |
| 3 | 给一个品牌/项目,系统地"认真学习并尊重"它相关的 subreddit,产出可执行的社区研究。**这是上 Reddit 前的尽调,不是投放手册。** |
| 4 | |
| 5 | ## 铁律 · 合规两道门(每个结论都要过) |
| 6 | |
| 7 | - **门1 = 该 sub 的成文规则**:这个版允不允许链接/自我推广/品牌内容?(看 rules.json,过不了别发) |
| 8 | - **门2 = FTC 披露**:只要发帖人与品牌有物质关联(供货/返利/付费/雇佣),链品牌/荐品牌**必须显式披露**。**门1过 ≠ 可不披露打广告。** 谁发链接决定要不要披露:真独立用户链品牌=自由(不可代写不可编造);关联创作者链品牌=必须披露。 |
| 9 | - **核弹红线**:关联身份不披露 + 去竞品帖踩对手 = 任何 sub 一律绝不做(Insta360 就是这么被全网锤的)。 |
| 10 | |
| 11 | ## ⚠️ 数据能拿到什么 · 不能拿到什么(先记牢,别建在假设上) |
| 12 | |
| 13 | | 数据 | 能不能拿 | 说明 | |
| 14 | |---|---|---| |
| 15 | | 高赞帖 top 10/20/50 | ✅ 能 | 按 score / 评论数 / upvote_ratio,MCP `get_subreddit_top_posts` limit 到 100 | |
| 16 | | 高赞评论 | ✅ 能 | MCP `get_post_comments` | |
| 17 | | 规则原文 rules.json | ✅ 能(需真实浏览器) | 本地 curl/WebFetch 撞 403 反爬;要登录态 Chrome 同源 fetch(见下) | |
| 18 | | upvote_ratio(顶踩比例) | ✅ 能 | 但只有百分比 | |
| 19 | | **单独的 downvote 数** | ❌ **拿不到** | Reddit 只公开净分 score + upvote_ratio | |
| 20 | | **别人帖子的 view(浏览量)** | ❌ **拿不到** | view **只有作者本人**在自己后台能看;别人的高赞帖看不到 view。"view 前 50"不可得 | |
| 21 | | 自己发的帖/评论的 view | ✅ 能 | 登录作者可从 DOM/后台刮(仅限自己发的内容,随发帖累积) | |
| 22 | |
| 23 | ## 🔐 账号安全 · 两条路分开走(重要) |
| 24 | |
| 25 | **高量的活走 MCP,轻量的规则走浏览器,运营账号永不背爬取风险。** |
| 26 | |
| 27 | - **高赞帖/评论(高量)→ 走 Reddit MCP**:MCP 用独立的只读 API 凭证,**不碰我们的操盘账号**,可以放心大量拉(51 sub 实测无事)。 |
| 28 | - **规则 rules.json(轻量)→ 登录态 Chrome 同源 fetch**:本地会被 403,得用真实浏览器。用 `scripts/fetch_rules_via_server.py`(在 一台有登录态浏览器的机器 上跑,复用 `a logged-in-Chrome fetch helper (browser.py)`)。 |
| 29 | - **必须慢速拟人**:几秒一个请求。快了会触发 Reddit 限流(实测 40+ 请求/秒 → 账号被临时限流,返回空/HTML)。读规则本身极低风险(公开元数据),但**别拿运营账号猛刷**——怕连累 bot 主业,不是怕封。 |
| 30 | - **最佳实践**:爬取用**专门的研究账号**,和发帖运营账号分开。限流是临时的、会自己恢复,但节奏要压住。 |
| 31 | |
| 32 | ## 流程 |
| 33 | |
| 34 | ### 1. 圈定社区宇宙(六维枚举) |
| 35 | 沿六维枚举相关 sub:①产品线→活动 ②相机/设备系统 ③题材/用途 ④创作者平台/变现 ⑤邻接生活方式 ⑥购买决策枢纽。**自家品牌相关 + 竞品相关都要**。扩到"新增 sub 不再冒高价值"为止(饱和)。 |
| 36 | |
| 37 | ### 2. 拉高赞帖 + 打契合分(走 MCP,安全) |
| 38 | 每 sub `get_subreddit_top_posts(time="month"/"all", limit=20~50)`。逐帖学:标题格式/钩子/帖型(text/link/image/gallery)/分数。**找共性**:什么内容在这个社区能火?挑评论最多的几帖 `get_post_comments` 看高赞评论。用 agnes 免费模型做批量粗加工(逐帖 map + 合并 reduce,别一次喂大块——小模型会漏)。产出每 sub:brand-fit 1-5 + 爆款规律 + 社区画像。 |
| 39 | |
| 40 | ### 3. 爬规则原文(走登录态 Chrome,慢速) |
| 41 | `python3 scripts/fetch_rules_via_server.py`(改 PRIORITY 列表)。抽每 sub:自我推广政策 / 链接政策(禁不禁 affiliate·referral·短链·跟踪参数) / 品牌关联条款原文 / 品牌提及允许度 / 置信度(抓到原文=高,只行为证据=低)。**抓不到就标"未核实-需人工登录补抄",绝不编造。** |
| 42 | |
| 43 | ### 4. 品牌实况(规则 vs 实践的落差) |
| 44 | 在高赞帖里看:品牌实际怎么被提及(帖里/评论里/正负中)?链接谁在发、链到哪、有没有披露?竞品对比帖社区反应(高赞还是被喷)?**落差往往才是真空间**——有些 sub 写得严但品牌在高赞帖里自然存活,靠的是"有机+有用+透明"。 |
| 45 | |
| 46 | ### 5. 产出逐社区政策矩阵 |
| 47 | 每 sub 一行:社区 | 自我推广政策 | 链接政策 | 品牌提及允许度 | 实测:品牌怎么出现 | 实测:链接怎么用 | **披露要求** | **净结论:关联创作者能不能提/怎么提**。附三条判定规则(何时发链接 / 何时必披露 / 绝不做=关联黑竞品)。 |
| 48 | |
| 49 | ## 用 ultracode 编排(可选) |
| 50 | 量大时:phase1 并行拉高赞帖+画像(每 agent 几个 sub,走 MCP),phase2 合成矩阵。**并发压到 ≤2-3**,避免服务端瞬时限流(实测 6-7 agent 齐发会被限)。 |
| 51 | |
| 52 | ## 成品范例 |