抖音评论数据自动洞察
把评论原文和互动字段转成带样本证据的需求、口碑与内容反馈报告。
执行流程
- 确认作品范围、时间窗、评论层级、目标条数、排序方式、品牌/竞品词和是否需要回复建议。
- 优先使用已配置的评论连接器或官方 API;其次使用用户已登录页面;再其次读取用户导出的评论文件。不得绕过验证码、登录限制或批量抓取限制。
- 采集评论 ID、作品 ID、评论原文、发布时间、点赞数、回复数、作者公开标识、父评论 ID 和来源。
- 按评论 ID 去重;无 ID 时使用规范化文本、作品 ID、时间和作者公开标识组合,并降低去重置信度。
- 清洗空白、表情和重复灌水,但保留原文证据。广告、刷屏、无语义表情和疑似机器人内容单独标记,不静默删除。
- 分类情绪、需求、痛点、购买意向、售后问题、竞品提及、谣言/风险和内容建议。低置信度样本进入待复核,不强制归类。
- 结合评论点赞、回复和主题频次排序高价值信号;不得只按情绪强度排序。
- 输出主题证据、代表评论的短摘录、优先级和建议动作。需要回复时只生成草稿,未经用户明确授权不得发布。
- 验收样本量、楼层覆盖、时间范围、重复率、语言分布、分类置信度和来源可回溯性。
输出合同
样本概览:作品、时间窗、评论层级、采集数、去重数、数据源和采集时间。主题分布:主题、样本数、占比、互动权重、代表证据和置信度。需求与痛点:用户场景、期望、障碍、影响人群和建议验证方式。竞品与口碑:竞品提及、比较维度、正负向证据和风险边界。高价值评论:评论 ID、短摘录、点赞/回复、所属主题和处理优先级。行动清单:产品、客服、内容、舆情分别负责的下一步;回复仅为草稿。
质量门槛
- 不公开用户名、头像、主页或其他不必要的个人标识;报告默认使用匿名样本编号。
- 不把讽刺、反问或方言强制判为确定情绪;低置信度必须标记。
- 主题占比使用去重后的有效评论数作分母,并写明广告/空评论处理方式。
- 代表评论只做必要短摘录,不复制大量第三方内容。
- 采集范围受分页、登录或接口限制时,明确写样本边界,不声称全量舆情。
字段与分类
需要评论字段、分类标签和优先级公式时,读取 references/field-contract.md。
微信扫一扫