Website Analysis(网站深度分析)
Overview
对任意网站进行五维度的深度拆解并输出 HTML 交互式分析报告:
- 基本情况 — 域名 Whois(注册商、创建时间、到期时间、域名年龄、注册人组织)、所属国家/地区、运营公司、开发者/团队信息、基础流量概览
- 技术分析 — 前端框架、部署/CDN、AI 模型、功能矩阵、技术壁垒评估
- 运营分析 — 流量规模、来源分布、Top 关键词、地理分布、用户粘性指标
- 营收预测 — 定价模型、三档情景测算(保守/基准/乐观)、成本结构与利润率
- 竞争格局 — 竞品对比、SWOT、市场背景与风险
工作流
按以下 6 个阶段顺序执行,每阶段产出的数据在最终报告中汇总。
阶段 0:域名与基础信息
- 从用户输入中提取目标域名(去除协议前缀与路径,例如
https://example.com/page→example.com)。 - 通过 RDAP API(免 Key)查询 Whois 信息:
(rdap.org 会自动路由到对应注册局;失败时可用https://rdap.org/domain/{domain}https://rdap.verisign.com/com/v1/domain/{domain}对 .com 域名重试) - 提取字段:注册商(registrar)、创建日期(events→registration)、到期日期、注册人组织/国家(如果公开)、状态(status)。
- 计算域名年龄 = 当前年份 − 创建年份。域名年龄影响 SEO 信任度判断。
- 注意:GDPR 后多数域名注册人信息脱敏,注册人组织通常不可见——如缺失则如实标注,不要编造。
- 归属信息采集(强制):通过以下渠道尽可能搜集网站的归属信息,填入基本信息表:
- Whois 注册人组织/国家:阶段 0 已获取,若有则直接使用。
- 网站页面:WebFetch 抓取首页及
/about、/about-us、/company、/team等路径,提取公司名称、团队/开发者信息、办公地点。 - 隐私政策/服务条款:尝试抓取
/privacy、/terms页面,通常包含公司法定名称及注册地。 - WebSearch 搜索:搜索
{domain} company、{domain} who owns、{domain} developer team,交叉验证。 - 第三方企业库:搜索
{domain} crunchbase、{domain} linkedin company获取公司信息。 - 需采集的字段:所属国家/地区、运营公司(法定名称或品牌主体)、开发者/创始团队(如有)。
- 如果多渠道均无法获取某字段,如实标注"未公开",不要编造。
- 如果不同来源信息有冲突,以官方页面(about/terms)为准,并注明来源。
阶段 1:技术栈分析
- 用 WebFetch 抓取目标网站首页,提取:
- 页面标题、meta description、SEO 关键词(判断 SEO 策略)
- 功能特性列表(判断产品功能矩阵)
- 定价页信息(
/pricing路径优先尝试) - 页面结构暗示(是否 SPA、是否 SSR)
- 结合以下线索推断技术栈(标注"推断"而非"确认"):
- CDN/部署:查看响应头中的
server、cf-ray(Cloudflare)、x-vercel(Vercel)等 - 前端框架:Next.js(
__NEXT_DATA__)、Nuxt(__NUXT__)、React SPA 等特征 - 样式:Tailwind(类名特征)、Bootstrap 等
- 分析工具:GA4、Plausible、Cloudflare Analytics 等
- CDN/部署:查看响应头中的
- 如需更精确,可用 WebSearch 搜索
{domain} builtwith technology stack或{domain} stackshare。 - 产品功能矩阵:整理网站提供的所有功能及各自定价档位(如积分/次数)。
阶段 2:运营数据采集
关键约束:没有第一方数据(Google Analytics),必须依赖第三方流量估算平台。多个平台数据差异可能很大(可差几十倍),必须交叉引用并标注数据来源与时间窗口,不要只采单一来源。
- 依次查询以下第三方平台(用 WebSearch 或 WebFetch):
creati.ai/ai-tools/{domain}(数据较全:月访问、跳出率、页/次、停留、来源、地理、关键词)aitrustlist.com/ai/{domain}或aitrustlist.com/ai/background-remove风格页面(需搜索)mossai.org/ai/{domain}/analyze- 搜索
{domain} traffic monthly visits similarweb寻找其他估算
- 提取指标:月访问量、跳出率、人均页面数、平均停留时长、流量来源占比(自然搜索/直接/引荐/社媒/付费)、Top 国家、Top 关键词及 CPC。
- 数据可信度处理:
- 多平台一致的结构性判断(如"自然搜索为主")→ 高可信,可直接写入结论
- 绝对值差异大 → 报告中选择数据最全、时间窗口最新的平台为主数据源,其余列作对照区间
- 数据明显异常(如低到 2K 与其他平台差百倍)→ 标注为异常值,不采用
- 在报告中必须注明:数据来自哪些平台、时间窗口、是第三方估算非官方数据。
阶段 3:市场与竞品
- WebSearch 获取目标品类的市场数据:
{品类} market size 2025 CAGR forecast。 - 竞品基准:搜索该品类的头部玩家,重点找:
- 各竞品的用户规模(月活/注册用户)
- 营收规模(公开披露或第三方估算)
- 定价模式(订阅/积分/按次)
- 融资或收购事件(判断市场热度)
- 行业标准转化率、ARPU 等基准存入
references/revenue-model.md对照使用。
阶段 4:营收预测
使用三档情景测算模型(详细方法见 references/revenue-model.md):
- 保守:低转化率 × 低 ARPU
- 基准:中转化率 × 中 ARPU
- 乐观:高转化率 × 高 ARPU
关键输入:
- 月访问量(阶段 2 主数据)
- 免费→付费转化率(行业基准 1.5%–4%,工具型网站取 2-3%)
- 月付费用户数 = 月访问量 × 转化率
- ARPU(按定价模式估算:订阅制 $8-15/月,积分制按客单价折算)
- 年化收入 = 月收入 × 12
成本结构估算(占比如下,按实际调整):
- AI 推理/算力:30-40%
- CDN/带宽:5-10%
- 人力(2-4 人):40-50%
- 支付手续费:收入 3-5%
- 其他:5%
阶段 5:生成 HTML 报告
使用 assets/report-template.html 作为模板,替换为目标网站数据。报告结构固定为:
- 执行摘要 — 4 个关键指标卡(月访问/自然搜索占比/预估年收入/市场增速)
- 域名与基本信息 — Whois 表格 + 归属信息(所属国家/地区、运营公司、开发者/团队)+ 域名年龄判断
- 技术分析 — 技术栈表格 + 功能矩阵 + 技术洞察框
- 运营分析 — 流量指标卡 + 流量来源饼图 + 关键词表 + 地理分布柱状图
- 营收预测 — 定价对比表 + 三档测算柱状图 + 成本结构 + 利润率评估
- 竞争格局 — 竞品对比表 + SWOT 四象限
- 市场背景 — 市场规模趋势线图 + 数据来源表
- 结论与判断 — 评分 + 风险 + 最终判断
图表用 Chart.js(CDN: cdnjs.cloudflare.com/ajax/libs/Chart.js/4.4.1/chart.umd.js),全部使用硬编码十六进制颜色(canvas 无法解析 CSS 变量)。每张 canvas 必须有 role="img" 和 aria-label。
技术洞察框(insight-box)使用以下语义色:
- 蓝色边框(
#0f3460)= 中性洞察 - 绿色边框(
#2e7d32)= 优势/亮点 - 橙色边框(
#e65100)= 风险/警告
输出要求
- 语言要求(强制):每次分析完成后,必须使用简体中文输出全部结果,包括但不限于:HTML 报告中的所有文案(标题、表格、洞察分析、结论判断等)、对话中向用户汇报的分析摘要、以及所有中间分析过程的文字描述。即使目标网站是英文站点,报告内容也必须用简体中文撰写(专有名词、技术术语、品牌名等可保留原文)。
- 生成 HTML 文件到工作区,文件名如
{domain}-analysis.html - 使用 present_files 展示报告
- 报告中数据来源(第三方平台名 + 时间窗口)必须透明标注
- 营收预测必须注明"为区间估算,不构成投资建议"
- 无法获取的数据如实标注"数据未公开/无法获取",不要编造
资源
references/
data-sources.md— 全部数据源清单(WHOIS/RDAP、流量估算平台、技术栈检测、市场报告)revenue-model.md— 营收测算方法论、行业转化率/ARPU/成本基准
assets/
report-template.html— 可直接复用的 HTML 报告模板(含全部 Chart.js 图表骨架)
scripts/
(本技能无需脚本,所有操作为搜索/抓取/分析流程)
微信扫一扫