返回 Skill 列表
extension
分类: 数据与分析无需 API Key

网站分析

深度分析任意网站的全面报告生成器。本技能应用于用户要求"分析某网站/某网址的技术、运营、营收"、"评估这个网站值多少钱/赚多少钱"、"网站用的什么技术栈"、"查看某域名的 Whois 信息和流量"等场景。技能会采集网站基本信息(域名 Whois、注册信息、流量数据),分析技术栈、运营策略(流量来源/关键词/地理分布/用户粘性),结合市场规模与竞品基准预测营收,并输出一份带交互图表的 HTML 分析报告。触发词:网站分析、网站技术、营收预测、网站运营、domain analysis、website teardown、site review。

person作者: user_88f5a0e7hubcommunity

Website Analysis(网站深度分析)

Overview

对任意网站进行五维度的深度拆解并输出 HTML 交互式分析报告:

  1. 基本情况 — 域名 Whois(注册商、创建时间、到期时间、域名年龄、注册人组织)、所属国家/地区、运营公司、开发者/团队信息、基础流量概览
  2. 技术分析 — 前端框架、部署/CDN、AI 模型、功能矩阵、技术壁垒评估
  3. 运营分析 — 流量规模、来源分布、Top 关键词、地理分布、用户粘性指标
  4. 营收预测 — 定价模型、三档情景测算(保守/基准/乐观)、成本结构与利润率
  5. 竞争格局 — 竞品对比、SWOT、市场背景与风险

工作流

按以下 6 个阶段顺序执行,每阶段产出的数据在最终报告中汇总。

阶段 0:域名与基础信息

  1. 从用户输入中提取目标域名(去除协议前缀与路径,例如 https://example.com/pageexample.com)。
  2. 通过 RDAP API(免 Key)查询 Whois 信息:
    https://rdap.org/domain/{domain}
    
    (rdap.org 会自动路由到对应注册局;失败时可用 https://rdap.verisign.com/com/v1/domain/{domain} 对 .com 域名重试)
  3. 提取字段:注册商(registrar)、创建日期(events→registration)、到期日期、注册人组织/国家(如果公开)、状态(status)。
  4. 计算域名年龄 = 当前年份 − 创建年份。域名年龄影响 SEO 信任度判断。
  5. 注意:GDPR 后多数域名注册人信息脱敏,注册人组织通常不可见——如缺失则如实标注,不要编造。
  6. 归属信息采集(强制):通过以下渠道尽可能搜集网站的归属信息,填入基本信息表:
    • Whois 注册人组织/国家:阶段 0 已获取,若有则直接使用。
    • 网站页面:WebFetch 抓取首页及 /about/about-us/company/team 等路径,提取公司名称、团队/开发者信息、办公地点。
    • 隐私政策/服务条款:尝试抓取 /privacy/terms 页面,通常包含公司法定名称及注册地。
    • WebSearch 搜索:搜索 {domain} company{domain} who owns{domain} developer team,交叉验证。
    • 第三方企业库:搜索 {domain} crunchbase{domain} linkedin company 获取公司信息。
    • 需采集的字段:所属国家/地区运营公司(法定名称或品牌主体)、开发者/创始团队(如有)。
    • 如果多渠道均无法获取某字段,如实标注"未公开",不要编造。
    • 如果不同来源信息有冲突,以官方页面(about/terms)为准,并注明来源。

阶段 1:技术栈分析

  1. 用 WebFetch 抓取目标网站首页,提取:
    • 页面标题、meta description、SEO 关键词(判断 SEO 策略)
    • 功能特性列表(判断产品功能矩阵)
    • 定价页信息(/pricing 路径优先尝试)
    • 页面结构暗示(是否 SPA、是否 SSR)
  2. 结合以下线索推断技术栈(标注"推断"而非"确认"):
    • CDN/部署:查看响应头中的 servercf-ray(Cloudflare)、x-vercel(Vercel)等
    • 前端框架:Next.js(__NEXT_DATA__)、Nuxt(__NUXT__)、React SPA 等特征
    • 样式:Tailwind(类名特征)、Bootstrap 等
    • 分析工具:GA4、Plausible、Cloudflare Analytics 等
  3. 如需更精确,可用 WebSearch 搜索 {domain} builtwith technology stack{domain} stackshare
  4. 产品功能矩阵:整理网站提供的所有功能及各自定价档位(如积分/次数)。

阶段 2:运营数据采集

关键约束:没有第一方数据(Google Analytics),必须依赖第三方流量估算平台。多个平台数据差异可能很大(可差几十倍),必须交叉引用并标注数据来源与时间窗口,不要只采单一来源。

  1. 依次查询以下第三方平台(用 WebSearch 或 WebFetch):
    • creati.ai/ai-tools/{domain}(数据较全:月访问、跳出率、页/次、停留、来源、地理、关键词)
    • aitrustlist.com/ai/{domain}aitrustlist.com/ai/background-remove 风格页面(需搜索)
    • mossai.org/ai/{domain}/analyze
    • 搜索 {domain} traffic monthly visits similarweb 寻找其他估算
  2. 提取指标:月访问量、跳出率、人均页面数、平均停留时长、流量来源占比(自然搜索/直接/引荐/社媒/付费)、Top 国家、Top 关键词及 CPC
  3. 数据可信度处理:
    • 多平台一致的结构性判断(如"自然搜索为主")→ 高可信,可直接写入结论
    • 绝对值差异大 → 报告中选择数据最全、时间窗口最新的平台为主数据源,其余列作对照区间
    • 数据明显异常(如低到 2K 与其他平台差百倍)→ 标注为异常值,不采用
  4. 在报告中必须注明:数据来自哪些平台、时间窗口、是第三方估算非官方数据。

阶段 3:市场与竞品

  1. WebSearch 获取目标品类的市场数据:{品类} market size 2025 CAGR forecast
  2. 竞品基准:搜索该品类的头部玩家,重点找:
    • 各竞品的用户规模(月活/注册用户)
    • 营收规模(公开披露或第三方估算)
    • 定价模式(订阅/积分/按次)
    • 融资或收购事件(判断市场热度)
  3. 行业标准转化率、ARPU 等基准存入 references/revenue-model.md 对照使用。

阶段 4:营收预测

使用三档情景测算模型(详细方法见 references/revenue-model.md):

  • 保守:低转化率 × 低 ARPU
  • 基准:中转化率 × 中 ARPU
  • 乐观:高转化率 × 高 ARPU

关键输入:

  • 月访问量(阶段 2 主数据)
  • 免费→付费转化率(行业基准 1.5%–4%,工具型网站取 2-3%)
  • 月付费用户数 = 月访问量 × 转化率
  • ARPU(按定价模式估算:订阅制 $8-15/月,积分制按客单价折算)
  • 年化收入 = 月收入 × 12

成本结构估算(占比如下,按实际调整):

  • AI 推理/算力:30-40%
  • CDN/带宽:5-10%
  • 人力(2-4 人):40-50%
  • 支付手续费:收入 3-5%
  • 其他:5%

阶段 5:生成 HTML 报告

使用 assets/report-template.html 作为模板,替换为目标网站数据。报告结构固定为:

  1. 执行摘要 — 4 个关键指标卡(月访问/自然搜索占比/预估年收入/市场增速)
  2. 域名与基本信息 — Whois 表格 + 归属信息(所属国家/地区、运营公司、开发者/团队)+ 域名年龄判断
  3. 技术分析 — 技术栈表格 + 功能矩阵 + 技术洞察框
  4. 运营分析 — 流量指标卡 + 流量来源饼图 + 关键词表 + 地理分布柱状图
  5. 营收预测 — 定价对比表 + 三档测算柱状图 + 成本结构 + 利润率评估
  6. 竞争格局 — 竞品对比表 + SWOT 四象限
  7. 市场背景 — 市场规模趋势线图 + 数据来源表
  8. 结论与判断 — 评分 + 风险 + 最终判断

图表用 Chart.js(CDN: cdnjs.cloudflare.com/ajax/libs/Chart.js/4.4.1/chart.umd.js),全部使用硬编码十六进制颜色(canvas 无法解析 CSS 变量)。每张 canvas 必须有 role="img"aria-label

技术洞察框(insight-box)使用以下语义色:

  • 蓝色边框(#0f3460)= 中性洞察
  • 绿色边框(#2e7d32)= 优势/亮点
  • 橙色边框(#e65100)= 风险/警告

输出要求

  • 语言要求(强制):每次分析完成后,必须使用简体中文输出全部结果,包括但不限于:HTML 报告中的所有文案(标题、表格、洞察分析、结论判断等)、对话中向用户汇报的分析摘要、以及所有中间分析过程的文字描述。即使目标网站是英文站点,报告内容也必须用简体中文撰写(专有名词、技术术语、品牌名等可保留原文)。
  • 生成 HTML 文件到工作区,文件名如 {domain}-analysis.html
  • 使用 present_files 展示报告
  • 报告中数据来源(第三方平台名 + 时间窗口)必须透明标注
  • 营收预测必须注明"为区间估算,不构成投资建议"
  • 无法获取的数据如实标注"数据未公开/无法获取",不要编造

资源

references/

  • data-sources.md — 全部数据源清单(WHOIS/RDAP、流量估算平台、技术栈检测、市场报告)
  • revenue-model.md — 营收测算方法论、行业转化率/ARPU/成本基准

assets/

  • report-template.html — 可直接复用的 HTML 报告模板(含全部 Chart.js 图表骨架)

scripts/

(本技能无需脚本,所有操作为搜索/抓取/分析流程)