返回 Skill 列表
extension
分类: 数据与分析无需 API Key

AI日报

采用新闻源白名单直抓(免费、无需密钥)+ 免费联网搜索补搜,经交叉验证、信源审查、溯源排重、四维评分后,按板块渲染 md / 统计 / HTML 三文件。内容板块:大模型、算力、机器人、应用、政策、一级市场六大板块。 采集层零付费依赖,可整体移植到任意支持运行 Python 与联网搜索的 agent。

person作者: user_7f91090dhubcommunity

阿信AI日报

每日产出标准化 AI 行业日报。流程:白名单 RSS 直抓(免费、无密钥)+ 宿主免费联网搜索补搜 → 交叉验证、信源审查、溯源排重、四维评分 → 按七大板块渲染三文件。

配置依赖(宿主环境提供)

| 能力 | 说明 | 必需性 | |------|------|--------| | Python 3.8+ | 仅标准库;运行 references/collect.pyrender.py | 必需 | | 免费联网搜索 | 宿主内置 WebSearch 工具,或宿主提供的免费搜索 skill。不绑定任何付费搜索 API | 仅补搜步骤必需 | | RSS 出网 | collect.py rss 抓取公开 RSS,无需密钥 | 必需 |

若宿主无任何免费搜索能力,补搜步骤无法执行;可改由宿主直接提供搜索结果,不影响 RSS 直抓与渲染。

职责边界

  • 只负责内容生产:采集、撰写、渲染三文件(md / 统计 / HTML)。
  • 不推送飞书、不部署网站、不调用云账号。分发由上层编排 daily-news-build-deploy 完成。

数据铁律

  1. 时效:仅收近 24h 内发布内容(以报道发布时间为准),超时丢弃。
  2. 交叉验证:每条 ≥2 独立信源;例外(仅需 1 源):学术源(arXiv / 顶会 / 机构官方)、官网一手公告(openai.com/news、anthropic.com/news、blog.google 等)。
  3. 溯源排重:用最早权威来源链接;同事件多源合并为 1 条,摘要以最早最完整信源为准。
  4. 信源审查:丢弃纯个人自媒体、营销号、论坛帖、匿名内容;保留专业媒体、官方新闻中心、学术平台、财经媒体。
  5. 禁幻觉:企业、金额、参数、日期须有素材支撑;缺失标「暂无完整公开信息」。
  6. 文风:专业客观,禁用「炸裂 / 颠覆」等营销词,禁投资建议。

工作流

1. 加载参考

references/news_sources.md(白名单 + 信源分级)、scoring_criteria.md(评分 + 验证例外)、output_template.md(模板)。

2. 白名单直抓(免费,无密钥)

python3 references/collect.py rss --hours 48 --json-out /tmp/rss_$(date +%F).json

脚本抓全部白名单 RSS,过滤近 48h 新鲜条目,输出 JSON(含每源状态:有效产出 / 无更新 / 不可达)。

宿主有 WebFetch 工具时也可直接抓各源,结果一致。

3. 缺口分析

对照七大板块检查覆盖度,列出白名单未覆盖 / 偏弱的板块,生成精准补搜关键词(中英文)。不为凑数而搜。

4. 联网补搜(宿主免费搜索)

对每个缺口板块,调用宿主免费搜索能力(内置 WebSearch 工具或免费搜索 skill),topic="news",每组同时搜中英文变体,结果并入素材池。

本步骤不依赖付费 API。若宿主只能以 API 形式提供搜索,接入免费端点(如自建 SearXNG)并在宿主环境配置后使用,skill 本身无需改动。

5. 深度抓取(可选)

对高价值条目,宿主有 WebFetch 则抓全文提取参数 / 金额 / 时间;否则用搜索摘要,不阻塞。

6–10. 研判(LLM 执行)

依次执行:24h 时效过滤 → 交叉验证(含例外)→ 信源审查 → 溯源排重 → 四维评分(产业 0.40 / 创新 0.25 / 时效 0.20 / 数据 0.15,≥60 入库)。

11. 板块归类

每条归入唯一板块(一~六),末尾标来源链接(≤2)。核心观点(七)从一~六提炼 3–5 条(≤50 字)。

12. 今日重点动态

从一~六选 4–6 条(评分最高 + 板块多样),以「标题:描述」一句话概括,置于日报顶部。

13. 渲染三文件

将研判结果整理为 items.json(schema 见 render.py 文件头),运行:

python3 references/render.py --input items.json --out outputs/ai-daily-news

产出:

  • 阿信AI日报-YYYY-MM-DD.md —— 纯日报正文
  • 信息源统计-YYYY-MM-DD.md —— 采集 / 采用统计
  • 阿信AI日报-YYYY-MM-DD.html —— 单文件可视化(内联 CSS/JS、深色模式、响应式、全局连续编号、吸顶锚点导航、人话时间)

信源统计

执行步骤 2–12 时持续记录:每白名单源采集 / 通过 / 采用数及状态;补搜轮次与过滤数;各环节淘汰数;例外收录条目。

特殊情形

  • 白名单大面积无效:如实记录,加大补搜。
  • 补搜也无果:标注「今日相关重磅资讯较少」,不编造。
  • 当日 0 条:生成空日报,观点标「暂无核心观点」。
  • 某板块无匹配:标注空缺,不凑数。
  • 交叉验证失败(单源且非例外):丢弃并计入统计。

移植说明

采集层仅依赖:①免费 RSS(collect.py,标准库)②宿主免费搜索。无付费 API、无云账号硬编码。整体复制本 skill 到任意支持 Python + 联网搜索的 agent 即可运行;上层编排接 daily-news-build-deploy 完成发布。