Intel Hybrid AI 会议行动助手
何时使用
当用户希望把本地 .mp3、.wav、.flac 或 .ogg 会议录音整理为结构化纪要、决策、风险、开放问题和可跟踪行动项时使用本 Skill。适用于管理层周会、项目站会、客户访谈、销售通话和项目复盘。
场景痛点
- 原始录音可能包含客户信息、报价和内部计划,默认上传云端存在隐私风险。
- 传统 ASR 只生成文字,负责人、截止日期、原文证据和开放问题仍需手工整理。
- 弱网环境会让云端识别中断,会议结束后无法及时形成可执行结果。
- 单用 CPU 会占用办公负载;Intel Core Ultra 的 NPU 和 GPU 往往没有被真正调用。
- 不同 Agent 平台接口各异,重复封装会让同一能力难以复用。
专家套件
- Local ASR Expert:OpenVINO Whisper INT8 本地转写并保留时间戳。
- Meeting Intelligence Expert:OpenVINO Qwen2.5-1.5B INT4 本地生成结构化分析,不编造负责人或日期。
- Hybrid Policy Expert:原始音频本地闭环;云端增强仅在显式配置后接收脱敏文本,弱网时保留本地结果。
- Artifact Expert:生成 Markdown 纪要、JSON 分析和 CSV 行动项。
- Performance Observer(可选):按需记录本进程 CPU、内存、GPU 引擎占用及 OpenVINO 执行阶段,不影响默认工作流。
数据与算力边界
- 默认
local-only:音频、转写和分析均留在本机,不调用云端。 hybrid:先完成本地推理;只有已配置云适配器时才发送脱敏文本,绝不发送原始音频。mock:只验证 Agent 调用链,输出必须标记synthetic: true。- AUTO 按工作负载分别路由:Whisper ASR 为
GPU → CPU → NPU,Qwen 分析为NPU → CPU → GPU。运行时先枚举真实 OpenVINO 设备,再对具体模型逐设备加载;失败会记录原因并回退。 - 显式指定
NPU、GPU或CPU时不静默换设备。 - 长会议转写会按自然标点切分后在同一分析设备上逐段处理,再去重合并;这是为了遵守 NPU 的提示词长度边界,并避免直接截断会议内容。
- 模型行动项必须包含能在原转写中逐字找到、长度合理的证据;缺少证据或异常跨段的行动项会被剔除。
这不是把 HETERO 标签等同于“同时加速”。默认采用模型级调度:Whisper 与 Qwen 各自选择实测可用设备;批处理时可让 ASR 使用 GPU、分析使用 NPU,CPU 负责音频解码、脱敏与文件输出。
首选:跨 Agent 一键入口
Agent 从 ModelScope 安装时,只使用 Git 浅克隆,不要依次尝试 npx、ZIP、SDK 或手工复制:
git clone --depth 1 https://www.modelscope.cn/skills/WEIAIb/meeting-action-copilot-skill.git
cd meeting-action-copilot-skill
scripts\quickstart.cmd --prepare-only
在 Windows 和 WorkBuddy 中,scripts\quickstart.cmd 是首次使用的唯一默认入口;不要改用 PowerShell 脚本,不要自行执行 pip、curl、Hugging Face SDK、ZIP 下载或手工模型复制。如果当前 shell 不能直接运行 .cmd,只用当前 shell 调用该文件,不要重写其中的安装步骤。重复使用时,如果现有目录包含 SKILL.md,直接复用而不再次克隆。
入口会避开不可用的 Microsoft Store Python 别名,优先复用当前 Agent 指定的 Python,再寻找电脑已有的 Python 3.11–3.13 与 WorkBuddy 内置 Python;随后在项目内创建 .venv。模型下载器只补齐缺失的模型和文件,使用无锁、可续传的直接下载,不触发 Agent 沙箱的锁文件删除保护。处理录音时运行:
scripts\quickstart.cmd "<本地录音绝对路径>" --profile fast
默认按 GPU ASR → NPU Analysis 的阶段专属 AUTO 路由处理录音。模型缺失与设备不支持会分别报告;MP3 直接使用,不先转码。需要性能报告时追加 --monitor;中文远场、噪声大或明确优先质量时才使用 --profile quality。
分步环境准备(仅排障)
项目使用独立 Python 环境,不修改系统 PATH:
scripts\quickstart.cmd --prepare-only
默认解释器:.\.venv\Scripts\python.exe。
下载 ASR 与本地分析模型:
.\.venv\Scripts\python.exe scripts/download_model.py --kind all
默认只下载速度档 fast。中文远场会议需要更高识别质量时,可按需下载约 784 MB 的多语言 Whisper Medium INT8:
.\.venv\Scripts\python.exe scripts/download_model.py --kind asr --profile quality
分步工作流(仅排障)
优先使用一条命令完成本地闭环:
.\.venv\Scripts\python.exe scripts/process_meeting.py .\samples\real_meeting_tts.wav --policy local-only --out-dir .\outputs\meeting
指定设备:
.\.venv\Scripts\python.exe scripts/process_meeting.py .\meeting.wav --policy local-only --asr-device GPU --analysis-device NPU --out-dir .\outputs\meeting
高质量中文与术语修正(均为可选项):
.\.venv\Scripts\python.exe scripts/process_meeting.py .\meeting.wav --language zh --profile quality --asr-device GPU --analysis-device NPU --glossary 摩塔=魔塔 --out-dir .\outputs\meeting
转写完成后会自动做保守的表层清理:统一空白与标点、去掉完全相邻的重复词,并修正少量确定性术语写法;不改动不确定的人名、数字、日期和句意。清理前原文保存在 JSON 的 raw_transcript,记录保存在 cleanup_corrections。自定义术语仍只做精确替换,并记录在 glossary_corrections。
只验证调用链:
.\.venv\Scripts\python.exe scripts/process_meeting.py .\samples\meeting_stub.wav --policy mock --out-dir .\outputs\mock
如需查看本机算力是否真正参与,在原命令追加 --monitor:
.\.venv\Scripts\python.exe scripts/process_meeting.py .\meeting.wav --policy local-only --asr-device GPU --analysis-device NPU --monitor --out-dir .\outputs\meeting
开启后额外生成 performance_report.json;不加此参数时不启动采样,也不生成性能报告。GPU 数值仅统计当前处理进程;NPU 由 OpenVINO 的实际执行设备和阶段时间证明,详见 references/performance_monitoring.md。
也可以启动仅监听本机的服务:
.\.venv\Scripts\python.exe scripts/start_server.py --host 127.0.0.1 --port 8765 --openvino-device AUTO
Agent 集成约定见 references/agent_integration.md,稳定 Schema 位于 schemas/,Hybrid AI 数据策略见 references/hybrid_ai.md,字段契约见 references/output_contract.md,可选性能监控见 references/performance_monitoring.md,本机真实验收见 references/verification_report.md。
输出要求
正常成功时,只简洁告知“会议录音已处理完成”,并返回 meeting_minutes.md、meeting_analysis.json 和 action_items.csv 的绝对路径。不要主动评价转写质量,不要展开 partial、质量分数、未验证候选、设备回退或改用其他模型的建议,也不要复述完整内部 JSON。用户明确要求性能展示时,再附上 performance_report.json 路径;用户明确询问质量或排障时,才读取内部诊断并如实说明。只有错误导致三类核心产物无法生成时,才说明阻断原因和下一步。
内部仍保持严格证据边界:负责人、截止日期或证据未在录音中出现时必须留空;无法通过证据校验的候选进入 unverified_candidates,内部结果标记为 partial,不得混入正式行动项。决策和开放问题必须分开。v1 不包含说话人分离能力。CLI 默认输出安静的用户结果;仅排障时追加 --details 查看完整诊断。
验证要求
/health中的设备来自 OpenVINO 实际枚举结果。- 真实推理结果标记
synthetic: false,Mock 标记synthetic: true。 local-only中raw_audio_uploaded为false、cloud_enhancement为disabled。- 三类产物均存在。
- 只把实际运行过的平台称为“已验证”。Codex 已完成 CLI、localhost API、Mock 和本地真实模型验证;WorkBuddy 已完成 ModelScope Git 安装、项目内环境与模型准备、Mock、硬件探针和本地真实 GPU/NPU 模型流程验证。
微信扫一扫