audio-translate
Build, install, and run an English audio transcription + translation tool using OpenVINO models (distil-whisper for ASR, HY-MT1.5 for translation). Use when the user wants to set up or use the transcr…
Browse curated skills with source links, package snapshots, README assets and install signals in one calm, searchable catalog.
Build, install, and run an English audio transcription + translation tool using OpenVINO models (distil-whisper for ASR, HY-MT1.5 for translation). Use when the user wants to set up or use the transcr…
remotion-tts-video-pipeline
在 Intel AI PC 本地使用 OpenVINO 转写音视频,生成带时间码逐字稿、SRT 字幕、章节和结构化 JSON。源媒体无需上传云端,可被 Qoder、WorkBuddy、TRAE Work 等生产力 Agent 稳定调用,适合采访、播客、课程、会议和创作者素材整理。
将复杂内容(文章、观点、知识)分解为1~10张小红书图文(封面+内容+结尾),自动分析内容类型、钩子、受众、互动潜力,并适配最佳视觉风格。Use when the user asks for 小红书图片、小红书笔记、图文生成、小红书图文、配图生成、小红书封面。
基于 PaddleOCR + Qwen3-VL-4B (OpenVINO) 的本地 AI 营销海报合规审核 Skill。自动检测广告法违规风险(绝对化用语、虚假宣传、行业禁用词等),生成结构化审核报告。所有推理在本地 Intel CPU 上完成,数据不出设备。
剧本视觉资产提取器 — 多阶段工作流编排器
短视频/影视剪辑中,需要音乐转场
睿小鉴AI检测智能体是首家面向C端用户的AI鉴伪智能体。它以统一入口承载图片、文本、音频、视频等全模态内容的一站式鉴伪检测能力,支持 AI 生成内容检测、PS 篡改检测、深度伪造识别与可解释性报告生成,并通过多轮深度对话帮助用户理解检测结论与判断依据。 产品网址:https://agent.ruijianai.com/?from=extension-modelscope
基于 python 的视频高速本地下载 skill,安装后根据指示完成环境配置后,提供视频链接 URL 即可保存 mp4 文件到本地。基本实现所见即所得,支持读取浏览器 cookiee 以应对网站本身拦截。
本地音视频智能索引 Skill。支持麦克风/摄像头实时采集和音频视频文件导入,基于 OpenVINO 端侧推理实现 VAD + ASR + LLM 双路径流水线,输出实时字幕和结构化总结(摘要、关键词、时间线、待办事项),数据全程不出设备。当用户需要本地音视频转录、会议记录、课程笔记、采访整理等场景时使用。
给中文新手的一条真人口播成片包装 Skill:默认保留原声、生成严格同步字幕,并强制避免 UI 遮挡人物脸部、眼镜、嘴部、发际线和关键手势。优先使用 HyperFrames,必要时切换 Remotion,并在交付前检查成片音视频与可解码性。
根据音乐、歌词、参考图、角色、情绪和发布平台,制作带歌词贴字的风格化音乐视频或情绪短片。先分析节拍与人声时序,区分人物、场景和文字参考,设计随节奏变化的空间字幕,再把长内容拆成连续镜头,默认用 H3 批量生成,并围绕同一主音轨完成拼接。交付创意、分镜提示词、歌词方案与成片;不用于普通字幕校对、照搬现有版权形象或纯手工剪辑。
当用户提到邮箱相关能力时,进入这个skill,统一邮件入口(纯路由层):识别用户意图后路由到 public-skill 或 imap-smtp-email,自身不执行任何脚本
核心功能:视频内容智能解析与多场景内容生成 一、核心处理能力 智能视频摘要:输入B站、抖音、小红书、YouTube等平台视频链接或本地视频文件,自动提取音频并转写文字,通过大模型生成结构化的【标题】+【200字摘要】+【3-5条核心要点】,将2小时视频压缩为3分钟阅读。 双引擎转写架构:主引擎使用通义听悟(Paraformer)实现高精度语音转写,支持时间戳输出;当云端服务不可用时,自动降级至本地…
用 PaddleOCR 云端 API 将 PDF 转为结构化 Markdown,自动检测 PDF 类型选择最优模型(文字版走 PP-StructureV3,扫描件走 PaddleOCR-VL-1.6),支持表格、公式、图表识别,自动切分超长文件,每天 2000 页免费额度。
对图片进行智能压缩优化。支持本地路径、文件夹和远程 URL,直传 NX API 压缩后返回 CDN 地址和压缩率。适用于用户提到图片压缩、图片优化、减小图片体积、TinyPNG、JPG/PNG/BMP/WebP/TGA 压缩的场景。
技能介绍:上传个人照片,AI一键生成简约高级的职场IM头像,风格干净商务、无网红浮夸质感。建议优先选择平台内置参数,出图效果更统一稳定。支持多维度搭配: 背景:经典浅灰、无缝纯白 服装:精英西装、黑色polo、灰色T恤、极简圆领白 适配各类办公社交场景,快速打造专业、靠谱的职场个人形象。 使用场景:- 替换企业微信、钉钉、飞书等办公软件头像 - 销售、商务、职场博主打造专属专业头像 - 团队统一…
面向生产力 Agent 的本地文档脱敏与隐私泄漏复检。用户要求对 Word(.docx)、PowerPoint(.pptx)、PDF、TXT 或一批办公文档进行“脱敏、打码、匿名化、隐藏隐私、外发前检查、去掉姓名/手机号/身份证/银行卡/地址”等处理时使用。通过规则、可选 localhost LLM 和本地 OCR 识别文本与图片;OCR 优先 OpenVINO,没有 OpenVINO 时自动回退…
Use when user uploads an image and wants to generate a structured prompt template and concrete prompt case from it. Triggers on image uploads with requests like "根据这张图生成 prompt", "reverse engineer thi…
Stop LLM slop. A curated system prompt that cuts verbose, corporate-sounding LLM output by 56-71% (measured) while preserving information. Works bilingually (English + Chinese). Installs into your AGE…
Lightweight AI writing decontaminator. Detects and fixes the most common AI-generated writing patterns in one pass. Covers: inflated language, AI vocabulary, structural cliches, filler, and sycophancy…
爱奇艺视频内容 Skill 的无登录版 MVP。用于处理爱奇艺内容搜索、片库筛选、实体详情、榜单/热门推荐、qips 播放与播控、客户端安装检测、客户端下载链接和无客户端 H5 播放降级;不处理账号绑定、登录态、会员状态真实查询、个性化推荐闭环、新 native 指令或后端新接口。
搜索B站游戏视频,获取播放地址,并使用AI大模型对视频内容进行智能总结
一键抓取每日最新咨询,解决大量找资料的时间,ai职场打工人,新媒体牛马人的引路神灯