项目概览
本收藏条目涵盖两个面向 AI Agent 的技能工具:Narrator AI CLI Skill 与 Agent Reach。Narrator AI CLI Skill 是专为 AI Agent 设计的视频解说自动化技能文件,对应 CLI 客户端 narrator-ai-cli,封装了 Narrator AI 开放平台的完整 API,支持 Claude Code、OpenClaw、Windsurf 等主流 AI Agent 平台。其核心能力是用一句自然语言指令,自动完成从脚本生成到成片输出的全流程影视解说视频生产,内置 93 部电影素材库、146 首 BGM、63 种配音音色(覆盖 11 种语言)、90+ 解说模板,提供「改编解说」和「原创解说」两条工作路径。Agent Reach 是一个开源的 AI Agent 互联网能力脚手架,由 Panniantong 开发,作为一键安装器和配置管理器,将 15+ 个平台的内容读取能力(如 Twitter、Reddit、YouTube、B站、小红书、GitHub、微信公众号、抖音、LinkedIn、微博、V2EX、雪球、RSS 等)集成到任何 AI Agent 中,核心价值是零 API 费用、零配置门槛,所有底层工具均为开源免费的 CLI 工具,通过本地 Cookie 和抓取方式访问平台内容,数据只留在本地。
解决什么问题
影视解说行业传统制作流程高度人工密集:脚本撰写需人工观看整部电影并撰写解说文案,耗时 2-4 小时/部且质量依赖个人经验;素材匹配需手动截图、剪辑关键片段,要求熟练使用 Premiere/FCP;配音合成需录制人声或使用 TTS 工具,存在声音单调、情感不足的问题;视觉包装需手动套模板、调字幕、加特效,设计门槛高且耗时;BGM 匹配需手动选曲、调音量,存在版权风险和节奏不匹配问题。一个成熟创作者一天最多产出 1-3 条解说视频。
AI Agent 在互联网信息获取方面存在「信息孤岛」问题:读 Twitter 官方 API 昂贵($100/月起),免费版每月只读 1500 条;读 Reddit 直接 HTTP 请求会被 403 封禁;读小红书必须登录且反爬极严;读 B 站海外 IP 被屏蔽需要代理;各平台搜索 API 要么付费、要么质量差;读网页抓回大量 HTML 清洗成本高。每个平台都有各自门槛,需要付费 API、绕过封锁、登录账号、清洗数据,让 Agent 能读个推特就得折腾半天。
工作方式
Narrator AI CLI Skill 采用自然语言驱动的视频生产流水线设计。架构分为三层:用户自然语言指令由 AI Agent(Claude Code / OpenClaw 等)解析意图并构造 CLI 命令参数;narrator-ai-cli 作为 Python CLI 客户端,使用 Typer 框架和 httpx HTTP 客户端,自动认证(app-key header),支持 SSE 流式进度推送;Narrator AI 云端 API(openapi.jieshuo.cn)执行 9 种任务类型的异步处理,通过预签名 URL 上传至 OSS 存储并回调确认。工作流提供双路径:原创解说路径(Fast Path)依次执行 search-movie(搜索电影信息)、fast-writing(AI 生成脚本)、fast-clip-data(匹配素材+配音+BGM)、video-composing(视频合成)、magic-video(可选,套视觉模板);改编解说路径(Standard Path)依次执行 popular-learning(学习原片解说风格)、generate-writing(生成改编脚本)、clip-data(素材匹配)、video-composing、magic-video。所有任务创建后返回 task_id,通过轮询 task query 获取状态(0=初始化、1=进行中、2=成功、3=失败)。
Agent Reach 采用脚手架思维实现 Agent 互联网接入。架构为:AI Agent 读取 SKILL.md 了解每个平台该调什么工具;agent-reach 作为安装器+配置管理器+诊断工具,提供 agent-reach install / doctor / uninstall 命令;安装完成后 Agent 直接调用上游工具(如 twitter-cli、rdt-cli、yt-dlp 等),不经过包装层。每个 channel 文件实现 check() 方法检测对应上游工具是否可用,agent-reach doctor 汇总所有渠道状态。Cookie 管理优先从配置文件 ~/.agent-reach/config.yaml 读取,支持 Chrome 浏览器直接提取(--from-browser),文件权限 600(仅所有者可读写)。
核心能力
- 全流程自动化:脚本生成到成品输出六步一键完成
- 双路径设计:改编解说(需先学习原片风格)和原创解说(直接生成,更快更便宜)
- 资源预置化:93 部电影、146 首 BGM、63 种配音、90+ 模板开箱即用
- 成本预估前置:创建任务前可 budget 估算积分消耗
- 错误码全覆盖:18 种 API 错误码均有处理方案
- 多语言支持:11 种语言配音,支持多语言影视内容本地化
- 声音克隆:支持 voice-clone 任务克隆主播声音,品牌化统一音色
- 三种原创模式:热门影视、原声混剪、冷门/新剧
- 脚手架而非框架:安装完成后 Agent 直接调用上游工具,零性能损耗
- 可插拔架构:每个平台背后是独立上游工具,可替换对应 channel 文件
- SKILL.md 驱动:安装时注册 Skill 文件,Agent 读完即知调用工具
- 环境自适应:自动检测本地电脑还是服务器,给出对应配置建议
使用前需要了解
- AI 整理 · 本地测试,未经人工复核;依据历史报告节选,不代表当前产品状态。
- Narrator AI 依赖云端 API,所有处理在 Narrator AI 云端,无法离线使用;素材库有限,仅 93 部预置电影,新片需要自己上传;需要积分,pro 模式 15pts/字,flash 模式 5pts/字,批量生产成本累积;search-movie 较慢,Gradio 后端可能需要 60+ 秒;仅支持特定视频格式(.mp4、.mkv、.mov 等);电影素材库以中文影视为主。使用中需注意:永远不要伪造 confirmed_movie_json,必须通过 search-movie 获取;video-composing 用的是 writing 步骤的 order_num,不是 clip-data 的;search-movie 结果缓存 24 小时;创建任务前先用 task verify 检查素材、用 task budget 估算成本。
Agent Reach 的 Cookie 平台存在封号风险,Twitter、小红书等建议使用专用小号;部分平台需额外配置(Cookie 导出、代理设置等);搜索 API 有配额,WebSearch 等搜索服务有月度限制;B站海外访问受限,服务器部署需要代理(约 $1/月);微信公众号依赖 Gradio,Exa 搜索可能不稳定;非框架,只是脚手架,高级需求仍需直接操作上游工具;抖音/小红书内容获取能力受平台反爬政策影响;雪球等金融平台需要 Cookie 才能获取完整数据。使用中需注意:不要执行 agent-reach uninstall 后忘记备份,会清除所有 token/cookie;OpenClaw 用户需先开启 exec 权限(openclaw config set tools.profile "coding")。

