跳到主要内容
prolist.
发现项目AI 收集我的项目我的模型
正在确认账号…
prolist.

发现有价值的项目,留下有依据的判断。

项目专题关于我的收藏
© 2026 prolist项目知识,由人判断。

IDEAS CONNECT PROJECTS

沿着兴趣,发现项目。

从一个标签出发,打开一份值得研究的档案。

收集项目线索
筛选与排序 · 已应用
地图列表
不限标签67开源34AI Agent23Python18Claude Code10MIT9TypeScript8LLM7MCP7React7CLI6Markdown6Rust6

项目搜索结果

找到 67 个项目

清除筛选

以下内容已由 AI 根据历史资料整理,供本地测试,未经人工复核。

ahang008 的 GitHub 头像ahang008/ah-xhs-cover-title
内容创作GitHub 项目

ah-xhs-cover-title

短视频封面标题生成器,基于85条爆款公式进行可追溯路由匹配

ah-xhs-cover-title 是一款短视频封面标题生成器,由开发者 ahang008(阿航)于 2026 年 4 月 22 日开源发布,以 Claude Code Skill 形式运行。用户输入文章、选题或核心观点后,系统自动从 85 条经过验证的爆款封面公式中进行路由匹配,生成标题和封面三行文案。其核心是双层分类体系(8 种钩子手法 × 6 条内容赛道)和三层路由决策机制(识别赛道、匹配钩子、锁定拆法),每条输出都标注钩子代号和案例编号,实现可追溯。工具支持自然语言反馈迭代(如“再来几条”“换个方向”),并配套四种封面三行拆法模板。项目采用 MIT 协议,即开即用,无需训练。

案例库标题生成短视频
09.08
其他项目主题配图

一人电商 GitHub 工作流(changedetection.io + PicPilot + Medusa + n8n + Chatwoot)

用5个开源工具串联选品到客服,构建可自托管的一人电商全链路工作流

这是一套基于5个开源项目组合而成的一人电商全链路工作流,覆盖从选品到客服转化的完整电商运营链路。它不是一个单独的技术框架,而是通过将5个成熟的开源工具串联起来,构建一支"虚拟电商团队"。该工作流属于开源电商工具链体系,不绑定任何单一平台,所有组件都可以自托管,数据完全掌控在自己手中。它通过 changedetection.io 解决选品研究,PicPilot 处理素材生成,Medusa 搭建无头电商后端,n8n 实现工作流自动化,Chatwoot 提供全渠道客服。核心思想是用开源工具替代团队角色,用自动化工作流替代人工协调,让一个人具备完整电商运营能力。报告指出其适合有基础技术能力、重视数据自主权、追求高度定制化的个人或小型团队,但不适合完全没有技术背景、只求快速上线的纯运营型卖家。

第 1 页第 2 页第 3 页
电商工作流自动化开源
09.08
TrendRadar README 配图
AI 智能体GitHub 项目

TrendRadar

AI 驱动的多平台热点聚合与智能推送工具

TrendRadar 是一款 AI 驱动的舆情监控与热点聚合工具,由开发者 sansan0 于 2025 年 4 月创建。项目定位为面向信息过载时代的一站式热点助手,核心能力包括一键聚合 35+ 平台实时热点(如抖音、B 站、知乎、微博、头条、财联社、华尔街见闻等),通过 AI 智能筛选、翻译和深度分析,生成趋势预测、情感洞察、跨平台关联等简报,并支持 10+ 智能推送渠道(企业微信、微信、飞书、钉钉、Telegram、邮件、Slack 等)。项目采用时间线智能调度,针对早高峰、晚上、周末等不同时段配置不同推送策略。技术栈包括 Python、GitHub Actions、GitHub Pages、Docker 和 MCP Server,开源协议为 GPL-3.0。项目支持 MCP 架构,可接入 AI Agent 生态,实现自然语言对话分析。

热点聚合信息推送舆情监控
09.08
PDFMathTranslate README 配图
开发工具GitHub 项目

PDFMathTranslate

开源 PDF 科学文档翻译工具,翻译全文并保留公式、图表与排版。

PDFMathTranslate(命令行工具名 pdf2zh)是一个开源的 PDF 科学文档翻译工具,其核心能力是在翻译 PDF 全文的同时,完整保留原始排版、数学公式、图表、目录和批注。它通过 PDF 解析、元素分类、文本翻译、原位回填四个阶段处理文档,使用 DocLayout-YOLO 模型识别并跳过公式区域,避免公式被翻译引擎误读。翻译引擎可插拔,支持 Google、DeepL、OpenAI、Ollama 等十余种后端,并支持 CLI、GUI、Docker、MCP Server、Zotero 插件等多种部署形态。工具同时生成纯译文版和双语对照版,满足不同阅读需求。项目以 AGPL-3.0 许可证开源,论文被 EMNLP 2025 录用。

机器翻译开源文档智能
09.08
伯乐 Skill / ai-news-radar README 配图
AI 智能体GitHub 项目

伯乐 Skill / ai-news-radar

AI 信息源智能筛选系统,先判断再接入

伯乐 Skill(Scout Skill)是基于开源项目 ai-news-radar 构建的 AI 信息源智能筛选与新闻雷达系统,由 LearnPrompt 创始人卡尔的AI沃茨开发,2026 年 5 月发布 v0.4.0。其核心定位不是又一个新闻聚合站,而是帮助用户从一堆信源里选出千里马的 AI 信息源筛选系统。它解决 AI 从业者追踪行业动态时的信息淹没、原始来源丢失、接入方式差异大、个性化需求无法满足、缺乏健康评估机制以及 Agent 自动化维护门槛高等痛点。核心设计思想是“先判断,再接入”,在信息源层面做第一轮判断,区分一手源与聚合源,并尊重每个源的原生接入方式。系统支持九类信源,内置 22 个默认信息源,通过六阶段 Pipeline 完成信源分类、抓取、去重、过滤、健康统计和静态站点生成。核心流程不依赖大模型 API,也不需要服务器,运行在 GitHub Actions 和 GitHub Pages 上,每 30 分钟自动更新。

静态站点生成开源信息源评估
09.08
Guizang PPT Skill README 配图
AI 智能体GitHub 项目

Guizang PPT Skill

将十年设计经验压缩为规则文件,让 AI 按杂志级排版生成单文件网页 PPT

Guizang PPT Skill(magazine-web-ppt)是由设计师歸藏(op7418)开源的一个 Claude Code / AI Agent Skill,用于生成单文件 HTML 横向翻页网页 PPT,视觉基调定位为“电子杂志 × 电子墨水”。它不是一个 PPT 编辑器,而是一套“人 × AI 协作做 PPT”的接口,把十年设计经验压缩成一个 SKILL.md 规则文件,让 AI 按照专业杂志排版规则自动生成网页幻灯片。项目发布于 2026-04-24,采用 MIT 协议,语言为 HTML 100%,拥有 396 Stars 和 60 Forks。核心工作流包括 6 问需求澄清、大纲与叙事弧规划、拷贝模板并选主题色、类名预检与主题节奏规划、挑选布局并填充内容、Checklist 自检。产物为单文件 index.html,浏览器直接打开,零依赖。

单文件应用开源杂志排版
09.08
AI 智能体主题配图

AI Agent 技能工具

面向 AI Agent 的影视解说自动化与互联网信息获取技能工具

本收藏条目涵盖两个面向 AI Agent 的技能工具:Narrator AI CLI Skill 与 Agent Reach。Narrator AI CLI Skill 是专为 AI Agent 设计的视频解说自动化技能文件,对应 CLI 客户端 narrator-ai-cli,封装了 Narrator AI 开放平台的完整 API,支持 Claude Code、OpenClaw、Windsurf 等主流 AI Agent 平台。其核心能力是用一句自然语言指令,自动完成从脚本生成到成片输出的全流程影视解说视频生产,内置 93 部电影素材库、146 首 BGM、63 种配音音色(覆盖 11 种语言)、90+ 解说模板,提供「改编解说」和「原创解说」两条工作路径。Agent Reach 是一个开源的 AI Agent 互联网能力脚手架,由 Panniantong 开发,作为一键安装器和配置管理器,将 15+ 个平台的内容读取能力(如 Twitter、Reddit、YouTube、B站、小红书、GitHub、微信公众号、抖音、LinkedIn、微博、V2EX、雪球、RSS 等)集成到任何 AI Agent 中,核心价值是零 API 费用、零配置门槛,所有底层工具均为开源免费的 CLI 工具,通过本地 Cookie 和抓取方式访问平台内容,数据只留在本地。

脚手架视频解说信息获取
09.08
Hermes Agent 记忆系统 README 配图
AI 智能体GitHub 项目

Hermes Agent 记忆系统

开源 AI Agent 框架 Hermes Agent 内置的多层记忆架构,以缓存优先和冷热分离为核心设计。

Hermes Agent 记忆系统是开源 AI Agent 框架 Hermes Agent(由 Nous Research 开发)内置的多层记忆架构,由四套协同工作的记忆子系统组成。第一层为固化提示词记忆,将高频关键信息存入 MEMORY.md 和 USER.md 文件,合计约 1,300 Token,会话期间固化不变。第二层为会话搜索回溯,历史对话存储在 SQLite 数据库中,通过 FTS5 全文搜索按需检索,并使用辅助模型进行摘要。第三层为技能系统,用于记住如何做事的程序记忆,技能文件存储在 ~/.hermes/skills/ 目录。第四层为可选的 Honcho 用户建模,用于跨会话、跨平台的深层用户画像。该系统的核心设计思想是缓存优先,保持系统提示词前缀稳定以最大化利用 Prompt Caching,同时采用冷热分离策略,只保存用户偏好、环境事实、错误修正、稳定规范和学到的技能五类高价值信息。

分层记忆缓存优化记忆系统
09.08
Hermes Agent 高阶工具配置 README 配图
AI 智能体GitHub 项目

Hermes Agent 高阶工具配置

一个整合终端操作、代码编辑、浏览器控制、记忆系统与语音交互的开源 AI Agent 框架。

Hermes Agent 是由 Nous Research 开发的开源 AI Agent 框架,定位为自我进化的个人 AI 助手。它整合终端操作、代码编辑、浏览器控制、记忆系统、语音交互于一体,通过 Skill 系统实现无限扩展能力。其核心差异在于内置学习循环,能从经验中创建和改进 Skill,并跨会话构建对用户的深度理解。 该框架采用 CLI 与 GUI 双形态,支持 MCP 协议,不绑定单一 LLM,可灵活切换模型提供商,并支持跨平台部署。其能力分为身份与记忆、感知、表达、效率与成本、生态扩展五大层。记忆系统包含会话内、跨会话和知识图谱三层架构。感知能力涵盖网页抓取、搜索、浏览器自动化等。表达层支持语音合成、语音识别和图片生成。效率层提供 Token 监控、压缩和智能路由工具。生态方面拥有 380+ 社区 Skill。 报告指出其优点包括全能性、丰富的 Skill 生态、强大的记忆系统和零成本可行性,但也存在学习曲线陡、生态碎片化、文档不完善等缺点。

多模型路由记忆系统开源
09.08
内容创作主题配图

AI短剧精细化制作开源工作流

开源工具链将AI短剧生产从一键生成升级为逐镜头可控的工业化流水线

AI短剧精细化制作工作流利用开源工具链,将剧本解析、角色与场景一致性管理、分镜编辑、视频生成和后期剪辑串联成一条可精细调控的工业化生产线。与粗放式一键生成方案不同,它强调逐镜头控制和全流程可回溯,让创作者能对每个分镜的景别、运镜、情绪、时长、氛围进行精确调整,最终输出商用品质的竖屏短剧。报告覆盖两个代表性开源项目:Jellyfish AI短剧工厂主打人物一致性和精控镜头,从剧本到后期全闭环;Toonflow主打智能剧本改编和无限画布工作台,适合小说IP转视觉内容。两者均属于AI视频生成加工作流编排技术体系,为AI视频生成能力增加导演级控制力和制片级管理能力。

短剧制作分镜控制工作流编排
09.08
开发工具主题配图

DesignMD & DESIGN.md 设计系统提取

从任意网站提取设计规范,生成 AI 可读的 DESIGN.md 文件

DesignMD 是一款由 Crowdlinker 开发的 AI 驱动设计系统提取工具,用户输入任意网站 URL 或描述项目需求,即可自动生成符合 Google Stitch DESIGN.md 规范的完整设计系统文档。DESIGN.md 是 Google Stitch 项目提出的一种纯 Markdown 格式的设计系统文档,AI 编码代理可以直接阅读并据此生成一致的 UI。配套的 awesome-design-md 是由 VoltAgent 维护的开源仓库,收录了 68 个全球顶级品牌的现成 DESIGN.md 文件,Star 数达 57.6k,MIT 协议开源。该工具免费使用,无需注册,打开即用。核心价值在于让 AI 编码工具(如 Cursor、Claude Code)能“看懂”设计意图并复刻 UI。

开源逆向工程设计提取
09.08
ATLAS (Adaptive Test-time Learning and Autonomous Specialization) README 配图
开发工具GitHub 项目

ATLAS (Adaptive Test-time Learning and Autonomous Specialization)

完全本地化、无需 API 的 AI 编程助手,通过推理时增强让 14B 小模型在单张消费级 GPU 上达到接近前沿模型的编程能力。

ATLAS(Adaptive Test-time Learning and Autonomous Specialization)是一个完全本地化、无需 API 的 AI 编程助手,由 Virginia Tech 商学院学生 Isaac Tigges 独立开发,采用 AGPL-3.0 开源许可。其核心思路是冻结小模型(如 Qwen3-14B),通过智能推理基础设施在推理阶段提升输出质量,而非微调模型。在 RTX 5060 Ti 16GB 显卡上,ATLAS 在 LiveCodeBench v5 上达到 74.6% pass@1-v(k=3) 的分数,接近 GPT-5 和 Claude 4.5 的水平。其 V3 Pipeline 包含三阶段:候选生成(PlanSearch、BudgetForcing、DivSampling)、Lens 路由评分和 PR-CoT 自验证迭代修复。ATLAS 支持 8 个工具调用,通过语法约束解码保证 JSON 输出格式正确,并采用 T1/T2 文件分级机制智能路由简单与复杂任务。主要优势是 100% 本地运行、零 API 成本(每任务约 $0.004 电费)和数据隐私,但需要 16GB VRAM 的 NVIDIA GPU,安装复杂且仅支持 Linux。

本地优先开源推理时增强
09.08
apify 的 GitHub 头像apify/awesome-skills
AI 智能体GitHub 项目

Apify Awesome Skills

为 AI 编程助手提供网页抓取与业务自动化能力的社区驱动 Skills 合集

Apify Awesome Skills 是 Apify 官方维护的社区驱动 AI Agent Skills 合集,为 Claude Code、Cursor、Codex、Gemini CLI 等 AI 编程助手提供网页抓取、数据提取和业务自动化的预置能力。它不是独立运行的软件,而是一套以 Markdown(SKILL.md)为载体的指令包与工具编排规则,安装后 Agent 可通过自然语言指挥 Apify 云端的爬虫 Actors 执行数据采集任务。项目包含受众分析、品牌监控、竞品情报、内容分析、电商数据、KOL 发现、线索生成、市场调研、趋势分析等九个垂直领域 Skills,覆盖 Google Maps、Instagram、TikTok、Amazon 等主流平台。其核心设计原则包括声明式触发、云端执行零本地依赖、领域垂直化、多 Agent 兼容、按结果付费和社区共建。项目采用 Apache-2.0 开源协议,主要语言为 JavaScript(91%)和 Python(9%),前置条件包括 Apify 账号、API Token 和 Node.js 20.6+。

数据提取网页抓取业务自动化
09.08
EvoLinkAI 的 GitHub 头像EvoLinkAI/awesome-gpt-image-2-API-and-Prompts
内容创作GitHub 项目

awesome-gpt-image-2-prompts

GPT Image-2 提示词社区精选百科,收录 31+ 条真实案例与五大类别

awesome-gpt-image-2-prompts 是由 EvoLinkAI 团队维护的 GPT Image-2 提示词精选合辑,托管在 GitHub 上,采用 CC BY 4.0 协议开源。项目定位为 GPT Image-2 提示词的百科全书式参考库,收录人像摄影、海报插画、角色设计、UI 仿真、社区实验等五大类别的真实提示词与生成效果图。截至 2026.4.19,收录 31+ 条精选案例,来自 X/Twitter、创作者社区和公开演示。项目提供 11 种语言版本,持续更新。核心理念是"真实案例 > 理论指导",强调提示词原汁原味、图证合一、创作者溯源。项目还提炼了五种提示词写作模式,包括摄影参数式、设计需求式、规格清单式、场景仿真式和极简指令式,帮助用户理解和掌握 GPT Image-2 提示词的写法。

多语言精选合辑开源
09.08
AI 智能体主题配图

CUA Computer-Use Agents

开源全平台 AI 桌面操控基础设施,沙盒隔离、后台驱动、模型无关

CUA(Computer-Use Agents)是由 trycua 组织开发的开源基础设施项目,为 AI Agent 提供「像人一样操控电脑」的完整能力栈,覆盖 macOS、Linux、Windows、Android 全平台。项目提供沙盒环境、Agent SDK、桌面驱动、基准测试和虚拟化工具,核心组件包括 Cua Driver(macOS 后台桌面驱动)、Cua Sandbox(跨 OS 沙盒环境)、CuaBot(多 Agent 协作沙盒 CLI)、Cua-Bench(基准测试与 RL 环境)、Lume(Apple Silicon 虚拟化管理)和 Lumier(Docker 兼容接口)。CUA 的设计强调沙盒优先、一个 API 覆盖所有平台、后台驱动不抢光标、模型无关、云加本地双模式以及内置可观测性。它通过统一的 Sandbox API 抽象了 Docker、QEMU、Apple Virtualization.Framework 等底层虚拟化技术,并支持 Claude、GPT、Gemini、Qwen 等主流视觉语言模型。项目采用 MIT 许可证,本地使用免费,云沙盒提供免费额度和按量付费选项。

跨平台沙盒虚拟化
09.08
Cult UI README 配图
开发工具GitHub 项目

Cult UI

面向 Design Engineer 的开源动效组件集,通过源码复制模式扩展 shadcn/ui 生态

Cult UI 是 nolly-studio 开发的开源前端组件集,提供 60+ 动效丰富、可定制的 UI 组件,兼容 shadcn/ui 生态,采用"复制即拥有"的分发模式。它解决的核心问题是 shadcn/ui 只提供无样式底层原语,当产品需要"好看"和"有动效"的组件时,开发者需从零编写。Cult UI 通过 shadcn registry CLI 分发源码,组件代码复制到项目后完全归开发者所有,可自由定制。技术栈为 React + TypeScript + Tailwind CSS v4 + motion。项目还提供 AI SDK Agents(92+ 免费 Agent 模式)、Cult Pro(129 个付费 Block 和 10 个 Starter Template)以及 MCP Server,覆盖从组件到产品的完整链路。

动效开源MIT
09.08
Narrator AI CLI Skill README 配图
AI 智能体GitHub 项目

Narrator AI CLI Skill

让 AI Agent 通过自然语言对话自动完成电影解说视频全流程生产的技能描述文件

Narrator AI CLI Skill 是一个 AI Agent 技能描述文件,教会 AI Agent(如 OpenClaw、Claude Code、Cursor、Windsurf 等)如何调用 narrator-ai-cli 命令行工具,完成电影/短剧解说视频的全自动化生产。它解决的核心问题是让不懂视频剪辑、命令行和 API 调用的普通用户,通过自然语言对话就能完成从搜片、选模板、选 BGM、选配音、生成文案到合成视频的完整流水线。项目采用 SKILL.md 主文件加 references/ 子目录的结构化行为规范,将 CLI 的调用顺序、参数依赖、错误处理和决策逻辑编码为机器可读的说明书,并定义了 Fast Path(原创文案)和 Standard Path(二创文案)两条工作流路径。内置约 100 部电影素材、146 首 BGM、63 个配音音色(11 种语言)和 90+ 解说模板,支持多语种出海场景。项目采用积分计费模式,MIT 开源协议,版本 v1.0.5,已在 9 个 AI Agent 平台验证。

多语种视频生成自动化
09.08
Hermes Agent README 配图
AI 智能体GitHub 项目

Hermes Agent

一个自带学习闭环的开源 AI Agent 运行时

Hermes Agent 是由 Nous Research 开发的开源 AI Agent 框架,定位为通用的、可自我改进的 AI Agent 平台。它通过终端 TUI 或 15+ 消息平台与用户对话,调用 47+ 内置工具操作终端、浏览器、文件系统等,并支持通过 MCP 协议扩展能力。其核心特色是闭环学习系统:通过持久化记忆(MEMORY.md + USER.md)、技能(Skills)自创建与改进、以及会话搜索(FTS5),从经验中持续成长。它支持 18+ LLM 提供商,可随时切换模型,避免供应商锁定。此外,它提供六种终端后端(本地、Docker、SSH 等)和内置 Cron 调度器,适用于开发助手、运维监控、知识管理等场景。

多平台记忆系统开源
09.08
z-mio 的 GitHub 头像z-mio/ParseHub
数据与分析GitHub 项目

ParseHub

一个统一接口解析17+国内外社交媒体平台的轻量异步工具

ParseHub 是一款由开发者梓澪(z-mio)于 2024 年 11 月开源的社交媒体聚合解析库与 CLI 工具,使用 Python 编写,采用 MIT 协议。它通过统一的 parse() 和 download() 接口,支持 17+ 国内外主流社交媒体平台的链接解析与媒体下载,覆盖视频、图文、实况照片等多种内容类型。其核心设计是“一个接口,17+ 平台,零配置即用”,用户无需预处理链接,工具可自动从分享文案中提取 URL、清理跟踪参数并识别目标平台。ParseHub 底层聚合了 yt-dlp、instaloader 等成熟项目,并针对国内特有平台自行实现解析逻辑。它提供 CLI、Python API(同步/异步)和 Telegram Bot 三种使用方式,支持按平台配置 Cookie 和代理,并原生支持 async/await,适合批量处理场景。

媒体下载社交媒体解析异步
09.08