跳到主要内容
prolist.
发现项目AI 收集我的项目我的模型
正在确认账号…
prolist.

发现有价值的项目,留下有依据的判断。

项目专题关于我的收藏
© 2026 prolist项目知识,由人判断。

IDEAS CONNECT PROJECTS

沿着兴趣,发现项目。

从一个标签出发,打开一份值得研究的档案。

收集项目线索
筛选与排序 · 已应用
地图列表
不限标签13开源4AI Agent4HTML3Markdown3设计系统2Apache-2.02Claude Code2CLI2GSAP2HTML-to-Video2MIT2Python2

项目搜索结果

找到 13 个项目

清除筛选

以下内容已由 AI 根据历史资料整理,供本地测试,未经人工复核。

HyperFrames 提示词工程 README Logoheygen-com/hyperframes
内容创作GitHub 项目

HyperFrames 提示词工程

用自然语言指挥 AI Agent 编写 HTML 视频的声明式合成框架

HyperFrames 是由 HeyGen 开源的一款 HTML-to-Video 渲染框架,核心理念是“Write HTML. Render video. Built for agents”。它让 AI Agent(如 Claude Code、Cursor、Codex)能够用纯 HTML + GSAP 动画来“编写”视频,再通过无头浏览器确定性渲染为 MP4/WebM 视频文件。框架不是视频编辑器,而是声明式视频合成框架,用户写 HTML,输出视频。其设计哲学是 Agent-First,通过三个 Slash Command(/hyperframes、/hyperframes-cli、/gsap)将框架知识注入 Agent 上下文,并通过自然语言词汇表(如“smooth”、“bouncy”、“dramatic”)直接映射到 GSAP easing 函数,实现意图到代码的精准映射。框架支持冷启动(从零描述)和暖启动(喂素材转化)两种 Prompt 形态,并强调小步精准修改的迭代原则。

开源视频合成提示词工程
09.08
Architecture Diagram Generator README 配图
AI 智能体GitHub 项目

Architecture Diagram Generator

用自然语言对话生成专业架构图的 Claude Skill

Architecture Diagram Generator 是由 Cocoon AI 开发的 AI 驱动系统架构图生成器,以 Claude.ai Skill 的形式存在。用户用自然语言描述系统架构,Claude 即可生成深色主题、自包含的 HTML 架构图文件。项目定位为 AI 辅助设计/架构可视化,目标用户是架构师、技术负责人和开发者,运行环境为 Claude.ai(Pro/Max/Team/Enterprise)。核心特性包括零设计门槛、通过对话极速迭代、输出自包含 HTML 文件(内嵌 CSS 与内联 SVG,无外部依赖),以及采用深色主题、语义色彩编码和 JetBrains Mono 字体的专业视觉系统。项目采用 MIT 协议,当前版本为 v1.0。

架构图生成自然语言AI驱动
09.08
Hermes WebUI README 配图
AI 智能体GitHub 项目

Hermes WebUI

为 Hermes Agent 提供浏览器端图形界面的纯 UI 层,让会话、文件与工具调用可视化。

Hermes WebUI 是 Hermes Agent 的浏览器端图形界面,由 Nathan Esquena(@nesquena)开发并开源。它本身不运行 Agent,而是对接用户已有的 Hermes Agent 服务,所有数据仍存储在用户机器上。项目采用 Python 后端与原生 JS/CSS/HTML 前端,零框架、零构建步骤,通过 REST API 与 SSE 流式传输实现通信。它主要解决传统终端与聊天平台交互的痛点,包括会话不可追溯、文件操作割裂、Profile 管理原始、工具调用黑盒以及跨设备访问受限等问题。WebUI 提供三栏布局,左侧会话列表、中间聊天区域、右侧文件浏览器,并支持 CLI 会话桥接、Profile 热切换、工具调用卡片展示等功能。部署方式包括本地脚本启动、Docker 容器以及 macOS 原生客户端(Swift/WKWebView 封装)。项目为 MIT 开源,适合需要可视化管理 Hermes Agent 会话与工作区的用户。

零框架原生JavaScriptAI Agent
09.08
microsoft 的 GitHub 头像microsoft/markitdown
开发工具GitHub 项目

MarkItDown

微软开源的轻量级多格式文档转 Markdown 工具,为 LLM 与 RAG 管道提供结构化文本提取。

MarkItDown 是微软 AutoGen 团队开发并维护的开源 Python 工具,采用 MIT 协议,当前 GitHub 星标超过 105k,最新版本为 v0.1.5(2026 年 2 月发布)。它支持 PDF、Word、PowerPoint、Excel、图片、音频、HTML、EPUB 等 15 种以上文件格式,将其转换为结构化的 Markdown 文本。其核心设计目标是让 LLM 和文本分析工具能以最高效的方式“阅读”非文本文件,输出为机器可消费的结构化文本,而非人类可读的高保真转换。工具采用可插拔的 Converter 架构,每种格式对应独立转换器,核心库仅依赖 Python 标准库,其他功能通过可选依赖按需安装。v0.1.0 之后支持流式处理,不创建临时文件。基础转换不依赖 LLM,但可选用 LLM 增强图片描述与 OCR 功能。此外,项目提供 MCP 服务器,便于 AI 客户端直接调用。

开源文档转换LLM
09.08
HyperFrames README Logoheygen-com/hyperframes
开发工具GitHub 项目

HyperFrames

用 HTML 写视频,为 AI Agent 而生的确定性渲染框架

HyperFrames 是由 HeyGen 开源的一个 HTML-to-Video 渲染框架,核心理念是“Write HTML. Render video. Built for agents.”。它允许用户用纯 HTML 文件定义视频内容,通过 data-* 属性控制时间轴、轨道和布局,然后通过 CLI 一键渲染成 MP4。该框架采用声明式数据模型、可插拔动画运行时和确定性逐帧渲染引擎,旨在解决 AI Agent 无法操作传统视频编辑工具的问题。它支持非交互式 CLI、Vercel Skills 规范,并提供 50+ 预制 Block。HyperFrames 使用 TypeScript 开发,开源协议为 Apache 2.0,最新版本为 v0.4.3。

AI AgentApache-2.0CLI
09.08
guizang-ppt-skill 歸藏PPT Skill README 配图
AI 智能体GitHub 项目

guizang-ppt-skill 歸藏PPT Skill

将十年设计经验编码为规则,让 AI 生成专业级 HTML 演示文稿的开源技能

guizang-ppt-skill 是由设计师歸藏开发的开源 AI Agent 技能,用于在 Claude Code、Codex 等环境中生成专业级横向翻页 HTML 演示文稿。它通过 SKILL.md 定义工作流和约束,将设计经验转化为自然语言硬规则,让 AI 在约束内执行,而非自由发挥。项目提供两套视觉系统:电子杂志风(Style A)适合叙事与个人风格,瑞士国际主义风(Style B)适合事实、产品与分析。瑞士风包含 22 种锁定版式、16 列网格和自动校验脚本,确保版式合规。核心设计决策包括不允许自定义颜色、单一视觉锚点、结构优于装饰等。此外,项目支持在 Codex 环境中通过 GPT-Image 2.0 生成配图,并可生成多平台封面(如公众号 21:9、小红书 3:4、视频号 16:9),实现从大纲到 PPT、配图、封面的全链路闭合。项目以 MIT 协议开源,GitHub 上获得 7.2k+ Stars。

开源设计系统AI Agent Skill
09.08
AI Animation README 配图
内容创作GitHub 项目

AI Animation

用 Prompt 模板驱动 AI 生成 HTML 动画的示例与模板集合

AI Animation 是一个由 Unclecheng 开发的 AI Prompt 模板集合项目,专注于用 AI 生成炫酷的 HTML 动画网页。项目包含分类整理的 Prompt 模板、多种预置 HTML 动画示例(技术可视化、PPT 模板、3D 效果等),配合 Trae、Claude、GPT-4o 等 AI 工具使用。项目定位为 AI 辅助内容创作与教育可视化,目标用户包括教育者、内容创作者和技术博主。核心能力包括技术概念可视化、PPT 风格模板、3D 效果演示、UI 参考重构以及纯前端零依赖实现。所有动画示例基于 HTML5、CSS3 和原生 JavaScript,不依赖任何外部库。项目提供 40+ 个预置 HTML 动画文件,涵盖网络协议、AI/ML 概念、PPT 模板等类别,可直接在浏览器中打开使用。项目采用 MIT 协议,但明确仅限学习研究,禁止商业用途。

3D 效果纯前端教育可视化
09.08
opendataloader-pdf README 配图
数据与分析GitHub 项目

opendataloader-pdf

开源 PDF 解析与无障碍标注引擎,本地优先、AI 增强

OpenDataLoader PDF 是由韩国 Hancom 开发的 PDF 解析引擎,能将 PDF 转换为 AI 可消费的结构化数据(Markdown、JSON、HTML),同时是全球首个开源端到端 PDF 无障碍自动标注工具。它采用“本地确定性解析为主,AI 混合增强为辅”的核心思想:简单页面由本地 Java 引擎快速处理,复杂页面(如无边框表格、扫描件、公式、图表)路由到自托管的 AI 后端增强,全程数据不出机器。引擎提供阅读顺序识别(XY-Cut++)、边界框坐标、表格抽取、OCR(80+ 语言)、公式提取(LaTeX)、图表描述等功能,并内置 AI 安全过滤机制。项目采用 Apache-2.0 许可证,提供 Python、Node.js、Java SDK 及 CLI,支持 LangChain 集成。报告指出其基准测试成绩为开源第一(Hybrid 模式总分 0.907),但基准由 Hancom 内部测试,缺乏第三方独立验证。

表格抽取公式提取无障碍标注
09.08
AI-CanvasPro README 配图
内容创作GitHub 项目

AI-CanvasPro

基于节点的 AI 多模态画布编辑器,通过可视化连线编排文本、图像、视频与音频生成

AI-CanvasPro 是一款基于节点的 AI 多模态画布编辑器,由独立开发者阿硕(ashuoAI)打造,采用纯原生 HTML/CSS/JS 前端与 Python 后端,支持 Windows、macOS 与 Web 平台。它通过无限画布上的可视化节点连线,让用户组合文本、图像、视频、音频等 AI 能力,实现多模态内容的一站式创作。项目定位为 ComfyUI 的“轻量中文替代”,中文原生支持,无需本地 GPU,通过 API 调用即梦、RunningHub、PPIO、GRSAI 及 OpenAI 兼容接口等云端模型。核心机制包括连线数据流、@引用跨节点嵌入、多供应商适配、资产与工作流复用,以及遮罩重绘、抠图、高清放大等图像编辑工具链。项目采用 Source Available 许可证,禁止商业使用。

本地部署画布编辑器节点式工作流
09.08
内容创作主题配图

md2wechat

面向微信公众号的 Markdown 转 HTML 排版与全流程创作 CLI 工具

md2wechat 是一款专为微信公众号设计的 Markdown 转 HTML 排版及全流程创作 CLI 工具,由开发者 geekjourneyx 创建,GitHub 2.1k+ Stars。其定位是“AI 时代的公众号创作工作台”,覆盖从写作、去 AI 痕迹、排版、AI 配图到推送草稿箱的完整流程。工具采用 Go 1.26+ 实现,提供 40+ 专业主题(Minimal / Focus / Elegant / Bold 四大系列)和 43 个结构化 `:::block` 高级排版模块。架构上分为 AI 模式(免费,生成 prompt 由 LLM 执行,输出不确定)和 API 模式(专业服务,确定性输出,需付费)。md2wechat 为 Agent 集成设计了完整的发现协议,原生兼容 Claude Code、Codex、OpenClaw。许可证为 BUSL-1.1,个人/学习/非商用免费,商用需授权,2030-01-01 后自动转为 Apache 2.0。

内容创作排版微信公众号
09.08
Guizang PPT Skill README 配图
AI 智能体GitHub 项目

Guizang PPT Skill

将十年设计经验压缩为规则文件,让 AI 按杂志级排版生成单文件网页 PPT

Guizang PPT Skill(magazine-web-ppt)是由设计师歸藏(op7418)开源的一个 Claude Code / AI Agent Skill,用于生成单文件 HTML 横向翻页网页 PPT,视觉基调定位为“电子杂志 × 电子墨水”。它不是一个 PPT 编辑器,而是一套“人 × AI 协作做 PPT”的接口,把十年设计经验压缩成一个 SKILL.md 规则文件,让 AI 按照专业杂志排版规则自动生成网页幻灯片。项目发布于 2026-04-24,采用 MIT 协议,语言为 HTML 100%,拥有 396 Stars 和 60 Forks。核心工作流包括 6 问需求澄清、大纲与叙事弧规划、拷贝模板并选主题色、类名预检与主题节奏规划、挑选布局并填充内容、Checklist 自检。产物为单文件 index.html,浏览器直接打开,零依赖。

单文件应用开源杂志排版
09.08
内容创作主题配图

Claude Design

AI 驱动的视觉设计协作工具,通过自然语言对话实现从想法到视觉的快速创作。

Claude Design 是 Anthropic Labs 于 2026 年 4 月 17 日发布的 AI 驱动视觉设计协作工具,属于 Research Preview 阶段,由 Claude Opus 4.7 驱动。它通过自然语言对话与 Claude 协作,创建设计方案、交互原型、演示文稿、产品 One-Pager 等视觉作品。该工具旨在解决传统设计工作流中探索受限、非设计人员视觉表达壁垒、设计到开发交接断层、原型制作代码依赖以及品牌一致性执行漂移等问题。其核心创新包括自动构建设计系统、多粒度编辑系统(对话级、标注级、精确级)、组织级协作以及多种交付方式(如 PDF、PPTX、HTML、Canva 集成、Claude Code Handoff)。Claude Design 支持代码驱动的原型,包括 3D、Shader、语音、视频等前沿能力。它适用于快速视觉探索、原型制作和跨角色协作,与 Figma 等专业工具形成互补而非替代关系。

对话式设计多模态设计系统
09.08
AI 智能体主题配图

HTML作为Agent输出格式(The Unreasonable Effectiveness of HTML)

让 Agent 用 HTML 而非 Markdown 向人类传达复杂信息,以可视化与交互让人重新进入决策循环。

本文档基于 2026 年 5 月 8 日 Anthropic Claude Code 团队成员 Thariq Shihipar 发表的长文《Using Claude Code: The Unreasonable Effectiveness of HTML》整理而成。其核心主张是,当 AI Agent 需要向人类传达复杂信息时,HTML 应取代 Markdown 成为首选输出格式。文章指出 Markdown 存在信息密度不足、可读性差、分享困难、无法交互、编辑范式转移以及人与 Agent 的 Loop 断裂等六大痛点。HTML 则凭借其高表达力、视觉可读性、零摩擦分享、双向交互、数据摄取优势及情感连接等特性,成为更优的 Agent 输出格式。该方法论强调自包含的 HTML 文件、导出闭环以及让人类重新参与 Agent 决策过程。文章还对比了 HTML 与 Markdown、Claude.ai Artifacts 及 Notion/飞书文档的差异,并提供了九大输出场景、Prompt 模板、工程落地技巧及优缺点分析。

工程方法论交互设计输出格式
09.08