跳到主要内容
prolist.
发现项目AI 收集我的项目我的模型
正在确认账号…
prolist.

发现有价值的项目,留下有依据的判断。

项目专题关于我的收藏
© 2026 prolist项目知识,由人判断。

IDEAS CONNECT PROJECTS

沿着兴趣,发现项目。

从一个标签出发,打开一份值得研究的档案。

收集项目线索
筛选与排序 · 已应用
地图列表
不限标签27开源12MIT10Python9AI Agent8Claude Code Skill3CLI3Markdown3MCP3React3TypeScript3记忆系统2逆向工程2

项目搜索结果

找到 27 个项目

清除筛选

以下内容已由 AI 根据历史资料整理,供本地测试,未经人工复核。

Voicebox README 配图
内容创作GitHub 项目

Voicebox

本地优先的开源语音合成工作站,集成多引擎声音克隆、情感标签、后处理音效与多轨编辑

Voicebox 是由 Jamie Pine 开发的开源语音合成工作室,定位为 ElevenLabs 的免费本地替代方案。它是一个完整的桌面应用,集声音克隆、语音生成、后处理特效、多轨编辑于一体,所有模型和数据完全在本地运行。项目采用 Tauri (Rust) 桌面框架,前端使用 React + TypeScript,后端为 Python (FastAPI),音效处理由 Spotify pedalboard 驱动。内置 5 个 TTS 引擎,支持 23 种语言,最大文本长度 50,000 字符,并提供完整 REST API 供外部集成。核心能力包括多引擎声音克隆、情感表达控制(如 [laugh]、[sigh] 等副语言学标签)、8 种后处理音效、多轨时间轴编辑(Stories Editor)以及长文本自动分段与交叉淡入淡出拼接。项目采用 MIT 协议完全开源,支持 CUDA、ROCm、MLX、DirectML、XPU 及 CPU 等多种 GPU 后端。

本地优先声音克隆FastAPI
09.08
PromptLens README 配图
内容创作GitHub 项目

PromptLens

开源 AI 视频提示词反推分析工具,自动提取关键帧并生成结构化提示词

PromptLens 是一款开源的 AI 视频提示词反推分析工具,提供完整的 Web 应用体验。其核心能力是上传 AI 生成的视频或图片,自动提取关键帧,通过多模态大模型(如智谱 GLM-4V、Google Gemini、OpenRouter)分析画面内容,反向推导出可能使用的提示词,并输出结构化的、可直接复用的英文提示词。项目采用 Next.js 15 + React 19 全栈技术,使用 Supabase PostgreSQL 存储数据,Cloudflare R2 存储媒体文件,FFmpeg 进行视频帧提取,支持 better-auth 的 Google/GitHub 登录。除画面分析外,还支持通过 AssemblyAI 进行音频识别,提取视频中的语音旁白和台词。项目以 MIT 许可证开源,代码透明,可自由修改和商用。

第 1 页第 2 页
多模态大模型开源提示词反推
09.08
CLIProxyAPI 本地反代大模型 API 网关 README 配图
开发工具GitHub 项目

CLIProxyAPI 本地反代大模型 API 网关

将已授权的 AI CLI 账号统一转换为 OpenAI 兼容 API 的本地网关

CLIProxyAPI 是一个用 Go 编写的轻量级 AI 代理网关,由 router-for-me 团队开源维护,采用 MIT 协议。它能够将用户已登录授权的各种 AI CLI 工具(如 Gemini CLI、ChatGPT Codex CLI、Claude Code CLI)包装成一个统一的 OpenAI 兼容 API 接口,默认暴露在本机 localhost:8317 上。该工具解决了 AI 服务格式不统一、CLI 能力无法被代码调用、多账号管理混乱、安全暴露风险等问题。其核心设计思想包括:将 CLI 授权能力网关化、以 OpenAI 格式为标准、双层隔离架构、多账号轮询实现负载均衡、默认本机监听保障安全。CLIProxyAPI 支持流式/非流式响应、函数调用、多模态等功能,并支持多账户轮询负载均衡。它适用于本地 Agent 开发调试、多账号额度聚合、统一接入多个 AI 模型、IDE 编码助手后端等场景。但需注意,它主要代理 Chat 能力,不支持 Embeddings、Fine-tuning 等完整 API 特性,且依赖 CLI 授权,存在服务条款风险和稳定性问题。

本地部署多账号轮询协议翻译
09.08
Architecture Diagram Generator README 配图
AI 智能体GitHub 项目

Architecture Diagram Generator

用自然语言对话生成专业架构图的 Claude Skill

Architecture Diagram Generator 是由 Cocoon AI 开发的 AI 驱动系统架构图生成器,以 Claude.ai Skill 的形式存在。用户用自然语言描述系统架构,Claude 即可生成深色主题、自包含的 HTML 架构图文件。项目定位为 AI 辅助设计/架构可视化,目标用户是架构师、技术负责人和开发者,运行环境为 Claude.ai(Pro/Max/Team/Enterprise)。核心特性包括零设计门槛、通过对话极速迭代、输出自包含 HTML 文件(内嵌 CSS 与内联 SVG,无外部依赖),以及采用深色主题、语义色彩编码和 JetBrains Mono 字体的专业视觉系统。项目采用 MIT 协议,当前版本为 v1.0。

架构图生成自然语言AI驱动
09.08
val1813 的 GitHub 头像val1813/kwcode
AI 智能体GitHub 项目

KWCode天工开物

为本地小模型优化的确定性流水线 Coding Agent CLI 工具

KWCode(天工开物)是一个专为本地开源模型优化的 Coding Agent CLI 工具,由中国开发者 val1813(ValHuang)开发,MIT 协议开源。其核心定位是让 8B-30B 参数的小模型也能完成编程任务,数据不出网。 KWCode 采用确定性专家流水线架构,LLM 只负责任务分类和代码生成,文件定位、验证、调试等环节由确定性代码完成。内置 5 个确定性工具,支持 BM25+AST 调用图定位、三阶段重试、Debug Subagent 运行时调试、DAG 多任务编排、专家飞轮自动积累经验等功能。 项目支持 Windows/macOS/Linux 平台,Windows 原生运行,无需 WSL2。系统要求 Python 3.10+,支持任意 OpenAI 兼容 API。当前处于 MVP 阶段,AST 引擎主要支持 Python,社区规模较小。

本地模型开源确定性流水线
09.08
multica-ai 的 GitHub 头像multica-ai/andrej-karpathy-skills
开发工具GitHub 项目

andrej-karpathy-skills

用四条行为准则约束 AI 编码助手,减少过度工程化与越界修改

该项目是一个开源项目,由 multica-ai 维护,将 Andrej Karpathy 对 LLM 编码缺陷的观察总结为四个核心行为准则,封装在单个 CLAUDE.md 文件中,用于改善 Claude Code / Cursor 等 AI 编码助手的代码输出质量。它属于 AI 辅助编程质量保障体系,不是代码框架或 SDK,而是一份注入到 AI 编码助手上下文中的行为约束指令。项目核心要解决的问题是 LLM 在编写代码时存在的系统性缺陷,包括隐性假设、过度工程化、越界修改、目标模糊等,这些问题导致代码质量下降、维护成本上升。项目通过 Think Before Coding、Simplicity First、Surgical Changes、Goal-Driven Execution 四条准则,将 LLM 的多做倾向约束为做准、做少、做稳。安装方式极简,支持 Claude Code 插件、项目级 CLAUDE.md 和 Cursor 规则等多种方式。

开源行为约束AI编码助手
09.08
Hermes WebUI README 配图
AI 智能体GitHub 项目

Hermes WebUI

为 Hermes Agent 提供浏览器端图形界面的纯 UI 层,让会话、文件与工具调用可视化。

Hermes WebUI 是 Hermes Agent 的浏览器端图形界面,由 Nathan Esquena(@nesquena)开发并开源。它本身不运行 Agent,而是对接用户已有的 Hermes Agent 服务,所有数据仍存储在用户机器上。项目采用 Python 后端与原生 JS/CSS/HTML 前端,零框架、零构建步骤,通过 REST API 与 SSE 流式传输实现通信。它主要解决传统终端与聊天平台交互的痛点,包括会话不可追溯、文件操作割裂、Profile 管理原始、工具调用黑盒以及跨设备访问受限等问题。WebUI 提供三栏布局,左侧会话列表、中间聊天区域、右侧文件浏览器,并支持 CLI 会话桥接、Profile 热切换、工具调用卡片展示等功能。部署方式包括本地脚本启动、Docker 容器以及 macOS 原生客户端(Swift/WKWebView 封装)。项目为 MIT 开源,适合需要可视化管理 Hermes Agent 会话与工作区的用户。

零框架原生JavaScriptAI Agent
09.08
microsoft 的 GitHub 头像microsoft/markitdown
开发工具GitHub 项目

MarkItDown

微软开源的轻量级多格式文档转 Markdown 工具,为 LLM 与 RAG 管道提供结构化文本提取。

MarkItDown 是微软 AutoGen 团队开发并维护的开源 Python 工具,采用 MIT 协议,当前 GitHub 星标超过 105k,最新版本为 v0.1.5(2026 年 2 月发布)。它支持 PDF、Word、PowerPoint、Excel、图片、音频、HTML、EPUB 等 15 种以上文件格式,将其转换为结构化的 Markdown 文本。其核心设计目标是让 LLM 和文本分析工具能以最高效的方式“阅读”非文本文件,输出为机器可消费的结构化文本,而非人类可读的高保真转换。工具采用可插拔的 Converter 架构,每种格式对应独立转换器,核心库仅依赖 Python 标准库,其他功能通过可选依赖按需安装。v0.1.0 之后支持流式处理,不创建临时文件。基础转换不依赖 LLM,但可选用 LLM 增强图片描述与 OCR 功能。此外,项目提供 MCP 服务器,便于 AI 客户端直接调用。

开源文档转换LLM
09.08
Logo Generator Skill README 配图
AI 智能体GitHub 项目

Logo Generator Skill

一个为开发者生成可编辑 SVG Logo 与专业展示图的开源 AI Skill

Logo Generator 是由归藏(op7418/guizang.ai)开发的开源 AI Skill,用于生成专业级别的 SVG Logo 和图标,并自动创建高端展示图。它适用于 Claude Code、Gemini CLI 等 AI Agent 平台,项目托管在 GitHub,采用 MIT 协议。该工具主要解决小项目、开源项目或创业团队需要“够用的好 Logo”,但既请不起设计师、也用不好 AI 画图工具的痛点。其核心思路是“分阶段生成,先矢量后位图”:先由 AI 生成可编辑的 SVG 几何基础,再生成专业展示图。它内置设计模式库,包含点阵、线条系统、几何切割、负空间、括号/壳、六边形核心等范式,并提供 12 种静态背景风格和 6 种 WebGL 动态背景。整个流程约需 10-30 分钟,对话式交互,零设计基础也可使用。

开源设计模式库矢量图形
09.08
JFGAtlas 的 GitHub 头像JFGAtlas/aethergate-pro
其他项目GitHub 项目

AetherGate Pro

基于 Linux 网络命名空间隔离的免费住宅 IP 代理网关管理器

AetherGate Pro 是一款专为 Linux VPS 设计的企业级、高可用 VPN 与代理网关管理器。它利用 VPNGate 公共学术 VPN 节点池作为免费住宅 IP 来源,通过 Linux 网络命名空间(netns)隔离 VPN 流量,对外暴露统一的混合协议代理端口(SOCKS5 + HTTP),让用户以零成本获取全球住宅/移动网络出口 IP。项目由 JFGAtlas(狗富贵)开发,采用 MIT 开源协议,核心语言为 Python 3(异步架构),当前版本为 v2.0.0-async。它解决了 VPS 上直接运行 VPN 客户端导致 SSH 断连、商业住宅代理价格高昂、免费节点质量参差以及运维复杂度高等问题。通过 netns 隔离、自动节点筛选、看门狗故障自愈等机制,提供一键部署、自动故障转移、混合协议支持等功能。适用于测试、学习、轻量爬虫等场景,不适合大规模生产环境。

代理网络命名空间住宅IP
09.08
guizang-ppt-skill 歸藏PPT Skill README 配图
AI 智能体GitHub 项目

guizang-ppt-skill 歸藏PPT Skill

将十年设计经验编码为规则,让 AI 生成专业级 HTML 演示文稿的开源技能

guizang-ppt-skill 是由设计师歸藏开发的开源 AI Agent 技能,用于在 Claude Code、Codex 等环境中生成专业级横向翻页 HTML 演示文稿。它通过 SKILL.md 定义工作流和约束,将设计经验转化为自然语言硬规则,让 AI 在约束内执行,而非自由发挥。项目提供两套视觉系统:电子杂志风(Style A)适合叙事与个人风格,瑞士国际主义风(Style B)适合事实、产品与分析。瑞士风包含 22 种锁定版式、16 列网格和自动校验脚本,确保版式合规。核心设计决策包括不允许自定义颜色、单一视觉锚点、结构优于装饰等。此外,项目支持在 Codex 环境中通过 GPT-Image 2.0 生成配图,并可生成多平台封面(如公众号 21:9、小红书 3:4、视频号 16:9),实现从大纲到 PPT、配图、封面的全链路闭合。项目以 MIT 协议开源,GitHub 上获得 7.2k+ Stars。

开源设计系统AI Agent Skill
09.08
AI Animation README 配图
内容创作GitHub 项目

AI Animation

用 Prompt 模板驱动 AI 生成 HTML 动画的示例与模板集合

AI Animation 是一个由 Unclecheng 开发的 AI Prompt 模板集合项目,专注于用 AI 生成炫酷的 HTML 动画网页。项目包含分类整理的 Prompt 模板、多种预置 HTML 动画示例(技术可视化、PPT 模板、3D 效果等),配合 Trae、Claude、GPT-4o 等 AI 工具使用。项目定位为 AI 辅助内容创作与教育可视化,目标用户包括教育者、内容创作者和技术博主。核心能力包括技术概念可视化、PPT 风格模板、3D 效果演示、UI 参考重构以及纯前端零依赖实现。所有动画示例基于 HTML5、CSS3 和原生 JavaScript,不依赖任何外部库。项目提供 40+ 个预置 HTML 动画文件,涵盖网络协议、AI/ML 概念、PPT 模板等类别,可直接在浏览器中打开使用。项目采用 MIT 协议,但明确仅限学习研究,禁止商业用途。

3D 效果纯前端教育可视化
09.08
SoftwareCopyright-Skill README 配图
AI 智能体GitHub 项目

SoftwareCopyright-Skill

开源 Codex Skill,自动生成中国软著申请全套材料

SoftwareCopyright-Skill 是一个开源 Codex Skill,用于自动生成中国软件著作权申请材料。它通过阅读开发者真实项目源码,自动生成申请表信息、操作手册和代码鉴别材料,全部输出为 Word/TXT 格式。项目采用 MIT 协议,完全免费,旨在替代付费代办服务。核心功能包括自动分析项目源码、生成符合要求的操作手册、生成前 30 页和后 30 页代码鉴别材料、生成申请表辅助填报文件。代码材料只来自真实项目,禁止 AI 编造。关键节点设置人工确认门禁,确保材料准确性。支持基础 DOCX 和完整 OpenXML 两种生成路径。项目属于 AI Agent 与法律合规自动化交叉领域,面向中国开发者。

软著申请文档生成自动化
09.08
其他项目主题配图

Supertonic vs MOSS-TTS-Nano 开源轻量级 TTS 深度对比

对比两款开源轻量级 TTS:Supertonic 跨平台部署,MOSS-TTS-Nano 零样本声音克隆

本文档对比两款开源轻量级 TTS 系统:Supertonic 与 MOSS-TTS-Nano。Supertonic 由 Supertone Inc. 开发,基于 ONNX Runtime 完全本地运行,约 99M 参数,支持 31 种语言,提供 11 种语言 SDK,采用 Flow Matching 与语音自编码器架构,代码 MIT 许可,模型 OpenRAIL-M。MOSS-TTS-Nano 由 MOSI.AI 和复旦大学 OpenMOSS 团队开发,仅 0.1B 参数,基于 Audio Tokenizer + LLM 纯自回归架构,支持实时流式推理,可在 4 核 CPU 上运行,支持零样本声音克隆,输出 48kHz 立体声,Apache-2.0 许可。两者均解决传统 TTS 的部署、质量、工程与生态痛点,但侧重点不同:Supertonic 适合跨平台部署与极低资源设备,MOSS-TTS-Nano 适合声音克隆与中文 TTS。文档还包含架构原理、系统架构、关键流程、应用场景、优缺点与选型建议。

端侧推理声音克隆语音合成
09.08
内容创作主题配图

xiaohuai-video-translate

一套面向 AI 编程工具的视频翻译技能套件,将外语视频自动转为中文字幕视频和中文文稿。

xiaohuai-video-translate 是一套面向 AI 编程工具的视频翻译技能套件,由 xiaohuailabs(小灰)开发。它不是独立应用,而是由「脚本 + 说明书」组成的 AI Agent 技能,可被 Claude Code、OpenClaw、Gemini CLI、Codex 等工具加载和驱动。项目将下载、转写、翻译、润色、烧录等步骤编排为一条龙流水线,用户只需说一句话即可完成。转写使用本地 Whisper 引擎,不产生 API 费用;翻译复用已有的 AI 模型。项目包含三个独立技能:总指挥、字幕润色、下载专员,可单独或组合使用。支持中英双语字幕,通过 ASS 格式实现中文大、英文小的字号反差。全程本地运行,不上传数据,保护隐私。项目处于活跃状态,最新提交为 2026-06-08,采用 MIT 协议。

本地处理视频翻译字幕
09.08
yetone 的 GitHub 头像yetone/native-feel-skill
AI 智能体GitHub 项目

Native Feel Skill - 跨平台桌面应用原生体验架构

一套让 WebView 渲染的 UI 无法被用户分辨为原生应用的 AI Agent 技能包

Native Feel Skill 是一个 AI Agent 技能包,由开发者 yetone 创建,将 Raycast 2.0 的跨平台桌面应用架构经验提炼为可复用的结构化领域知识。它包含 8 条架构准则、四层架构方案(原生外壳 → 系统 WebView → Node 后端 → Rust 内核)、WebKit/WebView2 生存指南、75 项上线检查清单、IPC 契约设计指南、内存真相手册及 Raycast Beta 逆向证据。该技能包主要解决跨平台桌面开发中开发效率与原生性能不可兼得的问题,通过精确定义共享与原生边界,在 WebView 渲染表面画线,上方共享 React/TS 代码,下方使用原生 Swift/C#,让用户无法分辨是否为原生应用。安装到 Claude Code、Cursor 等兼容 AI Agent 后,讨论跨平台桌面应用架构时自动激活,提供架构建议、问题诊断和优化方案。

技能包架构跨平台桌面
09.08
crafter-station 的 GitHub 头像crafter-station/petdex
开发工具GitHub 项目

Petdex

面向 OpenAI Codex CLI 的动画宠物公共画廊平台

Petdex 是一个面向 OpenAI Codex CLI 的动画宠物公共画廊平台,由 crafter-station 组织维护。它解决了 Codex 宠物散落在 GitHub、Reddit 等各处,缺乏统一浏览、预览和安装入口的问题。平台提供公共画廊,支持按类型、颜色、风格分类浏览,每个宠物可预览所有动画状态。用户可通过 `npx petdex install <name>` 一行命令安装宠物。宠物由社区创作和提交,平台提供自动审核(OpenAI LLM)与人工审核双重机制。此外,平台支持合集(Collections)、排行榜、个人图鉴以及社区宠物请求匹配功能。技术栈为 Next.js 15 + TypeScript + Bun + Drizzle ORM + Neon Postgres + Cloudflare R2 + Clerk 认证,采用 MIT 开源协议。截至 2026 年 5 月,平台已收录 1146+ 个社区提交的宠物。

BunClerkCloudflare R2
09.08
fireworks-tech-graph README 配图
开发工具GitHub 项目

fireworks-tech-graph

用自然语言描述系统,几秒钟生成可嵌入文档的 SVG+PNG 技术图表

Fireworks Tech Graph 是一个专为 Claude Code 设计的开源 Skill,能够将自然语言描述直接转换为生产级质量的 SVG + PNG 技术图表。它支持 8 种图表类型、5 种视觉风格,并内置了深厚的 AI/Agent 领域知识(RAG、Agentic Search、Mem0、Multi-Agent、Tool Call 等)。核心解决的问题是让开发者和技术写作者不用学习任何图表 DSL(如 Mermaid 语法、PlantUML、Graphviz DOT),也不用打开 draw.io 等可视化编辑器,只需要用自然语言描述系统,就能获得出版级的技术图表。它本质上是一套注入到 Claude Code 中的专业绘图知识和规则体系,包含 9 步固定工作流、语义形状系统、语义箭头系统、5 套完整的视觉设计系统、40+ 产品图标库以及 AI/Agent 领域的 7+ 内置架构模式。输出为可编辑的 SVG 文件和 1920px 高清 PNG 文件,完全离线使用,不依赖外部 API 或 CDN。

技术图表开源自然语言生成
09.08
ahang008 的 GitHub 头像ahang008/ah-xhs-cover-title
内容创作GitHub 项目

ah-xhs-cover-title

短视频封面标题生成器,基于85条爆款公式进行可追溯路由匹配

ah-xhs-cover-title 是一款短视频封面标题生成器,由开发者 ahang008(阿航)于 2026 年 4 月 22 日开源发布,以 Claude Code Skill 形式运行。用户输入文章、选题或核心观点后,系统自动从 85 条经过验证的爆款封面公式中进行路由匹配,生成标题和封面三行文案。其核心是双层分类体系(8 种钩子手法 × 6 条内容赛道)和三层路由决策机制(识别赛道、匹配钩子、锁定拆法),每条输出都标注钩子代号和案例编号,实现可追溯。工具支持自然语言反馈迭代(如“再来几条”“换个方向”),并配套四种封面三行拆法模板。项目采用 MIT 协议,即开即用,无需训练。

案例库标题生成短视频
09.08
Guizang PPT Skill README 配图
AI 智能体GitHub 项目

Guizang PPT Skill

将十年设计经验压缩为规则文件,让 AI 按杂志级排版生成单文件网页 PPT

Guizang PPT Skill(magazine-web-ppt)是由设计师歸藏(op7418)开源的一个 Claude Code / AI Agent Skill,用于生成单文件 HTML 横向翻页网页 PPT,视觉基调定位为“电子杂志 × 电子墨水”。它不是一个 PPT 编辑器,而是一套“人 × AI 协作做 PPT”的接口,把十年设计经验压缩成一个 SKILL.md 规则文件,让 AI 按照专业杂志排版规则自动生成网页幻灯片。项目发布于 2026-04-24,采用 MIT 协议,语言为 HTML 100%,拥有 396 Stars 和 60 Forks。核心工作流包括 6 问需求澄清、大纲与叙事弧规划、拷贝模板并选主题色、类名预检与主题节奏规划、挑选布局并填充内容、Checklist 自检。产物为单文件 index.html,浏览器直接打开,零依赖。

单文件应用开源杂志排版
09.08
Hermes Agent 记忆系统 README 配图
AI 智能体GitHub 项目

Hermes Agent 记忆系统

开源 AI Agent 框架 Hermes Agent 内置的多层记忆架构,以缓存优先和冷热分离为核心设计。

Hermes Agent 记忆系统是开源 AI Agent 框架 Hermes Agent(由 Nous Research 开发)内置的多层记忆架构,由四套协同工作的记忆子系统组成。第一层为固化提示词记忆,将高频关键信息存入 MEMORY.md 和 USER.md 文件,合计约 1,300 Token,会话期间固化不变。第二层为会话搜索回溯,历史对话存储在 SQLite 数据库中,通过 FTS5 全文搜索按需检索,并使用辅助模型进行摘要。第三层为技能系统,用于记住如何做事的程序记忆,技能文件存储在 ~/.hermes/skills/ 目录。第四层为可选的 Honcho 用户建模,用于跨会话、跨平台的深层用户画像。该系统的核心设计思想是缓存优先,保持系统提示词前缀稳定以最大化利用 Prompt Caching,同时采用冷热分离策略,只保存用户偏好、环境事实、错误修正、稳定规范和学到的技能五类高价值信息。

分层记忆缓存优化记忆系统
09.08
开发工具主题配图

DesignMD & DESIGN.md 设计系统提取

从任意网站提取设计规范,生成 AI 可读的 DESIGN.md 文件

DesignMD 是一款由 Crowdlinker 开发的 AI 驱动设计系统提取工具,用户输入任意网站 URL 或描述项目需求,即可自动生成符合 Google Stitch DESIGN.md 规范的完整设计系统文档。DESIGN.md 是 Google Stitch 项目提出的一种纯 Markdown 格式的设计系统文档,AI 编码代理可以直接阅读并据此生成一致的 UI。配套的 awesome-design-md 是由 VoltAgent 维护的开源仓库,收录了 68 个全球顶级品牌的现成 DESIGN.md 文件,Star 数达 57.6k,MIT 协议开源。该工具免费使用,无需注册,打开即用。核心价值在于让 AI 编码工具(如 Cursor、Claude Code)能“看懂”设计意图并复刻 UI。

开源逆向工程设计提取
09.08
AI 智能体主题配图

CUA Computer-Use Agents

开源全平台 AI 桌面操控基础设施,沙盒隔离、后台驱动、模型无关

CUA(Computer-Use Agents)是由 trycua 组织开发的开源基础设施项目,为 AI Agent 提供「像人一样操控电脑」的完整能力栈,覆盖 macOS、Linux、Windows、Android 全平台。项目提供沙盒环境、Agent SDK、桌面驱动、基准测试和虚拟化工具,核心组件包括 Cua Driver(macOS 后台桌面驱动)、Cua Sandbox(跨 OS 沙盒环境)、CuaBot(多 Agent 协作沙盒 CLI)、Cua-Bench(基准测试与 RL 环境)、Lume(Apple Silicon 虚拟化管理)和 Lumier(Docker 兼容接口)。CUA 的设计强调沙盒优先、一个 API 覆盖所有平台、后台驱动不抢光标、模型无关、云加本地双模式以及内置可观测性。它通过统一的 Sandbox API 抽象了 Docker、QEMU、Apple Virtualization.Framework 等底层虚拟化技术,并支持 Claude、GPT、Gemini、Qwen 等主流视觉语言模型。项目采用 MIT 许可证,本地使用免费,云沙盒提供免费额度和按量付费选项。

跨平台沙盒虚拟化
09.08
Cult UI README 配图
开发工具GitHub 项目

Cult UI

面向 Design Engineer 的开源动效组件集,通过源码复制模式扩展 shadcn/ui 生态

Cult UI 是 nolly-studio 开发的开源前端组件集,提供 60+ 动效丰富、可定制的 UI 组件,兼容 shadcn/ui 生态,采用"复制即拥有"的分发模式。它解决的核心问题是 shadcn/ui 只提供无样式底层原语,当产品需要"好看"和"有动效"的组件时,开发者需从零编写。Cult UI 通过 shadcn registry CLI 分发源码,组件代码复制到项目后完全归开发者所有,可自由定制。技术栈为 React + TypeScript + Tailwind CSS v4 + motion。项目还提供 AI SDK Agents(92+ 免费 Agent 模式)、Cult Pro(129 个付费 Block 和 10 个 Starter Template)以及 MCP Server,覆盖从组件到产品的完整链路。

动效开源MIT
09.08