跳到主要内容
prolist.
发现项目AI 收集我的项目我的模型
正在确认账号…
prolist.

发现有价值的项目,留下有依据的判断。

项目专题关于我的收藏
© 2026 prolist项目知识,由人判断。

IDEAS CONNECT PROJECTS

沿着兴趣,发现项目。

从一个标签出发,打开一份值得研究的档案。

收集项目线索
筛选与排序 · 已应用
地图列表
不限标签10React9TypeScript5开源4FastAPI3Tauri3桌面应用2AI视频生成2Claude Agent SDK2MIT2Python2Rust2SQLite2

项目搜索结果

找到 10 个项目

清除筛选

以下内容已由 AI 根据历史资料整理,供本地测试,未经人工复核。

Voicebox README 配图
内容创作GitHub 项目

Voicebox

本地优先的开源语音合成工作站,集成多引擎声音克隆、情感标签、后处理音效与多轨编辑

Voicebox 是由 Jamie Pine 开发的开源语音合成工作室,定位为 ElevenLabs 的免费本地替代方案。它是一个完整的桌面应用,集声音克隆、语音生成、后处理特效、多轨编辑于一体,所有模型和数据完全在本地运行。项目采用 Tauri (Rust) 桌面框架,前端使用 React + TypeScript,后端为 Python (FastAPI),音效处理由 Spotify pedalboard 驱动。内置 5 个 TTS 引擎,支持 23 种语言,最大文本长度 50,000 字符,并提供完整 REST API 供外部集成。核心能力包括多引擎声音克隆、情感表达控制(如 [laugh]、[sigh] 等副语言学标签)、8 种后处理音效、多轨时间轴编辑(Stories Editor)以及长文本自动分段与交叉淡入淡出拼接。项目采用 MIT 协议完全开源,支持 CUDA、ROCm、MLX、DirectML、XPU 及 CPU 等多种 GPU 后端。

本地优先声音克隆FastAPI
09.08
PromptLens README 配图
内容创作GitHub 项目

PromptLens

开源 AI 视频提示词反推分析工具,自动提取关键帧并生成结构化提示词

PromptLens 是一款开源的 AI 视频提示词反推分析工具,提供完整的 Web 应用体验。其核心能力是上传 AI 生成的视频或图片,自动提取关键帧,通过多模态大模型(如智谱 GLM-4V、Google Gemini、OpenRouter)分析画面内容,反向推导出可能使用的提示词,并输出结构化的、可直接复用的英文提示词。项目采用 Next.js 15 + React 19 全栈技术,使用 Supabase PostgreSQL 存储数据,Cloudflare R2 存储媒体文件,FFmpeg 进行视频帧提取,支持 better-auth 的 Google/GitHub 登录。除画面分析外,还支持通过 AssemblyAI 进行音频识别,提取视频中的语音旁白和台词。项目以 MIT 许可证开源,代码透明,可自由修改和商用。

多模态大模型开源提示词反推
09.08
LLM Wiki Desktop (nashsu/llm_wiki) README 配图
知识管理GitHub 项目

LLM Wiki Desktop (nashsu/llm_wiki)

一款将文档编译为结构化、互相关联知识库的跨平台桌面应用

LLM Wiki 是一款跨平台桌面应用,由开发者 nashsu(Yong Su)基于 Andrej Karpathy 提出的 LLM Wiki 模式构建,将抽象设计模式转化为功能完整的桌面软件,能够自动将文档转化为结构化、互相关联的知识库。其核心定位是编译式知识管理,区别于传统 RAG 的检索式模式。应用采用三层架构(Schema 层、Wiki 层、Raw 层),支持 Ingest、Query、Lint 三大核心操作。其关键创新是 Two-Step Chain-of-Thought Ingest,将单步摄取拆分为分析和生成两步,以提升页面质量。知识图谱采用四信号模型(直接链接、来源重叠、共同邻居、类型亲和)并结合 Louvain 社区检测。查询采用多阶段检索管线,包含分词搜索、可选向量搜索、图谱扩展和预算控制。应用支持多格式文档导入、Chrome 扩展 Web Clip、Deep Research 等功能,数据完全本地化,Wiki 目录兼容 Obsidian。

知识管理知识图谱桌面应用
09.08
开发工具主题配图

skills-manage

一个界面统一管理 28+ 个 AI 编程代理平台 Skills 的跨平台桌面应用

skills-manage 是一款基于 Tauri v2 的跨平台桌面应用,用于在一个统一界面中管理 28+ 个 AI 编程代理(Coding Agent)平台的 Skills(技能/插件)。它由社区开发者志辉(@iamzhihuix)开发,于 2026 年 4 月 20 日发布首个公开版本 v0.8.0,采用 Apache 2.0 开源协议。该应用通过“中央技能库 + 符号链接分发”的机制,将 Skills 统一存放在 `~/.agents/skills/` 目录,并通过 symlink 链接到各平台目录,实现零副本、零同步延迟的管理。它内置 Skills 市场,支持从 GitHub 仓库一键导入,并提供 AI 自动解释功能以降低理解门槛。应用采用本地优先策略,所有数据存储在本地 SQLite 中,无需账号和云服务。当前预编译包仅支持 macOS,Windows/Linux 需从源码构建。

技能管理开源桌面应用
09.08
ArcReel README 配图
内容创作GitHub 项目

ArcReel

AI Agent 驱动的开源小说视频生成工作台

ArcReel 是一个开源的 AI 视频生成工作台,由 AI Agent 全程驱动,能够将小说文本自动转化为完整的短视频。其完整工作流为:小说 → 角色/场景/道具设计 → 剧本 → 分镜图 → 视频片段 → 最终成片。它本身不训练模型,而是通过统一的抽象层集成 Google Gemini、火山方舟、xAI Grok、OpenAI 等多个 AI 供应商,用 Agent 智能体协调完成从文本到视频的端到端生产流程。项目采用 React 19、Python 3.12+ / FastAPI、Claude Agent SDK 等技术栈,支持 SQLite 与 PostgreSQL 数据库,可通过 Docker 一键部署。ArcReel 旨在解决 AI 视频生成中角色一致性、场景连贯性、分镜拆分、多供应商调度与任务编排等工程问题,将传统人工串联多个 AI 工具的制作流程,转变为 Agent 自动编排与人工确认相结合的标准化流水线。

多模态生成Agent编排AI视频生成
09.08
yetone 的 GitHub 头像yetone/native-feel-skill
AI 智能体GitHub 项目

Native Feel Skill - 跨平台桌面应用原生体验架构

一套让 WebView 渲染的 UI 无法被用户分辨为原生应用的 AI Agent 技能包

Native Feel Skill 是一个 AI Agent 技能包,由开发者 yetone 创建,将 Raycast 2.0 的跨平台桌面应用架构经验提炼为可复用的结构化领域知识。它包含 8 条架构准则、四层架构方案(原生外壳 → 系统 WebView → Node 后端 → Rust 内核)、WebKit/WebView2 生存指南、75 项上线检查清单、IPC 契约设计指南、内存真相手册及 Raycast Beta 逆向证据。该技能包主要解决跨平台桌面开发中开发效率与原生性能不可兼得的问题,通过精确定义共享与原生边界,在 WebView 渲染表面画线,上方共享 React/TS 代码,下方使用原生 Swift/C#,让用户无法分辨是否为原生应用。安装到 Claude Code、Cursor 等兼容 AI Agent 后,讨论跨平台桌面应用架构时自动激活,提供架构建议、问题诊断和优化方案。

技能包架构跨平台桌面
09.08
Magic Resume README 配图
内容创作GitHub 项目

Magic Resume

开源在线 AI 简历编辑器,所见即所得,数据本地存储

Magic Resume 是一款开源的在线 AI 简历编辑器,由开发者 Siyue 创建并维护。它提供所见即所得的编辑体验,左侧编辑内容,右侧实时预览最终效果。所有简历数据存储在浏览器 localStorage,不上传服务器,从根本上解决隐私问题。内置 AI 辅助写作,支持 Gemini、DeepSeek、豆包等多个大模型,可进行内容润色、语法检查和简历导入。基于 TanStack Start、Tiptap v3、Zustand 等现代技术栈构建,支持多套模板和深色模式。PDF 导出时自动调整字号和间距,确保简历恰好一页。采用 Apache 2.0 开源协议,个人使用免费,商业使用需单独授权。支持 Docker 一键部署,无需数据库和后端。

简历编辑器开源AI辅助
09.08
内容创作主题配图

AI短剧精细化制作开源工作流

开源工具链将AI短剧生产从一键生成升级为逐镜头可控的工业化流水线

AI短剧精细化制作工作流利用开源工具链,将剧本解析、角色与场景一致性管理、分镜编辑、视频生成和后期剪辑串联成一条可精细调控的工业化生产线。与粗放式一键生成方案不同,它强调逐镜头控制和全流程可回溯,让创作者能对每个分镜的景别、运镜、情绪、时长、氛围进行精确调整,最终输出商用品质的竖屏短剧。报告覆盖两个代表性开源项目:Jellyfish AI短剧工厂主打人物一致性和精控镜头,从剧本到后期全闭环;Toonflow主打智能剧本改编和无限画布工作台,适合小说IP转视觉内容。两者均属于AI视频生成加工作流编排技术体系,为AI视频生成能力增加导演级控制力和制片级管理能力。

短剧制作分镜控制工作流编排
09.08
Cult UI README 配图
开发工具GitHub 项目

Cult UI

面向 Design Engineer 的开源动效组件集,通过源码复制模式扩展 shadcn/ui 生态

Cult UI 是 nolly-studio 开发的开源前端组件集,提供 60+ 动效丰富、可定制的 UI 组件,兼容 shadcn/ui 生态,采用"复制即拥有"的分发模式。它解决的核心问题是 shadcn/ui 只提供无样式底层原语,当产品需要"好看"和"有动效"的组件时,开发者需从零编写。Cult UI 通过 shadcn registry CLI 分发源码,组件代码复制到项目后完全归开发者所有,可自由定制。技术栈为 React + TypeScript + Tailwind CSS v4 + motion。项目还提供 AI SDK Agents(92+ 免费 Agent 模式)、Cult Pro(129 个付费 Block 和 10 个 Starter Template)以及 MCP Server,覆盖从组件到产品的完整链路。

动效开源MIT
09.08
claude-mem README 配图
开发工具GitHub 项目

claude-mem

为 Claude Code 提供跨会话持久记忆的插件,自动观察、压缩并注入上下文。

Claude-Mem 是一个为 Claude Code 设计的持久化记忆压缩系统,以插件形式运行。它通过生命周期钩子自动捕获 Claude Code 在编码会话中的所有工具使用行为,利用 Claude Agent SDK 对这些观察数据进行 AI 压缩提炼,生成语义摘要,并在未来的会话中自动注入相关上下文。其核心管线为“观察-压缩-注入”,由 6 个 Hook 覆盖会话生命周期,Worker 服务负责异步处理和 AI 压缩,数据存储采用 SQLite、FTS5 和可选的 ChromaDB 三层架构。系统支持渐进式披露检索,通过 mem-search Skill 或 MCP 工具实现约 10 倍的 token 节省。安装后全自动运行,无需手动操作,并支持通过标签排除敏感内容。

BunChromaDBClaude Agent SDK
09.08