跳到主要内容
prolist.
发现项目AI 收集我的项目我的模型
正在确认账号…
prolist.

发现有价值的项目,留下有依据的判断。

项目专题关于我的收藏
© 2026 prolist项目知识,由人判断。

IDEAS CONNECT PROJECTS

沿着兴趣,发现项目。

从一个标签出发,打开一份值得研究的档案。

收集项目线索
筛选与排序 · 已应用
地图列表
不限标签4开源3多语言2社区驱动2多模态1精选合辑1声音克隆1视频配音1提示词1提示词库1图像生成1文本转语音1文字渲染1

项目搜索结果

找到 4 个项目

清除筛选

以下内容已由 AI 根据历史资料整理,供本地测试,未经人工复核。

Voice-Pro README 配图
内容创作GitHub 项目

Voice-Pro

一站式 AI 语音工作台,从视频下载到多语言配音全流程自动化

Voice-Pro 是一款面向创作者和开发者的 AI 音频全流程处理工具,由韩国创业公司 ABUS 开发,基于 Gradio WebUI 构建。它将视频下载、音频分离、语音识别、多语言翻译、文本转语音(TTS)和零样本声音克隆集成到一个统一的 Web 界面中,定位为 ElevenLabs 的开源替代方案。核心价值在于将传统需要 5-8 个工具配合的流程(下载、分离、识别、翻译、配音、字幕)串联成一条自动化管道,用户只需输入视频链接,即可获得多语言配音视频和字幕。工具支持四种 Whisper 变体用于语音识别,三种零样本声音克隆引擎(F5-TTS、E2-TTS、CosyVoice),以及 Edge-TTS、kokoro 等多语言 TTS。完全开源免费,本地运行,数据不出机器。需要 NVIDIA GPU(最低 4GB 显存,推荐 8GB+),首次部署需下载模型,耗时较长。

开源声音克隆视频配音
09.08
内容创作主题配图

YouMind GPT Image 2 提示词库

社区驱动的 GPT Image 2 提示词策展平台,提供已验证提示词与多语言支持

YouMind GPT Image 2 提示词库是一个由 YouMind 团队维护的社区驱动型 AI 图像提示词集合平台,覆盖 OpenAI GPT Image 2 模型。截至 2026 年 4 月 21 日,平台已收录 725+ 条提示词,并以每日更新的速度持续增长。平台提供 Web Gallery 和 GitHub 开源仓库两种使用方式,支持 16 种语言版本,采用 CC BY 4.0 开源协议。核心功能包括瀑布流布局、全文搜索、分类筛选、AI 一键生成以及社区投稿系统。平台从用途、风格、主体三个维度对提示词进行分类,共 44+ 个类别。此外,部分提示词支持 Raycast Snippets 集成,便于用户模板化使用。平台通过 GitHub Actions 每 12 小时自动同步更新,确保内容时效性。

多语言开源社区驱动
09.08
内容创作主题配图

GPT-image2(OpenAI 图像生成模型)

OpenAI 第二代原生图像生成模型,以 Transformer 端到端架构实现印刷级文字渲染与 UI 仿真。

GPT-image2 是 OpenAI 推出的第二代原生图像生成模型,模型 ID 为 gpt-image-1.5,属于 GPT 多模态模型家族中专门负责图像输出的成员。与 DALL·E 系列不同,它不是独立的扩散模型,而是直接嵌入在 GPT 推理架构中的图像生成能力,用同一个 Transformer 做文本理解和图像输出。该模型解决的核心问题是让 AI 生成的图片不再“一眼假”,在文字渲染、UI 仿真、细节精度、多语言支持等方面实现了跨越式提升。其核心优势包括:文字渲染达到印刷级精度,能精确模拟 App 界面、网页截图、后台管理面板,支持中文等多语言原生理解,并支持对话式迭代修改。模型通过 Responses API 和 Chat Completions API 接入,适合海报、UI 截图、试卷、书法、架构图等精确性场景。其局限包括成本较高(标准输入每张 8 美元)、生成速度较慢、审美需精细 Prompt 控制、无本地部署选项。

多模态图像生成文字渲染
09.08
EvoLinkAI 的 GitHub 头像EvoLinkAI/awesome-gpt-image-2-API-and-Prompts
内容创作GitHub 项目

awesome-gpt-image-2-prompts

GPT Image-2 提示词社区精选百科,收录 31+ 条真实案例与五大类别

awesome-gpt-image-2-prompts 是由 EvoLinkAI 团队维护的 GPT Image-2 提示词精选合辑,托管在 GitHub 上,采用 CC BY 4.0 协议开源。项目定位为 GPT Image-2 提示词的百科全书式参考库,收录人像摄影、海报插画、角色设计、UI 仿真、社区实验等五大类别的真实提示词与生成效果图。截至 2026.4.19,收录 31+ 条精选案例,来自 X/Twitter、创作者社区和公开演示。项目提供 11 种语言版本,持续更新。核心理念是"真实案例 > 理论指导",强调提示词原汁原味、图证合一、创作者溯源。项目还提炼了五种提示词写作模式,包括摄影参数式、设计需求式、规格清单式、场景仿真式和极简指令式,帮助用户理解和掌握 GPT Image-2 提示词的写法。

多语言精选合辑开源
09.08