跳到主要内容
prolist.
发现项目AI 收集我的项目我的模型
正在确认账号…
prolist.

发现有价值的项目,留下有依据的判断。

项目专题关于我的收藏
© 2026 prolist项目知识,由人判断。

IDEAS CONNECT PROJECTS

沿着兴趣,发现项目。

从一个标签出发,打开一份值得研究的档案。

收集项目线索
筛选与排序
地图列表
不限标签115开源34AI Agent33Python23提示词工程13Claude Code13TypeScript12LLM11Markdown10MIT10React9知识管理8AI图像生成8

项目搜索结果

共 115 个项目

以下内容已由 AI 根据历史资料整理,供本地测试,未经人工复核。

guizang-ppt-skill 歸藏PPT Skill README 配图
AI 智能体GitHub 项目

guizang-ppt-skill 歸藏PPT Skill

将十年设计经验编码为规则,让 AI 生成专业级 HTML 演示文稿的开源技能

guizang-ppt-skill 是由设计师歸藏开发的开源 AI Agent 技能,用于在 Claude Code、Codex 等环境中生成专业级横向翻页 HTML 演示文稿。它通过 SKILL.md 定义工作流和约束,将设计经验转化为自然语言硬规则,让 AI 在约束内执行,而非自由发挥。项目提供两套视觉系统:电子杂志风(Style A)适合叙事与个人风格,瑞士国际主义风(Style B)适合事实、产品与分析。瑞士风包含 22 种锁定版式、16 列网格和自动校验脚本,确保版式合规。核心设计决策包括不允许自定义颜色、单一视觉锚点、结构优于装饰等。此外,项目支持在 Codex 环境中通过 GPT-Image 2.0 生成配图,并可生成多平台封面(如公众号 21:9、小红书 3:4、视频号 16:9),实现从大纲到 PPT、配图、封面的全链路闭合。项目以 MIT 协议开源,GitHub 上获得 7.2k+ Stars。

开源设计系统AI Agent Skill
09.08
知识管理主题配图

知识检索技术全景对比

从传统RAG到LLM Wiki,一文看懂五大知识检索技术流派

本文档是一份关于知识检索技术的深度对比指南,系统梳理了当前领域的五大技术流派:传统RAG、PageIndex、SirChmunk、MinerU和LLM Wiki。文档从技术概述、问题背景、核心思想、核心原理、系统架构、关键流程、技术关系、应用场景、工程落地、优缺点与适用边界等多个维度进行了全面分析。文档指出,传统RAG存在语义碎片化、静态索引僵化、近似匹配不等于真正相关、文档解析能力弱、知识不累积等五大结构性缺陷。针对这些痛点,PageIndex通过构建文档语义树实现推理式树搜索,SirChmunk采用无索引实时扫描与自进化缓存,MinerU作为文档解析上游基础设施提供高质量输入,LLM Wiki则通过编译式知识管理实现知识累积复利。文档强调,未来知识检索一定是混合方案,根据查询类型自动选择检索策略,没有银弹。

第 1 页第 2 页第 3 页第 4 页第 5 页
文档解析知识管理知识检索
09.08
GStack README 配图
开发工具GitHub 项目

GStack

Claude Code 的虚拟工程团队,23 个角色斜杠命令即用

GStack 是围绕 Claude Code 构建的开源工具体系,定位为“虚拟工程团队”,通过 23 个角色 Skill 和 8 个工具 Skill,将 Claude Code 配置成 CEO、设计师、工程经理、QA、安全官等角色自动协作。其核心原理是角色化 Slash Command 系统,每个斜杠命令对应一个工程角色,如 /review 为代码审查员、/qa 为测试工程师。GStack 支持多 Agent 兼容,不只支持 Claude Code,还支持 Codex CLI、Cursor、OpenCode、Kiro 等 8 个 AI 编码 Agent。安装结构为纯 Markdown 文件,没有代码依赖和框架锁定,通过 ./setup --team 可让整个团队共享同一套工具,自动更新,零版本漂移。报告提及 Garry Tan 本人 60 天写了 60 万行代码(35% 测试),日均 10-20k 行,作为真实验证过的产出数据。

安全审计代码审查发布流程
09.08
Claude Code Best Practice README 配图
开发工具GitHub 项目

Claude Code Best Practice

Claude Code 的“使用说明书”——系统化的技能、代理、命令最佳实践

Claude Code Best Practice 是一套围绕 Claude Code 构建的开源工具体系,定位为 Claude Code 的“使用说明书”,提供系统化的技能、代理、命令最佳实践。它旨在解决 Claude Code 功能丰富但官方文档分散、缺乏“什么场景用什么方案”决策指导的问题。项目采用 Commands → Agents → Skills 三层编排,简单任务用 Commands,复杂任务用 Agents,可复用能力用 Skills;并采用 Best Practice + Implementation 双轨制,每个功能都有最佳实践文档和实际实现代码。项目汇集了 Everything Claude Code、Superpowers、Spec Kit 等社区顶级方案,提供场景驱动、对比矩阵式的决策指导,帮助开发者降低学习曲线,提升功能利用率。

工作流知识库最佳实践
09.08
内容创作主题配图

YouMind GPT Image 2 提示词库

社区驱动的 GPT Image 2 提示词策展平台,提供已验证提示词与多语言支持

YouMind GPT Image 2 提示词库是一个由 YouMind 团队维护的社区驱动型 AI 图像提示词集合平台,覆盖 OpenAI GPT Image 2 模型。截至 2026 年 4 月 21 日,平台已收录 725+ 条提示词,并以每日更新的速度持续增长。平台提供 Web Gallery 和 GitHub 开源仓库两种使用方式,支持 16 种语言版本,采用 CC BY 4.0 开源协议。核心功能包括瀑布流布局、全文搜索、分类筛选、AI 一键生成以及社区投稿系统。平台从用途、风格、主体三个维度对提示词进行分类,共 44+ 个类别。此外,部分提示词支持 Raycast Snippets 集成,便于用户模板化使用。平台通过 GitHub Actions 每 12 小时自动同步更新,确保内容时效性。

多语言开源社区驱动
09.08
AI Animation README 配图
内容创作GitHub 项目

AI Animation

用 Prompt 模板驱动 AI 生成 HTML 动画的示例与模板集合

AI Animation 是一个由 Unclecheng 开发的 AI Prompt 模板集合项目,专注于用 AI 生成炫酷的 HTML 动画网页。项目包含分类整理的 Prompt 模板、多种预置 HTML 动画示例(技术可视化、PPT 模板、3D 效果等),配合 Trae、Claude、GPT-4o 等 AI 工具使用。项目定位为 AI 辅助内容创作与教育可视化,目标用户包括教育者、内容创作者和技术博主。核心能力包括技术概念可视化、PPT 风格模板、3D 效果演示、UI 参考重构以及纯前端零依赖实现。所有动画示例基于 HTML5、CSS3 和原生 JavaScript,不依赖任何外部库。项目提供 40+ 个预置 HTML 动画文件,涵盖网络协议、AI/ML 概念、PPT 模板等类别,可直接在浏览器中打开使用。项目采用 MIT 协议,但明确仅限学习研究,禁止商业用途。

3D 效果纯前端教育可视化
09.08
Yeachan-Heo 的 GitHub 头像Yeachan-Heo/oh-my-codex
AI 智能体GitHub 项目

OMX (Oh My Codex)

为 OpenAI Codex CLI 提供结构化工作流、多 Agent 协作与持久化状态管理的开源增强层。

OMX(Oh My Codex)是 OpenAI Codex CLI 的工作流增强层,它不替代 Codex,而是在其上叠加结构化工作流、多 Agent 协作、持久化状态管理和专业角色系统。它主要解决 Codex CLI 缺乏结构化工作流、多任务并行时缺少团队协调机制、项目状态与计划无法跨会话持久化、缺少专业角色分工等问题。其核心是四个 Skill:$deep-interview 用于澄清需求边界,$ralplan 用于生成并审批实现计划,$ralph 用于单人持续执行到完成,$team 用于基于 tmux 的多 Agent 并行执行。所有计划、日志、记忆和运行时状态都持久化在项目本地的 .omx/ 目录中,并通过 Codex 原生的 .codex/hooks.json 机制集成。OMX 主要针对 macOS/Linux 平台优化,并锁定 OpenAI Codex 生态。

多Agent协作工作流增强状态持久化
09.08
AI 智能体主题配图

B.AI

为 AI Agent 提供身份、支付与技能的全景金融基础设施平台

B.AI 定位为 AI Agent 经济时代的基础设施层,于 2026 年 4 月 10 日正式上线。其核心产品包括 LLM Service、x402 协议、8004 协议、Skills 与 BAIclaw 桌面终端。LLM Service 聚合 GPT、Claude、Gemini、DeepSeek 等 15+ 模型,提供统一 OpenAI 兼容 API 与智能路由;x402 协议基于 HTTP 402 标准实现「响应前付费」的自动链上支付;8004 协议为每个 Agent 铸造链上身份并记录信用档案;Skills 将 DeFi 交易、支付、数据分析等操作封装为标准化模块;BAIclaw 提供开箱即用的桌面级 Agent 客户端。平台支持 TRON、BNB Chain、Ethereum 三条公链,支持 Web3 钱包匿名登录,无需 KYC。报告同时指出其生态处于早期,存在加密货币门槛、合规风险、仅支持 macOS 桌面端等局限。

多模型路由金融基础设施区块链
09.08
内容创作主题配图

GPT-image2(OpenAI 图像生成模型)

OpenAI 第二代原生图像生成模型,以 Transformer 端到端架构实现印刷级文字渲染与 UI 仿真。

GPT-image2 是 OpenAI 推出的第二代原生图像生成模型,模型 ID 为 gpt-image-1.5,属于 GPT 多模态模型家族中专门负责图像输出的成员。与 DALL·E 系列不同,它不是独立的扩散模型,而是直接嵌入在 GPT 推理架构中的图像生成能力,用同一个 Transformer 做文本理解和图像输出。该模型解决的核心问题是让 AI 生成的图片不再“一眼假”,在文字渲染、UI 仿真、细节精度、多语言支持等方面实现了跨越式提升。其核心优势包括:文字渲染达到印刷级精度,能精确模拟 App 界面、网页截图、后台管理面板,支持中文等多语言原生理解,并支持对话式迭代修改。模型通过 Responses API 和 Chat Completions API 接入,适合海报、UI 截图、试卷、书法、架构图等精确性场景。其局限包括成本较高(标准输入每张 8 美元)、生成速度较慢、审美需精细 Prompt 控制、无本地部署选项。

多模态图像生成文字渲染
09.08
知识管理主题配图

横纵分析法深度研究方法论

一套结合纵向时间线与横向竞品对比的AI驱动深度研究框架

横纵分析法是由自媒体人“数字生命卡兹克”提出并开源的一套通用深度研究方法论与AI Prompt框架,核心理念来自语言学(索绪尔的历时/共时分析)和社会科学(纵向/横截面研究),经过作者在金融行业多年实战打磨,再结合AI深度研究能力封装而成。它通过纵向(时间维度)和横向(截面维度)两条分析轴交叉还原研究对象的完整面貌,配合AI模型的Deep Research功能,能在约30分钟内生成一份1-2万字的系统性研究报告。该方法论旨在解决传统深度研究中信息碎片化、质量参差不齐、缺乏时间纵深感、横向对比缺失以及AI生成报告质量不稳定等痛点,提供可复用、结构化、AI友好的研究流水线。框架包含纵向分析、横向分析和写作风格引擎三个核心模块,适用于快速了解陌生技术、行业竞品分析、投资标的研究、跨领域学习等多种场景。

横向分析开源深度研究
09.08
AI 智能体主题配图

Claude Code AI Agent 生态工具全景(Best Practice + GBrain + GStack)

围绕 Claude Code 的开源工具体系,覆盖最佳实践、个人知识记忆与虚拟工程团队三大维度

该收藏条目围绕 Claude Code 构建的开源工具体系展开,涵盖最佳实践知识库、个人知识大脑和虚拟工程团队三大维度。报告指出,Claude Code 功能丰富但官方文档分散,缺乏场景决策指导;AI Agent 缺乏记忆,无法积累个人知识;个人开发者缺少团队级工程保障。针对这些问题,Best Practice 提供功能-场景-工具三维决策矩阵,指导用户选择 Commands、Skills、Agents 等扩展机制;GBrain 通过 Markdown 知识库、混合检索和实体图谱,实现“读-答-写-同步”的知识积累循环;GStack 提供 23 个角色 Skill 和 8 个工具 Skill,以斜杠命令形式模拟虚拟工程团队。三者可独立使用,组合使用效果最大化。报告还包含安装部署、应用场景及与相似技术的对比。

混合检索虚拟工程团队知识管理
09.08
其他项目主题配图

软路由搭建

在网关层统一实现透明代理、DNS分流与广告拦截的软路由搭建指南

本指南以磊科N60Pro刷ImmortalWRT并安装OpenClash为具体方案,讲解从零搭建软路由的完整流程。软路由使用通用硬件与开源固件替代传统硬路由,在路由器层面统一解决代理、去广告、DNS分流等网络问题,所有设备连接WiFi即自动生效,无需逐台安装客户端。指南覆盖刷机流程、透明代理原理、DNS分流机制、硬件选购、配置要点、安全注意事项及常见误区,并对比了软路由与硬路由、主路由与旁路由、ImmortalWRT与OpenWRT等方案的差异。内容基于历史报告整理,未核实为事实,仅供学习参考。

软路由刷机透明代理
09.08
anthropics 的 GitHub 头像anthropics/claude-for-legal
AI 智能体GitHub 项目

Claude for Legal

Anthropic 官方法律工作流 AI 插件套件,覆盖 12 个业务领域

Claude for Legal 是 Anthropic 官方推出的法律工作流 AI 插件套件,为法律行业提供覆盖 12 个业务领域的专业化 AI Agent 能力。它不是单一产品,而是一套参考实现,包含预构建的 Agent、Skill、数据连接器和托管 Agent 范本,律师和法务团队可以直接安装使用,也可以基于自身业务定制。核心机制是冷启动面试,通过结构化面试学习团队业务规则并生成实践配置文件(Practice Profile),后续所有 Skill 都会读取该配置。插件通过 MCP 连接器对接真实法律数据库,确保引用可验证;没有连接器时,引用会被标记为 [verify],提醒律师必须人工验证。所有输出均为供律师审查的草稿,内置审查门控,不替代律师判断。项目采用 Apache 2.0 开源许可证,支持 Claude Cowork、Claude Code 和 Managed Agent 三种运行模式。

插件法律工作流
09.08
开发工具主题配图

Ghostty终端配置与CLI工具链

一套从 iTerm2 + oh-my-zsh 迁移到轻量化现代终端方案的完整实践

这是一套从 iTerm2 + oh-my-zsh 迁移到轻量化现代终端方案的完整实践,由三层组成:Ghostty(Zig 语言编写的 GPU 加速终端模拟器)、Starship(Rust 编写的跨平台提示符工具)、zsh 插件与现代 CLI 工具。方案核心目标是更轻量、更快、更简洁,去掉不需要的 300 个 oh-my-zsh 插件和 iTerm2 的臃肿 GUI,只保留日常真正用到的 3 个 zsh 插件和 5 个现代 CLI 工具。Ghostty 使用 Metal API 进行 GPU 渲染,文本渲染速度比 iTerm2 快约 4 倍,配置保存即生效。Starship 采用模块化渲染引擎,每个模块独立计算、独立配色。三个 zsh 插件(autosuggestions、syntax-highlighting、completions)替代整个 oh-my-zsh 框架。五个现代 CLI 工具(fzf、zoxide、eza、bat、yazi)全面替代传统 Unix 命令。方案支持一键安装,配置全部开源,可纳入 dotfiles 版本管理。

终端模拟器CLI工具Ghostty
09.08
SoftwareCopyright-Skill README 配图
AI 智能体GitHub 项目

SoftwareCopyright-Skill

开源 Codex Skill,自动生成中国软著申请全套材料

SoftwareCopyright-Skill 是一个开源 Codex Skill,用于自动生成中国软件著作权申请材料。它通过阅读开发者真实项目源码,自动生成申请表信息、操作手册和代码鉴别材料,全部输出为 Word/TXT 格式。项目采用 MIT 协议,完全免费,旨在替代付费代办服务。核心功能包括自动分析项目源码、生成符合要求的操作手册、生成前 30 页和后 30 页代码鉴别材料、生成申请表辅助填报文件。代码材料只来自真实项目,禁止 AI 编造。关键节点设置人工确认门禁,确保材料准确性。支持基础 DOCX 和完整 OpenXML 两种生成路径。项目属于 AI Agent 与法律合规自动化交叉领域,面向中国开发者。

软著申请文档生成自动化
09.08
其他项目主题配图

Supertonic vs MOSS-TTS-Nano 开源轻量级 TTS 深度对比

对比两款开源轻量级 TTS:Supertonic 跨平台部署,MOSS-TTS-Nano 零样本声音克隆

本文档对比两款开源轻量级 TTS 系统:Supertonic 与 MOSS-TTS-Nano。Supertonic 由 Supertone Inc. 开发,基于 ONNX Runtime 完全本地运行,约 99M 参数,支持 31 种语言,提供 11 种语言 SDK,采用 Flow Matching 与语音自编码器架构,代码 MIT 许可,模型 OpenRAIL-M。MOSS-TTS-Nano 由 MOSI.AI 和复旦大学 OpenMOSS 团队开发,仅 0.1B 参数,基于 Audio Tokenizer + LLM 纯自回归架构,支持实时流式推理,可在 4 核 CPU 上运行,支持零样本声音克隆,输出 48kHz 立体声,Apache-2.0 许可。两者均解决传统 TTS 的部署、质量、工程与生态痛点,但侧重点不同:Supertonic 适合跨平台部署与极低资源设备,MOSS-TTS-Nano 适合声音克隆与中文 TTS。文档还包含架构原理、系统架构、关键流程、应用场景、优缺点与选型建议。

端侧推理声音克隆语音合成
09.08
minimind README 配图
其他项目GitHub 项目

minimind

从零开始用 PyTorch 原生实现并训练 GPT 风格语言模型的开源项目

MiniMind 是一个开源项目,目标是从绝对零开始训练一个 GPT 风格的语言模型。项目没有使用任何第三方框架的高级抽象,所有核心算法代码均使用 PyTorch 原生实现,开发者可以逐行阅读、理解、修改每一处计算逻辑。项目覆盖了从预训练、SFT 到 DPO 的完整训练链路,并支持推理、多模态、工具调用等能力。其最小模型为 26M 参数,最低硬件要求为单张 NVIDIA 3090,最短训练时间约 2 小时。项目强调“大道至简”的理念,不追求 SOTA,而是追求“最小可理解”,旨在帮助开发者理解 LLM 的每个组件如何工作。同时,项目兼容 llama.cpp、vllm、ollama 等推理部署方案,并兼容 OpenAI API,可接入 FastGPT、Open-WebUI。

预训练DPOLLM
09.08
Huobao Drama 火宝短剧 README 配图
内容创作GitHub 项目

Huobao Drama 火宝短剧

一站式 AI 短剧自动化生产平台,从剧本到成片全流程编排

Huobao Drama(火宝短剧)是由南京 AI 火宝团队开发的一站式 AI 短剧自动化生产平台,实现从剧本生成、角色设计、分镜制作到视频合成的全流程自动化。项目以 TypeScript 全栈构建,后端采用 Hono + Drizzle ORM + Mastra AI Agent 框架,前端使用 Nuxt 3 + Vue 3,数据库选用 SQLite。其核心价值在于将短剧制作拆解为剧本改写、角色提取、分镜拆解、音色分配、提示词生成五步流水线,每一步由专门的 AI Agent 负责,通过结构化数据在步骤间传递上下文。平台不依赖单一厂商,通过多厂商适配层(OpenAI、Gemini、MiniMax、火山引擎、阿里、Chatfire)实现图片、视频、TTS 的灵活切换。最终视频合成依赖 FFmpeg,支持 Docker 单镜像部署。项目采用 CC BY-NC-SA 4.0 许可证,禁止商业用途。

自动化生产AI短剧Drizzle ORM
09.08
内容创作主题配图

AI短剧开源工作流

用LLM、文生图、文生视频与TTS串联成自动化流水线,实现从剧本到成片的批量短剧生产

AI短剧开源工作流是一类利用大语言模型(LLM)、AI图像生成、AI视频生成、TTS语音合成等技术,实现从剧本或小说文本到完整短剧视频全自动化生产的开源工具链。其核心思想是将影视生产的每个环节模型化,用LLM做编剧和导演、用文生图做美术、用文生视频做摄影、用TTS做配音,再通过Agent工作流将所有环节串联成一条自动化流水线。报告覆盖三个代表性开源项目:moyin-creator(魔因漫创)为桌面端生产级工具,深度绑定Seedance 2.0,采用6层身份锚点保证角色一致性;waoowaoo为Web端工业级AI影视平台,专攻网文转视频;huobao-drama(火宝短剧)为极简一站式平台,内置5个Mastra AI Agent,支持一句话生成完整短剧。这些项目覆盖了剧本解析、角色生成、场景生成、分镜制作、视频生成、配音合成、成片导出的核心链路,旨在将传统短剧3-6个月的生产周期压缩到数小时甚至数分钟。

工作流角色一致性开源
09.08
内容创作主题配图

GPT-Image 2 极简几何海报提示词

一段结构化提示词,让 AI 为任意产品快速生成极简几何装置风的商业级产品海报。

这是一套基于 ChatGPT Image 2.0 的提示词设计方法论,属于 AI 图像生成领域的 Prompt Engineering 范畴。其核心是通过一段精心设计的结构化提示词,让 AI 为任意产品一次性生成极简几何装置风的产品海报,达到商业级品牌 KV 级别的视觉效果。该方法旨在解决商业产品海报制作中“质量-成本-速度”的不可能三角,通过一段提示词加一张产品图,在几十秒内产出品牌级海报。提示词支持双模式输入:提供产品图时保留其核心外观特征与配色;仅输入产品名时,则自动生成符合产品定位的外观与包装设计。其底层依赖 OpenAI 的 GPT-Image 2.0 多模态图像生成模型,但提示词的设计逻辑可迁移至其他图像生成模型。

产品海报批量生产商业设计
09.08
CloakHQ 的 GitHub 头像CloakHQ/CloakBrowser
开发工具GitHub 项目

CloakBrowser

源码级修改 Chromium 指纹的反检测浏览器自动化工具

CloakBrowser 是一个基于 Chromium 的隐身浏览器自动化工具,其核心思路是在 Chromium 的 C++ 源码层面修改浏览器指纹,编译出定制二进制文件,使反爬虫/反机器人系统无法识别其为自动化浏览器。它属于反检测浏览器自动化领域,介于传统浏览器自动化和商业反检测浏览器之间,提供与 Playwright/Puppeteer 完全兼容的 Python 和 JavaScript API。项目通过修改 49–57 处 C++ 源码,覆盖 Canvas、WebGL、Audio、字体、GPU、屏幕、WebRTC、网络计时、自动化标志、CDP、硬件参数、UA 等多个指纹维度,并采用种子驱动的确定性指纹生成系统,确保指纹内部一致性。同时提供 humanize 行为模拟,通过拦截页面方法调用,将鼠标移动、键盘输入、滚动等交互替换为人类模拟版本。定制 Chromium 二进制在 TLS 层面也与正常 Chrome 一致。项目支持 HTTP/SOCKS5 代理、持久化 Profile、Docker 部署及 AWS Lambda 部署。

反检测浏览器开源C++
09.08
AI 智能体主题配图

Agentic Engineering

专业工程师用编码智能体放大自身能力的软件工程新范式

Agentic Engineering(智能体工程)是2025-2026年间快速兴起的软件工程新范式,核心定义来自Simon Willison:专业软件工程师使用编码智能体(Coding Agents)来放大自身专业能力的实践。该概念由Andrej Karpathy在2026年4月Sequoia Capital的AI Ascent大会上正式推向公众视野,并明确区分了Vibe Coding与Agentic Engineering:前者抬高所有人做软件的下限,后者要保住专业软件过去已有的质量门槛。它属于AI-Native软件工程范畴,横跨AI Agent技术栈、软件工程实践和人机协同设计三个领域。其出现源于三个力量:LLM能力质变、Agentic工具成熟、代码生产成本趋近于零。核心方法包括:人类编写规格(Spec)和测试,Agent生成代码,人类审查结果;测试被视为人类与Agent之间的通信协议。该范式强调代码是廉价的、理解是昂贵的,细节可以外包、结构不能外包。

多智能体编排软件工程质量门控
09.08
内容创作主题配图

xiaohuai-video-translate

一套面向 AI 编程工具的视频翻译技能套件,将外语视频自动转为中文字幕视频和中文文稿。

xiaohuai-video-translate 是一套面向 AI 编程工具的视频翻译技能套件,由 xiaohuailabs(小灰)开发。它不是独立应用,而是由「脚本 + 说明书」组成的 AI Agent 技能,可被 Claude Code、OpenClaw、Gemini CLI、Codex 等工具加载和驱动。项目将下载、转写、翻译、润色、烧录等步骤编排为一条龙流水线,用户只需说一句话即可完成。转写使用本地 Whisper 引擎,不产生 API 费用;翻译复用已有的 AI 模型。项目包含三个独立技能:总指挥、字幕润色、下载专员,可单独或组合使用。支持中英双语字幕,通过 ASS 格式实现中文大、英文小的字号反差。全程本地运行,不上传数据,保护隐私。项目处于活跃状态,最新提交为 2026-06-08,采用 MIT 协议。

本地处理视频翻译字幕
09.08
其他项目主题配图

设计灵感网站合集

五个高质量设计灵感网站,帮助你在AI时代提升审美判断力

本合集源自X(Twitter)博主 @Jackywine 的推荐帖子,精选了五个高质量的设计灵感网站,覆盖网页设计的不同维度,包括暗色主题、页脚设计、着陆页、综合网页设计和行业奖项。这些网站不仅是设计师的灵感来源,也是产品经理、开发者、内容创作者等非设计角色提升视觉素养的高效工具。核心思想是:在AI时代,当执行能力不再是瓶颈时,审美判断力成为核心竞争力。通过分类浏览、聚焦单一维度、接触顶级案例、可操作模板和持续训练,用户可以系统性地提升审美能力。五个网站各有侧重:Dark.design专注暗色主题,Footer.design专注页脚设计,Landingly提供着陆页灵感与Figma模板,Godly.website收录顶级设计,Awwwards提供行业奖项与评审标准。它们共同构成一个分层审美训练体系,从建立全局标准到专项深挖,再到可落地执行。

暗色主题设计奖项设计灵感
09.08