跳到主要内容
prolist.
发现项目AI 收集我的项目我的模型
正在确认账号…
prolist.

发现有价值的项目,留下有依据的判断。

项目专题关于我的收藏
© 2026 prolist项目知识,由人判断。

IDEAS CONNECT PROJECTS

沿着兴趣,发现项目。

从一个标签出发,打开一份值得研究的档案。

收集项目线索
筛选与排序
地图列表
不限标签115开源34AI Agent33Python23提示词工程13Claude Code13TypeScript12LLM11Markdown10MIT10React9知识管理8AI图像生成8

项目搜索结果

共 115 个项目

以下内容已由 AI 根据历史资料整理,供本地测试,未经人工复核。

Voice-Pro README 配图
内容创作GitHub 项目

Voice-Pro

一站式 AI 语音工作台,从视频下载到多语言配音全流程自动化

Voice-Pro 是一款面向创作者和开发者的 AI 音频全流程处理工具,由韩国创业公司 ABUS 开发,基于 Gradio WebUI 构建。它将视频下载、音频分离、语音识别、多语言翻译、文本转语音(TTS)和零样本声音克隆集成到一个统一的 Web 界面中,定位为 ElevenLabs 的开源替代方案。核心价值在于将传统需要 5-8 个工具配合的流程(下载、分离、识别、翻译、配音、字幕)串联成一条自动化管道,用户只需输入视频链接,即可获得多语言配音视频和字幕。工具支持四种 Whisper 变体用于语音识别,三种零样本声音克隆引擎(F5-TTS、E2-TTS、CosyVoice),以及 Edge-TTS、kokoro 等多语言 TTS。完全开源免费,本地运行,数据不出机器。需要 NVIDIA GPU(最低 4GB 显存,推荐 8GB+),首次部署需下载模型,耗时较长。

开源声音克隆视频配音
09.08
内容创作主题配图

AI形象照接单级模板提示词

一套分层锁定的AI生图提示词架构,将专业摄影参数硬性锁定,仅开放客户定制区,实现标准化接单交付。

AI形象照接单级模板提示词是一套结构化的AI生图提示词工程方法论,旨在将Midjourney、Flux、GPT Image等AI图像生成工具的输出质量从“塑料感”提升到商业影楼级写真水准,并实现标准化接单交付。其本质是分层锁死的提示词架构:将摄影参数(镜头、光位、胶片质感)硬性锁定,仅暴露客户定制区(动作、穿搭、修饰)作为可变变量。用户只需复制模板、填入客户需求、让LLM生成最终提示词,并配合客户原始照片垫图出图。该方法论解决了传统AI生图的六大痛点,包括“塑料微商味”、非标交付、摄影知识门槛、客户需求翻译困难、效率低下和AI发散不可控。核心思想是“锁定底层参数,只动客户变量”,通过三层分离架构(客户定制层、项目设定层、摄影锁定层)实现。报告还提供了五套风格模板(影楼级黑白写真、王家卫复古港风、法式冷金油画感、美漫赛博硬核风、时装型录Lookbook),以及标准接单出图流程、工具环境、常见问题排查和优缺点分析。

第 1 页第 2 页第 3 页第 4 页第 5 页
接单变现
模板化
商业摄影
09.08
内容创作主题配图

GPT-Image科学百科图解提示词

一套通过结构化提示词让AI自动生成百科级科学信息图的方法论

这是一套专为GPT-Image等多模态图像生成模型设计的高密度信息图提示词工程体系,通过结构化的视觉布局指令,让AI自动生成类似DK百科全书风格的专业科学图解。它并非软件或工具,而是一套提示词工程方法论,核心成果物是“单图即百科”的信息图:中央主体以逼真3D效果“跃出画面”,周围环绕6-8个知识模块,通过引导线、箭头、标注形成完整的知识网络。该体系解决了传统AI图像生成在知识密集型场景下的信息密度不足、布局不可控、文字渲染差、学科覆盖窄、专业度低等问题。其核心思想包括“太阳系布局”、战略性留白、引导线编织知识网络、中文书法体与手写注释的双层文字系统、三大领域模板化以及3:4竖版画幅与复古纸张质感。提示词结构拆解为7个控制层:角色定义、任务描述、领域选择、风格定义、视觉要求、模块结构、主题注入。用户只需修改主题名即可生成不同物种或人物的信息图。报告还提供了标准使用流程、批量生产流程、与竞品的对比、真实应用场景、工程落地步骤、优缺点与局限、常见误区及学习路径。

多模态AI科学教育内容创作
09.08
opencli-rs README 配图
开发工具GitHub 项目

opencli-rs

用 Rust 重写的命令行信息获取工具,一条命令访问 55+ 网站并支持 AI 生成适配器

opencli-rs 是一款用纯 Rust 编写的命令行工具,旨在通过一条命令从 55+ 个网站获取结构化信息,覆盖 Twitter/X、Reddit、YouTube、HackerNews、Bilibili、知乎、小红书等主流平台,同时支持控制 Electron 桌面应用和集成本地 CLI 工具。它是基于 TypeScript 实现的 OpenCLI 的完整 Rust 重写版本,编译为 4.7MB 的单一静态二进制,零运行时依赖。其核心设计包括声明式 YAML Pipeline、编译时嵌入适配器、AI 原生适配器生成以及浏览器会话复用。工具内置 333+ 命令,支持 table/json/yaml/csv/markdown 等多种输出格式,并专为 AI Agent 设计了工具发现机制。项目采用 Apache-2.0 许可证,截至 2026 年 4 月开源不到两周,生态和文档仍在完善中。

开源浏览器桥接信息获取
09.08
内容创作主题配图

GPT-Image 2 博物标本解剖风格提示词

用博物学视角与卡拉瓦乔光影,把食物变成博物馆级解剖标本的提示词技术

本项目是一套面向 GPT-Image 2 的提示词技术,由知识猫图解(@GeekCatX)创作,核心思路是以博物学大师发现野外标本的方式解剖食物,将剖开、展开、固定的处理步骤与博物馆珍贵藏品的展示框架结合,并以卡拉瓦乔为《国家地理》掌镜时的戏剧性明暗对比作为光影方向。提示词强调每个内部结构以自身材质真相发光,通过“截面锋利得近乎暴力、内部美丽得近乎神圣”的对立制造视觉张力。报告指出,该提示词约 80 字,适用于水果、坚果、蔬菜等内部结构丰富的对象,也可扩展至矿物、植物等非食物对象;其传播力在社交媒体上得到验证(原帖 274 转发、244 评论)。报告同时说明其局限:风格偏暗调侧光、仅适合可解剖展示的对象、大量使用可能引发审美疲劳,且部分食物或处理方式可能触发内容审核。

博物学卡拉瓦乔光影内容创作
09.08
内容创作主题配图

GPT-Image 2 技术蓝图信息图提示词

在真实产品照片上叠加工业级技术蓝图标注,一句话生成设计手册风格信息图

该收藏记录了一种利用 GPT-Image 2 模型生成产品技术解剖图的提示词技术,由 Bitturing 分享。其核心是在真实产品照片上叠加技术蓝图风格的标注层,包括白线、箭头、尺寸、标签以及零件、材料、尺寸和功能的小型示意图,并配有左上角写有"OBJECT"的草图框和 1:1 维度标注,呈现出类似工业设计手册的专业感。该技术旨在解决传统产品技术展示中摄影与设计分离、专业门槛高、效率低下和风格一致性难保证等问题。报告指出,该技术适用于电子产品、机械产品、运动装备、汽车等对象,其中内部结构复杂的产品效果最好。报告同时提醒,AI 生成的尺寸标注可能不准确,仅供参考,正式使用需人工核实。

技术蓝图内容创作提示词
09.08
Codex多智能体实战 README 配图
AI 智能体GitHub 项目

Codex多智能体实战

基于Git Worktree物理隔离与DAG调度的多智能体并行编程方案

Codex 是 OpenAI 于 2025 年开源的终端 AI 编程助手,其多智能体能力将编程任务拆解为有向无环图(DAG),由 Manager 调度多个 Subagent 在独立的 Git Worktree 中并行执行,通过 Harness 层统一管理上下文压缩、状态同步和执行环境隔离。该方案旨在解决多智能体并行时的 Token 消耗暴涨、上下文失控和状态无法收敛等痛点,强调控制成本、控制状态、控制依赖,而非追求最大并行度。核心机制包括 Manager 负责任务拆解、依赖分析和结果合并,Subagent 在独立工作区中执行具体编码任务,Harness 提供执行环境隔离、上下文自动压缩和状态同步。配置采用全局与项目级双层体系,支持 MCP 工具集成和自动化审批。报告指出并发数 4 左右是甜点区间,超过后 Token 消耗指数增长但收益递减。该方案适用于全栈应用并行开发、大型项目重构、多模块库开发等场景,但 Token 成本高、合并冲突风险和学习曲线陡峭等局限也需注意。

多智能体开源AI编程助手
09.08
Donchitos 的 GitHub 头像Donchitos/Claude-Code-Game-Studios
AI 智能体GitHub 项目

Claude Code Game Studios

将单个 Claude Code 会话改造为完整游戏开发工作室的开源模板仓库

Claude Code Game Studios(CCGS)是一个开源模板仓库,将单个 Claude Code 会话改造为一个完整的游戏开发工作室。它不是一个独立工具或引擎,而是一套运行在 Anthropic Claude Code CLI 环境之上的组织架构层,通过 49 个专业 AI Agent、72 个 Slash Command(Skill)、12 个自动化 Hook、11 条路径作用域规则和 39 个文档模板,模拟真实游戏工作室的层级分工与协作流程。CCGS 属于 AI 多 Agent 协作模板,不提供新的 AI 能力,而是把 Claude Code 已有的 Agent 机制组织成一套游戏开发专用的流程体系。其核心是三级 Agent 层级,对应真实工作室的组织架构,并采用用户驱动的五步协作协议。CCGS 支持 Godot 4、Unity、Unreal Engine 5 引擎,主要测试平台为 Windows 10 + Git Bash,兼容 macOS 和 Linux。

工作流模板游戏开发
09.08
ArcReel README 配图
内容创作GitHub 项目

ArcReel

AI Agent 驱动的开源小说视频生成工作台

ArcReel 是一个开源的 AI 视频生成工作台,由 AI Agent 全程驱动,能够将小说文本自动转化为完整的短视频。其完整工作流为:小说 → 角色/场景/道具设计 → 剧本 → 分镜图 → 视频片段 → 最终成片。它本身不训练模型,而是通过统一的抽象层集成 Google Gemini、火山方舟、xAI Grok、OpenAI 等多个 AI 供应商,用 Agent 智能体协调完成从文本到视频的端到端生产流程。项目采用 React 19、Python 3.12+ / FastAPI、Claude Agent SDK 等技术栈,支持 SQLite 与 PostgreSQL 数据库,可通过 Docker 一键部署。ArcReel 旨在解决 AI 视频生成中角色一致性、场景连贯性、分镜拆分、多供应商调度与任务编排等工程问题,将传统人工串联多个 AI 工具的制作流程,转变为 Agent 自动编排与人工确认相结合的标准化流水线。

多模态生成Agent编排AI视频生成
09.08
AI 智能体主题配图

Xiaomi MiMo 大模型

小米自研的 Agent 基础模型,面向“完成任务”而非“回答问题”设计

Xiaomi MiMo(Mind in Motion)是小米集团自研的大语言模型产品线,面向 Agent 时代设计,覆盖文本生成、全模态理解、语音合成三大能力域。它被定位为一套完整的智能体基础模型体系,设计目标是“完成任务”而非仅仅是“回答问题”。MiMo 解决的核心问题是让 AI 从“能对话”进化到“能干活”,能够稳定完成近千轮工具调用的长程任务,自主诊断和恢复错误,并同时处理文本、图像、音频、视频等多种模态信息。截至 2026 年 4 月,MiMo 系列已迭代至 V2.5 版本,包含旗舰推理模型 MiMo-V2.5-Pro、全模态 Agent 模型 MiMo-V2.5、语音合成模型 MiMo-V2.5-TTS、语音识别模型 MiMo-V2.5-ASR 以及轻量快速模型 MiMo-V2-Flash。其核心架构创新包括混合注意力机制和全模态统一架构,并强调 Token 效率优化。

1M上下文大语言模型混合注意力
09.08
multica-ai 的 GitHub 头像multica-ai/andrej-karpathy-skills
开发工具GitHub 项目

andrej-karpathy-skills

用四条行为准则约束 AI 编码助手,减少过度工程化与越界修改

该项目是一个开源项目,由 multica-ai 维护,将 Andrej Karpathy 对 LLM 编码缺陷的观察总结为四个核心行为准则,封装在单个 CLAUDE.md 文件中,用于改善 Claude Code / Cursor 等 AI 编码助手的代码输出质量。它属于 AI 辅助编程质量保障体系,不是代码框架或 SDK,而是一份注入到 AI 编码助手上下文中的行为约束指令。项目核心要解决的问题是 LLM 在编写代码时存在的系统性缺陷,包括隐性假设、过度工程化、越界修改、目标模糊等,这些问题导致代码质量下降、维护成本上升。项目通过 Think Before Coding、Simplicity First、Surgical Changes、Goal-Driven Execution 四条准则,将 LLM 的多做倾向约束为做准、做少、做稳。安装方式极简,支持 Claude Code 插件、项目级 CLAUDE.md 和 Cursor 规则等多种方式。

开源行为约束AI编码助手
09.08
AI 智能体主题配图

AI Agent编程技术全景对比

对比 Hermes Agent、NanoClaw 与 OpenHarness 三大 Agent Harness 框架的技术全景指南

本报告对 2025-2026 年 AI Agent 编程领域的三个代表性框架进行了全景对比:Hermes Agent(Nous Research,47.5k Stars)、OpenClaw/NanoClaw(轻量级 Agent 运行时)以及 OpenHarness(HKUDS,8.4k Stars)。报告首先介绍了 Agent Harness 范式的技术定义与谱系,指出其为 LLM 提供工具、搜索、记忆与安全边界等基础设施。随后分析了 AI 编程的六大结构性痛点,包括模型无记忆、工具碎片化、无法持久化、模型锁定与单 Agent 瓶颈等。核心章节详细阐述了各框架的设计思想、核心原理与系统架构,并通过对比矩阵、关键数据流和典型应用场景,展示了它们在功能定位、技术特性与适用场景上的差异。报告还讨论了工程落地建议、优缺点与通用局限,并澄清了常见误区,为开发者选择和使用 Agent 框架提供了参考。

多Agent协调Agent HarnessAI Agent
09.08
Hermes WebUI README 配图
AI 智能体GitHub 项目

Hermes WebUI

为 Hermes Agent 提供浏览器端图形界面的纯 UI 层,让会话、文件与工具调用可视化。

Hermes WebUI 是 Hermes Agent 的浏览器端图形界面,由 Nathan Esquena(@nesquena)开发并开源。它本身不运行 Agent,而是对接用户已有的 Hermes Agent 服务,所有数据仍存储在用户机器上。项目采用 Python 后端与原生 JS/CSS/HTML 前端,零框架、零构建步骤,通过 REST API 与 SSE 流式传输实现通信。它主要解决传统终端与聊天平台交互的痛点,包括会话不可追溯、文件操作割裂、Profile 管理原始、工具调用黑盒以及跨设备访问受限等问题。WebUI 提供三栏布局,左侧会话列表、中间聊天区域、右侧文件浏览器,并支持 CLI 会话桥接、Profile 热切换、工具调用卡片展示等功能。部署方式包括本地脚本启动、Docker 容器以及 macOS 原生客户端(Swift/WKWebView 封装)。项目为 MIT 开源,适合需要可视化管理 Hermes Agent 会话与工作区的用户。

零框架原生JavaScriptAI Agent
09.08
zxfccmm4 的 GitHub 头像zxfccmm4/Obsidian-OpenCode-Knowledge
知识管理GitHub 项目

Obsidian OpenCode Knowledge

本地优先的 AI 知识管理方案,通过规则驱动实现自动录入、查询与维护

Obsidian OpenCode Knowledge 是一套面向非技术用户的本地 AI 知识管理方案,由开源项目 zxfccmm4/Obsidian-OpenCode-Knowledge 提供。它结合 Obsidian 笔记软件、OpenCode 终端 AI 助手和预配置的知识库规则(AGENTS.md),通过一键部署模板,让用户在 5 分钟内拥有完全本地化、AI 驱动的个人知识库。项目主要解决信息录入成本高、知识库混乱、查询效率低、缺乏维护以及隐私担忧等问题。其核心设计包括三目录隔离(raw/wiki/assets)、四触发行为(Ingest/Query/Lint/Social Ingest)、社交媒体知识域分类、可配置的 AI_CONFIG.md 以及完全本地存储。系统支持多种 LLM 后端,并预装 9 个技能包,实现素材消化、社交媒体采集、知识库体检和自然语言查询等功能。

本地优先社交媒体采集知识管理
09.08
microsoft 的 GitHub 头像microsoft/markitdown
开发工具GitHub 项目

MarkItDown

微软开源的轻量级多格式文档转 Markdown 工具,为 LLM 与 RAG 管道提供结构化文本提取。

MarkItDown 是微软 AutoGen 团队开发并维护的开源 Python 工具,采用 MIT 协议,当前 GitHub 星标超过 105k,最新版本为 v0.1.5(2026 年 2 月发布)。它支持 PDF、Word、PowerPoint、Excel、图片、音频、HTML、EPUB 等 15 种以上文件格式,将其转换为结构化的 Markdown 文本。其核心设计目标是让 LLM 和文本分析工具能以最高效的方式“阅读”非文本文件,输出为机器可消费的结构化文本,而非人类可读的高保真转换。工具采用可插拔的 Converter 架构,每种格式对应独立转换器,核心库仅依赖 Python 标准库,其他功能通过可选依赖按需安装。v0.1.0 之后支持流式处理,不创建临时文件。基础转换不依赖 LLM,但可选用 LLM 增强图片描述与 OCR 功能。此外,项目提供 MCP 服务器,便于 AI 客户端直接调用。

开源文档转换LLM
09.08
内容创作主题配图

OpenNana 提示词图库

中文原生的 AI 图像提示词视觉化图库,收录 104+ 条精选案例覆盖多种主流模型

OpenNana 是一个 AI 图片提示词分享平台,核心产品是提示词图库,目前已收录 104+ 条精选提示词案例,覆盖 Nano Banana Pro、GPT Image-2(ChatGPT)、Grok、Seedance 2.0 等主流 AI 图像/视频生成模型。平台定位为 AI 图像创作者的灵感库和提示词参考站,提供浏览、搜索、收藏高质量提示词的功能。核心能力包括多模型覆盖、分类筛选(按模型、媒体类型、标签)、视觉化展示(每条提示词配有生成效果图)以及一站式体验(提供 AI 生图、AI 生视频、生成记录等工具)。平台采用三维分类体系:模型、媒体类型、标签,便于用户快速定位目标提示词。设计原则包括视觉优先、多模型平等、标签化组织、创作者溯源、平台一体化和持续更新。平台还内置 AI 生图工具,用户可一键生成图片。

视觉化展示提示词图库中文原生
09.08
AI 智能体主题配图

Codex Chrome Extension

让 AI Agent 在用户已登录的 Chrome 浏览器中直接执行网页自动化任务

Codex Chrome Extension 是 OpenAI 于 2026 年 5 月 7 日发布的 Chrome 浏览器扩展插件,让 Codex AI Agent 能够直接操控用户已登录的 Chrome 浏览器,执行网页自动化任务。该插件解决了 Codex 此前无法操作需要登录的网站的问题,通过复用浏览器已有的 Cookie 和登录状态,使 AI 能够访问邮箱、社交媒体、公司后台等需要认证的页面。其核心能力包括身份共享、多标签页并行处理和多代理协同。用户通过 @Chrome 指令触发浏览器操控,Agent 在独立标签页中工作,不接管整个浏览器,用户可正常使用。该插件需要 Codex CLI 0.129.0 或更高版本,支持 macOS 和 Windows 平台。

多代理协同浏览器自动化身份共享
09.08
Logo Generator Skill README 配图
AI 智能体GitHub 项目

Logo Generator Skill

一个为开发者生成可编辑 SVG Logo 与专业展示图的开源 AI Skill

Logo Generator 是由归藏(op7418/guizang.ai)开发的开源 AI Skill,用于生成专业级别的 SVG Logo 和图标,并自动创建高端展示图。它适用于 Claude Code、Gemini CLI 等 AI Agent 平台,项目托管在 GitHub,采用 MIT 协议。该工具主要解决小项目、开源项目或创业团队需要“够用的好 Logo”,但既请不起设计师、也用不好 AI 画图工具的痛点。其核心思路是“分阶段生成,先矢量后位图”:先由 AI 生成可编辑的 SVG 几何基础,再生成专业展示图。它内置设计模式库,包含点阵、线条系统、几何切割、负空间、括号/壳、六边形核心等范式,并提供 12 种静态背景风格和 6 种 WebGL 动态背景。整个流程约需 10-30 分钟,对话式交互,零设计基础也可使用。

开源设计模式库矢量图形
09.08
开发工具主题配图

Codex Plugin for Claude Code

在 Claude Code 工作流中直接调用 OpenAI Codex CLI,实现跨模型协作的官方插件

Codex Plugin for Claude Code 是 OpenAI 官方推出的 Claude Code 插件,让用户可以在 Claude Code 工作流中直接调用 OpenAI Codex CLI,实现跨模型协作——用 Claude 做主力编程,用 Codex 做代码审查和任务委派。插件通过 Claude Code 的 Plugin System 注册自定义 Slash Commands、Hooks、Subagents 和 Skills,在命令触发时通过 Bash 调用本地 Codex CLI 的 App Server 接口。它提供六个 Slash Command,覆盖代码审查、对抗性审查、任务委派和任务管理;通过 SessionStart、SessionEnd、Stop 三种 Hook 实现生命周期管理和自动质量门控。其核心创新是 Review Gate,在 Claude Code 完成代码修改后自动触发 Codex 审查,审查结果为 ALLOW 则放行,BLOCK 则阻止 Stop 并让 Claude 继续修复,形成自动化的写代码、审查、修复循环。插件支持后台运行任务、灵活选择 Codex 模型,并自动读取现有 Codex 配置。

代码审查开发工具跨模型协作
09.08
内容创作主题配图

GPT-Image 2 实操案例与提示词工程指南

一份基于实操案例整理的 GPT-Image 2 提示词工程指南,覆盖 13 类应用场景与模板化用法。

本指南基于一份实操报告整理,围绕 OpenAI 于 2026 年 4 月推出的图像生成模型 GPT-Image 2 展开。报告指出,该模型并非传统文生图工具,而是集成了意图理解、知识补全、设计规划与精准渲染的 Agent 系统。指南重点介绍了其四大核心亮点:高质量中文渲染、自动补全缺失信息、支持极简提示词以及可对话式追问微调。内容主体为 13 个实操案例,覆盖图鉴拆解、古文书法、科普百科、电商详情、试卷生成、旅游攻略、人物关系图、密集中文排版等场景,每个案例均提供了对应的提示词模板与通用性说明。此外,指南还对比了 GPT-Image 2 与 Midjourney、DALL-E 3、Stable Diffusion 等工具的差异,并总结了优缺点、常见误区与学习路径。报告同时指出其局限,如不适合像素级精确排版、无法本地部署或批量调用,以及存在伦理风险。

提示词工程图像生成信息图
09.08
CosyVoice README 配图
内容创作GitHub 项目

CosyVoice

多语种语音生成模型,支持3秒声音克隆与流式合成

CosyVoice 是阿里巴巴达摩院 FunAudioLLM 团队开发的多语种大语音生成模型,提供推理、训练和部署的全栈能力。其核心能力包括仅需 3 秒参考音频即可实现零样本声音克隆,覆盖 9 种常见语言和 18 种以上中文方言,并支持跨语种克隆。模型采用 LLM 生成语义 Token 与 Flow Matching 渲染声波的双阶段架构,CosyVoice 2.0 起支持双向流式合成,延迟低至 150ms。CosyVoice 3.0 引入多任务 Tokenizer 和可微分奖励模型后训练,训练数据扩展至 100 万小时。项目采用 Apache-2.0 许可证,支持本地部署,提供 Docker、FastAPI、gRPC、vLLM、TensorRT-LLM 等多种部署方式。

多语种流式合成深度学习
09.08
HyperFrames README Logoheygen-com/hyperframes
开发工具GitHub 项目

HyperFrames

用 HTML 写视频,为 AI Agent 而生的确定性渲染框架

HyperFrames 是由 HeyGen 开源的一个 HTML-to-Video 渲染框架,核心理念是“Write HTML. Render video. Built for agents.”。它允许用户用纯 HTML 文件定义视频内容,通过 data-* 属性控制时间轴、轨道和布局,然后通过 CLI 一键渲染成 MP4。该框架采用声明式数据模型、可插拔动画运行时和确定性逐帧渲染引擎,旨在解决 AI Agent 无法操作传统视频编辑工具的问题。它支持非交互式 CLI、Vercel Skills 规范,并提供 50+ 预制 Block。HyperFrames 使用 TypeScript 开发,开源协议为 Apache 2.0,最新版本为 v0.4.3。

AI AgentApache-2.0CLI
09.08
garrytan 的 GitHub 头像garrytan/gbrain
知识管理GitHub 项目

GBrain

为 AI Agent 提供长期记忆的 Markdown 知识库与混合检索工具

GBrain 是一个为 AI Agent 提供长期记忆的开源工具,由 Garry Tan 开发。它通过 Markdown 知识库、混合检索和实体图谱,解决 AI 每次对话从零开始、无法积累个人知识的问题。其核心是一个“读-答-写-同步”四步循环:Agent 在回答前先查询大脑获取上下文,对话后更新大脑页面,使知识像复利一样增长。GBrain 采用 Markdown 即数据库的设计,每个实体对应一个文件,人类可读可编辑,并用 Git 管理。存储层默认使用嵌入式 PGLite,2 秒启动,零配置,长大后可迁移到 Supabase。检索层采用向量搜索、关键词搜索与 RRF 融合排序的混合检索,兼顾语义理解和精确匹配。集成层通过 Markdown 食谱声明式描述,Agent 读取后即可自动安装。

个人知识库混合检索实体图谱
09.08
JFGAtlas 的 GitHub 头像JFGAtlas/aethergate-pro
其他项目GitHub 项目

AetherGate Pro

基于 Linux 网络命名空间隔离的免费住宅 IP 代理网关管理器

AetherGate Pro 是一款专为 Linux VPS 设计的企业级、高可用 VPN 与代理网关管理器。它利用 VPNGate 公共学术 VPN 节点池作为免费住宅 IP 来源,通过 Linux 网络命名空间(netns)隔离 VPN 流量,对外暴露统一的混合协议代理端口(SOCKS5 + HTTP),让用户以零成本获取全球住宅/移动网络出口 IP。项目由 JFGAtlas(狗富贵)开发,采用 MIT 开源协议,核心语言为 Python 3(异步架构),当前版本为 v2.0.0-async。它解决了 VPS 上直接运行 VPN 客户端导致 SSH 断连、商业住宅代理价格高昂、免费节点质量参差以及运维复杂度高等问题。通过 netns 隔离、自动节点筛选、看门狗故障自愈等机制,提供一键部署、自动故障转移、混合协议支持等功能。适用于测试、学习、轻量爬虫等场景,不适合大规模生产环境。

代理网络命名空间住宅IP
09.08