跳到主要内容
prolist.
发现项目AI 收集我的项目我的模型
正在确认账号…
prolist.

发现有价值的项目,留下有依据的判断。

项目专题关于我的收藏
© 2026 prolist项目知识,由人判断。

IDEAS CONNECT PROJECTS

沿着兴趣,发现项目。

从一个标签出发,打开一份值得研究的档案。

收集项目线索
筛选与排序 · 已应用
地图列表
不限标签115开源34AI Agent33Python23提示词工程13Claude Code13TypeScript12LLM11Markdown10MIT10React9知识管理8AI图像生成8

项目搜索结果

找到 23 个项目 · 标签:Python 移除标签

清除筛选

以下内容已由 AI 根据历史资料整理,供本地测试,未经人工复核。

Voicebox README 配图
内容创作GitHub 项目

Voicebox

本地优先的开源语音合成工作站,集成多引擎声音克隆、情感标签、后处理音效与多轨编辑

Voicebox 是由 Jamie Pine 开发的开源语音合成工作室,定位为 ElevenLabs 的免费本地替代方案。它是一个完整的桌面应用,集声音克隆、语音生成、后处理特效、多轨编辑于一体,所有模型和数据完全在本地运行。项目采用 Tauri (Rust) 桌面框架,前端使用 React + TypeScript,后端为 Python (FastAPI),音效处理由 Spotify pedalboard 驱动。内置 5 个 TTS 引擎,支持 23 种语言,最大文本长度 50,000 字符,并提供完整 REST API 供外部集成。核心能力包括多引擎声音克隆、情感表达控制(如 [laugh]、[sigh] 等副语言学标签)、8 种后处理音效、多轨时间轴编辑(Stories Editor)以及长文本自动分段与交叉淡入淡出拼接。项目采用 MIT 协议完全开源,支持 CUDA、ROCm、MLX、DirectML、XPU 及 CPU 等多种 GPU 后端。

本地优先声音克隆FastAPI
09.08
Horizon AI新闻雷达 README 配图
知识管理GitHub 项目

Horizon AI新闻雷达

AI驱动的个人新闻雷达,自动完成多源抓取、评分、去重、背景补充与双语日报生成

Horizon 是由开发者 Thysrael 开源的个人新闻雷达系统,定位为"AI 新闻编辑"而非传统 RSS 阅读器。它从 Hacker News、RSS/Atom、Reddit、Telegram、Twitter/X、GitHub 六类信息源并发抓取内容,通过 URL 归一化与标题相似度进行跨平台去重,再调用大语言模型按用户兴趣领域进行 0-10 分评分,仅保留超过阈值的高分新闻。随后自动搜索补充背景知识、收集并摘要社区评论,最终生成中英双语 Markdown 日报,并通过 GitHub Pages、邮件订阅、Webhook 通知及 MCP Server 等多渠道分发。项目使用 Python 编写,支持 Claude、GPT、Gemini、DeepSeek、豆包、MiniMax 等多种模型提供商,可通过 Docker 或 GitHub Actions 部署,并内置交互式配置向导降低使用门槛。

开源日报信息聚合
09.08
微软Qlib AI量化投资平台 README 配图
数据与分析GitHub 项目

微软Qlib AI量化投资平台

微软研究院开源的AI量化投资研究平台,将量化研究全流程标准化

Qlib 是微软研究院(Microsoft Research)开源的面向 AI 的量化投资平台。它将量化投资的完整研究流程——从数据获取、特征工程、模型训练到回测评估——标准化为一套模块化的 Python 框架,让开发者可以专注于策略逻辑本身,而不是底层工程实现。Qlib 采用分层模块化架构,从底向上依次为数据层、特征引擎、模型层、策略层、回测与评估层、在线服务层。数据层负责数据的获取、存储和预处理,统一存储为 qlib binary 格式;特征引擎内置 Alpha158 和 Alpha360 特征集;模型层支持传统机器学习(LightGBM、XGBoost)、深度学习(LSTM、Transformer)以及强化学习;策略层提供 TopkDropout、TopK 等策略;回测与评估层考虑滑点、交易摩擦、手续费,并提供 IC、Sharpe Ratio、Max Drawdown 等评估指标;在线服务层支持模型部署到生产环境。Qlib 支持美股、A 股、港股等市场,并集成了微软的 RD-Agent,可自动搜索最优的模型架构和因子组合。

回测机器学习开源
09.08
musicDownload README 配图
其他项目GitHub 项目

musicDownload

基于 musicdl 的跨平台音乐下载 GUI 工具,聚合国内五大音乐平台搜索与无损下载

musicDownload 是一个基于 Python 的跨平台音乐下载 GUI 工具,由 MrsEWE44 开发,基于 CharlesPikachu 的 musicdl 库(4.6k Stars)进行 GUI 封装和功能增强。工具支持酷狗、酷我、QQ音乐、网易云、咪咕等国内主流音乐平台的音乐搜索与下载,包括无损音质文件。项目采用 Python 3.10 + tkinter GUI + musicdl 核心引擎的技术栈,通过图形界面降低了命令行工具的使用门槛。核心功能包括聚合搜索、音质优先选择、批量下载和歌单下载。项目为 V1.0 版本(2026.4.19 发布),Stars 1.5k,Forks 185,协议继承自 musicdl(Non-Commercial)。项目结构简洁,核心代码集中在单个 musicdownload.py 文件中。需要注意的是,项目仅 3 次提交,维护活跃度极低,且明确要求 Python 3.10.11 版本。工具仅供学习和研究使用,禁止商用,下载付费内容可能违反版权法和平台协议。

跨平台批量下载无损音质
09.08
val1813 的 GitHub 头像val1813/kwcode
AI 智能体GitHub 项目

KWCode天工开物

为本地小模型优化的确定性流水线 Coding Agent CLI 工具

KWCode(天工开物)是一个专为本地开源模型优化的 Coding Agent CLI 工具,由中国开发者 val1813(ValHuang)开发,MIT 协议开源。其核心定位是让 8B-30B 参数的小模型也能完成编程任务,数据不出网。 KWCode 采用确定性专家流水线架构,LLM 只负责任务分类和代码生成,文件定位、验证、调试等环节由确定性代码完成。内置 5 个确定性工具,支持 BM25+AST 调用图定位、三阶段重试、Debug Subagent 运行时调试、DAG 多任务编排、专家飞轮自动积累经验等功能。 项目支持 Windows/macOS/Linux 平台,Windows 原生运行,无需 WSL2。系统要求 Python 3.10+,支持任意 OpenAI 兼容 API。当前处于 MVP 阶段,AST 引擎主要支持 Python,社区规模较小。

本地模型开源确定性流水线
09.08
Voice-Pro README 配图
内容创作GitHub 项目

Voice-Pro

一站式 AI 语音工作台,从视频下载到多语言配音全流程自动化

Voice-Pro 是一款面向创作者和开发者的 AI 音频全流程处理工具,由韩国创业公司 ABUS 开发,基于 Gradio WebUI 构建。它将视频下载、音频分离、语音识别、多语言翻译、文本转语音(TTS)和零样本声音克隆集成到一个统一的 Web 界面中,定位为 ElevenLabs 的开源替代方案。核心价值在于将传统需要 5-8 个工具配合的流程(下载、分离、识别、翻译、配音、字幕)串联成一条自动化管道,用户只需输入视频链接,即可获得多语言配音视频和字幕。工具支持四种 Whisper 变体用于语音识别,三种零样本声音克隆引擎(F5-TTS、E2-TTS、CosyVoice),以及 Edge-TTS、kokoro 等多语言 TTS。完全开源免费,本地运行,数据不出机器。需要 NVIDIA GPU(最低 4GB 显存,推荐 8GB+),首次部署需下载模型,耗时较长。

开源声音克隆视频配音
09.08
ArcReel README 配图
内容创作GitHub 项目

ArcReel

AI Agent 驱动的开源小说视频生成工作台

ArcReel 是一个开源的 AI 视频生成工作台,由 AI Agent 全程驱动,能够将小说文本自动转化为完整的短视频。其完整工作流为:小说 → 角色/场景/道具设计 → 剧本 → 分镜图 → 视频片段 → 最终成片。它本身不训练模型,而是通过统一的抽象层集成 Google Gemini、火山方舟、xAI Grok、OpenAI 等多个 AI 供应商,用 Agent 智能体协调完成从文本到视频的端到端生产流程。项目采用 React 19、Python 3.12+ / FastAPI、Claude Agent SDK 等技术栈,支持 SQLite 与 PostgreSQL 数据库,可通过 Docker 一键部署。ArcReel 旨在解决 AI 视频生成中角色一致性、场景连贯性、分镜拆分、多供应商调度与任务编排等工程问题,将传统人工串联多个 AI 工具的制作流程,转变为 Agent 自动编排与人工确认相结合的标准化流水线。

多模态生成Agent编排AI视频生成
09.08
AI 智能体主题配图

AI Agent编程技术全景对比

对比 Hermes Agent、NanoClaw 与 OpenHarness 三大 Agent Harness 框架的技术全景指南

本报告对 2025-2026 年 AI Agent 编程领域的三个代表性框架进行了全景对比:Hermes Agent(Nous Research,47.5k Stars)、OpenClaw/NanoClaw(轻量级 Agent 运行时)以及 OpenHarness(HKUDS,8.4k Stars)。报告首先介绍了 Agent Harness 范式的技术定义与谱系,指出其为 LLM 提供工具、搜索、记忆与安全边界等基础设施。随后分析了 AI 编程的六大结构性痛点,包括模型无记忆、工具碎片化、无法持久化、模型锁定与单 Agent 瓶颈等。核心章节详细阐述了各框架的设计思想、核心原理与系统架构,并通过对比矩阵、关键数据流和典型应用场景,展示了它们在功能定位、技术特性与适用场景上的差异。报告还讨论了工程落地建议、优缺点与通用局限,并澄清了常见误区,为开发者选择和使用 Agent 框架提供了参考。

多Agent协调Agent HarnessAI Agent
09.08
Hermes WebUI README 配图
AI 智能体GitHub 项目

Hermes WebUI

为 Hermes Agent 提供浏览器端图形界面的纯 UI 层,让会话、文件与工具调用可视化。

Hermes WebUI 是 Hermes Agent 的浏览器端图形界面,由 Nathan Esquena(@nesquena)开发并开源。它本身不运行 Agent,而是对接用户已有的 Hermes Agent 服务,所有数据仍存储在用户机器上。项目采用 Python 后端与原生 JS/CSS/HTML 前端,零框架、零构建步骤,通过 REST API 与 SSE 流式传输实现通信。它主要解决传统终端与聊天平台交互的痛点,包括会话不可追溯、文件操作割裂、Profile 管理原始、工具调用黑盒以及跨设备访问受限等问题。WebUI 提供三栏布局,左侧会话列表、中间聊天区域、右侧文件浏览器,并支持 CLI 会话桥接、Profile 热切换、工具调用卡片展示等功能。部署方式包括本地脚本启动、Docker 容器以及 macOS 原生客户端(Swift/WKWebView 封装)。项目为 MIT 开源,适合需要可视化管理 Hermes Agent 会话与工作区的用户。

零框架原生JavaScriptAI Agent
09.08
microsoft 的 GitHub 头像microsoft/markitdown
开发工具GitHub 项目

MarkItDown

微软开源的轻量级多格式文档转 Markdown 工具,为 LLM 与 RAG 管道提供结构化文本提取。

MarkItDown 是微软 AutoGen 团队开发并维护的开源 Python 工具,采用 MIT 协议,当前 GitHub 星标超过 105k,最新版本为 v0.1.5(2026 年 2 月发布)。它支持 PDF、Word、PowerPoint、Excel、图片、音频、HTML、EPUB 等 15 种以上文件格式,将其转换为结构化的 Markdown 文本。其核心设计目标是让 LLM 和文本分析工具能以最高效的方式“阅读”非文本文件,输出为机器可消费的结构化文本,而非人类可读的高保真转换。工具采用可插拔的 Converter 架构,每种格式对应独立转换器,核心库仅依赖 Python 标准库,其他功能通过可选依赖按需安装。v0.1.0 之后支持流式处理,不创建临时文件。基础转换不依赖 LLM,但可选用 LLM 增强图片描述与 OCR 功能。此外,项目提供 MCP 服务器,便于 AI 客户端直接调用。

开源文档转换LLM
09.08
CosyVoice README 配图
内容创作GitHub 项目

CosyVoice

多语种语音生成模型,支持3秒声音克隆与流式合成

CosyVoice 是阿里巴巴达摩院 FunAudioLLM 团队开发的多语种大语音生成模型,提供推理、训练和部署的全栈能力。其核心能力包括仅需 3 秒参考音频即可实现零样本声音克隆,覆盖 9 种常见语言和 18 种以上中文方言,并支持跨语种克隆。模型采用 LLM 生成语义 Token 与 Flow Matching 渲染声波的双阶段架构,CosyVoice 2.0 起支持双向流式合成,延迟低至 150ms。CosyVoice 3.0 引入多任务 Tokenizer 和可微分奖励模型后训练,训练数据扩展至 100 万小时。项目采用 Apache-2.0 许可证,支持本地部署,提供 Docker、FastAPI、gRPC、vLLM、TensorRT-LLM 等多种部署方式。

多语种流式合成深度学习
09.08
anthropics 的 GitHub 头像anthropics/claude-for-legal
AI 智能体GitHub 项目

Claude for Legal

Anthropic 官方法律工作流 AI 插件套件,覆盖 12 个业务领域

Claude for Legal 是 Anthropic 官方推出的法律工作流 AI 插件套件,为法律行业提供覆盖 12 个业务领域的专业化 AI Agent 能力。它不是单一产品,而是一套参考实现,包含预构建的 Agent、Skill、数据连接器和托管 Agent 范本,律师和法务团队可以直接安装使用,也可以基于自身业务定制。核心机制是冷启动面试,通过结构化面试学习团队业务规则并生成实践配置文件(Practice Profile),后续所有 Skill 都会读取该配置。插件通过 MCP 连接器对接真实法律数据库,确保引用可验证;没有连接器时,引用会被标记为 [verify],提醒律师必须人工验证。所有输出均为供律师审查的草稿,内置审查门控,不替代律师判断。项目采用 Apache 2.0 开源许可证,支持 Claude Cowork、Claude Code 和 Managed Agent 三种运行模式。

插件法律工作流
09.08
SoftwareCopyright-Skill README 配图
AI 智能体GitHub 项目

SoftwareCopyright-Skill

开源 Codex Skill,自动生成中国软著申请全套材料

SoftwareCopyright-Skill 是一个开源 Codex Skill,用于自动生成中国软件著作权申请材料。它通过阅读开发者真实项目源码,自动生成申请表信息、操作手册和代码鉴别材料,全部输出为 Word/TXT 格式。项目采用 MIT 协议,完全免费,旨在替代付费代办服务。核心功能包括自动分析项目源码、生成符合要求的操作手册、生成前 30 页和后 30 页代码鉴别材料、生成申请表辅助填报文件。代码材料只来自真实项目,禁止 AI 编造。关键节点设置人工确认门禁,确保材料准确性。支持基础 DOCX 和完整 OpenXML 两种生成路径。项目属于 AI Agent 与法律合规自动化交叉领域,面向中国开发者。

软著申请文档生成自动化
09.08
CloakHQ 的 GitHub 头像CloakHQ/CloakBrowser
开发工具GitHub 项目

CloakBrowser

源码级修改 Chromium 指纹的反检测浏览器自动化工具

CloakBrowser 是一个基于 Chromium 的隐身浏览器自动化工具,其核心思路是在 Chromium 的 C++ 源码层面修改浏览器指纹,编译出定制二进制文件,使反爬虫/反机器人系统无法识别其为自动化浏览器。它属于反检测浏览器自动化领域,介于传统浏览器自动化和商业反检测浏览器之间,提供与 Playwright/Puppeteer 完全兼容的 Python 和 JavaScript API。项目通过修改 49–57 处 C++ 源码,覆盖 Canvas、WebGL、Audio、字体、GPU、屏幕、WebRTC、网络计时、自动化标志、CDP、硬件参数、UA 等多个指纹维度,并采用种子驱动的确定性指纹生成系统,确保指纹内部一致性。同时提供 humanize 行为模拟,通过拦截页面方法调用,将鼠标移动、键盘输入、滚动等交互替换为人类模拟版本。定制 Chromium 二进制在 TLS 层面也与正常 Chrome 一致。项目支持 HTTP/SOCKS5 代理、持久化 Profile、Docker 部署及 AWS Lambda 部署。

反检测浏览器开源C++
09.08
内容创作主题配图

xiaohuai-video-translate

一套面向 AI 编程工具的视频翻译技能套件,将外语视频自动转为中文字幕视频和中文文稿。

xiaohuai-video-translate 是一套面向 AI 编程工具的视频翻译技能套件,由 xiaohuailabs(小灰)开发。它不是独立应用,而是由「脚本 + 说明书」组成的 AI Agent 技能,可被 Claude Code、OpenClaw、Gemini CLI、Codex 等工具加载和驱动。项目将下载、转写、翻译、润色、烧录等步骤编排为一条龙流水线,用户只需说一句话即可完成。转写使用本地 Whisper 引擎,不产生 API 费用;翻译复用已有的 AI 模型。项目包含三个独立技能:总指挥、字幕润色、下载专员,可单独或组合使用。支持中英双语字幕,通过 ASS 格式实现中文大、英文小的字号反差。全程本地运行,不上传数据,保护隐私。项目处于活跃状态,最新提交为 2026-06-08,采用 MIT 协议。

本地处理视频翻译字幕
09.08
Browser Harness README 配图
AI 智能体GitHub 项目

Browser Harness

一个让 LLM Agent 通过 Unix Socket 直连用户 Chrome 的自愈式浏览器控制框架

Browser Harness 是由 browser-use 团队开发的一个自愈式浏览器控制框架,总计约 592 行 Python 代码,直接基于 Chrome DevTools Protocol(CDP)构建。它让 LLM Agent 能够通过一个 Unix Socket 连接到用户已运行的 Chrome 浏览器,实现完全自由地完成任何浏览器任务。其核心定义是:最简单、最轻量的自愈式浏览器控制装置——Agent 在任务执行过程中发现缺少什么功能,就当场写出来补上,无需重启、无需框架更新。该项目旨在解决 LLM Agent 如何以最少的前置代码、最大的灵活性控制真实浏览器的问题。传统方案要么依赖重量级框架(如 Playwright、Selenium),要么把所有交互逻辑预先编码。Browser Harness 反其道而行,只提供一个极薄的 CDP 桥接层(daemon + helpers),剩下的能力由 Agent 在任务执行中即时编写。

浏览器自动化自愈式AI Agent
09.08
TrendRadar README 配图
AI 智能体GitHub 项目

TrendRadar

AI 驱动的多平台热点聚合与智能推送工具

TrendRadar 是一款 AI 驱动的舆情监控与热点聚合工具,由开发者 sansan0 于 2025 年 4 月创建。项目定位为面向信息过载时代的一站式热点助手,核心能力包括一键聚合 35+ 平台实时热点(如抖音、B 站、知乎、微博、头条、财联社、华尔街见闻等),通过 AI 智能筛选、翻译和深度分析,生成趋势预测、情感洞察、跨平台关联等简报,并支持 10+ 智能推送渠道(企业微信、微信、飞书、钉钉、Telegram、邮件、Slack 等)。项目采用时间线智能调度,针对早高峰、晚上、周末等不同时段配置不同推送策略。技术栈包括 Python、GitHub Actions、GitHub Pages、Docker 和 MCP Server,开源协议为 GPL-3.0。项目支持 MCP 架构,可接入 AI Agent 生态,实现自然语言对话分析。

热点聚合信息推送舆情监控
09.08
PDFMathTranslate README 配图
开发工具GitHub 项目

PDFMathTranslate

开源 PDF 科学文档翻译工具,翻译全文并保留公式、图表与排版。

PDFMathTranslate(命令行工具名 pdf2zh)是一个开源的 PDF 科学文档翻译工具,其核心能力是在翻译 PDF 全文的同时,完整保留原始排版、数学公式、图表、目录和批注。它通过 PDF 解析、元素分类、文本翻译、原位回填四个阶段处理文档,使用 DocLayout-YOLO 模型识别并跳过公式区域,避免公式被翻译引擎误读。翻译引擎可插拔,支持 Google、DeepL、OpenAI、Ollama 等十余种后端,并支持 CLI、GUI、Docker、MCP Server、Zotero 插件等多种部署形态。工具同时生成纯译文版和双语对照版,满足不同阅读需求。项目以 AGPL-3.0 许可证开源,论文被 EMNLP 2025 录用。

机器翻译开源文档智能
09.08
伯乐 Skill / ai-news-radar README 配图
AI 智能体GitHub 项目

伯乐 Skill / ai-news-radar

AI 信息源智能筛选系统,先判断再接入

伯乐 Skill(Scout Skill)是基于开源项目 ai-news-radar 构建的 AI 信息源智能筛选与新闻雷达系统,由 LearnPrompt 创始人卡尔的AI沃茨开发,2026 年 5 月发布 v0.4.0。其核心定位不是又一个新闻聚合站,而是帮助用户从一堆信源里选出千里马的 AI 信息源筛选系统。它解决 AI 从业者追踪行业动态时的信息淹没、原始来源丢失、接入方式差异大、个性化需求无法满足、缺乏健康评估机制以及 Agent 自动化维护门槛高等痛点。核心设计思想是“先判断,再接入”,在信息源层面做第一轮判断,区分一手源与聚合源,并尊重每个源的原生接入方式。系统支持九类信源,内置 22 个默认信息源,通过六阶段 Pipeline 完成信源分类、抓取、去重、过滤、健康统计和静态站点生成。核心流程不依赖大模型 API,也不需要服务器,运行在 GitHub Actions 和 GitHub Pages 上,每 30 分钟自动更新。

静态站点生成开源信息源评估
09.08
ATLAS (Adaptive Test-time Learning and Autonomous Specialization) README 配图
开发工具GitHub 项目

ATLAS (Adaptive Test-time Learning and Autonomous Specialization)

完全本地化、无需 API 的 AI 编程助手,通过推理时增强让 14B 小模型在单张消费级 GPU 上达到接近前沿模型的编程能力。

ATLAS(Adaptive Test-time Learning and Autonomous Specialization)是一个完全本地化、无需 API 的 AI 编程助手,由 Virginia Tech 商学院学生 Isaac Tigges 独立开发,采用 AGPL-3.0 开源许可。其核心思路是冻结小模型(如 Qwen3-14B),通过智能推理基础设施在推理阶段提升输出质量,而非微调模型。在 RTX 5060 Ti 16GB 显卡上,ATLAS 在 LiveCodeBench v5 上达到 74.6% pass@1-v(k=3) 的分数,接近 GPT-5 和 Claude 4.5 的水平。其 V3 Pipeline 包含三阶段:候选生成(PlanSearch、BudgetForcing、DivSampling)、Lens 路由评分和 PR-CoT 自验证迭代修复。ATLAS 支持 8 个工具调用,通过语法约束解码保证 JSON 输出格式正确,并采用 T1/T2 文件分级机制智能路由简单与复杂任务。主要优势是 100% 本地运行、零 API 成本(每任务约 $0.004 电费)和数据隐私,但需要 16GB VRAM 的 NVIDIA GPU,安装复杂且仅支持 Linux。

本地优先开源推理时增强
09.08
Narrator AI CLI Skill README 配图
AI 智能体GitHub 项目

Narrator AI CLI Skill

让 AI Agent 通过自然语言对话自动完成电影解说视频全流程生产的技能描述文件

Narrator AI CLI Skill 是一个 AI Agent 技能描述文件,教会 AI Agent(如 OpenClaw、Claude Code、Cursor、Windsurf 等)如何调用 narrator-ai-cli 命令行工具,完成电影/短剧解说视频的全自动化生产。它解决的核心问题是让不懂视频剪辑、命令行和 API 调用的普通用户,通过自然语言对话就能完成从搜片、选模板、选 BGM、选配音、生成文案到合成视频的完整流水线。项目采用 SKILL.md 主文件加 references/ 子目录的结构化行为规范,将 CLI 的调用顺序、参数依赖、错误处理和决策逻辑编码为机器可读的说明书,并定义了 Fast Path(原创文案)和 Standard Path(二创文案)两条工作流路径。内置约 100 部电影素材、146 首 BGM、63 个配音音色(11 种语言)和 90+ 解说模板,支持多语种出海场景。项目采用积分计费模式,MIT 开源协议,版本 v1.0.5,已在 9 个 AI Agent 平台验证。

多语种视频生成自动化
09.08
Hermes Agent README 配图
AI 智能体GitHub 项目

Hermes Agent

一个自带学习闭环的开源 AI Agent 运行时

Hermes Agent 是由 Nous Research 开发的开源 AI Agent 框架,定位为通用的、可自我改进的 AI Agent 平台。它通过终端 TUI 或 15+ 消息平台与用户对话,调用 47+ 内置工具操作终端、浏览器、文件系统等,并支持通过 MCP 协议扩展能力。其核心特色是闭环学习系统:通过持久化记忆(MEMORY.md + USER.md)、技能(Skills)自创建与改进、以及会话搜索(FTS5),从经验中持续成长。它支持 18+ LLM 提供商,可随时切换模型,避免供应商锁定。此外,它提供六种终端后端(本地、Docker、SSH 等)和内置 Cron 调度器,适用于开发助手、运维监控、知识管理等场景。

多平台记忆系统开源
09.08
z-mio 的 GitHub 头像z-mio/ParseHub
数据与分析GitHub 项目

ParseHub

一个统一接口解析17+国内外社交媒体平台的轻量异步工具

ParseHub 是一款由开发者梓澪(z-mio)于 2024 年 11 月开源的社交媒体聚合解析库与 CLI 工具,使用 Python 编写,采用 MIT 协议。它通过统一的 parse() 和 download() 接口,支持 17+ 国内外主流社交媒体平台的链接解析与媒体下载,覆盖视频、图文、实况照片等多种内容类型。其核心设计是“一个接口,17+ 平台,零配置即用”,用户无需预处理链接,工具可自动从分享文案中提取 URL、清理跟踪参数并识别目标平台。ParseHub 底层聚合了 yt-dlp、instaloader 等成熟项目,并针对国内特有平台自行实现解析逻辑。它提供 CLI、Python API(同步/异步)和 Telegram Bot 三种使用方式,支持按平台配置 Cookie 和代理,并原生支持 async/await,适合批量处理场景。

媒体下载社交媒体解析异步
09.08