跳到主要内容
prolist.
发现项目AI 收集我的项目我的模型
正在确认账号…
prolist.

发现有价值的项目,留下有依据的判断。

项目专题关于我的收藏
© 2026 prolist项目知识,由人判断。

IDEAS CONNECT PROJECTS

沿着兴趣,发现项目。

从一个标签出发,打开一份值得研究的档案。

收集项目线索
筛选与排序 · 已应用
地图列表
不限标签3Python2表格抽取1公式提取1回测1机器学习1开源1量化投资1媒体下载1社交媒体解析1深度学习1特征工程1无障碍标注1

项目搜索结果

找到 3 个项目

清除筛选

以下内容已由 AI 根据历史资料整理,供本地测试,未经人工复核。

微软Qlib AI量化投资平台 README 配图
数据与分析GitHub 项目

微软Qlib AI量化投资平台

微软研究院开源的AI量化投资研究平台,将量化研究全流程标准化

Qlib 是微软研究院(Microsoft Research)开源的面向 AI 的量化投资平台。它将量化投资的完整研究流程——从数据获取、特征工程、模型训练到回测评估——标准化为一套模块化的 Python 框架,让开发者可以专注于策略逻辑本身,而不是底层工程实现。Qlib 采用分层模块化架构,从底向上依次为数据层、特征引擎、模型层、策略层、回测与评估层、在线服务层。数据层负责数据的获取、存储和预处理,统一存储为 qlib binary 格式;特征引擎内置 Alpha158 和 Alpha360 特征集;模型层支持传统机器学习(LightGBM、XGBoost)、深度学习(LSTM、Transformer)以及强化学习;策略层提供 TopkDropout、TopK 等策略;回测与评估层考虑滑点、交易摩擦、手续费,并提供 IC、Sharpe Ratio、Max Drawdown 等评估指标;在线服务层支持模型部署到生产环境。Qlib 支持美股、A 股、港股等市场,并集成了微软的 RD-Agent,可自动搜索最优的模型架构和因子组合。

回测机器学习开源
09.08
opendataloader-pdf README 配图
数据与分析GitHub 项目

opendataloader-pdf

开源 PDF 解析与无障碍标注引擎,本地优先、AI 增强

OpenDataLoader PDF 是由韩国 Hancom 开发的 PDF 解析引擎,能将 PDF 转换为 AI 可消费的结构化数据(Markdown、JSON、HTML),同时是全球首个开源端到端 PDF 无障碍自动标注工具。它采用“本地确定性解析为主,AI 混合增强为辅”的核心思想:简单页面由本地 Java 引擎快速处理,复杂页面(如无边框表格、扫描件、公式、图表)路由到自托管的 AI 后端增强,全程数据不出机器。引擎提供阅读顺序识别(XY-Cut++)、边界框坐标、表格抽取、OCR(80+ 语言)、公式提取(LaTeX)、图表描述等功能,并内置 AI 安全过滤机制。项目采用 Apache-2.0 许可证,提供 Python、Node.js、Java SDK 及 CLI,支持 LangChain 集成。报告指出其基准测试成绩为开源第一(Hybrid 模式总分 0.907),但基准由 Hancom 内部测试,缺乏第三方独立验证。

表格抽取公式提取无障碍标注
09.08
z-mio 的 GitHub 头像z-mio/ParseHub
数据与分析GitHub 项目

ParseHub

一个统一接口解析17+国内外社交媒体平台的轻量异步工具

ParseHub 是一款由开发者梓澪(z-mio)于 2024 年 11 月开源的社交媒体聚合解析库与 CLI 工具,使用 Python 编写,采用 MIT 协议。它通过统一的 parse() 和 download() 接口,支持 17+ 国内外主流社交媒体平台的链接解析与媒体下载,覆盖视频、图文、实况照片等多种内容类型。其核心设计是“一个接口,17+ 平台,零配置即用”,用户无需预处理链接,工具可自动从分享文案中提取 URL、清理跟踪参数并识别目标平台。ParseHub 底层聚合了 yt-dlp、instaloader 等成熟项目,并针对国内特有平台自行实现解析逻辑。它提供 CLI、Python API(同步/异步)和 Telegram Bot 三种使用方式,支持按平台配置 Cookie 和代理,并原生支持 async/await,适合批量处理场景。

媒体下载社交媒体解析异步
09.08