跳到主要内容
prolist.
发现项目AI 收集我的项目我的模型
正在确认账号…
prolist.

发现有价值的项目,留下有依据的判断。

项目专题关于我的收藏
© 2026 prolist项目知识,由人判断。

IDEAS CONNECT PROJECTS

沿着兴趣,发现项目。

从一个标签出发,打开一份值得研究的档案。

收集项目线索
筛选与排序 · 已应用
地图列表
不限标签5浏览器自动化3AI Agent3开源2Python2短视频1多代理协同1多模型路由1反检测浏览器1记忆系统1身份共享1终端1自动化1

项目搜索结果

找到 5 个项目

清除筛选

以下内容已由 AI 根据历史资料整理,供本地测试,未经人工复核。

内容创作主题配图

AI短视频全流程自动化工具链

从创意到发布的全流程自动化短视频生产工具链

AI短视频全流程自动化工具链是一组开源项目按“生成→剪辑→翻译→发布”顺序串联形成的工作流体系,利用大语言模型、语音识别、语音合成、机器翻译和浏览器自动化等技术,将短视频内容创作的全生命周期从“人工逐环节操作”升级为“一键自动化流水线”。工具链由四个核心项目组成:MoneyPrinterTurbo负责视频生成,FunClip负责智能视频剪辑,KrillinAI负责视频翻译配音,social-auto-upload负责多平台一键发布。它属于“AI辅助内容创作”技术体系,核心价值是把一个短视频从“创意到上线”的全流程压缩到分钟级别,并且一个人就能完成传统需要文案、剪辑师、翻译、运营四个人协作的工作。传统短视频制作周期通常需要1-3天,该工具链可大幅缩短制作时间。

短视频浏览器自动化自动化
09.08
AI 智能体主题配图

Codex Chrome Extension

让 AI Agent 在用户已登录的 Chrome 浏览器中直接执行网页自动化任务

Codex Chrome Extension 是 OpenAI 于 2026 年 5 月 7 日发布的 Chrome 浏览器扩展插件,让 Codex AI Agent 能够直接操控用户已登录的 Chrome 浏览器,执行网页自动化任务。该插件解决了 Codex 此前无法操作需要登录的网站的问题,通过复用浏览器已有的 Cookie 和登录状态,使 AI 能够访问邮箱、社交媒体、公司后台等需要认证的页面。其核心能力包括身份共享、多标签页并行处理和多代理协同。用户通过 @Chrome 指令触发浏览器操控,Agent 在独立标签页中工作,不接管整个浏览器,用户可正常使用。该插件需要 Codex CLI 0.129.0 或更高版本,支持 macOS 和 Windows 平台。

多代理协同浏览器自动化身份共享
09.08
CloakHQ 的 GitHub 头像CloakHQ/CloakBrowser
开发工具GitHub 项目

CloakBrowser

源码级修改 Chromium 指纹的反检测浏览器自动化工具

CloakBrowser 是一个基于 Chromium 的隐身浏览器自动化工具,其核心思路是在 Chromium 的 C++ 源码层面修改浏览器指纹,编译出定制二进制文件,使反爬虫/反机器人系统无法识别其为自动化浏览器。它属于反检测浏览器自动化领域,介于传统浏览器自动化和商业反检测浏览器之间,提供与 Playwright/Puppeteer 完全兼容的 Python 和 JavaScript API。项目通过修改 49–57 处 C++ 源码,覆盖 Canvas、WebGL、Audio、字体、GPU、屏幕、WebRTC、网络计时、自动化标志、CDP、硬件参数、UA 等多个指纹维度,并采用种子驱动的确定性指纹生成系统,确保指纹内部一致性。同时提供 humanize 行为模拟,通过拦截页面方法调用,将鼠标移动、键盘输入、滚动等交互替换为人类模拟版本。定制 Chromium 二进制在 TLS 层面也与正常 Chrome 一致。项目支持 HTTP/SOCKS5 代理、持久化 Profile、Docker 部署及 AWS Lambda 部署。

反检测浏览器开源C++
09.08
Browser Harness README 配图
AI 智能体GitHub 项目

Browser Harness

一个让 LLM Agent 通过 Unix Socket 直连用户 Chrome 的自愈式浏览器控制框架

Browser Harness 是由 browser-use 团队开发的一个自愈式浏览器控制框架,总计约 592 行 Python 代码,直接基于 Chrome DevTools Protocol(CDP)构建。它让 LLM Agent 能够通过一个 Unix Socket 连接到用户已运行的 Chrome 浏览器,实现完全自由地完成任何浏览器任务。其核心定义是:最简单、最轻量的自愈式浏览器控制装置——Agent 在任务执行过程中发现缺少什么功能,就当场写出来补上,无需重启、无需框架更新。该项目旨在解决 LLM Agent 如何以最少的前置代码、最大的灵活性控制真实浏览器的问题。传统方案要么依赖重量级框架(如 Playwright、Selenium),要么把所有交互逻辑预先编码。Browser Harness 反其道而行,只提供一个极薄的 CDP 桥接层(daemon + helpers),剩下的能力由 Agent 在任务执行中即时编写。

浏览器自动化自愈式AI Agent
09.08
Hermes Agent 高阶工具配置 README 配图
AI 智能体GitHub 项目

Hermes Agent 高阶工具配置

一个整合终端操作、代码编辑、浏览器控制、记忆系统与语音交互的开源 AI Agent 框架。

Hermes Agent 是由 Nous Research 开发的开源 AI Agent 框架,定位为自我进化的个人 AI 助手。它整合终端操作、代码编辑、浏览器控制、记忆系统、语音交互于一体,通过 Skill 系统实现无限扩展能力。其核心差异在于内置学习循环,能从经验中创建和改进 Skill,并跨会话构建对用户的深度理解。 该框架采用 CLI 与 GUI 双形态,支持 MCP 协议,不绑定单一 LLM,可灵活切换模型提供商,并支持跨平台部署。其能力分为身份与记忆、感知、表达、效率与成本、生态扩展五大层。记忆系统包含会话内、跨会话和知识图谱三层架构。感知能力涵盖网页抓取、搜索、浏览器自动化等。表达层支持语音合成、语音识别和图片生成。效率层提供 Token 监控、压缩和智能路由工具。生态方面拥有 380+ 社区 Skill。 报告指出其优点包括全能性、丰富的 Skill 生态、强大的记忆系统和零成本可行性,但也存在学习曲线陡、生态碎片化、文档不完善等缺点。

多模型路由记忆系统开源
09.08