探索 Python 项目
筛选并发现收录的、配有高质量中文文档或教程的 GitHub 项目。
插入光盘后自动检测类型(音频/视频/数据),使用 MakeMKV、HandBrake 或 abcde 翻录。支持从多个光驱并行处理,提供 Flask Web 界面管理任务与日志。
ControlNet 1.1 是官方发布的稳定版本,架构与 1.0 完全一致,保证了模型的稳定性和兼容性。包含 14 个模型(11 个生产就绪,3 个实验性),支持多种预处理方式,如深度图、线稿、姿态等。提供 A1111 WebUI 插件支持,可同时使用多个 ControlNet 模型。
基于 PyTorch 的 3D 深度学习加速库,提供模块化可微渲染、快速表示转换、数据加载、3D 检查点、可微相机与光照 API、结构化点云加速及 Jupyter 交互式可视化等 GPU 优化操作。
基于 PyTorch 的人脸识别库,提供预训练的 MTCNN 人脸检测和 InceptionResnet 识别模型。支持快速部署与微调,包含完整检测识别流程示例。
动机驱动学术写作系统,学习优秀论文构建中心论点,通过证据感知蓝图、修订矩阵和 LaTeX 安全审计重写手稿。支持多宿主适配、五阶段科研工作流,输出 LaTeX/PDF/Word,覆盖期刊、会议等场景。
视频场景切换检测工具,基于 Python 与 OpenCV。命令行和 API 支持,自动分割视频场景,使用 ffmpeg 或 mkvmerge。
提供 DRY Django 表单的最佳方式。通过标签和过滤器,快速以 div 格式渲染表单,同时提供强大的配置和控制渲染 HTML 的能力。支持 Bootstrap、Tailwind 等多种前端框架。
开源语音接口,支持桌面、移动端和 ESP32 芯片。基于 Open Interpreter,提供自然语言交互,可执行代码、浏览网页、管理文件和控制第三方软件。提供轻量级和 Livekit 服务器选项,以及 Android、iOS、ESP32 和桌面客户端。
基于 veRL 的高效可扩展多模态强化学习训练框架。支持 Llama3/Qwen2-VL 等模型,集成 GRPO/DAPO 等算法,提供 LoRA 训练、无填充训练及多节点分布式支持。可通过 Docker 快速部署。
基于 Stable Diffusion 的 WebUI 插件,通过 5-20 张肖像训练生成个性化数字分身。支持 SDXL、视频生成及属性编辑,可快速部署于云端或本地。
将 GeminiCLI 和 Antigravity 转换为 OpenAI、GEMINI 和 Claude API 接口,支持多格式端点、智能凭证管理、流式传输和 Web 控制台。
基于 Keras 的深度学习模型,将手绘网站线框图转换为可运行的 HTML 代码。采用图像描述架构,从手绘草图生成 HTML 标记。项目基于 pix2code 和 Design Mockups 构建。
CommonMark 是 Markdown 语法的规范化版本,提供规范及 C 和 JavaScript 参考实现。包含测试工具和 HTML/PDF 生成,支持多种语言库。
基于 Python 的 Web SSH 客户端,支持密码、公钥及双因素认证。提供全屏终端、自定义编码与字体,可通过浏览器或 Docker 部署。
免费开源 AI 图像放大与增强工具,支持高分辨率、自定义模型及多种集成方式,提供 App、API 和 ComfyUI 节点。
灵活的多版本、多配置、多平台、多编译器包管理器,支持 Linux、macOS、Windows 和超算,非破坏性安装,使用 Python 编写,提供简洁的 spec 语法。
PyTorch 深度学习项目模板,提供清晰的文件结构、JSON 配置支持、命令行选项、断点续训和抽象基类,加速开发流程。
Python 脚本集合,支持百度网盘、115网盘、网易/百度音乐、虾米音乐、视频解析、BT磁力转换、Tumblr下载等,提供命令行工具。