探索 Python 项目
筛选并发现收录的、配有高质量中文文档或教程的 GitHub 项目。
完全本地的自主 AI 助手,无需 API 和月费。支持网页浏览、代码编写与任务规划,所有数据保留在本地设备,确保隐私安全。适用于 Python 等多种语言。
开源微信个人号接口,使用 Python 调用微信。仅需三十行代码即可创建自定义机器人,支持消息处理、文件收发、多账号登录等。提供命令行二维码、热重载登录状态及高级消息注册功能。
完全开源复现 DeepSeek-R1 的项目,提供模型训练、数据生成和评估的完整流程。包含 GRPO 和 SFT 训练脚本,支持从 R1 蒸馏数据生成合成数据集,如 Mixture-of-Thoughts 和 CodeForces-CoTs。项目使用 Python 构建,已发布多个基准数据集和训练模型,旨在让社区共同构建和扩展 R1 能力。
Facebook AI Research 的目标检测研究平台,实现 Mask R-CNN 等流行算法,基于 Caffe2 框架。已弃用,请转向 detectron2。
深度学习图像处理教程,涵盖分类与目标检测。提供 PyTorch 和 TensorFlow 实现,包含 ResNet、YOLO 等经典网络视频讲解与代码。
🤗 LeRobot:通过端到端学习降低机器人 AI 门槛。提供 PyTorch 模型、数据集与工具,支持硬件无关的统一控制接口,涵盖低成本机械臂到人形机器人。拥有标准化 LeRobotDataset 格式(Parquet + MP4/图像),可在 Hugging Face Hub 高效存储与流式访问。提供可迁移至真实世界的 SOTA 策略,支持模仿学习、强化学习与视觉-语言-动作模型。
开源AI编排框架,用于构建可定制、生产就绪的LLM应用。连接组件至流水线或智能体,支持高级检索方法,适用于RAG、问答、语义搜索和对话智能体。
端侧多模态大模型,支持视觉、语音及全双工实时流式处理,性能媲美 Gemini 2.5 Flash。提供 4.5B 和 9B 参数版本,适用于手机等设备部署。
Vim 的快速代码补全引擎,支持模糊搜索和语义补全。内置多种语言支持,包括 C/C++、Python、Java、C#、Go、Rust、JavaScript/TypeScript 等,并兼容 Language Server Protocol。
开源手机智能代理模型与框架,通过视觉语言模型理解屏幕内容,结合 ADB 自动化操作,实现自然语言驱动的手机任务自动化。支持 Android 与 iOS 设备,提供远程调试能力,适用于研究与学习。
FLUX.1 官方推理库,支持多种图像生成与编辑模型,包括文本到图像、图像修复、结构化条件生成等。提供 Python 安装与 TensorRT 支持,模型权重开放,可商用授权。
实现 Manus 风格的持久化 Markdown 规划工作流,支持多 IDE 平台与会话恢复,核心功能包括自动任务跟踪与上下文管理。
Chatterbox 是 Resemble AI 推出的系列开源 TTS 模型,包含三个版本。Turbo 版本采用 350M 参数架构,计算和显存需求更低,支持 `[cough]` 等副语言标签,延迟低于 200ms,适用于低延迟语音代理和创意工作流。
开源 RAG 工具,用于与文档对话。支持多种 LLM 和本地模型,提供简洁 UI 与可定制框架。具备混合检索、多模态问答和高级引用功能。
开源视觉语言多任务学习模型,提供 MiniGPT-4 和 MiniGPT-v2 代码。支持图像理解与对话,集成 Hugging Face 和 Gradio 演示,社区构建了多种应用。
开发者作品集灵感库,收录 1478 个作品集,按字母排序,支持随机跳转。由 Ali Spittel 的推文启发,欢迎贡献。
基于 Python 的命令行工具,从 Spotify 播放列表和歌曲中下载音乐,并从 YouTube 获取匹配的音频,同时嵌入专辑封面、歌词和元数据。支持多种安装方式,包括 pip、Docker 和预编译可执行文件。
基于 Keras 和 TensorFlow 的 Mask R-CNN 实现,用于目标检测与实例分割。支持 MS COCO 预训练权重、多 GPU 训练及自定义数据集训练,提供可视化工具与逐步调试笔记本。
基于深度神经网络的 GUI 人声移除工具,支持 Windows 和 macOS,提供多种先进模型,可分离音轨。
基于 PyTorch 的 Vision Transformer 实现,支持多种变体如 Simple ViT、NaViT、Deep ViT 等,适用于图像分类任务,提供简洁 API 和预训练模型接口。
PyTorch 实现的 CycleGAN 和 pix2pix,支持无配对和配对图像转换。2025 年更新支持 Python 3.11 和 PyTorch 2.4,新增 DDP 多 GPU 训练。推荐 img2img-turbo 和 CUT 以获得更快推理和更高效训练。
连接 LLM 与 ML 社区的系统,以 LLM 为控制器,集成 HuggingFace 专家模型执行复杂 AI 任务。支持任务规划、模型选择、执行与响应生成,提供轻量级配置与云端部署选项。
基于 Python 和 Qt 的图形化图像标注工具,支持 PASCAL VOC、YOLO 和 CreateML 格式。已不再积极开发,推荐使用其所属的 Label Studio 社区项目。
Python 开发工作流管理工具,统一 pip、virtualenv 和 Python 解释器,支持多平台。自动生成虚拟环境和 Pipfile,提供确定性构建,通过 Pipfile.lock 确保依赖安全与一致性。
跨平台命令行工具,基于模板快速创建项目。支持 Python 包、C 项目等,无需 Python 知识。兼容 Windows、Mac、Linux,使用 Jinja2 模板引擎。