探索 Python 项目
筛选并发现收录的、配有高质量中文文档或教程的 GitHub 项目。
最良心的 Python 教程,基于 Python 3.6 编写,涵盖从入门到进阶的完整知识体系,包括语法、数据类型、函数、面向对象、模块等核心内容。
基于 Chromium 的隐私增强浏览器,移除所有 Google 服务依赖与后台请求,保留原生体验,提供自定义配置与构建选项。
由阿里云 Qwen 团队开发的大语言模型系列,提供多种规模的密集模型和 MoE 模型。支持思考与非思考模式切换,具备强大的推理、代码生成和长上下文理解能力(最高 1M tokens)。开源权重,支持 Hugging Face、ModelScope 等平台。
🚀 快速、Pythonic 的 MCP 服务器与客户端构建框架。基于 Python,提供组件、提供者、转换三大抽象,简化协议实现,让开发者专注于业务逻辑。星标 22k+,被 70% 的 MCP 服务器采用。
基于 MkDocs 的强大文档框架,支持 Markdown 编写。提供搜索、多语言、自定义主题,可快速生成专业静态站点。
🤗 LeRobot:通过端到端学习降低机器人 AI 门槛。提供 PyTorch 模型、数据集与工具,支持硬件无关的统一控制接口,涵盖低成本机械臂到人形机器人。拥有标准化 LeRobotDataset 格式(Parquet + MP4/图像),可在 Hugging Face Hub 高效存储与流式访问。提供可迁移至真实世界的 SOTA 策略,支持模仿学习、强化学习与视觉-语言-动作模型。
Stability AI 开发的生成模型库,核心为 Stable Video 4D 2.0 (SV4D 2.0)。支持从单视频生成高保真新视角视频与 4D 资产,具备更优的时空一致性与真实世界泛化能力。提供 Python 接口与快速启动脚本。
完全本地的自主 AI 助手,无需 API 和月费。支持网页浏览、代码编写与任务规划,所有数据保留在本地设备,确保隐私安全。适用于 Python 等多种语言。
实现 Manus 风格的持久化 Markdown 规划工作流,支持多 IDE 平台与会话恢复,核心功能包括自动任务跟踪与上下文管理。
开发者作品集灵感库,收录 1478 个作品集,按字母排序,支持随机跳转。由 Ali Spittel 的推文启发,欢迎贡献。
开源微信个人号接口,使用 Python 调用微信。仅需三十行代码即可创建自定义机器人,支持消息处理、文件收发、多账号登录等。提供命令行二维码、热重载登录状态及高级消息注册功能。
完全开源复现 DeepSeek-R1 的项目,提供模型训练、数据生成和评估的完整流程。包含 GRPO 和 SFT 训练脚本,支持从 R1 蒸馏数据生成合成数据集,如 Mixture-of-Thoughts 和 CodeForces-CoTs。项目使用 Python 构建,已发布多个基准数据集和训练模型,旨在让社区共同构建和扩展 R1 能力。
开源AI编排框架,用于构建可定制、生产就绪的LLM应用。连接组件至流水线或智能体,支持高级检索方法,适用于RAG、问答、语义搜索和对话智能体。
提供 AI 代理技能目录,包含指令、脚本和资源。支持一次编写,随处使用,帮助团队以可重复方式完成特定任务。可通过 Codex 安装和分发技能。
深度学习图像处理教程,涵盖分类与目标检测。提供 PyTorch 和 TensorFlow 实现,包含 ResNet、YOLO 等经典网络视频讲解与代码。
Facebook AI Research 的目标检测研究平台,实现 Mask R-CNN 等流行算法,基于 Caffe2 框架。已弃用,请转向 detectron2。
端侧多模态大模型,支持视觉、语音及全双工实时流式处理,性能媲美 Gemini 2.5 Flash。提供 4.5B 和 9B 参数版本,适用于手机等设备部署。
Chatterbox 是 Resemble AI 推出的系列开源 TTS 模型,包含三个版本。Turbo 版本采用 350M 参数架构,计算和显存需求更低,支持 `[cough]` 等副语言标签,延迟低于 200ms,适用于低延迟语音代理和创意工作流。
开源手机智能代理模型与框架,通过视觉语言模型理解屏幕内容,结合 ADB 自动化操作,实现自然语言驱动的手机任务自动化。支持 Android 与 iOS 设备,提供远程调试能力,适用于研究与学习。
基于深度神经网络的 GUI 人声移除工具,支持 Windows 和 macOS,提供多种先进模型,可分离音轨。
基于 Python 的命令行工具,从 Spotify 播放列表和歌曲中下载音乐,并从 YouTube 获取匹配的音频,同时嵌入专辑封面、歌词和元数据。支持多种安装方式,包括 pip、Docker 和预编译可执行文件。
FLUX.1 官方推理库,支持多种图像生成与编辑模型,包括文本到图像、图像修复、结构化条件生成等。提供 Python 安装与 TensorRT 支持,模型权重开放,可商用授权。
Vim 的快速代码补全引擎,支持模糊搜索和语义补全。内置多种语言支持,包括 C/C++、Python、Java、C#、Go、Rust、JavaScript/TypeScript 等,并兼容 Language Server Protocol。
开源 RAG 工具,用于与文档对话。支持多种 LLM 和本地模型,提供简洁 UI 与可定制框架。具备混合检索、多模态问答和高级引用功能。
提供 192 个生产就绪的 Claude Code 技能与插件,支持 11 种 AI 编码工具,涵盖工程、营销、产品等多领域,Python 编写,零依赖安装。
开源视觉语言多任务学习模型,提供 MiniGPT-4 和 MiniGPT-v2 代码。支持图像理解与对话,集成 Hugging Face 和 Gradio 演示,社区构建了多种应用。
基于 Keras 和 TensorFlow 的 Mask R-CNN 实现,用于目标检测与实例分割。支持 MS COCO 预训练权重、多 GPU 训练及自定义数据集训练,提供可视化工具与逐步调试笔记本。