探索 Python 项目
筛选并发现收录的、配有高质量中文文档或教程的 GitHub 项目。
开源智能体框架,模拟人类操作计算机。Agent S3 在 OSWorld 上首次超越人类性能 (72.60%),支持 Windows、macOS 和 Linux。提供 Python 库,可轻松集成。
纯 Python 3 MTProto 库,用于通过用户或机器人账号与 Telegram API 交互。支持 asyncio,易于安装和使用。
Python SQL 工具包与 ORM,提供企业级持久化模式,支持高效数据库访问。核心包含 SQL 表达式语言、模式元数据和连接池,ORM 支持声明式配置与事务管理。
基于深度学习,将图形用户界面截图自动转换为代码,支持 iOS、Android 和 Web 平台,准确率超过 77%。
让 Claude 具备视频理解能力。支持 URL 或本地文件,自动下载、提取关键帧、转录音频。通过字幕或 Whisper API 获取文本,结合视觉帧进行深度分析,适用于内容解析、问题诊断、视频摘要等场景。
开源 DevOps 部署平台,支持 Git、多环境、灰度发布与实时控制台。一键完成 PHP、Java、Python、Go 等代码的发布与回滚。
一站式检索工具包,支持检索与检索增强生成(RAG),提供 BGE 系列模型,涵盖多模态、多语言及轻量级重排序器,适用于搜索与 RAG 应用。
一个小型、表达力强的 ORM,支持 PostgreSQL、MySQL、SQLite 和 CockroachDB。兼容 Python 2.7+ 和 3.4+,提供 asyncio 支持及丰富扩展。安装简单,模型定义直观,查询表达力强。
零样本身份保持生成技术,仅需单张图片即可在数秒内生成高质量图像。支持多种下游任务,无需额外训练,融合文本编辑与风格转换,兼容 Kolors 等模型。
私有化部署的本地 GPT,支持文档、图像、视频等多模态查询与总结。100% 隐私,Apache 2.0 开源。集成 oLLaMa、Mixtral、llama.cpp 等多种模型,提供 Gradio UI 与 CLI,支持 Linux、macOS、Windows 及 Docker。
将 FastAPI 端点作为 MCP 工具暴露,内置认证。原生 FastAPI 零配置,保留请求/响应模型与文档,支持 ASGI 传输与灵活部署。
终端 MySQL 客户端,支持自动补全和语法高亮。基于 Python 开发,提供智能上下文补全、多行查询、常用查询保存、SSL 连接及 Shell 风格重定向等功能。
基于 LLM 的通用软件工程任务智能体,提供强大 CLI 接口,支持自然语言指令与多工具工作流。模块化架构便于研究与扩展,支持 OpenAI、Anthropic 等多种模型。
基于 PyTorch 的开源 NLP 研究库,用于开发各类语言任务的最先进深度学习模型。现已进入维护模式,推荐迁移到 AI2 Tango 等替代方案。
高性能开源音乐生成模型,支持 Mac、AMD、Intel 和 CUDA 设备。生成速度快,A100 上每首歌不到 2 秒,RTX 3090 上不到 10 秒。支持 10 秒到 10 分钟的音频生成,以及 50 多种语言的歌词。提供 LoRA 训练、音频编辑和音轨分离等功能。
基于深度学习的图像超分辨率工具,通过神经网络将低分辨率图像放大 2x 或 4x,可修复 JPEG 瑕疵并生成高清细节。支持 GPU 加速,训练自定义模型以适应特定图像类型。
为 NeRFs 提供协作友好的工作室,简化从创建到训练的端到端流程。模块化设计提升可解释性,支持社区贡献与扩展,提供教程和文档资源。
Serverless Python 框架,用于在 AWS Lambda 上部署 Python 应用。项目已迁移至 zappa/Zappa。
基于容器技术,在常规 GNU/Linux 系统(如 Ubuntu)上启动完整的 Android 系统。使用 Linux 命名空间运行 Android 容器,提供 Android 应用支持,镜像基于 LineageOS 和 Android 13。
⚡️ 高效图像生成基础模型,6B 参数,支持单流扩散 Transformer。提供 Z-Image-Turbo 版本,8 NFE 实现亚秒级推理,16G VRAM 可用。支持高质量生成、丰富美学、强多样性与可控性,适用于创意生成、微调及图像编辑任务。
先进的 OCR 模型,处理复杂表格、表单和手写内容,保留完整布局。支持 90+ 语言,输出 HTML/Markdown/JSON,提供本地和远程推理模式。
开源大模型 DevOps 平台,面向企业级 AI 应用。集成 GenAI 工作流、RAG、Agent、统一模型管理、评估、SFT、数据集管理及企业级系统管理,提供高精度文档解析与复杂场景构建能力。
通用自动化框架,用于验收测试、ATDD 和 RPA。基于 Python,语法简洁,可扩展性强,支持跨平台和应用。
低代码框架,用于构建自定义 LLM、神经网络等 AI 模型。支持声明式 YAML 配置,具备分布式训练、参数高效微调、4 位量化等优化,可扩展至生产环境。
基于 PyTorch 的开源语音工具包,加速对话式 AI 开发。支持语音识别、说话人识别、语音增强等任务,提供 200+ 训练配方和 100+ 预训练模型,可轻松微调 Whisper、Wav2Vec2 等模型。
快速、表达力强的 Python 模板引擎。支持模板继承、宏、HTML 自动转义、沙箱环境、AsyncIO、I18N。模板即时编译为优化的 Python 代码,异常定位准确,可扩展。
PAL MCP 是一个模型上下文协议服务器,将 Claude Code、Gemini CLI 等工具与多种 AI 模型(如 Gemini、OpenAI、Ollama)连接,实现多模型协作。核心功能 clink 支持 CLI 到 CLI 的桥接,允许在单一工作流中启动子代理,实现上下文隔离与角色专业化,提升代码审查、问题排查等复杂任务的效率。