探索 Python 项目
筛选并发现收录的、配有高质量中文文档或教程的 GitHub 项目。
包含 3Blue1Brown 视频中 Manim 生成场景的代码。主要使用 Python,基于 Manim 库。提供交互式工作流,支持 Sublime Text 插件和命令行调试。内容遵循 CC BY-NC-SA 4.0 许可。
StyleGAN2 是 NVIDIA 官方发布的 TensorFlow 实现,用于生成高质量图像。它通过改进生成器归一化、重新审视渐进式增长和正则化等方法,显著提升了图像质量,并提供了预训练模型和相关资源。
基于深度学习的图像风格迁移工具,支持将风格照片的纹理与内容照片融合,实现照片级真实感效果。采用闭式解法,速度快,兼容 Python 2.7 和 3.5。
提供机器学习算法的简洁、干净实现示例,涵盖深度学习、线性模型、随机森林、SVM、K-Means、GMM、KNN、朴素贝叶斯、PCA、因子分解机、RBM、t-SNE、GBDT 和强化学习。代码基于 Python、NumPy、SciPy 和 Autograd,便于学习算法内部原理和从头实现。
自托管书签管理器,设计极简、快速,支持 Docker 部署。提供标签管理、批量编辑、Markdown 笔记、自动归档、PWA 安装、浏览器扩展及 OIDC SSO 等功能。
基于 LLVM 的 Python 即时编译器,专为 NumPy 数值计算优化。支持自动并行化、GPU 加速及 ufunc 生成,显著提升 Python 数值代码性能。
纯本地量化解决方案,支持股票/期货/期权的数据、回测、模拟、交易、可视化及多账户管理。集成 Rust 核心 QARS2,实现 100x 账户操作与 10x 回测性能提升,内存占用降低 90%。提供 QARSBridge 与 QADataBridge 实现高性能桥接与零拷贝数据交换,兼容 QIFI 协议。
开源框架,用于构建实时多模态对话式语音 AI 代理。支持低延迟、高质量实时交互,涵盖语音助手、涂鸦板、说话人识别、唇形同步、SIP 通话、转录及 ESP32 硬件集成等丰富示例。
入门级人脸、视频、文字检测与识别项目。支持人脸检测识别、轮廓标识、头像合成、数字化妆、性别与表情识别、视频对象提取、图片修复及自动上色。基于 Python、OpenCV、Dlib、Keras 等技术栈。
开源情报平台,整合 60+ 实时数据源,追踪飞机、卫星、船舶、地震等,支持多视觉模式与自托管后端,无用户数据收集。
Python Serverless 微框架,用于 AWS。快速创建和部署 AWS Lambda 应用,提供命令行工具、装饰器 API 集成 API Gateway、S3、SNS、SQS 等服务,并自动生成 IAM 策略。
实时全双工语音对话框架,基于 Mimi 流式神经音频编解码器。提供 PyTorch、MLX 和 Rust 三种推理栈,支持研究、本地与生产部署。
定义 AI/ML 任务的标准化技能,兼容 Claude Code、Codex、Gemini CLI 和 Cursor 等主流编码代理工具。提供 Gradio、Hugging Face CLI、数据集管理、模型训练与评估等技能,支持自定义扩展。
基于 AI 大模型,一键完成视频解说、剪辑、配音和字幕生成,实现高效自动化内容创作。支持多种模型和语音克隆,提供一站式影视解说解决方案。
超低延迟自托管实时语音转文本,支持说话人识别与多语言同步翻译。基于前沿研究,提供智能缓冲与增量处理,适用于多种场景。
开源 AI SRE 代理框架,支持构建自定义工作流,连接 60+ 工具,调查基础设施事件。提供训练与评估环境,适用于生产环境故障排查。
基于大语言模型的高效文本转语音系统,支持零样本语音克隆与中英双语合成。采用单流解耦语音令牌技术,无需额外生成模型,直接从 LLM 预测的代码重建音频,实现高效推理。支持性别、音高、语速等参数控制,可创建虚拟说话者。
社区驱动的多智能体金融平台,提供 A 股深度研究与市场分析。核心功能包括:多智能体系统(深度研究、策略、新闻检索)、灵活集成(多 LLM、市场数据、框架兼容)、实时交易(支持 OKX、Binance 等)。数据本地存储,保障安全。
通用 SIEM 签名格式,提供超过 3000 条检测规则,涵盖通用检测、威胁狩猎、新兴威胁和合规规则。支持多厂商 SIEM 查询语言转换,社区驱动,免费共享。
开源推理服务软件,支持多框架模型部署,优化云端与边缘端性能。支持并发执行、动态批处理、序列批处理及状态管理,提供 HTTP/REST、gRPC、C 和 Java API。
开源密码恢复工具,支持从多种软件中提取密码,包括浏览器、邮件客户端、数据库等。支持 Windows、Linux 和 macOS,可离线运行并输出多种格式。