探索 Python 项目
筛选并发现收录的、配有高质量中文文档或教程的 GitHub 项目。
基于帧上下文打包与漂移预防的下一代帧预测视频扩散模型。支持常数长度输入上下文,生成负载与视频长度无关。可在笔记本 GPU 上处理 13B 模型与大量帧,训练批大小与图像扩散相似,提供桌面软件。
亚马逊 Web 服务的统一命令行界面,基于 Python 开发。支持多版本 Python,提供安装与配置指南。当前 v1 版本已进入维护模式,建议迁移至 v2。
利用 AI 代理探索数据,创建丰富的可视化图表。支持连接实时数据源,自动刷新并提供实时洞察。可从截图、文本或数据库中提取数据,生成可验证的报告。
Reddit.com 的历史代码归档,主要使用 Python 编写。项目已存档,不再更新。提供 API 文档与自建实例安装指南。
让 Claude 具备视频理解能力。支持 URL 或本地文件,自动下载、提取关键帧、转录音频。通过字幕或 Whisper API 获取文本,结合视觉帧进行深度分析,适用于内容解析、问题诊断、视频摘要等场景。
一个更快的命令行目录导航工具,通过维护常用目录数据库实现快速跳转。支持 j、jc、jo 等命令,兼容 bash、zsh、fish 等 shell,适用于 Linux、macOS 和 Windows。
开源大规模视频生成模型套件,支持文本到视频、图像到视频、视频编辑等多种任务。具备 SOTA 性能,可在消费级 GPU 上运行,支持中英文视觉文本生成,并拥有强大的视频 VAE。
基于 Python 的前馈式 3D 基础模型,用于流式场景重建。采用几何上下文 Transformer,实现高效流式推理与高精度重建,支持长序列处理。
高性能 Python 编译器,零开销编译为原生机器码,支持 NumPy。单线程性能提升 10-100 倍,媲美 C/C++,支持原生多线程、GPU 和 Python 生态互操作。
Qwen3-Coder 是 Qwen3 的代码版本,专为智能体编码和本地开发设计。支持 256K 上下文长度,可扩展至 1M,覆盖 358 种编程语言。提供高效性能与成本的平衡,在 Agentic Coding 和 Agentic Browser-Use 等任务中表现卓越,支持 Qwen Code、CLINE 等多种平台。
基于 Django 和 React 构建的可扩展协作笔记、Wiki 与文档平台。支持实时协同编辑、离线同步与 AI 辅助(改写、摘要、翻译等)。提供多种导出格式与细粒度权限控制,支持自托管部署。
通过轨迹驱动编辑、验证门控更新和可部署 best_skill.md 工件,为冻结 LLM 代理训练可复用自然语言技能。支持多后端、基准测试和 WebUI 仪表板。
交互式 Python 计算环境,提供对象自省、历史记录、输出缓存、可扩展补全和魔法命令。支持 Python 3.11+,遵循 SPEC-0000 规范。
基于 Python 的强大网络爬虫系统,支持分布式架构与多种数据库后端。提供功能丰富的 WebUI,包含脚本编辑、任务监控与结果查看。支持 JavaScript 页面抓取及 Python 2/3 多版本。
OpenAI Baselines 提供高质量的强化学习算法实现,支持 DQN、PPO 等算法,便于研究复现与基准测试。基于 Python,需 TensorFlow 1.4-1.14,支持 GPU 加速。
安全扫描 AI 代理技能,检测漏洞、恶意模式和安全风险。支持多格式输入、64 种漏洞模式、两阶段分析、实时 CVE 查询及多种报告格式。
使用 Python 构建实时 Web、移动和桌面应用,无需前端经验。支持单代码库跨平台,内置 150+ UI 控件和 50+ Python 库,提供完整 Web 支持与打包功能。
通用 SEO 技能,支持 19 项子技能、12 个子代理和 3 个扩展。涵盖技术 SEO、E-E-A-T、结构化数据、GEO/AEO、外链、本地 SEO、地图智能、Google API 及 PDF/Excel 报告。
一个轻量级 Python 调试工具,通过装饰器或 with 语句自动记录代码执行流程和变量变化,无需复杂设置,替代繁琐的 print 调试。
基于 ViT 的 LaTeX OCR 系统,将数学公式图像转换为 LaTeX 代码。提供命令行、GUI、API 及 Python 集成,支持自动分辨率预处理,提升识别准确率。