探索 Python 项目
筛选并发现收录的、配有高质量中文文档或教程的 GitHub 项目。
Tongyi DeepResearch 是阿里云推出的开源深度研究智能体,具备 305 亿参数,每 token 仅激活 33 亿参数。专为长周期、深度信息检索任务设计,在多个智能体搜索基准测试中表现领先。
全流程加速科研:利用 ChatGPT 对 arXiv 论文进行全文总结、专业翻译、润色、审稿及审稿回复。支持本地 PDF 全文翻译与一键生成 XMind 笔记。
Python3 网络爬虫实战项目,涵盖淘宝、京东、网易云、B站、12306、抖音、笔趣阁等平台,提供漫画小说、音乐电影下载工具及验证码识别、代理IP池构建等实用脚本。
将电子书转换为有声书,支持章节与元数据。利用 XTTSv2、Piper-TTS 等多种引擎,提供高质量语音合成与语音克隆,支持 1158 种语言。提供 Web GUI 与命令行界面,可本地或云端运行。
AI 原生数据应用开发框架,集成 AWEL 智能体工作流表达语言与多智能体协作。支持 RAG、GBI、微调及数据驱动自进化,简化大模型应用开发。
开源 AI 软件工程师,能理解指令、拆解步骤、研究信息并编写代码。支持 Claude 3、GPT-4、Gemini 等多种模型及本地 LLM,具备高级规划推理与网页浏览能力。项目处于早期开发阶段,欢迎贡献。
端到端语音识别工具包,支持 ASR、VAD、标点恢复、说话人验证等。提供工业级预训练模型,支持推理与微调,涵盖 Paraformer、Whisper 等模型。
精选知名 SaaS 产品的开源替代方案列表,由 Runa Capital 维护。涵盖 API 网关、平台、测试等类别,收录标准严格,包括 100+ GitHub 星标、近十年成立的私有营利公司。
1.6B 参数 TTS 模型,单次生成超逼真对话。支持音频条件控制情感与语调,可生成笑声、咳嗽等非语言声音。提供预训练模型与推理代码,支持 Hugging Face Transformers。
Python 伪数据生成库,支持数据库填充、XML 文档创建、压力测试和数据脱敏。灵感源自 PHP、Perl 和 Ruby 的 Faker,提供多语言本地化支持,兼容 Python 3.8+。
将数据与 AI 算法快速转化为生产就绪的 Web 应用。无需学习新语言,仅需 Python。提供 UI 生成、数据集成、管道编排、场景管理及部署工具。
用 Rust 编写的超快 Python 类型检查器和语言服务器,速度比 mypy 和 Pyright 快 10-100 倍。提供丰富的诊断信息、可配置规则、语言服务器功能,并支持 VS Code、PyCharm 等编辑器集成。
开源高频加密交易机器人框架,支持多交易所自动化策略部署,已生成超 340 亿美元交易量。基于 Python,提供 Docker 快速安装与社区支持。
基于 Python 3.10+ 的开源 Google 框架,专注于 OSINT 信息收集。支持 CLI 与库调用,完全异步,可导出 JSON。提供浏览器扩展简化登录流程。
将 PDF 等图像文档线性化为纯文本,支持公式、表格和手写体识别。基于 7B 参数 VLM,成本低于 200 美元/百万页,需 GPU。
包含大量简单 Python 小项目,用于提升编程技能。支持 GitHub 协作,提供贡献指南与模板。
专注于大模型异构推理与微调的高效框架,支持 CPU-GPU 协同计算。核心模块 kt-kernel 提供高性能内核,支持 AMX/AVX 加速与 MoE 优化;kt-sft 集成 LLaMA-Factory,支持 RL-DPO 等微调。已支持 Kimi-K2、DeepSeek-V3/R1、Qwen3-Next 等模型,提供 Day0 支持与多硬件适配。
评估 LLM 及其系统的框架,提供开源基准注册表。支持自定义评估,可使用私有数据构建工作流模式评估。支持在 OpenAI 仪表板中直接配置运行。
🚀 高性能异步数据爬取工具,支持抖音、快手、TikTok、Bilibili。提供 API 调用、在线批量解析及下载功能,开箱即用。
开源 Python UI 框架,支持跨平台开发。基于 OpenGL ES 2.0,提供多触控支持与可扩展控件库。可部署于 Windows、Linux、macOS、Android 和 iOS。
基于 Hugging Face Transformers 构建的强化学习库,支持 SFT、GRPO、DPO 等后训练技术。提供多种训练器,可扩展至多节点集群,并与 PEFT、Unsloth 等工具集成,支持 CLI 操作。
提供最先进的文本嵌入、检索与重排序框架。支持 15000+ 预训练模型,可快速计算句子向量、相似度分数或稀疏嵌入。适用于语义搜索、文本相似度等任务,支持自定义模型训练与微调。
开源中文LLaMA与Alpaca大语言模型,扩展中文词表并基于中文数据预训练与指令精调。支持本地CPU/GPU量化部署,兼容transformers、llama.cpp等生态,提供7B/13B/33B等多版本模型。
可 DIY 的多模态 AI 聊天机器人,支持微信、QQ、Telegram 等平台。集成 DeepSeek、Claude、Grok、OpenAI 等主流大模型,具备工作流系统、网页搜索、AI 画图、语音对话及虚拟女仆功能。
基于 Pydantic 的 GenAI Agent 框架,提供类型安全、模型无关、无缝可观测性和强大的评估功能。支持 MCP、A2A 和 UI 标准,实现人机回圈工具审批和持久化执行。
Agent 记忆系统,学习而非仅记忆。基于 Python,支持 Docker 快速部署,提供 LLM 包装器与 SDK,自动存储检索记忆。性能领先,适用于 Fortune 500 企业与 AI 初创公司。