探索 Python 项目
筛选并发现收录的、配有高质量中文文档或教程的 GitHub 项目。
5秒克隆声音,实时生成任意语音。基于Python与PyTorch,支持多语言数据集,兼容Windows/Linux/Mac,提供Web服务接口。
基于VITS的简单易用变声框架。支持使用≤10分钟语音数据快速训练高质量模型,通过检索替换特征杜绝音色泄漏。提供网页界面,支持实时变声(端到端延迟低至90ms),集成UVR5人声伴奏分离及InterSpeech2023-RMVPE音高提取算法。兼容N卡、A卡、I卡加速。
面向初学者的Python编程课程,包含100节视频课、44小时内容、代码与项目。涵盖基础、前端、后端、测试及AI(如FastAPI、MongoDB、ChatGPT)。支持实时直播互动与聊天群组。
面向生产环境的多语种NLP工具包,基于PyTorch和TensorFlow 2.x双引擎,支持130种语言的10种联合任务,涵盖分词、词性标注、命名实体识别、句法分析、语义角色标注、指代消解、文本分类、自动摘要等核心功能,精度高、性能优、语料时新。
用于编程而非提示语言模型的框架,支持快速迭代构建模块化AI系统,提供优化提示和权重的算法,适用于简单分类器、复杂RAG管道或智能体循环。
您的AI第二大脑。可自托管,从本地或云端LLM获取答案。支持自定义智能体、自动化排程、深度研究,将任何LLM变为个人自主AI。提供语义搜索、多格式文档解析及跨平台访问。
基于用户名从数千个网站收集个人档案信息,支持 Tor、I2P 站点及域名解析。无需 API 密钥,提供递归搜索、标签过滤及反审查检测功能。
EMNLP 2025演示项目,基于AI完整保留排版的PDF科学论文全文双语翻译,支持Google/DeepL/Ollama/OpenAI等服务,提供CLI/GUI/MCP/Docker/Zotero集成。
精选 500+ AI 智能体行业应用案例,涵盖医疗、金融、教育、零售等领域,提供开源项目链接与实践指南,助力开发者快速上手。
高效的 Python 中文分词库,支持精确、全模式、搜索引擎及深度学习模式。提供新词识别、自定义词典和关键词提取功能,基于 MIT 协议开源。
首个开源金融K线基础模型,基于45+全球交易所数据预训练。采用两阶段框架:专用分词器将连续OHLCV数据量化为层次离散标记,大型自回归Transformer在此基础上预训练,支持多样量化任务。提供多种规模模型,支持微调与实时预测。
Facebook AI Research的下一代视觉识别库,提供目标检测、分割等先进算法。支持多种任务,模型可导出部署,训练速度更快。
基于 MiniCPM-4 的无分词器 TTS 系统,支持上下文感知语音生成与零样本克隆。采用端到端扩散自回归架构,直接从文本生成连续语音表示,实现高表现力与自然度。支持高效流式合成,RTF 低至 0.15,适用于实时应用。
Python 项目打包与依赖管理工具,使用 pyproject.toml 统一管理依赖、版本和脚本,支持虚拟环境、依赖分组及多版本 Python。
基于 PyTorch 的先进扩散模型库,支持图像、视频和音频生成。提供预训练管道、可互换调度器和模块化模型,便于快速推理与自定义训练。
Python 12306 智能刷票订票助手,支持自动打码、登录、预售捡漏、候补及邮件通知,可本地或云打码,提供 Docker 部署。
连接ChatGPT与视觉基础模型,实现聊天中发送和接收图像。支持图像检测、分割、编辑等复杂任务,通过模板机制整合多模型能力,无需额外训练。
ControlNet 通过添加额外条件控制扩散模型。复制神经网络权重为锁定和可训练副本,保护原模型并学习新条件。支持小数据集训练,零卷积确保无失真,可在个人设备上运行。兼容多种社区模型。
将 Claude 转为金融专家,支持投行、研究、私募及财富管理。提供端到端工作流,连接数据源与 Excel/PPT 输出,包含核心插件及合作伙伴插件。