探索 Python 项目
筛选并发现收录的、配有高质量中文文档或教程的 GitHub 项目。
跨平台应用,使用 mpv 作为 DLNA 媒体渲染器。可从手机推送视频、图片或音乐到电脑。支持 macOS、Windows 和 Linux。
基于 Stable Diffusion 的 PyTorch 实现,通过文本指令编辑图像。支持命令行和 Gradio 交互界面,提供预训练模型和生成数据集。
一个全面的 WSGI Web 应用库,提供交互式调试器、请求/响应对象、路由系统和 HTTP 工具。支持本地开发服务器和测试客户端,无强制依赖,可构建各类应用。
通过小米 AI 音箱使用 ChatGPT 及其他大语言模型。支持多种 AI 类型,如 ChatGPT、New Bing、ChatGLM、Gemini 等。提供命令行工具,可配置 API 密钥,实现语音交互与 TTS 回答。
基于 Claude 的自主漏洞发现与修复参考实现,包含威胁建模、扫描、分类、打补丁等技能,支持自定义扫描流程。适用于 Python 项目。
基于参考的多智能体框架,自动化生成学术插图。通过检索、规划、风格化、可视化和批评智能体协作,将科学内容转化为出版级图表。支持 Python,集成 Hugging Face 数据集与模型。
基于 ICCV 2023 的视频修复工具,结合传播与 Transformer 技术,支持物体移除与视频补全。提供在线演示与高效推理,代码已开源。
基于 LLM 的多模态智能体框架,用于操作智能手机应用。通过简化动作空间模仿人类交互,如点击和滑动,无需系统后端访问。支持通过自主探索或观察人类演示学习新应用,生成知识库以执行跨应用复杂任务。
开源工具包,轻松为基于 LLM 的对话系统添加可编程护栏。支持 Python 3.10+,可控制对话路径、防止敏感话题、连接外部工具,并防御越狱和提示注入等漏洞。
基于 Python 的流处理库,将 Kafka Streams 理念移植到 Python。支持异步、静态类型和分布式状态管理,适用于实时数据管道和高吞吐量事件处理。
本地预览 GitHub README.md 文件。使用 GitHub Markdown API 渲染,样式与 GitHub 完全一致。支持命令行服务器、导出 HTML、标准输入输出及用户内容渲染。
集中式网络可见性与持续资产发现框架。监控设备、检测变更,保持分布式网络的态势感知。提供网络基础设施的“单一事实来源”,维护实时设备库存,识别影子IT与未授权硬件,确保合规性。支持多种发现方法与80+通知服务集成,如Apprise、Pushsafer。
开源实现 AlphaEvolve 的进化编码代理。将 LLM 转化为自主代码优化器,自动发现突破性算法。支持 GPU 优化、数学优化等多领域,提供研究级可复现性,实现 2-3 倍硬件加速。
使用深度强化学习(Deep Q-learning)破解 Flappy Bird 游戏。基于 Python 和 TensorFlow 实现,采用卷积神经网络处理原始像素输入,通过经验回放和 ε-greedy 策略训练智能体,实现自动游戏控制。
为 Django 框架收集全局自定义管理扩展的集合。提供如 `graph_models`、`show_urls`、`validate_templates`、`shell_plus` 和 `runserver_plus` 等实用命令,增强开发与调试体验。
Python scikit,用于构建和分析显式评分推荐系统。提供多种预测算法(SVD、SVD++、NMF、KNN 等)、内置数据集支持、交叉验证与网格搜索工具,便于实验控制与性能评估。
全栈代码库,用于训练与评估推测解码算法。支持 DSpark、DFlash、Eagle3 等模型,提供数据准备、训练及基准评估全流程。已发布多个目标模型对应的预训练检查点。
ClearML 是一个开源的 MLOps/LLMOps 平台,提供实验管理、数据管理、流水线编排、调度和模型服务的一站式解决方案,支持 CI/CD 自动化,简化 AI 工作流。
一站式基础模型数据处理系统,支持文本、图像、音频、视频多模态数据清洗、合成与分析。提供丰富的算子库和数据配方,支持 Python API、Docker 部署及云平台集成。
利用大型语言模型将 Linux x86_64 二进制文件反编译为可读 C 源码,支持 GCC O0-O3 优化级别。提供端到端反编译与 Ghidra 伪代码精炼两种模式,包含多版本模型与基准测试数据集。
基于大型重建模型(LRM),实现从单张图像快速重建高质量 3D 模型。在 NVIDIA A100 GPU 上推理时间 <0.5 秒,性能优于其他开源方案。提供源代码、预训练模型及在线演示。
将自然语言描述转为专业 draw.io 图表的 AI 技能。支持 6 种预设,自动从代码库或 IaC 配置生成架构图,含视觉自检与多轮精炼。提供 10,000+ 官方形状与 321 个 AI/LLM 品牌 Logo,可导出 PNG/SVG/PDF/JPG。
基于 Python 的音频指纹识别库。通过一次聆听即可记忆音频特征,支持从麦克风或文件中识别匹配的歌曲。适用于含合理噪声的精确信号识别,不适用于语音识别。
开源 CTF 框架,专注于易用性和可定制性。提供完整的 CTF 运行环境,支持插件和主题扩展。包含动态评分、团队竞赛、排行榜、Markdown 内容管理及多种部署方式。