探索 大语言模型 项目
筛选并发现收录的、配有高质量中文文档或教程的 GitHub 项目。
专为移动设备与可穿戴设备打造的低延迟 AI 引擎。支持 ARM CPU 最快推理,零拷贝内存映射实现 10 倍 RAM 节省,多模态 SDK 覆盖语音、视觉与语言模型,支持云回退与 NPU 加速。
开放代理计算机,适用于任何数字工作。基于 TypeScript 构建,支持 macOS,Windows 和 Linux 开发中。提供共享环境,人类与 AI 代理协作,记忆连续,工作状态不丢失。
一个统一的 AI 平台,从管道到智能体。支持任何 Python 逻辑,自动容器化、追踪运行、抽象基础设施复杂性,并集成 MLflow、Langgraph 等工具,助力快速迭代实验。
lakeFS 是开源数据湖版本控制工具,提供类 Git 的数据管理能力。支持 AWS S3、Azure Blob Storage 和 Google Cloud Storage,兼容 S3 API,可与 Spark、Hive 等框架无缝集成。实现可重复、原子性的数据湖操作,适用于 ETL 测试、数据科学和分析。
⚡️ 下一代个人 AI 助手,基于 LLM、RAG 和智能体循环,支持计算机使用、浏览器使用和编码智能体。单二进制文件,无需安装。
将统计格式转换为可编辑内容。基于 SAM 3 和多模态大模型,实现高保真重建,保留原始图表细节与逻辑关系。支持一键生成可编辑的 DrawIO (XML) 文件。
精选 LLM/VLM 推理论文与代码库,涵盖 Flash-Attention、Paged-Attention、WINT8/4、并行化等技术。提供 PDF 下载与分类索引。
将 EPUB、PDF、文本文件快速转换为带同步字幕的高品质有声书。基于 Kokoro-82M 引擎,支持 Windows、macOS 和 Linux 系统。提供简洁的 GUI 界面与命令行选项,适合 Instagram、YouTube 等平台的配音需求。
AI 驱动的 ComfyUI 智能助手,提供工作流生成、一键调试与优化,支持 Agent 架构升级,提升创作效率。
开源 AI 原生应用开发平台。统一集成数百种 LLM 模型,提供工具、RAG、助手等模块的直观管理。支持异步高性能计算与一键部署,助力高效构建可扩展的 AI Agent。
开源 GPU 集群管理器,配置并编排 vLLM、SGLang 等推理引擎,支持多集群管理、即日模型部署与性能优化,适用于高性能 AI 模型部署。
高性能 LLM 推理 API 与聊天界面,融合 DeepSeek R1 的链式思考推理与 Anthropic Claude 的创意代码生成能力。基于 Rust 构建,提供零延迟流式响应、私有安全的 BYOK API 管理,并支持高度可配置与开源部署。
开源 LLM 资产管理平台,提供统一管理、微服务架构与企业级安全。支持私有化部署,兼容 Hugging Face SDK,助力高效处理模型、数据集及应用。
为 AI 代理提供通用记忆层,支持可扩展、可扩展和可互操作的记忆存储与检索,实现下一代自主系统的状态管理。主要语言 Python。
端到端框架,用于构建自定义 AI 应用和智能体。支持多种数据库后端,如 MongoDB、SQL、Snowflake 和 Redis。基于 Python,提供插件化架构,便于集成现有工具。
跨平台桌面 AI 助手与 MCP 客户端。兼容主流服务提供商,支持通过 MCP 服务器接入本地知识库与工具。基于 TypeScript 构建,提供文件系统访问、数据库交互等扩展能力。
开源代理开发环境,并行运行多个编码代理。支持本地及 SSH 远程项目,集成 Claude Code、Gemini 等主流代理,提供 Git 隔离工作树、差异审查与合并功能。兼容 Linear、GitHub 等问题跟踪系统。
基于 MLX 的 Mac 平台视觉语言模型推理与微调工具包,支持多模态(图像、音频、视频)及 Omni 模型,提供 CLI、Gradio UI、FastAPI 服务与分布式推理。
提供从基础到部署高级 LLM 和 RAG 应用的实践指南,使用 LLMOps 最佳实践,支持 AWS 部署。涵盖数据收集、训练管道、监控和测试框架。
VS Code 扩展,自主编码代理。将想法转化为代码,支持网站、仪表盘、服务器开发。提供调试、部署、网络搜索功能,适合各水平开发者。加速开发流程,让编码更高效。
基于 ML、LLM 和 Vision LLM 实现结构化数据提取与指令调用。支持多格式文档处理、可插拔架构、多种后端(MLX、Ollama、vLLM、Hugging Face)及 RESTful API。提供交互式 Web 界面,支持拖拽上传与实时处理。
非官方 Python 包,通过 Cookie 值调用 Google Bard API。适用于无法通过官方认证的用户。项目已停止维护,建议转向 Gemini API。
开源程序合成模型家族,由 Salesforce AI Research 开发。包含 CodeGen1 和 CodeGen2 系列,参数规模从 350M 到 16B,性能媲美 OpenAI Codex。提供多版本模型,支持 Hugging Face Hub 调用。
新一代超大规模 MoE 模型训练引擎。支持无丢弃训练、长序列支持及卓越效率,训练规模可达 1T 参数。优化 Ascend NPU,兼容 GPU 与 NPU 硬件。
开源 AI 研究环境,支持本地、本地部署或云端训练、评估和扩展模型。统一工具链,提供跨平台支持,包含基础模型、微调、扩散模型和评估功能。
专为 LM Studio 打造的命令行工具,支持管理模型、启停本地 API 服务器及创建 SDK 项目。基于 lmstudio.js 构建,随 LM Studio 0.2.22 及更新版本提供,可通过 npx 安装至路径。