探索 大语言模型 项目
筛选并发现收录的、配有高质量中文文档或教程的 GitHub 项目。
基于 Ray 的易用、可扩展、高性能智能体强化学习框架,支持 PPO、REINFORCE++ 等多种算法,集成 vLLM 与异步训练。
面向消费级 GPU 的高速大语言模型推理引擎,利用激活局部性实现 CPU/GPU 混合推理,显著降低内存需求与数据传输,支持多种模型与硬件。
为 Hermes Agent 提供的全功能 Web 仪表板,支持多平台 AI 聊天、会话管理、定时任务与使用分析,基于 TypeScript 构建,界面简洁响应迅速。
全自动、零代码的 LLM Agent 框架。通过自然语言驱动,自动构建和编排协作式智能体系统。支持自管理工作流生成与智能资源编排,无需编码即可创建和定制 Agent、工具与工作流。
循环工程(Loop Engineering)提供 AI 编码代理的设计模式、启动模板与 CLI 工具。核心功能包括循环审计、初始化和成本管理,用于构建提示与编排代理的系统,以提升开发效率。
精选 LangChain 生态工具与项目列表。涵盖框架、多语言移植、低代码工具、服务、开源项目及学习资源,助力 LLM 应用快速开发。
企业级、商业友好的智能体工作流平台,集成 AI 工作流编排、模型管理、AI 与 MCP 工具集成、RPA 自动化及团队协作功能。支持高可用部署,助力快速构建可扩展的生产就绪智能体应用。
汇集异常检测相关书籍、论文、视频和工具箱,覆盖 LLM 和 VLM 等前沿工作,提供全面的学习资源。
UFO³:编织数字智能体星系。从单设备智能体到多设备星系,实现跨设备协作、复杂自动化与异构平台集成。UFO² 为稳定桌面智能体操作系统,UFO³ Galaxy 提供多设备编排能力。
提供完全本地的 AI Agent 长期记忆,通过 4 级渐进管道实现,零外部 API 依赖。核心为符号化短期记忆与分层长期记忆,显著降低 token 使用并提升任务成功率。
🚀 下一代 AI 一站式 B/C 端解决方案,支持 OpenAI、Midjourney、Claude 等多模型,提供对话分享、自定义预设、云端同步、模型市场、弹性计费与订阅计划,支持图片解析、联网搜索、模型缓存,配备丰富美观的后台管理与仪表盘。
专为 AI 设计的数据库,支持向量、图像、文本、视频等数据的存储与查询。与 LLMs/LangChain 集成,提供数据版本管理、可视化及实时流式传输至 PyTorch/TensorFlow。
强大的 GUI 智能体家族,支持跨平台自动化操作。提供在线演示与 API,集成 GUI-Owl 多模态模型,适用于 OSWorld、AndroidWorld 及真实移动场景。
跨平台桌面应用,无需安装 Edge 或浏览器插件即可使用新版 Bing AI 聊天。支持导出对话为 Markdown、PNG 或 PDF,可自定义主题与字体大小,提供键盘快捷键。
加速本地大模型推理与微调,支持 Intel XPU(iGPU、NPU、Arc 等),无缝集成 llama.cpp、Ollama、HuggingFace 等框架,提供 70+ 模型优化与低比特支持。
本地化深度研究助手,支持所有本地及云端 LLM,10+ 搜索引擎,数据全本地加密。在 RTX 3090 上实现 ~95% SimpleQA 准确率。
汇总全球顶尖 LLM 资源,涵盖多模态生成、Agent、辅助编程、AI 审稿、数据处理、模型训练与推理、o1 模型、MCP、小语言模型及视觉语言模型等。
统一模型服务框架。轻松构建 AI/ML 模型推理 API、多模型流水线及 LLM 应用。支持 Docker 部署与 BentoCloud 云服务,优化 CPU/GPU 利用率。
基于 PyTorch 从零实现 Transformer,支持单 GPU 训练亿级参数 LLM,涵盖从数据下载到文本生成全流程。新增对齐后训练套件(SFT、RM、PPO、DPO、GRPO),纯 PyTorch 手写,无需 trl/peft/transformers。
BAML 是一个用于构建可靠 AI 工作流和代理的简单提示语言。它将提示工程转变为模式工程,支持 Python、TS、Ruby、Java、C#、Rust、Go 等多种语言。提供完整的类型安全、流式处理和重试机制,即使模型不支持原生工具调用 API 也能可靠工作。
🚀💪 最大化效率与生产力。管理、定制和分享提示词的终极中心。提供一键复制、智能搜索、多语言支持、社区分享及浏览器扩展等功能,无需注册即可使用。