大语言模型资源
探索与 大语言模型 相关的精选开源项目、速读教程和最新工作机会
相关开源项目
deeplethe/utopia
首个开源企业世界模型,基于 Rust 构建。集成时间感知知识图谱,支持冲突检测、推理和决策。可离线部署,确保数据隐私。单一二进制文件加 PostgreSQL,轻松部署。
pbek/qownnotes
开源纯文本笔记与待办管理器,支持 Markdown,可与 Nextcloud/ownCloud 同步,适用于 Linux、macOS 和 Windows。
kserve/kserve
基于 Kubernetes 的标准化分布式生成式与预测式 AI 推理平台,支持多框架部署。提供 LLM 优化、GPU 加速、模型缓存、KV 缓存卸载、自动扩缩容等生成式 AI 功能,以及多框架支持、智能路由、高级部署、模型可解释性、高级监控等预测式 AI 功能。
modelengine-group/nexent
零代码平台,基于 Harness Engineering 原则自动生成生产级 AI 代理。统一工具、技能、内存与编排,内置约束、反馈循环和控制平面。支持多模型集成,纯语言开发,无需复杂拖拽。
michael-a-kuykendall/shimmy
⚡ 无 Python 依赖的 Rust 推理服务器,兼容 OpenAI API。支持 GGUF + SafeTensors,热模型切换,自动发现,单二进制文件。免费且永久免费。
openai-php/client
⚡️ 社区维护的 PHP API 客户端,用于与 OpenAI API 交互。支持 PHP 8.2+,通过 Composer 安装,提供完整的 API 资源覆盖,包括模型、聊天、音频、嵌入等。
amazon-science/chronos-forecasting
提供 Chronos 系列预训练时间序列预测模型接口,支持零样本单/多变量及协变量预测。Chronos-2 性能领先,Chronos-Bolt 速度提升 250 倍,内存效率更高。支持 Hugging Face 模型与 SageMaker 部署。
makazhanalpamys/soup
微调大语言模型的工具。通过一个YAML配置文件,无需SSH或复杂设置。支持层流技术,在4GB GPU上训练8B模型。自动化处理批量、GPU检测和量化。
rllm-org/rllm
开源强化学习框架,用于语言智能体的后训练。支持自定义智能体与环境构建,提供 verl 和 tinker 两种训练后端,便于部署与扩展。
agentops-ai/agentops
Python SDK,用于 AI 智能体监控、LLM 成本追踪与基准测试。原生集成 CrewAI、OpenAI Agents SDK、LangChain 等主流框架,支持自托管,助力从原型到生产的全流程开发。
timescale/pgai
将 PostgreSQL 转变为 RAG 和智能体应用的生产级检索引擎。自动创建并同步向量嵌入,支持语义目录实现自然语言转 SQL。兼容 pgvector,提供开箱即用的批处理与容错机制。
giskard-ai/giskard-oss
开源评估与测试库,用于 LLM 代理。自动检测 AI 应用中的性能、偏见和安全问题,支持 RAG 评估工具包 (RAGET) 生成测试集并评估各组件,兼容多种模型与环境。
klavis-ai/klavis
MCP 集成平台,让 AI 代理在任何规模下可靠使用工具。提供智能连接器 Strata、100+ 预构建集成及可扩展的 MCP 沙盒环境,支持 LLM 训练与强化学习。
q00/ouroboros
规范优先的 AI 编码操作系统,将模糊想法转化为可验证的代码库。支持 Claude、Codex 等多种工具,实现可重放、可观测的工作流。本地运行,自动化评估。
shibing624/medicalgpt
实现医疗大模型训练,支持增量预训练、SFT、RLHF、DPO、ORPO、GRPO 等方法,兼容多种开源模型。
pyspur-dev/pyspur
视觉化智能体工作流开发平台,加速迭代 10 倍。支持 Python 代码或 UI 构建,内置测试、调试、部署功能。提供人机回环、循环、RAG、多模态处理等核心特性,兼容 100+ LLM 供应商。
areal-project/areal
开源全异步强化学习系统,专为大模型推理与智能体设计。支持快速定制与大规模训练,性能领先,适用于数学、代码、搜索等场景。
coze-dev/coze-loop
下一代 AI Agent 优化平台,提供开发、调试、评估到监控的全生命周期管理,支持 Prompt 开发、系统评估与可观测性,助力高效构建与运营 AI Agent。
steipete/agent-rules
为 Claude Code 和 Cursor 等 AI 代理提供工作规则与知识库,提升协作效率。此为旧项目,新工作已迁移至 agent-scripts。
generalaction/emdash
开源代理开发环境,并行运行多个编码代理。支持本地及 SSH 远程项目,集成 Claude Code、Gemini 等主流代理,提供 Git 隔离工作树、差异审查与合并功能。兼容 Linear、GitHub 等问题跟踪系统。
openbmb/ultrarag
基于 MCP 架构的低代码 RAG 框架,通过 YAML 配置实现复杂流程编排。提供可视化 IDE,支持管道构建与代码编辑双向同步,内置 AI 助手辅助开发。
huggingface/alignment-handbook
提供稳健的对齐配方,用于继续预训练和使语言模型与人类及 AI 偏好对齐。包含训练脚本、复现模型的配方,以及 DPO、ORPO 等对齐方法的实现。
vllm-project/semantic-router
可编程路由层,用于异构LLM推断的Mixture-of-Models系统。评估请求信号,选择或组合模型路径,优化质量、成本、延迟、隐私和安全性。
lemonade-sdk/lemonade
本地 AI 服务器,在 GPU/NPU 上运行优化大语言模型,免费私密提供聊天、编码、语音和图像生成,支持标准 API 集成。
baichuan-inc/baichuan-7b
开源可商用的70亿参数双语预训练模型,基于Transformer架构,在1.2万亿token上训练,支持4096上下文窗口。在C-Eval、MMLU等中英文基准测试中表现优异。
mostlygeek/llama-swap
在本地运行多个生成式 AI 模型,按需热切换,兼容 OpenAI/Anthropic API。Go 实现,零依赖,部署配置简单。
gpustack/gpustack
开源 GPU 集群管理器,配置并编排 vLLM、SGLang 等推理引擎,支持多集群管理、即日模型部署与性能优化,适用于高性能 AI 模型部署。
dograh-hq/dograh
开源语音 AI 平台,自托管替代 Vapi/Retell。支持语音对语音或 LLM/STT/TTS,可视化工作流构建器,MCP 原生,电话集成。完全控制,无供应商锁定。
ramon-victor/freegpt-webui
基于 G4F API 的免费 GPT 3.5/4 聊天 WebUI,无需 API 密钥。提供用户友好的界面和增强的越狱功能。
the-open-agent/openagent
⚡️ 下一代个人 AI 助手,基于 LLM、RAG 和智能体循环,支持计算机使用、浏览器使用和编码智能体。单二进制文件,无需安装。