大语言模型资源
探索与 大语言模型 相关的精选开源项目、速读教程和最新工作机会
相关开源项目
postgresml/postgresml
Postgres with GPUs for ML/AI apps. 在数据库内运行机器学习与AI,支持GPU加速、LLMs、RAG管道和向量搜索。提供47+算法,性能提升8-40倍,无缝集成PostgreSQL生态。
nvidia-nemo/guardrails
开源工具包,轻松为基于 LLM 的对话系统添加可编程护栏。支持 Python 3.10+,可控制对话路径、防止敏感话题、连接外部工具,并防御越狱和提示注入等漏洞。
algorithmicsuperintelligence/openevolve
开源实现 AlphaEvolve 的进化编码代理。将 LLM 转化为自主代码优化器,自动发现突破性算法。支持 GPU 优化、数学优化等多领域,提供研究级可复现性,实现 2-3 倍硬件加速。
clearml/clearml
ClearML 是一个开源的 MLOps/LLMOps 平台,提供实验管理、数据管理、流水线编排、调度和模型服务的一站式解决方案,支持 CI/CD 自动化,简化 AI 工作流。
datajuicer/data-juicer
一站式基础模型数据处理系统,支持文本、图像、音频、视频多模态数据清洗、合成与分析。提供丰富的算子库和数据配方,支持 Python API、Docker 部署及云平台集成。
jerryzliu/dayflow
自动生成每日时间线,通过 AI 分析屏幕内容,提供上下文感知的活动追踪。隐私优先,数据本地处理,支持多种 AI 模型。开源、轻量、高效,适用于 macOS。
olimorris/codecompanion.nvim
Neovim 中的 AI 编程助手,支持多种 LLM 和 Agent 协议,提供内联转换、代码创建和重构功能。
lintsinghua/deepaudit
国内首个开源 AI 代码漏洞挖掘多智能体系统。支持 Ollama 私有部署、自主协作审计、自动化沙箱 PoC 验证与一键生成报告。小白友好,一键部署,让安全触手可及。
strands-agents/harness-sdk
轻量级 Python SDK,采用模型驱动方法,仅需几行代码即可构建 AI 代理。支持多模型提供商、MCP 协议及热重载工具,适用于从开发到生产的各类场景。
superagent-ai/superagent
开源 SDK,保护 AI 应用免受提示注入、数据泄露和有害输出。提供运行时防护、PII 脱敏、仓库扫描及红队测试,支持 TypeScript 和 Python,低延迟且可本地部署。
blockrunai/clawrouter
Agent-native LLM 路由器,支持 41+ 模型,<1ms 路由,USDC 支付。15 维评分,零 API 密钥,非托管钱包,节省 92% 成本。
open-multi-agent/open-multi-agent
TypeScript 多智能体框架,一键 runTeam() 从目标到结果。自动任务分解、并行执行,3 个依赖,可在任何 Node.js 环境部署。
yangjianxin1/firefly
一站式大模型训练工具,支持预训练、指令微调和DPO。兼容Qwen2.5、Llama3、Gemma等主流模型,提供全量、LoRA、QLoRA高效训练方案。集成Unsloth加速,节省显存与时间。开源数据集与模型权重。
julep-ai/julep
开源平台,用于构建可扩展的无服务器 AI 工作流。提供持久记忆、模块化流程、工具编排和并行执行,无需管理基础设施。
nndl/llm-beginner
提供自然语言处理入门练习,涵盖文本分类、序列标注、语言模型等任务,使用 NumPy 和 PyTorch 实现,适合初学者系统学习。
fr0gger/awesome-gpt-agents
精选网络安全 GPT 智能体列表,涵盖攻防、漏洞分析、代码审计等场景,提供社区贡献与实用指南。
vas3k/taxhacker
自托管 AI 会计应用。支持 LLM 分析收据、发票和交易,可自定义提示和分类。主要语言 TypeScript,提供多币种支持(含加密货币)和本地 LLM 兼容。
run-llama/rags
通过自然语言构建基于数据的 ChatGPT。支持描述任务、配置参数并查询 RAG 代理。支持 OpenAI、Anthropic 等 LLM 和嵌入模型。
linkedin/liger-kernel
专为 LLM 训练设计的高效 Triton 内核集合,提升多 GPU 训练吞吐量 20%,降低内存使用 60%。兼容 Hugging Face,支持 RMSNorm、RoPE、SwiGLU 等算子,与 Flash Attention、FSDP、DeepSpeed 即插即用。新增后训练优化内核,对齐与蒸馏任务内存节省高达 80%。
googlecloudplatform/agent-starter-pack
提供生产就绪的 Google Cloud AI Agent 模板,内置 CI/CD、评估与可观测性。支持 ReAct、RAG、多智能体等架构,一键部署至 Cloud Run 或 Agent Engine。
airweave-ai/airweave
开源 AI 代理上下文检索层,连接应用、工具和数据库,持续同步数据,通过统一的 LLM 友好搜索接口提供实时、多源上下文检索。
dataease/sqlbot
基于大模型和 RAG 的智能问数系统,支持对话式数据分析。开箱即用,安全可控,易于集成,通过持续优化提升问数准确度。
j3ssie/osmedeus
现代安全编排引擎,支持声明式 YAML 工作流、多运行器、事件驱动触发、模板引擎、实用函数、REST API、分布式执行、通知集成、云存储及 LLM 集成。提供 CLI 与 Web UI,支持 Docker 部署。
josstorer/rwkv-runner
轻量级 RWKV 大语言模型管理工具,仅 8MB,全自动化部署。提供 OpenAI API 兼容接口,支持多平台安装与 WebGPU 加速,内置聊天、创作及 MIDI 硬件输入功能。
ml-explore/mlx-lm
基于 MLX 的 Python 包,用于在 Apple 芯片上运行和微调大语言模型。支持 Hugging Face Hub 集成、模型量化、LoRA 微调及分布式推理。提供命令行和 Python API,便于文本生成与聊天。
haifengl/smile
基于 Java 的统计机器智能与学习引擎,提供全面的机器学习算法,包括深度学习、LLM、分类、回归、聚类、特征选择、流形学习等。支持 Scala 和 Kotlin API。
rikkahub/rikkahub
原生 Android LLM 聊天客户端,支持多模型提供商切换,具备 Material You 设计、多模态输入、网络访问及 MCP 等功能。
lavague-ai/lavague
开源框架,用于开发 AI Web 代理。包含世界模型和动作引擎,可自动化网页任务。支持 Selenium、Playwright 等驱动,提供 Gradio 界面和调试工具。
opensquilla/opensquilla
微内核 AI 代理,通过本地模型路由器将请求动态分配给最经济适用的模型。内置持久记忆、分层沙箱、网页搜索及设备嵌入,支持 CLI、Web UI 和聊天频道。提供可插拔的 provider 层,兼容 OpenRouter、OpenAI、Anthropic 等 20 余种 LLM 服务商。在相同预算下提供更高智能密度与更优结果。
e2b-dev/fragments
开源 Next.js 模板,用于构建完全由 AI 生成的应用。基于 E2B SDK 安全执行代码,支持流式 UI、多栈(Python、Next.js、Vue.js 等)及多种 LLM 提供商(OpenAI、Anthropic 等)。