探索 大语言模型 项目
筛选并发现收录的、配有高质量中文文档或教程的 GitHub 项目。
统一框架,支持 300+ 模型与 RAG 管道,优化本地、私有、安全的企业级应用。支持 GGUF、OpenVINO 等多种推理技术,提供模型目录与知识库管理,可在 AI PC 和边缘设备运行。
整理大语言模型(LLMs)算法工程师相关知识及面试题,涵盖基础、架构、训练、微调等。提供多个动手实践项目,如 tiny-llm-zh、tiny-rag 等,帮助快速掌握大模型技术。
Llama中文社区,实时汇总最新Llama学习资料,构建最好的中文Llama大模型开源生态,完全开源可商用。提供模型、算力、数据、论坛等资源,支持Llama2、Llama3、Llama4全系列,涵盖预训练、微调、量化、部署等全流程。
专为 LLM 微调、RAG 和评估构建数据集的强大工具。支持 PDF、DOCX 等多种格式文档的智能解析与分割,自动生成高质量 QA 数据集。内置评估系统,支持自动化模型评测与人工盲测,助力垂直领域模型优化。
轻量级 vLLM 实现,从零构建。提供快速离线推理、可读代码库及优化套件,如前缀缓存、张量并行、Torch 编译和 CUDA 图。性能媲美 vLLM,代码约 1200 行 Python。
基于大语言模型的自动化渗透测试智能体框架,支持自主执行、会话持久化与 Docker 环境。提供实时反馈与多类别漏洞检测,已发表于 USENIX Security 2024。
基于 Claude Code / Codex 的价值投资研究框架。系统化巴菲特、芒格、段永平、李录四大师方法论,通过多 Agent 并行分析实现专业级投研。具备强制结论、多视角对抗、反偏见机制和精确计算能力,将一人投研效率提升至团队水平。实盘验证,连续两年大幅跑赢全球主要指数。
提供易用的 Python API 定义大语言模型,支持前沿优化以在 NVIDIA GPU 上高效推理。包含 Python 和 C++ 运行时组件,实现高性能推理编排。
开源身份与访问管理 / 单点登录平台,以 Web UI 为核心,支持 OAuth 2.0、OIDC、SAML、CAS、LDAP、SCIM、WebAuthn、TOTP、MFA、Face ID、RADIUS、Google Workspace、Active Directory 和 Kerberos 等协议。
自动化高价值研发流程,以数据和模型为核心,通过 AI 驱动数据驱动的 AI。支持 LiteLLM 后端,提供数据科学与 Kaggle 场景代理,在 MLE-bench 上表现领先。
ARIS ⚔️ 通过 Markdown 技能实现自主 ML 研究:跨模型评审循环、想法发现与实验自动化。零依赖、无框架锁定,兼容 Claude Code、Codex、OpenClaw 等任意 LLM 代理。
从想法到论文的全自动研究平台。聊天输入想法,直接生成论文。支持 OpenClaw 集成,23 阶段流水线,完全自主进化。
桌面端应用,用于安装、配置和与 Hermes Agent 聊天。提供图形界面管理会话、工具、计划等,支持多平台安装。
提供 20+ 高性能大语言模型,支持从零实现、预训练、微调与大规模部署。无抽象层,代码精简,支持 Flash Attention、FSDP、LoRA 等技术,适配多 GPU/TPU 环境。
自进化智能体:从 3.3K 行种子代码生长技能树,实现全系统控制,Token 消耗降低 6 倍。核心仅 ~3K 行代码,9 个原子工具 + ~100 行 Agent Loop,支持浏览器、终端、文件系统等操作。
强大的终端 AI 编程助手,基于 Go 开发。支持多种 AI 模型(OpenAI、Claude、Gemini 等),提供交互式 TUI 界面、会话管理、工具执行与代码修改功能。内置 SQLite 存储与 LSP 集成,支持 Vim 编辑器与外部编辑器调用。
包含 70 多个实用示例、教程和配方的集合,展示 RAG、智能体、工作流等 AI 应用。主要使用 Python,涵盖从简单聊天机器人到高级 AI 智能体的多种框架和工具。
个人技术博客仓库,分享 Go 语言、机器学习等领域的深度解析与源码阅读心得。包含多维空间搜索、并发编程等主题,累计阅读量超 300 万。
开源、安全的云沙盒环境,专为企业级 AI 代理设计,提供真实工具。支持 JavaScript 和 Python SDK,轻松运行 AI 生成的代码。
训练和评估大语言模型的函数调用(工具调用)能力。提供 Berkeley 函数调用排行榜,支持多轮、多步骤复杂任务评估,并集成 GoEx 运行时以实现 LLM 生成动作的安全执行与验证。
基于飞桨的易用强大LLM/SLM开发套件,支持高效训练、无损压缩与高性能推理。提供丰富模型库,涵盖Qwen3、DeepSeek-R1等热门模型,支持FP8/INT8量化及投机解码,单机推理速度超1000 tokens/s。
文本和图像到视频生成框架,支持 CogVideoX (2024) 和 CogVideo (ICLR 2023)。提供在线体验、微调工具和多平台 API,优化推理性能,支持单卡微调。
在本地计算机上轻松运行 LLaMA 和 Alpaca 模型。支持 Linux、Mac 和 Windows,内存要求低,提供 Web UI 和 JavaScript API。基于 llama.cpp 和 alpaca.cpp,包含可定制的 Web 应用。
AI 短剧工厂,小说秒变剧集。AI 剧本 × AI 影像 × 极速生成,0 门槛全流程 AI 化,创作效率提升 10 倍+。
作为桥梁,让 AI 助手(如 Claude、Cursor)通过本地 MCP 客户端直接与 Unity 编辑器交互。提供工具管理资产、控制场景、编辑脚本和自动化任务,支持 C# 语言。
支持免提语音交互、语音打断和 Live2D 虚拟形象的本地多平台 AI 伴侣。基于 Python,可离线运行,提供网页版和桌面客户端。
开源 Agentic 浏览器,隐私优先。支持本地 AI 模型(Ollama)或自定义 API 密钥,数据不离机。提供工作流自动化、MCP 服务器集成及内置广告拦截。支持 macOS、Windows、Linux。