AI 大模型基建
共 97 篇网址
Navi2AI.com关于【AI 大模型基建】的分类定义与收录描述:模型从「训练好」到「能用起来」的整条技术栈,服务开发者与企业。涵盖模型获取(MaaS&API、开源权重)、能力改造(微调)、高效运行(推理与本地部署)、多模型调度(API 网关),以及让回答更准的 RAG 与向量数据库。这一层决定 AI 应用的成本、性能与合规边界。
AI 大模型基建
AI 文案与写作
AI 图像与设计
AI 视频与创作
AI 音频与制作
AI 代码与开发
AI 效率与办公
AI 通用智能体
模型服务 MaaS&API
开源模型
推理与本地部署
API 网关与聚合
检索增强 RAG
向量数据库
训练与微调
排序
发布
更新
浏览
点赞
PEFT
Hugging Face 开源的 LoRA/QLoRA/DoRA 等参数高效微调标准底座库。
14
0
训练与微调
# PEFT
OpenRLHF
高性能分布式 RLHF 框架,支持 PPO/GRPO/REINFORCE++,基于 Ray 与 vLLM。
14
0
训练与微调
# OpenRLHF
Apertus
瑞士 Swiss AI Initiative 的完全开放多语种多模态大模型家族。
14
0
开源模型
# Apertus
DeepSeek
DeepSeek 开放权重大模型家族,MIT 许可,1M 上下文。
14
0
开源模型
# DeepSeek
Quivr
Apache-2.0 许可的开源"第二大脑"式 RAG 平台,Brain 抽象统一封装摄入-检索-生成,任意 LLM+任意向量库。
13
0
检索增强 RAG
# Quivr
R2R
MIT 许可的生产级 RAG 引擎,RESTful API 统一封装多模态摄入、混合搜索、知识图谱与 Agentic Deep Research。
13
0
检索增强 RAG
# R2R
CTranslate2
OpenNMT团队开源,Transformer模型高效C++推理引擎,自定义运行时+faster-whisper底层。
13
0
推理与本地部署
# CTranslate2
DeepSpeed
微软开源的ZeRO优化器标杆,支撑千亿模型训练的深度学习加速库。
13
0
训练与微调
# DeepSpeed
Megatron-Core/LM
NVIDIA开源的GPU优化大规模Transformer训练库,并行策略事实标准。
13
0
训练与微调
# Megatron-Core
GLM
智谱 Z.ai 开放权重大模型家族,MIT 许可,1M 上下文。
13
0
开源模型
# GLM
Qdrant
Apache-2.0 许可的 Rust 编写 AI 原生向量数据库,HNSW 遍历期过滤、量化降内存 64 倍、原生混合检索。
12
0
向量数据库
# Qdrant
LiteLLM
BerriAI主导,以OpenAI格式统一调用100+ LLM提供商,MIT许可,AI网关事实标准。
12
0
API 网关与聚合
# LiteLLM
SGLang
SGLang是基于RadixAttention前缀缓存的高吞吐LLM/VLM服务框架。
12
0
推理与本地部署
# SGLang
veRL
字节火山引擎开源,PPO/GRPO/REINFORCE++强化学习后训练框架。
12
0
训练与微调
# veRL
Colossal-AI
潞晨科技出品,集成多维并行与异构内存优化的开源大模型训练系统。
12
0
训练与微调
# Colossal-AI
Axolotl
YAML配置统一驱动LLM后训练,Apache-2.0许可的全栈微调框架。
12
0
训练与微调
# Axolotl
LlamaFactory
北航开源零代码大模型微调框架,统一100+模型全流程训练。
12
0
训练与微调
# LlamaFactory
FLUX
Black Forest Labs 的开放权重图像生成家族,schnell 为 Apache-2.0 可商用。
12
0
开源模型
# FLUX
加载更多
网址
网址
文章
软件
书籍