AI 大模型基建
共 97 篇网址
Navi2AI.com关于【AI 大模型基建】的分类定义与收录描述:模型从「训练好」到「能用起来」的整条技术栈,服务开发者与企业。涵盖模型获取(MaaS&API、开源权重)、能力改造(微调)、高效运行(推理与本地部署)、多模型调度(API 网关),以及让回答更准的 RAG 与向量数据库。这一层决定 AI 应用的成本、性能与合规边界。
AI 大模型基建
AI 文案与写作
AI 图像与设计
AI 视频与创作
AI 音频与制作
AI 代码与开发
AI 效率与办公
AI 通用智能体
模型服务 MaaS&API
开源模型
推理与本地部署
API 网关与聚合
检索增强 RAG
向量数据库
训练与微调
排序
发布
更新
浏览
点赞
ExLlamaV3
turboderp主导,消费级NVIDIA GPU本地LLM推理库,EXL3量化格式发源地,MIT许可。
15
0
推理与本地部署
# ExLlamaV3
MLX
Apple机器学习研究团队出品,Apple Silicon统一内存原生的数组框架与LLM推理引擎。
14
0
推理与本地部署
# MLX
# MLX LM
Sonar
PygmalionAI主导的vLLM分支推理引擎,量化格式覆盖最广,AGPL-3.0许可。
16
0
推理与本地部署
# Sonar
DeepSpeed-MII
微软DeepSpeed团队开源,Blocked KV Cache+Dynamic SplitFuse高吞吐推理库。
15
0
推理与本地部署
# DeepSpeed-MII
TensorRT-LLM
NVIDIA官方开源,编译优化大模型推理,NVIDIA GPU上极限吞吐引擎。
14
0
推理与本地部署
# TensorRT-LLM
LMDeploy
上海AI Lab开源,TurboMind引擎驱动,国产LLM/VLM高性能部署工具箱。
16
0
推理与本地部署
# LMDeploy
SGLang
SGLang是基于RadixAttention前缀缓存的高吞吐LLM/VLM服务框架。
12
0
推理与本地部署
# SGLang
PEFT
Hugging Face 开源的 LoRA/QLoRA/DoRA 等参数高效微调标准底座库。
14
0
训练与微调
# PEFT
TorchTune
PyTorch官方原生后训练库,YAML配置+SFT/DPO/PPO/GRPO可黑盒配方。
15
0
训练与微调
# TorchTune
OpenRLHF
高性能分布式 RLHF 框架,支持 PPO/GRPO/REINFORCE++,基于 Ray 与 vLLM。
14
0
训练与微调
# OpenRLHF
Unsloth
手写Triton内核加速LLM微调,单卡2倍速、省70%显存的开源库。
16
0
训练与微调
# Unsloth
TRL
Hugging Face 官方后训练库,SFT/GRPO/DPO/KTO 等 Trainer 一站式封装。
11
0
训练与微调
# TRL
veRL
字节火山引擎开源,PPO/GRPO/REINFORCE++强化学习后训练框架。
12
0
训练与微调
# veRL
Colossal-AI
潞晨科技出品,集成多维并行与异构内存优化的开源大模型训练系统。
12
0
训练与微调
# Colossal-AI
DeepSpeed
微软开源的ZeRO优化器标杆,支撑千亿模型训练的深度学习加速库。
13
0
训练与微调
# DeepSpeed
Megatron-Core/LM
NVIDIA开源的GPU优化大规模Transformer训练库,并行策略事实标准。
13
0
训练与微调
# Megatron-Core
Axolotl
YAML配置统一驱动LLM后训练,Apache-2.0许可的全栈微调框架。
12
0
训练与微调
# Axolotl
MS-SWIFT
阿里达摩院开源,600+模型统一训练与部署的全栈框架。
15
0
训练与微调
# MS-SWIFT
加载更多
网址
网址
文章
软件
书籍