Navi2AI

      AI 大模型基建

      共 97 篇网址
      Navi2AI.com关于【AI 大模型基建】的分类定义与收录描述:模型从「训练好」到「能用起来」的整条技术栈,服务开发者与企业。涵盖模型获取(MaaS&API、开源权重)、能力改造(微调)、高效运行(推理与本地部署)、多模型调度(API 网关),以及让回答更准的 RAG 与向量数据库。这一层决定 AI 应用的成本、性能与合规边界。
      AI 大模型基建AI 文案与写作AI 图像与设计AI 视频与创作AI 音频与制作AI 代码与开发AI 效率与办公AI 通用智能体
      模型服务 MaaS&API开源模型推理与本地部署API 网关与聚合检索增强 RAG向量数据库训练与微调
      排序
      发布更新浏览点赞
      ExLlamaV3

      ExLlamaV3

      turboderp主导,消费级NVIDIA GPU本地LLM推理库,EXL3量化格式发源地,MIT许可。
      140
      推理与本地部署# ExLlamaV3
      MLX

      MLX

      Apple机器学习研究团队出品,Apple Silicon统一内存原生的数组框架与LLM推理引擎。
      130
      推理与本地部署# MLX# MLX LM
      Sonar

      Sonar

      PygmalionAI主导的vLLM分支推理引擎,量化格式覆盖最广,AGPL-3.0许可。
      160
      推理与本地部署# Sonar
      DeepSpeed-MII

      DeepSpeed-MII

      微软DeepSpeed团队开源,Blocked KV Cache+Dynamic SplitFuse高吞吐推理库。
      140
      推理与本地部署# DeepSpeed-MII
      TensorRT-LLM

      TensorRT-LLM

      NVIDIA官方开源,编译优化大模型推理,NVIDIA GPU上极限吞吐引擎。
      140
      推理与本地部署# TensorRT-LLM
      LMDeploy

      LMDeploy

      上海AI Lab开源,TurboMind引擎驱动,国产LLM/VLM高性能部署工具箱。
      160
      推理与本地部署# LMDeploy
      SGLang

      SGLang

      SGLang是基于RadixAttention前缀缓存的高吞吐LLM/VLM服务框架。
      120
      推理与本地部署# SGLang
      PEFT

      PEFT

      Hugging Face 开源的 LoRA/QLoRA/DoRA 等参数高效微调标准底座库。
      140
      训练与微调# PEFT
      TorchTune

      TorchTune

      PyTorch官方原生后训练库,YAML配置+SFT/DPO/PPO/GRPO可黑盒配方。
      150
      训练与微调# TorchTune
      OpenRLHF

      OpenRLHF

      高性能分布式 RLHF 框架,支持 PPO/GRPO/REINFORCE++,基于 Ray 与 vLLM。
      140
      训练与微调# OpenRLHF
      Unsloth

      Unsloth

      手写Triton内核加速LLM微调,单卡2倍速、省70%显存的开源库。
      160
      训练与微调# Unsloth
      TRL

      TRL

      Hugging Face 官方后训练库,SFT/GRPO/DPO/KTO 等 Trainer 一站式封装。
      110
      训练与微调# TRL
      veRL

      veRL

      字节火山引擎开源,PPO/GRPO/REINFORCE++强化学习后训练框架。
      120
      训练与微调# veRL
      Colossal-AI

      Colossal-AI

      潞晨科技出品,集成多维并行与异构内存优化的开源大模型训练系统。
      120
      训练与微调# Colossal-AI
      DeepSpeed

      DeepSpeed

      微软开源的ZeRO优化器标杆,支撑千亿模型训练的深度学习加速库。
      130
      训练与微调# DeepSpeed
      Megatron-Core/LM

      Megatron-Core/LM

      NVIDIA开源的GPU优化大规模Transformer训练库,并行策略事实标准。
      130
      训练与微调# Megatron-Core
      Axolotl

      Axolotl

      YAML配置统一驱动LLM后训练,Apache-2.0许可的全栈微调框架。
      120
      训练与微调# Axolotl
      MS-SWIFT

      MS-SWIFT

      阿里达摩院开源,600+模型统一训练与部署的全栈框架。
      150
      训练与微调# MS-SWIFT
      加载更多
      Navi2AI
      Navi2AI 是一个专注 AI 工具的一站式导航站。汇集对话、绘画、编程、办公等热门 AI 产品,分类清晰、直达可用,帮你快速找到趁手的 AI 利器。

      友链申请 免责声明 广告合作 关于我们

      扫码加QQ群Navi2AI
      扫码加QQ群
      扫码加微信Navi2AI
      扫码加微信
      Copyright © 2026 Navi2AI 京ICP备2024080263号-3  京公网安备11010502061824号 
      网址
      网址文章软件书籍