Navi2AI

      训练与微调

      共 12 篇网址
      Navi2AI.com关于【AI 大模型基建】二级分类【训练与微调】的分类定义与收录描述:SFT / LoRA / RLHF / DPO 等后训练与定制框架,工程师向。当通用模型不够懂业务时,微调让它学习私有知识与输出风格。PEFT、Unsloth、LlamaFactory 把 LoRA、DPO 等高效微调标准化,DeepSpeed 支撑全量训练与分布式并行。相比从零预训练,成本低、见效快。
      AI 大模型基建AI 文案与写作AI 图像与设计AI 视频与创作AI 音频与制作AI 代码与开发AI 效率与办公AI 通用智能体
      模型服务 MaaS&API开源模型推理与本地部署API 网关与聚合检索增强 RAG向量数据库训练与微调
      排序
      发布更新浏览点赞
      PEFT

      PEFT

      Hugging Face 开源的 LoRA/QLoRA/DoRA 等参数高效微调标准底座库。
      140
      训练与微调# PEFT
      TorchTune

      TorchTune

      PyTorch官方原生后训练库,YAML配置+SFT/DPO/PPO/GRPO可黑盒配方。
      150
      训练与微调# TorchTune
      OpenRLHF

      OpenRLHF

      高性能分布式 RLHF 框架,支持 PPO/GRPO/REINFORCE++,基于 Ray 与 vLLM。
      140
      训练与微调# OpenRLHF
      Unsloth

      Unsloth

      手写Triton内核加速LLM微调,单卡2倍速、省70%显存的开源库。
      160
      训练与微调# Unsloth
      TRL

      TRL

      Hugging Face 官方后训练库,SFT/GRPO/DPO/KTO 等 Trainer 一站式封装。
      110
      训练与微调# TRL
      veRL

      veRL

      字节火山引擎开源,PPO/GRPO/REINFORCE++强化学习后训练框架。
      120
      训练与微调# veRL
      Colossal-AI

      Colossal-AI

      潞晨科技出品,集成多维并行与异构内存优化的开源大模型训练系统。
      120
      训练与微调# Colossal-AI
      DeepSpeed

      DeepSpeed

      微软开源的ZeRO优化器标杆,支撑千亿模型训练的深度学习加速库。
      130
      训练与微调# DeepSpeed
      Megatron-Core/LM

      Megatron-Core/LM

      NVIDIA开源的GPU优化大规模Transformer训练库,并行策略事实标准。
      130
      训练与微调# Megatron-Core
      Axolotl

      Axolotl

      YAML配置统一驱动LLM后训练,Apache-2.0许可的全栈微调框架。
      120
      训练与微调# Axolotl
      MS-SWIFT

      MS-SWIFT

      阿里达摩院开源,600+模型统一训练与部署的全栈框架。
      150
      训练与微调# MS-SWIFT
      LlamaFactory

      LlamaFactory

      北航开源零代码大模型微调框架,统一100+模型全流程训练。
      120
      训练与微调# LlamaFactory
      没有了
      Navi2AI
      Navi2AI 是一个专注 AI 工具的一站式导航站。汇集对话、绘画、编程、办公等热门 AI 产品,分类清晰、直达可用,帮你快速找到趁手的 AI 利器。

      友链申请 免责声明 广告合作 关于我们

      扫码加QQ群Navi2AI
      扫码加QQ群
      扫码加微信Navi2AI
      扫码加微信
      Copyright © 2026 Navi2AI 京ICP备2024080263号-3  京公网安备11010502061824号 
      网址
      网址文章软件书籍