训练与微调
共 12 篇网址
Navi2AI.com关于【AI 大模型基建】二级分类【训练与微调】的分类定义与收录描述:SFT / LoRA / RLHF / DPO 等后训练与定制框架,工程师向。当通用模型不够懂业务时,微调让它学习私有知识与输出风格。PEFT、Unsloth、LlamaFactory 把 LoRA、DPO 等高效微调标准化,DeepSpeed 支撑全量训练与分布式并行。相比从零预训练,成本低、见效快。
AI 大模型基建
AI 文案与写作
AI 图像与设计
AI 视频与创作
AI 音频与制作
AI 代码与开发
AI 效率与办公
AI 通用智能体
模型服务 MaaS&API
开源模型
推理与本地部署
API 网关与聚合
检索增强 RAG
向量数据库
训练与微调
排序
发布
更新
浏览
点赞
PEFT
Hugging Face 开源的 LoRA/QLoRA/DoRA 等参数高效微调标准底座库。
14
0
训练与微调
# PEFT
TorchTune
PyTorch官方原生后训练库,YAML配置+SFT/DPO/PPO/GRPO可黑盒配方。
15
0
训练与微调
# TorchTune
OpenRLHF
高性能分布式 RLHF 框架,支持 PPO/GRPO/REINFORCE++,基于 Ray 与 vLLM。
14
0
训练与微调
# OpenRLHF
Unsloth
手写Triton内核加速LLM微调,单卡2倍速、省70%显存的开源库。
16
0
训练与微调
# Unsloth
TRL
Hugging Face 官方后训练库,SFT/GRPO/DPO/KTO 等 Trainer 一站式封装。
11
0
训练与微调
# TRL
veRL
字节火山引擎开源,PPO/GRPO/REINFORCE++强化学习后训练框架。
12
0
训练与微调
# veRL
Colossal-AI
潞晨科技出品,集成多维并行与异构内存优化的开源大模型训练系统。
12
0
训练与微调
# Colossal-AI
DeepSpeed
微软开源的ZeRO优化器标杆,支撑千亿模型训练的深度学习加速库。
13
0
训练与微调
# DeepSpeed
Megatron-Core/LM
NVIDIA开源的GPU优化大规模Transformer训练库,并行策略事实标准。
13
0
训练与微调
# Megatron-Core
Axolotl
YAML配置统一驱动LLM后训练,Apache-2.0许可的全栈微调框架。
12
0
训练与微调
# Axolotl
MS-SWIFT
阿里达摩院开源,600+模型统一训练与部署的全栈框架。
15
0
训练与微调
# MS-SWIFT
LlamaFactory
北航开源零代码大模型微调框架,统一100+模型全流程训练。
12
0
训练与微调
# LlamaFactory
没有了
网址
网址
文章
软件
书籍