首页
站长博客
文档中心
申请收录
首页
站长博客
文档中心
申请收录
熊猫老爹
帅气的我简直无法用语言描述!
文章
2
网址
434
书籍
0
软件
0
评论
0
已发布
434
SGLang
SGLang是基于RadixAttention前缀缓存的高吞吐LLM/VLM服务框架。
18
0
推理与本地部署
# SGLang
PEFT
Hugging Face 开源的 LoRA/QLoRA/DoRA 等参数高效微调标准底座库。
22
0
训练与微调
# PEFT
TorchTune
PyTorch官方原生后训练库,YAML配置+SFT/DPO/PPO/GRPO可黑盒配方。
25
0
训练与微调
# TorchTune
OpenRLHF
高性能分布式 RLHF 框架,支持 PPO/GRPO/REINFORCE++,基于 Ray 与 vLLM。
22
0
训练与微调
# OpenRLHF
Unsloth
手写Triton内核加速LLM微调,单卡2倍速、省70%显存的开源库。
23
0
训练与微调
# Unsloth
TRL
Hugging Face 官方后训练库,SFT/GRPO/DPO/KTO 等 Trainer 一站式封装。
21
0
训练与微调
# TRL
veRL
字节火山引擎开源,PPO/GRPO/REINFORCE++强化学习后训练框架。
23
0
训练与微调
# veRL
Colossal-AI
潞晨科技出品,集成多维并行与异构内存优化的开源大模型训练系统。
21
0
训练与微调
# Colossal-AI
DeepSpeed
微软开源的ZeRO优化器标杆,支撑千亿模型训练的深度学习加速库。
20
0
训练与微调
# DeepSpeed
Megatron-Core/LM
NVIDIA开源的GPU优化大规模Transformer训练库,并行策略事实标准。
22
0
训练与微调
# Megatron-Core
Axolotl
YAML配置统一驱动LLM后训练,Apache-2.0许可的全栈微调框架。
19
0
训练与微调
# Axolotl
MS-SWIFT
阿里达摩院开源,600+模型统一训练与部署的全栈框架。
23
0
训练与微调
# MS-SWIFT
加载更多
网址
网址
文章
软件
书籍