Texonom
Texonom
/
Science
Science
/Mathematics/Math Field/Statistics/Statistical Model/Model Generalization/Model Training/Finetuning/
SFT
Loading views...
Search

SFT

Creator
Creator
Seonglae ChoSeonglae Cho
Created
Created
2023 Jul 15 17:6
Editor
Editor
Seonglae ChoSeonglae Cho
Edited
Edited
2025 Feb 4 16:46
Refs
Refs
Knowledge Distillation
Language Model RL
RLHF
PEFT

Supervised Fine-Tuning

 
 
 
 
SFT rarely alters the underlying model capabilities which means practitioners can unintentionally remove a model’s safety wrapper by merely fine-tuning it on a superficially unrelated task
openreview.net
https://openreview.net/pdf?id=FbFyO1r7rV
Supervised Fine-tuning Trainer
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
Supervised Fine-tuning Trainer
https://huggingface.co/docs/trl/sft_trainer
 
 

Backlinks

Deepseek R1DatasetDatasetHuggingface TRLPreference OptimizationAI FrameworkFinetuning

Recommendations

Texonom
Texonom
/
Science
Science
/Mathematics/Math Field/Statistics/Statistical Model/Model Generalization/Model Training/Finetuning/
SFT
Copyright Seonglae Cho·Sign in