Texonom
Texonom
/
Engineering
Engineering
/Data Engineering/Artificial Intelligence/AI Risk/AI Alignment/Explainable AI/Interpretable AI/Mechanistic interpretability/Activation Engineering/Activation Decomposition/Sparse Autoencoder/SAE Training/
SAE Finetuning
Loading views...
Search

SAE Finetuning

Creator
Creator
Seonglae ChoSeonglae Cho
Created
Created
2025 Feb 3 14:11
Editor
Editor
Seonglae ChoSeonglae Cho
Edited
Edited
2025 Mar 8 12:29
Refs
Refs
 
 
 
 
 
 
 
 
 
 
Extracting SAE task features for in-context learning — LessWrong
TL;DR * We try to study task vectors in the SAE basis. This is challenging because there is no canonical way to convert an arbitrary vector in the r…
Extracting SAE task features for in-context learning — LessWrong
https://www.lesswrong.com/posts/5FGXmJ3wqgGRcbyH7/extracting-sae-task-features-for-in-context-learning
Extracting SAE task features for in-context learning — LessWrong
 
 
 

Recommendations

Texonom
Texonom
/
Engineering
Engineering
/Data Engineering/Artificial Intelligence/AI Risk/AI Alignment/Explainable AI/Interpretable AI/Mechanistic interpretability/Activation Engineering/Activation Decomposition/Sparse Autoencoder/SAE Training/
SAE Finetuning
Copyright Seonglae Cho·