Texonom
Texonom
/
Engineering
Engineering
/Data Engineering/Artificial Intelligence/AI Risk/AI Alignment/Explainable AI/Interpretable AI/Mechanistic interpretability/Activation Engineering/Activation Decomposition/Sparse Autoencoder/Transcoder/
CLT
Loading views...
Search

CLT

Creator
Creator
Seonglae ChoSeonglae Cho
Created
Created
2025 Oct 30 0:5
Editor
Editor
Seonglae ChoSeonglae Cho
Edited
Edited
2025 Oct 30 0:6
Refs
Refs
 
 
 
 
Circuit Tracing: Revealing Computational Graphs in Language Models
We describe an approach to tracing the “step-by-step” computation involved when a model responds to a single prompt.
Circuit Tracing: Revealing Computational Graphs in Language Models
https://transformer-circuits.pub/2025/attribution-graphs/methods.html
Circuit Tracing: Revealing Computational Graphs in Language Models
 
 
 

Recommendations

Texonom
Texonom
/
Engineering
Engineering
/Data Engineering/Artificial Intelligence/AI Risk/AI Alignment/Explainable AI/Interpretable AI/Mechanistic interpretability/Activation Engineering/Activation Decomposition/Sparse Autoencoder/Transcoder/
CLT
Copyright Seonglae Cho·