research
research projects and publications
Publications
Re-Align@ICLR
On the Non-Identifiability of Steering Vectors in Large Language Models
Sohan Venkatesh, Ashish Mahendran Kurapath
Representational Alignment Workshop at ICLR 2026
MechInterp
Architecture, Not Scale: Circuit Localization in Large Language Models
Sohan Venkatesh
Mechanistic Interpretability Workshop at ICML 2026
MechInterp
Negative Before Positive: Asymmetric Valence Processing in Large Language Models
Sohan Venkatesh
Mechanistic Interpretability Workshop at ICML 2026
Preprint
Repeated-Token Counting Reveals a Dissociation Between Representations and Outputs
Sohan Venkatesh
Preprint under review