Andrei Kanavalau

I recently defended my PhD in Electrical Engineering at Stanford and am now pursuing independent research on questions in technical AI safety. I am particularly interested in how training and internal model mechanisms shape safety-relevant behavior, and in how reliably that behavior can be evaluated.

projects

all projects →