Anthropic이 개발한 분석 도구로, 대규모 언어 모델의 내부에서 개념이 어떻게 변환되고 추론되는지 시각화합니다.
모델의 중간 활성화 상태를 추적하여 블랙박스였던 추론 과정을 투명하게 만듭니다.