Anthropic의 Transformer Circuits를 따라가는 시리즈.

기계적 해석가능성: 시작을 위한 무료 자료

2025-05-10 · 1 분 읽기

학습된 신경망을 회로 단위로 역설계하기. Anthropic의 Transformer Circuits 스레드와 몇 가지 동반 자료가 전부 무료다. 이 시리즈를 여는 김에 어디서 시작할지 정리한다.

트랜스포머 회로 1: 결과 요약

2025-05-17 · 3 분 읽기

Framework 논문 읽기 1편. 작은 어텐션 전용 모델을 모델 생물 삼아 트랜스포머를 완전히 역설계하려는 시도, 그리고 그 핵심 결과들의 지도.

트랜스포머 회로 3: 0-레이어 트랜스포머

2025-06-14 · 2 분 읽기

Framework 논문 읽기 3편. 어텐션이 하나도 없는 트랜스포머는 무엇을 배우는가. 답은 바이그램 통계, 그리고 이 답은 큰 모델의 직접 경로를 이해하는 열쇠가 된다.

트랜스포머 회로 6: 남은 질문들

2025-07-26 · 3 분 읽기

Framework 논문 읽기 6편. 이 프레임워크가 확보한 것과 확보하지 못한 것. MLP라는 벽, 그리고 이 논문이 예고하는 다음 연구들.

트랜스포머 회로 7: 관련 연구 지형

2025-08-09 · 3 분 읽기

Framework 논문 읽기 마지막 편. 이 논문이 어떤 연구들의 어깨 위에 서 있는지, 그리고 기존 접근과 무엇이 다른지를 정리한다.