.learn() - page 5
what I have learned so far
-
Dependency Injection으로 생성자 인자 정리하기: MVVM과 .NET Host
DI가 객체 생성을 어떻게 단순하게 만드는지, 그리고 MVVM 뷰모델의 길어지는 생성자를 .NET Generic Host로 어떻게 간결하게 유지하는지.
-
Dynamic Programming
Overlapping subproblem과 optimal substructure가 재귀 정의를 효율적인 알고리즘으로 바꾸는 과정.
-
Self-Attention과 Transformer - 순차 연결을 끊고 직접 참조하다
RNN이 이전 상태 통해 문맥을 누적 전달했다면, Transformer는 필요한 토큰을 직접 찾아본다. Self-Attention이 어떻게 순차 구조를 없애고, Attention Seq2Seq와 어떻게 연결되는지 살펴본다.
-
Decoder의 남은 문제 - 출력 문맥도 여전히 누적된다
Attention은 Encoder의 정보 병목을 해결했다. 하지만 Decoder 자체는 여전히 이전 상태에 의존하는 순차 구조다. 이 문제가 왜 Transformer 등장의 마지막 동기가 되는지 살펴본다.
-
Attention Seq2Seq - 마지막 상태만 보지 말고 직접 보자
Vanilla Seq2Seq의 병목을 어떻게 해결할까? Decoder가 Encoder의 모든 hidden state를 "필요에 따라" 직접 참고하는 방식.