๐Ÿ“’์ž๋ฃŒ

https://medium.com/@hugmanskj/transformer์˜-ํฐ-๊ทธ๋ฆผ-์ดํ•ด-๊ธฐ์ˆ ์ -๋ณต์žกํ•จ-์—†์ด-ํ•ต์‹ฌ-์•„์ด๋””์–ด-ํŒŒ์•…ํ•˜๊ธฐ-5e182a40459d

https://www.blossominkyung.com/deeplearning/transfomer-positional-encoding

https://www.blossominkyung.com/deeplearning/transformer-mha

https://www.blossominkyung.com/deeplearning/transfomer-last

https://medium.com/@mansoorsyed05/understanding-transformers-architecture-c571044a1c21

https://wikidocs.net/31379

Attention is All you Need : https://proceedings.neurips.cc/paper/2017/file/3f5ee243547dee91fbd053c1c4a845aa-Paper.pdf

๐ŸŽฏํ•ต์‹ฌ ํ‚ค์›Œ๋“œ

self-attention, positional encoding, Mulit-Head Attention, Scaled dot-product Attention, Cross Attention

๊ธฐ์กด ๋ชจ๋ธ์˜ ํ•œ๊ณ„

<aside>

๐Ÿ’กํŠธ๋žœ์Šคํฌ๋จธ์˜ ํ•ต์‹ฌ ์•„์ด๋””์–ด:

์ด ์–ดํ…์…˜์„ RNN์˜ ๋ณด์ •์„ ์œ„ํ•œ ์šฉ๋„๋กœ์„œ ์‚ฌ์šฉํ•˜๋Š” ๊ฒƒ์ด ์•„๋‹ˆ๋ผ ์–ดํ…์…˜๋งŒ์œผ๋กœ ์ธ์ฝ”๋”์™€ ๋””์ฝ”๋”๋ฅผ ๋งŒ๋“ค์–ด๋ณด๋ฉด ์–ด๋–จ๊นŒ?

</aside>

๊ตฌ์กฐ

transformer1.png

ํŠธ๋žœ์Šคํฌ๋จธ๋Š” RNN์„ ์‚ฌ์šฉํ•˜์ง€ ์•Š์ง€๋งŒ ๊ธฐ์กด์˜ seq2seq์ฒ˜๋Ÿผ ์ธ์ฝ”๋”-๋””์ฝ”๋” ๊ตฌ์กฐ๋ฅผ ์œ ์ง€ํ•˜๊ณ  ์žˆ๋‹ค.

Positional Encoding