Learn AI, Data Science & Business — Earn Certificates That Get You Hired
Earn Your Business Degree, Tuition-Free, 100% Online!
Overview
Google, IBM & Meta Certificates – 40% Off
One Coursera Plus subscription covers most Professional Certificates on Coursera.
Unlock All Certificates
This course explains the Transformer neural network architecture for language translation, covering embeddings, positional encodings, query-key-value attention, residual connections, normalization, encoder-decoder attention, tokenization, and inference.
Syllabus
Introduction
Transformer at a high level
Why Batch Data? Why Fixed Length Sequence?
Embeddings
Positional Encodings
Query, Key and Value vectors
Masked Multi Head Self Attention
Residual Connections
Layer Normalization
Decoder
Masked Multi Head Cross Attention
Tokenization & Generating the next translated word
Transformer Inference Example
Taught by
CodeEmporium