Skip to content
AI360Xpert
Playgrounds
Visuals
Concepts
Learning Paths
Interview Questions
Papers
Explore
Hire Us
Learning Paths
Deep Learning Engineer
A comprehensive guide for Deep Learning Engineer
""
1
PREREQUISITES & FUNDAMENTALS
2
NEURAL NETWORK FOUNDATIONS
3
DEEP LEARNING FRAMEWORKS
4
CONVOLUTIONAL NEURAL NETWORKS (CNNS) & COMPUTER VISION
5
SEQUENCE MODELS & NATURAL LANGUAGE PROCESSING (NLP)
6
ADVANCED DEEP LEARNING ARCHITECTURES
7
OPTIMIZATION & DISTRIBUTED TRAINING
8
GENERATIVE AI & LARGE LANGUAGE MODELS (LLMS)
9
DEEP LEARNING IN PRODUCTION (MLOPS)
10
HARDWARE & DEPLOYMENT OPTIMIZATION
Deep Learning Engineer
Programming & Software Engineering
Python Programming
Data Structures
OOP
Async/Await
Data Manipulation
NumPy
Pandas
Polars
Version Control
Git
GitHub
GitLab
Software Design
Patterns & Clean Code
Applied Mathematics
Linear Algebra
Vectors
Matrices
Eigenvalues
SVD
Calculus
Derivatives
Partial Derivatives
Chain Rule
Probability &
Statistics
Distributions
Bayes Theorem
Hypothesis Testing
Information Theory
Entropy
Cross-Entropy
KL Divergence
Machine Learning Basics
Supervised vs
Unsupervised Learning
Linear & Logistic
Regression
Support Vector
Machines & Decision
Trees
Ensemble Methods
Random Forest
Gradient Boosting
XGBoost
Evaluation Metrics
Accuracy
Precision
Recall
F1
ROC-AUC
Artificial Neural Networks (ANNs)
Perceptrons &
Multi-Layer
Perceptrons
MLPs
Activation Functions
Sigmoid
Tanh
ReLU
LeakyReLU
GELU
Swish
Forward Propagation &
Backpropagation
Training Neural Networks
Loss Functions
MSE
Cross-Entropy
Huber Loss
Focal Loss
Gradient Descent &
Variants
SGD
Mini-batch
Nesterov
Regularization
Techniques
L1
L2
Dropout
Early Stopping
Weight Decay
Normalization
Batch Norm
Layer Norm
Instance Norm
Group Norm
Weight Initialization
Strategies
Xavier/Glorot
He
Kaiming
PyTorch
Tensors and Autograd
Building nn.Module
classes
DataLoaders and Custom
Datasets
PyTorch Lightning &
Ecosystem Boilerplate
Reduction
TensorFlow & Keras
Eager Execution vs
Graph Mode
Keras Sequential and
Functional APIs
tf.data API for Data
Pipelines
TensorBoard for
Visualization
JAX & Ecosystem
JAX Primitives
jit
grad
vmap
pmap
Neural Network
Libraries
Flax
Haiku
Optax for Optimization
CNN Architectures
Convolutions, Pooling,
and Strides
Classic Architectures
LeNet
AlexNet
VGG
Advanced Architectures
ResNet
Inception
EfficientNet
ConvNeXt
Object Detection & Segmentation
Two-stage Detectors
R-CNN
Faster R-CNN
One-stage Detectors
YOLO series
SSD
Semantic Segmentation
FCN
U-Net
DeepLab
Instance & Panoptic
Segmentation
Mask R-CNN
DETR
Advanced Vision Tasks
Image Generation &
Style Transfer
Vision Transformers
ViT
Swin Transformer
3D Computer Vision
NeRF
3D Gaussian Splatting
Point Clouds
Video Understanding &
Action Recognition
Traditional Sequence Models
Recurrent Neural
Networks
RNNs
Long Short-Term Memory
(LSTMs) & Gated
Recurrent Units
GRUs
Bidirectional RNNs
Word Embeddings & Representation
Word2Vec & GloVe
FastText &
Character-level
Embeddings
Contextual Embeddings
ELMo
Tokenization
Algorithms
BPE
WordPiece
SentencePiece
Tiktoken
Attention Mechanisms & Transformers
Self-Attention &
Multi-Head Attention
The Transformer
Architecture
Vaswani et al.
Encoder-only Models
BERT
RoBERTa
DeBERTa
Decoder-only Models
GPT series
LLaMA
Mistral
Encoder-Decoder Models
T5
BART
State Space Models (SSMs) & Alternatives
Linear State Space
Models
Mamba
S4
Hybrid Architectures
Jamba
RWKV and Linear
Attention
Generative Adversarial Networks (GANs)
Generator and
Discriminator Networks
DCGAN, WGAN, and
StyleGAN
Conditional GANs
cGAN
Pix2Pix
CycleGAN
Autoencoders & Diffusion
Vanilla and Sparse
Autoencoders
Variational
Autoencoders
VAEs
Denoising Diffusion
Probabilistic Models
DDPMs
Latent Diffusion
Stable Diffusion
Flux
Flow Matching &
Continuous-Time Models
Self-Supervised Learning (SSL)
Contrastive Learning
SimCLR
MoCo
BYOL
Masked Image Modeling
MAE
BEiT
Self-Distillation
DINO
DINOv2
Reinforcement Learning (RL) & Deep RL
Markov Decision
Processes (MDPs) &
Q-Learning
Deep Q-Networks
DQN
Policy Gradients &
Actor-Critic Methods
PPO
SAC
Inverse RL & Offline
RL
Graph Neural Networks (GNNs)
Graph Convolutions
GCNs
Message Passing Neural
Networks
MPNNs
Graph Attention
Networks
GATs
Advanced Optimizers
Momentum, RMSprop,
AdaGrad
Adam, AdamW, and LAMB
Learning Rate
Schedulers
Cosine Annealing
One-Cycle Policy
Warmup
Tuning Strategies
Grid Search and Random
Search
Bayesian Optimization
Optuna
Hyperopt
Population Based
Training
PBT
Distributed Training
Data Parallelism
DDP
Model Parallelism
Tensor
Pipeline Parallelism
Fully Sharded Data
Parallel
FSDP
DeepSpeed
Gradient Checkpointing
& Mixed Precision
Training
FP16
BF16
Ring Attention &
Context Scaling
Large Language Model Architectures
Scaling Laws &
Emergent Abilities
Mixture of Experts
MoE
Prompt Engineering &
In-Context Learning
Retrieval-Augmented
Generation (RAG) &
Vector Databases
Agentic LLM Workflows
LangChain
LlamaIndex
ReAct
Fine-Tuning & Alignment
Instruction Tuning
Supervised Fine-Tuning
Parameter-Efficient
Fine-Tuning
PEFT
LoRA
QLoRA
DoRA
Reinforcement Learning
from Human Feedback
RLHF
Direct Preference
Optimization
DPO
ORPO
KTO
Multimodal Models
Contrastive
Language-Image
Pretraining
CLIP
SigLIP
Visual Question
Answering
VQA
Vision-Language Models
LLaVA
BLIP
Qwen-VL
Audio & Video
Generation
Sora
WaveNet
VITS
Model Serving & Deployment
REST APIs
FastAPI
Flask
gRPC and Protocol
Buffers
Dedicated Servers
TorchServe
vLLM
Triton Inference
Server
Containerization & Orchestration
Docker &
Containerization Best
Practices
Kubernetes (K8s) for
ML Workloads
Kubeflow & MLflow for
Lifecycle Management
Continuous Integration & Data Management
CI/CD for Machine
Learning
Feature Stores
Feast
Hopsworks
Data Version Control
DVC
Monitoring & Maintenance
Model Drift and Data
Drift Detection
Logging and Telemetry
Prometheus
Grafana
ELK Stack
A/B Testing, Shadow
Deployments, Canary
Deployments
Hardware Accelerators
GPUs
CUDA
cuDNN
ROCm
TPUs & Specialized
ASICs
AWS Inferentia
Google TPU
NPUs and LPUs
Groq
Neural Processing
Units
Edge Devices
Jetson Nano
Raspberry Pi
Model Optimization Techniques
Quantization
PTQ
QAT
8-bit/4-bit
GPTQ
AWQ
GGUF
Pruning
Magnitude
Structured
Unstructured
Knowledge Distillation
Attention
Optimizations
FlashAttention
PagedAttention
Speculative Decoding
Deployment Frameworks
ONNX and ONNX Runtime
TensorRT for NVIDIA
GPUs
OpenVINO for Intel
Hardware
Edge & Mobile
Frameworks
TFLite
CoreML
ExecuTorch