paper-with-me

Methods

Rendezvous 6 Static Word Embeddings 5 Vision Transformers 5 Data Parallel Methods 4 Data Parallel Methods 4 Data Parallel Methods 4 Fine-Tuning 4 Lane Detection Models 4 Output Functions 4 Replicated Data Parallel 4 Topic Embeddings 4 3D Face Mesh Models 3 3D Object Detection Models 3 Asynchronous Data Parallel 3 Asynchronous Data Parallel 3 Asynchronous Pipeline Parallel 3 Asynchronous Pipeline Parallel 3 Asynchronous Pipeline Parallel 3 Attention Mechanisms 3 Attention Modules 3 Autoencoding Transformers 3 Autoencoding Transformers 3 Autoencoding Transformers 3 Autoregressive Transformers 3

Softmax

2000년 · 논문 37,448편
Output Functions

Dense Connections

2000년 · 논문 29,235편
Feedforward Networks

Dropout

2000년 · 논문 27,477편
Regularization

Linear Layer

2000년 · 논문 25,425편
Feedforward Networks

Layer Normalization

2000년 · 논문 24,985편
Normalization

Convolution

1980년 · 논문 19,588편
Convolutions

BPE

Byte Pair Encoding
2000년 · 논문 18,980편
Subword Segmentation

Focus

2000년 · 논문 15,341편
Transformers

Label Smoothing

1985년 · 논문 14,332편
Regularization

Absolute Position Encodings

2000년 · 논문 13,947편
Position Embeddings

SET

Sparse Evolutionary Training
2000년 · 논문 13,421편
Sparsity

Attention Dropout

2018년 · 논문 10,892편
Regularization

ReLU

*Communicated@Fast*How Do I Communicate to Expedia?
2000년 · 논문 10,350편
Activation Functions

SPEED

SPEED: Separable Pyramidal Pooling EncodEr-Decoder for Real-Time Monocular Depth Estimation on Low-Resource Settings
2000년 · 논문 9,576편

Max Pooling

2000년 · 논문 7,126편
Pooling Operations
다음 →