TASK	DATASET	MODEL	METRIC NAME	METRIC VALUE	GLOBAL RANK
Atari Games	Atari 2600 Alien	Rainbow+SEER	Score	1172.6	# 36
Atari Games	Atari 2600 Amidar	Rainbow+SEER	Score	250.5	# 33
Atari Games	Atari 2600 Bank Heist	Rainbow+SEER	Score	276.6	# 39
Atari Games	Atari 2600 Crazy Climber	Rainbow+SEER	Score	28066	# 43
Atari Games	Atari 2600 Krull	Rainbow+SEER	Score	3277.5	# 45
Atari Games	Atari 2600 Q*Bert	Qbert Rainbow+SEER	Score	4123.5	# 45
Atari Games	Atari 2600 Road Runner	Rainbow+SEER	Score	11794	# 39
Atari Games	Atari 2600 Seaquest	Rainbow+SEER	Score	561.2	# 52

Badge	Markdown
	`[![PWC](https://img.shields.io/endpoint.svg?url=https://paperswithcode.com/badge/improving-computational-efficiency-in-visual/atari-games-on-atari-2600-amidar)](https://paperswithcode.com/sota/atari-games-on-atari-2600-amidar?p=improving-computational-efficiency-in-visual)`
	`[![PWC](https://img.shields.io/endpoint.svg?url=https://paperswithcode.com/badge/improving-computational-efficiency-in-visual/atari-games-on-atari-2600-alien)](https://paperswithcode.com/sota/atari-games-on-atari-2600-alien?p=improving-computational-efficiency-in-visual)`
	`[![PWC](https://img.shields.io/endpoint.svg?url=https://paperswithcode.com/badge/improving-computational-efficiency-in-visual/atari-games-on-atari-2600-bank-heist)](https://paperswithcode.com/sota/atari-games-on-atari-2600-bank-heist?p=improving-computational-efficiency-in-visual)`
	`[![PWC](https://img.shields.io/endpoint.svg?url=https://paperswithcode.com/badge/improving-computational-efficiency-in-visual/atari-games-on-atari-2600-road-runner)](https://paperswithcode.com/sota/atari-games-on-atari-2600-road-runner?p=improving-computational-efficiency-in-visual)`
	`[![PWC](https://img.shields.io/endpoint.svg?url=https://paperswithcode.com/badge/improving-computational-efficiency-in-visual/atari-games-on-atari-2600-crazy-climber)](https://paperswithcode.com/sota/atari-games-on-atari-2600-crazy-climber?p=improving-computational-efficiency-in-visual)`
	`[![PWC](https://img.shields.io/endpoint.svg?url=https://paperswithcode.com/badge/improving-computational-efficiency-in-visual/atari-games-on-atari-2600-krull)](https://paperswithcode.com/sota/atari-games-on-atari-2600-krull?p=improving-computational-efficiency-in-visual)`
	`[![PWC](https://img.shields.io/endpoint.svg?url=https://paperswithcode.com/badge/improving-computational-efficiency-in-visual/atari-games-on-atari-2600-qbert)](https://paperswithcode.com/sota/atari-games-on-atari-2600-qbert?p=improving-computational-efficiency-in-visual)`
	`[![PWC](https://img.shields.io/endpoint.svg?url=https://paperswithcode.com/badge/improving-computational-efficiency-in-visual/atari-games-on-atari-2600-seaquest)](https://paperswithcode.com/sota/atari-games-on-atari-2600-seaquest?p=improving-computational-efficiency-in-visual)`

Improving Computational Efficiency in Visual Reinforcement Learning via Stored Embeddings

NeurIPS 2021 · Lili Chen, Kimin Lee, Aravind Srinivas, Pieter Abbeel ·

Recent advances in off-policy deep reinforcement learning (RL) have led to impressive success in complex tasks from visual observations. Experience replay improves sample-efficiency by reusing experiences from the past, and convolutional neural networks (CNNs) process high-dimensional inputs effectively. However, such techniques demand high memory and computational bandwidth. In this paper, we present Stored Embeddings for Efficient Reinforcement Learning (SEER), a simple modification of existing off-policy RL methods, to address these computational and memory requirements. To reduce the computational overhead of gradient updates in CNNs, we freeze the lower layers of CNN encoders early in training due to early convergence of their parameters. Additionally, we reduce memory requirements by storing the low-dimensional latent vectors for experience replay instead of high-dimensional images, enabling an adaptive increase in the replay buffer capacity, a useful technique in constrained-memory settings. In our experiments, we show that SEER does not degrade the performance of RL agents while significantly saving computation and memory across a diverse set of DeepMind Control environments and Atari games.

PDF Abstract NeurIPS 2021 PDF NeurIPS 2021 Abstract

Code

Add Remove Mark official

lili-chen/SEER official

Tasks

Add Remove

Atari Games

Computational Efficiency

reinforcement-learning

Reinforcement Learning (RL)

Transfer Learning

Datasets

Arcade Learning Environment

DeepMind Control Suite

Results from the Paper

Edit

Ranked #33 on Atari Games on Atari 2600 Amidar

Get a GitHub badge

Task	Dataset	Model	Metric Name	Metric Value	Global Rank	Benchmark
Atari Games	Atari 2600 Alien	Rainbow+SEER	Score	1172.6	# 36	Compare
Atari Games	Atari 2600 Amidar	Rainbow+SEER	Score	250.5	# 33	Compare
Atari Games	Atari 2600 Bank Heist	Rainbow+SEER	Score	276.6	# 39	Compare
Atari Games	Atari 2600 Crazy Climber	Rainbow+SEER	Score	28066	# 43	Compare
Atari Games	Atari 2600 Krull	Rainbow+SEER	Score	3277.5	# 45	Compare
Atari Games	Atari 2600 Q*Bert	Qbert Rainbow+SEER	Score	4123.5	# 45	Compare
Atari Games	Atari 2600 Road Runner	Rainbow+SEER	Score	11794	# 39	Compare
Atari Games	Atari 2600 Seaquest	Rainbow+SEER	Score	561.2	# 52	Compare

Methods

Add Remove

1x1 Convolution • Average Pooling • Batch Normalization • Convolution • Cosine Annealing • Dense Connections • Experience Replay • Global Average Pooling • Grouped Convolution • LARS • RegNetY • ReLU • SEER • Sigmoid Activation • Squeeze-and-Excitation Block • SwAV

Edit Social Preview

Improving Computational Efficiency in Visual Reinforcement Learning via Stored Embeddings

Code Edit Add Remove Mark official

Tasks Edit Add Remove

Datasets Edit

Results from the Paper Edit

Methods Edit Add Remove

Code

Add Remove Mark official

Tasks

Add Remove

Datasets

Results from the Paper

Edit

Methods

Add Remove