MP

Matthias Plappert

cs.LGcs.ROcs.AIstat.MLcs.CVcs.CLcs.NEdeep learningin-hand manipulationreinforcement learning

On Valency

published · living versions
W_3seyyh2p·v1 · currentpublished
Evaluating Large Language Models Trained on Code
with Mark Chen, Jerry Tworek, Heewoo Jun, Qiming Yuan +53
1 version

Preprints & journals

10 papers in the corpus · 2016–2021
Using Tactile Sensing to Improve the Sample Efficiency and Performance of Deep Deterministic Policy Gradients for Simulated In-Hand Manipulation Tasks.34268337 · Melnik, Andrew, Lach, Luca, Plappert, Matthias et al.2021 · 28 citationsFrontiers in robotics and AI. 2021;8:538773
Evaluating Large Language Models Trained on Code2107.03374v2 · Mark Chen, Jerry Tworek, Heewoo Jun et al.2021 · 1,468 citationsarXivon Valency
Asymmetric self-play for automatic goal discovery in robotic manipulation2101.04882v1 · OpenAI OpenAI, Matthias Plappert, Raul Sampedro et al.2021 · 20 citationsarXiv
Predicting Sim-to-Real Transfer with Probabilistic Dynamics Models2009.12864v1 · Lei M. Zhang, Matthias Plappert, Wojciech Zaremba2020 · 0 citationsarXiv
Solving Rubik's Cube with a Robot Hand1910.07113v1 · OpenAI, Ilge Akkaya, Marcin Andrychowicz et al.2019 · 630 citationsarXiv
Learning Dexterous In-Hand Manipulation1808.00177v5 · OpenAI, Marcin Andrychowicz, Bowen Baker et al.2018 · 1,822 citationsarXiv
Multi-Goal Reinforcement Learning: Challenging Robotics Environments and Request for Research1802.09464v2 · Matthias Plappert, Marcin Andrychowicz, Alex Ray et al.2018 · 309 citationsarXiv
Parameter Space Noise for Exploration1706.01905v2 · Matthias Plappert, Rein Houthooft, Prafulla Dhariwal et al.2017 · 441 citationsarXiv
Career total: 12 works. 10 are in this corpus.

Profile built from the corpus for this byline.

Author records are still filling in while the Hub is in alpha. If this is your page, you'll be able to claim it soon. Spot a mistake? Tell us.