WZ
Wojciech Zaremba
cs.LGcs.AIcs.NEcs.ROcs.CVstat.MLcs.CLcs.CRcs.CYcs.SD
On Valency
published · living versionsW_fvh7g6bt·v1 · currentpublished
Monitoring Reasoning Models for Misbehavior and the Risks of Promoting Obfuscation
with Bowen Baker, Joost Huizinga, Leo Gao, Zehao Dou +4
1 version
Preprints & journals
35 papers in the corpus · 2013–2025Transfer from Simulation to Real World through Learning Deep Inverse Dynamics Model1610.03518v1 · Paul Christiano, Zain Shah, Igor Mordatch et al.2016 · 161 citationsarXiv
OpenAI o1 System Card2412.16720v2 · OpenAI: Aaron Jaech, Adam Kalai, Adam Lerer et al.2024 · 44 citationsarXiv
Chain of Thought Monitorability: A New and Fragile Opportunity for AI Safety2507.11473v2 · Tomek Korbak, Mikita Balesni, Elizabeth Barnes et al.2025 · 2 citationsarXiv
Stress Testing Deliberative Alignment for Anti-Scheming Training2509.15541v1 · Bronson Schoen, Evgenia Nitishinskaya, Mikita Balesni et al.2025 · 2 citationsarXiv
Trading Inference-Time Compute for Adversarial Robustness2501.18841v1 · Wojciech Zaremba, Evgenia Nitishinskaya, Boaz Barak et al.2025 · 0 citationsarXivon Valency
GPT-4o System Card2410.21276v1 · OpenAI: Aaron Hurst, Adam Lerer, Adam P. Goucher et al.2024 · 165 citationsarXiv
Exploiting Linear Structure Within Convolutional Networks for Efficient Evaluation1404.0736v2 · Remi Denton, Wojciech Zaremba, Joan Bruna et al.2014 · 1,469 citationsarXiv
Evaluating Large Language Models Trained on Code2107.03374v2 · Mark Chen, Jerry Tworek, Heewoo Jun et al.2021 · 1,468 citationsarXivon Valency
A Generalizable Approach to Learning Optimizers2106.00958v2 · Diogo Almeida, Clemens Winter, Jie Tang et al.2021 · 4 citationsarXiv
Asymmetric self-play for automatic goal discovery in robotic manipulation2101.04882v1 · OpenAI OpenAI, Matthias Plappert, Raul Sampedro et al.2021 · 20 citationsarXiv
Predicting Sim-to-Real Transfer with Probabilistic Dynamics Models2009.12864v1 · Lei M. Zhang, Matthias Plappert, Wojciech Zaremba2020 · 0 citationsarXiv
Solving Rubik's Cube with a Robot Hand1910.07113v1 · OpenAI, Ilge Akkaya, Marcin Andrychowicz et al.2019 · 630 citationsarXiv
Learning Dexterous In-Hand Manipulation1808.00177v5 · OpenAI, Marcin Andrychowicz, Bowen Baker et al.2018 · 1,822 citationsarXiv
Domain Randomization and Generative Models for Robotic Grasping1710.06425v2 · Joshua Tobin, Lukas Biewald, Rocky Duan et al.2017 · 164 citationsarXiv
Multi-Goal Reinforcement Learning: Challenging Robotics Environments and Request for Research1802.09464v2 · Matthias Plappert, Marcin Andrychowicz, Alex Ray et al.2018 · 309 citationsarXiv
Overcoming Exploration in Reinforcement Learning with Demonstrations1709.10089v2 · Ashvin Nair, Bob McGrew, Marcin Andrychowicz et al.2017 · 720 citationsarXiv
Hindsight Experience Replay1707.01495v3 · Marcin Andrychowicz, Filip Wolski, Alex Ray et al.2017 · 337 citationsarXiv
One-Shot Imitation Learning1703.07326v3 · Yan Duan, Marcin Andrychowicz, Bradly C. Stadie et al.2017 · 226 citationsarXiv
Asymmetric Actor Critic for Image-Based Robot Learning1710.06542v1 · Lerrel Pinto, Marcin Andrychowicz, Peter Welinder et al.2017 · 354 citationsarXiv
Domain Randomization for Transferring Deep Neural Networks from Simulation to the Real World1703.06907v1 · Josh Tobin, Rachel Fong, Alex Ray et al.2017 · 3,127 citationsarXiv
Convolutional networks and learning invariant to homogeneous multiplicative scalings1506.08230v4 · Mark Tygert, Arthur Szlam, Soumith Chintala et al.2015 · 4 citationsAppl. Comput. Harmon. Anal., 42 (1): 154-166, 2017
Extensions and Limitations of the Neural GPU1611.00736v2 · Eric Price, Wojciech Zaremba, Ilya Sutskever2016 · 11 citationsarXiv
Improved Techniques for Training GANs1606.03498v1 · Tim Salimans, Ian Goodfellow, Wojciech Zaremba et al.2016 · 1,344 citationsarXiv
OpenAI Gym1606.01540v1 · Greg Brockman, Vicki Cheung, Ludwig Pettersson et al.2016 · 620 citationsarXiv
Sequence Level Training with Recurrent Neural Networks1511.06732v7 · Marc'Aurelio Ranzato, Sumit Chopra, Michael Auli et al.2015 · 1,365 citationsarXivon Valency
Reinforcement Learning Neural Turing Machines - Revised1505.00521v3 · Wojciech Zaremba, Ilya Sutskever2015 · 112 citationsarXiv
Learning Simple Algorithms from Examples1511.07275v2 · Wojciech Zaremba, Tomas Mikolov, Armand Joulin et al.2015 · 23 citationsarXiv
Learning to Execute1410.4615v3 · Wojciech Zaremba, Ilya Sutskever2014 · 305 citationsarXiv
Addressing the Rare Word Problem in Neural Machine Translation1410.8206v4 · Minh-Thang Luong, Ilya Sutskever, Quoc V. Le et al.2014 · 736 citationsarXiv
Recurrent Neural Network Regularization1409.2329v5 · Wojciech Zaremba, Ilya Sutskever, Oriol Vinyals2014 · 2,267 citationsarXivon Valency
Learning to Discover Efficient Mathematical Identities1406.1584v3 · Wojciech Zaremba, Karol Kurach, Rob Fergus2014 · 33 citationsarXiv
Learning from M/EEG data with variable brain activation delays.24683987 · Zaremba, Wojciech, Kumar, M Pawan, Gramfort, Alexandre et al.2014 · 6 citationsInformation processing in medical imaging : proceedings of the ... conference. 2013;23:414-25
Spectral Networks and Locally Connected Networks on Graphs1312.6203v3 · Joan Bruna, Wojciech Zaremba, Arthur Szlam et al.2013 · 2,689 citationsarXivon Valency
Intriguing properties of neural networks1312.6199v4 · Christian Szegedy, Wojciech Zaremba, Ilya Sutskever et al.2013 · 5,711 citationsarXivon Valency
B-tests: Low Variance Kernel Two-Sample Tests1307.1954v3 · Wojciech Zaremba, Arthur Gretton, Matthew Blaschko2013 · 18 citationsarXiv
Career total: 51 works. 35 are in this corpus.
Profile built from the corpus for this byline.
Author records are still filling in while the Hub is in alpha. If this is your page, you'll be able to claim it soon. Spot a mistake? Tell us.