PS
Pierre Sermanet
cs.ROcs.CVcs.LGcs.AIcs.CLcs.CYcs.HCcs.SYeess.SYcs.NE
On Valency
published · living versionsW_6um5xyqj·v1 · currentpublished
Preprints & journals
36 papers in the corpus · 2012–2025SciFi-Benchmark: Leveraging Science Fiction To Improve Robot Behavior2503.10706v2 · Pierre Sermanet, Anirudha Majumdar, Vikas Sindhwani2025 · 0 citationsarXiv
Open X-Embodiment: Robotic Learning Datasets and RT-X Models2310.08864v9 · Abby O'Neill, Abdul Rehman, Abhinav Gupta et al.2023 · 104 citationsarXiv
Gemini Robotics: Bringing AI into the Physical World2503.20020v1 · Gemini Robotics Team, Saminda Abeyruwan, Joshua Ainslie et al.2025 · 8 citationsarXiv
Generating Robot Constitutions & Benchmarks for Semantic Safety2503.08663v1 · Pierre Sermanet, Anirudha Majumdar, Alex Irpan et al.2025 · 0 citationsarXiv
Robotic Table Tennis: A Case Study into a High Speed Learning System2309.03315v2 · David B. D'Ambrosio, Jonathan Abelian, Saminda Abeyruwan et al.2023 · 19 citationsarXiv
Predictive Red Teaming: Breaking Policies Without Breaking Robots2502.06575v1 · Anirudha Majumdar, Mohit Sharma, Dmitry Kalashnikov et al.2025 · 0 citationsarXiv
A Short Note on Evaluating RepNet for Temporal Repetition Counting in Videos2411.08878v1 · Debidatta Dwibedi, Yusuf Aytar, Jonathan Tompson et al.2024 · 0 citationsarXiv
Vid2Robot: End-to-end Video-conditioned Policy Learning with Cross-Attention Transformers2403.12943v2 · Vidhi Jain, Maria Attarian, Nikhil J Joshi et al.2024 · 25 citationsarXiv
AutoRT: Embodied Foundation Models for Large Scale Orchestration of Robotic Agents2401.12963v2 · Michael Ahn, Debidatta Dwibedi, Chelsea Finn et al.2024 · 14 citationsarXiv
RT-H: Action Hierarchies Using Language2403.01823v2 · Suneel Belkhale, Tianli Ding, Ted Xiao et al.2024 · 67 citationsarXiv
RoboVQA: Multimodal Long-Horizon Reasoning for Robotics2311.00899v1 · Pierre Sermanet, Tianli Ding, Jeffrey Zhao et al.2023 · 47 citationsarXiv
Video Language Planning2310.10625v1 · Yilun Du, Mengjiao Yang, Pete Florence et al.2023 · 3 citationsarXiv
RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control2307.15818v1 · Anthony Brohan, Noah Brown, Justice Carbajal et al.2023 · 270 citationsarXiv
Robotic Skill Acquisition via Instruction Augmentation with Vision-Language Models2211.11736v3 · Ted Xiao, Harris Chan, Pierre Sermanet et al.2022 · 35 citationsarXiv
Visuomotor Control in Multi-Object Scenes Using Object-Aware Representations2205.06333v2 · Negin Heravi, Ayzaan Wahid, Corey Lynch et al.2022 · 9 citationsarXiv
PaLM-E: An Embodied Multimodal Language Model2303.03378v1 · Danny Driess, Fei Xia, Mehdi S. M. Sajjadi et al.2023 · 349 citationsarXiv
GoalsEye: Learning High Speed Precision Table Tennis on a Physical Robot2210.03662v2 · Tianli Ding, Laura Graesser, Saminda Abeyruwan et al.2022 · 1 citationarXiv
Do As I Can, Not As I Say: Grounding Language in Robotic Affordances2204.01691v2 · Michael Ahn, Anthony Brohan, Noah Brown et al.2022 · 518 citationsarXiv
Inner Monologue: Embodied Reasoning through Planning with Language Models2207.05608v1 · Wenlong Huang, Fei Xia, Ted Xiao et al.2022 · 203 citationsarXiv
With a Little Help from My Friends: Nearest-Neighbor Contrastive Learning of Visual Representations2104.14548v2 · Debidatta Dwibedi, Yusuf Aytar, Jonathan Tompson et al.2021 · 395 citationsarXiv
Language Conditioned Imitation Learning over Unstructured Data2005.07648v2 · Corey Lynch, Pierre Sermanet2020 · 113 citationsarXiv
Broadly-Exploring, Local-Policy Trees for Long-Horizon Task Planning2010.06491v1 · Brian Ichter, Pierre Sermanet, Corey Lynch2020 · 19 citationsarXiv
Counting Out Time: Class Agnostic Video Repetition Counting in the Wild2006.15418v1 · Debidatta Dwibedi, Yusuf Aytar, Jonathan Tompson et al.2020 · 130 citationsarXiv
Learning to Play by Imitating Humans2006.06874v1 · Rostam Dinyari, Pierre Sermanet, Corey Lynch2020 · 2 citationsarXiv
Motion2Vec: Semi-Supervised Representation Learning from Surgical Videos2006.00545v1 · Ajay Kumar Tanwani, Pierre Sermanet, Andy Yan et al.2020 · 46 citationsarXiv
Learning Latent Plans from Play1903.01973v2 · Corey Lynch, Mohi Khansari, Ted Xiao et al.2019 · 22 citationsarXiv
Online Object Representations with Contrastive Learning1906.04312v1 · Soren Pirk, Mohi Khansari, Yunfei Bai et al.2019 · 13 citationsarXiv
Temporal Cycle-Consistency Learning1904.07846v1 · Debidatta Dwibedi, Yusuf Aytar, Jonathan Tompson et al.2019 · 257 citationsarXiv
Wasserstein Dependency Measure for Representation Learning1903.11780v1 · Sherjil Ozair, Corey Lynch, Yoshua Bengio et al.2019 · 19 citationsarXiv
Learning Actionable Representations from Visual Observations1808.00928v3 · Debidatta Dwibedi, Jonathan Tompson, Corey Lynch et al.2018 · 69 citationsarXiv
Time-Contrastive Networks: Self-Supervised Learning from Video1704.06888v3 · Pierre Sermanet, Corey Lynch, Yevgen Chebotar et al.2017 · 617 citationsarXiv
Unsupervised Perceptual Rewards for Imitation Learning1612.06699v3 · Pierre Sermanet, Kelvin Xu, Sergey Levine2016 · 130 citationsarXiv
Going Deeper with Convolutions1409.4842v1 · Christian Szegedy, Wei Liu, Yangqing Jia et al.2014 · 1,374 citationsarXivon Valency
OverFeat: Integrated Recognition, Localization and Detection using Convolutional Networks1312.6229v4 · Pierre Sermanet, David Eigen, Xiang Zhang et al.2013 · 1,398 citationsarXiv
Pedestrian Detection with Unsupervised Multi-Stage Feature Learning1212.0142v2 · Pierre Sermanet, Koray Kavukcuoglu, Soumith Chintala et al.2012 · 789 citationsarXiv
Convolutional Neural Networks Applied to House Numbers Digit Classification1204.3968v1 · Pierre Sermanet, Soumith Chintala, Yann LeCun2012 · 347 citationsarXiv
Career total: 75 works. 36 are in this corpus.
Profile built from the corpus for this byline.
Author records are still filling in while the Hub is in alpha. If this is your page, you'll be able to claim it soon. Spot a mistake? Tell us.