RG
Ross Girshick
cs.CVcs.LGcs.AIcs.CLcs.NEstat.MLAlgorithmscs.ROcs.SDeess.AS
On Valency
published · living versionsW_ssszqkn3·v1 · currentpublished
DenseNet: Implementing Efficient ConvNet Descriptor Pyramids
with Forrest Iandola, Matt Moskewicz, Sergey Karayev, Trevor Darrell +1
1 version
Preprints & journals
83 papers in the corpus · 2010–2025SIMS-V: Simulated Instruction-Tuning for Spatial Video Understanding2511.04668v2 · Ellis Brown, Arijit Ray, Ranjay Krishna et al.2025 · 0 citationsarXiv
Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models2409.17146v2 · Matt Deitke, Christopher Clark, Sangho Lee et al.2024 · 59 citationsarXiv
SAM 2: Segment Anything in Images and Videos2408.00714v2 · Nikhila Ravi, Valentin Gabeur, Yuan-Ting Hu et al.2024 · 266 citationsarXiv
PoliFormer: Scaling On-Policy RL with Transformers Results in Masterful Navigators2406.20083v1 · Kuo-Hao Zeng, Zichen Zhang, Kiana Ehsani et al.2024 · 0 citationsarXiv
The effectiveness of MAE pre-pretraining for billion-scale pretraining2303.13496v3 · Mannat Singh, Quentin Duval, Kalyan Vasudev Alwala et al.2023 · 51 citationsarXiv
Segment Anything2304.02643v1 · Alexander Kirillov, Eric Mintun, Nikhila Ravi et al.2023 · 568 citationsarXiv
Exploring Plain Vision Transformer Backbones for Object Detection2203.16527v2 · Yanghao Li, Hanzi Mao, Ross Girshick et al.2022 · 798 citationsarXiv
Focal Loss for Dense Object Detection.30040631 · Lin, Tsung-Yi, Goyal, Priya, Girshick, Ross et al.2022 · 11,203 citationsIEEE transactions on pattern analysis and machine intelligence. 2020;42(2):318-327
Revisiting Weakly Supervised Pre-Training of Visual Perception Models2201.08371v2 · Mannat Singh, Laura Gustafson, Aaron Adcock et al.2022 · 94 citationsarXiv
Evaluating Large-Vocabulary Object Detectors: The Devil is in the Details2102.01066v2 · Achal Dave, Piotr Doll'ar, Deva Ramanan et al.2021 · 25 citationsarXiv
Masked Autoencoders Are Scalable Vision Learners2111.06377v3 · Kaiming He, Xinlei Chen, Saining Xie et al.2021 · 8,115 citationsarXiv
Benchmarking Detection Transfer Learning with Vision Transformers2111.11429v1 · Yanghao Li, Saining Xie, Xinlei Chen et al.2021 · 77 citationsarXiv
PyTorchVideo: A Deep Learning Library for Video Understanding2111.09887v1 · Haoqi Fan, Tullie Murrell, Heng Wang et al.2021 · 1 citationarXiv
Early Convolutions Help Transformers See Better2106.14881v3 · Tete Xiao, Mannat Singh, Eric Mintun et al.2021 · 370 citationsarXiv
A Large-Scale Study on Unsupervised Spatiotemporal Representation Learning2104.14558v1 · Christoph Feichtenhofer, Haoqi Fan, Bo Xiong et al.2021 · 223 citationsarXiv
Boundary IoU: Improving Object-Centric Image Segmentation Evaluation2103.16562v1 · Bowen Cheng, Ross Girshick, Piotr Doll'ar et al.2021 · 488 citationsarXiv
Fast and Accurate Model Scaling2103.06877v1 · Piotr Doll'ar, Mannat Singh, Ross Girshick2021 · 117 citationsarXiv
Impact of data on generalization of AI for surgical intelligence applications.33335191 · Bar, Omri, Neimark, Daniel, Zohar, Maya et al.2021 · 91 citationsScientific reports. 2020;10(1):22208
Large scale weakly and semi-supervised learning for low-resource video ASR2005.07850v2 · Kritika Singh, Vimal Manohar, Alex Xiao et al.2020 · 14 citationsarXiv
Are Labels Necessary for Neural Architecture Search?2003.12056v2 · Chenxi Liu, Piotr Doll'ar, Kaiming He et al.2020 · 71 citationsarXiv
A Multigrid Method for Efficiently Training Video Models1912.00998v2 · Chao-Yuan Wu, Ross Girshick, Kaiming He et al.2019 · 88 citationsarXiv
Designing Network Design Spaces2003.13678v1 · Ilija Radosavovic, Raj Prateek Kosaraju, Ross Girshick et al.2020 · 1,958 citationsarXiv
Momentum Contrast for Unsupervised Visual Representation Learning1911.05722v3 · Kaiming He, Haoqi Fan, Yuxin Wu et al.2019 · 13,135 citationsarXiv
Improved Baselines with Momentum Contrastive Learning2003.04297v1 · Xinlei Chen, Haoqi Fan, Ross Girshick et al.2020 · 2,070 citationsarXiv
Mask R-CNN.29994331 · He, Kaiming, Gkioxari, Georgia, Dollar, Piotr et al.2020 · 3,514 citationsIEEE transactions on pattern analysis and machine intelligence. 2020;42(2):386-397
Training ASR models by Generation of Contextual Information1910.12367v2 · Kritika Singh, Dmytro Okhonko, Jun Liu et al.2019 · 8 citationsarXiv
PointRend: Image Segmentation as Rendering1912.08193v2 · Alexander Kirillov, Yuxin Wu, Kaiming He et al.2019 · 1,175 citationsarXiv
LVIS: A Dataset for Large Vocabulary Instance Segmentation1908.03195v2 · Agrim Gupta, Piotr Doll'ar, Ross Girshick2019 · 1,290 citationsarXiv
TensorMask: A Foundation for Dense Object Segmentation1903.12174v2 · Xinlei Chen, Ross Girshick, Kaiming He et al.2019 · 415 citationsarXiv
PHYRE: A New Benchmark for Physical Reasoning1908.05656v1 · Anton Bakhtin, Laurens van der Maaten, Justin Johnson et al.2019 · 1 citationarXiv
Long-Term Feature Banks for Detailed Video Understanding1812.05038v2 · Chao-Yuan Wu, Christoph Feichtenhofer, Haoqi Fan et al.2018 · 480 citationsarXiv
Panoptic Segmentation1801.00868v3 · Alexander Kirillov, Kaiming He, Ross Girshick et al.2018 · 1,616 citationsarXiv
Panoptic Feature Pyramid Networks1901.02446v2 · Alexander Kirillov, Ross Girshick, Kaiming He et al.2019 · 61 citationsarXiv
Exploring Randomly Wired Neural Networks for Image Recognition1904.01569v2 · Saining Xie, Alexander Kirillov, Ross Girshick et al.2019 · 382 citationsarXiv
Rethinking ImageNet Pre-training1811.08883v1 · Kaiming He, Ross Girshick, Piotr Doll'ar2018 · 98 citationsarXiv
Object Detection Networks on Convolutional Feature Maps.27541490 · Shaoqing Ren, Kaiming He, Girshick, Ross et al.2018 · 477 citationsIEEE transactions on pattern analysis and machine intelligence. 2017;39(7):1476-1481
Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks.27295650 · Ren, Shaoqing, He, Kaiming, Girshick, Ross et al.2018 · 56,059 citationsIEEE transactions on pattern analysis and machine intelligence. 2017;39(6):1137-1149
Object Instance Segmentation and Fine-Grained Localization Using Hypercolumns.27295654 · Hariharan, Bharath, Arbelaez, Pablo, Girshick, Ross et al.2018 · 105 citationsIEEE transactions on pattern analysis and machine intelligence. 2017;39(4):627-639
Exploring the Limits of Weakly Supervised Pretraining1805.00932v1 · Dhruv Mahajan, Ross Girshick, Vignesh Ramanathan et al.2018 · 1,267 citationsarXiv
Accurate, Large Minibatch SGD: Training ImageNet in 1 Hour1706.02677v2 · Priya Goyal, Piotr Doll'ar, Ross Girshick et al.2017 · 2,532 citationsarXiv
Non-local Neural Networks1711.07971v3 · Xiaolong Wang, Ross Girshick, Abhinav Gupta et al.2017 · 150 citationsarXiv
Low-Shot Learning from Imaginary Data1801.05401v2 · Yu-Xiong Wang, Ross Girshick, Martial Hebert et al.2018 · 829 citationsarXiv
Detecting and Recognizing Human-Object Interactions1704.07333v3 · Georgia Gkioxari, Ross Girshick, Piotr Doll'ar et al.2017 · 645 citationsarXiv
Learning to Segment Every Thing1711.10370v2 · Ronghang Hu, Piotr Doll'ar, Kaiming He et al.2017 · 328 citationsarXiv
Focal Loss for Dense Object Detection1708.02002v2 · Tsung-Yi Lin, Priya Goyal, Ross Girshick et al.2017 · 28,671 citationsarXiv
Mask R-CNN1703.06870v3 · Kaiming He, Georgia Gkioxari, Piotr Doll'ar et al.2017 · 423 citationsarXiv
Data Distillation: Towards Omni-Supervised Learning1712.04440v1 · Ilija Radosavovic, Piotr Doll'ar, Ross Girshick et al.2017 · 465 citationsarXiv
Learning by Asking Questions1712.01238v1 · Ishan Misra, Ross Girshick, Rob Fergus et al.2017 · 67 citationsarXiv
LSDA: Large Scale Detection Through Adaptation1407.5035v3 · Judy Hoffman, Sergio Guadarrama, Eric Tzeng et al.2014 · 193 citationsNeural Information Processing Systems (NIPS) 2014
Low-shot Visual Recognition by Shrinking and Hallucinating Features1606.02819v4 · Bharath Hariharan, Ross Girshick2016 · 860 citationsarXiv
Career total: 167 works. 83 are in this corpus.Showing the 50 most recent.
Profile built from the corpus for this byline.
Author records are still filling in while the Hub is in alpha. If this is your page, you'll be able to claim it soon. Spot a mistake? Tell us.