JG

Joseph E. Gonzalez

cs.LGcs.AIcs.CVcs.DCcs.CLstat.MLcs.ROcs.DBcs.SEcs.NE

On Valency

published · living versions
W_twun7uez·v1 · currentpublished
The Missing Piece in Complex Analytics: Low Latency, Scalable Model Management and Serving with Velox
with Daniel Crankshaw, Peter Bailis, Haoyuan Li, Zhao Zhang +3
1 version

Preprints & journals

220 papers in the corpus · 2010–2026
Investigating the behavior of diffusion models for accelerating electronic structure calculations.39183908 · Rothchild, Daniel, Rosen, Andrew S, Taw, Eric et al.2026 · 1 citationChemical science. 2024;15(33):13506-13522
ParaStudent: Closing the Sim2Real Gap in User Simulators for AI Tutor Evaluation2507.12674v3 · Rose Niousha, Mihran Miroyan, Abigail O'Neill et al.2025 · 0 citationsarXiv
CoVA-SFT: A Large-Scale Dataset for Chain of Visual Abstractions2608.28958v1 · Tsung-Han Wu, Heekyung Lee, Anya Ji et al.2026 · 0 citationsarXiv
Fantastic Adaptive Taxonomies and How to Use Them2607.16387v2 · Mert Cemri, Andrei Cojocaru, Melissa Pan et al.2026 · 0 citationsarXiv
PIXELRAG: Web Screenshots Beat Text for Retrieval-Augmented Generation2606.28344v1 · Yichuan Wang, Zhifei Li, Zirui Wang et al.2026 · 0 citationsarXiv
Continual Learning Bench: Evaluating Frontier AI Systems in Real-World Stateful Environments2606.05661v1 · Parth Asawa, Christopher M. Glaze, Gabriel Orlanski et al.2026 · 0 citationsarXiv
Stateful Visual Encoders for Vision-Language Models2606.04433v1 · Zirui Wang, Junwei Yu, Adam Yala et al.2026 · 0 citationsarXiv
Are Large Reasoning Models Interruptible?2510.11713v4 · Tsung-Han Wu, Mihran Miroyan, David M. Chan et al.2025 · 0 citationsarXiv
vAttention: Verified Sparse Attention2510.05688v2 · Aditya Desai, Kumar Krishna Agrawal, Shuo Yang et al.2025 · 0 citationsProceedings of the International Conference on Learning Representations (ICLR), 2026
Inference Time Context Sparsity: Illusion or Opportunity?2605.24168v1 · Sahil Joshi, Prithvi Dixit, Agniva Chowdhury et al.2026 · 0 citationsarXiv
optimize_anything: A Universal API for Optimizing any Text Parameter2605.19633v1 · Lakshya A Agrawal, Donghyun Lee, Shangyin Tan et al.2026 · 1 citationProceedings of the ACM Conference on AI and Agentic Systems (CAIS 26), May 26-29, 2026, San Jose, CA, USA
How to Train Your Advisor: Steering Black-Box LLMs with Advisor Models2510.02453v3 · Parth Asawa, Alan Zhu, Abigail O'Neill et al.2025 · 1 citationarXiv
Learning, Fast and Slow: Towards LLMs That Adapt Continually2605.12484v2 · Rishabh Tiwari, Kusha Sareen, Lakshya A Agrawal et al.2026 · 0 citationsarXiv
FrontierSmith: Synthesizing Open-Ended Coding Problems at Scale2605.14445v1 · Runyuan He, Qiuyang Mang, Shang Zhou et al.2026 · 0 citationsarXiv
Concurrency without Model Changes: Future-based Asynchronous Function Calling for LLMs2605.15077v1 · Guangyu Feng, Huanzhi Mao, Prabal Dutta et al.2026 · 0 citationsarXiv
Search Arena: Analyzing Search-Augmented LLMs2506.05334v2 · Mihran Miroyan, Tsung-Han Wu, Logan King et al.2025 · 1 citationarXiv
SageBwd: A Trainable Low-bit Attention2603.02170v1 · Jintao Zhang, Marco Chen, Haoxu Wang et al.2026 · 0 citationsarXiv
K-Search: LLM Kernel Generation via Co-Evolving Intrinsic World Model2602.19128v2 · Shiyi Cao, Ziming Mao, Joseph E. Gonzalez et al.2026 · 0 citationsarXiv
vCache: Verified Semantic Prompt Caching2502.03771v5 · Luis Gaspar Schroeder, Aditya Desai, Alejandro Cuadron et al.2025 · 0 citationsarXiv
SLA2: Sparse-Linear Attention with Learnable Routing and QAT2602.12675v1 · Jintao Zhang, Haoxu Wang, Kai Jiang et al.2026 · 0 citationsarXiv
TURBO: Utility-Aware Bandwidth Allocation for Cloud-Augmented Autonomous Control2503.20127v2 · Peter Schafhalter, Alexander Krentsel, Hongbo Wei et al.2025 · 15 citationsarXiv
VisGym: Diverse, Customizable, Scalable Environments for Multimodal Agents2601.16973v1 · Zirui Wang, Junyi Zhang, Jiaxin Ge et al.2026 · 0 citationsarXiv
TurboDiffusion: Accelerating Video Diffusion Models by 100-200 Times2512.16093v1 · Jintao Zhang, Kaiwen Zheng, Kai Jiang et al.2025 · 0 citationsarXiv
Supporting Our AI Overlords: Redesigning Data Systems to be Agent-First2509.00997v2 · Shu Liu, Soujanya Ponnapalli, Shreya Shankar et al.2025 · 2 citationsarXiv
LEANN: A Low-Storage Vector Index2506.08276v2 · Yichuan Wang, Zhifei Li, Shu Liu et al.2025 · 0 citationsarXiv
SkyRL-Agent: Efficient RL Training for Multi-turn LLM Agent2511.16108v1 · Shiyi Cao, Dacheng Li, Fangzhou Zhao et al.2025 · 0 citationsarXiv
Discovering Divergent Representations between Text-to-Image Models2509.08940v1 · Lisa Dunlap, Joseph E. Gonzalez, Trevor Darrell et al.2025 · 0 citationsarXiv
Towards Efficient and Practical GPU Multitasking in the Era of LLM2508.08448v1 · Jiarong Xing, Yifan Qiao, Simon Mo et al.2025 · 0 citationsarXiv
CLAIR-A: Leveraging Large Language Models to Judge Audio Captions2409.12962v2 · Tsung-Han Wu, Joseph E. Gonzalez, Trevor Darrell et al.2024 · 1 citationarXiv
HashAttention: Semantic Sparsity for Faster Inference2412.14468v2 · Aditya Desai, Shuo Yang, Alejandro Cuadron et al.2024 · 1 citationarXiv
BARE: Leveraging Base Language Models for Few-Shot Synthetic Data Generation2502.01697v3 · Alan Zhu, Parth Asawa, Jared Quincy Davis et al.2025 · 0 citationsarXiv
VibeCheck: Discover and Quantify Qualitative Differences in Large Language Models2410.12851v7 · Lisa Dunlap, Krishna Mandal, Trevor Darrell et al.2024 · 0 citationsarXiv
Sleep-time Compute: Beyond Inference Scaling at Test-time2504.13171v1 · Kevin Lin, Charlie Snell, Yu Wang et al.2025 · 0 citationsarXiv
Optimizing LLM Queries in Relational Data Analytics Workloads2403.05821v2 · Shu Liu, Asim Biswal, Amog Kamsetty et al.2024 · 6 citationsarXiv
VisionArena: 230K Real World User-VLM Conversations with Preference Labels2412.08687v3 · Christopher Chou, Lisa Dunlap, Koki Mashita et al.2024 · 2 citationsarXiv
Visual Haystacks: A Vision-Centric Needle-In-A-Haystack Benchmark2407.13766v4 · Tsung-Han Wu, Giscard Biamby, Jerome Quenum et al.2024 · 1 citationarXiv
SkyStore: Cost-Optimized Object Storage Across Regions and Clouds2502.20818v1 · Shu Liu, Xiangxi Mo, Moshik Hershcovitch et al.2025 · 3 citationsarXiv
RouteLLM: Learning to Route LLMs with Preference Data2406.18665v4 · Isaac Ong, Amjad Almahairi, Vincent Wu et al.2024 · 8 citationsarXiv
S*: Test Time Scaling for Code Generation2502.14382v1 · Dacheng Li, Shiyi Cao, Chengkun Cao et al.2025 · 4 citationsarXiv
Autellix: An Efficient Serving Engine for LLM Agents as General Programs2502.13965v1 · Michael Luo, Xiaoxiang Shi, Colin Cai et al.2025 · 1 citationarXiv
LLMs Can Easily Learn to Reason from Demonstrations Structure, not content, is what matters!2502.07374v2 · Dacheng Li, Shiyi Cao, Tyler Griggs et al.2025 · 0 citationsarXiv
The Danger of Overthinking: Examining the Reasoning-Action Dilemma in Agentic Tasks2502.08235v1 · Alejandro Cuadron, Dacheng Li, Wenjie Ma et al.2025 · 1 citationarXiv
Locality-aware Fair Scheduling in LLM Serving2501.14312v1 · Shiyi Cao, Yichuan Wang, Ziming Mao et al.2025 · 0 citationsarXiv
Specifications: The missing link to making the development of LLM systems an engineering discipline2412.05299v2 · Ion Stoica, Matei Zaharia, Joseph Gonzalez et al.2024 · 2 citationsarXiv
MoE-Lightning: High-Throughput MoE Inference on Memory-constrained GPUs2411.11217v1 · Shiyi Cao, Shu Liu, Tyler Griggs et al.2024 · 1 citationarXiv
Multiversion Hindsight Logging for Continuous Training2310.07898v4 · Rolando Garcia, Anusha Dandamudi, Gabriel Matute et al.2023 · 0 citationsarXiv
Career total: 360 works. 220 are in this corpus.Showing the 50 most recent.

Profile built from the corpus for this byline.

Author records are still filling in while the Hub is in alpha. If this is your page, you'll be able to claim it soon. Spot a mistake? Tell us.