Scholar
Krishna Teja Chitty-Venkata
Google Scholar ID: 96UrOW4AAAAJ
ML Research Engineer @ Red Hat
Large Language Models
Quantization
Neural Architecture Search
Pruning
Follow
Homepage
↗
Google Scholar
↗
Citations & Impact
All-time
Citations
517
H-index
7
i10-index
7
Publications
20
Co-authors
21
list available
Contact
Email
krishnateja95@outlook.com
GitHub
Open ↗
LinkedIn
Open ↗
Publications
10 items
H-Spec: Parallel Speculative Decoding Without a Drafter-Side KV Cache
2026
Cited
0
Swimba: Switch Mamba Model Scales State Space Models
2026
Cited
0
ImageNet-Think-250K: A Large-Scale Synthetic Dataset for Multimodal Reasoning for Vision Language Models
2025
Cited
0
PreLoRA: Hybrid Pre-training of Vision Transformers with Full Training and Low-Rank Adapters
2025
Cited
0
PagedEviction: Structured Block-wise KV Cache Pruning for Efficient Large Language Model Inference
2025
Cited
0
MoPEQ: Mixture of Mixed Precision Quantized Experts
2025
Cited
0
LExI: Layer-Adaptive Active Experts for Efficient MoE Model Inference
2025
Cited
0
MoE-Inference-Bench: Performance Evaluation of Mixture of Expert Large Language and Vision Models
2025
Cited
0
Load more
Co-authors
14 total
Murali Krishna Emani
Computer Scientist at Argonne National Laboratory
Venkatram Vishwanath
Computer Scientist, Argonne National Laboratory
Sparsh Mittal
Associate Professor at ECE and Mehta Family School of DS&AI, IIT Roorkee
Siddhisanket Raskar
Pacific Northwest National Laboratory
Ken Raffenetti
Argonne National Laboratory
Valerie Taylor
Argonne National Laboratory
Sanjif Shanmugavelu
Groq
Bogdan Nicolae
Argonne National Laboratory