Leaky Language Models: Stealing Architecture and Inference Optimizations via Per-Token Timing
Research demonstrates 'LeakyLMs' attacks can infer proprietary model architecture and inference optimizations from production LLMs via token timing analysis.