Agent-aware rate limiting: per-agent quotas, model-specific limits, burst allowance, queue management, priority lanes an