vLLM 自适应验证:让大模型推理在高并发下依然保持高效 vLLM 引入自适应验证机制,根据置信度动态调整验证预算,使投机解码在高并发场景下依然有效,减少调参需求。 vLLM Blog · 2026年8月14日