SGLang 真正解决的不是启动模型,而是把 LLM 推理服务跑稳SGLang 把 RadixAttention、结构化生成、批处理和投机解码放进同一套 serving 系统,适合认真运营 LLM 推理服务的团队。AI InfrastructureLLM InferenceSGLang2026.06.29·3 min