Skip to content

feat(quantization): adapt W8A8 inference to vLLM 0.24 #962

feat(quantization): adapt W8A8 inference to vLLM 0.24

feat(quantization): adapt W8A8 inference to vLLM 0.24 #962