Skip to content

Commit dff8f7c

Browse files
Adds support for AWQ to use quantization_layer_structure hooks (keras-team#2511)
1 parent c643c3c commit dff8f7c

4 files changed

Lines changed: 4 additions & 4 deletions

File tree

keras_hub/src/models/causal_lm.py

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -431,7 +431,7 @@ def _post_quantize(self, mode, **kwargs):
431431
self.generate_function = None
432432

433433
def get_quantization_layer_structure(self, mode):
434-
if mode != "gptq":
434+
if mode not in ["gptq", "awq"]:
435435
return None
436436

437437
backbone = self.backbone

keras_hub/src/models/gemma/gemma_causal_lm.py

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -433,7 +433,7 @@ def default_layer_intercept_fn(x, unused_i):
433433
return per_token_loss
434434

435435
def get_quantization_layer_structure(self, mode):
436-
if mode != "gptq":
436+
if mode not in ["gptq", "awq"]:
437437
return None
438438

439439
# Wrap embedding + scaling

keras_hub/src/models/gpt2/gpt2_causal_lm.py

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -422,7 +422,7 @@ def default_layer_intercept_fn(x, unused_i):
422422
return per_token_loss
423423

424424
def get_quantization_layer_structure(self, mode):
425-
if mode != "gptq":
425+
if mode not in ["gptq", "awq"]:
426426
return None
427427

428428
backbone = self.backbone

keras_hub/src/models/masked_lm.py

Lines changed: 1 addition & 1 deletion
Original file line numberDiff line numberDiff line change
@@ -86,7 +86,7 @@ def compile(
8686
)
8787

8888
def get_quantization_layer_structure(self, mode):
89-
if mode != "gptq":
89+
if mode not in ["gptq", "awq"]:
9090
return None
9191

9292
backbone = self.backbone

0 commit comments

Comments
 (0)