fix quantization error

This commit is contained in:
sirius0xdev 2026-04-21 02:39:30 +00:00
parent 956ae90794
commit d78090b69c

View file

@ -33,7 +33,7 @@ spec:
value: DEBUG value: DEBUG
args: args:
- --model=tvall43/Qwen3.6-35B-A3B-heretic - --model=tvall43/Qwen3.6-35B-A3B-heretic
- --quantization=awq
- --host=0.0.0.0 - --host=0.0.0.0
- --port=8000 - --port=8000
- --tensor-parallel-size=1 - --tensor-parallel-size=1