This commit is contained in:
2026-03-27 01:52:05 +08:00
parent 0507dea0bc
commit 2df305cad0
2 changed files with 4 additions and 1 deletions
+3
View File
@@ -7,6 +7,9 @@ ENV LOCAL_MODEL_DIR=/opt/model
# Create necessary directories
RUN mkdir -p /opt/script /opt/model /config
# Update transformers to support qwen3_5_moe architecture
RUN pip install --upgrade transformers
# Copy scripts to /opt/script
COPY scripts/start_vllm.py /opt/script/start-vllm
COPY benchmarks/run_vllm_bench.py /opt/script/run_vllm_bench.py
+1 -1
View File
@@ -1,5 +1,5 @@
{
"default_model": "Qwen3-Coder-30B-A3B-Instruct-GPTQ-4bit",
"default_model": "Qwen3.5-35B-A3B-GPTQ-Int4",
"models": {
"gpt-oss-20b": {
"ctx": "32768",