Update vllm to version 0.9.2 with enhanced model and configuration
This commit is contained in:
@@ -1,8 +1,8 @@
|
||||
version: 0.5.4-7
|
||||
version: 0.9.2-1
|
||||
defaultConfig:
|
||||
namespace: llm
|
||||
model: Qwen/Qwen2.5-7B-Instruct
|
||||
maxModelLen: 8192
|
||||
model: Qwen/Qwen3-8B
|
||||
maxModelLen: 32768
|
||||
gpuMemoryUtilization: 0.9
|
||||
cpuRequest: '4'
|
||||
cpuLimit: '8'
|
||||
|
||||
Reference in New Issue
Block a user