diff --git a/clients/python/llmengine/data_types/vllm.py b/clients/python/llmengine/data_types/vllm.py index 0ea17f96..5d9aae9c 100644 --- a/clients/python/llmengine/data_types/vllm.py +++ b/clients/python/llmengine/data_types/vllm.py @@ -64,6 +64,11 @@ class VLLMModelConfig(BaseModel): description="Tool call parser", ) + reasoning_parser: Optional[str] = Field( + None, + description="Reasoning parser (e.g. 'qwen3', 'deepseek_r1'); splits model reasoning into reasoning_content in chat completions", + ) + enable_auto_tool_choice: Optional[bool] = Field( None, description="Enable auto tool choice", diff --git a/model-engine/model_engine_server/common/dtos/llms/vllm.py b/model-engine/model_engine_server/common/dtos/llms/vllm.py index 5a85dc30..0101e4d5 100644 --- a/model-engine/model_engine_server/common/dtos/llms/vllm.py +++ b/model-engine/model_engine_server/common/dtos/llms/vllm.py @@ -68,6 +68,11 @@ class VLLMModelConfig(BaseModel): description="Tool call parser", ) + reasoning_parser: Optional[str] = Field( + None, + description="Reasoning parser (e.g. 'qwen3', 'deepseek_r1'); splits model reasoning into reasoning_content in chat completions", + ) + enable_auto_tool_choice: Optional[bool] = Field( None, description="Enable auto tool choice",