diff --git a/models/alibaba/deepseek-v4.1-flash.yaml b/models/alibaba/deepseek-v4.1-flash.yaml new file mode 100644 index 00000000..9f93bbc5 --- /dev/null +++ b/models/alibaba/deepseek-v4.1-flash.yaml @@ -0,0 +1,55 @@ +# yaml-language-server: $schema=https://modelparams.dev/api/v1/schema.json +provider: alibaba +authType: api_key +apiSurface: openai-chat-completions +model: deepseek-v4.1-flash +params: + - path: max_completion_tokens + type: integer + label: Max tokens + description: Maximum number of tokens to generate, including both reasoning and the final answer. + range: + min: 1 + group: generation_length + - path: temperature + type: number + label: Temperature + description: Controls randomness. Lower values make outputs more focused; higher values make them more varied. + range: + min: 0 + max: 1.9 + step: 0.1 + group: sampling + - path: top_p + type: number + label: Top P + description: Controls nucleus sampling by limiting generation to tokens within the selected cumulative probability. + range: + min: 0 + max: 1 + step: 0.01 + group: sampling + - path: extra_body.top_k + type: integer + label: Top K + description: Limits generation to the selected number of highest-probability tokens. Values above 100 disable top-k sampling. + default: 20 + range: + min: 0 + group: sampling + - path: extra_body.enable_thinking + type: boolean + label: Enable thinking + description: Toggles the model's hybrid thinking mode, sent as a provider-specific extra body field on OpenAI-compatible clients. + default: true + group: reasoning + - path: extra_body.thinking_budget + type: integer + label: Thinking budget + description: Maximum number of tokens the model may spend on reasoning before it starts the final answer; defaults to the model's maximum reasoning length. + range: + min: 1 + group: reasoning + applicability: + only: + extra_body.enable_thinking: true diff --git a/packages/modelparams-python/src/modelparams/_generated/catalog.json b/packages/modelparams-python/src/modelparams/_generated/catalog.json index 06f0ef42..187e2de4 100644 --- a/packages/modelparams-python/src/modelparams/_generated/catalog.json +++ b/packages/modelparams-python/src/modelparams/_generated/catalog.json @@ -379,6 +379,82 @@ } ] }, + { + "provider": "alibaba", + "authType": "api_key", + "apiSurface": "openai-chat-completions", + "model": "deepseek-v4.1-flash", + "params": [ + { + "path": "max_completion_tokens", + "label": "Max tokens", + "description": "Maximum number of tokens to generate, including both reasoning and the final answer.", + "group": "generation_length", + "type": "integer", + "range": { + "min": 1 + } + }, + { + "path": "temperature", + "label": "Temperature", + "description": "Controls randomness. Lower values make outputs more focused; higher values make them more varied.", + "group": "sampling", + "type": "number", + "range": { + "min": 0, + "max": 1.9, + "step": 0.1 + } + }, + { + "path": "top_p", + "label": "Top P", + "description": "Controls nucleus sampling by limiting generation to tokens within the selected cumulative probability.", + "group": "sampling", + "type": "number", + "range": { + "min": 0, + "max": 1, + "step": 0.01 + } + }, + { + "path": "extra_body.top_k", + "label": "Top K", + "description": "Limits generation to the selected number of highest-probability tokens. Values above 100 disable top-k sampling.", + "group": "sampling", + "type": "integer", + "default": 20, + "range": { + "min": 0 + } + }, + { + "path": "extra_body.enable_thinking", + "label": "Enable thinking", + "description": "Toggles the model's hybrid thinking mode, sent as a provider-specific extra body field on OpenAI-compatible clients.", + "group": "reasoning", + "type": "boolean", + "default": true + }, + { + "path": "extra_body.thinking_budget", + "label": "Thinking budget", + "description": "Maximum number of tokens the model may spend on reasoning before it starts the final answer; defaults to the model's maximum reasoning length.", + "group": "reasoning", + "applicability": { + "only": { + "extra_body.enable_thinking": true + } + }, + "type": "integer", + "range": { + "min": 1 + } + } + ] + }, { "provider": "alibaba", "authType": "api_key", diff --git a/packages/modelparams-python/src/modelparams/_generated/model_ids.py b/packages/modelparams-python/src/modelparams/_generated/model_ids.py index c7c23c4d..2feab6ff 100644 --- a/packages/modelparams-python/src/modelparams/_generated/model_ids.py +++ b/packages/modelparams-python/src/modelparams/_generated/model_ids.py @@ -9,6 +9,7 @@ "alibaba/deepseek-v4-flash-0731", "alibaba/deepseek-v4-pro", "alibaba/deepseek-v4-pro-0813", + "alibaba/deepseek-v4.1-flash", "alibaba/glm-5.1", "alibaba/glm-5.2", "alibaba/kimi-k2.7-code", @@ -425,6 +426,7 @@ "alibaba/deepseek-v4-flash-0731", "alibaba/deepseek-v4-pro", "alibaba/deepseek-v4-pro-0813", + "alibaba/deepseek-v4.1-flash", "alibaba/glm-5.1", "alibaba/glm-5.2", "alibaba/kimi-k2.7-code", diff --git a/packages/modelparams-python/src/modelparams/_generated/registry.py b/packages/modelparams-python/src/modelparams/_generated/registry.py index ab0a6102..a28a37e7 100644 --- a/packages/modelparams-python/src/modelparams/_generated/registry.py +++ b/packages/modelparams-python/src/modelparams/_generated/registry.py @@ -34,6 +34,7 @@ "alibaba/deepseek-v4-flash-0731": alibaba.Deepseek_V4_Flash_0731Params, "alibaba/deepseek-v4-pro": alibaba.Deepseek_V4_ProParams, "alibaba/deepseek-v4-pro-0813": alibaba.Deepseek_V4_Pro_0813Params, + "alibaba/deepseek-v4.1-flash": alibaba.Deepseek_V4_1_FlashParams, "alibaba/glm-5.1": alibaba.Glm_5_1Params, "alibaba/glm-5.2": alibaba.Glm_5_2Params, "alibaba/kimi-k2.7-code": alibaba.Kimi_K2_7_CodeParams, diff --git a/packages/modelparams-python/src/modelparams/types/alibaba.py b/packages/modelparams-python/src/modelparams/types/alibaba.py index fb728b79..2359a1c8 100644 --- a/packages/modelparams-python/src/modelparams/types/alibaba.py +++ b/packages/modelparams-python/src/modelparams/types/alibaba.py @@ -80,6 +80,20 @@ ) setattr(Deepseek_V4_Pro_0813Params, "__pydantic_config__", _PARAMS_CONFIG) +Deepseek_V4_1_FlashParams = TypedDict( + "Deepseek_V4_1_FlashParams", + { + "max_completion_tokens": Annotated[int, Field(ge=1)], + "temperature": Annotated[float, Field(ge=0, le=1.9)], + "top_p": Annotated[float, Field(ge=0, le=1)], + "extra_body.top_k": Annotated[int, Field(ge=0)], + "extra_body.enable_thinking": bool, + "extra_body.thinking_budget": Annotated[int, Field(ge=1)], + }, + total=False, +) +setattr(Deepseek_V4_1_FlashParams, "__pydantic_config__", _PARAMS_CONFIG) + Glm_5_1Params = TypedDict( "Glm_5_1Params", { @@ -606,6 +620,7 @@ "Deepseek_V4_Flash_0731Params", "Deepseek_V4_ProParams", "Deepseek_V4_Pro_0813Params", + "Deepseek_V4_1_FlashParams", "Glm_5_1Params", "Glm_5_2Params", "Kimi_K2_7_CodeParams", diff --git a/packages/modelparams/src/generated/data.ts b/packages/modelparams/src/generated/data.ts index 2c6df607..7e2b21eb 100644 --- a/packages/modelparams/src/generated/data.ts +++ b/packages/modelparams/src/generated/data.ts @@ -384,6 +384,82 @@ const GENERATED_CATALOG = [ } ] }, + { + "provider": "alibaba", + "authType": "api_key", + "apiSurface": "openai-chat-completions", + "model": "deepseek-v4.1-flash", + "params": [ + { + "path": "max_completion_tokens", + "label": "Max tokens", + "description": "Maximum number of tokens to generate, including both reasoning and the final answer.", + "group": "generation_length", + "type": "integer", + "range": { + "min": 1 + } + }, + { + "path": "temperature", + "label": "Temperature", + "description": "Controls randomness. Lower values make outputs more focused; higher values make them more varied.", + "group": "sampling", + "type": "number", + "range": { + "min": 0, + "max": 1.9, + "step": 0.1 + } + }, + { + "path": "top_p", + "label": "Top P", + "description": "Controls nucleus sampling by limiting generation to tokens within the selected cumulative probability.", + "group": "sampling", + "type": "number", + "range": { + "min": 0, + "max": 1, + "step": 0.01 + } + }, + { + "path": "extra_body.top_k", + "label": "Top K", + "description": "Limits generation to the selected number of highest-probability tokens. Values above 100 disable top-k sampling.", + "group": "sampling", + "type": "integer", + "default": 20, + "range": { + "min": 0 + } + }, + { + "path": "extra_body.enable_thinking", + "label": "Enable thinking", + "description": "Toggles the model's hybrid thinking mode, sent as a provider-specific extra body field on OpenAI-compatible clients.", + "group": "reasoning", + "type": "boolean", + "default": true + }, + { + "path": "extra_body.thinking_budget", + "label": "Thinking budget", + "description": "Maximum number of tokens the model may spend on reasoning before it starts the final answer; defaults to the model's maximum reasoning length.", + "group": "reasoning", + "applicability": { + "only": { + "extra_body.enable_thinking": true + } + }, + "type": "integer", + "range": { + "min": 1 + } + } + ] + }, { "provider": "alibaba", "authType": "api_key", diff --git a/packages/modelparams/src/generated/defaults.ts b/packages/modelparams/src/generated/defaults.ts index 6ea10c74..06302061 100644 --- a/packages/modelparams/src/generated/defaults.ts +++ b/packages/modelparams/src/generated/defaults.ts @@ -25,6 +25,10 @@ export const DEFAULTS = { "extra_body.top_k": 20, "extra_body.enable_thinking": true, }, + "alibaba/deepseek-v4.1-flash": { + "extra_body.top_k": 20, + "extra_body.enable_thinking": true, + }, "alibaba/glm-5.1": { "extra_body.top_k": 20, "extra_body.enable_thinking": true, diff --git a/packages/modelparams/src/generated/model-ids.ts b/packages/modelparams/src/generated/model-ids.ts index 52ba634d..991870c4 100644 --- a/packages/modelparams/src/generated/model-ids.ts +++ b/packages/modelparams/src/generated/model-ids.ts @@ -7,6 +7,7 @@ export const MODEL_IDS = [ "alibaba/deepseek-v4-flash-0731", "alibaba/deepseek-v4-pro", "alibaba/deepseek-v4-pro-0813", + "alibaba/deepseek-v4.1-flash", "alibaba/glm-5.1", "alibaba/glm-5.2", "alibaba/kimi-k2.7-code", diff --git a/packages/modelparams/src/generated/params-by-id.ts b/packages/modelparams/src/generated/params-by-id.ts index 87fc3e70..030c78c9 100644 --- a/packages/modelparams/src/generated/params-by-id.ts +++ b/packages/modelparams/src/generated/params-by-id.ts @@ -47,6 +47,14 @@ export type ParamsById = { "extra_body.enable_thinking": boolean; "extra_body.thinking_budget": number; }; + "alibaba/deepseek-v4.1-flash": { + max_completion_tokens: number; + temperature: number; + top_p: number; + "extra_body.top_k": number; + "extra_body.enable_thinking": boolean; + "extra_body.thinking_budget": number; + }; "alibaba/glm-5.1": { max_completion_tokens: number; temperature: number;