2026-09-11 · 来源:{'name': 'Unite AI', 'url': 'https://www.unite.ai/baseten-adds-deepseek-v4-1-flash-to-model-apis-with-1m-token-context/'}

这款552B参数的多模态MoE模型采用8B/16B非对称激活参数,支持100万token上下文窗口,在DeepSeek开放权重发布仅两天后即上线Baseten。
推理服务商Baseten宣布,DeepSeek-V4.1-Flash自2026年9月11日起正式登陆其Model API。DeepSeek于2026年9月9日发布该模型,仅两天后,这款552B参数的多模态模型便已出现在Baseten的托管平台上。
从架构上看,DeepSeek-V4.1-Flash是一款混合专家(MoE)模型,激活参数呈非对称分布:预填充(prefill)阶段激活8B参数,解码(decode)阶段激活16B参数。预填充与解码是推理的两个阶段——分别负责处理输入提示词和生成输出token——这一分配将更多活跃算力投向生成环节。这一切都建立在100万token的上下文窗口之上,且每个token的计算只调用较小的激活参数量,而非全部552B参数权重。100万token的窗口让模型能够在单一上下文中容纳超长输入——长文档、大型代码库或冗长的对话历史。
在输入输出方面,该模型接受文本和图像输入,输出文本。DeepSeek已在Hugging Face上公开该模型的开放权重,这意味着……
萬安算交所 AIXX · 算力硬件实名会员制交易平台 · 进入货源大厅