动察 Beating AI 快讯,DeepSeek 在 V4.1 Flash 开源公告里罕见地直接向大规模部署方喊话:如果有 2000 张 GPU 和存储集群,可以直接联系 DeepSeek。
但这并不是新的商业授权门槛。V4.1 Flash 仍按 MIT License 开源,没有按照公司营收或业务规模设置额外授权条件。有资源的企业可以自己部署,联系 DeepSeek 更像是针对超大规模场景的直接技术合作。DeepSeek 目前也没有宣布正式的私有化部署产品或收费服务。
过去 DeepSeek 开源模型后,部署适配更多由 SGLang、TensorRT-LLM 等推理框架和硬件厂商完成。这次官方主动留下大规模部署的直接联系方式,并表示会继续支持开源社区做新模型的推理适配,尝试进一步扩大部署范围。
DeepSeek 在 V4.1 Flash 开源公告里直接留下大规模部署联系方式,门槛划在 2000 张 GPU。这不改变 MIT 许可,但标志着官方从"放权重、社区自适配"转向主动介入超大规模部署环节。过去 V4 系列的适配由寒武纪、SGLang、vLLM 等外部完成,官方只给运行说明;V4-Pro 正式版和 0813 权重均沿用这一路径。
最值得注意的细节是 2000 张 GPU 这个数字本身。V4.1 Flash 总参数 552B,输入侧只激活 8B,官方称推理成本被压下来——对多数企业,这个规模意味着单集群即可承载,而非必须求助官方。真正需要对接的,是能把 552B 塞进生产环境、同时有存储集群配套的少数玩家。
这与 8 月 V4-Pro 搭配 Harness 的 Agent 产品线形成呼应:模型层开源铺量,应用层开始收口。