SkillAtlasAI 资讯
返回 AI 资讯
模型发布2026年9月17日 00:00

DeepSeek-V4.1-Flash 发布:552B MoE 多模态模型主打 KV cache 压缩

DeepSeek 发布 DeepSeek-V4.1-Flash,一个 552B 参数的多模态 MoE 模型,支持最长 100 万 token 上下文,模型权重已在 Hugging Face 开放。 via AIHOT ·

来源:AI HOT 精选
阅读原文

相关文章