Moe

这条路线仍在建立,先从已经核验的节点进入。

01

DeepSeek-V2 发布

DeepSeek 发布 V2,采用 MLA(多头潜在注意力)+ DeepSeekMoE 稀疏架构,以远低于同行的价格开放 API。推理成本约为 Llama 3 的 1/100,直接引爆了中国大模型的价格战。

A行业级

试试搜索