开放模型

从「Hugging Face Transformers 库成型」到「腾讯混元发布并开源 Hy4 preview」,先抓住起点、路线转向与当前边界,再展开完整事件线。

01

腾讯混元发布并开源 Hy4 preview

腾讯混元发布并开源 Hy4 preview:770B 总参、49B 激活的 MoE,上下文突破 1M,Apache 2.0 协议;定位「为生产力而生」,聚焦软件工程、办公分析、游戏开发与科学研究,在 WorkBuddy/CodeBuddy、元宝、ima 等产品同步首发,并首次参与自身研发全链路形成「初步的递归自我改进闭环」。

A行业级
02

智谱开源 GLM-5.3-Flash(Ox Alpha)

智谱「认领」此前以匿名身份 Ox Alpha(中文社区称「牛来」)上线的模型为 GLM-5.3-Flash:320B-A18B,GLM-5 系列首个原生多模态模型,以 MIT 协议开源;其训练使用数十万亿词元、由约 10 万张国产芯片支撑,匿名盲测期间曾登顶 OpenRouter 并终结 DeepSeek 连续 56 天霸榜。

A行业级
03

阿里发布并开源 Qwen3.8-Flash

阿里发布并开源 Qwen3.8-Flash:总参 125B、单 token 激活 6B 的多模态 MoE,采用全新「Next」架构(QSA 稀疏注意力 + Gated DeltaNet 混合注意力),训练成本较 Qwen3.7-Plus 下降约 90%,推理定价每百万输入 1 元、输出 3 元;被视为 Qwen4 的雏形,首发上线「千问办公」。

A行业级
04

智谱发布 GLM-5.3

智谱发布 GLM-5.3:基座与 GLM-5.2 相同,通过极致的后训练 Scaling(强化学习)大幅提升智能上界,编程能力较前代提升约 50%,主打智能体编程与防御性网络安全;官方承诺安全评估完成后两周内开源权重。

A行业级
05

DeepSeek-V4 Pro 正式版发布

DeepSeek 将 V4 Pro 更新为 0813 正式版:1.6T 总参 MoE、1M 上下文、最大输出 38.4 万 token,首次原生支持图像推理;DeepSWE 从预览版 12.8 升至 62.7,超过 Claude Opus 4.8,部分智能体基准逼近甚至反超 Claude Fable 5。同日发布开源 Agent 开发框架 DeepSeek Harness v0.1。

A行业级
06

Meta 发布并开源 Muse Glimmer

Meta 超级智能实验室发布 Muse Glimmer:约 30B 参数的稠密多模态智能体模型,由闭源基座 Muse Spark 逻辑蒸馏而来,Apache 2.0 开源,可在 24GB 显存消费级 GPU 或 M4/M5 Max MacBook 上完全本地运行;扎克伯格同日发文宣布 Meta 重返开源。

B领域级
07

阿里发布 Qwen3.8 与 Qwen3.8-Max

阿里云发布 Qwen3.8 与 Qwen3.8-Max:总参数 2.4T、每 token 激活约 950B 的稀疏 MoE 架构,原生多模态视觉与 1M 上下文,CodeArena 全球第四;官方宣布下周开源 Max 权重与 Qwen3.8-27B,并同步推出 Agent 产品「千问办公」。

A行业级
08

DeepSeek-V4-Flash 正式版发布

DeepSeek 发布 V4-Flash 正式版(V4-Flash-0731),取代预览版:思考/非思考双模式、1M 上下文、Agent 能力增强与推测解码;8 月 6 日公告整体上调 API 定价,市场解读为低价策略转折与 V4-Pro 正式版信号。

A行业级
09

Kimi K3 发布并开源

月之暗面发布 Kimi K3,总参数 2.8 万亿、每 token 激活约 1040 亿的 MoE 架构模型,原生支持视觉与百万级上下文;7 月 27 日权重开放,成为当时全球参数最大的开源模型,并在 WebDev Arena 上首次由开源模型登顶。

A行业级
10

DeepSeek-V4 预览版发布

DeepSeek 开源 V4 Pro 与 Flash 预览版,把 1M 上下文、思考模式和 Agent 编程能力放进同一家族,并继续强调稀疏架构的成本效率。

B领域级
11

DeepSeek 发布 V3.2

DeepSeek 在 2025 年底发布 V3.2,采用更激进的稀疏注意力与 MoE 架构,在保持能力的同时把推理成本进一步压低,继续推动开源模型的效率革命。

B领域级
12

DeepSeek 发布 V3.1

DeepSeek 发布 V3.1,把上下文窗口大幅扩展并强化工具调用能力,延续「高性价比开源旗舰」路线。它巩固了 DeepSeek 在中国开源模型中的领先位置。

B领域级
13

月之暗面开源 Kimi K2

月之暗面发布 Kimi K2,约 1T 总参数、32B 激活的开放 MoE,编码与 Agent 基准表现突出,把 Kimi 从长上下文聊天产品扩展为全球可下载的旗舰权重。

A行业级
14

阿里发布 Qwen3 系列

阿里发布 Qwen3 系列,从 0.6B 到旗舰 235B(MoE)全面开源,原生支持思考/非思考双模式。Qwen3-235B 在多项评测中成为最强开源模型之一,改写开源与闭源的实力版图。

A行业级
15

Llama 4 发布

Meta 发布 Llama 4 Scout 与 Maverick,采用混合专家架构并原生支持多模态,把开放权重模型推向超长上下文和更高计算效率。

B领域级
16

DeepSeek-R1 发布

DeepSeek 发布开放推理模型 DeepSeek-R1,以强化学习驱动的推理能力和开放权重迅速引发全球关注。

A行业级
17

DeepSeek-V3 发布

DeepSeek 发布 DeepSeek-V3,以开放权重和显著的训练效率引发行业关注,并让前沿模型的成本结构成为公开讨论的焦点。

B领域级
18

腾讯开源混元视频模型

腾讯开源 HunyuanVideo 等视频生成基础模型,以较大参数规模进入开源视频权重第一梯队,并在 Hugging Face 等平台获得高下载量。

A行业级
19

Black Forest Labs 发布 FLUX.1

Black Forest Labs 发布 FLUX.1 家族(pro / dev / schnell),在提示遵循与细节上显著抬升开放与 API 文生图上限,并迅速成为社区默认高质量选项之一。

A行业级
20

Meta 发布 Llama 3.1 405B

Meta 发布 Llama 3.1,其中 405B 版本在多项基准上逼近 GPT-4o,是首个与闭源旗舰同场竞技的开源模型。扎克伯格同时发表长文,公开为开源 AI 辩护。

A行业级
21

阿里开源 Qwen2 系列

阿里通义千问团队发布 Qwen2 系列开源模型,覆盖 0.5B 到 72B 多个尺寸,7B/72B 在多项基准上领先同量级开源模型。它把开源生态从「单点模型」推向「全尺寸系列」。

A行业级
22

昆仑万维推进天工 / Skywork 大模型

昆仑万维以天工产品与 Skywork 模型系列推进搜索增强对话、多模态与后续开放权重,成为中国互联网第二梯队中坚持全栈模型品牌的代表之一。

B领域级
23

Meta 发布 Llama 3

Meta 发布 Llama 3 家族(8B 与 70B),性能大幅提升并随后推出 405B 旗舰。它让开源模型的水平首次逼近闭源前沿模型,也把「开源与闭源之争」推向全球大模型竞争的中心。

A行业级
24

Stability AI 发布 Stable Diffusion 3

Stability AI 发布 Stable Diffusion 3,采用新的多模态扩散变压器架构,在文字渲染与多主体遵循上显著进步。开源图像生成迎来架构换代。

B领域级
25

Google 开源 Gemma

Google 发布开源模型 Gemma,提供 2B 与 7B 两种规模。这是谷歌首次向社区开放自家大模型权重,标志着开源与闭源双线作战成为巨头标配。

B领域级
26

面壁开源 MiniCPM 端侧模型

面壁智能与 OpenBMB 开源 MiniCPM 系列,以小参数中文友好基座强调端侧可部署;随后 MiniCPM-V 把多模态也压进边缘设备叙事。

B领域级
27

智谱发布 GLM-4

智谱发布 GLM-4,性能对标同期 GPT-4,同时延续开源策略。GLM 系列成为国产大模型中「学术出身、开源与商业并进」路线的代表。

B领域级
28

Mistral 发布 Mixtral 8x7B 混合专家模型

Mistral AI 以 Apache 2.0 发布 Mixtral 8x7B 稀疏混合专家模型:每层 8 组专家、每 token 路由 2 个,总参数约 46.7B、每 token 约 12.9B 激活。厂商报告在多数基准上超过 Llama 2 70B、推理更快,并匹配或超过 GPT-3.5;这些比较由发布方给出。

A行业级
29

零一万物发布 Yi 系列

零一万物由李开复创立,发布 Yi 系列大模型,其中 Yi-34B 以较强的中英文综合能力进入开源模型第一梯队,成为「大模型六小龙」中的代表。

B领域级
30

Mistral 7B 以小模型进入开放生态

Mistral AI 以 Apache 2.0 许可证发布 Mistral 7B 权重。模型采用分组查询注意力和 4096 token 滑动窗口;发布方报告它在多项基准上超过 Llama 2 13B,但这属于厂商基准比较。

B领域级
31

通义千问开放 Qwen 权重

阿里云发布 Qwen-7B 与 Qwen-7B-Chat 的代码和权重;基础模型以超过 2.2 万亿 token 预训练,覆盖中文、英文、代码和多语言文本。许可允许研究使用,月活用户低于一亿的商业主体可直接使用,更大规模须另行申请。

B领域级
32

Continue 开源 IDE 编程助手

Continue 以开源 VS Code / JetBrains 扩展提供聊天、补全与代码库上下文,强调开发者自带模型与可定制工作流,成为商业 AI IDE 之外的开放对照。

B领域级
33

Meta 发布 Llama 2 开放权重

Meta 发布 Llama 2 预训练与对话微调权重,参数规模 7B、13B、70B,并宣布研究与商业用途免费可用。许可为 Llama 2 社区许可(含可接受使用政策与月活门槛等附加条款),不是无限制的 OSI 开源软件许可;微软为优先云合作方。

A行业级
34

上海 AI 实验室开源 InternLM

上海人工智能实验室发布并开源书生 InternLM 系列大模型,这是中国科研机构主导的国产开源大模型代表,后续迭代出 InternLM2、InternLM3 等版本,并配套开源工具链。

B领域级
35

vLLM 与 PagedAttention 重塑 LLM 服务吞吐

UC Berkeley 等研究者开源 vLLM,并以 PagedAttention 把 KV 缓存拆成可非连续映射的页,降低显存碎片与预留浪费,显著提高大模型服务吞吐。

A行业级
36

百川智能发布 Baichuan 开源大模型

王小川创立的百川智能发布 Baichuan-7B,首个版本即开源,随后推出 Baichuan-13B 与 53B。公司以「开源+商业双轨」切入,成为国产开源大模型的重要参与者。

B领域级
37

智谱开源 ChatGLM

智谱 AI 发布并开源 ChatGLM 系列,其中包括中文场景优化的对话模型,成为国产开源大模型的重要代表,随后迭代出 ChatGLM2、ChatGLM3 与 GLM-4。

B领域级
38

Aider 把 Git 结对写进终端

开源工具 Aider 在终端中对接多厂商 LLM,按聊天指令直接修改本地 Git 仓库并生成可审查 diff,成为 Agent Coding 兴起前最重要的开源结对路径之一。

B领域级
39

AutoGPT 引爆自主智能体实验

开源项目 AutoGPT 发布,展示让 GPT-4 自主拆分目标、调用工具并迭代执行的思路。它虽不成熟,却让「AI 智能体」成为生成式 AI 最热门的叙事之一。

B领域级
40

斯坦福 Alpaca 低成本复刻

斯坦福团队用 52K 条由 GPT-3.5 生成的指令数据微调 LLaMA-7B,训练成本仅约 600 美元,得到行为接近 GPT-3.5 的 Alpaca。它引爆了「低成本复刻闭源模型」的浪潮。

A行业级
41

Meta 发布 LLaMA

Meta 发布 7B、13B、33B 和 65B 参数的 LLaMA 论文,并向获批研究者提供非商业许可权重;其中 65B 模型用 1.4 万亿 token 训练。权重随后外泄,社区迅速开发量化、微调和本地推理工具。

A行业级
42

Stable Diffusion 开放文生图权重

Stability AI 与 CompVis 发布 Stable Diffusion 1.4 的代码和约 4GB 权重。模型在压缩潜空间中去噪,能在消费级 GPU 上生成 512×512 图像,也让本地微调和第三方界面迅速扩散。

S范式级
43

EleutherAI 开源 GPT-Neo

EleutherAI 发布 GPT-Neo 1.3B 与 2.7B,证明没有科技巨头预算的独立社区也能训练出可用的语言大模型,为开源 AI 的后续繁荣埋下伏笔。

B领域级
44

Hugging Face Transformers 库成型

Hugging Face 推出并扩展 Transformers 库,把 BERT 等预训练模型的加载、分词与微调收成统一 API,降低复现与迁移成本。

A行业级
谱系

相关模型谱系

Qwen(通义千问)模型谱系Qwen3.8-Flash / Qwen3.8-Max 百川模型谱系Baichuan4 系列 Flux 模型谱系Flux 1.1 / Pro DeepSeek 模型谱系DeepSeek-V4-Pro(0813 正式版)· V4-Flash(正式版) Gemini 模型谱系Gemini 3.7 Flash Gemma 模型谱系Gemma 3 IBM Granite 谱系Granite 3.x 书生·浦语 InternLM 模型谱系InternLM3 Llama 模型谱系Llama 4 Scout / Maverick Mistral 模型谱系Mistral Large / 开放权重家族 面壁 MiniCPM 谱系MiniCPM 最新代 Kimi 模型谱系Kimi K3 NVIDIA Nemotron / Cosmos 谱系Nemotron / Cosmos Stable Diffusion 谱系Stable Diffusion 3 / 后续 Yi 模型谱系Yi-Lightning 智谱 GLM 模型谱系GLM-5.3 / GLM-5.3-Flash
机构

相关机构

阿里巴巴 / Alibaba通过通义千问(Qwen)家族把中文与多语言开放模型做成持续迭代的云与开发者生态。 百川智能 / Baichuan王小川创立,以快速开源 Baichuan/Baichuan2 与后续 Baichuan4 企业 API 进入中文大模型第一梯队。 Black Forest LabsStable Diffusion 核心作者团队创立,以 Flux 系列重新定义开放与 API 文生图质量。 DeepSeek(深度求索)以高效训练和开源策略著称的中国大模型公司,以低成本实现前沿性能。 Google以 Gemini 与 Gemma 覆盖闭源旗舰与开放轻量,并把模型嵌入搜索与云。 Hugging Face开源模型与数据集协作平台,Transformers 库定义了现代 LLM 工程默认接口。 IBM从 Deep Blue、Watson 到 Granite 开放企业模型,服务受监管行业。 上海人工智能实验室 / Shanghai AI Lab以书生·浦语(InternLM)开放模型服务科研与产业,强调可复现训练与中文能力。 Meta以 Llama 开放权重推动全球开源生态,覆盖研究、企业与端侧。 Mistral AI欧洲开源与高效模型代表,从 7B、Mixtral 到 Codestral 与 Large 旗舰。 面壁智能 / ModelBest以 MiniCPM 端侧与 CP 系列开放模型强调小而强与设备侧部署。 月之暗面 / Moonshot AI以超长上下文与 Kimi 产品闻名的中国大模型公司,后以 K2 开放 MoE 进入全球编码与 Agent 竞争。 NVIDIA以 CUDA 与 GPU 成为现代深度学习默认算力层,并发布 Nemotron、Cosmos 等模型。 Stability AI以 Stable Diffusion 开放文生图权重点燃本地生成生态,并延伸到视频与 3D。 零一万物 / 01.AI李开复创立的大模型公司,以 Yi 开放权重系列与 Yi-Lightning 高性价比 MoE 进入全球榜单。 智谱 AI / Zhipu以 GLM 架构与 ChatGLM 开源生态起家,提供基座模型、多模态与 Agent 产品的国产大模型公司。

试试搜索