开放模型
从「Hugging Face Transformers 库成型」到「腾讯混元发布并开源 Hy4 preview」,先抓住起点、路线转向与当前边界,再展开完整事件线。
腾讯混元发布并开源 Hy4 preview
腾讯混元发布并开源 Hy4 preview:770B 总参、49B 激活的 MoE,上下文突破 1M,Apache 2.0 协议;定位「为生产力而生」,聚焦软件工程、办公分析、游戏开发与科学研究,在 WorkBuddy/CodeBuddy、元宝、ima 等产品同步首发,并首次参与自身研发全链路形成「初步的递归自我改进闭环」。
智谱开源 GLM-5.3-Flash(Ox Alpha)
智谱「认领」此前以匿名身份 Ox Alpha(中文社区称「牛来」)上线的模型为 GLM-5.3-Flash:320B-A18B,GLM-5 系列首个原生多模态模型,以 MIT 协议开源;其训练使用数十万亿词元、由约 10 万张国产芯片支撑,匿名盲测期间曾登顶 OpenRouter 并终结 DeepSeek 连续 56 天霸榜。
阿里发布并开源 Qwen3.8-Flash
阿里发布并开源 Qwen3.8-Flash:总参 125B、单 token 激活 6B 的多模态 MoE,采用全新「Next」架构(QSA 稀疏注意力 + Gated DeltaNet 混合注意力),训练成本较 Qwen3.7-Plus 下降约 90%,推理定价每百万输入 1 元、输出 3 元;被视为 Qwen4 的雏形,首发上线「千问办公」。
智谱发布 GLM-5.3
智谱发布 GLM-5.3:基座与 GLM-5.2 相同,通过极致的后训练 Scaling(强化学习)大幅提升智能上界,编程能力较前代提升约 50%,主打智能体编程与防御性网络安全;官方承诺安全评估完成后两周内开源权重。
DeepSeek-V4 Pro 正式版发布
DeepSeek 将 V4 Pro 更新为 0813 正式版:1.6T 总参 MoE、1M 上下文、最大输出 38.4 万 token,首次原生支持图像推理;DeepSWE 从预览版 12.8 升至 62.7,超过 Claude Opus 4.8,部分智能体基准逼近甚至反超 Claude Fable 5。同日发布开源 Agent 开发框架 DeepSeek Harness v0.1。
Meta 发布并开源 Muse Glimmer
Meta 超级智能实验室发布 Muse Glimmer:约 30B 参数的稠密多模态智能体模型,由闭源基座 Muse Spark 逻辑蒸馏而来,Apache 2.0 开源,可在 24GB 显存消费级 GPU 或 M4/M5 Max MacBook 上完全本地运行;扎克伯格同日发文宣布 Meta 重返开源。
阿里发布 Qwen3.8 与 Qwen3.8-Max
阿里云发布 Qwen3.8 与 Qwen3.8-Max:总参数 2.4T、每 token 激活约 950B 的稀疏 MoE 架构,原生多模态视觉与 1M 上下文,CodeArena 全球第四;官方宣布下周开源 Max 权重与 Qwen3.8-27B,并同步推出 Agent 产品「千问办公」。
DeepSeek-V4-Flash 正式版发布
DeepSeek 发布 V4-Flash 正式版(V4-Flash-0731),取代预览版:思考/非思考双模式、1M 上下文、Agent 能力增强与推测解码;8 月 6 日公告整体上调 API 定价,市场解读为低价策略转折与 V4-Pro 正式版信号。
Kimi K3 发布并开源
月之暗面发布 Kimi K3,总参数 2.8 万亿、每 token 激活约 1040 亿的 MoE 架构模型,原生支持视觉与百万级上下文;7 月 27 日权重开放,成为当时全球参数最大的开源模型,并在 WebDev Arena 上首次由开源模型登顶。
DeepSeek-V4 预览版发布
DeepSeek 开源 V4 Pro 与 Flash 预览版,把 1M 上下文、思考模式和 Agent 编程能力放进同一家族,并继续强调稀疏架构的成本效率。
DeepSeek 发布 V3.2
DeepSeek 在 2025 年底发布 V3.2,采用更激进的稀疏注意力与 MoE 架构,在保持能力的同时把推理成本进一步压低,继续推动开源模型的效率革命。
DeepSeek 发布 V3.1
DeepSeek 发布 V3.1,把上下文窗口大幅扩展并强化工具调用能力,延续「高性价比开源旗舰」路线。它巩固了 DeepSeek 在中国开源模型中的领先位置。
月之暗面开源 Kimi K2
月之暗面发布 Kimi K2,约 1T 总参数、32B 激活的开放 MoE,编码与 Agent 基准表现突出,把 Kimi 从长上下文聊天产品扩展为全球可下载的旗舰权重。
阿里发布 Qwen3 系列
阿里发布 Qwen3 系列,从 0.6B 到旗舰 235B(MoE)全面开源,原生支持思考/非思考双模式。Qwen3-235B 在多项评测中成为最强开源模型之一,改写开源与闭源的实力版图。
Llama 4 发布
Meta 发布 Llama 4 Scout 与 Maverick,采用混合专家架构并原生支持多模态,把开放权重模型推向超长上下文和更高计算效率。
DeepSeek-R1 发布
DeepSeek 发布开放推理模型 DeepSeek-R1,以强化学习驱动的推理能力和开放权重迅速引发全球关注。
DeepSeek-V3 发布
DeepSeek 发布 DeepSeek-V3,以开放权重和显著的训练效率引发行业关注,并让前沿模型的成本结构成为公开讨论的焦点。
腾讯开源混元视频模型
腾讯开源 HunyuanVideo 等视频生成基础模型,以较大参数规模进入开源视频权重第一梯队,并在 Hugging Face 等平台获得高下载量。
Black Forest Labs 发布 FLUX.1
Black Forest Labs 发布 FLUX.1 家族(pro / dev / schnell),在提示遵循与细节上显著抬升开放与 API 文生图上限,并迅速成为社区默认高质量选项之一。
Meta 发布 Llama 3.1 405B
Meta 发布 Llama 3.1,其中 405B 版本在多项基准上逼近 GPT-4o,是首个与闭源旗舰同场竞技的开源模型。扎克伯格同时发表长文,公开为开源 AI 辩护。
阿里开源 Qwen2 系列
阿里通义千问团队发布 Qwen2 系列开源模型,覆盖 0.5B 到 72B 多个尺寸,7B/72B 在多项基准上领先同量级开源模型。它把开源生态从「单点模型」推向「全尺寸系列」。
昆仑万维推进天工 / Skywork 大模型
昆仑万维以天工产品与 Skywork 模型系列推进搜索增强对话、多模态与后续开放权重,成为中国互联网第二梯队中坚持全栈模型品牌的代表之一。
Meta 发布 Llama 3
Meta 发布 Llama 3 家族(8B 与 70B),性能大幅提升并随后推出 405B 旗舰。它让开源模型的水平首次逼近闭源前沿模型,也把「开源与闭源之争」推向全球大模型竞争的中心。
Stability AI 发布 Stable Diffusion 3
Stability AI 发布 Stable Diffusion 3,采用新的多模态扩散变压器架构,在文字渲染与多主体遵循上显著进步。开源图像生成迎来架构换代。
Google 开源 Gemma
Google 发布开源模型 Gemma,提供 2B 与 7B 两种规模。这是谷歌首次向社区开放自家大模型权重,标志着开源与闭源双线作战成为巨头标配。
面壁开源 MiniCPM 端侧模型
面壁智能与 OpenBMB 开源 MiniCPM 系列,以小参数中文友好基座强调端侧可部署;随后 MiniCPM-V 把多模态也压进边缘设备叙事。
智谱发布 GLM-4
智谱发布 GLM-4,性能对标同期 GPT-4,同时延续开源策略。GLM 系列成为国产大模型中「学术出身、开源与商业并进」路线的代表。
Mistral 发布 Mixtral 8x7B 混合专家模型
Mistral AI 以 Apache 2.0 发布 Mixtral 8x7B 稀疏混合专家模型:每层 8 组专家、每 token 路由 2 个,总参数约 46.7B、每 token 约 12.9B 激活。厂商报告在多数基准上超过 Llama 2 70B、推理更快,并匹配或超过 GPT-3.5;这些比较由发布方给出。
零一万物发布 Yi 系列
零一万物由李开复创立,发布 Yi 系列大模型,其中 Yi-34B 以较强的中英文综合能力进入开源模型第一梯队,成为「大模型六小龙」中的代表。
Mistral 7B 以小模型进入开放生态
Mistral AI 以 Apache 2.0 许可证发布 Mistral 7B 权重。模型采用分组查询注意力和 4096 token 滑动窗口;发布方报告它在多项基准上超过 Llama 2 13B,但这属于厂商基准比较。
通义千问开放 Qwen 权重
阿里云发布 Qwen-7B 与 Qwen-7B-Chat 的代码和权重;基础模型以超过 2.2 万亿 token 预训练,覆盖中文、英文、代码和多语言文本。许可允许研究使用,月活用户低于一亿的商业主体可直接使用,更大规模须另行申请。
Continue 开源 IDE 编程助手
Continue 以开源 VS Code / JetBrains 扩展提供聊天、补全与代码库上下文,强调开发者自带模型与可定制工作流,成为商业 AI IDE 之外的开放对照。
Meta 发布 Llama 2 开放权重
Meta 发布 Llama 2 预训练与对话微调权重,参数规模 7B、13B、70B,并宣布研究与商业用途免费可用。许可为 Llama 2 社区许可(含可接受使用政策与月活门槛等附加条款),不是无限制的 OSI 开源软件许可;微软为优先云合作方。
上海 AI 实验室开源 InternLM
上海人工智能实验室发布并开源书生 InternLM 系列大模型,这是中国科研机构主导的国产开源大模型代表,后续迭代出 InternLM2、InternLM3 等版本,并配套开源工具链。
vLLM 与 PagedAttention 重塑 LLM 服务吞吐
UC Berkeley 等研究者开源 vLLM,并以 PagedAttention 把 KV 缓存拆成可非连续映射的页,降低显存碎片与预留浪费,显著提高大模型服务吞吐。
百川智能发布 Baichuan 开源大模型
王小川创立的百川智能发布 Baichuan-7B,首个版本即开源,随后推出 Baichuan-13B 与 53B。公司以「开源+商业双轨」切入,成为国产开源大模型的重要参与者。
智谱开源 ChatGLM
智谱 AI 发布并开源 ChatGLM 系列,其中包括中文场景优化的对话模型,成为国产开源大模型的重要代表,随后迭代出 ChatGLM2、ChatGLM3 与 GLM-4。
Aider 把 Git 结对写进终端
开源工具 Aider 在终端中对接多厂商 LLM,按聊天指令直接修改本地 Git 仓库并生成可审查 diff,成为 Agent Coding 兴起前最重要的开源结对路径之一。
AutoGPT 引爆自主智能体实验
开源项目 AutoGPT 发布,展示让 GPT-4 自主拆分目标、调用工具并迭代执行的思路。它虽不成熟,却让「AI 智能体」成为生成式 AI 最热门的叙事之一。
斯坦福 Alpaca 低成本复刻
斯坦福团队用 52K 条由 GPT-3.5 生成的指令数据微调 LLaMA-7B,训练成本仅约 600 美元,得到行为接近 GPT-3.5 的 Alpaca。它引爆了「低成本复刻闭源模型」的浪潮。
Meta 发布 LLaMA
Meta 发布 7B、13B、33B 和 65B 参数的 LLaMA 论文,并向获批研究者提供非商业许可权重;其中 65B 模型用 1.4 万亿 token 训练。权重随后外泄,社区迅速开发量化、微调和本地推理工具。
Stable Diffusion 开放文生图权重
Stability AI 与 CompVis 发布 Stable Diffusion 1.4 的代码和约 4GB 权重。模型在压缩潜空间中去噪,能在消费级 GPU 上生成 512×512 图像,也让本地微调和第三方界面迅速扩散。
EleutherAI 开源 GPT-Neo
EleutherAI 发布 GPT-Neo 1.3B 与 2.7B,证明没有科技巨头预算的独立社区也能训练出可用的语言大模型,为开源 AI 的后续繁荣埋下伏笔。
Hugging Face Transformers 库成型
Hugging Face 推出并扩展 Transformers 库,把 BERT 等预训练模型的加载、分词与微调收成统一 API,降低复现与迁移成本。