AI MODELS DIRECTORY

AI 模型大全

收录各大开源模型、闭源大模型(国内/ 海外)、本地部署模型与多模态模型

全部 107 开源模型 107 闭源大模型·国内 90 闭源大模型·海外 80 本地部署模型 35 多模态模型 132
DeepSeek-V2
深度求索
开源

DeepSeek-V2 以 MLA(多头潜在注意力)架构开源,MoE 高效推理、中文优秀,训练成本极具竞争力,V3 的前身。

参数:236B(MoE,激活 21B) 上下文:128K 👁 7
Mistral Nemo
Mistral AI × NVIDIA
开源

Mistral 与 NVIDIA 合作开源的 12B 模型,128K 上下文,多语言能力强(含中文改善),Apache-2.0 可用,端侧友好。

参数:12B 上下文:128K 👁 4
Mistral 7B v0.3
Mistral AI
开源

Mistral 开源的 7B 轻量模型,小参数量却有出色指令跟随,Apache-2.0 商用自由,是边缘部署经典。

参数:7B 上下文:32K 👁 4
Mixtral 8x22B
Mistral AI
开源

Mistral 开源的大规模 MoE 模型,总参 141B 仅激活 39B,推理效率与性能兼备,Apache-2.0 可商用,多语言好。

参数:141B(MoE,激活 39B) 上下文:64K 👁 9
Llama 2
Meta AI
开源

Meta 第二代入门开源模型,开创商业免费许可,是全球开源热潮的起点,如今仍是学习与轻量部署参考。

参数:7B / 13B / 70B 上下文:4K 👁 5
Llama 3.2(端侧多模态)
Meta AI
开源·多模态

Meta 开源的代表端侧与多模态的 Llama 3.2,1B/3B 面向移动端,11B/90B 新增视觉理解,指令遵循强。

参数:1B / 3B / 11B / 90B 上下文:128K 👁 4
面壁楚儿(端脑)
面壁智能
开源·多模态 国内

面壁智能的端到端多模态大模型,端侧推理能力强,最新「楚儿」系列兼顾浏览器 agent 能力,中文好、本地可部署。

参数:8B~35B 上下文:64K 👁 4
澜舟孟子
澜舟科技
开源 国内

澜舟科技的孟子大模型,开源权重可商用,中文能力好,主打可控生成与垂直行业(金融等)支持。

参数:6B~13B 上下文:8K~32K 👁 3
DBRX(MoE 开源)
Databricks
开源 海外

Databricks 开源的大规模 MoE 模型,132B 总参数激活仅 36B,推理效率高,通用能力与代码表现优秀,面向企业数据场景。

参数:132B(MoE,激活 36B) 上下文:32K 👁 6
Qwen2.5-Coder
阿里巴巴通义千问
开源

阿里开源的代码专用大模型,在代码生成、补全、多语言任务上表现优秀,128K 上下文可处理大文件,Apache-2.0 免费商用。

参数:0.5B ~ 32B 上下文:128K 👁 6
MiniCPM(端侧模型)
面壁智能(OpenBMB)
开源 国内

面壁智能开源的端侧大模型,2.4B~8B 却能表现接近大模型的推理能力,可部署到手机、笔记本、树莓派等设备,隐私友好免费商用。

参数:2.4B / 4B / 8B 上下文:32K 👁 5
ChatGLM
智谱AI
开源 国内

智谱与清华团队开源的对话模型系列,中文能力强,6B 参数即可流畅运行,接入自家开放平台生态,是国产开源对话模型的重要代表。

参数:6B 上下文:128K 👁 5
Llama 4
Meta AI
开源·多模态

Meta 新一代开源模型,首次原生多模态,支持文、图、视频理解与百万级上下文,MoE 架构提升效率,MaVerick/Scout 尺寸灵活。

参数:17B ~ 400B(MoE) 上下文:10M(百万级) 👁 6
InternLM(书生浦语)
上海人工智能实验室
开源 国内

上海人工智能实验室与商汤联合开源的书生浦语大模型,支持 128K 长上下文与工具调用,学术研究与应用并重,Apache-2.0 可商用。

参数:1.8B ~ 20B 上下文:128K 👁 5
Yi-1.5
零一万物
开源

零一万物开源的 Yi-1.5 系列,中英双语能力优秀,支持 128K 上下文与函数调用,Apache-2.0 协议免费商用,社区生态成熟。

参数:6B / 9B / 34B 上下文:128K 👁 5
DeepSeek-Coder
深度求索
开源

深度求索的代码专用大模型,在代码生成、补全、解释与 debug 任务上表现突出,支持长上下文代码项目,权重开放免费商用。

参数:1.3B ~ 33B 上下文:128K 👁 4
Phi-4
Microsoft
开源

微软最新一代小模型,14B 参数专注复杂推理,在数学与代码任务上可达到更大模型水平,MIT 协议完全免费商用,CPU 也能运行。

参数:14B 上下文:16K 👁 4
Gemma 3
Google
开源·多模态

Google 的开源多模态模型系列,升级支持图像输入,1B 到 27B 覆盖轻量到中端,128K 上下文,在自有硬件上表现优秀,适合端侧与私有化。

参数:1B ~ 27B 上下文:128K 👁 7
Llama 3.3
Meta AI
开源

Meta 在 Llama 3.1 基础上优化的 70B 模型,用更小规模达到接近 405B 的效果,推理成本大幅下降,是单卡 / 双卡可运行的顶级开源模型。

参数:70B 上下文:128K 👁 4
DeepSeek-V3
深度求索
开源

深度求索的开源大模型,671B MoE 架构激活仅 37B,训练成本极低且性能对标闭源旗舰,中文与代码任务表现突出,权重开放商用。

参数:671B(MoE,激活 37B) 上下文:128K 👁 6

共 107 个 AI 模型