AI MODELS DIRECTORY

AI 模型大全

收录各大开源模型、闭源大模型(国内/ 海外)、本地部署模型与多模态模型

全部 444 开源模型 107 闭源大模型·国内 90 闭源大模型·海外 80 本地部署模型 35 多模态模型 132
GLM-4-9B(开源)
智谱AI
开源 国内

智谱开源 GLM-4-9B,综合能力对标主流开源,128K 上下文,中文优秀且 MIT 免费商用,是国产开源新标杆之一。

参数:9B 上下文:128K 👁 3
Baichuan 3
百川智能
开源

百川智能的新一代基座大模型,医疗场景专项优化(Baichuan-3 药学),部分权重开放,商业化走闭源 API。

参数:超过 1000 亿参数量级(未开源全量) 上下文:32K 👁 3
Baichuan 2
百川智能
开源

百川智能开源的 Baichuan 2 模型,中文与数学能力突出,7B/13B 尺寸适合中文本地部署。

参数:7B / 13B 上下文:32K 👁 3
Qwen2(通义千问2)
阿里巴巴
开源

阿里开源 Qwen2 系列,多尺寸覆盖 MoE/密集,中文与代码能力强,Apache-2.0 免费商用,2.5 的前代主力。

参数:0.5B ~ 72B 上下文:128K 👁 3
DeepSeek-Math
深度求索
开源

DeepSeek 开源数学推理模型,基于 7B,在竞赛数学与 K12 题目上表现突出,专攻推理与符号计算。

参数:7B 上下文:8K 👁 4
DeepSeek-V2
深度求索
开源

DeepSeek-V2 以 MLA(多头潜在注意力)架构开源,MoE 高效推理、中文优秀,训练成本极具竞争力,V3 的前身。

参数:236B(MoE,激活 21B) 上下文:128K 👁 7
Mistral Nemo
Mistral AI × NVIDIA
开源

Mistral 与 NVIDIA 合作开源的 12B 模型,128K 上下文,多语言能力强(含中文改善),Apache-2.0 可用,端侧友好。

参数:12B 上下文:128K 👁 3
Mistral 7B v0.3
Mistral AI
开源

Mistral 开源的 7B 轻量模型,小参数量却有出色指令跟随,Apache-2.0 商用自由,是边缘部署经典。

参数:7B 上下文:32K 👁 3
Mixtral 8x22B
Mistral AI
开源

Mistral 开源的大规模 MoE 模型,总参 141B 仅激活 39B,推理效率与性能兼备,Apache-2.0 可商用,多语言好。

参数:141B(MoE,激活 39B) 上下文:64K 👁 8
Llama 2
Meta AI
开源

Meta 第二代入门开源模型,开创商业免费许可,是全球开源热潮的起点,如今仍是学习与轻量部署参考。

参数:7B / 13B / 70B 上下文:4K 👁 5
Llama 3.2(端侧多模态)
Meta AI
开源·多模态

Meta 开源的代表端侧与多模态的 Llama 3.2,1B/3B 面向移动端,11B/90B 新增视觉理解,指令遵循强。

参数:1B / 3B / 11B / 90B 上下文:128K 👁 3
Stable Video 3D
Stability AI
开源·多模态

Stable Video 3D 从单张图生成 3D 环绕视频(novel view synthesis),为 3D 重建与摄影测量提供素材。

参数:~2B 上下文:图生 3D 视频 👁 8
Stable Diffusion 3.5
Stability AI
开源·多模态

Stability 开源 SD3.5,MMDiT 架构,文字渲染与多主题理解大幅提升,2B/8B 覆盖不同显存档位。

参数:2B / 8B 上下文:文生图 👁 4
Stable Diffusion 1.5
Stability AI
开源·多模态

Stable Diffusion 1.5 是史上最流行的开源文生图模型,海量 LoRA 与模型生态,至今仍是社区主力。

参数:0.98B 上下文:文生图 👁 4
Qwen2.5-Omni
阿里巴巴
开源·多模态 国内

阿里开源全模态模型 Qwen2.5-Omni,文本、图像、音频、视频实时理解与生成,端侧可跑,Apache-2.0 商用。

参数:约 30B 上下文:全模态 👁 8
Stable Fast 3D
Stability AI
开源·多模态

Stability 开源 Stable Fast 3D,单张图片 0.5 秒生成 3D 模型,快速高质量,本地可跑。

参数:~1B 上下文:图生 3D 👁 6
Qwen-Image(阿里开源文生图)
阿里巴巴
开源·多模态 国内

阿里开源文生图模型 Qwen-Image,20B MoE,中文理解与高质量写实出图,支持多图与编辑,国产开源强将。

参数:20B(MoE) 上下文:文生图 👁 6
PaliGemma(Google 视觉)
Google
开源·多模态

Google 开源 PaliGemma,基于 Gemma 的视觉语言模型,3B 轻量,支持图文问答、检测与分割,端侧友好。

参数:3B 上下文:图文理解 👁 6
Florence-2(微软视觉)
Microsoft
开源·多模态

微软 Florence-2 统一视觉模型,用文本指令完成检测、分割、描述、OCR 等任务,小体积高效,MIT 商用。

参数:0.23B / 0.77B 上下文:视觉任务统一 👁 6
CogVLM(开源视觉)
智谱(THUDM)
开源·多模态 国内

智谱开源 CogVLM 视觉语言模型,17B 参数在视觉问答与理解上表现优秀,中文图文理解强。

参数:17B 上下文:图文理解 👁 7

共 444 个 AI 模型