AI MODELS DIRECTORY

AI 模型大全

收录各大开源模型、闭源大模型(国内/ 海外)、本地部署模型与多模态模型

全部 444 开源模型 107 闭源大模型·国内 90 闭源大模型·海外 80 本地部署模型 35 多模态模型 132
GPT-J
EleutherAI
开源 海外

EleutherAI 的 60 亿参数开源 GPT 模型,采用 Mesh Transformer JAX 训练,成为首个社区广泛使用的十亿级开源生成模型之一。

参数:6B 上下文:2K 👁 2
GPT-Neo
EleutherAI
开源 海外

EleutherAI 发布的 GPT-3 开源复刻系列,是社区驱动的代表性开放大型语言模型之一,为后续开源 LLM 生态打下基础。

参数:125M / 1.3B / 2.7B 上下文:2K 👁 2
Llama 3
Meta AI
开源 海外

Meta 第三代开源大模型,提供 8B 与 70B 两种尺寸,在开放权重模型中表现领先,广泛用于本地部署与微调,催生了庞大的开源生态。

参数:8B / 70B 上下文:8K(可扩长) 👁 2
Gemma
Google
开源 海外

Google DeepMind 基于 Gemini 技术推出的开放权重轻量模型系列,提供 2B/7B 两种规模,可在消费级硬件上本地运行,主要面向研究、开发与中小规模推理部署。

参数:2B / 7B 上下文:8K 👁 3
Grok 1
xAI
开源 海外

xAI 首个旗舰大模型,采用 314B 参数的 MoE 架构,侧重于实时知识与幽默化风格回答,其权重曾以 Apache-2.0 协议开放,在 GitHub 上开源。

参数:3140 亿参数(MoE,激活 86B) 上下文:8K 👁 2
Google Gemma 4
Google
开源·多模态

Google 2026 开源旗舰 Gemma 4,四种架构五档尺寸,31B 与 26B MoE 分别在 Arena 排名开源第 3/6,140+ 语言、最多 256K 上下文,Apache-2.0 可商用。

参数:E2B / E4B / 12B / 26B-A4B / 31B 上下文:256K 👁 2
Meta Muse Glimmer 30B
Meta AI
开源·多模态

Meta 开源 Muse Glimmer,30B 参数专为本地常驻 Agent 工作流优化,可跑在单张消费级 GPU 的 Mac 或 PC 上,支持本地 Agent、函数调用、本地编码与 LLM-as-judge,Apa

参数:30B 上下文:256K 👁 2
Meta SAM 3D
Meta AI
开源·多模态

Meta 开源 SAM 3D,单张 2D 图像即可生成 3D 模型,已集成到 Instagram/Facebook 的 View in Room 功能实现商品 3D 预览,Apache-2.0 开源。

参数:开源(未公开) 上下文:单图转 3D 👁 2
商汤 SenseNova-SI-1.3
商汤科技
开源·多模态

商汤开源的空间视觉模型 SenseNova-SI-1.3,可进行三维环境感知与理解,应用于机器人环境理解、AR 导航、智能制造检测等场景。

参数:开源(未公开) 上下文:128K 👁 2
智谱 GLM-4.5-Air
智谱AI
开源·多模态

智谱 GLM-4.5 系列的轻量 MoE 版本,总参 106B、激活 12B,兼顾性能与部署成本,200K 上下文,中文与编码能力强,适合单卡部署。

参数:106B(MoE,激活 12B) 上下文:200K 👁 2
智谱 GLM-4.6
智谱AI
开源

智谱开源 GLM-4.6,总参 355B、激活 32B 的 MoE,200K 上下文,编程、长文本、推理与智能体应用全面提升,MIT 可商用。

参数:355B(MoE,激活 32B) 上下文:200K 👁 2
智谱 GLM-4.7
智谱AI
开源

智谱开源 GLM-4.7,约 400B 混合专家(MoE),专注复杂编程任务(3D 游戏开发、全栈 Web 应用、工具链协同等),本地部署门槛较高。

参数:约 400B(MoE) 上下文:256K 👁 4
Kimi K2.7 Code
月之暗面
开源·多模态

月之暗面开源聚焦编程的 Agent 模型 Kimi K2.7 Code,1T 总参/32B 激活 MoE,长程软件工程任务端到端成功率显著提升,思考 token 较 K2.6 减少约 30%,始终开启思考模式。

参数:1T(MoE,激活 32B) 上下文:256K 👁 2
通义 Qwen3.8-27B
阿里巴巴
开源·多模态

阿里全新开源 Qwen3.8-27B,原生多模态稠密模型,整体能力超越 Qwen3.7-Plus,编程与办公场景表现好,Apache-2.0 宽松协议,是本地部署主力之选。

参数:27B(Dense) 上下文:256K 👁 2
通义 Qwen3.8-Max
阿里巴巴
开源·多模态 国内

阿里 2026 旗舰 Qwen3.8-Max,2.4T 总参/约 95B 激活的 MoE,1M 上下文与图文视频原生多模态,长程 Agent 任务能力强,权重已开源,综合水准对标海外前沿。

参数:2.4T(MoE,激活约 95B) 上下文:1M 👁 2
Llama 4 Maverick
Meta AI
开源·多模态

Llama 4 旗舰开源版,128 专家 MoE、17B 激活/400B 总参数,对标 GPT-4o,推理成本仅为十分之一,原生多模态与最长 1M 上下文。

参数:400B(17B 激活)MoE 上下文:1M 👁 5
Llama 4 Scout
Meta AI
开源·多模态

Meta Llama 4 系列中的超长上下文模型,17B 激活/109B 总参数 MoE,原生多模态,10M token 上下文,Int4 量化可单卡 H100 运行。

参数:109B(17B 激活)MoE 上下文:10M 👁 2
Mistral Coder
Mistral AI
开源 海外

Mistral 面向编码场景的专用模型,代码补全与生成能力强,支持主流 IDE 与工具链,Apache-2.0 开源可本地部署。

参数:约 24B 上下文:128K 👁 2
Mistral Small 3
Mistral AI
开源 海外

Mistral 最新小尺寸高效模型,24B/30B 参数,Apache-2.0 开源,延迟低、性能强,支持本地部署,是轻量推理的最佳选择之一。

参数:24B / 30B 上下文:128K 👁 2
MiniCPM-o 2.6
面壁智能
开源·多模态

面壁智能全能端侧多模态模型,8B 支持文本/视觉/音频/语音全模态,端侧跑通,Apache-2.0,是国产端侧多模态的代表。

参数:8B 上下文:128K 👁 2

共 444 个 AI 模型