AI MODELS DIRECTORY
AI 模型大全
收录各大开源模型、闭源大模型(国内/ 海外)、本地部署模型与多模态模型
Hugging Face 团队训练的超轻量小型语言模型,主打教育与设备端推理,可在低配硬件上运行,适合终端与实验场景。
NVIDIA 开源的 150 亿参数通用大模型,重点服务于企业多语种定制化场景,可与 NeMo 工具链配合微调。
LG 旗下 EXAONE 系列通用大模型,主打韩英双语与专家级专业能力,7.8B 开放权重,是韩国代表性开源大模型。
AI21 的混合架构大模型,融合 Mamba(状态空间)+ Transformer + MoE,支持 256K 长上下文,兼顾效率与成本,提供开源权重。
艾伦人工智能研究所(AI2)的全栈开源模型系列,公开了完整训练数据、代码与权重,主打科学透明与可复现的开源 LLM。
EleutherAI 发布的 200 亿参数开源模型,配套开源了 GPT-NeoX 训练框架与推理栈,是当时最大的开放权重模型之一。
EleutherAI 的 60 亿参数开源 GPT 模型,采用 Mesh Transformer JAX 训练,成为首个社区广泛使用的十亿级开源生成模型之一。
EleutherAI 发布的 GPT-3 开源复刻系列,是社区驱动的代表性开放大型语言模型之一,为后续开源 LLM 生态打下基础。
Meta 第三代开源大模型,提供 8B 与 70B 两种尺寸,在开放权重模型中表现领先,广泛用于本地部署与微调,催生了庞大的开源生态。
Google DeepMind 基于 Gemini 技术推出的开放权重轻量模型系列,提供 2B/7B 两种规模,可在消费级硬件上本地运行,主要面向研究、开发与中小规模推理部署。
xAI 首个旗舰大模型,采用 314B 参数的 MoE 架构,侧重于实时知识与幽默化风格回答,其权重曾以 Apache-2.0 协议开放,在 GitHub 上开源。
Google 2026 开源旗舰 Gemma 4,四种架构五档尺寸,31B 与 26B MoE 分别在 Arena 排名开源第 3/6,140+ 语言、最多 256K 上下文,Apache-2.0 可商用。
Meta 开源 Muse Glimmer,30B 参数专为本地常驻 Agent 工作流优化,可跑在单张消费级 GPU 的 Mac 或 PC 上,支持本地 Agent、函数调用、本地编码与 LLM-as-judge,Apa
商汤开源的空间视觉模型 SenseNova-SI-1.3,可进行三维环境感知与理解,应用于机器人环境理解、AR 导航、智能制造检测等场景。
智谱 GLM-4.5 系列的轻量 MoE 版本,总参 106B、激活 12B,兼顾性能与部署成本,200K 上下文,中文与编码能力强,适合单卡部署。
智谱开源 GLM-4.6,总参 355B、激活 32B 的 MoE,200K 上下文,编程、长文本、推理与智能体应用全面提升,MIT 可商用。
智谱开源 GLM-4.7,约 400B 混合专家(MoE),专注复杂编程任务(3D 游戏开发、全栈 Web 应用、工具链协同等),本地部署门槛较高。
月之暗面开源聚焦编程的 Agent 模型 Kimi K2.7 Code,1T 总参/32B 激活 MoE,长程软件工程任务端到端成功率显著提升,思考 token 较 K2.6 减少约 30%,始终开启思考模式。
阿里全新开源 Qwen3.8-27B,原生多模态稠密模型,整体能力超越 Qwen3.7-Plus,编程与办公场景表现好,Apache-2.0 宽松协议,是本地部署主力之选。
Llama 4 旗舰开源版,128 专家 MoE、17B 激活/400B 总参数,对标 GPT-4o,推理成本仅为十分之一,原生多模态与最长 1M 上下文。
共 107 个 AI 模型
Aitishiku.com