AI MODELS DIRECTORY
AI 模型大全
收录各大开源模型、闭源大模型(国内/ 海外)、本地部署模型与多模态模型
EleutherAI 的 60 亿参数开源 GPT 模型,采用 Mesh Transformer JAX 训练,成为首个社区广泛使用的十亿级开源生成模型之一。
EleutherAI 发布的 GPT-3 开源复刻系列,是社区驱动的代表性开放大型语言模型之一,为后续开源 LLM 生态打下基础。
Meta 第三代开源大模型,提供 8B 与 70B 两种尺寸,在开放权重模型中表现领先,广泛用于本地部署与微调,催生了庞大的开源生态。
Google DeepMind 基于 Gemini 技术推出的开放权重轻量模型系列,提供 2B/7B 两种规模,可在消费级硬件上本地运行,主要面向研究、开发与中小规模推理部署。
xAI 首个旗舰大模型,采用 314B 参数的 MoE 架构,侧重于实时知识与幽默化风格回答,其权重曾以 Apache-2.0 协议开放,在 GitHub 上开源。
Google 2026 开源旗舰 Gemma 4,四种架构五档尺寸,31B 与 26B MoE 分别在 Arena 排名开源第 3/6,140+ 语言、最多 256K 上下文,Apache-2.0 可商用。
Meta 开源 Muse Glimmer,30B 参数专为本地常驻 Agent 工作流优化,可跑在单张消费级 GPU 的 Mac 或 PC 上,支持本地 Agent、函数调用、本地编码与 LLM-as-judge,Apa
Meta 开源 SAM 3D,单张 2D 图像即可生成 3D 模型,已集成到 Instagram/Facebook 的 View in Room 功能实现商品 3D 预览,Apache-2.0 开源。
商汤开源的空间视觉模型 SenseNova-SI-1.3,可进行三维环境感知与理解,应用于机器人环境理解、AR 导航、智能制造检测等场景。
智谱 GLM-4.5 系列的轻量 MoE 版本,总参 106B、激活 12B,兼顾性能与部署成本,200K 上下文,中文与编码能力强,适合单卡部署。
智谱开源 GLM-4.6,总参 355B、激活 32B 的 MoE,200K 上下文,编程、长文本、推理与智能体应用全面提升,MIT 可商用。
智谱开源 GLM-4.7,约 400B 混合专家(MoE),专注复杂编程任务(3D 游戏开发、全栈 Web 应用、工具链协同等),本地部署门槛较高。
月之暗面开源聚焦编程的 Agent 模型 Kimi K2.7 Code,1T 总参/32B 激活 MoE,长程软件工程任务端到端成功率显著提升,思考 token 较 K2.6 减少约 30%,始终开启思考模式。
阿里全新开源 Qwen3.8-27B,原生多模态稠密模型,整体能力超越 Qwen3.7-Plus,编程与办公场景表现好,Apache-2.0 宽松协议,是本地部署主力之选。
阿里 2026 旗舰 Qwen3.8-Max,2.4T 总参/约 95B 激活的 MoE,1M 上下文与图文视频原生多模态,长程 Agent 任务能力强,权重已开源,综合水准对标海外前沿。
Llama 4 旗舰开源版,128 专家 MoE、17B 激活/400B 总参数,对标 GPT-4o,推理成本仅为十分之一,原生多模态与最长 1M 上下文。
Meta Llama 4 系列中的超长上下文模型,17B 激活/109B 总参数 MoE,原生多模态,10M token 上下文,Int4 量化可单卡 H100 运行。
Mistral 面向编码场景的专用模型,代码补全与生成能力强,支持主流 IDE 与工具链,Apache-2.0 开源可本地部署。
Mistral 最新小尺寸高效模型,24B/30B 参数,Apache-2.0 开源,延迟低、性能强,支持本地部署,是轻量推理的最佳选择之一。
面壁智能全能端侧多模态模型,8B 支持文本/视觉/音频/语音全模态,端侧跑通,Apache-2.0,是国产端侧多模态的代表。
共 444 个 AI 模型
Aitishiku.com