AI MODELS DIRECTORY

AI 模型大全

收录各大开源模型、闭源大模型(国内/ 海外)、本地部署模型与多模态模型

全部 132 开源模型 107 闭源大模型·国内 90 闭源大模型·海外 80 本地部署模型 35 多模态模型 132
阶跃 Step-1V
阶跃星辰
多模态 国内

阶跃星辰首款多模态模型,支持图像理解与视觉问答,中文场景适配良好。

参数:闭源(未公开) 上下文:32K 👁 4
MiniMax Video
MiniMax
多模态 国内

MiniMax 的视频生成模型,基于 M 系列核心技术,支持文生视频与多镜头创作。

参数:闭源(未公开) 👁 3
MiniMax Speech
MiniMax
多模态 国内

MiniMax 的语音合成模型,支持高度拟人的中文音色与情感表达,常用于配音与语音助手。

参数:闭源(未公开) 👁 3
SenseNova Pro
商汤科技
多模态 国内

日日新系列的 Pro 规格,面向企业 API 调用,综合性能与价格均衡。

参数:闭源(未公开) 上下文:128K 👁 5
商汤日日新 V6
商汤科技
多模态 国内

商汤日日新 V6,较 5.0 在推理与多模态图文理解全面升级,主打“超长上下文 + 超强推理”双强定位。

参数:闭源(未公开) 上下文:128K 👁 3
商汤日日新 4.0
商汤科技
多模态 国内

商汤“日日新 SenseNova”4.0 大模型,支持超长上下文、Agent 与多模态协同,商汤以视觉技术见长,模型在多模态上表现突出。

参数:闭源(未公开) 上下文:128K 👁 4
混元文生图
腾讯
多模态 国内

腾讯混元的图像生成模型,支持文生图、图生图与多轮图像创作,深度适配中文提示词。

参数:闭源(未公开) 👁 3
混元视频
腾讯
多模态 国内

腾讯混元的视频生成模型,支持文本/图像生成视频,是中国头部视频生成模型之一,在抖音/TikTok 内容生态中被广泛应用。

参数:闭源(未公开) 👁 3
Kimi K1
月之暗面
多模态 国内

月之暗面推出的多模态视觉推理模型,主打“让 AI 看见并思考”,在视觉问答、图表理解和长程多模态推理场景表现出众。

参数:闭源(未公开) 上下文:128K 👁 3
AutoGLM
智谱AI
多模态 国内

智谱 AI 的屏幕操控 Agent 模型,能模拟用户操作手机与网页,实现自动下单、订票、填表等真实世界的 Agent 任务。

参数:闭源(未公开) 上下文:128K 👁 3
GLM-4V
智谱AI
多模态 国内

智谱 AI 的图像理解模型,支持图片描述、OCR、表格识别与多图对比,可接入 RAG 与 Agent 的多模态流程。

参数:闭源(未公开) 上下文:8K 👁 3
Qwen3-Plus
阿里巴巴
多模态 国内

通义千问 Qwen3 的规模化 API 型号,基于 MoE 技术提供高性能通用对话与复杂推理,深度绑定阿里云百炼平台。

参数:闭源(未公开) 上下文:128K 👁 3
Meta Muse Image
Meta AI
多模态 海外

Meta 超级智能实验室 Muse Image,2026-07 发布的第一代文生图模型,与 Muse Spark 同步推出,主打高质量图像生成与编辑。

参数:闭源(未公开) 上下文:文生图 👁 3
通义万相 Qwen Image 3.0
阿里巴巴
多模态 国内

阿里通义万相文生图模型 Qwen Image 3.0,2026-08 发布,中文提示词理解、写实与非写实风格、文字渲染能力进一步提升。

参数:闭源(未公开) 上下文:文生图 👁 3
Grok Imagine Image 2.0
xAI
多模态 海外

xAI Grok Imagine 文生图模型 2.0,2026-08 发布,构图、写实与文字渲染大幅提升,与 Grok 生态及 X 平台深度整合。

参数:闭源(未公开) 上下文:文生图 👁 4
Seedance 2.5
字节跳动
多模态 国内

字节跳动文生视频旗舰 Seedance 2.5,2026-08 发布,运动与物理模拟、多镜头叙事、超高清输出进一步提升。

参数:闭源(未公开) 上下文:文生视频 👁 3
Imagen 4
Google
多模态 海外

Google Imagen 4,文本渲染与图像编辑能力优秀,Gemini 生态内可直接调用,适合高质量商业配图。

参数:闭源(未公开) 上下文:文生图 👁 5
Pika 2
Pika Labs
多模态 海外

Pika 2 创意视频生成工具,强调风格控制与特效,可生成影视级特效片段,面向创作者。

参数:闭源(未公开) 上下文:文生视频 👁 3
MiniMax Image
MiniMax(稀宇科技)
多模态 国内

MiniMax 文生图模型,中文提示词理解优秀,支持风格化与编辑,是国内文本生成图像的高质量 API 选项。

参数:闭源(未公开) 上下文:文生图 👁 3
Midjourney V7
Midjourney, Inc.
多模态 海外

Midjourney 最新版本 V7,图像细节、光影与美学质感进一步提升,仍是公认的最强艺术风格文生图工具。

参数:闭源(未公开) 上下文:文生图 👁 3

共 132 个 AI 模型