AI MODELS DIRECTORY
AI 模型大全
收录各大开源模型、闭源大模型(国内/ 海外)、本地部署模型与多模态模型
阶跃星辰首款多模态模型,支持图像理解与视觉问答,中文场景适配良好。
MiniMax 的视频生成模型,基于 M 系列核心技术,支持文生视频与多镜头创作。
MiniMax 的语音合成模型,支持高度拟人的中文音色与情感表达,常用于配音与语音助手。
日日新系列的 Pro 规格,面向企业 API 调用,综合性能与价格均衡。
商汤日日新 V6,较 5.0 在推理与多模态图文理解全面升级,主打“超长上下文 + 超强推理”双强定位。
商汤“日日新 SenseNova”4.0 大模型,支持超长上下文、Agent 与多模态协同,商汤以视觉技术见长,模型在多模态上表现突出。
腾讯混元的图像生成模型,支持文生图、图生图与多轮图像创作,深度适配中文提示词。
腾讯混元的视频生成模型,支持文本/图像生成视频,是中国头部视频生成模型之一,在抖音/TikTok 内容生态中被广泛应用。
月之暗面推出的多模态视觉推理模型,主打“让 AI 看见并思考”,在视觉问答、图表理解和长程多模态推理场景表现出众。
智谱 AI 的屏幕操控 Agent 模型,能模拟用户操作手机与网页,实现自动下单、订票、填表等真实世界的 Agent 任务。
智谱 AI 的图像理解模型,支持图片描述、OCR、表格识别与多图对比,可接入 RAG 与 Agent 的多模态流程。
通义千问 Qwen3 的规模化 API 型号,基于 MoE 技术提供高性能通用对话与复杂推理,深度绑定阿里云百炼平台。
Meta 超级智能实验室 Muse Image,2026-07 发布的第一代文生图模型,与 Muse Spark 同步推出,主打高质量图像生成与编辑。
阿里通义万相文生图模型 Qwen Image 3.0,2026-08 发布,中文提示词理解、写实与非写实风格、文字渲染能力进一步提升。
xAI Grok Imagine 文生图模型 2.0,2026-08 发布,构图、写实与文字渲染大幅提升,与 Grok 生态及 X 平台深度整合。
字节跳动文生视频旗舰 Seedance 2.5,2026-08 发布,运动与物理模拟、多镜头叙事、超高清输出进一步提升。
Google Imagen 4,文本渲染与图像编辑能力优秀,Gemini 生态内可直接调用,适合高质量商业配图。
Pika 2 创意视频生成工具,强调风格控制与特效,可生成影视级特效片段,面向创作者。
MiniMax 文生图模型,中文提示词理解优秀,支持风格化与编辑,是国内文本生成图像的高质量 API 选项。
Midjourney 最新版本 V7,图像细节、光影与美学质感进一步提升,仍是公认的最强艺术风格文生图工具。
共 132 个 AI 模型
Aitishiku.com