AI MODELS DIRECTORY
AI 模型大全
收录各大开源模型、闭源大模型(国内/ 海外)、本地部署模型与多模态模型
OpenAI GPT-5 系列的中间迭代版,综合能力在 GPT-5.3 基础上小幅提升,推理速度更快,作为 5.5 发布前的过渡版本。
Perplexity 的推理型搜索模型 R1,将深度思考与实时搜索结合,答案准确且带权威引用,是研究型问答的首选。
Mistral 的文档解析专用模型,PDF/扫描件理解与 OCR 效果业界领先,可结构化提取文档内容,适合知识库与文档处理管线。
Amazon Nova 最强旗舰版,面向最复杂推理与多模态任务,是 AWS Bedrock 生态最强模型,适合对能力要求极高的企业场景。
Amazon Nova 系列旗舰版,300K 上下文,多模态文本/图像/视频理解,深度融入 AWS Bedrock,企业级能力与生态完善。
xAI 2026 年 8 月发布的 Grok 4.6,专注长运行 Agent 与视觉工作流,AI 智能指数对齐顶级模型,定价低至 $2/百万 token,性价比突出。
Gemini 3 的深度思考版本,面向科学、研究与工程问题,支持长时间多步骤推理,是 Gemini 家族在极限推理场景的专用模型。
Google 2026 年 2 月发布的最新旗舰 Gemini 3.1 Pro,ARC-AGI-2 验证得分 77.1%(超过 3 Pro 一倍),推理与 Agentic 工作流大幅提升。
Anthropic 最新一代旗舰 Opus 4.7,SWE-Bench Pro 64.3% 领先业界,短时与长期 Agent 任务均顶级,是当前编程与复杂工作流的最强模型之一。
Claude Sonnet 4.5 是 2025 年 9 月发布的世界最强编码模型,最强构建复杂 Agent,擅长使用电脑,推理与数学大幅提升,性价比主力。
Anthropic 2025 年 11 月发布的 Opus 4.5,编码、Agent 与计算机操作全局最佳,比 Sonnet 4.5 更强的深度推理,token 效率极高。
GPT-5.5 的高精度旗舰版,面向最难的问题与最高准确性场景,FrontierMath 与 BrowseComp 等评测登顶,在商业、法律、教育、数据科学表现突出。
OpenAI 2026 年 4 月发布的最新旗舰,Agentic 能力(终端工作流 Terminal-Bench 2.0 82.7%)与推理大幅领先,1M 上下文,是当前最强的通用 Agent 模型之一。
Google Imagen 4,文本渲染与图像编辑能力优秀,Gemini 生态内可直接调用,适合高质量商业配图。
Pika 2 创意视频生成工具,强调风格控制与特效,可生成影视级特效片段,面向创作者。
MiniMax 文生图模型,中文提示词理解优秀,支持风格化与编辑,是国内文本生成图像的高质量 API 选项。
Midjourney 最新版本 V7,图像细节、光影与美学质感进一步提升,仍是公认的最强艺术风格文生图工具。
Suno 新一代文生音乐模型,人声质量与乐器真实感大幅提升,支持多语言演唱与完整歌曲结构,是音乐生成赛道标杆。
MiniMax 海螺视频 2.0,运动自然、镜头语言强,国内直连,是国产视频模型中的口碑黑马。
字节跳动文生视频旗舰 Seedance,运动与物理细节出色,支持超高清与多镜头,火山引擎生态内可 API 调用。
共 444 个 AI 模型
Aitishiku.com