AI MODELS DIRECTORY
AI 模型大全
收录各大开源模型、闭源大模型(国内/ 海外)、本地部署模型与多模态模型
Mistral 面向编码场景的专用模型,代码补全与生成能力强,支持主流 IDE 与工具链,Apache-2.0 开源可本地部署。
Mistral 最新小尺寸高效模型,24B/30B 参数,Apache-2.0 开源,延迟低、性能强,支持本地部署,是轻量推理的最佳选择之一。
Cohere 开放权重旗舰模型,MoE 架构 111B,原生多语言(含中文)能力优秀,面向企业检索增强(RAG)与 Agent 场景。
韩国 Upstage 公司基于 Llama 3.1 微调的旗舰模型,重写激活路径提升性能,面向企业客户提供英语与多语言 API 服务。
Cohere 的企业级大模型,主打检索增强生成(RAG)与工具调用,256K 上下文,面向企业私有化与安全合规场景。
xAI 第二代旗舰,在数学、推理与编程基准上大幅提升,通过 X(Twitter)内置体验与 xAI API 开放,以订阅制在社交平台中获得海量曝光。
Mistral AI 的轻量闭源 API 模型,主打低延迟低成本的文本生成,提供行业领先的性价比与开发者友好的 API。
Gemini 2.0 系列中的轻量型号,强调速度与容量,1M 上下文并以极低成本提供多模态能力,适合大规模生产任务。
Google 面向高吞吐场景的轻量多模态模型,支持 100 万 token 上下文,速度快、成本低,可同时处理文本、图像、音频与视频。
Anthropic 下一代主流模型,在智能基准全线超越 Opus 4,同时整合更强工具使用与搜索能力,成为 Claude 系列新的主力旗舰。
Claude 系列的旗舰推理模型,正式引入 extended thinking 与多步工具使用,在复杂软件工程、数学与长程 Agent 任务上达到当时业界顶尖水平。
Haiku 系列的升级版,以更低成本与更快速度提供接近 Sonnet 的日常表现,适合高吞吐业务场景。
Anthropic 2024 年的旗舰模型,在编程、Agent 任务与长文档理解上表现顶级,一度成为开发者最常用的代码模型之一,性价比远超 Opus 定位。
Claude 3 系列中的轻量型号,以极低延迟与低成本提供接近上代旗舰的质量,适合实时交互与高吞吐场景。
Claude 3 系列中的均衡型号,在速度与智能之间取得平衡,兼顾长上下文与稳定性,适合日常开发与生产调用。
Anthropic Claude 3 系列中的旗舰型号,在复杂分析、长文本与代码任务上表现优异,曾是 Claude 系列最强模型,主打“接近人类理解力”的深度推理。
o1 系列的早期预览版,率先开放思维链推理 API,供开发者提前适配推理模型的提示词策略,后逐步被正式版 o1/o3 取代。
o1 的轻量推理版本,以更低成本与更快速度提供数学和编程推理能力,适合需要强推理但预算有限的开发者场景。
OpenAI 首个具备“思维链”能力的推理模型,通过在作答前展开内部思考提升复杂推理表现,在数学竞赛、编程竞赛与科学问答场景显著超越 GPT-4o,开启推理模型路线。
GPT-4 的升级版,上下文提升至 128K,知识截止时间更新,价格相比 GPT-4 大幅下降,兼具更强指令遵循与更低的推理成本,曾长期作为 OpenAI 开发者默认模型。
共 80 个 AI 模型
Aitishiku.com