AI MODELS DIRECTORY
AI 模型大全
收录各大开源模型、闭源大模型(国内/ 海外)、本地部署模型与多模态模型
EleutherAI 的 Pythia 研究套件,从 70M 到 12B 全尺寸开源,每 1000 步存 checkpoint,是可解释性研究宝库。
BigScience 社区开源的 176B 多语言模型,覆盖 59 种语言,是史上最大开放科学项目之一,伦理许可先行者。
阿布扎比技术创新研究院开源 Falcon 系列,180B 曾登开源榜首,Apache-2.0 商用自由,主打推理加速训练。
Cohere 开源的企业 RAG 模型 Command R,35B 参数、128K 上下文,十种语言,检索增强能力强。
通义千问 1.5 开源系列,继承 Qwen 中文基因并改善多语言,Apache-2.0 可商用,是 2 代以前的重要版本。
WizardLM 通过 Evol-Instruct 进化指令微调,复杂指令跟随强,是早期爆款微调模型系列。
Mistral 开源的经典 MoE 模型,总参 46.7B 仅激活 12.9B 推理快,Apache-2.0 可商用,是 8x22B 的前作。
AI2 的开放语言模型 OLMo,权重、训练数据、代码全开放,是研究社区透明度标杆。
Milva 是 OpenBMB 推出的开源中文对话模型,低参数量适配端侧与消费级显卡,中文能力友好。
Vicuna 是早期微调对话模型代表,基于 LLaMA 用用户对话微调,Chatbot Arena 前身,历史地位高。
上海 AI 实验室开源的 InternLM2,多语言与工具能力平衡,多尺寸含轻量版,配套书生 Community 生态。
AWQ 是一种激活感知的权重量化方法,可将大模型 4-bit 量化几乎无损,显著降低显存与推理延迟,是部署利器。
BigCode 计划开源的代码模型,训练于 900+ 语言版本库,3B/7B/15B 尺寸覆盖,代码补全与生成能力强。
Meta 开源的代码专用模型,支持补全、填充与指令,多语言编程,早期最流行的本地代码模型之一。
OpenChat 以「可读代码的只有 7B 模型」著称,混合专家对齐算法,开源社区的代表之一,性价比高。
智谱开源 GLM-4-9B,综合能力对标主流开源,128K 上下文,中文优秀且 MIT 免费商用,是国产开源新标杆之一。
百川智能的新一代基座大模型,医疗场景专项优化(Baichuan-3 药学),部分权重开放,商业化走闭源 API。
百川智能开源的 Baichuan 2 模型,中文与数学能力突出,7B/13B 尺寸适合中文本地部署。
阿里开源 Qwen2 系列,多尺寸覆盖 MoE/密集,中文与代码能力强,Apache-2.0 免费商用,2.5 的前代主力。
DeepSeek 开源数学推理模型,基于 7B,在竞赛数学与 K12 题目上表现突出,专攻推理与符号计算。
共 107 个 AI 模型
Aitishiku.com