全模态开源端侧阿里巴巴 多模态模型

MiniOmni MiniOmni

MiniOmni系列 · 阿里巴巴 · 2024-10发布

开源支持本地部署多模态国内可直连有免费额度

模型介绍

阿里开源的全模态模型,仅 2.8B 参数即可同时处理文本、图像与音频,端到端实时语音对话,主打轻量与开源。

模型基础信息

模型系列MiniOmni系列
开发机构阿里巴巴
发布时间2024-10
参数规模2.8B(视觉 + 语音 + 理解)
上下文窗口未公开
模型类型多模态(文本 + 图像 + 音频)
中文能力良好
使用方式网页体验 / 本地部署

免费额度与收费政策

按量付费 订阅

模型能力介绍

✅ 核心优势

  • 全模态轻量
  • 实时语音
  • MIT 开源

⚠️ 短板与局限

  • 质量低于大模型
  • 中文数据有限

🎯 适用场景

  • 端侧助手
  • 研究
  • 语音交互原型

模型使用教程

本章节整理 MiniOmni 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。

暂无内容,可前往官方文档查看。

该模型支持本地部署,教程整理中,敬请期待。