Ollama多模态开源本地 本地部署模型

Ollama 桌面客户端(Ollama) Ollama latest

Ollama系列 · Ollama · 2023-06发布

开源支持本地部署多模态国内可直连有免费额度长上下文

模型介绍

Ollama 让本地大模型像 App 一样安装运行,扩展支持视觉与多模态,一条命令跑起各类模型,生态最流行。

模型基础信息

模型系列Ollama系列
开发机构Ollama
发布时间2023-06
参数规模本地模型管理(多模态)
上下文窗口可配
模型类型本地模型运行器
中文能力优秀
使用方式网页体验 / API调用 / 本地部署

免费额度与收费政策

开源免费

免费规则详情

引擎 MIT,模型按各自许可。

收费标准简介

完全免费。

模型能力介绍

✅ 核心优势

  • 一条命令
  • 模型库大
  • 多模态
  • 跨平台

⚠️ 短板与局限

  • 依赖下载
  • 大模型慢
  • 企业功能有限

🎯 适用场景

  • 本地助手
  • 多模态
  • 开发测试
  • 隐私场景

模型使用教程

本章节整理 Ollama 桌面客户端(Ollama) 的在线体验、API调用、本地部署全套入门教程,快速上手使用该模型。

  • 本地工具,安装后即可使用。
  • 支持对接主流模型与本地推理引擎。

启动服务后按提示操作即可。

export HF_ENDPOINT=https://hf-mirror.com

模型权重通过 HuggingFace 镜像或 ModelScope 下载。

提供 HTTP API:

curl http://localhost:PORT/v1/chat/completions -H "Content-Type: application/json" -d '{"model":"default","messages":[{"role":"user","content":"你好"}]}'

Ollama 是最流行的本地模型运行器,一条命令拉模型,桌面与终端均可使用。

  1. Windows/macOS 直接下载官网安装包;Linux 一键脚本:

curl -fsSL https://ollama.com/install.sh | sh

  1. 拉取并运行模型:

ollama pull qwen2.5:7b && ollama run qwen2.5:7b

  1. 兼容 OpenAI 的 API 默认在 http://localhost:11434/v1,可供其他客户端对接。
  2. 建议配合桌面端 Ollama 应用或 Open WebUI 获得图形界面。

Tips:国内加速:export HF_ENDPOINT=https://hf-mirror.com;模型商店搜 ollama.com/library 千款模型。

💡 使用小技巧

ollama run llama3.2

❓ 常见问题 FAQ

Q1:Ollama 干嘛的?\nA1:本地跑大模型最流行工具。

访问备注与注意事项