LogoAI225导航
Ollama的官方网站logo

Ollama

AI模型平台

Ollama 是一款开源 AI 模型运行平台,支持在 Windows、macOS 和 Linux 本地运行各类大语言模型,并提供 API、工具调用和 Ollama Cloud 云端模型服务,方便开发者构建 AI 应用与智能体。

立即访问

详细介绍

Ollama 是一个面向开发者和普通用户的开源模型运行与开发平台,核心目标是让用户能够更加简单地在自己的电脑上运行和使用各种开放模型,同时也提供云端模型服务。用户无需自行搭建复杂的推理环境,通过 Ollama 即可下载模型、运行模型,并将其接入 AI 应用、开发工具和智能体工作流。

本地运行 AI 模型

Ollama 最具代表性的功能是在本地运行大语言模型。安装 Ollama 后,可以直接从官方模型库获取模型并运行,例如用于聊天、代码生成、推理、视觉理解和 Embedding 等任务。模型运行在用户自己的硬件上,可以在没有网络连接的情况下使用,适合对隐私、本地部署和数据控制有要求的场景。

Ollama 支持 Windows、macOS 和 Linux,并能够利用不同硬件进行加速,包括 Apple GPU、NVIDIA GPU,以及部分 AMD GPU;同时也支持 CPU 运行。具体的 GPU 支持范围取决于操作系统、驱动和硬件型号。

丰富的模型生态

Ollama 提供了一个模型库,汇集了大量可直接运行的开放模型,覆盖通用对话、代码、视觉、多模态、推理和向量嵌入等不同用途。模型库中的模型来自不同模型开发者和社区,因此具体模型的参数规模、能力、许可证和硬件要求也各不相同。

目前 Ollama 不仅支持传统文本模型,也支持视觉和多模态模型。例如部分模型可以处理图片,并结合文本进行分析和推理。

CLI、API 与 AI 应用集成

Ollama 不只是一个本地聊天工具,它还提供完整的开发接口。安装后可以通过命令行管理和运行模型,并通过 API 将模型接入自己的应用程序、网站、自动化流程以及 AI Agent。

Ollama 本地 API 默认运行在 http://localhost:11434/api,官方同时提供 Python 和 JavaScript 库。此外,Ollama 还提供了部分 OpenAI API 兼容接口,包括 Chat Completions、Responses、Embeddings 和部分视觉、工具调用能力,因此许多原本针对 OpenAI API 开发的应用可以较容易地接入 Ollama。

Ollama 也支持 Tool Calling(工具调用),模型可以在应用提供的函数和工具支持下执行更复杂的任务,例如调用 API、访问外部工具或参与 AI Agent 工作流。

从纯本地运行扩展到 Ollama Cloud

Ollama 目前已经不再局限于本地模型。除了在个人电脑上运行模型外,Ollama 还提供 Ollama Cloud,允许用户直接使用更大型的云端模型,而无需在本地下载和运行庞大的模型文件。

云端模型与 Ollama 的本地工作流结合,可以继续通过 Ollama CLI、API 以及相关开发工具使用。对于本地硬件无法承载的大模型,这种方式可以降低硬件门槛;如果需要完全离线运行,则可以使用 Ollama 的本地模型和本地模式。

Ollama 官方目前提供 Free、Pro、Max、Team 和 Enterprise 等不同方案。本地硬件运行模型不受云端使用额度限制;云端模型则根据套餐提供不同的使用量和并发能力。当前 Free 方案为免费使用,Pro 为每月 20 美元或每年 200 美元;Max 目前暂停新用户注册。具体价格和限制会随官方政策调整。

隐私与本地部署

隐私是 Ollama 的重要特点之一。对于完全在本地运行的模型,模型推理和数据处理可以留在用户自己的设备上,并支持完全离线使用。Ollama 官方表示,用户的提示词和响应数据不会被用于训练;对于 Ollama Cloud,则由 Ollama 的云端基础设施提供模型推理服务,并采用不记录、不训练和零数据保留等相关政策。

需要注意的是,本地模型和云端模型属于不同的运行方式。如果对数据隐私有严格要求,应优先选择本地模型并确认应用本身没有额外的数据上传行为。

适合哪些用户?

Ollama 特别适合希望在个人电脑或服务器上运行 AI 模型的开发者、AI 爱好者和企业用户。例如:

  • 本地运行开源/开放模型,进行聊天和问答
  • 在本地进行代码生成、代码分析和 AI 编程
  • 构建基于大语言模型的应用和 AI Agent
  • 为现有程序提供本地 LLM API
  • 使用视觉模型分析图片和文档
  • 搭建 Embedding、RAG 等本地 AI 应用
  • 在无法或不希望上传数据到第三方平台的环境中运行模型
  • 使用 Ollama Cloud 调用本地硬件难以运行的大型模型

同时,Ollama 已经与 Claude Code、OpenCodeHermes Agent 等开发工具和智能体工作流结合,可以作为这些工具背后的模型运行基础设施。

总结

Ollama 可以理解为一个让 AI 模型更容易运行和接入应用的基础平台:个人用户可以通过它在 Windows、macOS 或 Linux 上快速运行各种开放模型,开发者则可以利用 CLI、API、Python/JavaScript SDK 以及 OpenAI API 兼容接口,将模型集成到自己的应用和 AI Agent 中。随着 Ollama Cloud 的加入,它又进一步从单纯的本地模型运行工具扩展为兼顾本地部署、模型开发、应用集成和云端推理的平台。

对于希望自己掌控 AI 模型、数据和运行环境,同时又希望降低本地部署门槛的用户来说,Ollama 是目前较具代表性的本地 AI 模型运行平台之一。

网站预览

Ollama网站首页截图预览