云图AI云图AI
O

ollama

MITGo

Get up and running with Kimi-K2.6, GLM-5.2, MiniMax, DeepSeek, gpt-oss, Qwen, Gemma and other models.

178kFork 17k更新于 2026-08-02

软件介绍

Ollama 是一个开源工具,旨在简化大型语言模型(LLM)的本地部署和运行。它支持包括 Kimi-K2.6、GLM-5.1、MiniMax、DeepSeek、Qwen、Gemma 在内的多种模型,并提供简洁的命令行界面和 REST API。用户可以通过简单的命令下载、运行模型,并集成到各种应用和开发环境中。Ollama 还拥有丰富的社区集成,涵盖聊天界面、代码编辑器、框架、RAG 系统等。

核心功能

支持多种开源模型,如 DeepSeek、Qwen、Gemma 等
跨平台支持:macOS、Windows、Linux 及 Docker
简洁的命令行界面,一键运行模型
提供 REST API,方便集成到应用中
支持 Python 和 JavaScript 等语言的 SDK
丰富的社区集成,包括聊天界面、代码编辑器、框架等

适用场景

在本地运行开源大模型进行聊天和问答集成到代码编辑器(如 VS Code)中作为 AI 编程助手构建基于 RAG 的知识库问答系统作为后端服务为聊天机器人或 AI 应用提供推理能力在开发环境中测试和比较不同模型的效果

Docker 部署

docker run -d -v ollama:/root/.ollama -p 11434:11434 --name ollama ollama/ollama

FAQ

Ollama 支持哪些模型?

Ollama 支持包括 DeepSeek、Qwen、Gemma、GLM、MiniMax、Mistral 等在内的多种开源模型,完整列表可查看 ollama.com/library。

如何安装 Ollama?

macOS 和 Linux 可通过 curl 脚本安装,Windows 使用 PowerShell 脚本,也可直接下载安装包或使用 Docker 镜像。

Ollama 是否支持 GPU 加速?

是的,Ollama 支持 GPU 加速,推荐使用 NVIDIA GPU 以获得更好的性能。

如何通过 API 调用 Ollama?

Ollama 提供 REST API,默认监听 localhost:11434,可通过 curl 或 SDK 进行调用。