Skip to content

Облачные модели

Облачные модели Ollama — это новый тип моделей в Ollama, которые могут работать без мощного GPU. Вместо этого облачные модели автоматически выгружаются на облачный сервис Ollama, при этом сохраняя все возможности локальных моделей, что позволяет продолжать использовать локальные инструменты для запуска более крупных моделей, которые не помещаются на персональный компьютер.

Поддерживаемые модели

Список поддерживаемых моделей доступен в библиотеке моделей Ollama.

Запуск облачных моделей

Для работы с облачными моделями Ollama требуется учётная запись на ollama.com. Чтобы войти в неё или создать новую, выполните команду:

ollama signin

CLI

Чтобы запустить облачную модель, откройте терминал и выполните команду:

ollama run gpt-oss:120b-cloud

Python

Сначала загрузите облачную модель, чтобы получить к ней доступ:

ollama pull gpt-oss:120b-cloud

Далее установите библиотеку Ollama для Python:

pip install ollama

Далее создайте и запустите простой скрипт на Python:

python
from ollama import Client

client = Client()

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b-cloud', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript

Сначала загрузите облачную модель, чтобы получить к ней доступ:

ollama pull gpt-oss:120b-cloud

Далее установите библиотеку Ollama для JavaScript:

npm i ollama

Затем используйте библиотеку для запуска облачной модели:

typescript


const ollama = new Ollama();

const response = await ollama.chat({
  model: "gpt-oss:120b-cloud",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL

Сначала загрузите облачную модель, чтобы получить к ней доступ:

ollama pull gpt-oss:120b-cloud

Выполните следующую команду cURL для вызова через API Ollama:

curl http://localhost:11434/api/chat -d '{
  "model": "gpt-oss:120b-cloud",
  "messages": [{
    "role": "user",
    "content": "Why is the sky blue?"
  }],
  "stream": false
}'

Доступ к облачному API

К облачным моделям также можно получить прямой доступ через API ollama.com. В этом режиме ollama.com выступает в роли удалённого хоста Ollama.

Аутентификация

Для прямого доступа к API ollama.com сначала создайте API-ключ.

Затем задайте для переменной окружения OLLAMA_API_KEY значение вашего API-ключа.

export OLLAMA_API_KEY=your_api_key

Получение списка моделей

Список моделей, доступных напрямую через API Ollama, можно получить с помощью:

curl https://ollama.com/api/tags

Генерация ответа

Python

Сначала установите библиотеку Ollama для Python

pip install ollama

Затем отправьте запрос

python

from ollama import Client

client = Client(
    host="https://ollama.com",
    headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript

Сначала установите библиотеку Ollama для JavaScript:

npm i ollama

Далее отправьте запрос к модели:

typescript


const ollama = new Ollama({
  host: "https://ollama.com",
  headers: {
    Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
  },
});

const response = await ollama.chat({
  model: "gpt-oss:120b",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL

Сгенерируйте ответ через чат-API Ollama:

curl https://ollama.com/api/chat \
  -H "Authorization: Bearer $OLLAMA_API_KEY" \
  -d '{
    "model": "gpt-oss:120b",
    "messages": [{
      "role": "user",
      "content": "Why is the sky blue?"
    }],
    "stream": false
  }'

Только локальный режим

Ollama может работать в режиме только локального использования путём отключения функций облака Ollama.

Вывод моделей из эксплуатации

Ollama периодически прекращает поддержку и выводит из эксплуатации старые облачные модели по мере выхода новых и более качественных открытых моделей. Инструменты и приложения, использующие облачные модели Ollama, могут потребовать обновления для продолжения работы. Пользователи, которых это затрагивает, будут уведомлены заранее о прекращении поддержки и выводе моделей из эксплуатации. Информация о прекращении поддержки будет отправляться по электронной почте и публиковаться на сайте Ollama.

Вывод облачных моделей Ollama из эксплуатации не затрагивает локальные модели.

Предстоящие выводы из эксплуатации

Дата вывода из эксплуатацииМодельРекомендуемая альтернатива
15 июля 2026 г.deepseek-v3.1:671bdeepseek-v4-flash
15 июля 2026 г.deepseek-v3.2deepseek-v4-flash
15 июля 2026 г.devstral-2:123bmistral-large-3:675b
15 июля 2026 г.devstral-small-2:24b
15 июля 2026 г.ministral-3:14b
15 июля 2026 г.ministral-3:3b
15 июля 2026 г.ministral-3:8b
15 июля 2026 г.gemini-3-flash-previewminimax-m3
15 июля 2026 г.gemma3:12bgemma4:31b
15 июля 2026 г.gemma3:27bgemma4:31b
15 июля 2026 г.gemma3:4bgemma4:31b
15 июля 2026 г.glm-4.7glm-5.2
15 июля 2026 г.glm-5glm-5.2
15 июля 2026 г.minimax-m2.1minimax-m3
15 июля 2026 г.qwen3-coder-nextqwen3.5:397b
15 июля 2026 г.qwen3-coder:480bqwen3.5:397b

Прошедшие выводы из эксплуатации

30 июня 2026 г.
| Модель | Рекомендуемая альтернатива |
| --- | --- | --- |
| `rnj-1:8b` | |
16 июня 2026 г.
| Модель | Рекомендуемая альтернатива |
| --- | --- | --- |
| `kimi-k2-thinking` | `kimi-k2.6` |
| `kimi-k2:1t` | `kimi-k2.6` |
| `minimax-m2`  | `minimax-m3` |
| `glm-4.6` | `glm-5.1` |
| `qwen3-next:80b` | `qwen3.5` |
| `qwen3-vl:235b` | `qwen3.5` |
| `qwen3-vl:235b-instruct` | `qwen3.5` |
| `cogito-2.1:671b` | `deepseek-v4-flash` |