Skip to content

Хмарові моделі

Хмарові моделі Ollama — це новий тип моделей у Ollama, які можуть запускатися без потужної GPU. Замість цього хмарові моделі автоматично переносяться на хмарний сервіс Ollama, зберігаючи ті самі можливості, що й локальні моделі. Це дозволяє продовжувати використовувати ваші локальні інструменти під час запуску більших моделей, які не помістяться на персональний комп'ютер.

Підтримувані моделі

Перелік підтримуваних моделей можна знайти в бібліотеці моделей Ollama.

Запуск хмарових моделей

Для роботи з хмаровими моделями Ollama потрібен обліковий запис на ollama.com. Щоб увійти в існуючий або створити новий обліковий запис, виконайте команду:

ollama signin

CLI

Щоб запустити хмарову модель, відкрийте термінал і виконайте команду:

ollama run gpt-oss:120b-cloud

Python

Спочатку завантажте хмарову модель, щоб до неї можна було отримати доступ:

ollama pull gpt-oss:120b-cloud

Далі встановіть бібліотеку Python для Ollama:

pip install ollama

Далі створіть і запустіть простий скрипт на Python:

python
from ollama import Client

client = Client()

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b-cloud', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript

Спочатку завантажте хмарову модель, щоб до неї можна було отримати доступ:

ollama pull gpt-oss:120b-cloud

Далі встановіть бібліотеку JavaScript для Ollama:

npm i ollama

Потім використовуйте цю бібліотеку для запуску хмарової моделі:

typescript


const ollama = new Ollama();

const response = await ollama.chat({
  model: "gpt-oss:120b-cloud",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL

Спочатку завантажте хмарову модель, щоб до неї можна було отримати доступ:

ollama pull gpt-oss:120b-cloud

Виконайте наступну команду cURL, щоб запустити модель через API Ollama:

curl http://localhost:11434/api/chat -d '{
  "model": "gpt-oss:120b-cloud",
  "messages": [{
    "role": "user",
    "content": "Why is the sky blue?"
  }],
  "stream": false
}'

Доступ до хмарового API

Хмарові моделі також можна отримувати напряму через API ollama.com. У цьому режимі ollama.com виступає як віддалений хост Ollama.

Аутентифікація

Для прямого доступу до API ollama.com спочатку створіть API-ключ.

Потім встановіть змінну середовища OLLAMA_API_KEY у значення вашого API-ключа.

export OLLAMA_API_KEY=your_api_key

Перелік моделей

Перелік моделей, доступних напряму через API Ollama, можна отримати за допомогою:

curl https://ollama.com/api/tags

Генерація відповіді

Python

Спочатку встановіть бібліотеку Python для Ollama

pip install ollama

Потім надішліть запит

python

from ollama import Client

client = Client(
    host="https://ollama.com",
    headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript

Спочатку встановіть бібліотеку JavaScript для Ollama:

npm i ollama

Далі надішліть запит до моделі:

typescript


const ollama = new Ollama({
  host: "https://ollama.com",
  headers: {
    Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
  },
});

const response = await ollama.chat({
  model: "gpt-oss:120b",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL

Згенеруйте відповідь через чат-API Ollama:

curl https://ollama.com/api/chat \
  -H "Authorization: Bearer $OLLAMA_API_KEY" \
  -d '{
    "model": "gpt-oss:120b",
    "messages": [{
      "role": "user",
      "content": "Why is the sky blue?"
    }],
    "stream": false
  }'

Лише локальний режим

Ollama може працювати в режимі лише локальних обчислень, якщо вимкнути функції хмари Ollama.

Вилучення моделей

Ollama періодично припиняє підтримку та вилучає з обігу старіші хмарові моделі, коли виходять новіші та кращі моделі з відкритим вихідним кодом. Інструментам та застосункам, що використовують моделі Ollama Cloud, може знадобитися оновлення, щоб продовжувати працювати. Користувачів, яких це стосується, буде повідомлено заздалегідь про припинення підтримки та вилучення моделей з обігу. Інформація про припинення підтримки надсилатиметься електронною поштою та публікуватиметься на вебсайті Ollama.

Вилучення моделей Ollama Cloud не впливає на локальні моделі.

Майбутні вилучення

Дата вилученняМодельРекомендована альтернатива
15 липня 2026 р.deepseek-v3.1:671bdeepseek-v4-flash
15 липня 2026 р.deepseek-v3.2deepseek-v4-flash
15 липня 2026 р.devstral-2:123bmistral-large-3:675b
15 липня 2026 р.devstral-small-2:24b
15 липня 2026 р.ministral-3:14b
15 липня 2026 р.ministral-3:3b
15 липня 2026 р.ministral-3:8b
15 липня 2026 р.gemini-3-flash-previewminimax-m3
15 липня 2026 р.gemma3:12bgemma4:31b
15 липня 2026 р.gemma3:27bgemma4:31b
15 липня 2026 р.gemma3:4bgemma4:31b
15 липня 2026 р.glm-4.7glm-5.2
15 липня 2026 р.glm-5glm-5.2
15 липня 2026 р.minimax-m2.1minimax-m3
15 липня 2026 р.qwen3-coder-nextqwen3.5:397b
15 липня 2026 р.qwen3-coder:480bqwen3.5:397b

Минулі вилучення

30 червня 2026 р.
| Модель | Рекомендована альтернатива |
| --- | --- | --- |
| `rnj-1:8b` | |
16 червня 2026 р.
| Модель | Рекомендована альтернатива |
| --- | --- | --- |
| `kimi-k2-thinking` | `kimi-k2.6` |
| `kimi-k2:1t` | `kimi-k2.6` |
| `minimax-m2`  | `minimax-m3` |
| `glm-4.6` | `glm-5.1` |
| `qwen3-next:80b` | `qwen3.5` |
| `qwen3-vl:235b` | `qwen3.5` |
| `qwen3-vl:235b-instruct` | `qwen3.5` |
| `cogito-2.1:671b` | `deepseek-v4-flash` |