Хмарові моделі
Хмарові моделі Ollama — це новий тип моделей у Ollama, які можуть запускатися без потужної GPU. Замість цього хмарові моделі автоматично переносяться на хмарний сервіс Ollama, зберігаючи ті самі можливості, що й локальні моделі. Це дозволяє продовжувати використовувати ваші локальні інструменти під час запуску більших моделей, які не помістяться на персональний комп'ютер.
Підтримувані моделі
Перелік підтримуваних моделей можна знайти в бібліотеці моделей Ollama.
Запуск хмарових моделей
Для роботи з хмаровими моделями Ollama потрібен обліковий запис на ollama.com. Щоб увійти в існуючий або створити новий обліковий запис, виконайте команду:
ollama signinCLI
Щоб запустити хмарову модель, відкрийте термінал і виконайте команду:
ollama run gpt-oss:120b-cloudPython
Спочатку завантажте хмарову модель, щоб до неї можна було отримати доступ:
ollama pull gpt-oss:120b-cloudДалі встановіть бібліотеку Python для Ollama:
pip install ollamaДалі створіть і запустіть простий скрипт на Python:
python
from ollama import Client
client = Client()
messages = [
{
'role': 'user',
'content': 'Why is the sky blue?',
},
]
for part in client.chat('gpt-oss:120b-cloud', messages=messages, stream=True):
print(part['message']['content'], end='', flush=True)JavaScript
Спочатку завантажте хмарову модель, щоб до неї можна було отримати доступ:
ollama pull gpt-oss:120b-cloudДалі встановіть бібліотеку JavaScript для Ollama:
npm i ollamaПотім використовуйте цю бібліотеку для запуску хмарової моделі:
typescript
const ollama = new Ollama();
const response = await ollama.chat({
model: "gpt-oss:120b-cloud",
messages: [{ role: "user", content: "Explain quantum computing" }],
stream: true,
});
for await (const part of response) {
process.stdout.write(part.message.content);
}cURL
Спочатку завантажте хмарову модель, щоб до неї можна було отримати доступ:
ollama pull gpt-oss:120b-cloudВиконайте наступну команду cURL, щоб запустити модель через API Ollama:
curl http://localhost:11434/api/chat -d '{
"model": "gpt-oss:120b-cloud",
"messages": [{
"role": "user",
"content": "Why is the sky blue?"
}],
"stream": false
}'Доступ до хмарового API
Хмарові моделі також можна отримувати напряму через API ollama.com. У цьому режимі ollama.com виступає як віддалений хост Ollama.
Аутентифікація
Для прямого доступу до API ollama.com спочатку створіть API-ключ.
Потім встановіть змінну середовища OLLAMA_API_KEY у значення вашого API-ключа.
export OLLAMA_API_KEY=your_api_keyПерелік моделей
Перелік моделей, доступних напряму через API Ollama, можна отримати за допомогою:
curl https://ollama.com/api/tagsГенерація відповіді
Python
Спочатку встановіть бібліотеку Python для Ollama
pip install ollamaПотім надішліть запит
python
from ollama import Client
client = Client(
host="https://ollama.com",
headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)
messages = [
{
'role': 'user',
'content': 'Why is the sky blue?',
},
]
for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
print(part['message']['content'], end='', flush=True)JavaScript
Спочатку встановіть бібліотеку JavaScript для Ollama:
npm i ollamaДалі надішліть запит до моделі:
typescript
const ollama = new Ollama({
host: "https://ollama.com",
headers: {
Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
},
});
const response = await ollama.chat({
model: "gpt-oss:120b",
messages: [{ role: "user", content: "Explain quantum computing" }],
stream: true,
});
for await (const part of response) {
process.stdout.write(part.message.content);
}cURL
Згенеруйте відповідь через чат-API Ollama:
curl https://ollama.com/api/chat \
-H "Authorization: Bearer $OLLAMA_API_KEY" \
-d '{
"model": "gpt-oss:120b",
"messages": [{
"role": "user",
"content": "Why is the sky blue?"
}],
"stream": false
}'Лише локальний режим
Ollama може працювати в режимі лише локальних обчислень, якщо вимкнути функції хмари Ollama.
Вилучення моделей
Ollama періодично припиняє підтримку та вилучає з обігу старіші хмарові моделі, коли виходять новіші та кращі моделі з відкритим вихідним кодом. Інструментам та застосункам, що використовують моделі Ollama Cloud, може знадобитися оновлення, щоб продовжувати працювати. Користувачів, яких це стосується, буде повідомлено заздалегідь про припинення підтримки та вилучення моделей з обігу. Інформація про припинення підтримки надсилатиметься електронною поштою та публікуватиметься на вебсайті Ollama.
Вилучення моделей Ollama Cloud не впливає на локальні моделі.
Майбутні вилучення
| Дата вилучення | Модель | Рекомендована альтернатива |
|---|---|---|
| 15 липня 2026 р. | deepseek-v3.1:671b | deepseek-v4-flash |
| 15 липня 2026 р. | deepseek-v3.2 | deepseek-v4-flash |
| 15 липня 2026 р. | devstral-2:123b | mistral-large-3:675b |
| 15 липня 2026 р. | devstral-small-2:24b | |
| 15 липня 2026 р. | ministral-3:14b | |
| 15 липня 2026 р. | ministral-3:3b | |
| 15 липня 2026 р. | ministral-3:8b | |
| 15 липня 2026 р. | gemini-3-flash-preview | minimax-m3 |
| 15 липня 2026 р. | gemma3:12b | gemma4:31b |
| 15 липня 2026 р. | gemma3:27b | gemma4:31b |
| 15 липня 2026 р. | gemma3:4b | gemma4:31b |
| 15 липня 2026 р. | glm-4.7 | glm-5.2 |
| 15 липня 2026 р. | glm-5 | glm-5.2 |
| 15 липня 2026 р. | minimax-m2.1 | minimax-m3 |
| 15 липня 2026 р. | qwen3-coder-next | qwen3.5:397b |
| 15 липня 2026 р. | qwen3-coder:480b | qwen3.5:397b |
Минулі вилучення
30 червня 2026 р.
| Модель | Рекомендована альтернатива |
| --- | --- | --- |
| `rnj-1:8b` | |
16 червня 2026 р.
| Модель | Рекомендована альтернатива |
| --- | --- | --- |
| `kimi-k2-thinking` | `kimi-k2.6` |
| `kimi-k2:1t` | `kimi-k2.6` |
| `minimax-m2` | `minimax-m3` |
| `glm-4.6` | `glm-5.1` |
| `qwen3-next:80b` | `qwen3.5` |
| `qwen3-vl:235b` | `qwen3.5` |
| `qwen3-vl:235b-instruct` | `qwen3.5` |
| `cogito-2.1:671b` | `deepseek-v4-flash` |