Облачные модели
Облачные модели Ollama — это новый тип моделей в Ollama, которые могут работать без мощного GPU. Вместо этого облачные модели автоматически выгружаются на облачный сервис Ollama, при этом сохраняя все возможности локальных моделей, что позволяет продолжать использовать локальные инструменты для запуска более крупных моделей, которые не помещаются на персональный компьютер.
Поддерживаемые модели
Список поддерживаемых моделей доступен в библиотеке моделей Ollama.
Запуск облачных моделей
Для работы с облачными моделями Ollama требуется учётная запись на ollama.com. Чтобы войти в неё или создать новую, выполните команду:
ollama signinCLI
Чтобы запустить облачную модель, откройте терминал и выполните команду:
ollama run gpt-oss:120b-cloudPython
Сначала загрузите облачную модель, чтобы получить к ней доступ:
ollama pull gpt-oss:120b-cloudДалее установите библиотеку Ollama для Python:
pip install ollamaДалее создайте и запустите простой скрипт на Python:
python
from ollama import Client
client = Client()
messages = [
{
'role': 'user',
'content': 'Why is the sky blue?',
},
]
for part in client.chat('gpt-oss:120b-cloud', messages=messages, stream=True):
print(part['message']['content'], end='', flush=True)JavaScript
Сначала загрузите облачную модель, чтобы получить к ней доступ:
ollama pull gpt-oss:120b-cloudДалее установите библиотеку Ollama для JavaScript:
npm i ollamaЗатем используйте библиотеку для запуска облачной модели:
typescript
const ollama = new Ollama();
const response = await ollama.chat({
model: "gpt-oss:120b-cloud",
messages: [{ role: "user", content: "Explain quantum computing" }],
stream: true,
});
for await (const part of response) {
process.stdout.write(part.message.content);
}cURL
Сначала загрузите облачную модель, чтобы получить к ней доступ:
ollama pull gpt-oss:120b-cloudВыполните следующую команду cURL для вызова через API Ollama:
curl http://localhost:11434/api/chat -d '{
"model": "gpt-oss:120b-cloud",
"messages": [{
"role": "user",
"content": "Why is the sky blue?"
}],
"stream": false
}'Доступ к облачному API
К облачным моделям также можно получить прямой доступ через API ollama.com. В этом режиме ollama.com выступает в роли удалённого хоста Ollama.
Аутентификация
Для прямого доступа к API ollama.com сначала создайте API-ключ.
Затем задайте для переменной окружения OLLAMA_API_KEY значение вашего API-ключа.
export OLLAMA_API_KEY=your_api_keyПолучение списка моделей
Список моделей, доступных напрямую через API Ollama, можно получить с помощью:
curl https://ollama.com/api/tagsГенерация ответа
Python
Сначала установите библиотеку Ollama для Python
pip install ollamaЗатем отправьте запрос
python
from ollama import Client
client = Client(
host="https://ollama.com",
headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)
messages = [
{
'role': 'user',
'content': 'Why is the sky blue?',
},
]
for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
print(part['message']['content'], end='', flush=True)JavaScript
Сначала установите библиотеку Ollama для JavaScript:
npm i ollamaДалее отправьте запрос к модели:
typescript
const ollama = new Ollama({
host: "https://ollama.com",
headers: {
Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
},
});
const response = await ollama.chat({
model: "gpt-oss:120b",
messages: [{ role: "user", content: "Explain quantum computing" }],
stream: true,
});
for await (const part of response) {
process.stdout.write(part.message.content);
}cURL
Сгенерируйте ответ через чат-API Ollama:
curl https://ollama.com/api/chat \
-H "Authorization: Bearer $OLLAMA_API_KEY" \
-d '{
"model": "gpt-oss:120b",
"messages": [{
"role": "user",
"content": "Why is the sky blue?"
}],
"stream": false
}'Только локальный режим
Ollama может работать в режиме только локального использования путём отключения функций облака Ollama.
Вывод моделей из эксплуатации
Ollama периодически прекращает поддержку и выводит из эксплуатации старые облачные модели по мере выхода новых и более качественных открытых моделей. Инструменты и приложения, использующие облачные модели Ollama, могут потребовать обновления для продолжения работы. Пользователи, которых это затрагивает, будут уведомлены заранее о прекращении поддержки и выводе моделей из эксплуатации. Информация о прекращении поддержки будет отправляться по электронной почте и публиковаться на сайте Ollama.
Вывод облачных моделей Ollama из эксплуатации не затрагивает локальные модели.
Предстоящие выводы из эксплуатации
| Дата вывода из эксплуатации | Модель | Рекомендуемая альтернатива |
|---|---|---|
| 15 июля 2026 г. | deepseek-v3.1:671b | deepseek-v4-flash |
| 15 июля 2026 г. | deepseek-v3.2 | deepseek-v4-flash |
| 15 июля 2026 г. | devstral-2:123b | mistral-large-3:675b |
| 15 июля 2026 г. | devstral-small-2:24b | |
| 15 июля 2026 г. | ministral-3:14b | |
| 15 июля 2026 г. | ministral-3:3b | |
| 15 июля 2026 г. | ministral-3:8b | |
| 15 июля 2026 г. | gemini-3-flash-preview | minimax-m3 |
| 15 июля 2026 г. | gemma3:12b | gemma4:31b |
| 15 июля 2026 г. | gemma3:27b | gemma4:31b |
| 15 июля 2026 г. | gemma3:4b | gemma4:31b |
| 15 июля 2026 г. | glm-4.7 | glm-5.2 |
| 15 июля 2026 г. | glm-5 | glm-5.2 |
| 15 июля 2026 г. | minimax-m2.1 | minimax-m3 |
| 15 июля 2026 г. | qwen3-coder-next | qwen3.5:397b |
| 15 июля 2026 г. | qwen3-coder:480b | qwen3.5:397b |
Прошедшие выводы из эксплуатации
30 июня 2026 г.
| Модель | Рекомендуемая альтернатива |
| --- | --- | --- |
| `rnj-1:8b` | |
16 июня 2026 г.
| Модель | Рекомендуемая альтернатива |
| --- | --- | --- |
| `kimi-k2-thinking` | `kimi-k2.6` |
| `kimi-k2:1t` | `kimi-k2.6` |
| `minimax-m2` | `minimax-m3` |
| `glm-4.6` | `glm-5.1` |
| `qwen3-next:80b` | `qwen3.5` |
| `qwen3-vl:235b` | `qwen3.5` |
| `qwen3-vl:235b-instruct` | `qwen3.5` |
| `cogito-2.1:671b` | `deepseek-v4-flash` |