Modele chmurowe
Modele chmurowe Ollamy to nowy typ modeli w Ollamie, które można uruchomić bez potężnej karty GPU. Zamiast tego modele chmurowe są automatycznie przenoszone do usługi chmurowej Ollamy, oferując jednocześnie takie same możliwości jak modele lokalne. Dzięki temu można nadal korzystać z lokalnych narzędzi podczas uruchamiania większych modeli, które nie zmieściłyby się na komputerze osobistym.
Obsługiwane modele
Listę obsługiwanych modeli znajdziesz w bibliotece modeli Ollamy.
Uruchamianie modeli chmurowych
Modele chmurowe Ollamy wymagają konta na ollama.com. Aby się zalogować lub utworzyć konto, uruchom polecenie:
ollama signinCLI
Aby uruchomić model chmurowy, otwórz terminal i uruchom polecenie:
ollama run gpt-oss:120b-cloudPython
Najpierw pobierz model chmurowy, aby móc go użyć:
ollama pull gpt-oss:120b-cloudNastępnie zainstaluj bibliotekę Pythona dla Ollamy:
pip install ollamaNastępnie utwórz i uruchom prosty skrypt w Pythonie:
python
from ollama import Client
client = Client()
messages = [
{
'role': 'user',
'content': 'Why is the sky blue?',
},
]
for part in client.chat('gpt-oss:120b-cloud', messages=messages, stream=True):
print(part['message']['content'], end='', flush=True)JavaScript
Najpierw pobierz model chmurowy, aby móc go użyć:
ollama pull gpt-oss:120b-cloudNastępnie zainstaluj bibliotekę JavaScript dla Ollamy:
npm i ollamaNastępnie użyj biblioteki do uruchomienia modelu chmurowego:
typescript
const ollama = new Ollama();
const response = await ollama.chat({
model: "gpt-oss:120b-cloud",
messages: [{ role: "user", content: "Explain quantum computing" }],
stream: true,
});
for await (const part of response) {
process.stdout.write(part.message.content);
}cURL
Najpierw pobierz model chmurowy, aby móc go użyć:
ollama pull gpt-oss:120b-cloudUruchom poniższe polecenie cURL, aby wywołać model za pośrednictwem API Ollamy:
curl http://localhost:11434/api/chat -d '{
"model": "gpt-oss:120b-cloud",
"messages": [{
"role": "user",
"content": "Why is the sky blue?"
}],
"stream": false
}'Dostęp do API chmurowego
Modele chmurowe można również uzyskać bezpośrednio za pośrednictwem API strony ollama.com. W tym trybie ollama.com działa jako zdalny host Ollamy.
Uwierzytelnianie
Aby uzyskać bezpośredni dostęp do API ollama.com, najpierw utwórz klucz API.
Następnie ustaw zmienną środowiskową OLLAMA_API_KEY na wartość swojego klucza API.
export OLLAMA_API_KEY=your_api_keyWyświetlanie listy modeli
Modele dostępne bezpośrednio za pośrednictwem API Ollamy można wyświetlić za pomocą:
curl https://ollama.com/api/tagsGenerowanie odpowiedzi
Python
Najpierw zainstaluj bibliotekę Pythona dla Ollamy
pip install ollamaNastępnie wyślij żądanie
python
from ollama import Client
client = Client(
host="https://ollama.com",
headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)
messages = [
{
'role': 'user',
'content': 'Why is the sky blue?',
},
]
for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
print(part['message']['content'], end='', flush=True)JavaScript
Najpierw zainstaluj bibliotekę JavaScript dla Ollamy:
npm i ollamaNastępnie wyślij żądanie do modelu:
typescript
const ollama = new Ollama({
host: "https://ollama.com",
headers: {
Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
},
});
const response = await ollama.chat({
model: "gpt-oss:120b",
messages: [{ role: "user", content: "Explain quantum computing" }],
stream: true,
});
for await (const part of response) {
process.stdout.write(part.message.content);
}cURL
Wygeneruj odpowiedź za pośrednictwem czatu API Ollamy:
curl https://ollama.com/api/chat \
-H "Authorization: Bearer $OLLAMA_API_KEY" \
-d '{
"model": "gpt-oss:120b",
"messages": [{
"role": "user",
"content": "Why is the sky blue?"
}],
"stream": false
}'Tylko lokalnie
Ollama może działać w trybie tylko lokalnym po wyłączeniu funkcji chmurowych Ollamy.
Wycofania modeli
Ollama od czasu do czasu deprecjonuje i wycofuje starsze modele chmurowe, gdy pojawiają się nowsze i lepsze modele open-source. Narzędzia i aplikacje korzystające z modeli chmurowych Ollamy mogą wymagać aktualizacji, aby nadal działać. Użytkownicy, których dotyczy wycofanie, zostaną powiadomieni z wyprzedzeniem o deprecjacji i wycofaniu modeli. Informacje o deprecjach są przekazywane za pośrednictwem poczty e-mail oraz na stronie internetowej Ollamy.
Wycofanie modeli chmurowych Ollamy nie dotyczy modeli lokalnych.
Nadchodzące wycofania
| Data wycofania | Model | Zalecana alternatywa |
|---|---|---|
| 15 lipca 2026 | deepseek-v3.1:671b | deepseek-v4-flash |
| 15 lipca 2026 | deepseek-v3.2 | deepseek-v4-flash |
| 15 lipca 2026 | devstral-2:123b | mistral-large-3:675b |
| 15 lipca 2026 | devstral-small-2:24b | |
| 15 lipca 2026 | ministral-3:14b | |
| 15 lipca 2026 | ministral-3:3b | |
| 15 lipca 2026 | ministral-3:8b | |
| 15 lipca 2026 | gemini-3-flash-preview | minimax-m3 |
| 15 lipca 2026 | gemma3:12b | gemma4:31b |
| 15 lipca 2026 | gemma3:27b | gemma4:31b |
| 15 lipca 2026 | gemma3:4b | gemma4:31b |
| 15 lipca 2026 | glm-4.7 | glm-5.2 |
| 15 lipca 2026 | glm-5 | glm-5.2 |
| 15 lipca 2026 | minimax-m2.1 | minimax-m3 |
| 15 lipca 2026 | qwen3-coder-next | qwen3.5:397b |
| 15 lipca 2026 | qwen3-coder:480b | qwen3.5:397b |
Poprzednie wycofania
30 czerwca 2026
| Model | Zalecana alternatywa |
| --- | --- |
| `rnj-1:8b` | |
16 czerwca 2026
| Model | Zalecana alternatywa |
| --- | --- |
| `kimi-k2-thinking` | `kimi-k2.6` |
| `kimi-k2:1t` | `kimi-k2.6` |
| `minimax-m2` | `minimax-m3` |
| `glm-4.6` | `glm-5.1` |
| `qwen3-next:80b` | `qwen3.5` |
| `qwen3-vl:235b` | `qwen3.5` |
| `qwen3-vl:235b-instruct` | `qwen3.5` |
| `cogito-2.1:671b` | `deepseek-v4-flash` |