Skip to content

Modele chmurowe

Modele chmurowe Ollamy to nowy typ modeli w Ollamie, które można uruchomić bez potężnej karty GPU. Zamiast tego modele chmurowe są automatycznie przenoszone do usługi chmurowej Ollamy, oferując jednocześnie takie same możliwości jak modele lokalne. Dzięki temu można nadal korzystać z lokalnych narzędzi podczas uruchamiania większych modeli, które nie zmieściłyby się na komputerze osobistym.

Obsługiwane modele

Listę obsługiwanych modeli znajdziesz w bibliotece modeli Ollamy.

Uruchamianie modeli chmurowych

Modele chmurowe Ollamy wymagają konta na ollama.com. Aby się zalogować lub utworzyć konto, uruchom polecenie:

ollama signin

CLI

Aby uruchomić model chmurowy, otwórz terminal i uruchom polecenie:

ollama run gpt-oss:120b-cloud

Python

Najpierw pobierz model chmurowy, aby móc go użyć:

ollama pull gpt-oss:120b-cloud

Następnie zainstaluj bibliotekę Pythona dla Ollamy:

pip install ollama

Następnie utwórz i uruchom prosty skrypt w Pythonie:

python
from ollama import Client

client = Client()

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b-cloud', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript

Najpierw pobierz model chmurowy, aby móc go użyć:

ollama pull gpt-oss:120b-cloud

Następnie zainstaluj bibliotekę JavaScript dla Ollamy:

npm i ollama

Następnie użyj biblioteki do uruchomienia modelu chmurowego:

typescript


const ollama = new Ollama();

const response = await ollama.chat({
  model: "gpt-oss:120b-cloud",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL

Najpierw pobierz model chmurowy, aby móc go użyć:

ollama pull gpt-oss:120b-cloud

Uruchom poniższe polecenie cURL, aby wywołać model za pośrednictwem API Ollamy:

curl http://localhost:11434/api/chat -d '{
  "model": "gpt-oss:120b-cloud",
  "messages": [{
    "role": "user",
    "content": "Why is the sky blue?"
  }],
  "stream": false
}'

Dostęp do API chmurowego

Modele chmurowe można również uzyskać bezpośrednio za pośrednictwem API strony ollama.com. W tym trybie ollama.com działa jako zdalny host Ollamy.

Uwierzytelnianie

Aby uzyskać bezpośredni dostęp do API ollama.com, najpierw utwórz klucz API.

Następnie ustaw zmienną środowiskową OLLAMA_API_KEY na wartość swojego klucza API.

export OLLAMA_API_KEY=your_api_key

Wyświetlanie listy modeli

Modele dostępne bezpośrednio za pośrednictwem API Ollamy można wyświetlić za pomocą:

curl https://ollama.com/api/tags

Generowanie odpowiedzi

Python

Najpierw zainstaluj bibliotekę Pythona dla Ollamy

pip install ollama

Następnie wyślij żądanie

python

from ollama import Client

client = Client(
    host="https://ollama.com",
    headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript

Najpierw zainstaluj bibliotekę JavaScript dla Ollamy:

npm i ollama

Następnie wyślij żądanie do modelu:

typescript


const ollama = new Ollama({
  host: "https://ollama.com",
  headers: {
    Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
  },
});

const response = await ollama.chat({
  model: "gpt-oss:120b",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL

Wygeneruj odpowiedź za pośrednictwem czatu API Ollamy:

curl https://ollama.com/api/chat \
  -H "Authorization: Bearer $OLLAMA_API_KEY" \
  -d '{
    "model": "gpt-oss:120b",
    "messages": [{
      "role": "user",
      "content": "Why is the sky blue?"
    }],
    "stream": false
  }'

Tylko lokalnie

Ollama może działać w trybie tylko lokalnym po wyłączeniu funkcji chmurowych Ollamy.

Wycofania modeli

Ollama od czasu do czasu deprecjonuje i wycofuje starsze modele chmurowe, gdy pojawiają się nowsze i lepsze modele open-source. Narzędzia i aplikacje korzystające z modeli chmurowych Ollamy mogą wymagać aktualizacji, aby nadal działać. Użytkownicy, których dotyczy wycofanie, zostaną powiadomieni z wyprzedzeniem o deprecjacji i wycofaniu modeli. Informacje o deprecjach są przekazywane za pośrednictwem poczty e-mail oraz na stronie internetowej Ollamy.

Wycofanie modeli chmurowych Ollamy nie dotyczy modeli lokalnych.

Nadchodzące wycofania

Data wycofaniaModelZalecana alternatywa
15 lipca 2026deepseek-v3.1:671bdeepseek-v4-flash
15 lipca 2026deepseek-v3.2deepseek-v4-flash
15 lipca 2026devstral-2:123bmistral-large-3:675b
15 lipca 2026devstral-small-2:24b
15 lipca 2026ministral-3:14b
15 lipca 2026ministral-3:3b
15 lipca 2026ministral-3:8b
15 lipca 2026gemini-3-flash-previewminimax-m3
15 lipca 2026gemma3:12bgemma4:31b
15 lipca 2026gemma3:27bgemma4:31b
15 lipca 2026gemma3:4bgemma4:31b
15 lipca 2026glm-4.7glm-5.2
15 lipca 2026glm-5glm-5.2
15 lipca 2026minimax-m2.1minimax-m3
15 lipca 2026qwen3-coder-nextqwen3.5:397b
15 lipca 2026qwen3-coder:480bqwen3.5:397b

Poprzednie wycofania

30 czerwca 2026
| Model | Zalecana alternatywa |
| --- | --- |
| `rnj-1:8b` | |
16 czerwca 2026
| Model | Zalecana alternatywa |
| --- | --- |
| `kimi-k2-thinking` | `kimi-k2.6` |
| `kimi-k2:1t` | `kimi-k2.6` |
| `minimax-m2`  | `minimax-m3` |
| `glm-4.6` | `glm-5.1` |
| `qwen3-next:80b` | `qwen3.5` |
| `qwen3-vl:235b` | `qwen3.5` |
| `qwen3-vl:235b-instruct` | `qwen3.5` |
| `cogito-2.1:671b` | `deepseek-v4-flash` |