Skip to content

Modele chmurowe ​

Modele chmurowe Ollamy to nowy typ modeli w Ollamie, które można uruchomić bez potężnej karty GPU. Zamiast tego modele chmurowe są automatycznie przenoszone do usługi chmurowej Ollamy, oferując jednocześnie takie same możliwości jak modele lokalne. Dzięki temu można nadal korzystać z lokalnych narzędzi podczas uruchamiania większych modeli, które nie zmieściłyby się na komputerze osobistym.

Obsługiwane modele ​

Listę obsługiwanych modeli znajdziesz w bibliotece modeli Ollamy.

Uruchamianie modeli chmurowych ​

Modele chmurowe Ollamy wymagają konta na ollama.com. Aby się zalogować lub utworzyć konto, uruchom polecenie:

ollama signin

CLI ​

Aby uruchomić model chmurowy, otwórz terminal i uruchom polecenie:

ollama run gpt-oss:120b-cloud

Python ​

Najpierw pobierz model chmurowy, aby móc go użyć:

ollama pull gpt-oss:120b-cloud

Następnie zainstaluj bibliotekę Pythona dla Ollamy:

pip install ollama

Następnie utwórz i uruchom prosty skrypt w Pythonie:

python
from ollama import Client

client = Client()

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b-cloud', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript ​

Najpierw pobierz model chmurowy, aby móc go użyć:

ollama pull gpt-oss:120b-cloud

Następnie zainstaluj bibliotekę JavaScript dla Ollamy:

npm i ollama

Następnie użyj biblioteki do uruchomienia modelu chmurowego:

typescript


const ollama = new Ollama();

const response = await ollama.chat({
  model: "gpt-oss:120b-cloud",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL ​

Najpierw pobierz model chmurowy, aby móc go użyć:

ollama pull gpt-oss:120b-cloud

Uruchom poniższe polecenie cURL, aby wywołać model za pośrednictwem API Ollamy:

curl http://localhost:11434/api/chat -d '{
  "model": "gpt-oss:120b-cloud",
  "messages": [{
    "role": "user",
    "content": "Why is the sky blue?"
  }],
  "stream": false
}'

Dostęp do API chmurowego ​

Modele chmurowe można również uzyskać bezpośrednio za pośrednictwem API strony ollama.com. W tym trybie ollama.com działa jako zdalny host Ollamy.

Uwierzytelnianie ​

Aby uzyskać bezpośredni dostęp do API ollama.com, najpierw utwórz klucz API.

Następnie ustaw zmienną środowiskową OLLAMA_API_KEY na wartość swojego klucza API.

export OLLAMA_API_KEY=your_api_key

Wyświetlanie listy modeli ​

Modele dostępne bezpośrednio za pośrednictwem API Ollamy można wyświetlić za pomocą:

curl https://ollama.com/api/tags

Generowanie odpowiedzi ​

Python ​

Najpierw zainstaluj bibliotekę Pythona dla Ollamy

pip install ollama

Następnie wyślij żądanie

python

from ollama import Client

client = Client(
    host="https://ollama.com",
    headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript ​

Najpierw zainstaluj bibliotekę JavaScript dla Ollamy:

npm i ollama

Następnie wyślij żądanie do modelu:

typescript


const ollama = new Ollama({
  host: "https://ollama.com",
  headers: {
    Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
  },
});

const response = await ollama.chat({
  model: "gpt-oss:120b",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL ​

Wygeneruj odpowiedź za pośrednictwem czatu API Ollamy:

curl https://ollama.com/api/chat \
  -H "Authorization: Bearer $OLLAMA_API_KEY" \
  -d '{
    "model": "gpt-oss:120b",
    "messages": [{
      "role": "user",
      "content": "Why is the sky blue?"
    }],
    "stream": false
  }'

Tylko lokalnie ​

Ollama może działać w trybie tylko lokalnym po wyłączeniu funkcji chmurowych Ollamy.

Wycofania modeli ​

Ollama od czasu do czasu deprecjonuje i wycofuje starsze modele chmurowe, gdy pojawiają się nowsze i lepsze modele open-source. Narzędzia i aplikacje korzystające z modeli chmurowych Ollamy mogą wymagać aktualizacji, aby nadal działać. Użytkownicy, których dotyczy wycofanie, zostaną powiadomieni z wyprzedzeniem o deprecjacji i wycofaniu modeli. Informacje o deprecjach są przekazywane za pośrednictwem poczty e-mail oraz na stronie internetowej Ollamy.

Wycofanie modeli chmurowych Ollamy nie dotyczy modeli lokalnych.

Nadchodzące wycofania ​

Data wycofaniaModelZalecana alternatywa
15 lipca 2026deepseek-v3.1:671bdeepseek-v4-flash
15 lipca 2026deepseek-v3.2deepseek-v4-flash
15 lipca 2026devstral-2:123bmistral-large-3:675b
15 lipca 2026devstral-small-2:24b
15 lipca 2026ministral-3:14b
15 lipca 2026ministral-3:3b
15 lipca 2026ministral-3:8b
15 lipca 2026gemini-3-flash-previewminimax-m3
15 lipca 2026gemma3:12bgemma4:31b
15 lipca 2026gemma3:27bgemma4:31b
15 lipca 2026gemma3:4bgemma4:31b
15 lipca 2026glm-4.7glm-5.2
15 lipca 2026glm-5glm-5.2
15 lipca 2026minimax-m2.1minimax-m3
15 lipca 2026qwen3-coder-nextqwen3.5:397b
15 lipca 2026qwen3-coder:480bqwen3.5:397b

Poprzednie wycofania ​

30 czerwca 2026
| Model | Zalecana alternatywa |
| --- | --- |
| `rnj-1:8b` | |
16 czerwca 2026
| Model | Zalecana alternatywa |
| --- | --- |
| `kimi-k2-thinking` | `kimi-k2.6` |
| `kimi-k2:1t` | `kimi-k2.6` |
| `minimax-m2`  | `minimax-m3` |
| `glm-4.6` | `glm-5.1` |
| `qwen3-next:80b` | `qwen3.5` |
| `qwen3-vl:235b` | `qwen3.5` |
| `qwen3-vl:235b-instruct` | `qwen3.5` |
| `cogito-2.1:671b` | `deepseek-v4-flash` |