Skip to content

Modelli Cloud

I modelli cloud di Ollama sono un nuovo tipo di modello che possono essere eseguiti senza una GPU potente. Invece, i modelli cloud vengono automaticamente scaricati sul servizio cloud di Ollama, offrendo le stesse capacità dei modelli locali e rendendo possibile continuare a utilizzare i tuoi strumenti locali mentre si eseguono modelli più grandi che non potrebbero essere eseguiti su un computer personale.

Modelli supportati

Per un elenco dei modelli supportati, consulta la libreria di modelli di Ollama.

Esecuzione dei modelli Cloud

I modelli cloud di Ollama richiedono un account su ollama.com. Per accedere o creare un account, esegui:

ollama signin

CLI

Per eseguire un modello cloud, apri il terminale ed esegui:

ollama run gpt-oss:120b-cloud

Python

Per prima cosa, scarica un modello cloud in modo che possa essere accessibile:

ollama pull gpt-oss:120b-cloud

Successivamente, installa la libreria Python di Ollama:

pip install ollama

Successivamente, crea ed esegui un semplice script Python:

python
from ollama import Client

client = Client()

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b-cloud', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript

Per prima cosa, scarica un modello cloud in modo che possa essere accessibile:

ollama pull gpt-oss:120b-cloud

Successivamente, installa la libreria JavaScript di Ollama:

npm i ollama

Quindi utilizza la libreria per eseguire un modello cloud:

typescript


const ollama = new Ollama();

const response = await ollama.chat({
  model: "gpt-oss:120b-cloud",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL

Per prima cosa, scarica un modello cloud in modo che possa essere accessibile:

ollama pull gpt-oss:120b-cloud

Esegui il seguente comando cURL per avviare la richiesta tramite l'API di Ollama:

curl http://localhost:11434/api/chat -d '{
  "model": "gpt-oss:120b-cloud",
  "messages": [{
    "role": "user",
    "content": "Why is the sky blue?"
  }],
  "stream": false
}'

Accesso all'API Cloud

I modelli cloud possono anche essere accessibili direttamente tramite l'API di ollama.com. In questa modalità, ollama.com funge da host Ollama remoto.

Autenticazione

Per l'accesso diretto all'API di ollama.com, crea prima una chiave API.

Successivamente, imposta la variabile d'ambiente OLLAMA_API_KEY con la tua chiave API.

export OLLAMA_API_KEY=your_api_key

Elenco dei modelli

Per i modelli disponibili direttamente tramite l'API di Ollama, è possibile elencare i modelli tramite:

curl https://ollama.com/api/tags

Generazione di una risposta

Python

Per prima cosa, installa la libreria Python di Ollama

pip install ollama

Successivamente, effettua una richiesta

python

from ollama import Client

client = Client(
    host="https://ollama.com",
    headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript

Per prima cosa, installa la libreria JavaScript di Ollama:

npm i ollama

Successivamente, effettua una richiesta al modello:

typescript


const ollama = new Ollama({
  host: "https://ollama.com",
  headers: {
    Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
  },
});

const response = await ollama.chat({
  model: "gpt-oss:120b",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL

Genera una risposta tramite l'API di chat di Ollama:

curl https://ollama.com/api/chat \
  -H "Authorization: Bearer $OLLAMA_API_KEY" \
  -d '{
    "model": "gpt-oss:120b",
    "messages": [{
      "role": "user",
      "content": "Why is the sky blue?"
    }],
    "stream": false
  }'

Solo locale

Ollama può essere eseguito in modalità solo locale disabilitando il cloud di Ollama.

Ritiri dei modelli

Ollama deprecherà e ritirerà occasionalmente i modelli cloud più vecchi man mano che verranno rilasciati modelli open source più nuovi e migliori. Strumenti e applicazioni che dipendono dai modelli Ollama Cloud potrebbero dover essere aggiornati per continuare a funzionare. Gli utenti interessati verranno notificati in anticipo rispetto alla deprecazione e al ritiro dei modelli. Le deprecazioni verranno comunicate tramite email e sul sito web di Ollama.

Il ritiro dei modelli Ollama Cloud non influisce sui modelli locali.

Ritiri imminenti

Data di ritiroModelloAlternativa consigliata
15 luglio 2026deepseek-v3.1:671bdeepseek-v4-flash
15 luglio 2026deepseek-v3.2deepseek-v4-flash
15 luglio 2026devstral-2:123bmistral-large-3:675b
15 luglio 2026devstral-small-2:24b
15 luglio 2026ministral-3:14b
15 luglio 2026ministral-3:3b
15 luglio 2026ministral-3:8b
15 luglio 2026gemini-3-flash-previewminimax-m3
15 luglio 2026gemma3:12bgemma4:31b
15 luglio 2026gemma3:27bgemma4:31b
15 luglio 2026gemma3:4bgemma4:31b
15 luglio 2026glm-4.7glm-5.2
15 luglio 2026glm-5glm-5.2
15 luglio 2026minimax-m2.1minimax-m3
15 luglio 2026qwen3-coder-nextqwen3.5:397b
15 luglio 2026qwen3-coder:480bqwen3.5:397b

Ritiri passati

30 giugno 2026
| Modello | Alternativa consigliata |
| --- | --- |
| `rnj-1:8b` |  |
16 giugno 2026
| Modello | Alternativa consigliata |
| --- | --- |
| `kimi-k2-thinking` | `kimi-k2.6` |
| `kimi-k2:1t` | `kimi-k2.6` |
| `minimax-m2`  | `minimax-m3` |
| `glm-4.6` | `glm-5.1` |
| `qwen3-next:80b` | `qwen3.5` |
| `qwen3-vl:235b` | `qwen3.5` |
| `qwen3-vl:235b-instruct` | `qwen3.5` |
| `cogito-2.1:671b` | `deepseek-v4-flash` |