Skip to content

Modelli Cloud ​

I modelli cloud di Ollama sono un nuovo tipo di modello che possono essere eseguiti senza una GPU potente. Invece, i modelli cloud vengono automaticamente scaricati sul servizio cloud di Ollama, offrendo le stesse capacità dei modelli locali e rendendo possibile continuare a utilizzare i tuoi strumenti locali mentre si eseguono modelli più grandi che non potrebbero essere eseguiti su un computer personale.

Modelli supportati ​

Per un elenco dei modelli supportati, consulta la libreria di modelli di Ollama.

Esecuzione dei modelli Cloud ​

I modelli cloud di Ollama richiedono un account su ollama.com. Per accedere o creare un account, esegui:

ollama signin

CLI ​

Per eseguire un modello cloud, apri il terminale ed esegui:

ollama run gpt-oss:120b-cloud

Python ​

Per prima cosa, scarica un modello cloud in modo che possa essere accessibile:

ollama pull gpt-oss:120b-cloud

Successivamente, installa la libreria Python di Ollama:

pip install ollama

Successivamente, crea ed esegui un semplice script Python:

python
from ollama import Client

client = Client()

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b-cloud', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript ​

Per prima cosa, scarica un modello cloud in modo che possa essere accessibile:

ollama pull gpt-oss:120b-cloud

Successivamente, installa la libreria JavaScript di Ollama:

npm i ollama

Quindi utilizza la libreria per eseguire un modello cloud:

typescript


const ollama = new Ollama();

const response = await ollama.chat({
  model: "gpt-oss:120b-cloud",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL ​

Per prima cosa, scarica un modello cloud in modo che possa essere accessibile:

ollama pull gpt-oss:120b-cloud

Esegui il seguente comando cURL per avviare la richiesta tramite l'API di Ollama:

curl http://localhost:11434/api/chat -d '{
  "model": "gpt-oss:120b-cloud",
  "messages": [{
    "role": "user",
    "content": "Why is the sky blue?"
  }],
  "stream": false
}'

Accesso all'API Cloud ​

I modelli cloud possono anche essere accessibili direttamente tramite l'API di ollama.com. In questa modalità, ollama.com funge da host Ollama remoto.

Autenticazione ​

Per l'accesso diretto all'API di ollama.com, crea prima una chiave API.

Successivamente, imposta la variabile d'ambiente OLLAMA_API_KEY con la tua chiave API.

export OLLAMA_API_KEY=your_api_key

Elenco dei modelli ​

Per i modelli disponibili direttamente tramite l'API di Ollama, è possibile elencare i modelli tramite:

curl https://ollama.com/api/tags

Generazione di una risposta ​

Python ​

Per prima cosa, installa la libreria Python di Ollama

pip install ollama

Successivamente, effettua una richiesta

python

from ollama import Client

client = Client(
    host="https://ollama.com",
    headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript ​

Per prima cosa, installa la libreria JavaScript di Ollama:

npm i ollama

Successivamente, effettua una richiesta al modello:

typescript


const ollama = new Ollama({
  host: "https://ollama.com",
  headers: {
    Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
  },
});

const response = await ollama.chat({
  model: "gpt-oss:120b",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL ​

Genera una risposta tramite l'API di chat di Ollama:

curl https://ollama.com/api/chat \
  -H "Authorization: Bearer $OLLAMA_API_KEY" \
  -d '{
    "model": "gpt-oss:120b",
    "messages": [{
      "role": "user",
      "content": "Why is the sky blue?"
    }],
    "stream": false
  }'

Solo locale ​

Ollama può essere eseguito in modalità solo locale disabilitando il cloud di Ollama.

Ritiri dei modelli ​

Ollama deprecherà e ritirerà occasionalmente i modelli cloud più vecchi man mano che verranno rilasciati modelli open source più nuovi e migliori. Strumenti e applicazioni che dipendono dai modelli Ollama Cloud potrebbero dover essere aggiornati per continuare a funzionare. Gli utenti interessati verranno notificati in anticipo rispetto alla deprecazione e al ritiro dei modelli. Le deprecazioni verranno comunicate tramite email e sul sito web di Ollama.

Il ritiro dei modelli Ollama Cloud non influisce sui modelli locali.

Ritiri imminenti ​

Data di ritiroModelloAlternativa consigliata
15 luglio 2026deepseek-v3.1:671bdeepseek-v4-flash
15 luglio 2026deepseek-v3.2deepseek-v4-flash
15 luglio 2026devstral-2:123bmistral-large-3:675b
15 luglio 2026devstral-small-2:24b
15 luglio 2026ministral-3:14b
15 luglio 2026ministral-3:3b
15 luglio 2026ministral-3:8b
15 luglio 2026gemini-3-flash-previewminimax-m3
15 luglio 2026gemma3:12bgemma4:31b
15 luglio 2026gemma3:27bgemma4:31b
15 luglio 2026gemma3:4bgemma4:31b
15 luglio 2026glm-4.7glm-5.2
15 luglio 2026glm-5glm-5.2
15 luglio 2026minimax-m2.1minimax-m3
15 luglio 2026qwen3-coder-nextqwen3.5:397b
15 luglio 2026qwen3-coder:480bqwen3.5:397b

Ritiri passati ​

30 giugno 2026
| Modello | Alternativa consigliata |
| --- | --- |
| `rnj-1:8b` |  |
16 giugno 2026
| Modello | Alternativa consigliata |
| --- | --- |
| `kimi-k2-thinking` | `kimi-k2.6` |
| `kimi-k2:1t` | `kimi-k2.6` |
| `minimax-m2`  | `minimax-m3` |
| `glm-4.6` | `glm-5.1` |
| `qwen3-next:80b` | `qwen3.5` |
| `qwen3-vl:235b` | `qwen3.5` |
| `qwen3-vl:235b-instruct` | `qwen3.5` |
| `cogito-2.1:671b` | `deepseek-v4-flash` |