Modelli Cloud
I modelli cloud di Ollama sono un nuovo tipo di modello che possono essere eseguiti senza una GPU potente. Invece, i modelli cloud vengono automaticamente scaricati sul servizio cloud di Ollama, offrendo le stesse capacità dei modelli locali e rendendo possibile continuare a utilizzare i tuoi strumenti locali mentre si eseguono modelli più grandi che non potrebbero essere eseguiti su un computer personale.
Modelli supportati
Per un elenco dei modelli supportati, consulta la libreria di modelli di Ollama.
Esecuzione dei modelli Cloud
I modelli cloud di Ollama richiedono un account su ollama.com. Per accedere o creare un account, esegui:
ollama signinCLI
Per eseguire un modello cloud, apri il terminale ed esegui:
ollama run gpt-oss:120b-cloudPython
Per prima cosa, scarica un modello cloud in modo che possa essere accessibile:
ollama pull gpt-oss:120b-cloudSuccessivamente, installa la libreria Python di Ollama:
pip install ollamaSuccessivamente, crea ed esegui un semplice script Python:
python
from ollama import Client
client = Client()
messages = [
{
'role': 'user',
'content': 'Why is the sky blue?',
},
]
for part in client.chat('gpt-oss:120b-cloud', messages=messages, stream=True):
print(part['message']['content'], end='', flush=True)JavaScript
Per prima cosa, scarica un modello cloud in modo che possa essere accessibile:
ollama pull gpt-oss:120b-cloudSuccessivamente, installa la libreria JavaScript di Ollama:
npm i ollamaQuindi utilizza la libreria per eseguire un modello cloud:
typescript
const ollama = new Ollama();
const response = await ollama.chat({
model: "gpt-oss:120b-cloud",
messages: [{ role: "user", content: "Explain quantum computing" }],
stream: true,
});
for await (const part of response) {
process.stdout.write(part.message.content);
}cURL
Per prima cosa, scarica un modello cloud in modo che possa essere accessibile:
ollama pull gpt-oss:120b-cloudEsegui il seguente comando cURL per avviare la richiesta tramite l'API di Ollama:
curl http://localhost:11434/api/chat -d '{
"model": "gpt-oss:120b-cloud",
"messages": [{
"role": "user",
"content": "Why is the sky blue?"
}],
"stream": false
}'Accesso all'API Cloud
I modelli cloud possono anche essere accessibili direttamente tramite l'API di ollama.com. In questa modalità, ollama.com funge da host Ollama remoto.
Autenticazione
Per l'accesso diretto all'API di ollama.com, crea prima una chiave API.
Successivamente, imposta la variabile d'ambiente OLLAMA_API_KEY con la tua chiave API.
export OLLAMA_API_KEY=your_api_keyElenco dei modelli
Per i modelli disponibili direttamente tramite l'API di Ollama, è possibile elencare i modelli tramite:
curl https://ollama.com/api/tagsGenerazione di una risposta
Python
Per prima cosa, installa la libreria Python di Ollama
pip install ollamaSuccessivamente, effettua una richiesta
python
from ollama import Client
client = Client(
host="https://ollama.com",
headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)
messages = [
{
'role': 'user',
'content': 'Why is the sky blue?',
},
]
for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
print(part['message']['content'], end='', flush=True)JavaScript
Per prima cosa, installa la libreria JavaScript di Ollama:
npm i ollamaSuccessivamente, effettua una richiesta al modello:
typescript
const ollama = new Ollama({
host: "https://ollama.com",
headers: {
Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
},
});
const response = await ollama.chat({
model: "gpt-oss:120b",
messages: [{ role: "user", content: "Explain quantum computing" }],
stream: true,
});
for await (const part of response) {
process.stdout.write(part.message.content);
}cURL
Genera una risposta tramite l'API di chat di Ollama:
curl https://ollama.com/api/chat \
-H "Authorization: Bearer $OLLAMA_API_KEY" \
-d '{
"model": "gpt-oss:120b",
"messages": [{
"role": "user",
"content": "Why is the sky blue?"
}],
"stream": false
}'Solo locale
Ollama può essere eseguito in modalità solo locale disabilitando il cloud di Ollama.
Ritiri dei modelli
Ollama deprecherà e ritirerà occasionalmente i modelli cloud più vecchi man mano che verranno rilasciati modelli open source più nuovi e migliori. Strumenti e applicazioni che dipendono dai modelli Ollama Cloud potrebbero dover essere aggiornati per continuare a funzionare. Gli utenti interessati verranno notificati in anticipo rispetto alla deprecazione e al ritiro dei modelli. Le deprecazioni verranno comunicate tramite email e sul sito web di Ollama.
Il ritiro dei modelli Ollama Cloud non influisce sui modelli locali.
Ritiri imminenti
| Data di ritiro | Modello | Alternativa consigliata |
|---|---|---|
| 15 luglio 2026 | deepseek-v3.1:671b | deepseek-v4-flash |
| 15 luglio 2026 | deepseek-v3.2 | deepseek-v4-flash |
| 15 luglio 2026 | devstral-2:123b | mistral-large-3:675b |
| 15 luglio 2026 | devstral-small-2:24b | |
| 15 luglio 2026 | ministral-3:14b | |
| 15 luglio 2026 | ministral-3:3b | |
| 15 luglio 2026 | ministral-3:8b | |
| 15 luglio 2026 | gemini-3-flash-preview | minimax-m3 |
| 15 luglio 2026 | gemma3:12b | gemma4:31b |
| 15 luglio 2026 | gemma3:27b | gemma4:31b |
| 15 luglio 2026 | gemma3:4b | gemma4:31b |
| 15 luglio 2026 | glm-4.7 | glm-5.2 |
| 15 luglio 2026 | glm-5 | glm-5.2 |
| 15 luglio 2026 | minimax-m2.1 | minimax-m3 |
| 15 luglio 2026 | qwen3-coder-next | qwen3.5:397b |
| 15 luglio 2026 | qwen3-coder:480b | qwen3.5:397b |
Ritiri passati
30 giugno 2026
| Modello | Alternativa consigliata |
| --- | --- |
| `rnj-1:8b` | |
16 giugno 2026
| Modello | Alternativa consigliata |
| --- | --- |
| `kimi-k2-thinking` | `kimi-k2.6` |
| `kimi-k2:1t` | `kimi-k2.6` |
| `minimax-m2` | `minimax-m3` |
| `glm-4.6` | `glm-5.1` |
| `qwen3-next:80b` | `qwen3.5` |
| `qwen3-vl:235b` | `qwen3.5` |
| `qwen3-vl:235b-instruct` | `qwen3.5` |
| `cogito-2.1:671b` | `deepseek-v4-flash` |