Modelos de nube
Los modelos de nube de Ollama son un nuevo tipo de modelo en Ollama que se puede ejecutar sin una GPU potente. En su lugar, estos modelos se externalizan automáticamente al servicio en la nube de Ollama, al mismo tiempo que ofrecen las mismas capacidades que los modelos locales, lo que permite seguir usando tus herramientas locales mientras ejecutas modelos más grandes que no cabrían en un ordenador personal.
Modelos compatibles
Para ver una lista de los modelos compatibles, consulta la biblioteca de modelos de Ollama.
Ejecutar modelos de nube
Los modelos de nube de Ollama requieren una cuenta en ollama.com. Para iniciar sesión o crear una cuenta, ejecuta:
ollama signinCLI
Para ejecutar un modelo de nube, abre la terminal y ejecuta:
ollama run gpt-oss:120b-cloudPython
Primero, descarga un modelo de nube para que se pueda acceder a él:
ollama pull gpt-oss:120b-cloudA continuación, instala la biblioteca de Python de Ollama:
pip install ollamaA continuación, crea y ejecuta un script de Python sencillo:
python
from ollama import Client
client = Client()
messages = [
{
'role': 'user',
'content': 'Why is the sky blue?',
},
]
for part in client.chat('gpt-oss:120b-cloud', messages=messages, stream=True):
print(part['message']['content'], end='', flush=True)JavaScript
Primero, descarga un modelo de nube para que se pueda acceder a él:
ollama pull gpt-oss:120b-cloudA continuación, instala la biblioteca de JavaScript de Ollama:
npm i ollamaLuego usa la biblioteca para ejecutar un modelo de nube:
typescript
const ollama = new Ollama();
const response = await ollama.chat({
model: "gpt-oss:120b-cloud",
messages: [{ role: "user", content: "Explain quantum computing" }],
stream: true,
});
for await (const part of response) {
process.stdout.write(part.message.content);
}cURL
Primero, descarga un modelo de nube para que se pueda acceder a él:
ollama pull gpt-oss:120b-cloudEjecuta el siguiente comando de cURL para ejecutar el comando a través de la API de Ollama:
curl http://localhost:11434/api/chat -d '{
"model": "gpt-oss:120b-cloud",
"messages": [{
"role": "user",
"content": "Why is the sky blue?"
}],
"stream": false
}'Acceso a la API de nube
Los modelos de nube también se pueden acceder directamente a través de la API de ollama.com. En este modo, ollama.com actúa como un host remoto de Ollama.
Autenticación
Para acceder directamente a la API de ollama.com, primero crea una clave de API.
A continuación, establece la variable de entorno OLLAMA_API_KEY con tu clave de API.
export OLLAMA_API_KEY=your_api_keyListar modelos
Para los modelos disponibles directamente a través de la API de Ollama, se pueden listar mediante:
curl https://ollama.com/api/tagsGenerar una respuesta
Python
Primero, instala la biblioteca de Python de Ollama
pip install ollamaA continuación, realiza una solicitud
python
from ollama import Client
client = Client(
host="https://ollama.com",
headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)
messages = [
{
'role': 'user',
'content': 'Why is the sky blue?',
},
]
for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
print(part['message']['content'], end='', flush=True)JavaScript
Primero, instala la biblioteca de JavaScript de Ollama:
npm i ollamaA continuación, realiza una solicitud al modelo:
typescript
const ollama = new Ollama({
host: "https://ollama.com",
headers: {
Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
},
});
const response = await ollama.chat({
model: "gpt-oss:120b",
messages: [{ role: "user", content: "Explain quantum computing" }],
stream: true,
});
for await (const part of response) {
process.stdout.write(part.message.content);
}cURL
Genera una respuesta a través de la API de chat de Ollama:
curl https://ollama.com/api/chat \
-H "Authorization: Bearer $OLLAMA_API_KEY" \
-d '{
"model": "gpt-oss:120b",
"messages": [{
"role": "user",
"content": "Why is the sky blue?"
}],
"stream": false
}'Solo local
Ollama se puede ejecutar en modo solo local desactivando las funciones de la nube de Ollama.
Retiros
Ollama ocasionalmente marcará como obsoletos y retirará modelos de nube más antiguos a medida que se publiquen modelos de código abierto más nuevos y mejores. Las herramientas y aplicaciones que dependan de los modelos de nube de Ollama pueden necesitar actualizaciones para seguir funcionando. Los usuarios afectados recibirán una notificación con antelación a la obsolescencia y retiro de los modelos. Las obsolescencias se comunicarán por correo electrónico y en el sitio web de Ollama.
El retiro de modelos de nube de Ollama no afecta a los modelos locales.
Próximos retiros
| Fecha de retiro | Modelo | Alternativa recomendada |
|---|---|---|
| 15 de julio de 2026 | deepseek-v3.1:671b | deepseek-v4-flash |
| 15 de julio de 2026 | deepseek-v3.2 | deepseek-v4-flash |
| 15 de julio de 2026 | devstral-2:123b | mistral-large-3:675b |
| 15 de julio de 2026 | devstral-small-2:24b | |
| 15 de julio de 2026 | ministral-3:14b | |
| 15 de julio de 2026 | ministral-3:3b | |
| 15 de julio de 2026 | ministral-3:8b | |
| 15 de julio de 2026 | gemini-3-flash-preview | minimax-m3 |
| 15 de julio de 2026 | gemma3:12b | gemma4:31b |
| 15 de julio de 2026 | gemma3:27b | gemma4:31b |
| 15 de julio de 2026 | gemma3:4b | gemma4:31b |
| 15 de julio de 2026 | glm-4.7 | glm-5.2 |
| 15 de julio de 2026 | glm-5 | glm-5.2 |
| 15 de julio de 2026 | minimax-m2.1 | minimax-m3 |
| 15 de julio de 2026 | qwen3-coder-next | qwen3.5:397b |
| 15 de julio de 2026 | qwen3-coder:480b | qwen3.5:397b |
Retiros anteriores
30 de junio de 2026
| Modelo | Alternativa recomendada |
| --- | --- | --- |
| `rnj-1:8b` | |
16 de junio de 2026
| Modelo | Alternativa recomendada |
| --- | --- | --- |
| `kimi-k2-thinking` | `kimi-k2.6` |
| `kimi-k2:1t` | `kimi-k2.6` |
| `minimax-m2` | `minimax-m3` |
| `glm-4.6` | `glm-5.1` |
| `qwen3-next:80b` | `qwen3.5` |
| `qwen3-vl:235b` | `qwen3.5` |
| `qwen3-vl:235b-instruct` | `qwen3.5` |
| `cogito-2.1:671b` | `deepseek-v4-flash` |