Skip to content

Modelos de nube

Los modelos de nube de Ollama son un nuevo tipo de modelo en Ollama que se puede ejecutar sin una GPU potente. En su lugar, estos modelos se externalizan automáticamente al servicio en la nube de Ollama, al mismo tiempo que ofrecen las mismas capacidades que los modelos locales, lo que permite seguir usando tus herramientas locales mientras ejecutas modelos más grandes que no cabrían en un ordenador personal.

Modelos compatibles

Para ver una lista de los modelos compatibles, consulta la biblioteca de modelos de Ollama.

Ejecutar modelos de nube

Los modelos de nube de Ollama requieren una cuenta en ollama.com. Para iniciar sesión o crear una cuenta, ejecuta:

ollama signin

CLI

Para ejecutar un modelo de nube, abre la terminal y ejecuta:

ollama run gpt-oss:120b-cloud

Python

Primero, descarga un modelo de nube para que se pueda acceder a él:

ollama pull gpt-oss:120b-cloud

A continuación, instala la biblioteca de Python de Ollama:

pip install ollama

A continuación, crea y ejecuta un script de Python sencillo:

python
from ollama import Client

client = Client()

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b-cloud', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript

Primero, descarga un modelo de nube para que se pueda acceder a él:

ollama pull gpt-oss:120b-cloud

A continuación, instala la biblioteca de JavaScript de Ollama:

npm i ollama

Luego usa la biblioteca para ejecutar un modelo de nube:

typescript


const ollama = new Ollama();

const response = await ollama.chat({
  model: "gpt-oss:120b-cloud",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL

Primero, descarga un modelo de nube para que se pueda acceder a él:

ollama pull gpt-oss:120b-cloud

Ejecuta el siguiente comando de cURL para ejecutar el comando a través de la API de Ollama:

curl http://localhost:11434/api/chat -d '{
  "model": "gpt-oss:120b-cloud",
  "messages": [{
    "role": "user",
    "content": "Why is the sky blue?"
  }],
  "stream": false
}'

Acceso a la API de nube

Los modelos de nube también se pueden acceder directamente a través de la API de ollama.com. En este modo, ollama.com actúa como un host remoto de Ollama.

Autenticación

Para acceder directamente a la API de ollama.com, primero crea una clave de API.

A continuación, establece la variable de entorno OLLAMA_API_KEY con tu clave de API.

export OLLAMA_API_KEY=your_api_key

Listar modelos

Para los modelos disponibles directamente a través de la API de Ollama, se pueden listar mediante:

curl https://ollama.com/api/tags

Generar una respuesta

Python

Primero, instala la biblioteca de Python de Ollama

pip install ollama

A continuación, realiza una solicitud

python

from ollama import Client

client = Client(
    host="https://ollama.com",
    headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript

Primero, instala la biblioteca de JavaScript de Ollama:

npm i ollama

A continuación, realiza una solicitud al modelo:

typescript


const ollama = new Ollama({
  host: "https://ollama.com",
  headers: {
    Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
  },
});

const response = await ollama.chat({
  model: "gpt-oss:120b",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL

Genera una respuesta a través de la API de chat de Ollama:

curl https://ollama.com/api/chat \
  -H "Authorization: Bearer $OLLAMA_API_KEY" \
  -d '{
    "model": "gpt-oss:120b",
    "messages": [{
      "role": "user",
      "content": "Why is the sky blue?"
    }],
    "stream": false
  }'

Solo local

Ollama se puede ejecutar en modo solo local desactivando las funciones de la nube de Ollama.

Retiros

Ollama ocasionalmente marcará como obsoletos y retirará modelos de nube más antiguos a medida que se publiquen modelos de código abierto más nuevos y mejores. Las herramientas y aplicaciones que dependan de los modelos de nube de Ollama pueden necesitar actualizaciones para seguir funcionando. Los usuarios afectados recibirán una notificación con antelación a la obsolescencia y retiro de los modelos. Las obsolescencias se comunicarán por correo electrónico y en el sitio web de Ollama.

El retiro de modelos de nube de Ollama no afecta a los modelos locales.

Próximos retiros

Fecha de retiroModeloAlternativa recomendada
15 de julio de 2026deepseek-v3.1:671bdeepseek-v4-flash
15 de julio de 2026deepseek-v3.2deepseek-v4-flash
15 de julio de 2026devstral-2:123bmistral-large-3:675b
15 de julio de 2026devstral-small-2:24b
15 de julio de 2026ministral-3:14b
15 de julio de 2026ministral-3:3b
15 de julio de 2026ministral-3:8b
15 de julio de 2026gemini-3-flash-previewminimax-m3
15 de julio de 2026gemma3:12bgemma4:31b
15 de julio de 2026gemma3:27bgemma4:31b
15 de julio de 2026gemma3:4bgemma4:31b
15 de julio de 2026glm-4.7glm-5.2
15 de julio de 2026glm-5glm-5.2
15 de julio de 2026minimax-m2.1minimax-m3
15 de julio de 2026qwen3-coder-nextqwen3.5:397b
15 de julio de 2026qwen3-coder:480bqwen3.5:397b

Retiros anteriores

30 de junio de 2026
| Modelo | Alternativa recomendada |
| --- | --- | --- |
| `rnj-1:8b` | |
16 de junio de 2026
| Modelo | Alternativa recomendada |
| --- | --- | --- |
| `kimi-k2-thinking` | `kimi-k2.6` |
| `kimi-k2:1t` | `kimi-k2.6` |
| `minimax-m2`  | `minimax-m3` |
| `glm-4.6` | `glm-5.1` |
| `qwen3-next:80b` | `qwen3.5` |
| `qwen3-vl:235b` | `qwen3.5` |
| `qwen3-vl:235b-instruct` | `qwen3.5` |
| `cogito-2.1:671b` | `deepseek-v4-flash` |