Skip to content

Modelos de nube ​

Los modelos de nube de Ollama son un nuevo tipo de modelo en Ollama que se puede ejecutar sin una GPU potente. En su lugar, estos modelos se externalizan automáticamente al servicio en la nube de Ollama, al mismo tiempo que ofrecen las mismas capacidades que los modelos locales, lo que permite seguir usando tus herramientas locales mientras ejecutas modelos más grandes que no cabrían en un ordenador personal.

Modelos compatibles ​

Para ver una lista de los modelos compatibles, consulta la biblioteca de modelos de Ollama.

Ejecutar modelos de nube ​

Los modelos de nube de Ollama requieren una cuenta en ollama.com. Para iniciar sesión o crear una cuenta, ejecuta:

ollama signin

CLI ​

Para ejecutar un modelo de nube, abre la terminal y ejecuta:

ollama run gpt-oss:120b-cloud

Python ​

Primero, descarga un modelo de nube para que se pueda acceder a él:

ollama pull gpt-oss:120b-cloud

A continuación, instala la biblioteca de Python de Ollama:

pip install ollama

A continuación, crea y ejecuta un script de Python sencillo:

python
from ollama import Client

client = Client()

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b-cloud', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript ​

Primero, descarga un modelo de nube para que se pueda acceder a él:

ollama pull gpt-oss:120b-cloud

A continuación, instala la biblioteca de JavaScript de Ollama:

npm i ollama

Luego usa la biblioteca para ejecutar un modelo de nube:

typescript


const ollama = new Ollama();

const response = await ollama.chat({
  model: "gpt-oss:120b-cloud",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL ​

Primero, descarga un modelo de nube para que se pueda acceder a él:

ollama pull gpt-oss:120b-cloud

Ejecuta el siguiente comando de cURL para ejecutar el comando a través de la API de Ollama:

curl http://localhost:11434/api/chat -d '{
  "model": "gpt-oss:120b-cloud",
  "messages": [{
    "role": "user",
    "content": "Why is the sky blue?"
  }],
  "stream": false
}'

Acceso a la API de nube ​

Los modelos de nube también se pueden acceder directamente a través de la API de ollama.com. En este modo, ollama.com actúa como un host remoto de Ollama.

Autenticación ​

Para acceder directamente a la API de ollama.com, primero crea una clave de API.

A continuación, establece la variable de entorno OLLAMA_API_KEY con tu clave de API.

export OLLAMA_API_KEY=your_api_key

Listar modelos ​

Para los modelos disponibles directamente a través de la API de Ollama, se pueden listar mediante:

curl https://ollama.com/api/tags

Generar una respuesta ​

Python ​

Primero, instala la biblioteca de Python de Ollama

pip install ollama

A continuación, realiza una solicitud

python

from ollama import Client

client = Client(
    host="https://ollama.com",
    headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

JavaScript ​

Primero, instala la biblioteca de JavaScript de Ollama:

npm i ollama

A continuación, realiza una solicitud al modelo:

typescript


const ollama = new Ollama({
  host: "https://ollama.com",
  headers: {
    Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
  },
});

const response = await ollama.chat({
  model: "gpt-oss:120b",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL ​

Genera una respuesta a través de la API de chat de Ollama:

curl https://ollama.com/api/chat \
  -H "Authorization: Bearer $OLLAMA_API_KEY" \
  -d '{
    "model": "gpt-oss:120b",
    "messages": [{
      "role": "user",
      "content": "Why is the sky blue?"
    }],
    "stream": false
  }'

Solo local ​

Ollama se puede ejecutar en modo solo local desactivando las funciones de la nube de Ollama.

Retiros ​

Ollama ocasionalmente marcará como obsoletos y retirará modelos de nube más antiguos a medida que se publiquen modelos de código abierto más nuevos y mejores. Las herramientas y aplicaciones que dependan de los modelos de nube de Ollama pueden necesitar actualizaciones para seguir funcionando. Los usuarios afectados recibirán una notificación con antelación a la obsolescencia y retiro de los modelos. Las obsolescencias se comunicarán por correo electrónico y en el sitio web de Ollama.

El retiro de modelos de nube de Ollama no afecta a los modelos locales.

Próximos retiros ​

Fecha de retiroModeloAlternativa recomendada
15 de julio de 2026deepseek-v3.1:671bdeepseek-v4-flash
15 de julio de 2026deepseek-v3.2deepseek-v4-flash
15 de julio de 2026devstral-2:123bmistral-large-3:675b
15 de julio de 2026devstral-small-2:24b
15 de julio de 2026ministral-3:14b
15 de julio de 2026ministral-3:3b
15 de julio de 2026ministral-3:8b
15 de julio de 2026gemini-3-flash-previewminimax-m3
15 de julio de 2026gemma3:12bgemma4:31b
15 de julio de 2026gemma3:27bgemma4:31b
15 de julio de 2026gemma3:4bgemma4:31b
15 de julio de 2026glm-4.7glm-5.2
15 de julio de 2026glm-5glm-5.2
15 de julio de 2026minimax-m2.1minimax-m3
15 de julio de 2026qwen3-coder-nextqwen3.5:397b
15 de julio de 2026qwen3-coder:480bqwen3.5:397b

Retiros anteriores ​

30 de junio de 2026
| Modelo | Alternativa recomendada |
| --- | --- | --- |
| `rnj-1:8b` | |
16 de junio de 2026
| Modelo | Alternativa recomendada |
| --- | --- | --- |
| `kimi-k2-thinking` | `kimi-k2.6` |
| `kimi-k2:1t` | `kimi-k2.6` |
| `minimax-m2`  | `minimax-m3` |
| `glm-4.6` | `glm-5.1` |
| `qwen3-next:80b` | `qwen3.5` |
| `qwen3-vl:235b` | `qwen3.5` |
| `qwen3-vl:235b-instruct` | `qwen3.5` |
| `cogito-2.1:671b` | `deepseek-v4-flash` |