Skip to content

نماذج السحابة

نماذج السحابة من Ollama هي نوع جديد من النماذج في Ollama يمكن تشغيلها دون الحاجة إلى وحدة معالجة رسوميات (GPU) قوية. بدلاً من ذلك، يتم تحويل نماذج السحابة تلقائياً إلى خدمة السحابة الخاصة بـ Ollama مع تقديم نفس القدرات المتوفرة في النماذج المحلية، مما يجعل من الممكن الاستمرار في استخدام أدواتك المحلية أثناء تشغيل نماذج أكبر لا يمكن تشغيلها على جهاز كمبيوتر شخصي.

النماذج المدعومة

للحصول على قائمة بالنماذج المدعومة، راجع مكتبة النماذج الخاصة بـ Ollama.

تشغيل نماذج السحابة

تتطلب نماذج السحابة من Ollama حساباً على ollama.com. لتسجيل الدخول أو إنشاء حساب، قم بتشغيل الأمر:

ollama signin

CLI

لتشغيل نموذج سحابة، افتح الطرفية وقم بتشغيل الأمر:

ollama run gpt-oss:120b-cloud

بايثون

أولاً، قم بسحب نموذج السحابة حتى يمكن الوصول إليه:

ollama pull gpt-oss:120b-cloud

بعد ذلك، قم بتثبيت مكتبة بايثون الخاصة بـ Ollama:

pip install ollama

بعد ذلك، قم بإنشاء وتشغيل نص برمجي بايثون بسيط:

python
from ollama import Client

client = Client()

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b-cloud', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

جافاسكريبت

أولاً، قم بسحب نموذج السحابة حتى يمكن الوصول إليه:

ollama pull gpt-oss:120b-cloud

بعد ذلك، قم بتثبيت مكتبة جافاسكريبت الخاصة بـ Ollama:

npm i ollama

بعد ذلك، استخدم المكتبة لتشغيل نموذج السحابة:

typescript
const ollama = new Ollama();

const response = await ollama.chat({
  model: "gpt-oss:120b-cloud",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL

أولاً، قم بسحب نموذج السحابة حتى يمكن الوصول إليه:

ollama pull gpt-oss:120b-cloud

قم بتشغيل أمر cURL التالي لتشغيل الأمر عبر واجهة برمجة التطبيقات (API) الخاصة بـ Ollama:

curl http://localhost:11434/api/chat -d '{
  "model": "gpt-oss:120b-cloud",
  "messages": [{
    "role": "user",
    "content": "Why is the sky blue?"
  }],
  "stream": false
}'

الوصول إلى واجهة برمجة تطبيقات السحابة

يمكن أيضاً الوصول إلى نماذج السحابة مباشرة عبر واجهة برمجة التطبيقات (API) الخاصة بـ ollama.com. في هذا الوضع، يعمل ollama.com كمضيف Ollama عن بعد.

المصادقة

للوصول المباشر إلى واجهة برمجة التطبيقات (API) الخاصة بـ ollama.com، قم أولاً بإنشاء مفتاح API.

بعد ذلك، قم بتعيين متغير البيئة OLLAMA_API_KEY إلى مفتاح API الخاص بك.

export OLLAMA_API_KEY=your_api_key

سرد النماذج

بالنسبة للنماذج المتوفرة مباشرة عبر واجهة برمجة التطبيقات (API) الخاصة بـ Ollama، يمكن سردها عبر:

curl https://ollama.com/api/tags

إنشاء استجابة

بايثون

أولاً، قم بتثبيت مكتبة بايثون الخاصة بـ Ollama

pip install ollama

بعد ذلك، قم بإرسال طلب

python
from ollama import Client

client = Client(
    host="https://ollama.com",
    headers={'Authorization': 'Bearer ' + os.environ.get('OLLAMA_API_KEY')}
)

messages = [
  {
    'role': 'user',
    'content': 'Why is the sky blue?',
  },
]

for part in client.chat('gpt-oss:120b', messages=messages, stream=True):
  print(part['message']['content'], end='', flush=True)

جافاسكريبت

أولاً، قم بتثبيت مكتبة جافاسكريبت الخاصة بـ Ollama:

npm i ollama

بعد ذلك، قم بإرسال طلب إلى النموذج:

typescript
const ollama = new Ollama({
  host: "https://ollama.com",
  headers: {
    Authorization: "Bearer " + process.env.OLLAMA_API_KEY,
  },
});

const response = await ollama.chat({
  model: "gpt-oss:120b",
  messages: [{ role: "user", content: "Explain quantum computing" }],
  stream: true,
});

for await (const part of response) {
  process.stdout.write(part.message.content);
}

cURL

إنشاء استجابة عبر واجهة برمجة تطبيقات الدردشة (chat API) الخاصة بـ Ollama:

curl https://ollama.com/api/chat \
  -H "Authorization: Bearer $OLLAMA_API_KEY" \
  -d '{
    "model": "gpt-oss:120b",
    "messages": [{
      "role": "user",
      "content": "Why is the sky blue?"
    }],
    "stream": false
  }'

الوضع المحلي فقط

يمكن تشغيل Ollama في الوضع المحلي فقط عن طريق تعطيل ميزات السحابة الخاصة بـ Ollama.

عمليات الإيقاف

يقوم Ollama من وقت لآخر بإيقاف نماذج السحابة القديمة وإحالتها إلى التقاعد مع إصدار نماذج مفتوحة المصدر أحدث وأفضل. قد تحتاج الأدوات والتطبيقات التي تعتمد على نماذج سحابة Ollama إلى تحديث لمواصلة العمل. سيتم إخطار المستخدمين المتأثرين مسبقاً بإيقاف النماذج وإحالتها إلى التقاعد. سيتم إبلاغ عمليات الإيقاف عبر البريد الإلكتروني وعلى موقع Ollama الإلكتروني.

إن إحالة نماذج سحابة Ollama إلى التقاعد لا يؤثر على النماذج المحلية.

عمليات الإيقاف القادمة

تاريخ الإيقافالنموذجالبديل الموصى به
15 يوليو 2026deepseek-v3.1:671bdeepseek-v4-flash
15 يوليو 2026deepseek-v3.2deepseek-v4-flash
15 يوليو 2026devstral-2:123bmistral-large-3:675b
15 يوليو 2026devstral-small-2:24b
15 يوليو 2026ministral-3:14b
15 يوليو 2026ministral-3:3b
15 يوليو 2026ministral-3:8b
15 يوليو 2026gemini-3-flash-previewminimax-m3
15 يوليو 2026gemma3:12bgemma4:31b
15 يوليو 2026gemma3:27bgemma4:31b
15 يوليو 2026gemma3:4bgemma4:31b
15 يوليو 2026glm-4.7glm-5.2
15 يوليو 2026glm-5glm-5.2
15 يوليو 2026minimax-m2.1minimax-m3
15 يوليو 2026qwen3-coder-nextqwen3.5:397b
15 يوليو 2026qwen3-coder:480bqwen3.5:397b

عمليات الإيقاف السابقة

30 يونيو 2026
| النموذج | البديل الموصى به |
| --- | --- |
| `rnj-1:8b` | |
16 يونيو 2026
| النموذج | البديل الموصى به |
| --- | --- |
| `kimi-k2-thinking` | `kimi-k2.6` |
| `kimi-k2:1t` | `kimi-k2.6` |
| `minimax-m2`  | `minimax-m3` |
| `glm-4.6` | `glm-5.1` |
| `qwen3-next:80b` | `qwen3.5` |
| `qwen3-vl:235b` | `qwen3.5` |
| `qwen3-vl:235b-instruct` | `qwen3.5` |
| `cogito-2.1:671b` | `deepseek-v4-flash` |