لا ترقِّ النموذج — أصلح ما حوله
رخُصت النماذج مرة أخرى هذا الأسبوع: Grok 4.6 بـ $2 للمليون، وDeepSeek بنصف السعر خارج الذروة، وQwen 27B بأوزان مفتوحة. ثم جاء البحث بالخبر المزعج — ورقة رفعت الدقة من 82.7% إلى 88.1% دون أن تمسّ النموذج، بـ $15 بدل $574.68. عنق الزجاجة انتقل: صار في ما حول النموذج، لا فيه.
🗞️ أخبار المختبرات
17 ساعة يوميًا بنصف السعر — DeepSeek V4-Pro يصل GA
المصدر: DeepSeek API Docs
خرج DeepSeek-V4-Pro من المعاينة رسميًا: سياق مليون توكن، وإخراج حتى 384K، وثلاثة مستويات تفكير — low وhigh وmax. لكن الخبر الحقيقي في جدول الأسعار: صار التسعير يفرّق بين الذروة وخارجها، وخارج الذروة نصف السعر تمامًا. الذروة سبع ساعات فقط: 01:00–04:00 و06:00–10:00 بتوقيت UTC — أي 04:00–07:00 و09:00–13:00 بتوقيت الرياض. كل ما عداها بالنصف. وصارت الواجهة تتكلم صيغة OpenAI Responses أصلًا، فتبديل الـ base URL يكفي غالبًا. (الأسعار في الجدول لكل مليون توكن، إدخال بلا كاش.)
| النموذج | خارج الذروة | الذروة |
|---|---|---|
| deepseek-v4-flash · input | $0.22 | $0.44 |
| deepseek-v4-flash · output | $0.66 | $1.32 |
| deepseek-v4-pro · input | $0.66 | $1.32 |
| deepseek-v4-pro · output | $1.98 | $3.96 |
الخلاصة لك: انقل كل ما لا ينتظره مستخدم — التلخيص الليلي، ومعالجة الدفعات، وإعادة الفهرسة — إلى خارج الذروة. نصف الفاتورة مقابل سطر في الجدولة.
Qwen3.8-27B بأوزان Apache 2.0 — نموذج بصري تملكه
المصدر: Hugging Face
فتحت Alibaba أوزان Qwen3.8-27B تحت رخصة Apache 2.0 — الرخصة المتساهلة، لا رخصة مخصصة بشروط. نموذج كثيف بـ 27 مليار معامل يقرأ النص والصور والفيديو أصلًا، بسياق 262,144 توكن يمتد إلى مليون. الأرقام المعلنة على بطاقة النموذج: 73.0 على Terminal-Bench 2.1، و61.7 على SWE-bench Pro، و90.3 على LiveCodeBench v6، و84.3 على OSWorld-Verified. تبقى أرقام Alibaba نفسها — غير مستقلة، فاختبرها على حالاتك قبل أن تبني عليها.
الخلاصة لك: 27B تعمل على GPU واحدة. لو منتجك يمسّ بيانات حساسة، صار بين يديك نموذج بصري بلا تكلفة لكل توكن وبلا رخصة تحتاج محاميًا — نزّله واختبره هذا الأسبوع.
Grok 4.6: أداء جاد بـ $2 للمليون
المصدر: xAI News
أطلقت xAI نسخة 4.6 بتركيز معلن على الوكلاء طويلة الأمد والعمل البصري التفاعلي. الأرقام على صفحة الإطلاق: 69.9% على CursorBench v3.2، و65.9% على DeepSWE v1.1، و61.3% على FrontierCode v1.1، و57.5% على APEX-Agents، و61 على مؤشر Artificial Analysis. السعر $2 للمليون إدخال و$6 إخراج، والنسخة السريعة بالضعف. متاح من اليوم الأول في Cursor وGrok Build وOpenRouter وVercel وCloudflare.
الخلاصة لك: لو أوقفت حلقة وكيل لأن تشغيلها المستمر يكلّف كثيرًا، أعد حسابها على $2/$6. كثير مما كان «مكلفًا جدًا» الشهر الماضي صار في حدود الميزانية.
Google أطفأت Imagen 4 — وسمّت بديلًا بلا طريق
المصدر: Google AI for Developers
انطفأت ثلاث نقاط نهاية دفعة واحدة في 17 أغسطس 2026: imagen-4.0-generate-001 وimagen-4.0-ultra-generate-001 وimagen-4.0-fast-generate-001. البديل الموصى به على صفحة الإهلاك هو gemini-3.1-flash-image. لكن الصفحة تكتفي بذكر الاسم: لا جدول مقارنة، ولا دليل انتقال، ولا سطر يخبرك بما يتغيّر في شكل الطلب أو الاستجابة. أي أن الاكتشاف عليك، بعد أن يكون خط الإنتاج قد توقف فعلًا.
الخلاصة لك: الدرس أوسع من Imagen: نقطة نهاية مستأجرة تنطفئ بموعد معلن، وقد يصل بديلها بلا تعليمات. ضع في تقويمك مراجعة ربع سنوية لصفحة الإهلاك عند كل مزوّد تعتمد عليه.
فماذا فعل الصنّاع العرب بهذا الرخص؟ أحدهم جمع $2.5M على الطبقة التي حول النموذج بالضبط.
🌍 من العالم العربي
النماذج تفهم لهجتك ولا تتقنها — رقم يثبت ذلك
المصدر: Middle East AI News
عُرض معيار ArabCulture-Dialogue من MBZUAI في ACL 2026: فصحى و13 لهجة وطنية، بناه 26 متحدثًا أصليًا من 13 دولة، عبر 12 موضوعًا يوميًا و54 موضوعًا فرعيًا، بأكثر من 340,000 كلمة، وبياناته منشورة على Hugging Face. النتيجة التي تعنيك: النماذج المختبرة — Jais وALLaM وSILMA وGemma وQwen3 وGPT-5 وGemini 2.5 Pro — تميّز الملاءمة الثقافية في حدود منتصف التسعينات بالمئة، لكنها تولّد اللهجة الصحيحة عند 50% تقريبًا. أصعبها: لهجات شمال أفريقيا والإماراتية.
الخلاصة لك: الفجوة في الإخراج لا في الفهم. لو منتجك يردّ بالعربية، اختبر التوليد باللهجة تحديدًا — لا الفهم — وضع طبقة تصحيح فوق النموذج.
HeyBreez تجمع $2.5M على ما حول النموذج، لا عليه
المصدر: Wamda
أغلقت HeyBreez جولة seed بـ $2.5M بقيادة Lunara Partners، بعد تسعة أشهر من pre-seed بـ $1.3M قادته Wamda Capital. أسّسها كريم ملحس عام 2025، ومكاتبها في عمّان ودبي. واللافت ما تبيعه: ليست نموذج الصوت، بل الطبقة التشغيلية حوله — إعادة المحاولة، ومعاودة الاتصال، ومنطق المتابعة، والرحلات المتفرعة، والربط بالهاتف والأنظمة. تعالج أكثر من مليون مكالمة شهريًا، وتصل حملة واحدة إلى 10,000 مكالمة يوميًا لعميل واحد، في البنوك والصحة واللوجستيات والضيافة.
الخلاصة لك: المال يتحرك نحو السبّاكة لا نحو النموذج. لو تبني على نموذج جاهز، اسأل: ما الطبقة التشغيلية التي لا يريد أحد بناءها؟ هناك منتجك.
الإمارات ثالث سوق يشغّل استدلال OpenAI محليًا
المصدر: Middle East AI News
صار الاستدلال يعمل على GPUs داخل الإمارات، لا التخزين وحده — بعد أمريكا وأوروبا. والقيد المهم: GPT-5.2 وحده مدعوم، وليس GPT-5.6 Sol. الفئات المؤهلة: API وChatGPT Enterprise وChatGPT Edu، وبشرط تفعيل إقامة البيانات الإماراتية أولًا. تغطي المحادثات والملفات المرفوعة ومحتوى Custom GPT والذاكرة ومخرجات Code Interpreter. وخارج التغطية: توليد الصور والبحث الداخلي وChatGPT Work — وتبقى المصادقة والتوجيه والتحليلات عالمية.
الخلاصة لك: لو أوقفتك صفقة حكومية أو بنكية عند سؤال «أين يعمل النموذج؟» — صار لديك جواب. راجع القيد أولًا: GPT-5.2، لا الأحدث.
والأدوات التي تبني هذه الطبقة نزلت هذا الأسبوع — ثلاث منها بأمر تركيب واحد.
الرادار يصلك في بريدك كل أسبوع — بلا ضجيج
🛠️ أدوات وريبوز
Graft: خريطة لمستودعك تُسكت الوكيل عن إعادة الاستكشاف
المصدر: GitHub
يبني Graft رسمًا بيانيًا من ملفات markdown قابلة للبحث فوق مستودعك، فيتوقف وكيل البرمجة عن إعادة اكتشاف بنية الشيفرة في كل جلسة. التركيب أمر واحد: npm install -g @nanonets/graft ثم graft init، ويصل نفسه بـ Claude Code — شريط حالة يعرض حجم الرسم وتقادمه، ومزامنة تلقائية مع التعديلات غير المودعة، وحقن السياق مع كل طلب، وعرض نطاق التأثير عند تحرير ملف. على مقياسه الخاص — 162 تشغيلة مضبوطة على مستودعين — يوفّر 42% من التوكنات. وعلى SWE-bench Verified: 109.4M توكن مقابل 142.0M عبر 50 مشكلة حقيقية. رخصة MIT، و3,700 نجمة.
الخلاصة لك: أرخص تجربة في هذه النشرة: أمر تركيب واحد مقابل أكبر بند في فاتورة البرمجة بالوكلاء. جرّبه على مستودع واحد وقِس بنفسك.
Corsair يعطي وكيلك مفاتيح مؤقتة بدل مفاتيحك
المصدر: GitHub
المشكلة التي يحلّها Corsair واضحة: تريد وكيلك أن يلمس حساباتك الحقيقية دون أن يحمل مفاتيحها. والتصميم صريح — «الوكيل يرى أسماء الدوال والنتائج. وCorsair يحلّ بيانات الاعتماد داخليًا وقت النداء. لا يستطيع الوكيل قراءتها ولا تسجيلها ولا تسريبها». تربطه كـ MCP بأي وكيل فتحصل على النداءات والصلاحيات والوصول المحدود جاهزة. أربعة أوضاع: open يشغّل كل شيء فورًا، وcautious الموصى به يشغّل القراءة والكتابة ويوقف العمليات المدمّرة للموافقة، وstrict يطلب موافقة على الكتابة ويمنع المدمّر، وreadonly يمنع كل كتابة. رخصة Apache 2.0.
الخلاصة لك: هذا هو الجدار بين «عرض وكيل يعمل» و«وكيل في الإنتاج». ركّبه بوضع cautious قبل أن تسلّم أي وكيل مفتاحًا حقيقيًا.
llmfit: أمر واحد يخبرك أي نموذج يعمل على جهازك
المصدر: GitHub
وصف المشروع سطر واحد: «مئات النماذج والمزوّدين. أمر واحد يجد ما يعمل على عتادك». يقرأ llmfit ذاكرتك ومعالجك وذاكرة كرت الرسوم، ثم يرتّب النماذج على أربعة محاور — ملاءمة الذاكرة، والسرعة المقدّرة، والجودة، والسياق. يفتح واجهة طرفية تفاعلية افتراضيًا، أو تستدعيه مباشرة: llmfit fit وllmfit recommend --json وllmfit bench. مكتوب بـ Rust برخصة MIT، ويُركّب عبر Homebrew أو Scoop أو pip أو Docker.
الخلاصة لك: قبل أن تقرر بين الاستضافة الذاتية وAPI، شغّل الأمر واعرف سقفك الحقيقي. القرار يصير على رقم، لا على تخمين.
وحين قيس هذا الاتجاه في المختبر، جاء الرقم أقسى مما تتوقع: 38 ضعفًا في التكلفة.
🔬 أبحاث بعين الصانع
StateM: 88.1% بـ $15 بدل $574.68 — دون تغيير النموذج
المصدر: arXiv
الفرضية التي تبنيها الورقة: الوكلاء تفشل في المهام الطويلة رغم قدرة النموذج على كل خطوة منفردة — تفقد الحالة المتغيّرة، ولا تستعيد دروس التشغيلات السابقة، وتتخطى إجراءات تعرفها، وتتوقف قبل الإنجاز. فبدل ترقية الأوزان، يعيد StateM بناء وقت التشغيل حول حالات دائمة، وسياق محصور بالمرحلة، وانتقالات مُتحقَّق منها، وrunbooks قابلة للاستعادة. على Terminal-Bench 2.1: رفع DeepSeek-V4 Flash من 82.7% إلى 88.1% بأقل من $38 تكيّف، وبلغ 95.3% مع GPT-5.6 Sol xhigh عبر 445 تشغيلة. واستخدام API في التقييم النهائي نحو $15 مقابل $574.68 للمرجع. والشيفرة مفتوحة.
| الإعداد | الدقة | تكلفة API |
|---|---|---|
| GPT reference | 83.1% | $574.68 |
| DeepSeek-V4 Flash | 82.7% | — |
| StateM + DeepSeek-V4 Flash | 88.1% | ~$15 |
| StateM + GPT-5.6 Sol xhigh | 95.3% | — |
الخلاصة لك: قبل أن تدفع لنموذج أكبر لأن وكيلك يتعثّر في المهام الطويلة، أعد بناء ما حوله: حالة صريحة، وrunbook، وانتقالات مُتحقَّق منها. الورقة تقول إن هذا اشترى دقة أعلى بجزء من التكلفة.
مكتبة الـ skills تنهار عند 100 — والسبب الاسترجاع
المصدر: arXiv
تدقيق منهجي لِما تفعله الـ skills فعلًا، لا جدول نجاح تجميعي آخر: 8,135 سجل تجربة مُطبَّعًا، و238 تسمية فريدة من 240 سجلًا مُرمَّزًا يدويًا، عبر معايير وهياكل ونماذج مختلفة. أهم نتيجتين: الـ skills تثبّت السلوك ولا تضيف معرفة — 65.7% من أثرها «تثبيت إجرائي» مقابل 4.5% حقن معرفة صريحة، وتتفوق على Workflow Memory بـ 6.06 نقطة. والثانية أقسى: حين يكبر المخزون من 5 إلى 100، تهبط دقة الاستخدام الفعلي من 29.6% إلى 3.3%. والقيد معلن: التصنيف مبني على 240 سجلًا مُرمَّزًا يدويًا — قاعدة صغيرة لادعاءات سببية قوية.
الخلاصة لك: لا تكدّس كل الـ skills في سلة واحدة. اقسمها حسب نوع المهمة وحمّل المجموعة الصغيرة المناسبة فقط — العطب في الاسترجاع، لا في محتوى الـ skill.
فإن كان ما حول النموذج هو الفارق، فمن أين تبدأ أنت؟
💡 أفكار للصنّاع
ابنِ طبقة اللهجة التي لا يتقنها أحد
المصدر: Middle East AI News
الرقم من MBZUAI هذا الأسبوع يرسم فجوة نظيفة: النماذج تفهم اللهجة عند منتصف التسعينات بالمئة، وتولّدها عند 50% تقريبًا، وأضعفها لهجات شمال أفريقيا والإماراتية. هذه فجوة منتَج لا فجوة بحث. ابدأ بلهجة واحدة تعرفها جيدًا، وابنِ طبقة تصحيح وتقييم فوق نموذج جاهز — لا نموذجًا من الصفر. المعيار منشور، فقياسك أنت وقياس منافسك يبدآن من رقم معلوم.
الخلاصة لك: اختر لهجة، وقِس عليها، وانشر الرقم. من يملك القياس يملك السوق.
اجعل سقف الإنفاق ميزة معلنة، لا هامشًا في الفوترة
المصدر: GitHub
أداة Mole — وكيل بحث في الطرفية — جمعت 100 نقطة على Hacker News هذا الأسبوع، وأبرز ما فيها ليس البحث بل سطر التشغيل: mole research «سؤال» --usd 0.50. تعلن سقفًا بالدولار فلا يتجاوزه. وهذا جواب لأكثر ما يقلق من يجرّب وكيلًا لأول مرة: ألّا يعرف كم سيدفع قبل أن ينتهي. ضع الرقم في واجهة منتجك الأمامية، لا في صفحة الأسعار.
الخلاصة لك: أي منتج وكيل تبنيه: أضف سقفًا يحدده المستخدم واعرضه في العنوان. الثقة تُشترى بهذا الرقم.
منحة سعودية حتى SAR 500,000 — الباب يُغلق في 29 سبتمبر
المصدر: Middle East AI News
يمنح صندوق التنمية الثقافية حتى 500,000 ريال للمنشآت الثقافية متناهية الصغر والصغيرة والمتوسطة التي تتبنى الذكاء الاصطناعي أو تبني به. فُتح التقديم في 10 أغسطس ويُغلق في 29 سبتمبر 2026، عبر موقع الصندوق. والمسارات ستة: الإبداع والإنتاج، وحفظ التراث والأصول، وتطوير المحتوى والمعرفة، والتجارب الثقافية، وإدارة المشاريع الثقافية، والحوكمة والملكية الفكرية. بالشراكة مع وزارة الثقافة وبرنامج جودة الحياة وسدايا.
الخلاصة لك: مال لا يأخذ حصة من شركتك، وبموعد معلوم. لو فكرتك تلامس المحتوى أو التراث أو التجارب الثقافية، اكتب الطلب هذا الأسبوع — ستة أسابيع تمرّ سريعًا.
مصادر هذا العدد (14)
- DeepSeek API Docs — https://api-docs.deepseek.com/quick_start/pricing
- Hugging Face — https://huggingface.co/Qwen/Qwen3.8-27B
- xAI News — https://x.ai/news/grok-4-6
- Google AI for Developers — https://ai.google.dev/gemini-api/docs/deprecations
- Middle East AI News — https://www.middleeastainews.com/p/mbzuai-builds-first-cultural-benchmark
- Wamda — https://www.wamda.com/2026/08/voice-ai-startup-heybreez-raises-2-5-million-seed-round
- Middle East AI News — https://www.middleeastainews.com/p/openai-now-offers-inference-residency
- GitHub — https://github.com/NanoNets/Graft
- GitHub — https://github.com/corsairdev/corsair
- GitHub — https://github.com/AlexsJones/llmfit
- arXiv — https://arxiv.org/abs/2608.15089
- arXiv — https://arxiv.org/abs/2608.14036
- GitHub — https://github.com/lajosdeme/mole
- Middle East AI News — https://www.middleeastainews.com/p/saudi-fund-offers-grants-for-ai-in

