في يوم 16 أبريل 2026، الساعة 14:26 UTC، أتاحت Anthropic كلود أوبس 4.7 للاستخدام العام، وقد جاء النموذج الجديد ليغيّر ثلاثة أشياء في وقت واحد: نافذة سياق بمليون توكن دون رسوم إضافية، وقفزة 6.8 نقطة في SWE-bench Verified (80.8% إلى 87.6%) فوق أوبس 4.6، إلى جانب قفزة دراماتيكية في CursorBench من 58% إلى 70%، حيث تتلاقى هذه التحسينات في صورة موحّدة. والنتيجة، كما قال عنوان VentureBeat، هي أن Anthropic استعادت بهامش ضيق عرش «أقوى LLM متاح للعموم»، وذلك بعد فترة من سيطرة المنافسين على المؤشرات.
يلخّص هذه القفزة رقم واحد، وهو مقياس GDPval-AA Elo لعمل المعرفة في العالم الحقيقي، حيث سجّل أوبس 4.7 درجة 1753، مقابل 1674 لـ GPT-5.4 و1314 لـ Gemini 3.1 Pro، أي بفارق 439 نقطة Elo فوق رائد جوجل. ولم يتحرك السعر، إذ بقي 5$ لكل مليون توكن إدخال، و25$ لكل مليون توكن إخراج، وهو السعر نفسه الذي طُرح به أوبس 4.6 دون أي زيادة على المطورين. ولا توجد علاوة سياق طويل، فنافذة المليون لا تُحمّل المطورين رسماً إضافياً مهما طال المحتوى المُمرّر.
لماذا هذا مهم للمطور التركي؟ ثلاثة أمور: (1) مليون توكن يستوعب مشروع .NET متوسط الحجم (50+ مشروعاً) في محادثة واحدة؛ (2) 87.6% SWE-bench يمنح ثقة أكبر لتدفقات pull request الآلية؛ (3) 25$ لكل مليون إخراج مكلف بعملة الليرة التركية، لكن يمكن إدارته مع prompt caching وbatch API وتوزيع ذكي. وتتناول هذه المقالة الأرقام والتطبيق التركي معاً.
تفاصيل الإصدار: التاريخ والمنصات والتسعير والسياق
يحمل منشور المدونة الرسمي لـ Anthropic ختماً زمنياً يشير إلى 16 أبريل 2026، 14:26 UTC، فيما يتوفر النموذج عبر claude-opus-4-7 على API الخاص بـ Anthropic، إلى جانب الإصدارات السحابية التالية:
- Amazon Bedrock:
anthropic.claude-opus-4-7-v1 - Google Cloud Vertex AI:
claude-opus-4-7@20260415(US, EU, APAC) - Microsoft Foundry:
claude-opus-4-7(US, EU) - claude.ai: الافتراضي على فئات Free, Pro, Max, Team, Enterprise
تبلغ نافذة السياق 1,000,000 توكن، فيما يبلغ الحد الأقصى للإخراج 128,000 توكن، وتاريخ قطع المعرفة يناير 2026. وقد تم تحديث المُجزّئ بحيث يُنتج 1.0 إلى 1.35× توكن أكثر لنفس المحتوى مقارنة بأوبس 4.6. كذلك نمت سعة الرؤية، إذ بلغ الحد الأقصى للحافة الطويلة 2,576 بكسل (~3.75 ميجابكسل)، أي أكثر من 3 أضعاف سقف أوبس 4.6 البالغ نحو 860 بكسل. وتُربط إحداثيات البكسل الآن واحدة لواحدة بإحداثيات النموذج الداخلية، وهي قفزة ملموسة في سيناريوهات computer-use تنعكس مباشرة على دقة التفاعل مع الواجهات الرسومية المعقدة.
هناك تغيير حرج كاسر للتوافق: فمعامل budget_tokens الثابت يُعيد الآن خطأ 400، وقد حلّ محلّه التفكير التكيّفي، بحيث يمكنك تمرير ميزانيات توكن استشارية عبر header الإصدار التجريبي task-budgets-2026-03-13 ليرى النموذج عداً تنازلياً جارياً. ومطلوب Claude Code v2.1.111 أو أحدث.
المعايير: قفزة 13% في البرمجة وقمة جدول جديدة
تكشف الأرقام المستخرجة من بطاقة النظام الرسمية المؤلفة من 232 صفحة أين تقدّم أوبس 4.7 على أوبس 4.6، بحيث يصبح من الممكن قراءة الفارق دون الحاجة إلى ادعاءات تسويقية:
| المعيار | أوبس 4.6 | أوبس 4.7 | Δ |
|---|---|---|---|
| SWE-bench Verified | 80.8% | 87.6% | +6.8 |
| SWE-bench Pro | 53.4% | 64.3% | +10.9 |
| CursorBench (Cursor IDE) | 58% | 70% | +12 |
| XBOW حدة بصرية (computer-use) | 54.5% | 98.5% | +44 |
| ScreenSpot-Pro | 69.0% | 79.5% | +10.5 |
| Harvey BigLaw Bench (xhigh) | غير متاح | 90.9% | غير متاح |
| HLE (Humanity's Last Exam، xhigh) | غير متاح | 55.4% | غير متاح |
غير أن الصورة ليست مشرقة كلها. فهناك تراجع في السياق الطويل، وهو أمر مهم؛ إذ سجّل MRCR v2 8-needle عند 256k توكن انخفاضاً من 91.9% إلى 59.2%، وعند مليون توكن من 78.3% إلى 32.2%. نافذة المليون «موجودة»، لكن لا ضمان أن النموذج سيتذكر كل شيء تحشره فيها بنفس الإخلاص الذي يبديه مع السياقات الأقصر. ولسيناريوهات RAG والكوربس الكبير، هذا فخ حقيقي، لذا يبقى التخلي عن embedding+chunking سابقاً لأوانه.
الموقع مقابل المنافسين (المصدر: مقارنة معايير Vellum وspectrumailab.com بتاريخ 18 أبريل 2026):
| المعيار | أوبس 4.7 | GPT-5.4 | Gemini 3.1 Pro |
|---|---|---|---|
| SWE-bench Pro | 64.3% | 57.7% | 54.2% |
| MCP-Atlas (تنسيق الأدوات) | 77.3% | 68.1% | 73.9% |
| OSWorld (computer-use وكيلي) | 78.0% | غير متاح | غير متاح |
| BrowseComp (بحث وكيلي) | 79.3% | 89.3% | 85.9% |
| GPQA Diamond | 94.2% | 94.4% | 94.3% |
| GDPval-AA Elo | 1753 | 1674 | 1314 |
| السعر (إدخال/إخراج، $/مليون) | 5 / 25 | 2.50 / 15 | 2 / 12 |
المكاسب واضحة في البرمجة وتنسيق الأدوات وcomputer-use الوكيلي وعمل المعرفة العام (GDPval)، فيما الخسارة واضحة في البحث الشبكي الوكيلي (BrowseComp). ومن حيث السعر، يبقى أوبس 4.7 الأغلى، إذ لا يزال Gemini 3.1 Pro أرخص بنسبة 60%. ومهمة المطور هنا أن يسأل: «هل أحتاج فعلاً 25$ لكل مليون إخراج هنا؟»
قدرات جديدة: xhigh وTask Budgets و/ultrareview
حين يفتح أحد المطورين جلسة Claude Code أولى على أوبس 4.7، أوّل ما يلاحظه أن الإعدادات الافتراضية تغيّرت. فأهم تجديد في الواجهة هو مستوى جهد xhigh، وهو مستوى جديد بين high وَmax، وفي Claude Code يأتي افتراضياً عبر جميع الفئات. وتوصي Anthropic بـ xhigh للبرمجة الوكيلية، أي بالسماح للنموذج باتخاذ خطوات داخلية أكثر في المهام طويلة الأمد متعددة الخطوات.
Task budgets (إصدار تجريبي عام): يمكنك إعلان ميزانية توكن إجمالية استشارية عبر حلقة وكيلية كاملة، بحيث يرى النموذج عدّاً تنازلياً جارياً ويُنظّم سرعته وفقاً لما تبقّى لديه من رصيد. وHeader الإصدار التجريبي هو task-budgets-2026-03-13. يجلب هذا تحكماً تشغيلياً لسيناريوهات يتوقف فيها الوكيل في المنتصف بعد أن أحرق 80% من التوكنات، وهي حالة شائعة في خطوط الإنتاج الوكيلية المعقدة.
أمر /ultrareview: أمر جديد في Claude Code يفتح جلسة مكرّسة لمراجعة الكود حصراً، وينقل تدفق مراجعة الكود من تركيبة git diff مع LLM إلى استدعاء وكيل متخصص.
التحقق الذاتي: في المثال الرسمي لـ Anthropic، يكتب النموذج محرك تحويل النص إلى كلام بلغة Rust، ثم يُمرّر إخراجه الصوتي عبر محرك تعرّف على الكلام منفصل ويقارن بمرجع Python، وهو اختبار ذاتي لعمله الخاص. وإذا بنيت بهذا النمط، فإن تقارير «اكتمال المهمة» تأتي مع فحص سلامة افتراضي.
«يعمل بتماسك لساعات، يدفع عبر المشكلات الصعبة بدلاً من الاستسلام، ويفتح فئة من عمل التحقيق العميق لم نتمكن من تشغيلها بشكل موثوق من قبل.»
قصص العملاء: Cursor وNotion وVercel وReplit
يقول الرئيس التنفيذي لـ Cursor مايكل تروول إنّ النموذج الجديد يمثّل قفزة معنوية تظهر في أرقام CursorBench. وقد أدرجت Anthropic شركاء الوصول المبكر، وهم Intuit وHarvey وReplit وCursor وNotion وShopify وVercel وDatabricks. وفيما يلي أرقام محددة:
- Cursor (الرئيس التنفيذي مايكل تروول): «في CursorBench، أوبس 4.7 قفزة معنوية في القدرات، يتجاوز 70% مقابل 58% لأوبس 4.6.»
- Notion Agent: 14% مهام أكثر تم حلها، وتوكنات أقل مستهلكة، مع ثلث أقل من أخطاء الأدوات. وهو أول نموذج يجتاز اختبارات الحاجة الضمنية.
- Vercel (جو حدّاد): «يقوم ببراهين على كود الأنظمة قبل بدء العمل.» وهو سلوك جديد يمنع البرمجة المبكرة.
- Bolt: تحسّن بنسبة تصل إلى 10% في جلسات بناء التطبيق الطويلة.
- Databricks: 21% أخطاء أقل في OfficeQA Pro.
- Factory Droids: زيادة 10 إلى 15% في نجاح المهام.
- Replit: نفس الجودة بتكلفة أقل (تحليل السجلات، وإصلاح الأخطاء).
- GitHub Copilot: سيستبدل أوبس 4.5 و4.6 في منتقي نموذج Copilot Pro+ في الأسابيع القادمة، وهو متاح في VS Code وVisual Studio وJetBrains وXcode وEclipse. ويوجد مضاعف ترويجي 7.5× طلب premium حتى 30 أبريل 2026.
السلامة والمحاذاة: ASL-3 وProject Glasswing
تنص بطاقة النظام بصراحة على أن أوبس 4.7 «متماشٍ بشكل كبير وموثوق، رغم أنه ليس مثالياً تماماً في سلوكه.» وهذه اللغة الصريحة مهمة، فهي تُشير إلى أن Anthropic لا تزال تمتلك الصدق المؤسسي الذي تعتمد عليه علامتها التجارية، رغم الضغوط التنافسية المتصاعدة.
ويُنشر أوبس 4.7 ضمن معيار نشر وأمان AI Safety Level 3 (ASL-3) الخاص بـ Anthropic، أي المعيار نفسه الذي طُرح به أوبس 4.6. أمّا Project Glasswing، المُعلن قبل أسبوع، فيوفّر إطاراً للطرح المرحلي للنماذج ذات القدرات السيبرانية. وخلال التدريب، خفّضت Anthropic عمداً القدرات السيبرانية لأوبس 4.7 نسبة إلى Mythos Preview الداخلي. وMythos Preview غير متاح للعموم، إذ حصلت Nvidia وJPMorgan Chase وGoogle وApple وMicrosoft فقط على وصول مقيّد بحسب The Verge.
Cyber Verification Program: نموذج اشتراك اختياري عند claude.com/form/cyber-use-case لمحترفي الأمن الشرعيين (بحث الثغرات، واختبار الاختراق، والفريق الأحمر). ويمكن لشركات الأمن السيبراني التركية (Sparta Bilişim وPrivia Security وغيرها) التقديم عبر هذا النموذج.
منظور المطور التركي: الوصول والتسعير والممارسة
الوصول من تركيا مباشر، حيث API الخاص بـ Anthropic عالمي، وStripe متوافق مع تركيا. وتمتلك AWS Bedrock وGoogle Vertex AI وMicrosoft Foundry عملاء مؤسسات أتراك، وهي مسارات صالحة لفرق الامتثال الداخلية التي تشترط استضافة معتمدة على ولايات قضائية محددة.
أمّا التغطية باللغة التركية: فقد غطّى الإطلاق بتفصيل كل من ilkkod.com (17 أبريل)، وcanberkki.com (24 أبريل)، وInvesting.com TR (16 أبريل). وقد أبرز مجتمع المطورين الأتراك بشكل خاص ثلاثي سياق المليون، وجهد xhigh، والرؤية 3.75 ميجابكسل.
وأرى أن الاستنتاجات العملية يمكن تلخيصها فيما يلي من نقاط، وقد رتّبتها بحسب الأولوية التي تخدم فريق هندسة برمجيات تركي متوسط الحجم:
- تخفيض التكلفة: 25$ لكل مليون إخراج تقارب 850 ليرة تركية لكل مليون، وهو مبلغ مكلف. ومن الاستراتيجيات المتاحة prompt caching (~90% خصم على الإدخال المُخزّن مؤقتاً)، وbatch API (~50% خصم)، إلى جانب استخدام xhigh فقط على الخطوات الحرجة.
- استخدم سياق المليون بحكمة: تذكّر تراجع السياق الطويل. فالوكلاء متعدد الاستدعاءات مع الاسترجاع لا يزالون أكثر موثوقية من برومبت عملاق واحد، فيما يلمع سياق المليون لتحليل الكود على نطاق المستودع وPDFs الكبيرة.
- لا تتخلَّ عن RAG بعد: فانخفاض MRCR v2 حقيقي، وخطوط أنابيب embedding مع chunking لا تزال تُكسب لقمتها على نطاق المؤسسات التي تُشغّل مستودعات معرفة ضخمة. وقد يبدو أن عبارة «سياق المليون قتل RAG» مبالغة.
- أعد تقييم computer-use: XBOW 98.5% وScreenSpot-Pro 79.5% يعنيان أن أتمتة الويب وأدوات QA لسطح المكتب تستحق نظرة جديدة.
- دمج /ultrareview: أضف Claude Code v2.1.111+ وأوبس 4.7 إلى CI لمراجعة PR الآلية، إذ ينخفض زمن الدمج.
الأصوات النقدية: مخيّب أم خطوة حقيقية؟
يقول سولومون نيس (dev.to، 18 أبريل 2026): «الكثير من المستخدمين القويين على X وReddit يُصفونه بالمُخيّب، أكثر تكلفة في الممارسة، أو ببساطة أسوأ لتدفقات عملهم، خاصة في Claude Code.» التحذير مهم، إذ إنّ المكاسب في المعايير لا تترجم دائماً إلى مكاسب في الاستخدام اليومي. والمطورون القادمون من GPT-5.4 قد يجدون إيقاع استجابة أوبس 4.7 «بطيئاً» نسبياً، خصوصاً في الجلسات القصيرة التي يغلب عليها طابع الأسئلة السريعة.
أمّا ContextStudios (17 أبريل) فقد وصفه بأنه «نصف خطوة متعمّدة»، أي ليس ثورة بل نصف خطوة مُحكمة تختار أن تظهر مكاسبها تدريجياً بدلاً من قفزة واحدة. والتشخيص صحيح، فأوبس 4.7 هو النسخة العامة المخفّضة سيبرانياً من Mythos Preview الذي بقيت سعته الكاملة حبيسة جدران Anthropic ولم تُشحن بعد.
ويصف بن طومسون (Stratechery، عبر Financial Post 20 أبريل) رسائل سلامة أمودي بأنها «كارثة-إباحية-كأداة-تسويق»، لكنه في نفس المقال يتوّج Anthropic قائد سباق AI الحالي. والمفارقة تلخّص موقع Anthropic بدقة، فهي تبيع الخوف والثقة في وقت واحد.
الإطار الاقتصادي: جولة 30 مليار $ بتقييم 380 مليار $
بعد أربعة أيام فقط من إطلاق أوبس 4.7 (20 أبريل 2026)، أفادت Financial Post أن Anthropic أغلقت جولة جديدة بقيمة 30 مليار دولار بتقييم 380 مليار دولار، مع التوجّه المُبلّغ عنه نحو IPO في وقت لاحق من 2026. وتُفسّر هذه الخلفية المالية لماذا لم ينخفض تسعير أوبس 4.7، إذ تريد Anthropic النمو مع حماية الهامش الإجمالي، فيما يأتي ردها على تسعير Gemini العدواني من جوجل عبر قيادة الأداء.
واقتباس داريو أمودي لـ Financial Post جريء وخطير: «لا توجد نهاية لقوس قزح. هناك فقط قوس قزح. لا نرى أي شيء يتباطأ.» ويمكن للعملاء المؤسسات الأتراك قراءة هذا بطريقتين: قلق «استثماري اليوم سيصبح متقادماً في غضون عامين»، أو دافع «يجب أن أرتبط بنظام بيئي يتطور بسرعة».
الخاتمة: توقعات 30/60/90 يوماً
أوبس 4.7 ليس ثورة؛ بل هو نصف خطوة مُحكمة. لكن المكاسب للمطورين الأتراك ملموسة، وتشمل سياق مليون توكن (مع الانتباه إلى فخ السياق الطويل)، وتسعيراً ثابتاً، وبرمجة وكيلية بمستوى xhigh، وأمر /ultrareview، إلى جانب 87.6% SWE-bench لتدفقات PR آلية بثقة أعلى. ويتفوق على GPT-5.4 بـ 79 نقطة GDPval Elo وعلى Gemini 3.1 Pro بـ 439 نقطة، لكنه يتأخر بـ 10 نقاط في BrowseComp، ولعلّ الموقف يبقى دقيقاً.
توقعات 30/60/90 يوماً:
- 30 يوماً (مايو 2026): سيتقاعد Cursor وReplit وGitHub Copilot أوبس 4.5 و4.6 لصالح 4.7. وستبدأ تقارير حجم API من الشركات الناشئة التركية (Insider، وTrendyol، وGetir) بالتسرّب، فيما يتكثّف حديث IPO لـ Anthropic.
- 60 يوماً (يونيو-يوليو 2026): رد Google Gemini 3.2 Pro متوقع، ومن المرجح أن توسّع OpenAI وصول GPT-5.5 (انطلق GA على Copilot في 24 أبريل). ونافذة قيادة أوبس 4.7 يبدو أنها 60 إلى 90 يوماً على الأكثر.
- 90 يوماً (أغسطس 2026): شائعات النسخة العامة لـ Mythos Preview (أوبس 4.8؟) تتكثّف، فيما تتوسع منتجات RAG تركية اللغة المعتمدة على Bedrock وFoundry للشركات الصغيرة والمتوسطة.
تعليق سطر واحد: ثلاثي أوبس 4.7 «قفزة برمجة 13% وسياق مليون وتسعير ثابت» يجعله أكثر النماذج فائدة لربيع 2026 للمهندسين الأتراك، لكن تراجع السياق الطويل يعني عدم تقاعد خطوط أنابيب RAG الخاصة بك بعد، فالاستخدام المتكامل يبقى الطريق الأكثر أماناً.
ما رأيك؟ هل تستخدم أوبس 4.7 عبر Cursor أو Claude Code أو GitHub Copilot، وهل رأيت القفزة التي توقّعتها؟ شارك في التعليقات.
التعليقات (0)
لا توجد تعليقات بعد. كن أول من يعلق.