الذكاء الاصطناعي
شركة Anthropic تطلق Claude Fable 5 استعداداً لدخول الأسواق العامة
أطلقت شركة Anthropic نموذج Claude Fable 5، وهو أول نموذج متاح للجمهور من عائلة Mythos، مع تطبيق سياسات جديدة للاحتفاظ بالبيانات وضوابط أمان، وذلك في إطار استعدادها لدخول الأسواق العامة.
في يوم الثلاثاء، أطلقت Anthropic نموذج Claude Fable 5، وهو أول نسخة متاحة للجمهور من نموذج Mythos الخاص بها. يتفوق النموذج في هندسة البرمجيات، والأعمال المعرفية، والرؤية الحاسوبية، لكنه يعمل ضمن حدود أمان صارمة. ففي المجالات عالية المخاطر - وتحديداً الأمن السيبراني، وعلم الأحياء، والكيمياء، والتقطير - يقوم النموذج بحظر الردود والرجوع إلى نموذج Claude Opus 4.8.
تسعير النموذج هو:
- 10 دولارات لكل مليون رمز (token) للمدخلات
- 50 دولاراً لكل مليون رمز للمخرجات
ولمعالجة مخاوف السلامة، ستفرض Anthropic سياسة احتفاظ بالبيانات لمدة 30 يوماً على جميع حركات المرور للدفاع ضد الهجمات المعقدة والجديدة، بما في ذلك محاولات كسر الحماية (jailbreaks) الجديدة، حتى بالنسبة للمؤسسات التي لديها اتفاقيات سابقة بعدم الاحتفاظ بالبيانات. وأشارت الشركة إلى أنه قد تظل هناك هجمات جديدة، على الرغم من الاختبارات. ووفقاً لـ Anthropic: “داخلياً، أجرينا برنامج مكافآت لاكتشاف الثغرات خارجياً، ولم يسفر عن أي عمليات كسر حماية شاملة خلال أكثر من 1,000 ساعة من الاختبار. ثم عملنا مع مؤسسات خارجية متخصصة في الاختبارات الأمنية (red-teaming) التي فشلت أيضاً في العثور على عمليات كسر حماية شاملة”. وقد قامت الشركة باختبار مصنفاتها تحت الضغط باستخدام محاولات كسر الحماية قبل إطلاق Fable 5.
تشير بيانات الأداء الأولية إلى أن ما لا يقل عن 95٪ من جلسات Fable تعمل بالكامل بناءً على ردود النموذج نفسه. وقد أسفرت الاختبارات من أطراف خارجية عن ملاحظات؛ إذ أفادت شركة التحليلات Hex بأن Fable كان أول نموذج يحقق 90٪ في معيار التحليلات الأساسي الخاص بها، مشيرة إلى أن النموذج يُظهر حكماً قوياً واهتماماً بالتفاصيل الدقيقة في الأسئلة الأكثر صعوبة. وأشارت منصة Base44، وهي منصة “vibe-coding” (أسلوب من منصات البرمجة)، إلى أن Fable أفضل في إكمال تطبيقات كاملة في مطالبة واحدة - وهي عملية تُعرف بـ “one-shotting” - كما يتمتع بقدرة ممتازة على استدعاء الأدوات (tool-calling). وأفادت منصة مساحة العمل المدعومة بالذكاء الاصطناعي Genspark بأن Fable تفوق على النماذج الأخرى في تقييماتها، حيث كان أداؤه أفضل بكثير في مهام مثل تصميم واجهة المستخدم وبرمجة الألعاب. بالإضافة إلى ذلك، ذكرت منصة مكافآت التسوق Rakuten أنه عند بذل أقصى جهد، يقوم Fable بالتفكير في عمله والتحقق منه.
يوسع هذا النشر الوصول إلى 15 دولة. تم إطلاق Mythos في البداية كنسخة تجريبية في شهر أبريل، واقتصر على عدد قليل من الشركاء بسبب مخاوف تتعلق بالأمن السيبراني، قبل أن توسع Anthropic الوصول إلى مئات المؤسسات في الأسبوع الماضي. يأتي هذا الإطلاق في الوقت الذي تستعد فيه Anthropic لدخول الأسواق العامة، إلى جانب أقرانها مثل OpenAI وشركة SpaceX المملوكة لـ Elon Musk. كما حذرت Anthropic من أن أنظمة الذكاء الاصطناعي تتقدم بسرعة كبيرة لدرجة أنها قد تحقق قريباً التحسين الذاتي المتكرر (RSI)، حيث تقوم بتحسين نفسها ذاتياً دون تدخل بشري.
لماذا يهم
تطرح Anthropic أقوى نماذج الذكاء الاصطناعي لديها للجمهور العام لأول مرة، بينما تستعد في الوقت نفسه لدخول الأسواق العامة.