الوصف

🖼️ اسم الأداة:

Qwen2.5-VL-32B-Instruct

🔖 التصنيفات:

  • أتمتة ووكلاء ذكية
  • التعليم والبحث
  • البيانات والتحليلات
  • تجهيز البيانات وتنظيفها
  • المستندات ومجموعة أدوات تطوير البرمجيات
  • تكاملات وواجهات API
  • البرمجة والتطوير

✏️ ما الذي تقدّمه هذه الأداة؟

Qwen2.5-VL-32B-Instruct هو نموذج ذكاء اصطناعي متعدد الوسائط من شركة Qwen، مصمم لفهم وتحليل النصوص والصور والفيديوهات والتفاعل معها. يتيح النموذج تحليل العناصر المرئية داخل الصور مثل النصوص، والمخططات، والجداول، والأيقونات، والتصاميم، كما يستطيع فهم مقاطع الفيديو الطويلة وتحديد الأحداث المهمة داخلها.

يدعم النموذج تطبيقات الوكلاء الذكيين (AI Agents)، حيث يمكنه استخدام الأدوات والتفاعل مع الحاسوب والهاتف، بالإضافة إلى تحديد مواقع العناصر داخل الصور باستخدام الإحداثيات وإنشاء مخرجات منظمة بصيغة JSON، مما يجعله مناسبًا لتحليل المستندات، والفواتير، والنماذج، والبيانات المرئية.

يعتمد النموذج على بنية محسنة لفهم الصور والفيديوهات باستخدام تقنية الدقة الديناميكية ومعدل الإطارات الديناميكي، مما يسمح له بالتعامل مع مدخلات مختلفة الأحجام والجودة بكفاءة أعلى.

يتوفر Qwen2.5-VL بعدة أحجام تشمل 3 و7 و32 و72 مليار معامل، وتعد نسخة Qwen2.5-VL-32B-Instruct نسخة موجهة للمحادثة وتنفيذ التعليمات، وتحتوي على حوالي 33 مليار معامل مع دعم لأنواع بيانات BF16 وF32.


⭐ ما الذي تقدّمه فعليًا بناءً على تجربة المستخدمين؟

  • تحليل الصور وفهم محتواها.
  • استخراج النصوص من الصور والمستندات.
  • فهم الجداول والمخططات والرسوم البيانية.
  • تحليل الفيديوهات الطويلة وتحديد الأحداث المهمة.
  • إنشاء إجابات تعتمد على المحتوى المرئي.
  • تحديد مواقع العناصر داخل الصور باستخدام الإحداثيات.
  • إنشاء مخرجات منظمة بصيغة JSON.
  • دعم تطبيقات الوكلاء الذكيين.
  • التفاعل مع الحاسوب والهاتف ضمن تطبيقات الذكاء الاصطناعي.
  • تحليل الفواتير والنماذج والوثائق.
  • دعم التطبيقات التي تحتاج إلى فهم النصوص والصور معًا.

🤖 هل تتضمّن الأتمتة؟

نعم.

يدعم Qwen2.5-VL-32B-Instruct مهام الأتمتة من خلال قدرته على العمل ضمن أنظمة الوكلاء الذكيين (AI Agents)، واستخدام الأدوات، وتحليل البيانات المرئية، والتفاعل مع الحاسوب والهاتف لتنفيذ مهام تعتمد على فهم الصور والنصوص.


💰 نموذج التسعير:

مجاني ومفتوح المصدر.

يتوفر Qwen2.5-VL-32B-Instruct كمشروع مفتوح المصدر عبر منصة Hugging Face تحت ترخيص Apache 2.0، ولا توجد له خطط اشتراك مدفوعة خاصة بالنموذج نفسه.

قد تحتاج عملية تشغيل النموذج إلى موارد حوسبة مدفوعة حسب طريقة الاستخدام والبنية التحتية المستخدمة.


🆓 تفاصيل الخطة المجانية:

الميزةالتفاصيل
السعرمجانية
الترخيصApache 2.0
الاستخداممتاح كمشروع مفتوح المصدر
الوصولعبر Hugging Face
النماذج المتوفرة3B، 7B، 32B، 72B
تشغيل النموذجيحتاج إلى بيئة تقنية مناسبة

💳 تفاصيل الخطط المدفوعة:

الخطةالسعرالمزايا
Qwen2.5-VL-32B-Instructلا توجد خطة مدفوعة للنموذجالنموذج مجاني ومفتوح المصدر
Hugging Face PRO9 دولارات شهريًازيادة التخزين الخاص 10 مرات، زيادة التخزين العام مرتين، 20 ضعفًا من أرصدة الاستدلال، أولوية أعلى في ZeroGPU، استضافة Spaces وGradio وDocker، وضع التطوير للمساحات
Hugging Face Team20 دولارًا شهريًا لكل مستخدمتسجيل دخول موحد SSO، التحكم بتخزين البيانات، سجلات تدقيق، إدارة الصلاحيات، تحليلات استخدام المستودعات، سياسات أمان متقدمة، Spaces مع خيارات حوسبة متقدمة
Hugging Face Enterprise50 دولارًا شهريًا لكل مستخدمجميع مزايا Team، حدود أعلى للتخزين وعرض النطاق، SCIM لإدارة المستخدمين، أدوات أمان متقدمة، عقود سنوية، دعم مؤسسي

🧭 طريقة الوصول إلى الأداة:

الطريقةالتفاصيل
Hugging Face Hubمتاح عبر منصة Hugging Face
تشغيل محلييحتاج إلى تثبيت مكتبات مثل Transformers وAccelerate
API / Inference Providersمتوفر عبر مزودي الاستدلال المدعومين
الحوسبة السحابيةيمكن استخدام موارد GPU حسب الحاجة

🔗 رابط التجربة أو الموقع الرسمي:

https://huggingface.co/

 
 
 

تفاصيل التسعير

Hugging Face هي منصة متخصصة في تطوير ومشاركة نماذج الذكاء الاصطناعي والتعلم الآلي، وتوفر بيئة متكاملة للمطورين والباحثين لاستضافة النماذج، مجموعات البيانات، تطبيقات الذكاء الاصطناعي، وتشغيل عمليات الاستدلال. تقدم المنصة خططاً للأفراد والفرق والمؤسسات، بالإضافة إلى خدمات تخزين وحوسبة GPU وخدمات تشغيل النماذج عبر البنية السحابية. تعتمد Hugging Face على نموذج Freemium + خطط مدفوعة، حيث يمكن استخدام المنصة مجاناً للوصول إلى آلاف النماذج ومجموعات البيانات والمساحات العامة، بينما توفر الخطط المدفوعة مزايا إضافية مثل زيادة التخزين الخاص، أولوية الحوسبة، تشغيل المساحات الخاصة، أدوات التعاون، وإمكانيات المؤسسات. الخطة المجانية: تتيح استخدام Hugging Face Hub لاستكشاف النماذج، تحميل النماذج ومجموعات البيانات العامة، إنشاء المشاريع ومشاركة الأعمال مع المجتمع، واستخدام بعض موارد الحوسبة المجانية مثل ZeroGPU والمساحات العامة، مع وجود حدود على التخزين الخاص والاستخدام المتقدم. Hugging Face PRO: تبلغ تكلفة الخطة 9 دولارات شهرياً، وهي مخصصة للمستخدمين الأفراد الذين يحتاجون إلى قدرات أكبر في تطوير مشاريع الذكاء الاصطناعي. توفر الخطة زيادة سعة التخزين الخاص بمقدار 10 مرات، وزيادة التخزين العام بمقدار مرتين، و20 ضعفاً من أرصدة الاستدلال، وأولوية أعلى في طوابير ZeroGPU، وإمكانية استضافة مساحات ZeroGPU وGradio وDocker، بالإضافة إلى وضع التطوير للمساحات، نشر مدونة شخصية، وعرض البيانات الخاصة. Hugging Face Team: تبلغ التكلفة 20 دولاراً شهرياً لكل مستخدم، وهي مخصصة للفرق والشركات الناشئة. توفر دعم تسجيل الدخول الموحد SSO، التحكم بموقع تخزين البيانات، سجلات التدقيق، إدارة الصلاحيات عبر Resource Groups، تحليلات استخدام المستودعات، سياسات أمان متقدمة، التحكم المركزي في الرموز البرمجية، وإمكانيات إنشاء مساحات Gradio وDocker مع خيارات حوسبة متقدمة. كما يحصل جميع أعضاء الفريق على مزايا ZeroGPU وInference Providers الخاصة بخطة PRO. Hugging Face Enterprise: تبلغ التكلفة 50 دولاراً شهرياً لكل مستخدم، وهي موجهة للمؤسسات الكبيرة التي تحتاج إلى بنية تحتية متقدمة. تشمل جميع مزايا خطة Team بالإضافة إلى حدود أعلى للتخزين وعرض النطاق ومعدلات استخدام API، إدارة المستخدمين تلقائياً عبر SCIM، أدوات أمان وتحكم متقدمة، فواتير مخصصة بعقود سنوية، دعم العمليات القانونية والامتثال، ودعماً مخصصاً للمؤسسات. توفر Hugging Face أيضاً خدمات تخزين تعتمد على حجم البيانات، حيث يبدأ تخزين Hub بسعر أساسي يبلغ حوالي 12 دولاراً لكل تيرابايت شهرياً للمستودعات العامة و18 دولاراً لكل تيرابايت للمستودعات الخاصة، مع تخفيضات عند تجاوز أحجام تخزين كبيرة تصل إلى 500 تيرابايت. أما خدمات الحوسبة السحابية والمساحات Spaces فتبدأ من استخدام مجاني عبر CPU Basic وZeroGPU، بينما تتوفر موارد GPU مدفوعة حسب نوع المعالج. تبدأ أسعار بعض وحدات GPU مثل NVIDIA T4 من حوالي 0.40 إلى 0.50 دولار للساعة، وNVIDIA L4 من حوالي 0.80 دولار للساعة، وNVIDIA A100 من حوالي 2.50 دولار للساعة، بينما تصل الموارد المتقدمة مثل NVIDIA H200 وB200 إلى أسعار أعلى حسب عدد البطاقات المستخدمة. كما توفر Hugging Face خدمة Inference Endpoints لتشغيل نماذج الذكاء الاصطناعي على خوادم مخصصة تبدأ من حوالي 0.033 دولار للساعة، مع دعم المعالجات CPU، وحدات GPU مثل T4 وL4 وA100 وH100، وخيارات متقدمة للتطبيقات الإنتاجية التي تحتاج إلى أداء ثابت وقابلية توسع.