

يوفر Google Cloud Vision AI نماذج تعلم آلي مدربة مسبقاً لتحليل الصور عبر واجهات برمجة التطبيقات REST. يستخدمه المطورون لاستخراج النصوص من ملفات PDF والإشراف على الصور التي يحملها المستخدمون. يعالج ما يصل إلى 2,000 صورة لكل طلب مجمع. تحظر الخدمة التعرف على الوجوه لأفراد محددين.
ما هو Google Cloud Vision AI؟
يحتاج تطبيق بيع بالتجزئة إلى مسح صور الملابس التي يحملها المستخدمون وتحديد شعار العلامة التجارية الدقيق وفئة المنتج في أجزاء من الثانية. يأخذ Google Cloud Vision AI بيانات الصور الخام هذه ويعيد تصنيفات JSON منظمة.
تعمل خدمة التعلم الآلي هذه، التي طورتها Google LLC، كواجهة برمجة تطبيقات REST و RPC. وتمنح المطورين نماذج مدربة مسبقاً لاكتشاف الكائنات، والتعرف البصري على الحروف، وتحليل الوجوه. تستخدمها الفرق الهندسية في المؤسسات للإشراف على محتوى المستخدمين واستخراج النصوص من ملفات PDF الممسوحة ضوئياً.
- حالة الاستخدام الأساسية: أتمتة معالجة المستندات والإشراف على الصور التي يحملها المستخدمون.
- مثالي لـ: مطوري المؤسسات الذين يبنون تطبيقات على Google Cloud Platform.
- التسعير: يبدأ من $1.50 (لكل 1,000 وحدة) – تغطي الباقة المجانية أول 1,000 وحدة شهرياً.
الميزات الرئيسية وكيفية عمل Google Cloud Vision AI
تصنيف الصور والإشراف عليها
- اكتشاف التصنيفات: يحدد آلاف الفئات العامة داخل الصورة. الحد الأقصى: يعيد 100 تصنيف كحد أقصى لكل طلب.
- اكتشاف البحث الآمن: يضع علامات على المحتوى للبالغين، والمحتوى الطبي، والعنيف. الحد الأقصى: يعتمد على خمس فئات للاحتمالية بدلاً من نسب مئوية مخصصة.
استخراج النصوص والمستندات
- التعرف البصري على الحروف (OCR): يستخرج النصوص من أكثر من 50 لغة. الحد الأقصى: يجب ألا تتجاوز ملفات PDF و TIFF 2,000 صفحة لكل طلب مجمع.
- التعرف على الكتابة اليدوية: يعالج الملاحظات والإيصالات المكتوبة بخط اليد. الحد الأقصى: تنخفض الدقة في عمليات المسح الضوئي ذات التباين المنخفض أو الباهتة.
تحليل الكائنات والوجوه
- اكتشاف الوجوه: يحدد مواقع وجوه متعددة ويقرأ المشاعر المرتبطة بها مثل الفرح. الحد الأقصى: تحظر Google التعرف على الوجوه (تحديد أفراد محددين) للامتثال لسياسات الخصوصية.
- تحديد مواقع الكائنات: يرسم مربعات إحاطة حول عناصر متعددة في صورة واحدة. الحد الأقصى: تتم فوترته بمعدل أعلى يبلغ $2.25 لكل 1,000 وحدة مقارنة بالتصنيفات الأساسية.
إيجابيات وسلبيات Google Cloud Vision AI
الإيجابيات
- يعالج ما يصل إلى 2,000 صورة في طلب مجمع واحد غير متزامن.
- تتوفر مكتبات عملاء أصلية للغات Python و Java و Go و Node.js.
- يقرأ محرك OCR أكثر من 50 لغة بما في ذلك النصوص المكتوبة من اليمين إلى اليسار.
- تُجدد الباقة المجانية شهرياً وتغطي 1,000 وحدة.
السلبيات
- ترتفع تكاليف المعالجة ذات الحجم الكبير بمعدل $1.50 لكل 1,000 وحدة.
- يتطلب الإعداد الأولي لأذونات IAM معرفة محددة ببنية Google Cloud.
- لا توفر النماذج المدربة مسبقاً أي إمكانية للتخصيص دون الترقية إلى Vertex AI.
من يجب عليه استخدام Google Cloud Vision AI؟
- الفرق الهندسية في المؤسسات: تحصل الفرق التي تستخدم BigQuery و Cloud Storage على تكامل أصلي.
- فرق الإشراف على المحتوى: يمكن للمنصات الاجتماعية وضع علامات على الصور العنيفة أو المخصصة للبالغين قبل نشرها.
- المطورون المستقلون ذوو الميزانية المحدودة: تتيح الـ 1,000 وحدة المجانية شهرياً وصولاً كاملاً إلى واجهة برمجة التطبيقات للمشاريع الصغيرة.
- ليس لمنشئي النماذج المخصصة: يجب على الفرق التي تحتاج إلى تدريب نماذج على مجموعات بيانات خاصة استخدام Vertex AI بدلاً من ذلك.
تسعير وخطط Google Cloud Vision AI
يعمل نموذج التسعير على أساس الاستخدام المجاني (Freemium). الباقة المجانية هي مخصص شهري دائم، وليست فترة تجريبية مؤقتة.
- الباقة المجانية: $0 شهرياً. تغطي أول 1,000 وحدة عبر معظم فئات الميزات.
- الميزات القياسية: $1.50 لكل 1,000 وحدة. تنطبق على التصنيفات، و OCR، واكتشاف الوجوه للاستخدام بين 1,001 و 5,000,000 وحدة.
- تحديد مواقع الكائنات: $2.25 لكل 1,000 وحدة. تتم فوترتها بمعدل ممتاز لبيانات مربعات الإحاطة.
- اكتشاف الويب: $3.50 لكل 1,000 وحدة. وهي مكالمة واجهة برمجة التطبيقات القياسية الأكثر تكلفة.
- Vertex AI Vision Streams: $10.00 لكل بث شهرياً. يغطي معالجة الفيديو في الوقت الفعلي لتمويه الأشخاص.
تتصاعد التكاليف دون سابق إنذار إذا ارتفعت عمليات تحميل المستخدمين بشكل مفاجئ.
كيف يقارن Google Cloud Vision AI بالبدائل
يشبه Amazon Rekognition ولكن Google تقدم دعماً أفضل لتقنية OCR متعددة اللغات للمستندات المكتوبة بخط اليد. تفرض Amazon Rekognition رسوماً قدرها $1.00 لكل 1,000 صورة لأول مليون طلب. بينما تفرض Google رسوماً قدرها $1.50 لنفس الحجم. يسمح Amazon Rekognition بالتعرف على الوجوه للأفراد المعروفين، بينما تحظر Google ذلك.
على عكس Azure AI Vision، يجبر Google Cloud Vision AI المستخدمين على الانتقال إلى Vertex AI لتدريب النماذج المخصصة. يتضمن Azure AI Vision تدريب النماذج المخصصة ضمن واجهة Vision Studio الأساسية الخاصة به. تفرض Azure رسوماً قدرها $1.00 لكل 1,000 معاملة لتقنية OCR الأساسية. توفر Google باقة مجانية أكثر سخاءً (1,000 وحدة مقابل معاملات Azure المجانية المحدودة).
الخلاصة لمطوري السحابة في المؤسسات
يقدم Google Cloud Vision AI تحليلاً موثوقاً للصور مدرباً مسبقاً للفرق المستثمرة في نظام Google Cloud البيئي. وهو الأفضل للمطورين الذين يحتاجون إلى تقنية OCR جاهزة للإنتاج وإشراف على المحتوى دون تدريب نماذجهم الخاصة. يجب على الفرق التي تتطلب التعرف على الوجوه لأفراد محددين التوجه إلى Amazon Rekognition.
تقييمات المستخدمين
لا توجد تقييمات بعد. كن أول من يشارك تجربته!
سجّل الدخول لكتابة تقييم.
مقالات ذات صلة
أدلة ومقالات ذات صلة بـ Google Cloud Vision AI.

Google Vision AI Explained (2026): Pricing Per 1,000 Units, Free Tier, and Alternatives

Amazon Translate Review (2026): Pricing, Accuracy, and When to Pick an Alternative

Perplexity AI Tutorial: Maximize Your Research Workflows

Grok 4.3 API for Agents (May 2026): Pricing, Benchmarks, Migration

Does API Cost More Than a Subscription for Claude Opus 4.8, GPT-5.5, and Grok?
