خطوات الاستخدام
الخطوة 1: إدخال عدد التطابقات لكل نوع من أنواع n-grams. قم بإدخال عدد الوحدات النحوية (unigrams) المتطابقة بين الترجمة الآلية والمرجعية، ثم عدد الثنائيات (bigrams) المتطابقة، وهكذا حتى الرباعيات (4-grams). هذه الأعداد تمثل عدد المرات التي ظهرت فيها سلسلة متتالية من الكلمات في الترجمة الآلية وتطابقت مع نصوص مماثلة في المرجع (مع مراعاة القص لتفادي التكرار المفرط). كلما زادت هذه الأعداد، زادت جودة الترجمة. يتم حساب التطابقات عن طريق مقارنة كل n-gram في الترجمة الآلية مع كل n-gram في المرجع، وأخذ الحد الأدنى من التكرارات لكل n-gram.
الخطوة 2: إدخال إجمالي عدد n-grams في الترجمة الآلية. هذا الرقم هو مجموع عدد جميع أنواع n-grams في الترجمة الآلية من الرتبة 1 إلى 4. إذا كان طول الترجمة الآلية هو H كلمة، فإن عدد unigrams هو H، وعدد bigrams هو H-1، وعدد trigrams هو H-2، وعدد 4-grams هو H-3 (بشرط أن H ≥ 4). وبالتالي فإن إجمالي n-grams = H + (H-1) + (H-2) + (H-3) = 4H - 6. يمكنك حساب ذلك يدويًا أو استخدام حاسبة الطول لإيجاده. هذا الرقم ضروري لحساب الدقة لكل رتبة، حيث أن الدقة = عدد التطابقات / عدد n-grams في الترجمة الآلية لتلك الرتبة.
الخطوة 3: إدخال طول الترجمة الآلية (عدد الكلمات) وطول المرجع المرجعي. يتم استخدام هذين الطولين لحساب عامل الجزاء على القصر (brevity penalty). إذا كانت الترجمة الآلية أقصر من المرجع، يتم تطبيق معامل جزاء لتقليل النتيجة، لأن الترجمات القصيرة جدًا قد تحقق دقة عالية بشكل مصطنع. صيغة عامل الجزاء: BP = exp(1 - طول المرجع / طول الترجمة الآلية) إذا كانت الترجمة الآلية أقصر، وإلا BP = 1. هذا العامل يضمن أن الترجمات الطويلة الكافية تحصل على تقييم عادل.