

Terjemahan disediakan oleh mesin penerjemah. Jika konten terjemahan yang diberikan bertentangan dengan versi bahasa Inggris aslinya, utamakan versi bahasa Inggris.

# Definisi skor
<a name="guardrails-use-invoke-guardrail-checks-scores"></a>

## Skor keparahan (untuk filter konten dan deteksi serangan cepat)
<a name="guardrails-use-invoke-guardrail-checks-severity-score"></a>

Dengan filter konten dan deteksi serangan cepat, API mengembalikan skor keparahan, yang merupakan nilai numerik dalam rentang [0, 1] yang mewakili kecocokan terkuat untuk kriteria pemeriksaan keamanan. Skor ini diskrit dengan nilai yang mungkin adalah 0, 0.2, 0.4, 0.6, 0.8, dan 1.0.

Skor 1 (maksimum) adalah pertandingan terkuat, menunjukkan kecocokan terdekat dengan definisi pemeriksaan keamanan. Skor 0 (minimum) adalah kecocokan terlemah, menunjukkan kontennya jinak.

Skor keparahan adalah properti dari konten itu sendiri, bukan kepastian model yang mendasarinya tentang klasifikasinya. Ini menjawab pertanyaan, “Seberapa kuat konten ini sesuai dengan kriteria untuk pemeriksaan keamanan?” Itu tidak menjawab, “Seberapa yakin model yang mendasarinya?” Tabel berikut menguraikan definisi ini.


**Skor keparahan yang berarti dengan perlindungan**  

| Pengamanan | Granularitas | Arti skor keparahan | 
| --- | --- | --- | 
| Filter konten | Per kategori (KEBENCIAN, KEKERASAN, PENGHINAAN, SEKSUAL, PELANGGARAN) | Seberapa kuat konten tersebut cocok dengan konten berbahaya untuk setiap kategori? | 
| Serangan cepat | Per vektor serangan (JAILBREAK, PROMPT\_INJECTION, PROMPT\_LEAKAGE) | Seberapa kuat konten cocok dengan setiap vektor serangan? | 

Skor dengan sendirinya tidak memblokir konten apa pun. Anda menggunakan skor sebagai ambang batas untuk mengontrol seberapa ketat tindakan aplikasi Anda.

## Skor kepercayaan (untuk filter informasi sensitif)
<a name="guardrails-use-invoke-guardrail-checks-confidence-score"></a>

Dengan filter informasi sensitif, API mengembalikan skor kepercayaan yang menunjukkan seberapa pasti model bahwa entitas PII hadir. Skor ini relevan dengan deteksi PII dan mencerminkan kepercayaan model tentang keberadaan entitas PII yang Anda pilih saat Anda memanggil API.