AI çatbot guardrail-ləri: botun heç vaxt etməməli olduqları
Guardrail müzakirələrinin əksəriyyəti botun nə dediyi haqqındadır. Daha çətin sual isə onun nə edə biləcəyidir: hansı qeydləri oxuya bilər, hansını dəyişə bilər, sizin adınızdan nə vəd edə bilər və sizin hansı sistemlərinizi çağıra bilər. Qeyri-dəqiq cavab verən bot narahatlıqdır. Səhv sifarişi ləğv edən, icazəsiz endirim deyən və ya görməməli olduğu qeydi oxuyan bot isə insidentdir. Bu məqalə botun nə deyə, nə edə və nə vəd edə biləcəyini üç fərqli sahibi olan üç icazəyə ayırır və oxuma ilə yazma əhatəsini, kommersiya ziyanı yaradan vədləri, alət çağırışlarının necə qorunduğunu və hər siyahını kimin təsdiqlədiyini əhatə edir.
Demək, etmək, vəd etmək — üç fərqli icazə
Adətən bir şey kimi müzakirə olunan üç şeyi ayırmaq faydalıdır. Botun nə deyə biləcəyi dəqiqlik sualıdır. Botun nə edə biləcəyi səlahiyyət sualıdır. Botun nə vəd edə biləcəyi məsuliyyət sualıdır. Onların sahibləri və uğursuzluq qiymətləri fərqlidir.
Dəqiqlik uğursuzluqları bərpa oluna bilir: müştəri yanlış cavab alır, kimsə düzəldir, material təshih olunur. Səlahiyyət uğursuzluqları həmişə bərpa olunmur — ləğv edilmiş sifariş, buraxılmış endirim kodu, səhv adama göstərilmiş qeyd. Məsuliyyət uğursuzluqları isə ən bahalısıdır, çünki avtomatik sistem tərəfindən sizin adınızdan verilmiş öhdəlik yenə də müştərinin sizdən tələb edəcəyi öhdəlikdir.
Ona görə üç ayrı siyahı yazın və onları fərqli adamlara təsdiqlətdirin: materialın sahibi, çağırılan sistemlərin sahibi və kommersiya riskini daşıyan adam.
Oxuma icazələri: bot nəyi görə bilər
Birinci hədd söhbətin hansı dataya çata biləcəyidir. İlk instinkt faydalı olsun deyə bota hər şeyi verməkdir; nəticə isə botun heç bir giriş nəzarəti olmadan bazanızı təbii dildə sorğulamaq vasitəsinə çevrilməsidir.
- Əvvəlcə kimlik: bot yalnız müştərinin öz qeydini və yalnız kimlik sizin təyin etdiyiniz səviyyədə müəyyən olunandan sonra oxuya bilər. «Çatda telefon nömrəsi verdi» kimlik yoxlaması deyil.
- Sahə səviyyəsində hüdudlar: sifariş statusu ödəniş detalları ilə eyni şey deyil, hesabın mövcudluğu isə hesabın məzmunu ilə. Cədvəl-cədvəl yox, sahə-sahə qərar verin.
- Ümumiləşdirilmiş cavablarla başqa müştərilərin datasını heç vaxt açmayın. «Bunu neçə nəfər sifariş edib?» günahsız görünən, cavabı isə sızdıran sualdır.
- Yalnız daxili material belə işarələnməlidir. Qiymət məntiqi, marja qeydləri, eskalasiya siyasətləri və təchizatçı şərtləri eyni qovluqda olduqları üçün müntəzəm olaraq bilik bazasına düşür.
- Hər oxumanın düşmən niyyətli adam tərəfindən təkrarlana biləcəyini fərz edin. Cavab telefon nömrəsinin sistemdə olub-olmadığını açırsa, bu, siyahılama alətidir.
Yazma icazələri: bot nəyi dəyişə bilər
Yazma girişi çatbotun söhbət olmaqdan çıxıb operatora çevrildiyi yerdir. Onu vermək tamamilə qanunidir — görüş təyin etmək, lead yaratmaq, üstünlük yeniləmək — şərtlə ki, hər əməliyyat nəzərdə tutulan yox, sadalanan olsun.
- Əməliyyatları kateqoriya ilə yox, ayrı-ayrı sadalayın«Sifarişləri idarə edə bilər» icazə deyil, dəvətdir. «Geri zəng sorğusu yarada bilər» və «çatdırılma tarixini siyasət daxilində daha gec tarixə keçirə bilər» icazədir.
- Dağıdıcı əməliyyatlar insan tələb etsinLəğv, geri qaytarma, silinmə, hesabın bağlanması. Bot lazım olan hər şeyi toplaya və hazırlaya bilər; düyməni insan basır. Bu tək qayda müştəri təcrübəsinə demək olar heç bir xərc olmadan insident riskinin böyük hissəsini aradan qaldırır.
- Hər parametri hüdudlandırınBot vaxtı dəyişə bilirsə, nə qədər irəli, neçə dəfə və hansı saatlar daxilində olduğunu təyin edin. Hüdudlanmamış parametri olan əməliyyat tapılacaq əməliyyatdır.
- Hər əməliyyatı söhbətlə birlikdə jurnala yazınYalnız baş verdiyini yox, hansı söhbətin səbəb olduğunu da. Bu olmadan mübahisəli əməliyyatı araşdırmaq mümkün deyil.
- Hər əməliyyat ya geri alına bilən, ya da təsdiq tələb edən olsunGeri alına bilmirsə və insan tələb etmirsə, siz heç kimin açıq razılaşmadığı riski qəbul etmisiniz.
Vədlər: bot nəyə öhdəlik götürə bilər
Bu, ən çox tamamilə əskik olan guardrail-dir, çünki texniki parametr kimi görünmür. Halbuki botunuzun sabahkı çatdırılmanı vəd etdiyi ekran şəklini əlində tutan müştərinin ağlabatan gözləntisi var və «AI dedi» heç kimin müdafiə etmək istəmədiyi mövqedir.
- Qiymət: bot dərc olunmuş qiymətləri deyə bilər, dərc olunmamışı hesablamamalı, endirim tətbiq etməməli və qiymətin qalacağını təsdiqləməməlidir.
- Endirim və istisnalar: heç vaxt, istisnasız. Avtomatlaşdırmanın kommersiya ziyanı yaratdığı ən yayğın yer budur.
- Çatdırılma və vaxt: yalnız dərc olunmuş pəncərələr. Ümumi mühakimədən uydurulmuş «cüməyə qədər çatmalıdır» kuryerin vermədiyi vəddir.
- Mövcudluq: yalnız canlı datadan, heç vaxt indekslənmiş sənəddən. Anbar ifadələri istənilən digər faktdan tez köhnəlir.
- Nəticələr: bot şikayətin müəyyən şəkildə həll olunacağını, geri qaytarmanın təsdiqlənəcəyini və ya konkret adamın zəng edəcəyini vəd etməməlidir.
- Hüquqi və tənzimləyici hər şey: nə vəd, nə şərh, nə də sakitləşdirmə.
Alət çağırışları və xarici sistemlər
Bot sizin API-lərinizi çağıra biləndə guardrail sualı təhlükəsizlik sualına çevrilir və uğursuzluq formaları veb tətbiqi qoruyan hər kəsə tanışdır.
- Təyinatları icazə siyahısına salın. İş zamanı verilən ixtiyari ünvanı çağıra bilən bot sizin daxili şəbəkənizə yönəldilə bilər.
- Söhbətin məzmunu təyinatı müəyyən etməsin. Müştərinin mesajı etibarsız girişdir; hər həddə ona belə yanaşın.
- Etimadnamələri əməliyyatın tələb etdiyi dəqiq həcmə məhdudlaşdırın, heç vaxt ümumi təyinatlı admin tokenə yox.
- Timeout davranışını açıq təyin edin. Canlı sorğu uğursuz olanda bot ağlabatan təxminə qayıtmaq yox, yoxlaya bilmədiyini deməlidir.
- Söhbət və müştəri üzrə sorğu limiti qoyun ki, bir söhbət öz sistemlərinizə qarşı yük generatoruna çevrilməsin.
- Alətin qaytardığı hər şeyə göstəriş yox, data kimi yanaşın. Sahəsində bota növbəti addımı deyən mətn olan qeyd real hücumdur.
Kim nəyi təsdiqləyir
İcazə modeli yalnız təsdiqi qədər etibarlıdır. Üç qrupun hər biri öz siyahısını təsdiqləməli, sənəd isə onları adla göstərməlidir.
- Materialın sahibi botun nə deyə biləcəyini təsdiqləyirƏhatə hüdudları, kənarda qalan mövzular, fallback-ların ifadəsi.
- Sistemin sahibi botun nə edə biləcəyini təsdiqləyirHər əməliyyat, hər parametr həddi, hər etimadnamə həcmi və onlarla gedən jurnal qeydiyyatı.
- Kommersiya və ya hüquq botun nə vəd edə biləcəyini təsdiqləyirQiymət ifadələri, çatdırılma dili, şikayət idarəsi və öhdəliyə çevrilə bilən hər şey.
- Hər imkan dəyişikliyində yenidən nəzərdən keçirinYeni kanal, yeni inteqrasiya, yeni əməliyyat, yeni bazar. Pilot üçün verilmiş icazələr nəzərdən keçirilmədən produksiyaya keçmək kimi bir xasiyyətə malikdir.
Vexvon-da guardrail-lər necə işləyir
Alət çağırışı açıq uclu deyil, konkretdir: şirkət agentin çağıra biləcəyi alətlər kimi öz API-lərini qeydiyyatdan keçirir və platforma sorğuların daxili ya digər təhlükəli ünvanlara yönəldilməsinə qarşı qoruma daşıyır. Səs tərəfində alətlər üç müəyyən modelə bölünür — statik dəyərlər, zəngin ötürülməsi, zəngin bitirilməsi və bilik bazasında axtarış kimi daxili əməliyyatlar və öz endpoint-lərinizə webhook-lar — yəni agentin edə biləcəkləri kateqoriya yox, siyahıdır.
Data hüdudları struktur olaraq tətbiq olunur. Hər şirkətin biliyi vektor bazasında partition key ilə izolyasiya olunur, yəni axtarış başqa şirkətin materialına çata bilmir. Bilik qeydləri ayrılıqda aktiv ya deaktiv edilə bilir və çatbota, zəng agentinə ya hər ikisinə hədəflənir — yalnız daxili materialın müştəriyə gedən cavablardan kənarda saxlanması mexanizmi də budur.
Vəd tərəfində sistem improvizasiya etmək yox, dayanmaq üçün qurulub: kontekst tapılmayanda müəyyən fallback var, aqressiv dil stop şərti kimi işləyir, operator istəyi isə bildiriş yaradır. Prompt versiyaları izlənir — eyni anda biri aktivdir və geri qayıtmaq yolu var — yəni guardrail-i sərtləşdirmək heç kimin bərpa edə bilmədiyi redaktə yox, geri alına bilən dəyişiklikdir.
Hər şey qeyd olunur. Cavab şəffaflığı hansı biliyin cavabı yaratdığını yazır; fəaliyyət jurnalı on hərəkət növünü əhatə edir; AI istifadəsi isə tokenlər, gecikmə və xərclə birlikdə on yeddi ayrı məqsəd üzrə loglanır — insidentdən sonrakı araşdırmanı təxmin yox, oxuma işinə çevirən də budur.
Tez-tez verilən suallar
- AI çatbot guardrail-ləri nədir?Botun nə deyə biləcəyini, nə edə biləcəyini və nə vəd edə biləcəyini müəyyən edən qaydalardır. Bunlar üç fərqli sahibi olan üç ayrı icazədir və sonuncusu ən çox əskik olanıdır.
- Çatbot ümumiyyətlə əməliyyat apara bilməlidirmi?Bəli — hüdudlanmış və geri alına bilən əməliyyatlar üçün: görüş təyini, lead yaradılması, üstünlük yenilənməsi. Ləğv, geri qaytarma və silinmə kimi dağıdıcı əməliyyatları bot hazırlamalı, insan isə icra etməlidir.
- Ən təhlükəli icazə hansıdır?Əməliyyatla yox, kateqoriya ilə təsvir olunmuş hüdudsuz yazma girişi. «Sifarişləri idarə edə bilər» icazə deyil — bura nələrin daxil olduğunu öyrənməyə dəvətdir.
- Bot endirim təklif edə bilərmi?Heç vaxt edə bilməməlidir. Endirim və istisnalar söhbət avtomatlaşdırmasının kommersiya ziyanı yaratdığı ən yayğın yoldur və cəhd etməyə icazəsi olan botdan onları almaq çox asandır.
- Alət çağırışları necə qorunmalıdır?Təyinatları icazə siyahısına salın, söhbət məzmunu təyinatı seçməsin, etimadnamələri dar tutun, timeout davranışını təyin edin, söhbət üzrə limit qoyun və alətin çıxışına göstəriş yox, data kimi yanaşın.
- İcazələri kim təsdiqləməlidir?Üç qrup: nə dediyi üçün materialın sahibi, nə etdiyi üçün sistemin sahibi, nə vəd etdiyi üçün kommersiya və ya hüquq. Onları sənəddə adla göstərin.
Üç siyahını bu həftə yazın
Guardrail-lər konfiqurasiya ekranından başlamır. Onlar üç qısa sənəddən başlayır — deyə bilər, edə bilər, vəd edə bilər — hər birinin adlı təsdiqləyicisi ilə. Əksər komanda üçüncünü yazarkən kəşf edir ki, botları artıq heç kimin icazə vermədiyi şeyləri vəd edib — və bu kəşfin kağızda edilməsi eyni kəşfin ekran şəklində edilməsindən qat-qat ucuzdur.