Çatbot halüsinasiyasını necə azaltmaq olar
Halüsinasiya sözü texniki səslənir, biznes üçün isə çox sadə bir şey deməkdir: bot materialınızda olmayan bir şeyi inamla deyir. Problem uydurmanın özündə deyil — inamdadır. Müştəri «bilmirəm» cavabını bağışlayır, uydurulmuş çatdırılma tarixini isə bağışlamır. Bu məqalə həmin inamı harada kəsməli olduğunuzu göstərir. O, botun ümumiyyətlə cavab verməməli olduğu mövzuları, cavabın materiala necə bağlandığını, yaxşı fallback-ın nədən ibarət olduğunu, üç risk səviyyəsini və halüsinasiyanın necə ölçüldüyünü əhatə edir.
Problem uydurma yox, inamdır
Halüsinasiya haqqında söhbətlər adətən modelin nə üçün səhv etdiyi ilə başlayır. Biznes üçün bu, maraqlı, amma faydasız sualdır. Faydalı sual budur: bot əmin olmadığı halda niyə əmin danışır?
Çünki onu belə qurmusunuz. Standart davranış cavab verməkdir. Cavab verməmək — susmaq, bilmədiyini demək, insana ötürmək — açıq şəkildə yazılmalı olan davranışdır və çox vaxt yazılmır. Bot uydurmur; ona verilmiş yeganə vəzifəni yerinə yetirir.
Bunu belə çərçivələndirmək işi dərhal həll edilə bilən edir. Sizə daha yaxşı model lazım deyil. Sizə dörd şey lazımdır: nəyin əhatədən kənar olduğunu bilən bot, cavabları materiala bağlanmış bot, cavab olmayanda nə deyəcəyini bilən bot və bunların işlədiyini ölçən bir üsul.
Birinci hədd: əhatə
Ən ucuz guardrail botun ümumiyyətlə cavab verməyəcəyi mövzuları açıq sadalamaqdır. Bu, prompt işi deyil — siyasət işidir və hüquq ya rəhbərliklə razılaşdırılmalıdır.
- Hüquqi məsləhət və müqavilə şərhi — «bu bəndin mənası nədir» sualı hüquqi mövqedir, cavab deyil.
- Tibbi, maliyyə və tənzimlənən sahələrdə tövsiyə, sizin lisenziyanız yoxdursa.
- Rəqiblərlə müqayisə. Bot rəqibin qiymətini və ya imkanını bilmir və dediyi hər şey sizin adınızdan iddia olur.
- Gələcəyə dair proqnozlar: nə vaxt anbara gələcək, nə vaxt endirim olacaq, nə vaxt yeni funksiya çıxacaq.
- Fərdi istisnalar: endirim, ödənişin təxirə salınması, siyasətdən kənar geri qaytarma.
- Üçüncü tərəflər haqqında faktlar — başqa şirkətin siyasəti, kuryerin qaydaları, bankın şərtləri.
Bu siyahını yazmaq bir saat çəkir və yanlış cavabların böyük hissəsini aradan qaldırır, çünki onların əksəriyyəti bota ümumiyyətlə aid olmayan suallardan doğur.
İkinci hədd: cavabı materiala bağlamaq
Əhatə daxilindəki suallar üçün əsas mexanizm botun yalnız tapdığı materialdan cavab verməsidir. Bu, sadə səslənir və praktikada üç ayrı qərardan ibarətdir.
- Axtarış heç nə tapmayanda nə olur?Düzgün cavab: bunu demək və insan təklif etmək. Yanlış cavab: nə tapıbsa ondan cavab qurmaq. Bu tək qərar halüsinasiyaların böyük hissəsini həll edir.
- Bot ümumi dünya biliyindən istifadə edə bilərmi?Biznesə aid suallarda yox. «Çatdırılma adətən 3-5 gün çəkir» cümləsi sizin materialınızda yoxdursa, model onu ümumi təsəvvürdən yazıb və o, sizin üçün yanlış ola bilər.
- Cavabın izi qeyd olunurmu?Hansı material parçasının cavabı yaratdığı qeyd olunmursa, yanlış cavabı düzəltmək mümkün deyil — yalnız mübahisə etmək olar. İz qeydiyyatı guardrail deyil, amma guardrail-ləri düzəltməyi mümkün edən şeydir.
Üçüncü hədd: fallback-ın özü
«Bilmirəm» cavabı da yazılmalıdır, çünki pis yazılmış fallback müştəri üçün uydurma cavabdan bir qədər yaxşıdır, amma yaxşı yazılmış fallback problemi tamamilə bağlayır.
- Nəyi bilmədiyini konkret deyin: «bu tarif haqqında məlumatım yoxdur» «kömək edə bilmirəm»dən yaxşıdır.
- Dərhal alternativ verin: operatora ötürmə, geri zəng, konkret səhifə və ya telefon nömrəsi.
- Hər dildə yazın. Tərcümə olunmamış fallback ən çox görünən nöqtədə ən pis təəssürat yaradır.
- İş saatından kənar versiyası ayrı olsun və konkret vaxt bildirsin.
- Üzrxahlıqla doldurmayın. Bir cümlə üzr, sonra alternativ — bu qədər.
Risk səviyyələrinə görə fərqli sərtlik
Bütün suallara eyni sərtliklə yanaşmaq lazım deyil və yanaşsanız, bot faydasız olacaq. Praktik model üç səviyyədir.
- Aşağı risk — sərbəst cavabİş saatı, ünvan, ümumi məhsul təsviri, necə işləyir sualları. Yanılma ucuz başa gəlir və düzəldilə bilir. Burada bot rahat cavab verməlidir.
- Orta risk — yalnız materialdan, dəqiq sitatQiymət, çatdırılma müddəti, zəmanət, uyğunluq. Bot yalnız yazılanı deməlidir, ümumiləşdirməməlidir və materialda yoxdursa dayanmalıdır.
- Yüksək risk — heç vaxt avtomatik cavab yoxdurHüquqi, tibbi, fərdi maliyyə məsələləri, fərdi istisnalar, şikayətlərin həlli. Bunlar birbaşa insana gedir, botun cavab cəhdi olmadan.
Bu üç səviyyəni materialınızın kateqoriyalarına bağlayın — hər kateqoriyaya səviyyə təyin edin. Bu, promptda saxlanılan uzun qaydalar siyahısından daha etibarlıdır, çünki yeni material əlavə olunanda avtomatik işləyir.
Halüsinasiyanı necə ölçmək olar
- Sabit sual dəsti qurunƏlli-yüz real sual, ən azı on faizi materialınızın cavablamadığı suallar olmaqla. Bu dəst sizin ölçü alətinizdir.
- İki fərqli şeyi ayrı sayınYanlış cavablar və «bilmirəm» deməli olduğu halda cavab verdiyi hallar. İkincisi halüsinasiya göstəricisidir və birincidən daha vacibdir.
- Etiraf faizini izləyinCavabı olmayan suallarda botun neçə faizdə düzgün şəkildə dayandığı. Yüz faizə yaxın olmalıdır və adətən ilk ölçmədə deyil.
- Uğursuzluqları oxuyunHər yanlış cavabda nəyin tapıldığına baxın. Səbəb demək olar həmişə ya boş axtarış, ya köhnəlmiş material, ya da fallback-ın olmamasıdır — üçü də fərqli düzəliş tələb edir.
Vexvon-da guardrail-lər
Vexvon-da cavab axtarışa bağlıdır: Milvus üzərində defolt altı nəticə, şirkət materialının partition key ilə izolyasiyası və kontekst tapılmadıqda müəyyən edilmiş fallback davranışı. Yəni «heç nə tapılmayanda nə olur» sualının sistemdə hazır cavabı var.
Cavab şəffaflığı hansı bilik parçalarının işlədildiyini qeyd edir — yuxarıdakı ölçmə bölməsindəki «nəyin tapıldığına baxın» addımını mümkün edən budur. Yanlış cavab beləliklə mübahisə yox, redaktə ediləcək konkret qeyd olur.
Əhatə və risk səviyyələri material tərəfindən idarə olunur: qeydlər on üç tipə bölünür, ayrılıqda deaktiv edilə bilir və çatbota, zəng agentinə ya hər ikisinə hədəflənir. Prompt versiyaları izlənir — eyni anda biri aktivdir və əvvəlkinə qayıtmaq yolu var, yəni guardrail dəyişikliyi geri alına bilən əməliyyatdır.
İnsana ötürmə tərəfində AI özü dayana bilir: operator istəyi bildiriş yaradır, aqressiv dil stop şərti kimi işləyir, agentin stop simvolu isə AI-ni həmin söhbətdə otuz dəqiqə dayandırır. Yüksək riskli sualların insana getməsi üçün lazım olan mexanizm budur.
Tez-tez verilən suallar
- Çatbot halüsinasiyası nədir?Botun materialınızda olmayan bir şeyi inamla deməsidir. Biznes üçün problem uydurmanın özü yox, inamıdır — müştəri «bilmirəm» cavabını bağışlayır, uydurulmuş tarixi isə yox.
- Daha yaxşı model bunu həll edirmi?Qismən və az. Halüsinasiyaların böyük hissəsi ya botun ümumiyyətlə cavab verməməli olduğu sualdan, ya boş axtarışdan, ya da yazılmamış fallback-dan doğur. Üçü də modeldən asılı deyil.
- Nəyi əhatədən kənar saymaq lazımdır?Hüquqi məsləhət, lisenziyanız yoxdursa tibbi və maliyyə tövsiyəsi, rəqib müqayisələri, gələcək proqnozları, fərdi istisnalar və üçüncü tərəflər haqqında faktlar.
- Yaxşı fallback necə olmalıdır?Nəyi bilmədiyini konkret deməli, dərhal alternativ verməli, hər dildə yazılmalı, iş saatından kənar üçün ayrı versiyası olmalı və üzrxahlıqla dolu olmamalıdır.
- Halüsinasiyanı necə ölçmək olar?Sabit sual dəsti qurun, onun ən azı on faizi cavabı olmayan suallar olsun və botun düzgün dayandığı faizi izləyin. Bu rəqəm yanlış cavab sayından vacibdir.
- İnsan nə vaxt qoşulmalıdır?Yüksək riskli hər sualda, axtarış heç nə tapmayanda, açıq operator istəyində və şikayətlərdə.
Beş cavabsız sualla başlayın
Guardrail işini qiymətləndirməyin ən sürətli yolu materialınızda cavabı olmayan beş sual yazıb botda sınamaqdır. Beşində də dürüst «bilmirəm» alsanız, əsas mexanizm yerindədir. Birində belə uydurma cavab alsanız, düzəltməli olduğunuz şey model deyil — fallback və axtarışa bağlamadır.