Çox adam hansı modelin ən yaxşı olduğunu soruşur və ad gözləyir. Dürüst cavab budur ki, sualda bir söz çatmır: nədə ən yaxşı. Gözəl, yavaş alışan mətn yazan model qırxıncı cavabda süjetin ipini itirəcək, süjeti saxlayan model isə səliqəli hesabat kimi yazacaq.
Bir dəfəyə qərar verməyə məcbur deyilsiniz. Personaj, onun xasiyyəti və xatırladığı hər şey sözləri yaradan modeldən ayrıdır, ona görə keçid öhdəlik yox, səhnə üzrə seçimdir.
Hər növ nədə yaxşıdır
Beşi mövcuddur və onlar eyni şeyin beş ölçüsü yox, həqiqətən fərqli alətlərdir.
- Standard — hər yeni personajın işlədiyi model. Sürətli, sabit və əksər səhnə üçün kifayət qədər yaxşı. Onu seçməyə ehtiyac yoxdur, artıq oradadır.
- GLM — səhnə mürəkkəbləşəndə bir pillə yuxarı. Daha sıx məntiq, uzun yazışmada da planı əlində saxlayır.
- Claude Opus — ən zəngin dil və alt mətn. Yavaş alışan səhnələr, ölçülü sükut, dediyindən artığını duyduran personajlar.
- Google Gemma — cəld, isti və oynaq. Yüngül zarafat və qısa cavablaşma üçün əla.
- DeepSeek — uzun və dolaşıq hekayələri ipini itirmədən bir yerdə saxlayır.
Səhv modeldə olduğunuzu necə bilmək olar
Əlamətlər konkretdir və onları tanıyandan sonra təxmin etməyi dayandırırsınız.
Cavablar gözəldir, amma süjet sakitcə dayanıb. Kimsə üç səhnə əvvəl nəsə vəd etmişdi və o vaxtdan heç kim bunu xatırlamır. Bu, məntiq problemidir — GLM və ya DeepSeek tərəfə keçin.
Hər şey ardıcıldır və heç nə toxunmur. Personaj demək istədiyini olduğu kimi, sıra ilə və alt mətnsiz deyir. Bu, dil problemidir və Claude Opus elə bunun üçündür.
Səhnə yüngül olmalı ikən quruyub rəsmiləşib. Burada daha güclü model yox, daha isti və sürətli model uyğun gəlir; Gemma öz yerini məhz burada qazanır.
Personaj çoxdan qurulmuş bir şeyin əksini deyir. Modeli günahlandırmadan əvvəl yaddaşa baxın — fakt heç yazılmayıbsa, heç bir model onu düzgün uydura bilməz.
Keçid heç nəyi sıfırlamır
Model personajın bir hissəsi deyil. Xasiyyət, yaddaş, səhnə və yazışma tarixçəsi olduğu yerdə qalır; yalnız növbəti cavabı yaradan şey dəyişir.
Bu, keçidi qərar yox, alət kimi işlətməyə imkan verəcək qədər ucuz edir. Geniş yayılmış üsul budur: səhnənin gedişatı üçün sürətli model, önəmli an üçün isə daha zəngin modelə keçid — etiraf, qarşıdurma, final.
Gözləməli olduğunuz bir şey var: səs bir az sürüşəcək. Eyni xasiyyət verilən iki model eyni səslənmir və abzasın ortasında tikiş görünə bilər. Söhbətin ortasında yox, səhnələr arasında keçid etmək bunu demək olar ki, tam gizlədir.
Seçmə parametrləri düşündüyünüzdən çox əhəmiyyət daşıyır
Model seçimi tavanı qoyur; seçmə parametrləri isə həmin aralığın harasına düşəcəyinizi həll edir. Temperatur cavabın nə qədər gözlənilən olduğunu idarə edir — aşağı daha sabit, yuxarı daha qeyri-adi. Qalanları (top_p, top_k, min_p, təkrar cəriməsi) modelin ümumiyyətlə nəzərdən keçirdiyi söz namizədlərini məhdudlaşdırır.
Yastı görünən model çox vaxt model problemi yox, temperatur problemidir. Hər dördüncü cavabda sevimli ifadəsini təkrarlayan personaj isə təkrar cəriməsi problemidir.
Bunlar personaj və paket üzrə açıq göstərilir, JSON kimi ixrac və idxal olunur — beləcə işləyən dəyərlər dəsti hər dəfə yaddaşdan yenidən qurulmaq əvəzinə saxlanılıb daşına bilir.
Sıra nədir və nə deyil
Beş model — rəqəmi təsirli göstərmək üçün yox, həqiqətən fərqli sahələri örtdüyü üçün seçilib. Daha yaxşıları çıxdıqca sıra dəyişir; bu, konkret adlara dair vəd deyil, yönləndirmə qərarıdır.
Burada sıralama yoxdur, çünki sıralama tamamilə qarşınızdakı səhnədən asılıdır. Sizə bir modelin rol oyunu üçün sadəcə ən yaxşı olduğunu deyən səhifə başqa model tələb edən səhnəni sınamayıb.