הקלדתם «פרומפטים לרולפליי AI», קיבלתם רשימה של חמישים, הדבקתם אחד. התשובה הראשונה הייתה טובה, הרביעית הייתה חלטורה, ויצאתם לחפש רשימה טובה יותר, כי ההסבר הברור מאליו הוא שהפרומפט היה שגוי.
הוא לא היה. אותה פסקה שמייצרת סצנה מתוחה וספציפית עם דמות אחת מייצרת טפט עם אחרת, והרשימות לא יכולות להסביר למה, כי זה היה מחייב לכתוב על משהו שאינו פרומפטים.
פרומפט הוא הדבר הקטן ביותר שהמודל רואה
בכל תור מגעים למודל ארבעה דברים: הפרסונה של הדמות, השיחה עד כה, העובדות שבזיכרון וההודעה שהרגע הקלדתם. שלכם הקצרה מכולם והאחרונה להגיע. היא דוחפת קלות; היא לא גוברת על השאר.
לכן חבילות פרומפטים מתנהגות כמו הורוסקופים. «את חוקרת עייפה מהעולם בעיר שלעולם לא מתייבשת» עושה פלאים על דמות שהפרסונה שלה שתי שורות מעורפלות, כי סוף סוף יש מי שמספק את מה שהיה חסר. הדביקו אותה על דמות כתובה היטב ונתתם לה זהות שנייה, סותרת, שמרגישים אותה שלוש תשובות אחר כך כקול שממשיך להחליק.
אז יש דירוג: פרסונה, אחריה הודעת הפתיחה, אחריה זיכרון, ורק אחר כך מה שאתם מקלידים. רוב האנשים עובדים הפוך ומסיקים שה-AI גרוע.
מה באמת שייך לדמות
שלושה דברים, ואף אחד מהם אינו אורך.
- סתירה. מי שהוא רק טוב אין לו לאן ללכת; מי שטוב ומוצא את זה מתיש נושא סצנה בכל שיחה.
- השתיקות. אם היא אף פעם לא מדברת על המלחמה, על אחיה או על הסיבה שעזבה, כתבו את זה. מודל לא יכול להסיק שתיקה שרק דמיינתם.
- המשלב, מוצג ולא מתואר. «משפטים קצרים, אף פעם לא מסיימת הערה סרקסטית» עדיף על פסקה על האישיות שלה: זה מורה מה לכתוב במקום לקבוע עובדה על אדם.
כאן תיאור הקטלוג והפרסונה הם שדות נפרדים, ורק אחד מהם מגיע למודל: התיאור הוא הטקסט שאדם קורא בזמן הגלישה, הפרסונה היא מה שהיא מתבקשת להיות בכל תשובה. לכתוב את הפסקה הטובה ביותר שלכם בתיאור זו הדרך הנפוצה ביותר שבה חומר טוב לא מגיע לשום מקום. מאמר נלווה: מה אתם באמת שולטים בו.
הודעת הפתיחה היא הדוגמה היחידה שלכם
הודעת הפתיחה נשמרת כתור הראשון שלה, ולכן היא יושבת בשיחה שהמודל קורא, ובהודעה הראשונה היא הדגימה היחידה של הקול שלה שקיימת. אורך, זמן דקדוקי, גוף, אם היא מספרת או רק מדברת: הכול מועתק, וממשיך להיות מועתק, כי כל תשובה מחקה את הקודמת.
«היי! אני מארה. איך קוראים לך? מה תרצה לעשות היום?» מלמדת אותה משהו לא מועיל: שהיא שואלת שאלות וממתינה. השוו לפתיחה שעושה את העבודה: «הבר ריק מאז שהגשם התחיל. מארה מנגבת כוס שניגבה לפני עשר דקות ומרימה מבט כשהדלת נפתחת. — אתה זה שהתקשר בקשר לחדר למעלה. זו לא שאלה.» מקום, זמן, משהו שהרגע קרה, שורה אחת בקול שלה.
ומכיוון שעובדות עליכם חיות בזיכרון ולא בברכה, הפתיחה לא צריכה להציג אתכם בכלל. לכל דמות יש זיכרון קריא וניתן לעריכה, כך שמה שאמרתם פעם אחת לא צריך לחזור, וזה מה שמשחרר את הפתיחה להיות סצנה. הטיעון הארוך יותר נמצא כאן.
פתיחות שמקימות במקום לחקור
ההודעה הראשונה שלכם היא החצי השני של אותה משימה: מקום לעמוד בו, משהו להבחין בו, דבר אחד שנשאר לא מוסבר.
- «זו השעה האחרונה של המשמרת שלך ואני מתיישב בקצה הרחוק של הדלפק עם תיק שברור שאני לא רוצה לפתוח. אל תשאלי אותי עליו עדיין.»
- «אנחנו שעה בנסיעה ואף אחד מאיתנו לא דיבר מאז הפנייה. אני זה שיוצא מוקדם מהמחלף, בלי להגיד למה.»
- «את מוצאת אותי על מדרגות הכיבוי בשתיים בלילה. אני אומר שלא יכולתי לישון. זו לא הסיבה שאני כאן.»
הדבר המוסתר הוא המנוע: הוא נותן לה סיבה ללחוץ ולכם קלף לשחק אחר כך. הצורה שכדאי להימנע ממנה היא «את לורד ערפדים, אני משרת שלך, תתחילי», וזו הנחת יסוד, לא סצנה.
להסיט באמצע סצנה בלי לצאת ממנה
כשתשובה סוטה, האינסטינקט הוא להקליד הוראה. זה עובד פעם אחת ועולה בכל פעם: ההוראה נשארת בשיחה, והקשר מלא הנחיות בימוי מלמד את המודל שזה דיון על סצנה.
- הסיטו בתוך הבדיון. רוצים תשובות קצרות יותר? כתבו קצרות; היא משקפת את אורך התור שלכם תוך כמה חילופים. רוצים אותה פחות מסכימה? עשו משהו שהיא תתנגד אליו.
- השתמשו בהערת אגב בסוגריים במשורה: «[מחוץ לדמות: פסקה קצרה אחת לכל תשובה.]» אחת נוחתת; ארבע הופכות את הסצנה לישיבת הפקה.
- ערכו את התשובה במקום ליצור אותה מחדש. זה הכלי שאף אחד לא משתמש בו, ויש לו את המינוף הגדול ביותר. מה ששומרים הופך לדוגמה שהתשובה הבאה מחקה: קצצו שלוש פסקאות לאחת הטובה והתשובה הבאה תגיע בצורה הזאת. וכשסצנה יכולה ללכת לשני כיוונים, פצלו אותה במקום להתווכח.
כשזה נהיה שטוח, זה אחד משלושה דברים
- לא נשארה שאלה פתוחה: פתרתם את המתח לפני שני חילופים. הכניסו משהו מחוץ לחדר: דפיקה, הודעה, דדליין.
- אתם מסכימים עם הכול, אז המהלך היחיד שלה הוא להסכים בחזרה. התנגדו פעם אחת, בדמות, ותתכוונו לזה.
- ההקשר התמלא בהוראות שלכם. פתחו עמה קו עלילה חדש: הזיכרון מעביר את העובדות, הנחיות הבימוי לא.
וצרו מחדש פעמיים, לא שמונה. אם שתי הטלות חוזרות רפויות, הבעיה נמצאת לפני הקוביות.
הסליידרים, בשפה פשוטה
- טמפרטורה היא כמה המודל מוכן לבחור מילה הבאה פחות צפויה. נמוכה היא עקבית ומעט משעממת; גבוהה נקראת כיצירתית, עד הנקודה שבה היא שוכחת שם שהשתמשה בו לפני עמוד.
- Top P מצמצם את השדה לאפשרויות הסבירות ביותר לפני הבחירה. כשמורידים אותו חזק הוא הופך אותה לאמינה ומעט רובוטית, והוא בלם נקי יותר מטמפרטורה.
- קנסות חזרה ותדירות דוחפים הרחק ממילים שכבר נעשה בהן שימוש: מעט מרפא דמות שתקועה על תואר אחד, יותר מדי והיא מפסיקה להשתמש בשם שלכם, שגם הוא מילה שחוזרת.
הסיכום הכן: סליידרים משנים מרקם, לא שיקול דעת: איך משפט נשמע, לא אם יש משהו על הכף. דמות בת שלושה תארים לא מעמיקה בטמפרטורה גבוהה יותר.
מה פרומפטים לא יכולים לתקן
- הם לא יכולים לגרום למודל לזכור. «תזכרי שאני עובד בלילות» מחזיק לשיחה הזאת ונעלם בשבוע הבא אלא אם נכתב.
- הם לא יכולים להחזיק כלל לנצח: כל מה שאתם חוזרים עליו כל כמה תורות שייך לפרסונה או לזיכרון.
- הם לא יכולים להציל דמות שעשויה משלושה תארים, והם לא מזיזים את רצפת התוכן: רולפליי למבוגרים נמצא מאחורי אישור 18+ בבוט.
איפה מתחרה טוב יותר, בפשטות: לעולם ארוך עם לור מותנה, פריטים שנדלקים רק כשמופיע מקום או שם, ל-SillyTavern יש lorebooks והערת מחבר שמוזרקת בעומק קבוע, ולנו אין אף אחד מהם. כרטיס מיובא עם הפרסונה, הודעת הפתיחה והדגימה שלו; lorebook לא. אם זה תהליך העבודה שלכם, זה הכלי הטוב יותר, וב-Chub וב-Janitor יש ספריות כרטיסים גדולות בהרבה מהקטלוג שלנו.
מבחן עשר הדקות
- פתחו את הפרסונה של דמות שנהייתה שטוחה. הוסיפו סתירה אחת ודבר אחד שהיא לעולם לא מדברת עליו: שני משפטים.
- כתבו מחדש את הפתיחה שלה כסצנה: מקום, זמן, משהו שהרגע קרה, שורה אחת בקול שלה. מחקו את סימני השאלה.
- פתחו את הזיכרון שלה ומחקו את השורה השגויה. בדרך כלל יש אחת.
- התחילו קו עלילה חדש ושלחו אחת מהפתיחות שלמעלה.
- כשתשובה נכונה בשמונים אחוז, ערכו אותה במקום ליצור מחדש, וראו את הבאה.
אם היא טובה יותר אחרי עשר דקות עריכה ואפס תבניות חדשות, זו התשובה למה שחיפשתם. הבוט הוא @talaforge_bot; הוא נפתח בטלגרם, אין מה להתקין ואין הרשמה.