یادداشت‌های میدانی

شخصیت هوش مصنوعی را «آموزش» نمی‌دهید. این‌ها است که شکلش می‌دهد

«How to train ai chatbot» پرپیوندترین پرسش در داده‌های کلیدواژهٔ انگلیسی ماست، و برای شخصیت‌ها قاب اشتباهی است. مدل تمام‌شده می‌رسد. هرچه واقعاً در کنترل شماست سریع‌تر، ارزان‌تر و برگشت‌پذیر است.

2026-08-25۶ دقیقه مطالعه همهٔ یادداشت‌ها
شخصیت هوش مصنوعی را «آموزش» نمی‌دهید. این‌ها است که شکلش می‌دهد

در پژوهش کلیدواژه‌ای ما، پرپیوندترین پرسشِ منفرد در داده‌های انگلیسی «how to train ai chatbot» بود — چطور چت‌بات را آموزش بدهم. بذرهای بیشتری به آن رسیدند تا به هر عبارتی دربارهٔ دوست دختر، نقش‌آفرینی یا اپلیکیشن‌ها. مردم فرض می‌کنند پشت یک شخصیت خوب باید فرایند آموزشی در کار باشد، و دستشان از آن کوتاه است.

برای یک شخصیت، این قاب به‌سادگی اشتباه است — و فهمیدن چرایش سریع‌ترین ارتقای در دسترس است.

مدل مال شما نیست که آموزشش بدهید، و این اشکالی ندارد

مدل‌های زبانی پشت یک شخصیت — اینجا پنج‌تا، از جمله Claude Opus و DeepSeek — تمام‌شده می‌رسند؛ روی متنی آموزش دیده‌اند که هیچ آدمی در عمرش نخواهد دید. هیچ چیزی که بتوانید اضافه کنید تکانشان نمی‌دهد. آنچه کم دارند دانش نیست؛ دستورهایی است دربارهٔ اینکه همین حالا قرار است چه کسی باشند.

شخصیت دقیقاً همین است: دستورها به‌علاوهٔ حافظه. هر دو متن ساده‌اند. هر دو مال شمایند. تغییر هر کدام از پاسخ بعدی اثر می‌کند — حلقهٔ بازخوردی تنگ‌تر از هر دور آموزشی‌ای که تا حالا به کسی پیشنهاد شده.

بار اصلی را همان یک جمله می‌کشد

یک جملهٔ نوشته‌شده کل پیش‌نویس را می‌سازد — هویت، لحن، صحنهٔ آغاز، ظاهری قفل‌شده. کیفیت آن جمله بیش از هر تنظیمی روی صفحه تعیین‌کننده است.

ترفندی که کار می‌کند تضاد است. «کتابدار مهربان» تا پاسخ دهم صاف می‌شود، چون جایی برای رفتن ندارد. «کتابداری که با همه مهربان است و از این‌که این‌قدر به مهربانی‌اش محتاج‌اند دلخور است» به مدل تنشی می‌دهد که بازی‌اش کند — و تنش همان چیزی است که آدم خوانده می‌شود.

فیلدهایی که مردم رد می‌کنند

پیش‌نویس تولیدشده نقطهٔ شروع است و همهٔ فیلدها برای همیشه ویرایش‌پذیر می‌مانند. سه‌تایشان ارزش توجه دارند:

پیام آغازین بیش از خود هویت، لحن را تعیین می‌کند — نخستین جملهٔ شخصیت به هر دوی شما یاد می‌دهد این گفت‌وگو چه صدایی دارد. محدودیت‌ها جایشان در نوشته است: اگر او هرگز از جنگ حرف نمی‌زند، همین را بنویسید، چون مدل نمی‌تواند سکوتی را حدس بزند که شما نگفته‌اید. و ظاهر هنگام ساخت قفل می‌شود — برای همین عکس امشبش با عکس ماه پیشش می‌خواند.

هیچ‌کدام از این‌ها مهندسی پرامپت به آن معنای ترسناک نیست. بیشتر شبیه نوشتن بریف شخصیت برای بازیگری است که مو به مو اجرایش می‌کند.

حافظه همان حلقهٔ آموزشی است که واقعاً دارید

کسانی که دنبال «چت شخصیت هوش مصنوعی که همه‌چیز را یادش می‌ماند» می‌گردند در واقع یکدستی در طول هفته‌ها را می‌خواهند — و سازوکارش مدل بزرگ‌تر نیست؛ حافظه‌ای است که بشود اصلاحش کرد.

اینجا حافظه واقعیت‌های کوتاه خواندنی است، جدا برای هر شخصیت و هر موضوع. وقتی واقعیت غلطی ثبت شود — و یک روز می‌شود — فهرست را باز می‌کنید و سطر را درست می‌کنید. همان یک اصلاح کاری را می‌کند که مردم از فاین‌تیون تصور می‌کنند، در پنج ثانیه و برگشت‌پذیر. اصلاح حافظه در آغاز زندگی یک شخصیت، بیش از هر عادت دیگری شکلش می‌دهد.

وقتی هنوز غلط به گوش می‌رسد

اگر داستان منحرف شد، ابزارها جراحی‌اند، نه سراسری: همان یک پاسخی را که کج رفت دوباره تولید کنید، یا صحنه را شاخه کنید و هر دو شاخه را نگه دارید. اگر لحن بی‌روح است، شاید ساز برای این صحنه اشتباه است — جابه‌جایی میان پنج مدل در میانهٔ گفت‌وگو نثر را عوض می‌کند بی‌آنکه به این‌که شخصیت کیست دست بزند.

!تنها چیزی که هرگز کمک نمی‌کند از صفر شروع‌کردن است. شخصیت همان‌طور بهتر می‌شود که پیش‌نویس بهتر می‌شود — با ویرایش‌هایی که می‌مانند — و پاک‌کردن پیش‌نویس دقیقاً همان بخشی را پاک می‌کند که بازتولیدشدنی نیست: آنچه دربارهٔ شما آموخته.

پس پاسخ صادقانه به «چت‌باتم را چطور آموزش بدهم» این است: یک جملهٔ خوب می‌نویسید، وقتی حافظه‌اش خطا کرد اصلاحش می‌کنید، و در برابر وسوسهٔ گشتن دنبال صفحهٔ تنظیماتی که هنر در آن باشد مقاومت می‌کنید. هنر در نوشتن است، همان‌جا که همیشه بود.

چطور یک چت‌بات هوش مصنوعی را با دادهٔ خودم آموزش بدهم؟
برای یک شخصیت، نمی‌دهید: مدل‌ها از پیش آموزش‌دیده می‌رسند و آنچه در کنترل شماست هویت نوشته‌شدهٔ شخصیت و حافظهٔ آن است. اصلاح یک سطر حافظه رفتار را از پاسخ بعدی عوض می‌کند — همان چیزی که بیشتر مردم واقعاً از «آموزش» می‌خواهند.
می‌توانم شخصیت هوش مصنوعی خودم را از هیچ بسازم؟
بله — یک جمله پیش‌نویس کاملی می‌دهد با هویت، لحن، پیام آغازین و ظاهر قفل‌شده، و همهٔ بخش‌ها برای همیشه ویرایش‌پذیر می‌مانند. نه کدی، نه مجموعه‌داده‌ای، نه چیزی برای نصب.
چرا شخصیتم فراموش می‌کند یا با خودش تناقض می‌گوید؟
دو خطای متفاوت‌اند: جزئیات اخیر وقتی می‌افتند که گفت‌وگو از پنجرهٔ زمینهٔ مدل بلندتر شود؛ واقعیت‌های بلندمدت فقط وقتی خراب می‌شوند که حافظه چیزی غلط ثبت کرده باشد. دومی را مستقیم درست می‌کنید — حافظه را باز کنید و سطر را اصلاح کنید.
به مهارت مهندسی پرامپت نیاز دارم؟
نه. تنها تکنیکی که مهم است نوشتن یک تضاد در هویت شخصیت است، و گفتن صریح محدودیت‌ها به‌جای امید به این‌که مدل خودش حدس بزند. این نویسندگی است، نه مهندسی.
می‌توانم شخصیتی را که جای دیگری ساخته‌ام بیاورم؟
بله — قالب‌های رایج کارت شخصیت مستقیم وارد می‌شوند و پریست‌های نمونه‌برداری به‌صورت JSON جابه‌جا می‌شوند؛ تنظیماتی که در ابزار دیگری ساخته‌اید منتقل می‌شود، نه این‌که از نو انجام شود.
یک شخصیت در تلگرام بسازید ←