怎麼挑模型

角色扮演用哪個 AI 模型最好

沒有單一答案,而任何給你單一答案的頁面都在賣東西。下面寫的是每一種模型真正擅長什麼,以及怎麼在戲演到一半的時候看出你挑錯了。

Talaforge › 角色扮演用哪個 AI 模型最好

大部分人問「哪個模型最好」,等的是一個名字。誠實的答案是這個問題少了一個詞:最好——在哪件事上。文筆漂亮、慢火燉出來的那一個,往往在第四十則回覆時把劇情線弄丟;而把劇情守得住的那一個,寫起來像一份稱職的報告。

你不必一次決定。角色、他的性格和他記得的每一件事,跟生成文字的那個模型是分開的,所以換模型是一幕一幕的選擇,不是一次承諾。

每一種擅長什麼

有五個可以選,而且它們是真的不同的樂器,不是同一件東西的五種尺寸。

怎麼看出你在錯的那一個上面

症狀很具體,知道之後你就不用再猜了。

回覆都很漂亮,但劇情已經悄悄不動了。三幕之前有人答應過的事,之後再也沒人提起 — 那是推理的問題,往 GLM 或 DeepSeek 移。

什麼都合理,卻什麼都打不到心上。角色把意思照順序講得清清楚楚,一點潛台詞都沒有 — 那是文筆的問題,Claude Opus 就是為這個而存在的。

該輕鬆的場面卻僵硬又正式。這時候更暖、更快的模型比更強的模型合適,Gemma 的位置就在這裡。

角色和很久以前定下來的事情打架。先去看記憶,再怪模型 — 如果那件事從來沒被寫下來,沒有任何模型能把它正確地掰出來。

換模型不會重設任何東西

模型不是角色的一部分。人設、記憶、場景和對話記錄全部原地不動,改變的只有生成下一則回覆的那個東西。

所以換模型便宜到可以當工具用,而不是當決定。常見的做法是:來回鬥嘴時用快的,到了關鍵的那一刻再換濃的 — 一句告白、一次對峙、一個結尾。

有一件事要有心理準備:口氣會稍微變。同一份人設交給兩個模型,聲音不會一模一樣,段落中間換的話接縫可能看得出來。在兩幕之間換、而不是在一幕裡面換,幾乎就看不到了。

取樣參數比大家以為的更重要

模型的選擇決定上限,取樣參數決定你落在這個範圍裡的哪個位置。溫度(temperature)管的是回覆有多好猜 — 低一點更穩,高一點更意外。其餘那些(top_p、top_k、min_p、重複懲罰)限制的是模型連考慮都會考慮哪些候選字。

一個讀起來很平的模型,常常是溫度的問題,不是模型的問題。一個每四則回覆就把同一句愛用語再講一次的角色,是重複懲罰的問題。

這些參數在角色層和套餐層都是開放的,而且以 JSON 匯出匯入,所以一組調得好的數值可以存下來、搬著走,不必每次憑記憶重建。

這份陣容是什麼,不是什麼

五個模型,之所以是這五個,是因為它們覆蓋了真正不同的地盤,不是為了讓數字好看。有更好的模型出現時陣容就會換 — 這是一個路由決定,不是對特定名字的承諾。

這裡沒有排名,因為排名完全取決於你眼前這一幕。一個告訴你「某某模型就是角色扮演最強」的頁面,只是還沒演到需要另一個模型的那一幕。

整體來說,角色扮演用哪個 AI 模型最好?
沒有唯一的最好,誠實的判準是這一幕需要什麼。要濃的文筆和潛台詞就往 Claude Opus;劇情複雜又必須前後一致就往 GLM 或 DeepSeek;輕鬆鬥嘴就往 Gemma。因為換模型是一幕一幕的事,實務上的答案是:場景變了就換,而不是一次挑定。
換模型會讓角色忘記我嗎?
不會。記憶、人設和對話記錄屬於角色,不屬於模型。換掉的只有生成下一則回覆的東西 — 角色知道你的每一件事都原封不動地帶過去。
很長的故事適合哪一個模型?
DeepSeek 很會把又長又繞的敘事串住,GLM 則能在長段來回裡守住一個計畫。但在這件事上,能留得住的記憶比模型選擇更關鍵:一個從來沒被寫進記憶的事實,在任何模型上都撐不過長度。
換完模型之後,角色為什麼聽起來不一樣?
同一份人設交給兩個模型,聲音不會一模一樣 — 角色還是同一個,只是口氣稍微變了。在兩幕之間換、而不是在一段話中間換,接縫基本上看不出來。
只是隨便聊聊,值得用比較好的模型嗎?
通常不用。Standard 對多數場景是真的夠用,而且每個新角色本來就跑在它上面。比較濃的那幾個,是在特定的時刻賺到自己的位置,而不是整段對話都用。
取樣參數可以自己調嗎?
可以。溫度、top_p、top_k、min_p 和那幾個懲罰值都能按角色調整,每一項還有一個「送不送」的開關,所以某個模型不接受的參數,它就根本收不到。預設值以 JSON 匯出匯入。
建立角色的時候要先選模型嗎?
可以選,但不用非選不可。每個新角色都跑在 Standard 上,直到你去換;而任何一段對話裡的任何時候,你都能換。
角色扮演要用哪一個 Claude 模型?
陣容裡的 Claude 只有一個,就是 Claude Opus,重點是文字本身的時候就選它——慢慢燒起來的戲、利落的克制、話裡有話的角色。輕快的鬥嘴用它反而不對:它會把隨口的一來一往寫得比實際更重,而且是五個裡最慢的。這裡刻意不寫版本號,因為套餐後面的 Claude 一直維持在新的;你選的是這一支,戲一轉,聊天中途點一下就換過去。
角色扮演要用哪一個 GLM 模型?
GLM 也只有一個,是戲變複雜時往上的那一檔:長長的一段來回裡它能把計畫守住,劇情分支之後也記得誰知道什麼。它給不了 Claude Opus 那種質地——文字是乾淨而不是有氛圍的,告白那種戲讀起來比較平。不少人平常用 GLM 推劇情重的故事,只在關鍵的那一刻換到更濃的。
在 Telegram 建立一個角色 →

延伸閱讀

做角色的路上,我們學到的事