RESEARCH / CHARACTER MODELS研发中
角色模型研究
我们研究角色如何在长期交互中保持身份、记忆与关系,让每一次回应都建立在过去之上。
重要的不只是角色会说什么,而是它能否持续成为同一个角色
角色一致性
在长程交互中保持设定、语气、价值取向与行为边界,减少随轮次增长产生的角色漂移。
关系连续性
让共同经历与关系变化进入后续判断,使互动不是每轮重置,而是拥有可延续的过去。
叙事因果
让事件、选择与后果保持可追溯的关联,使角色行为在更长时间尺度上仍然成立。
以小模型验证聚焦训练的价值
qwen3-4b-tylogiorm
qwen3-4b-tylogiorm 是一款专注于角色扮演(RP)的后训练模型,基于 Qwen/Qwen3-4B 构建。它面向那些更看重角色一致性、独特语气和叙事连贯性的用户,而非追求通用助手功能。
该模型的主要目标并非成为全能型前沿助手,而是更加聚焦和务实:让一个小模型在沉浸式角色扮演方面真正表现出色。
在本代码库所存档的 SillyBench 测试中,这种专业化使其性能相比未经调优的 Qwen3-4B 基础模型实现了巨大飞跃,并在角色扮演专项评估中,达到了与多个规模大得多的参考模型相竞争的水平。
查看模型记录用长程交互,而不是单轮印象,判断角色是否稳定
SillyBench 将角色偏移、情感断裂、重复表达与叙事崩塌放进多轮交互中观察,让训练方向建立在可识别、可比较的结果上。
观察角色是否随上下文增长发生偏移
检查设定与共同经历能否在后续交互中继续起作用
识别情感断裂、重复表达与叙事崩塌
浙公网安备33011002019019号