公司动态

Qwen3 多轮对话调稳的 4 处设置:text-generation-webui 新手实战教程

📅 2026/8/31 12:33:13
Qwen3 多轮对话调稳的 4 处设置:text-generation-webui 新手实战教程
Qwen3 多轮对话调稳的 4 处设置text-generation-webui 新手实战教程【免费下载链接】textgenOpen-source desktop app for local LLMs. Text, vision, tool-calling, OpenAI/Anthropic-compatible API. 100% private.项目地址: https://gitcode.com/GitHub_Trending/te/textgen刚在 text-generation-webui 里跑通 Qwen3你会发现前两轮挺正常到第五六轮就开始跑偏第一轮约定的条件它全忘了同一段意思换个说法又原样输出偶尔直接答非所问。这类 Qwen3 多轮对话问题基本不用换模型把预设参数、上下文窗口和指令模板调对大部分症状都能压下去。两步先跑起来预设 自动生成长度分配先在 Parameters 标签页把预设选一个再确认 Generation 区域勾选了auto_max_new_tokens。勾上之后界面向生成内容预留的空间会跟着截断长度自动计算不用手动估max_new_tokens该填多少。改完刷新对话试一下新建一条聊天随便聊三五个来回如果不再出现刚说过的话又被复读说明方向对了。预设怎么选Thinking 与 No Thinking 两套参数预设temperaturetop_ptop_k适合什么对话Qwen3 - Thinking0.60.9520推理、排查、技术问答要稳Qwen3 - No Thinking0.70.820写文案、头脑风暴要发散仓库自带的预设放在 user_data/presetsCreative、Top-P 这些可以直接参考格式Qwen3 对应的两套数值按上表填一份同名预设即可。经验值技术问答挂 Thinking写作类切 No Thinking。top_k两套都设 20把候选词范围收一收长对话里跑题词会少很多生成速度也略快。上下文窗口怎么设截断长度取上限的 80%truncation_length控制整个提示词人设加历史最多占多长。经验值取模型上下文上限的 80% 左右比如上限 4096就填 3276留出约 800 给回复本身。auto_max_new_tokens的作用就是帮你算这笔账扣掉生成预留后剩下的全部留给对话历史历史装不下时才从最旧的消息开始丢。踩坑提示聊天越长越容易把窗口顶满这时悬停菜单里的 Remove last reply 可以删掉最后一对问答New chat 则保留角色设定直接重开。指令模板与角色定义Qwen3 对话上下文优化的另一半加载模型时界面会从元数据里自动检测指令模板并更新 Parameters 面板检测不到就手动选一个。模板格式和模型训练时不一致指令遵循会明显变差这是逻辑断裂里最常见的原因。角色文件放在 user_data/characters核心字段是name、greeting开场白和context人设与示例对话。示例可以对照 user_data/characters/Example.yamlname: 小林 greeting: 你好我是小林技术问题的直接问。 context: |- 角色资深技术顾问只用中文回答 风格简洁直接不堆术语 用户temperature 调多少合适 小林一般 0.6~0.8按用途微调。context永远排在提示词最前面且不会被截断历史超了会先丢旧消息保人设。重复与遗忘text-generation-webui 参数设置的自查位回复重复先把采样惩罚参数往上挪repetition_penalty放在 1.1 到 1.3frequency_penalty放在 0.05 到 0.1改完立刻重发上一轮对比效果。Chat 页面勾选 Show controls 后输入区附近能看到当前提示的 token 计数接近截断长度时会给出预警到这一步说明历史快被挤出去了。三轮自测法第一轮给约束比如用中文讨论、附代码示例、回答保持简短第二轮追问一个相关参数第三轮直接问那我第一轮提的约束你还遵守吗。第三轮答不上前两轮的信息多半是截断长度不够或中间某轮把窗口顶满了。调完这四处再跑一遍三轮自测Qwen3 在 text-generation-webui 里的长对话通常就稳了。想再往前走一步可以去 extensions 目录翻翻扩展或者看 docs/09 - Docker.md 做容器化部署。【免费下载链接】textgenOpen-source desktop app for local LLMs. Text, vision, tool-calling, OpenAI/Anthropic-compatible API. 100% private.项目地址: https://gitcode.com/GitHub_Trending/te/textgen创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考