树状分支对话怎么用
聊到一半发现开头问错了、或者想让同一个问题换个问法再试一次——大多数应用只能「重新开一轮」,Agora 的做法是直接从那条消息长出新分支。这篇讲清楚分支机制怎么用、上下文压缩怎么配合。
分支从哪来
对话在 Agora 里不是一条直线,而是一棵树。触发新分支的动作有两类:
- 编辑历史消息:改完发送,应用会从这条消息处分出一条新路径,原路径原封不动留在原地;
- 重新生成回答:对同一条提问再生成一次,新旧两个回答并行存在,随时切换查看。
两版答案可以并排对照:同一个问题换种问法、改掉提问里的错误信息再聊一遍,上下文都保留着,不需要复制粘贴来回复制。数据存在本机的数据库里,分支再多也不影响原有对话。
长对话的搭档:Compact 压缩
分支聊得越多,上下文越长,迟早碰到模型窗口上限。Agora 给每轮对话估算一个 token 预算(4K~1M 视所配模型而定),超限时用「Compact」把旧内容收拢:
- 最近一段对话保持原文,继续正常聊;
- 更早的内容压成一个可见的摘要胶囊,插在对话流里;
- 原消息一条不删——删掉胶囊,边界立刻回到压缩前的状态。
什么时候该手动压一次?发现模型开始忘记开头的细节、或者界面提示接近窗口上限时,触发一次 Compact 即可。压缩进行中发消息会先排队,等它跑完再处理。
两个实用习惯
- 改错别重开:提问里有错字、漏了背景,直接编辑那条消息分出新枝,比整轮重聊省时间。
- 重要分支早导出:会话可以整体导出为
.agora归档,聊出有价值的内容就先备份一份,换机也能直接导入。
接着了解
想先看看这款客户端长什么样、都有哪些能力,去Agora 安卓客户端说明站翻一遍就能有全貌;离线玩法见手机离线跑大模型,整体特点见开源AI对话客户端特点速览。