Skip to content

压缩上下文

引言

在智能会话的多轮对话中,随着上下文内容的不断累积,模型可能会出现“遗忘”早期信息的情况,进而影响回答的精准度,同时也会增加 Token 的消耗。为此,我们新增了“上下文压缩”功能。您可以灵活选择“自动”或“手动”模式:开启自动压缩后,系统会在达到预设条件时自动处理;选择手动模式,则可随时按需执行。您可以查看上下文使用率来决定是否压缩。该功能不仅能有效提升模型回答的准确性,还能显著降低 Token 的消耗。

自动压缩

  1. 在输入框中,鼠标放置在压缩的按钮上,勾选“自动压缩”,当上下文内容达到压缩条件时,会自动压缩。

说明:当前会话上下文窗口大小达到多少K将自动压缩,这个条件和您当前会话选择的模型有关,不同模型条件不同。自动压缩在用户界面无感知,但会提高后续回答的准确性。

手动压缩

  1. 鼠标输入框中,鼠标放置在压缩的按钮上,查看上下文使用率,使用率太高时,您可以单击“压缩当前会话”按钮,进行压缩。

上下文使用率说明:1M代表100万token数,约等于300万字符。使用率百分比计算:当前上下文字符/(500000*3)

  1. 页面显示压缩完成,则压缩成功,上下文使用率会降低,然后继续提问即可。

邮箱:chendw@feisuanyz.com 邮编:518000 地址:深圳市前海深港合作区前湾一路1号A栋201室