01
结构分析
消息角色、系统指令、文档片段和对话历史被作为独立的上下文来评估。
Aether 独立于供应商运行。在保留现有提示生成和模型选择的同时,仅使到达 LLM 的输入更加高效。
消息角色、系统指令、文档片段和对话历史被作为独立的上下文来评估。
保留与用户当前请求相关的信息,减少贡献较低的内容。
优化不仅仅是缩短字符;需要保留任务所要求的信息和指令层级。
输入和输出的token数量以及节省比例可对每个请求进行观察。
将您的消息或长文本发送到Compress API。
根据您的目标确定质量、平衡或最大节省的优化级别。
将返回的优化上下文发送到您使用的模型提供商。
联系团队,将Aether Compress添加到您现有的LLM流程中。