Aether
Aether Compress · LLM 上下文优化

减少发送给 LLM 的无效 Token。

AETHER 会在长篇、重复的上下文到达 OpenAI、Gemini 或 Claude 之前进行优化。无需更换现有模型或应用流程,即可减少输入 Token。

无需信用卡Free 计划每月 100 万 Token无设置费用
真实请求会发生什么?示例结果
原始上下文61 token

客户的订单号是 84721。配送地址已更新为安卡拉。支持团队每周一召开状态会议。订单 84721 的配送地址是安卡拉。客户再次确认了配送信息。旧地址记录不应继续使用。

优化后上下文20 token

订单 84721 当前已确认的配送地址是安卡拉。旧地址无效。

41减少的 Token%67示例降幅相同关键信息
01

将上下文发送至 AETHER

通过 HTTPS API 发送长上下文和用户当前的问题。

02

由 AETHER 优化上下文

减少重复和与问题无关的内容,同时保留关键信息。

03

使用更小的输入

将优化后的上下文交给现有模型,或通过 Generate 一次获得回答。

两种使用方式

无需更换模型,只需增加一层优化。

AETHER 不销售 AI 模型,也不会取代您的 OpenAI、Google 或 Anthropic 账户。它只减少发送给模型的输入。

仅获取优化后的上下文。

AETHER 不会调用任何模型。请在自己的 OpenAI、Gemini 或 Claude 请求中使用返回的 data.compressed。

POST https://api.aether.tr/v1/compress
Authorization: Bearer <API_KEY>
Idempotency-Key: <UNIQUE_KEY>

{ "context": "...", "query": "...", "level": "auto" }
适用于哪些场景?

控制每次请求中不断增长的上下文成本。

AI 对话应用

减少不断增长的对话历史中的重复内容。

RAG 与文档检索

根据当前问题精简检索到的长文本。

AI 智能体工作流

限制工具输出和任务历史的无序增长。

高流量 API

在保持业务价值的同时减少模型输入。

评估您的使用量

Token 规模越大,优化带来的效果越明显。

实际降幅取决于内容结构。AETHER 控制面板会测量每个请求的原始、优化后和节省的 Token。

10M示例原始量
6.2M示例优化量
3.8M示例节省量

本计算采用 38% 的示例降幅来说明产品,并非保证比例。实际结果将根据您的数据测量。

免费开始

创建您的第一个 API 密钥,并使用真实数据查看结果。

Free 计划 · 每月 100 万 Token · 无需信用卡

创建免费账户