Aether

减轻负担。支付更少。

Aether Compress,减少你发送给LLM的多余负担。较低的令牌使用量意味着更低的成本,并在不打断当前流程的情况下实现更高效的使用。
无需信用卡
100万免费令牌
Aether Compress
实时优化预览
实时模拟
Girdi12,840令牌
3.48毫秒
Optimized7,620令牌
$128.40
正常成本
$76.20
Aether之后
+$52.20
总节省
LLM·Semantik·GPU
40,65%
更少令牌使用
100K+
成功的测试场景
100%
测量的响应准确性
3.48毫秒
平均压缩时间
Aether API流程

一个API。两种使用方式。

仅获取压缩数据,或使用Aether Generate 在单个流程中从您选择的AI提供商生成最终响应。

01 · 请求
客户应用程序

将上下文和请求发送到Aether API。

POST /v1/compress
02 · 优化
Aether Compress

减少不必要的令牌负载,同时保持可用上下文。

正在压缩
选项01
仅 Aether Compress

优化后的数据直接返回给客户。 不会进行任何 AI 调用。

veya
选项 02
Aether Generate

优化后的数据将发送到您选择的 AI 提供商, 并最终将回答返回给客户。

OpenAI·Gemini·Claude
Aether Compress

发送更少的 Token。保持上下文。

Aether Compress 在发送到 LLM 之前优化您的输入, 减少不必要的 Token 负载并返回可用的上下文。

Genel
通过评估所有上下文来减少不必要的 Token 负载。
查询导向
根据特定查询优先处理所需上下文。
优化输出
直接在您的 LLM 流程中使用压缩后的上下文。
可选
Aether Generate

不要更改您使用的 AI 提供商。

Aether Compress 首先优化您的上下文,然后通过 Aether Generate 将其传递给所选的 AI 提供商以生成最终答案。

OpenAI
谷歌 Gemini
Claude

唯一集成

您无需为 OpenAI、Gemini 和 Claude 分别开发集成。通过 Aether Generate 选择您的提供商,使用单一 API 流程继续。

探索计划
为真实使用量设计的简单计划。
Free
$0无限期
每月 1M 令牌这是您每月通过 Aether Compress 可以处理的总输入令牌配额。
通用 + 查询导向在保留整体上下文或专注于特定查询的情况下优化内容。
Aether Compress压缩文本并返回优化后的上下文。不会向任何人工智能模型发送请求。
Aether Generate内容首先通过 Aether Compress 进行优化,然后发送到所选的 AI 提供商以生成最终答案。
每分钟 5 次请求通过 API 在一分钟内可进行的最大请求次数。
1 个并发请求可同时处理的最大 API 请求数。
每次请求 25K 令牌单个 API 请求中可发送的最大输入令牌数量。
最大请求 256 KB单个 API 请求允许的最大数据大小。
社区支持您可以通过社区资源和常见帮助内容获得支持。
电子邮件支持对于技术和账户相关问题,您可以通过电子邮件与我们的支持团队联系。
免费开始
Developer
$4.90/ 月
每月 10M 令牌这是您每月通过 Aether Compress 可以处理的总输入令牌配额。
通用 + 查询导向在保留整体上下文或专注于特定查询的情况下优化内容。
Aether Compress压缩文本并返回优化后的上下文。不会向任何人工智能模型发送请求。
Aether Generate内容首先通过 Aether Compress 进行优化,然后发送到所选的 AI 提供商以生成最终答案。
每分钟 20 个请求通过 API 在一分钟内可进行的最大请求次数。
同时 2 个请求可同时处理的最大 API 请求数。
每个请求 50K 令牌单个 API 请求中可发送的最大输入令牌数量。
最大请求 512 KB单个 API 请求允许的最大数据大小。
社区支持您可以通过社区资源和常见帮助内容获得支持。
电子邮件支持对于技术和账户相关问题,您可以通过电子邮件与我们的支持团队联系。
从 Developer 开始
最受欢迎
Pro
$19.90/ 月
每月 50M 令牌这是您每月通过 Aether Compress 可以处理的总输入令牌配额。
通用 + 查询导向在保留整体上下文或专注于特定查询的情况下优化内容。
Aether Compress压缩文本并返回优化后的上下文。不会向任何人工智能模型发送请求。
Aether Generate内容首先通过 Aether Compress 进行优化,然后发送到所选的 AI 提供商以生成最终答案。
每分钟 60 个请求通过 API 在一分钟内可进行的最大请求次数。
同时 5 个请求可同时处理的最大 API 请求数。
每个请求 100K 令牌单个 API 请求中可发送的最大输入令牌数量。
最大请求 1 MB单个 API 请求允许的最大数据大小。
社区支持您可以通过社区资源和常见帮助内容获得支持。
优先电子邮件支持您的支持请求将优先于标准电子邮件请求进行处理。
从 Pro 开始
Studio
$89.90/ 月
每月 250M 令牌这是您每月通过 Aether Compress 可以处理的总输入令牌配额。
通用 + 查询导向在保留整体上下文或专注于特定查询的情况下优化内容。
Aether Compress压缩文本并返回优化后的上下文。不会向任何人工智能模型发送请求。
Aether Generate内容首先通过 Aether Compress 进行优化,然后发送到所选的 AI 提供商以生成最终答案。
每分钟 120 次请求通过 API 在一分钟内可进行的最大请求次数。
10 个并发请求可同时处理的最大 API 请求数。
每次请求 200K 令牌单个 API 请求中可发送的最大输入令牌数量。
最大请求 2 MB单个 API 请求允许的最大数据大小。
社区支持您可以通过社区资源和常见帮助内容获得支持。
优先电子邮件支持您的支持请求将优先于标准电子邮件请求进行处理。
从 Studio 开始
Business
$349.90/ 月
每月 1B 令牌这是您每月通过 Aether Compress 可以处理的总输入令牌配额。
通用 + 查询导向在保留整体上下文或专注于特定查询的情况下优化内容。
Aether Compress压缩文本并返回优化后的上下文。不会向任何人工智能模型发送请求。
Aether Generate内容首先通过 Aether Compress 进行优化,然后发送到所选的 AI 提供商以生成最终答案。
每分钟 300 次请求通过 API 在一分钟内可进行的最大请求次数。
20 个并发请求可同时处理的最大 API 请求数。
每次请求 500K 令牌单个 API 请求中可发送的最大输入令牌数量。
最大请求 4 MB单个 API 请求允许的最大数据大小。
社区支持您可以通过社区资源和常见帮助内容获得支持。
7/24 电子邮件支持在技术和账户相关的关键问题上,提供每周 7 天、全天候的电子邮件支持。
从 Business 开始
准备好开始了吗?

发送更少的令牌。支付更少。

将 Aether Compress 添加到您当前的工作流程中,并立即开始减少您发送给 LLM 的不必要令牌负载。

免费试用
无需信用卡
100万免费令牌