Aether Compress
实时优化预览
实时模拟
Girdi12,840令牌
3.48毫秒
Optimized7,620令牌
$128.40
正常成本
$76.20
Aether之后
+$52.20
总节省
LLM·Semantik·GPU
40,65%
更少令牌使用
100K+
成功的测试场景
100%
测量的响应准确性
3.48毫秒
平均压缩时间
Aether API流程
一个API。两种使用方式。
仅获取压缩数据,或使用Aether Generate 在单个流程中从您选择的AI提供商生成最终响应。
01 · 请求
客户应用程序
将上下文和请求发送到Aether API。
POST /v1/compress
02 · 优化
Aether Compress
减少不必要的令牌负载,同时保持可用上下文。
正在压缩
选项01
仅 Aether Compress
优化后的数据直接返回给客户。 不会进行任何 AI 调用。
veya
选项 02
Aether Generate
优化后的数据将发送到您选择的 AI 提供商, 并最终将回答返回给客户。
OpenAI·Gemini·Claude
Aether Compress
发送更少的 Token。保持上下文。
Aether Compress 在发送到 LLM 之前优化您的输入, 减少不必要的 Token 负载并返回可用的上下文。
Genel
通过评估所有上下文来减少不必要的 Token 负载。查询导向
根据特定查询优先处理所需上下文。优化输出
直接在您的 LLM 流程中使用压缩后的上下文。可选
Aether Generate
不要更改您使用的 AI 提供商。
Aether Compress 首先优化您的上下文,然后通过 Aether Generate 将其传递给所选的 AI 提供商以生成最终答案。
OpenAI
谷歌 Gemini
Claude
唯一集成
您无需为 OpenAI、Gemini 和 Claude 分别开发集成。通过 Aether Generate 选择您的提供商,使用单一 API 流程继续。
探索计划
为真实使用量设计的简单计划。
Free
$0无限期
每月 1M 令牌这是您每月通过 Aether Compress 可以处理的总输入令牌配额。
通用 + 查询导向在保留整体上下文或专注于特定查询的情况下优化内容。
Aether Compress压缩文本并返回优化后的上下文。不会向任何人工智能模型发送请求。
Aether Generate内容首先通过 Aether Compress 进行优化,然后发送到所选的 AI 提供商以生成最终答案。
每分钟 5 次请求通过 API 在一分钟内可进行的最大请求次数。
1 个并发请求可同时处理的最大 API 请求数。
每次请求 25K 令牌单个 API 请求中可发送的最大输入令牌数量。
最大请求 256 KB单个 API 请求允许的最大数据大小。
社区支持您可以通过社区资源和常见帮助内容获得支持。
电子邮件支持对于技术和账户相关问题,您可以通过电子邮件与我们的支持团队联系。
Developer
$4.90/ 月
每月 10M 令牌这是您每月通过 Aether Compress 可以处理的总输入令牌配额。
通用 + 查询导向在保留整体上下文或专注于特定查询的情况下优化内容。
Aether Compress压缩文本并返回优化后的上下文。不会向任何人工智能模型发送请求。
Aether Generate内容首先通过 Aether Compress 进行优化,然后发送到所选的 AI 提供商以生成最终答案。
每分钟 20 个请求通过 API 在一分钟内可进行的最大请求次数。
同时 2 个请求可同时处理的最大 API 请求数。
每个请求 50K 令牌单个 API 请求中可发送的最大输入令牌数量。
最大请求 512 KB单个 API 请求允许的最大数据大小。
社区支持您可以通过社区资源和常见帮助内容获得支持。
电子邮件支持对于技术和账户相关问题,您可以通过电子邮件与我们的支持团队联系。
最受欢迎
Pro
$19.90/ 月
每月 50M 令牌这是您每月通过 Aether Compress 可以处理的总输入令牌配额。
通用 + 查询导向在保留整体上下文或专注于特定查询的情况下优化内容。
Aether Compress压缩文本并返回优化后的上下文。不会向任何人工智能模型发送请求。
Aether Generate内容首先通过 Aether Compress 进行优化,然后发送到所选的 AI 提供商以生成最终答案。
每分钟 60 个请求通过 API 在一分钟内可进行的最大请求次数。
同时 5 个请求可同时处理的最大 API 请求数。
每个请求 100K 令牌单个 API 请求中可发送的最大输入令牌数量。
最大请求 1 MB单个 API 请求允许的最大数据大小。
社区支持您可以通过社区资源和常见帮助内容获得支持。
优先电子邮件支持您的支持请求将优先于标准电子邮件请求进行处理。
Studio
$89.90/ 月
每月 250M 令牌这是您每月通过 Aether Compress 可以处理的总输入令牌配额。
通用 + 查询导向在保留整体上下文或专注于特定查询的情况下优化内容。
Aether Compress压缩文本并返回优化后的上下文。不会向任何人工智能模型发送请求。
Aether Generate内容首先通过 Aether Compress 进行优化,然后发送到所选的 AI 提供商以生成最终答案。
每分钟 120 次请求通过 API 在一分钟内可进行的最大请求次数。
10 个并发请求可同时处理的最大 API 请求数。
每次请求 200K 令牌单个 API 请求中可发送的最大输入令牌数量。
最大请求 2 MB单个 API 请求允许的最大数据大小。
社区支持您可以通过社区资源和常见帮助内容获得支持。
优先电子邮件支持您的支持请求将优先于标准电子邮件请求进行处理。
Business
$349.90/ 月
每月 1B 令牌这是您每月通过 Aether Compress 可以处理的总输入令牌配额。
通用 + 查询导向在保留整体上下文或专注于特定查询的情况下优化内容。
Aether Compress压缩文本并返回优化后的上下文。不会向任何人工智能模型发送请求。
Aether Generate内容首先通过 Aether Compress 进行优化,然后发送到所选的 AI 提供商以生成最终答案。
每分钟 300 次请求通过 API 在一分钟内可进行的最大请求次数。
20 个并发请求可同时处理的最大 API 请求数。
每次请求 500K 令牌单个 API 请求中可发送的最大输入令牌数量。
最大请求 4 MB单个 API 请求允许的最大数据大小。
社区支持您可以通过社区资源和常见帮助内容获得支持。
7/24 电子邮件支持在技术和账户相关的关键问题上,提供每周 7 天、全天候的电子邮件支持。
