Aether
AETHER · 常见问题

如果您有问题答案可能在这里。

Aether Compress,API 使用,Aether Generate, 价格、验证和安全相关的常见问题,我们在一个地方收集了。

Genel
Aether Compress 到底是什么?
Aether Compress 是在 LLM 调用之前运行的上下文优化层。它处理您的应用程序将发送给模型的上下文,减少可以削减的多余输入负载,并返回优化后的上下文。
Genel
Aether 是人工智能模型吗?
不是。Aether Compress 不是 LLM,也不会调用其他人工智能模型来优化上下文。它是运行在现有 AI 架构前的独立优化层。
Genel
Aether 可以与哪些模型一起使用?
Aether Compress 会生成优化的上下文。因此, 在下一阶段使用的模型或提供者与 Aether Compress 无关。您可以在现有 AI 流程中使用优化后的上下文。
Genel
我需要更改现有的 AI 架构吗?
您不需要更改基础模型架构。Aether Compress 会被放置在上下文生成阶段与 LLM 调用之间。 您的应用将接收优化后的上下文并继续其现有流程。
Compress
Aether Compress 在运行时会进行 LLM 调用吗?
不。仅当您使用 Aether Compress 时,才不会向任何 AI 提供商发送请求。上下文会被优化,结果会直接返回到您的应用程序。
Compress
发送 Query 是强制的吗?
不。如果不发送 Query,将使用通用优化。发送 Query 时,上下文会根据查询以查询为中心的方式进行优化。
Compress
General 和 Query-Aware 之间有什么区别?
通用模式专注于在不依赖特定问题的情况下保持上下文的一般可用性。在查询感知模式下,用户查询也被纳入优化输入,并且上下文将根据该查询的信息需求进行处理。
Compress
Aether 会在每次请求中缩小上下文吗?
不。目标并不是在任何情况下都产生更小的输出。当找不到可以安全减少的部分时,上下文可能保持不变或仅有非常有限的变化。
Compress
每次请求保证减少 40.65% 的 token 吗?
不。40.65%,是针对 Aether Compress v1.0 在 100,000 个场景的验证集上测得的平均输入减少率。 实际结果可能因上下文的结构、长度和优化模式而有所不同。
Compress
最高测得的减少率是多少?
在 100,000 个场景的验证集中测得的最高输入减少率为 52.67%。 此数值并非每次请求的预期或保证比例。
Generate
Aether Generate 是什么?
Aether Generate 会先使用 Aether Compress 对上下文进行优化,然后将其发送到您选择的 AI 提供商,并将最终模型响应以单流方式返回到您的应用程序中。
Generate
Compress和Generate之间有什么区别?
Compress 仅进行上下文优化,并返回优化后的上下文。 Generate 而在此优化之后,它会使用你自己的AI提供商生成最终答案。
Generate
我需要为Aether Generate提供我自己的LLM API密钥吗?
是的。在Generate使用中,采用BYOK,即自带密钥模式。你需要提供支持的提供商账户和API密钥。
Generate
AI提供商的使用费用包含在Aether计划中吗?
不。Aether 计划仅涵盖通过 Aether 处理的输入令牌使用情况。外部 AI 提供商的模型使用费用将另外计入您自己的提供商账户。
API
我如何集成 Aether Compress?
在您现有的 LLM 调用之前,将上下文发送至 Aether API。API 会返回优化后的上下文。随后,您可以在现有的模型调用中使用该上下文。
API
使用 Aether Compress 是否必须使用 SDK?
不可以。基础集成可以通过 HTTP API 完成。 您使用的应用语言或框架,只要能向 API 发送标准 HTTP 请求,就可以实现集成。
API
我一次请求可以发送的 token 数量有限制吗?
是的。单次请求的 token 限额取决于您使用的计划。 免费计划为 25K,开发者计划为 50K,专业计划为 100K, Studio 计划为 200K,企业计划为 500K 输入 token 上限。
API
速率限制会根据计划不同而不同吗?
是的。每分钟请求和并发请求容量会随着计划升级而增加。 详细限制可以在定价页面查看。
API
我应该用Aether来替代RAG系统吗?
不。Aether不能替代检索系统。RAG系统会检索相关内容,而Aether Compress则会插入到此检索结果与LLM调用之间,以优化上下文。
定价
有免费计划吗?
是的。免费计划每月包含100万输入令牌。开始使用无需信用卡。
定价
令牌配额是如何计算的?
计划配额根据通过Aether Compress处理的输入令牌数量计算。
定价
哪些计划包含Aether生成?
Aether 仅适用于付费计划。免费计划仅包含 Aether Compress 的使用。
定价
在非常高的 token 使用量下我应该使用哪个模型?
对于在自己公司每月使用 50 亿 token 及以上的情况,可以考虑 Technology License。如果您想将 Aether 提供给自己的客户,Distribution Partner 模式会更合适。
定价
Distribution Partner 与 Technology License 之间的区别是什么?
技术许可,Aether 是用于您自身高容量操作的。分销合作伙伴则是面向希望向客户提供 Aether 并管理下级客户结构的公司。
验证
Aether Compress 是如何测试的?
Aether Compress v1.0 已通过 100,000 个场景的本地验证集进行测试。在这些测试中,同时评估了信息保留和输入减少。
验证
100% 准确性意味着什么?
在外部模型验证中选择的500个场景中 都测量了必要响应的保留情况。该结果适用于测试的 场景,并不意味着对所有可能输入的无限普遍保证。
验证
3,48 毫秒表示什么?
3,48 毫秒是在验证环境中测量的平均 Aether Compress 处理时间。实际延迟可能因硬件、基础设施、请求 大小和运行环境而异。
验证
我在哪里可以看到基准测试结果?
详细的测量结果、方法论和测量限制 Benchmark 会发布在该页面上。
安全性
我可以在哪里查看Aether的安全方法?
关于访问控制、基础设施安全和 安全通知流程的详细信息 安全性 您可以在页面上查看。
安全性
关于个人数据的政策在哪里?
关于一般隐私方法 隐私政策, 关于土耳其个人数据处理流程的信息 KVKK披露文本 incelenebilir.
您仍有问题吗?

让我们一起找到答案。

您可以就集成、高流量使用、授权或 Aether 与您的架构的兼容性与我们联系。