AETHER · 常见问题
如果您有问题答案可能在这里。
Aether Compress,API 使用,Aether Generate, 价格、验证和安全相关的常见问题,我们在一个地方收集了。
01GenelAether Compress 到底是什么?
01
Genel
Aether Compress 到底是什么?
Aether Compress 是在 LLM 调用之前运行的上下文优化层。它处理您的应用程序将发送给模型的上下文,减少可以削减的多余输入负载,并返回优化后的上下文。
02GenelAether 是人工智能模型吗?
02
Genel
Aether 是人工智能模型吗?
不是。Aether Compress 不是 LLM,也不会调用其他人工智能模型来优化上下文。它是运行在现有 AI 架构前的独立优化层。
03GenelAether 可以与哪些模型一起使用?
03
Genel
Aether 可以与哪些模型一起使用?
Aether Compress 会生成优化的上下文。因此, 在下一阶段使用的模型或提供者与 Aether Compress 无关。您可以在现有 AI 流程中使用优化后的上下文。
04Genel我需要更改现有的 AI 架构吗?
04
Genel
我需要更改现有的 AI 架构吗?
您不需要更改基础模型架构。Aether Compress 会被放置在上下文生成阶段与 LLM 调用之间。 您的应用将接收优化后的上下文并继续其现有流程。
05CompressAether Compress 在运行时会进行 LLM 调用吗?
05
Compress
Aether Compress 在运行时会进行 LLM 调用吗?
不。仅当您使用 Aether Compress 时,才不会向任何 AI 提供商发送请求。上下文会被优化,结果会直接返回到您的应用程序。
06Compress发送 Query 是强制的吗?
06
Compress
发送 Query 是强制的吗?
不。如果不发送 Query,将使用通用优化。发送 Query 时,上下文会根据查询以查询为中心的方式进行优化。
07CompressGeneral 和 Query-Aware 之间有什么区别?
07
Compress
General 和 Query-Aware 之间有什么区别?
通用模式专注于在不依赖特定问题的情况下保持上下文的一般可用性。在查询感知模式下,用户查询也被纳入优化输入,并且上下文将根据该查询的信息需求进行处理。
08CompressAether 会在每次请求中缩小上下文吗?
08
Compress
Aether 会在每次请求中缩小上下文吗?
不。目标并不是在任何情况下都产生更小的输出。当找不到可以安全减少的部分时,上下文可能保持不变或仅有非常有限的变化。
09Compress每次请求保证减少 40.65% 的 token 吗?
09
Compress
每次请求保证减少 40.65% 的 token 吗?
不。40.65%,是针对 Aether Compress v1.0 在 100,000 个场景的验证集上测得的平均输入减少率。 实际结果可能因上下文的结构、长度和优化模式而有所不同。
10Compress最高测得的减少率是多少?
10
Compress
最高测得的减少率是多少?
在 100,000 个场景的验证集中测得的最高输入减少率为 52.67%。 此数值并非每次请求的预期或保证比例。
11GenerateAether Generate 是什么?
11
Generate
Aether Generate 是什么?
Aether Generate 会先使用 Aether Compress 对上下文进行优化,然后将其发送到您选择的 AI 提供商,并将最终模型响应以单流方式返回到您的应用程序中。
12GenerateCompress和Generate之间有什么区别?
12
Generate
Compress和Generate之间有什么区别?
Compress 仅进行上下文优化,并返回优化后的上下文。 Generate 而在此优化之后,它会使用你自己的AI提供商生成最终答案。
13Generate我需要为Aether Generate提供我自己的LLM API密钥吗?
13
Generate
我需要为Aether Generate提供我自己的LLM API密钥吗?
是的。在Generate使用中,采用BYOK,即自带密钥模式。你需要提供支持的提供商账户和API密钥。
14GenerateAI提供商的使用费用包含在Aether计划中吗?
14
Generate
AI提供商的使用费用包含在Aether计划中吗?
不。Aether 计划仅涵盖通过 Aether 处理的输入令牌使用情况。外部 AI 提供商的模型使用费用将另外计入您自己的提供商账户。
15API我如何集成 Aether Compress?
15
API
我如何集成 Aether Compress?
在您现有的 LLM 调用之前,将上下文发送至 Aether API。API 会返回优化后的上下文。随后,您可以在现有的模型调用中使用该上下文。
16API使用 Aether Compress 是否必须使用 SDK?
16
API
使用 Aether Compress 是否必须使用 SDK?
不可以。基础集成可以通过 HTTP API 完成。 您使用的应用语言或框架,只要能向 API 发送标准 HTTP 请求,就可以实现集成。
17API我一次请求可以发送的 token 数量有限制吗?
17
API
我一次请求可以发送的 token 数量有限制吗?
是的。单次请求的 token 限额取决于您使用的计划。 免费计划为 25K,开发者计划为 50K,专业计划为 100K, Studio 计划为 200K,企业计划为 500K 输入 token 上限。
18API速率限制会根据计划不同而不同吗?
18
API
速率限制会根据计划不同而不同吗?
是的。每分钟请求和并发请求容量会随着计划升级而增加。 详细限制可以在定价页面查看。
19API我应该用Aether来替代RAG系统吗?
19
API
我应该用Aether来替代RAG系统吗?
不。Aether不能替代检索系统。RAG系统会检索相关内容,而Aether Compress则会插入到此检索结果与LLM调用之间,以优化上下文。
20定价有免费计划吗?
20
定价
有免费计划吗?
是的。免费计划每月包含100万输入令牌。开始使用无需信用卡。
21定价令牌配额是如何计算的?
21
定价
令牌配额是如何计算的?
计划配额根据通过Aether Compress处理的输入令牌数量计算。
22定价哪些计划包含Aether生成?
22
定价
哪些计划包含Aether生成?
Aether 仅适用于付费计划。免费计划仅包含 Aether Compress 的使用。
23定价在非常高的 token 使用量下我应该使用哪个模型?
23
定价
在非常高的 token 使用量下我应该使用哪个模型?
对于在自己公司每月使用 50 亿 token 及以上的情况,可以考虑 Technology License。如果您想将 Aether 提供给自己的客户,Distribution Partner 模式会更合适。
24定价Distribution Partner 与 Technology License 之间的区别是什么?
24
定价
Distribution Partner 与 Technology License 之间的区别是什么?
技术许可,Aether 是用于您自身高容量操作的。分销合作伙伴则是面向希望向客户提供 Aether 并管理下级客户结构的公司。
25验证Aether Compress 是如何测试的?
25
验证
Aether Compress 是如何测试的?
Aether Compress v1.0 已通过 100,000 个场景的本地验证集进行测试。在这些测试中,同时评估了信息保留和输入减少。
26验证100% 准确性意味着什么?
26
验证
100% 准确性意味着什么?
在外部模型验证中选择的500个场景中 都测量了必要响应的保留情况。该结果适用于测试的 场景,并不意味着对所有可能输入的无限普遍保证。
27验证3,48 毫秒表示什么?
27
验证
3,48 毫秒表示什么?
3,48 毫秒是在验证环境中测量的平均 Aether Compress 处理时间。实际延迟可能因硬件、基础设施、请求 大小和运行环境而异。
28验证我在哪里可以看到基准测试结果?
28
验证
我在哪里可以看到基准测试结果?
详细的测量结果、方法论和测量限制 Benchmark 会发布在该页面上。
29安全性我可以在哪里查看Aether的安全方法?
29
安全性
我可以在哪里查看Aether的安全方法?
关于访问控制、基础设施安全和 安全通知流程的详细信息 安全性 您可以在页面上查看。
