01
Compress
发送上下文和查询;获取将在模型调用中使用的优化输入。
两个生产端点使用相同的身份验证、幂等性和错误协议。
发送上下文和查询;获取将在模型调用中使用的优化输入。
通过在一次请求中运行优化和模型生成,减少集成面。
从响应元数据中跟踪原始令牌、优化令牌和节省比例。
通过请求 ID 跟踪每个调用,以便日志记录、支持和审计流程。
const response = await fetch("https://api.aether.tr/v1/compress", {
method: "POST",
headers: {
"Authorization": "Bearer <API_KEY>",
"Idempotency-Key": crypto.randomUUID(),
"Content-Type": "application/json"
},
body: JSON.stringify({
context: "Your long context...",
query: "What should be answered?",
level: "auto"
})
});
const payload = await response.json();
if (!response.ok) throw new Error(payload.error?.code ?? "AETHER_API_ERROR");
console.log(payload.data.compressed);联系团队,将Aether Compress添加到您现有的LLM流程中。