LLM'e daha azcontext gönderin.
Aether Compress, context'inizi model çağrısından önce optimize eder. Gereksiz input token yükünü azaltır, kullanılabilir bilgiyi korur ve mevcut AI akışınızın daha verimli çalışmasını sağlar.
Modelden önce çalışanbir context optimizasyon katmanı.
Bir LLM çağrısında model yalnızca soruyu değil, ona gönderdiğiniz bütün context'i işler. Bu context büyüdükçe input token miktarı da büyür.
Aether Compress, uygulamanız ile model arasına yerleşir. Context'i önce optimize eder ve daha küçük bir context üretir. Sonraki adım tamamen sizin kontrolünüzdedir.
Model maliyetinin bir kısmımodele gönderdiğiniz yükten gelir.
Daha büyük context her zaman daha fazla faydalı bilgi anlamına gelmez. Tekrarlar, yardımcı içerikler ve sorguyla ilişkisi düşük bölümler de input token olarak modele taşınır.
Input context büyüdükçe sağlayıcıya gönderilen ve ücretlendirilen token miktarı artar.
Gereksiz içerik, gerçekten gerekli bilgilerin kullanabileceği context alanını tüketir.
Tek istekte küçük görünen fark, yüksek çağrı hacminde büyük toplam token miktarlarına dönüşür.
Context girer.Optimize edilmiş context çıkar.
Aether Compress, model cevabı üretmeye çalışmaz. Görevi LLM'e ulaşmadan önce input context'ini daha verimli hale getirmektir.
Uygulamanızdaki mevcut context'i Aether API'ye gönderirsiniz.
Query yoksa Genel, query varsa Sorgu Odaklı optimizasyon uygulanır.
Aether kullanılabilir bilgiyi koruyarak azaltılabilecek yükü belirler.
Optimize edilmiş context doğrudan uygulamanıza geri döner.
Sorgu olsun veya olmasın.
Context'in nasıl kullanılacağına göre iki farklı optimizasyon biçimi kullanabilirsiniz.
Genel bağlamıkoruyarak optimize edin.
Belirli bir kullanıcı sorusu olmadan context'i optimize etmek istediğiniz durumlarda General modu kullanabilirsiniz.
Context'isorguya odaklayın.
Kullanıcının sorusu biliniyorsa query de optimizasyon isteğine eklenebilir. Böylece Aether context'i o sorgunun bilgi ihtiyacını dikkate alarak işler.
Bir başka modeleklemiyoruz.
Context maliyetini azaltmak için yeni bir LLM çağrısı yapmak, maliyeti başka bir yere taşımak anlamına gelebilir. Aether Compress kendi optimizasyon işlemini ayrı bir LLM çağrısına dayandırmaz.
Aether Compress, context'i optimize etmek için başka bir yapay zekâ modeline istek göndermez.
Optimize edilen context sonraki aşamada tercih ettiğiniz model veya sağlayıcıyla kullanılabilir.
Modelinizi, prompt mimarinizi veya uygulamanızın ana LLM katmanını değiştirmek zorunda değilsiniz.
Her istekte orijinal ve optimize edilmiş token miktarını karşılaştırarak sonucu ölçebilirsiniz.
Yalnızca context'i alın.İsterseniz cevaba kadar devam edin.
Aether Compress ürünün optimizasyon katmanıdır. Aether Generate ise bu katmanı AI sağlayıcınızla tek çağrıda birleştiren isteğe bağlı kullanım biçimidir.
Optimize edilmiş context doğrudan uygulamanıza döner. Hangi modelle, ne zaman ve nasıl kullanacağınızı siz belirlersiniz.
Context önce optimize edilir, ardından kendi sağlayıcı hesabınız üzerinden modele gönderilir ve nihai cevap tek akışta döner.
Tek bir API çağrısıylaakışınıza ekleyin.
Mevcut context oluşturma aşamanız ile LLM çağrınızın arasına Aether Compress'i eklemeniz yeterlidir.
Dokümantasyonu inceleyinconst response = await fetch(
"https://api.aether.tr/v1/compress",
{
method: "POST",
headers: {
"Authorization": "Bearer YOUR_API_KEY",
"Idempotency-Key": crypto.randomUUID(),
"Content-Type": "application/json"
},
body: JSON.stringify({
context,
query
})
}
);
const result = await response.json();
console.log(result.context);Context büyüyorsa,optimizasyon alanı olabilir.
Aether belirli bir sektör yerine LLM'e gönderilen context yapısına odaklanır.
Uzun konuşma geçmişlerini ve tekrar eden context'i model çağrısından önce optimize edin.
Retrieval sonucunda gelen doküman parçalarını kullanıcı sorgusuna göre daha verimli hale getirin.
Tool çıktıları, görev geçmişi ve biriken agent context'inin yükünü azaltın.
Uzun rapor, sözleşme ve kurumsal dokümanları her istekte bütünüyle taşımayın.
Konuşma geçmişi, müşteri bilgileri ve yardım merkezi context'ini optimize edin.
Kaynak kod, log, hata çıktısı ve teknik dokümantasyon içeren büyük context'leri küçültün.
Sadece daha küçük değil.Bilgi de korunmalı.
Aether Compress'i değerlendirirken yalnızca token azaltımını ölçmüyoruz. Optimize edilen context'in gerekli bilgiyi korumasını da ayrı olarak doğruluyoruz.
Benchmark sonuçlarını inceleyinGüvenli azaltım yoksaazaltmak zorunda değil.
Amaç her koşulda daha küçük bir çıktı üretmek değildir. Korunması gereken bağlamın azaltılmasından daha önemli olan, kullanılabilir bilginin korunmasıdır.
Pazarlama ortalamasına değil,kendi context'inize bakın.
Her uygulamanın context yapısı farklıdır. Aether'in gerçek değerini görmenin en doğru yolu kendi production girdileriniz üzerinde ölçmektir.
Context maliyeti gerçekten varsa.
İstekleriniz konuşma geçmişi, doküman veya büyük sistem context'i taşıyorsa.
Aynı optimizasyonun binlerce veya milyonlarca istekte tekrarlandığı sistemlerde.
Input zaten birkaç token seviyesindeyse azaltılabilecek alan doğal olarak sınırlıdır.
Context'iniz daha önce agresif biçimde minimize edildiyse ek kazanç daha düşük olabilir.
Context'inizi gönderin.Farkı kendi verinizde görün.
1 milyon ücretsiz token ile Aether Compress'i production context'inize benzeyen gerçek girdiler üzerinde test edin.
