AETHER · Aether Compress

LLM'e daha azcontext gönderin.

Aether Compress, context'inizi model çağrısından önce optimize eder. Gereksiz input token yükünü azaltır, kullanılabilir bilgiyi korur ve mevcut AI akışınızın daha verimli çalışmasını sağlar.

Kredi kartı gerekmez
1M ücretsiz token
Aether Compress
Context Optimization
Ready
Input Context12,840 token
Optimize
Optimized Context7,620 token
-40,65%
ortalama
3,48 ms
ölçülen avg.
100%
test sonucu
LLM çağrısı yok·GPU gerektirmez·Context in / context out
40,65%
ortalama input azaltımı
100K+
doğrulama senaryosu
100%
ölçülen cevap doğruluğu
3,48 ms
ortalama işlem süresi
Aether Compress Nedir?

Modelden önce çalışanbir context optimizasyon katmanı.

Bir LLM çağrısında model yalnızca soruyu değil, ona gönderdiğiniz bütün context'i işler. Bu context büyüdükçe input token miktarı da büyür.

Aether Compress, uygulamanız ile model arasına yerleşir. Context'i önce optimize eder ve daha küçük bir context üretir. Sonraki adım tamamen sizin kontrolünüzdedir.

Yerleşim
01
Uygulamanız
Context oluşur
02
Aether Compress
Context optimize edilir
03
Mevcut LLM Akışınız
Optimize edilmiş context kullanılır
DeğişenContext
DeğişmeyenModel mimariniz
Context Ekonomisi

Model maliyetinin bir kısmımodele gönderdiğiniz yükten gelir.

Daha büyük context her zaman daha fazla faydalı bilgi anlamına gelmez. Tekrarlar, yardımcı içerikler ve sorguyla ilişkisi düşük bölümler de input token olarak modele taşınır.

01
Token maliyeti

Input context büyüdükçe sağlayıcıya gönderilen ve ücretlendirilen token miktarı artar.

02
Context alanı

Gereksiz içerik, gerçekten gerekli bilgilerin kullanabileceği context alanını tüketir.

03
Ölçek

Tek istekte küçük görünen fark, yüksek çağrı hacminde büyük toplam token miktarlarına dönüşür.

Nasıl Çalışır?

Context girer.Optimize edilmiş context çıkar.

Aether Compress, model cevabı üretmeye çalışmaz. Görevi LLM'e ulaşmadan önce input context'ini daha verimli hale getirmektir.

01
Context gönderin

Uygulamanızdaki mevcut context'i Aether API'ye gönderirsiniz.

02
Mod belirlenir

Query yoksa Genel, query varsa Sorgu Odaklı optimizasyon uygulanır.

03
Context optimize edilir

Aether kullanılabilir bilgiyi koruyarak azaltılabilecek yükü belirler.

04
Sonucu alın

Optimize edilmiş context doğrudan uygulamanıza geri döner.

Optimizasyon Modları

Sorgu olsun veya olmasın.

Context'in nasıl kullanılacağına göre iki farklı optimizasyon biçimi kullanabilirsiniz.

Mod 01
General

Genel bağlamıkoruyarak optimize edin.

Belirli bir kullanıcı sorusu olmadan context'i optimize etmek istediğiniz durumlarda General modu kullanabilirsiniz.

Conversation MemoryAgent StateGenel Context
Mod 02
Query-Aware

Context'isorguya odaklayın.

Kullanıcının sorusu biliniyorsa query de optimizasyon isteğine eklenebilir. Böylece Aether context'i o sorgunun bilgi ihtiyacını dikkate alarak işler.

RAGDoküman Q&AMüşteri Destek
Farkı Nedir?

Bir başka modeleklemiyoruz.

Context maliyetini azaltmak için yeni bir LLM çağrısı yapmak, maliyeti başka bir yere taşımak anlamına gelebilir. Aether Compress kendi optimizasyon işlemini ayrı bir LLM çağrısına dayandırmaz.

LLM'siz Optimizasyon

Aether Compress, context'i optimize etmek için başka bir yapay zekâ modeline istek göndermez.

Sağlayıcı Bağımsız

Optimize edilen context sonraki aşamada tercih ettiğiniz model veya sağlayıcıyla kullanılabilir.

Mevcut Akışın Önünde

Modelinizi, prompt mimarinizi veya uygulamanızın ana LLM katmanını değiştirmek zorunda değilsiniz.

Ölçülebilir Sonuç

Her istekte orijinal ve optimize edilmiş token miktarını karşılaştırarak sonucu ölçebilirsiniz.

API Akışı

Yalnızca context'i alın.İsterseniz cevaba kadar devam edin.

Aether Compress ürünün optimizasyon katmanıdır. Aether Generate ise bu katmanı AI sağlayıcınızla tek çağrıda birleştiren isteğe bağlı kullanım biçimidir.

Aether Compress
Optimize Only
AI Call Yok
INPUTcontext
AETHERcompress
OUTPUTdata.compressed

Optimize edilmiş context doğrudan uygulamanıza döner. Hangi modelle, ne zaman ve nasıl kullanacağınızı siz belirlersiniz.

Aether Generate
Optimize + Generate
BYOK
INPUTcontext
AETHERcompress
PROVIDERyour_llm
OUTPUTresponse

Context önce optimize edilir, ardından kendi sağlayıcı hesabınız üzerinden modele gönderilir ve nihai cevap tek akışta döner.

Entegrasyon

Tek bir API çağrısıylaakışınıza ekleyin.

Mevcut context oluşturma aşamanız ile LLM çağrınızın arasına Aether Compress'i eklemeniz yeterlidir.

Dokümantasyonu inceleyin
POST /v1/compress
const response = await fetch(
  "https://api.aether.tr/v1/compress",
  {
    method: "POST",
    headers: {
      "Authorization": "Bearer YOUR_API_KEY",
      "Idempotency-Key": crypto.randomUUID(),
      "Content-Type": "application/json"
    },
    body: JSON.stringify({
      context,
      query
    })
  }
);

const result = await response.json();

console.log(result.context);
Before12,840
After7,620
Kullanım Alanları

Context büyüyorsa,optimizasyon alanı olabilir.

Aether belirli bir sektör yerine LLM'e gönderilen context yapısına odaklanır.

AI Asistanları

Uzun konuşma geçmişlerini ve tekrar eden context'i model çağrısından önce optimize edin.

RAG Sistemleri

Retrieval sonucunda gelen doküman parçalarını kullanıcı sorgusuna göre daha verimli hale getirin.

AI Agent

Tool çıktıları, görev geçmişi ve biriken agent context'inin yükünü azaltın.

Doküman Analizi

Uzun rapor, sözleşme ve kurumsal dokümanları her istekte bütünüyle taşımayın.

Müşteri Destek

Konuşma geçmişi, müşteri bilgileri ve yardım merkezi context'ini optimize edin.

Kod & Teknik İçerik

Kaynak kod, log, hata çıktısı ve teknik dokümantasyon içeren büyük context'leri küçültün.

Doğrulama

Sadece daha küçük değil.Bilgi de korunmalı.

Aether Compress'i değerlendirirken yalnızca token azaltımını ölçmüyoruz. Optimize edilen context'in gerekli bilgiyi korumasını da ayrı olarak doğruluyoruz.

Benchmark sonuçlarını inceleyin
100.000
yerel doğrulama senaryosu
40,65%
ortalama input azaltımı
500 / 500
harici model doğrulaması
52,67%
ölçülen maksimum azaltım
Ölçüm notu: %40,65 değeri 100.000 senaryoluk doğrulama kümesinin ortalama input azaltımıdır. Gerçek sonuç context yapısına göre değişir. 3,48 ms değeri doğrulama ortamında ölçülen ortalama işlem süresidir.
Kontrol Sizde

Güvenli azaltım yoksaazaltmak zorunda değil.

Amaç her koşulda daha küçük bir çıktı üretmek değildir. Korunması gereken bağlamın azaltılmasından daha önemli olan, kullanılabilir bilginin korunmasıdır.

Ölçün

Pazarlama ortalamasına değil,kendi context'inize bakın.

Her uygulamanın context yapısı farklıdır. Aether'in gerçek değerini görmenin en doğru yolu kendi production girdileriniz üzerinde ölçmektir.

Ne Zaman Anlamlı?

Context maliyeti gerçekten varsa.

Uzun Context

İstekleriniz konuşma geçmişi, doküman veya büyük sistem context'i taşıyorsa.

Yüksek Çağrı Hacmi

Aynı optimizasyonun binlerce veya milyonlarca istekte tekrarlandığı sistemlerde.

Çok Kısa Prompt

Input zaten birkaç token seviyesindeyse azaltılabilecek alan doğal olarak sınırlıdır.

Zaten Minimal Context

Context'iniz daha önce agresif biçimde minimize edildiyse ek kazanç daha düşük olabilir.

Aether Compress

Context'inizi gönderin.Farkı kendi verinizde görün.

1 milyon ücretsiz token ile Aether Compress'i production context'inize benzeyen gerçek girdiler üzerinde test edin.

Kredi kartı gerekmez
1M ücretsiz token