Analisi strutturale
I ruoli dei messaggi, le istruzioni del sistema, i frammenti di documenti e la cronologia delle conversazioni sono considerati come contesti separati.
Aether Compress analizza l'input da inviare al modello prima della richiesta; genera un contesto più piccolo riducendo ripetizioni, parti di scarso valore e dettagli non necessari.
Aether funziona in modo indipendente dal fornitore. L'input che raggiunge l'LLM diventa più efficiente mantenendo intatti la generazione del prompt e la tua scelta del modello.
I ruoli dei messaggi, le istruzioni del sistema, i frammenti di documenti e la cronologia delle conversazioni sono considerati come contesti separati.
Le informazioni relative alla richiesta attuale dell'utente vengono conservate, mentre il contenuto a basso contributo viene ridotto.
L'ottimizzazione non consiste solo nell'abbreviare i caratteri; viene conservata la gerarchia delle informazioni e delle istruzioni necessarie al compito.
Il numero di token di input e output e il tasso di risparmio possono essere osservati per ogni richiesta.
Trasmetti i tuoi messaggi o il testo lungo all'API Compress.
Determina il livello di ottimizzazione adatto al tuo obiettivo di qualità, equilibrio o massimo risparmio.
Invia il context ottimizzato restituito al provider del modello che stai utilizzando.
Contatta il nostro team per aggiungere Aether Compress al tuo flusso LLM attuale.