Strukturanalyse
Nachrichtenrollen, Systemanweisungen, Dokumentfragmente und Konversationsverlauf werden als separate Kontexte behandelt.
Aether Compress analysiert die Eingabe für das Modell vor der Anfrage; es reduziert Wiederholungen, wenig wertvolle Teile und unnötige Details, um einen kleineren Kontext zu erzeugen.
Aether arbeitet anbieterunabhängig. Während Ihre aktuelle Prompt-Erstellung und Modellpräferenz beibehalten werden, wird nur die an das LLM gesendete Eingabe effizienter.
Nachrichtenrollen, Systemanweisungen, Dokumentfragmente und Konversationsverlauf werden als separate Kontexte behandelt.
Informationen im Zusammenhang mit der aktuellen Anfrage des Benutzers bleiben erhalten und Inhalte mit geringem Beitrag werden reduziert.
Bei der Optimierung geht es nicht nur um die Verkürzung von Zeichen; Die für die Aufgabe erforderliche Hierarchie der Informationen und Anweisungen bleibt erhalten.
Für jede Anfrage kann die Anzahl der Input- und Output-Tokens sowie die Sparquote beobachtet werden.
Übermitteln Sie Ihre Nachrichten oder Langtexte an die Compress API.
Bestimmen Sie den Optimierungsgrad, der Ihrem Ziel von Qualität, Ausgewogenheit oder maximalen Einsparungen entspricht.
Senden Sie den zurückgegebenen optimierten Kontext an den von Ihnen verwendeten Modellanbieter.
Kontaktieren Sie unser Team, um Aether Compress in Ihren aktuellen LLM-Flow zu integrieren.