AETHER · Blog

Effizientere KI-SystemeTechnische Hinweise zu.

Forschungs- und Anwendungspapiere zu Kontextarchitektur, Tokenkosten, RAG-Qualität und LLM-Operationen in der Produktionsumgebung.

Neueste Beiträge

Forschungs- und Anwendungshinweise.

Inhalte zu Messmethoden, technischen Entscheidungen und Produktionserfahrungen.

Kontext-Engineering01
KONTEXT / KOSTEN

Warum bleiben die Kosten nicht linear, wenn der LLM-Kontext wächst?

Wir untersuchen, wie sich die Token-Kosten ansammeln, wenn lange Gespräche, Systemanweisungen und sich wiederholender Produktkontext bei jeder Anfrage erneut übertragen werden.

12. August 2026 · 7 Min. gelesen
Lesen Sie den Artikel
RAG-Systeme02
ABRUF / SIGNAL

Ist mehr Dokumentation in RAG-Pipelines immer besser?

Qualitäts- und Kostenauswirkungen der Auswahl des mit der Abfrage verknüpften Kontexts, anstatt ganze Blöcke, die von der Abrufschicht zurückgegeben werden, an das Modell zu senden.

5. August 2026 · 9 Min. gelesen
Lesen Sie den Artikel