Структурный анализ
Роли сообщений, системные инструкции, части документов и история разговоров оцениваются как отдельные контексты.
Aether Compress анализирует входные данные, отправляемые модели, до запроса; уменьшает повторения, малоценные части и ненужные детали, создавая более маленький контекст.
Aether работает независимо от поставщика. Существующая генерация подсказок и выбор модели сохраняются, только входные данные, достигающие LLM, становятся более эффективными.
Роли сообщений, системные инструкции, части документов и история разговоров оцениваются как отдельные контексты.
Сохраняется информация, связанная с текущим запросом пользователя, контент с низкой значимостью сокращается.
Оптимизация — это не только сокращение символов; сохраняется иерархия информации и инструкций, необходимая для задачи.
Количество входных и выходных токенов и коэффициент экономии можно наблюдать для каждого запроса.
Передайте ваши сообщения или длинный текст в API сжатия.
Определите уровень оптимизации в соответствии с вашей целью: качество, баланс или максимальная экономия.
Отправьте возвращаемый оптимизированный контекст вашему поставщику модели.
Свяжитесь с нашей командой, чтобы добавить Aether Compress в ваш текущий поток LLM.