AETHER · Часто задаваемые вопросы

Если у вас есть вопросответ может быть здесь.

Aether Compress, использование API, Aether Generate, вопросы по ценообразованию, верификации и безопасности, с которыми мы чаще всего сталкиваемся, мы собрали в одном месте.

Genel
Что такое Aether Compress?
Aether Compress — это слой оптимизации контекста, который работает до вызова LLM. Он обрабатывает контекст, который ваше приложение отправит в модель, снижает ненужную нагрузку на ввод и возвращает оптимизированный контекст.
Genel
Aether является моделью искусственного интеллекта?
Нет. Aether Compress не является LLM и не вызывает другую модель ИИ для оптимизации контекста. Это отдельный слой оптимизации, работающий перед вашей существующей архитектурой ИИ.
Genel
С какими моделями можно использовать Aether?
Aether Compress создает оптимизированный контекст. Поэтому следующая модель или поставщик, которые вы будете использовать, независимы от Aether Compress. Оптимизированный контекст можно использовать в вашем текущем AI-потоке.
Genel
Мне нужно изменить текущую AI-архитектуру?
Менять базовую архитектуру модели не нужно. Aether Compress вставляется между этапом создания контекста и вызовом LLM. Ваше приложение получает оптимизированный контекст и продолжает текущий поток.
Compress
Aether Compress делает вызов LLM во время работы?
Нет. Запросы к любому поставщику ИИ не отправляются, если вы используете только Aether Compress. Контекст оптимизируется и результат возвращается прямо в ваше приложение.
Compress
Обязательно ли отправлять запрос?
Нет. Если вы не отправляете запрос, используется общая оптимизация. Если отправляете запрос, контекст оптимизируется с учетом запроса в режиме ориентированном на запрос.
Compress
В чем разница между General и Query-Aware?
Режим General фокусируется на сохранении общей применимости контекста без привязки к конкретному вопросу. В режиме Query-Aware запрос пользователя включается в оптимизационный ввод, и контекст обрабатывается с учётом информационной потребности этого запроса.
Compress
Aether уменьшает контекст при каждом запросе?
Нет. Цель не в том, чтобы всегда получать меньший вывод. Когда невозможно безопасно уменьшить контекст, он может оставаться без изменений или изменяться незначительно.
Compress
Гарантировано ли снижение на 40,65% токенов при каждом запросе?
Нет. 40,65%, Aether Compress v1.0 — это среднее снижение входных данных, измеренное на валидационном наборе из 100 000 сценариев. Фактический результат может различаться в зависимости от структуры, длины контекста и режима оптимизации.
Compress
Какое наибольшее измеренное снижение?
Наибольшее снижение входных данных, измеренное на валидационном наборе из 100 000 сценариев, составляет 52,67%. Это значение не является ожидаемой или гарантированной нормой для каждого запроса.
Generate
Что такое Aether Generate?
Aether Generate сначала оптимизирует контекст с помощью Aether Compress, затем отправляет его выбранному AI-поставщику и возвращает окончательный ответ модели в ваше приложение в одном потоке.
Generate
В чем разница между Compress и Generate?
Compress Он только оптимизирует контекст и возвращает оптимизированный контекст. Generate А после этой оптимизации с использованием вашего AI-поставщика он также генерирует окончательный ответ.
Generate
Нужно ли мне предоставлять свой LLM API ключ для Aether Generate?
Да. В использовании Generate применяется модель BYOK, то есть Bring Your Own Key. Вы предоставляете свой поддерживаемый аккаунт поставщика и API ключ.
Generate
Входит ли стоимость использования AI-поставщика в план Aether?
Нет. План Aether покрывает использование входных токенов, обработанных через Aether. Стоимость использования модели стороннего AI-провайдера дополнительно начисляется на ваш счет у этого провайдера.
API
Как интегрировать Aether Compress?
Вы отправляете контекст в API Aether перед существующим вызовом LLM. API возвращает оптимизированный контекст. Затем вы можете использовать этот контекст в своем текущем вызове модели.
API
Обязателен ли SDK для использования Aether Compress?
Нет. Базовая интеграция может быть выполнена через HTTP API. Язык или фреймворк, который вы используете, может интегрироваться, если способен отправлять стандартные HTTP-запросы в API.
API
Есть ли ограничение на количество токенов, которые я могу отправить за один запрос?
Да. Лимит токенов за один запрос зависит от вашего плана. В бесплатном плане 25K, в плане Developer — 50K, в плане Pro — 100K, в плане Studio — 200K и в плане Business — 500K входных токенов.
API
Меняется ли лимит запросов в зависимости от планов?
Да. Количество запросов в минуту и одновременных запросов увеличивается с повышением плана. Подробные лимиты можно увидеть на странице Ценообразования.
API
Должен ли я использовать Aether вместо системы RAG?
Нет. Aether не заменяет систему retrieval. Ваша система RAG получает соответствующий контент, а Aether Compress вставляется между результатом retrieval и вызовом LLM, оптимизируя контекст.
Ценообразование
Есть ли бесплатный план?
Да. Бесплатный план включает 1 миллион входных токенов в месяц. Для начала не требуется кредитная карта.
Ценообразование
Как рассчитывается квота токенов?
Квота плана рассчитывается на основе количества входных токенов, обработанных через Aether Compress.
Ценообразование
Какие планы включают Aether Generate?
Aether можно использовать в платных планах. Бесплатный план включает только Aether Compress.
Ценообразование
Какую модель мне следует использовать при очень большом объеме токенов?
Для использования 5 миллиардов токенов и более в месяц в вашей компании может рассматриваться Technology License. Если вы хотите предоставлять Aether своим клиентам, модель Distribution Partner более подходящая.
Ценообразование
В чем разница между Distribution Partner и Technology License?
Технологическая лицензия предназначена для использования Aether в вашей собственной высокообъемной операции. Партнер по распространению предназначен для компаний, которые хотят предлагать Aether своим клиентам и управлять структурой подчиненных клиентов.
Проверка
Как тестировался Aether Compress?
Aether Compress v1.0 тестировался на локальном наборе проверки из 100 000 сценариев. В этих тестах учитывались сохранение информации и уменьшение входных данных.
Проверка
Что означает 100% точность?
Во всех 500 сценариях, выбранных для внешней проверки модели, было измерено поддержание требуемого ответа. Этот результат относится к проверенным сценариям и не означает универсальную гарантию для всех возможных входных данных.
Проверка
Что означает 3,48 мс?
3,48 мс — это среднее время обработки Aether Compress, измеренное в проверочной среде. Реальная задержка может отличаться в зависимости от оборудования, инфраструктуры, объема запроса и рабочей среды.
Проверка
Где я могу увидеть результаты бенчмарка?
Подробные результаты измерений, методология и ограничения измерений Benchmark публикуются на странице.
Безопасность
Где я могу ознакомиться с подходом к безопасности Aether?
Наш подход к безопасности, контроль доступа, безопасность инфраструктуры и процесс уведомления о безопасности можно подробно изучить Безопасность на странице.
Безопасность
Где находятся политики, относящиеся к личным данным?
Для общего подхода к конфиденциальности Политика конфиденциальности, Для информации о процессах обработки личных данных в Турции Текст разъяснения KVKK incelenebilir.
У вас все еще есть вопросы?

Давайте найдем ответ вместе.давайте найдем.

Вы можете связаться с нами по вопросам интеграции, использования с высоким объемом, лицензирования или того, как Aether подходит для вашей архитектуры.