AETHER · Часто задаваемые вопросы
Если у вас есть вопросответ может быть здесь.
Aether Compress, использование API, Aether Generate, вопросы по ценообразованию, верификации и безопасности, с которыми мы чаще всего сталкиваемся, мы собрали в одном месте.
01GenelЧто такое Aether Compress?
01
Genel
Что такое Aether Compress?
Aether Compress — это слой оптимизации контекста, который работает до вызова LLM. Он обрабатывает контекст, который ваше приложение отправит в модель, снижает ненужную нагрузку на ввод и возвращает оптимизированный контекст.
02GenelAether является моделью искусственного интеллекта?
02
Genel
Aether является моделью искусственного интеллекта?
Нет. Aether Compress не является LLM и не вызывает другую модель ИИ для оптимизации контекста. Это отдельный слой оптимизации, работающий перед вашей существующей архитектурой ИИ.
03GenelС какими моделями можно использовать Aether?
03
Genel
С какими моделями можно использовать Aether?
Aether Compress создает оптимизированный контекст. Поэтому следующая модель или поставщик, которые вы будете использовать, независимы от Aether Compress. Оптимизированный контекст можно использовать в вашем текущем AI-потоке.
04GenelМне нужно изменить текущую AI-архитектуру?
04
Genel
Мне нужно изменить текущую AI-архитектуру?
Менять базовую архитектуру модели не нужно. Aether Compress вставляется между этапом создания контекста и вызовом LLM. Ваше приложение получает оптимизированный контекст и продолжает текущий поток.
05CompressAether Compress делает вызов LLM во время работы?
05
Compress
Aether Compress делает вызов LLM во время работы?
Нет. Запросы к любому поставщику ИИ не отправляются, если вы используете только Aether Compress. Контекст оптимизируется и результат возвращается прямо в ваше приложение.
06CompressОбязательно ли отправлять запрос?
06
Compress
Обязательно ли отправлять запрос?
Нет. Если вы не отправляете запрос, используется общая оптимизация. Если отправляете запрос, контекст оптимизируется с учетом запроса в режиме ориентированном на запрос.
07CompressВ чем разница между General и Query-Aware?
07
Compress
В чем разница между General и Query-Aware?
Режим General фокусируется на сохранении общей применимости контекста без привязки к конкретному вопросу. В режиме Query-Aware запрос пользователя включается в оптимизационный ввод, и контекст обрабатывается с учётом информационной потребности этого запроса.
08CompressAether уменьшает контекст при каждом запросе?
08
Compress
Aether уменьшает контекст при каждом запросе?
Нет. Цель не в том, чтобы всегда получать меньший вывод. Когда невозможно безопасно уменьшить контекст, он может оставаться без изменений или изменяться незначительно.
09CompressГарантировано ли снижение на 40,65% токенов при каждом запросе?
09
Compress
Гарантировано ли снижение на 40,65% токенов при каждом запросе?
Нет. 40,65%, Aether Compress v1.0 — это среднее снижение входных данных, измеренное на валидационном наборе из 100 000 сценариев. Фактический результат может различаться в зависимости от структуры, длины контекста и режима оптимизации.
10CompressКакое наибольшее измеренное снижение?
10
Compress
Какое наибольшее измеренное снижение?
Наибольшее снижение входных данных, измеренное на валидационном наборе из 100 000 сценариев, составляет 52,67%. Это значение не является ожидаемой или гарантированной нормой для каждого запроса.
11GenerateЧто такое Aether Generate?
11
Generate
Что такое Aether Generate?
Aether Generate сначала оптимизирует контекст с помощью Aether Compress, затем отправляет его выбранному AI-поставщику и возвращает окончательный ответ модели в ваше приложение в одном потоке.
12GenerateВ чем разница между Compress и Generate?
12
Generate
В чем разница между Compress и Generate?
Compress Он только оптимизирует контекст и возвращает оптимизированный контекст. Generate А после этой оптимизации с использованием вашего AI-поставщика он также генерирует окончательный ответ.
13GenerateНужно ли мне предоставлять свой LLM API ключ для Aether Generate?
13
Generate
Нужно ли мне предоставлять свой LLM API ключ для Aether Generate?
Да. В использовании Generate применяется модель BYOK, то есть Bring Your Own Key. Вы предоставляете свой поддерживаемый аккаунт поставщика и API ключ.
14GenerateВходит ли стоимость использования AI-поставщика в план Aether?
14
Generate
Входит ли стоимость использования AI-поставщика в план Aether?
Нет. План Aether покрывает использование входных токенов, обработанных через Aether. Стоимость использования модели стороннего AI-провайдера дополнительно начисляется на ваш счет у этого провайдера.
15APIКак интегрировать Aether Compress?
15
API
Как интегрировать Aether Compress?
Вы отправляете контекст в API Aether перед существующим вызовом LLM. API возвращает оптимизированный контекст. Затем вы можете использовать этот контекст в своем текущем вызове модели.
16APIОбязателен ли SDK для использования Aether Compress?
16
API
Обязателен ли SDK для использования Aether Compress?
Нет. Базовая интеграция может быть выполнена через HTTP API. Язык или фреймворк, который вы используете, может интегрироваться, если способен отправлять стандартные HTTP-запросы в API.
17APIЕсть ли ограничение на количество токенов, которые я могу отправить за один запрос?
17
API
Есть ли ограничение на количество токенов, которые я могу отправить за один запрос?
Да. Лимит токенов за один запрос зависит от вашего плана. В бесплатном плане 25K, в плане Developer — 50K, в плане Pro — 100K, в плане Studio — 200K и в плане Business — 500K входных токенов.
18APIМеняется ли лимит запросов в зависимости от планов?
18
API
Меняется ли лимит запросов в зависимости от планов?
Да. Количество запросов в минуту и одновременных запросов увеличивается с повышением плана. Подробные лимиты можно увидеть на странице Ценообразования.
19APIДолжен ли я использовать Aether вместо системы RAG?
19
API
Должен ли я использовать Aether вместо системы RAG?
Нет. Aether не заменяет систему retrieval. Ваша система RAG получает соответствующий контент, а Aether Compress вставляется между результатом retrieval и вызовом LLM, оптимизируя контекст.
20ЦенообразованиеЕсть ли бесплатный план?
20
Ценообразование
Есть ли бесплатный план?
Да. Бесплатный план включает 1 миллион входных токенов в месяц. Для начала не требуется кредитная карта.
21ЦенообразованиеКак рассчитывается квота токенов?
21
Ценообразование
Как рассчитывается квота токенов?
Квота плана рассчитывается на основе количества входных токенов, обработанных через Aether Compress.
22ЦенообразованиеКакие планы включают Aether Generate?
22
Ценообразование
Какие планы включают Aether Generate?
Aether можно использовать в платных планах. Бесплатный план включает только Aether Compress.
23ЦенообразованиеКакую модель мне следует использовать при очень большом объеме токенов?
23
Ценообразование
Какую модель мне следует использовать при очень большом объеме токенов?
Для использования 5 миллиардов токенов и более в месяц в вашей компании может рассматриваться Technology License. Если вы хотите предоставлять Aether своим клиентам, модель Distribution Partner более подходящая.
24ЦенообразованиеВ чем разница между Distribution Partner и Technology License?
24
Ценообразование
В чем разница между Distribution Partner и Technology License?
Технологическая лицензия предназначена для использования Aether в вашей собственной высокообъемной операции. Партнер по распространению предназначен для компаний, которые хотят предлагать Aether своим клиентам и управлять структурой подчиненных клиентов.
25ПроверкаКак тестировался Aether Compress?
25
Проверка
Как тестировался Aether Compress?
Aether Compress v1.0 тестировался на локальном наборе проверки из 100 000 сценариев. В этих тестах учитывались сохранение информации и уменьшение входных данных.
26ПроверкаЧто означает 100% точность?
26
Проверка
Что означает 100% точность?
Во всех 500 сценариях, выбранных для внешней проверки модели, было измерено поддержание требуемого ответа. Этот результат относится к проверенным сценариям и не означает универсальную гарантию для всех возможных входных данных.
27ПроверкаЧто означает 3,48 мс?
27
Проверка
Что означает 3,48 мс?
3,48 мс — это среднее время обработки Aether Compress, измеренное в проверочной среде. Реальная задержка может отличаться в зависимости от оборудования, инфраструктуры, объема запроса и рабочей среды.
28ПроверкаГде я могу увидеть результаты бенчмарка?
28
Проверка
Где я могу увидеть результаты бенчмарка?
Подробные результаты измерений, методология и ограничения измерений Benchmark публикуются на странице.
29БезопасностьГде я могу ознакомиться с подходом к безопасности Aether?
29
Безопасность
Где я могу ознакомиться с подходом к безопасности Aether?
Наш подход к безопасности, контроль доступа, безопасность инфраструктуры и процесс уведомления о безопасности можно подробно изучить Безопасность на странице.
30БезопасностьГде находятся политики, относящиеся к личным данным?
30
Безопасность
Где находятся политики, относящиеся к личным данным?
Для общего подхода к конфиденциальности Политика конфиденциальности, Для информации о процессах обработки личных данных в Турции Текст разъяснения KVKK incelenebilir.
Больше
Подробнее.
Продукт
Aether Compress
Изучите, как работает продукт и где он располагается в архитектуре.
Проверка
Benchmark
Изучите результаты проверки 100К и методологию измерений.
Planlar
Ценообразование
Сравните планы, квоты токенов и модели с высоким объемом.
Senaryolar
Сценарии использования
Посмотрите, в каких AI рабочих процессах может использоваться Aether Compress.
У вас все еще есть вопросы?
Давайте найдем ответ вместе.давайте найдем.
Вы можете связаться с нами по вопросам интеграции, использования с высоким объемом, лицензирования или того, как Aether подходит для вашей архитектуры.
