AETHER · Preguntas Frecuentes

Si tienes preguntasLa respuesta puede estar aquí.

Aether Compress, el uso de la API, Aether Generate, precios, validación y seguridad: hemos reunido todas las preguntas más frecuentes en un solo lugar.

Genel
¿Qué es exactamente Aether Compress?
Aether Compress es una capa de optimización de contexto que funciona antes de la llamada LLM. Procesa el contexto que su aplicación enviará al modelo, reduce la carga de entrada innecesaria que se pueda disminuir y devuelve el contexto optimizado.
Genel
¿Es Aether un modelo de inteligencia artificial?
No. Aether Compress no es un LLM y no llama a otro modelo de inteligencia artificial para optimizar el contexto. Es una capa de optimización separada que funciona delante de su arquitectura de IA existente.
Genel
¿Con qué modelos se puede usar Aether?
Aether Compress genera un contexto optimizado. Por lo tanto, el modelo o proveedor que use en la siguiente etapa es independiente de Aether Compress. Puede usar el contexto optimizado en su flujo de trabajo de IA existente.
Genel
¿Necesito cambiar mi arquitectura de IA actual?
No es necesario cambiar la arquitectura básica de su modelo. Aether Compress se coloca entre la etapa en que se crea el contexto y la llamada al LLM. Su aplicación toma el contexto optimizado y continúa con su flujo actual.
Compress
¿Aether Compress hace llamadas al LLM mientras se ejecuta?
No. Solo cuando usa Aether Compress, no se envía ninguna solicitud a ningún proveedor de IA. El contexto se optimiza y el resultado vuelve directamente a su aplicación.
Compress
¿Es obligatorio enviar una consulta?
No. Si no envía una consulta, se utiliza la optimización general. Si envía el contexto de la consulta, se considerará la consulta. Está optimizado de forma enfocada.
Compress
¿Cuál es la diferencia entre general y compatible con consultas?
El modo general es un contexto que no está ligado a una pregunta específica. se centra en mantener su disponibilidad general. Consciente de consultas En este modo, la consulta del usuario también se incluye en la entrada de optimización. y se tiene en cuenta el contexto teniendo en cuenta las necesidades de información de esa consulta. se procesa.
Compress
¿Aether reduce el contexto en cada solicitud?
No. El objetivo no es producir menos en todas las circunstancias. contexto en el que no hay espacio que pueda reducirse de forma segura Puede regresar sin cambios o con cambios muy limitados.
Compress
¿Se garantiza una reducción de token del 40,65 % para cada solicitud?
No. 40,65% es la reducción promedio de input medida en un conjunto de validación de 100.000 escenarios para Aether Compress v1.0. Los resultados reales pueden variar según la estructura, longitud y modo de optimización del contexto.
Compress
¿Cuál es la mayor reducción medida?
La entrada más alta medida en un conjunto de validación de 100.000 escenarios La reducción es del 52,67%. Este valor es el esperado o No es una tarifa garantizada.
Generate
¿Qué es Aether Generate?
Aether Generate primero optimiza el contexto con Aether Compress, luego lo envía al proveedor de IA que elija y devuelve la respuesta final del modelo a su aplicación en un mismo flujo.
Generate
¿Cuál es la diferencia entre comprimir y generar?
Compress Solo optimiza y optimiza el contexto. Devuelve contexto. Generate usando su propio proveedor de IA después de esta optimización También produce la respuesta final.
Generate
¿Necesito proporcionar mi propia clave de API de LLM para Aether Generate?
Sí. BYOK en Generar uso, es decir, Traiga su propia clave Se utiliza el modelo. Su cuenta de proveedor compatible y API Usted proporciona su clave.
Generate
¿Está incluida la tarifa de uso del proveedor de IA en el plan de Aether?
No. El plan Aether cubre el uso de tokens de entrada procesados a través de Aether. El coste de uso del modelo de un proveedor de IA externo se refleja por separado en su propia cuenta de proveedor.
API
¿Cómo integro Aether Compress?
Envía el contexto a la API de Aether antes de tu llamada LLM existente. La API devuelve el contexto optimizado. Luego puedes usar este contexto en tu llamada al modelo existente.
API
¿Es obligatorio usar el SDK para usar Aether Compress?
No. La integración básica se puede realizar a través de la API HTTP. El lenguaje o marco de la aplicación que utilizará depende de la API. integración siempre que pueda enviar una solicitud HTTP estándar se puede realizar.
API
¿Existe un límite en la cantidad de tokens que puedo enviar en una sola solicitud?
Sí. El límite de token de solicitud única varía según el plan que utilice. 25K en plan gratuito, 50K en desarrollador, 100K en Pro, Token de entrada de 200K en Studio y 500K en Business Hay un límite.
API
¿El límite de tarifa cambia según los planes?
Sí. Solicitud de minutos y plan de capacidad de solicitudes simultáneas aumenta a medida que sube. Límites detallados en la página de Precios. puedes ver.
API
¿Debo usar Aether en lugar del sistema RAG?
No. No reemplaza el sistema de recuperación Aether. Su sistema RAG trae el contenido relevante, y Aether Compress se coloca entre este resultado de recuperación y la llamada al LLM para optimizar el contexto.
Precios
¿Hay plan gratuito?
Sí. El plan gratuito incluye 1 millón de tokens de entrada por mes. para empezar no se requiere tarjeta de crédito.
Precios
¿Cómo se calcula la cuota de tokens?
El límite del plan se calcula según la cantidad de tokens de entrada procesados a través de Aether Compress.
Precios
¿Qué planes incluyen Aether Generate?
Aether Generate está disponible en planes de pago. El plan gratuito solo incluye el uso de Aether Compress.
Precios
¿Qué modelo debo usar con un volumen de tokens muy alto?
Para el uso de 5 mil millones de tokens o más al mes en su propia empresa, se puede evaluar la Licencia Tecnológica. Si desea ofrecer Aether a sus propios clientes, el modelo de Socio de Distribución es una estructura más adecuada.
Precios
¿Cuál es la diferencia entre Socio de Distribución y Licencia de Tecnología?
La Licencia Tecnológica está destinada a usar Aether en sus operaciones de alto volumen. El Socio de Distribución, en cambio, está dirigido a empresas que desean ofrecer Aether a sus clientes y gestionar la estructura de clientes secundarios.
verificación
¿Cómo se probó Aether Compress?
Aether Compress v1.0 se probó con un conjunto de validación local de 100.000 escenarios. En estas pruebas se evaluaron conjuntamente la conservación de la información y la reducción de entrada.
verificación
¿Qué significa 100% de precisión?
En los 500 escenarios seleccionados para la validación externa del modelo Se midió el mantenimiento de la respuesta requerida. Este resultado probado pertenece a escenarios y es universal para todas las entradas posibles sin límite. no significa garantía.
verificación
¿Qué significa 3,48 ms?
3,48 ms es el tiempo medio de procesamiento Aether Compress medido en el entorno de validación. La latencia real puede variar según el hardware, la infraestructura, el tamaño de la solicitud y el entorno de funcionamiento.
verificación
¿Dónde puedo ver los resultados de las pruebas comparativas?
Resultados de medición detallados, metodología y límites de medición. Benchmark esta publicado en la pagina.
Seguridad
¿Dónde puedo revisar el enfoque de seguridad de Aether?
Nuestro enfoque de seguridad incluye control de acceso, seguridad de infraestructura y Detalles sobre el proceso de notificación de seguridad Seguridad Puedes revisarlo en la página.
Seguridad
¿Dónde están las políticas en materia de datos personales?
Para un enfoque general de privacidad Política de privacidad, Respecto a los procesos de procesamiento de datos personales en Turquía para información Texto informativo de KVKK incelenebilir.
¿Aún tienes preguntas?

Respondan juntosEncontrémoslo.

Puede contactarnos sobre la integración, el uso de alto volumen, la licencia o la adecuación de Aether a su arquitectura.