AETHER · Questions Fréquemment Posées

Si vous avez des questionsLa réponse est peut-être ici.

Aether Compress, l'utilisation de l'API, Aether Generate, la tarification, la validation et la sécurité - nous avons rassemblé les questions les plus fréquemment posées en un seul endroit.

Genel
Qu'est-ce exactement que Aether Compress ?
Aether Compress est une couche d'optimisation du contexte qui fonctionne avant l'appel LLM. Elle traite le contexte que votre application enverra au modèle, réduit la charge d'entrée inutile pouvant être diminuée et renvoie le contexte optimisé.
Genel
Aether est-il un modèle d'intelligence artificielle ?
Non. Aether Compress n'est pas un LLM et n'appelle pas un autre modèle d'intelligence artificielle pour optimiser le contexte. C'est une couche d'optimisation séparée qui fonctionne devant l'architecture IA existante.
Genel
Avec quels modèles Aether peut-il être utilisé ?
Aether Compress génère un contexte optimisé. Par conséquent, le modèle ou le fournisseur que vous utiliserez à l'étape suivante est indépendant de Aether Compress. Vous pouvez utiliser le contexte optimisé dans votre flux IA existant.
Genel
Dois-je modifier mon architecture d’IA actuelle ?
Vous n'avez pas besoin de modifier l'architecture de votre modèle de base. Aether Compress, est placé entre l'étape de création du contexte et l'appel LLM. Votre application reçoit le contexte optimisé et continue son flux actuel.
Compress
Est-ce que Aether Compress effectue un appel LLM pendant son fonctionnement ?
Non. Lorsqu'il n'utilise que Aether Compress, aucune requête n'est envoyée à un fournisseur d'IA. Le contexte est optimisé et le résultat est renvoyé directement à votre application.
Compress
Est-il obligatoire d'envoyer une requête ?
Non. Si vous n’envoyez pas de requête, l’optimisation générale est utilisée. Si vous envoyez le contexte de la requête, la requête sera prise en compte Il est optimisé de manière ciblée.
Compress
Quelle est la différence entre Général et Query-Aware ?
Le mode général est un contexte qui n'est pas lié à une question spécifique. se concentre sur le maintien de sa disponibilité globale. Prise en charge des requêtes Dans ce mode, la requête de l'utilisateur est également incluse dans l'entrée d'optimisation. et le contexte est pris en compte en prenant en compte les besoins d'information de cette requête. est traité.
Compress
Aether réduit-il le contexte à chaque requête ?
Non. L’objectif n’est pas de produire une production moindre en toutes circonstances. contexte lorsqu'il n'y a pas d'espace pouvant être réduit en toute sécurité Il peut revenir inchangé ou avec un changement très limité.
Compress
Une réduction de 40,65 % des jetons est-elle garantie pour chaque demande ?
Non. 40,65 %, Aether Compress v1.0 pour un ensemble de validation de 100 000 scénarios est la réduction moyenne des entrées mesurée. Le résultat réel peut varier en fonction de la structure, de la longueur et du mode d'optimisation du contexte.
Compress
Quelle est la réduction mesurée la plus élevée ?
Entrée la plus élevée mesurée dans un ensemble de validation de 100 000 scénarios La réduction est de 52,67%. Cette valeur est la valeur attendue ou Ce n'est pas un taux garanti.
Generate
Qu'est-ce que Aether Generate ?
Aether Generate optimise d'abord le contexte avec Aether Compress, puis l'envoie au fournisseur d'IA de votre choix et renvoie la réponse finale du modèle à votre application en un seul flux.
Generate
Quelle est la différence entre Compresser et Générer ?
Compress Il fait uniquement l'optimisation du contexte et optimisé Renvoie le contexte. Generate utiliser votre propre fournisseur d'IA après cette optimisation Cela produit également la réponse finale.
Generate
Dois-je fournir ma propre clé API LLM pour Aether Generate ?
Oui. BYOK dans Générer une utilisation, c'est-à-dire Apportez votre propre clé modèle est utilisé. Votre compte de fournisseur pris en charge et votre API Vous fournissez votre clé.
Generate
Les frais d'utilisation du fournisseur d'IA sont-ils inclus dans le plan Aether ?
Non. Le plan Aether couvre l'utilisation des jetons d'entrée traités via Aether. Le coût d'utilisation du modèle d'un fournisseur d'IA externe est facturé séparément sur votre compte fournisseur.
API
Comment intégrer Aether Compress ?
Vous envoyez le contexte à l'API Aether avant votre appel LLM existant. L'API renvoie le contexte optimisé. Ensuite, vous pouvez utiliser ce contexte dans votre appel de modèle existant.
API
L'utilisation de Aether Compress nécessite-t-elle le SDK ?
Non. L'intégration de base peut être effectuée via l'API HTTP. Le langage ou le framework d'application que vous utiliserez dépend de l'API. intégration tant qu'il peut envoyer une requête HTTP standard peut être réalisé.
API
Y a-t-il une limite au nombre de jetons que je peux envoyer en une seule demande ?
Oui. La limite de jetons de requête unique varie en fonction du forfait que vous utilisez. 25K en plan gratuit, 50K en développeur, 100K en Pro, Jeton d'entrée de 200 000 dans Studio et 500 000 dans Business Il y a une limite.
API
La limite tarifaire change-t-elle en fonction des projets ?
Oui. Plan de capacité de demande minute et de demande simultanée augmente à mesure qu'il augmente. Limites détaillées sur la page Tarifs. tu peux voir.
API
Dois-je utiliser Aether à la place du système RAG ?
Non. Il ne remplace pas le système de récupération Aether. Le système RAG récupère le contenu pertinent, Aether Compress s'interpose entre le résultat de cette récupération et l'appel LLM pour optimiser le contexte.
Tarifs
Y a-t-il un plan gratuit ?
Oui. Le forfait gratuit comprend 1 million de jetons d'entrée par mois. pour commencer aucune carte de crédit requise.
Tarifs
Comment le quota de tokens est-il calculé ?
Le quota du plan est calculé en fonction du nombre de tokens d'entrée traités via Aether Compress.
Tarifs
Quels plans incluent Aether Generate ?
Aether Generate est disponible dans les plans payants. Le plan gratuit inclut uniquement l'utilisation de Aether Compress.
Tarifs
Quel modèle dois-je utiliser avec un volume de tokens très élevé ?
Pour l'utilisation de 5 milliards de tokens par mois ou plus dans votre propre entreprise, la Technology License peut être envisagée. Si vous souhaitez proposer Aether à vos propres clients, le modèle Distribution Partner est une structure plus appropriée.
Tarifs
Quelle est la différence entre un partenaire de distribution et une licence technologique ?
La Technology License est destinée à utiliser Aether dans vos opérations à haut volume. Distribution Partner est destiné aux entreprises qui souhaitent proposer Aether à leurs clients et gérer une structure de sous-clients.
vérification
Comment Aether Compress a-t-il été testé ?
Aether Compress v1.0 a été testé avec un ensemble de validation local de 100 000 scénarios. Lors de ces tests, la conservation des informations et la réduction des entrées ont été évaluées ensemble.
vérification
Que signifie une précision à 100 % ?
Dans l'ensemble des 500 scénarios sélectionnés pour la validation du modèle externe Le maintien de la réponse requise a été mesuré. Ce résultat testé appartient aux scénarios et est universel pour toutes les entrées possibles sans limite. ne veut pas dire garantie.
vérification
Que signifie 3,48 ms ?
3,48 ms, est le temps moyen de traitement Aether Compress mesuré dans un environnement de validation. Le délai réel peut varier en fonction du matériel, de l'infrastructure, de la taille de la requête et de l'environnement d'exécution.
vérification
Où puis-je voir les résultats du benchmark ?
Résultats de mesure détaillés, méthodologie et limites de mesure Benchmark est publié sur la page.
Sécurité
Où puis-je consulter l'approche de sécurité de Aether ?
Notre approche en matière de sécurité comprend le contrôle d'accès, la sécurité des infrastructures et Détails sur le processus de notification de sécurité Sécurité Vous pouvez le consulter sur la page.
Sécurité
Où sont les politiques concernant les données personnelles ?
Pour une approche générale en matière de confidentialité Politique de confidentialité, Concernant les processus de traitement des données personnelles en Turquie pour information Texte d'information KVKK incelenebilir.
Vous avez encore des questions ?

Répondre ensembleTrouvons-le.

Vous pouvez nous contacter pour l'intégration, l'utilisation à grand volume, la licence ou la compatibilité de Aether avec votre architecture.