AETHER · Questions Fréquemment Posées
Si vous avez des questionsLa réponse est peut-être ici.
Aether Compress, l'utilisation de l'API, Aether Generate, la tarification, la validation et la sécurité - nous avons rassemblé les questions les plus fréquemment posées en un seul endroit.
01GenelQu'est-ce exactement que Aether Compress ?
01
Genel
Qu'est-ce exactement que Aether Compress ?
Aether Compress est une couche d'optimisation du contexte qui fonctionne avant l'appel LLM. Elle traite le contexte que votre application enverra au modèle, réduit la charge d'entrée inutile pouvant être diminuée et renvoie le contexte optimisé.
02GenelAether est-il un modèle d'intelligence artificielle ?
02
Genel
Aether est-il un modèle d'intelligence artificielle ?
Non. Aether Compress n'est pas un LLM et n'appelle pas un autre modèle d'intelligence artificielle pour optimiser le contexte. C'est une couche d'optimisation séparée qui fonctionne devant l'architecture IA existante.
03GenelAvec quels modèles Aether peut-il être utilisé ?
03
Genel
Avec quels modèles Aether peut-il être utilisé ?
Aether Compress génère un contexte optimisé. Par conséquent, le modèle ou le fournisseur que vous utiliserez à l'étape suivante est indépendant de Aether Compress. Vous pouvez utiliser le contexte optimisé dans votre flux IA existant.
04GenelDois-je modifier mon architecture d’IA actuelle ?
04
Genel
Dois-je modifier mon architecture d’IA actuelle ?
Vous n'avez pas besoin de modifier l'architecture de votre modèle de base. Aether Compress, est placé entre l'étape de création du contexte et l'appel LLM. Votre application reçoit le contexte optimisé et continue son flux actuel.
05CompressEst-ce que Aether Compress effectue un appel LLM pendant son fonctionnement ?
05
Compress
Est-ce que Aether Compress effectue un appel LLM pendant son fonctionnement ?
Non. Lorsqu'il n'utilise que Aether Compress, aucune requête n'est envoyée à un fournisseur d'IA. Le contexte est optimisé et le résultat est renvoyé directement à votre application.
06CompressEst-il obligatoire d'envoyer une requête ?
06
Compress
Est-il obligatoire d'envoyer une requête ?
Non. Si vous n’envoyez pas de requête, l’optimisation générale est utilisée. Si vous envoyez le contexte de la requête, la requête sera prise en compte Il est optimisé de manière ciblée.
07CompressQuelle est la différence entre Général et Query-Aware ?
07
Compress
Quelle est la différence entre Général et Query-Aware ?
Le mode général est un contexte qui n'est pas lié à une question spécifique. se concentre sur le maintien de sa disponibilité globale. Prise en charge des requêtes Dans ce mode, la requête de l'utilisateur est également incluse dans l'entrée d'optimisation. et le contexte est pris en compte en prenant en compte les besoins d'information de cette requête. est traité.
08CompressAether réduit-il le contexte à chaque requête ?
08
Compress
Aether réduit-il le contexte à chaque requête ?
Non. L’objectif n’est pas de produire une production moindre en toutes circonstances. contexte lorsqu'il n'y a pas d'espace pouvant être réduit en toute sécurité Il peut revenir inchangé ou avec un changement très limité.
09CompressUne réduction de 40,65 % des jetons est-elle garantie pour chaque demande ?
09
Compress
Une réduction de 40,65 % des jetons est-elle garantie pour chaque demande ?
Non. 40,65 %, Aether Compress v1.0 pour un ensemble de validation de 100 000 scénarios est la réduction moyenne des entrées mesurée. Le résultat réel peut varier en fonction de la structure, de la longueur et du mode d'optimisation du contexte.
10CompressQuelle est la réduction mesurée la plus élevée ?
10
Compress
Quelle est la réduction mesurée la plus élevée ?
Entrée la plus élevée mesurée dans un ensemble de validation de 100 000 scénarios La réduction est de 52,67%. Cette valeur est la valeur attendue ou Ce n'est pas un taux garanti.
11GenerateQu'est-ce que Aether Generate ?
11
Generate
Qu'est-ce que Aether Generate ?
Aether Generate optimise d'abord le contexte avec Aether Compress, puis l'envoie au fournisseur d'IA de votre choix et renvoie la réponse finale du modèle à votre application en un seul flux.
12GenerateQuelle est la différence entre Compresser et Générer ?
12
Generate
Quelle est la différence entre Compresser et Générer ?
Compress Il fait uniquement l'optimisation du contexte et optimisé Renvoie le contexte. Generate utiliser votre propre fournisseur d'IA après cette optimisation Cela produit également la réponse finale.
13GenerateDois-je fournir ma propre clé API LLM pour Aether Generate ?
13
Generate
Dois-je fournir ma propre clé API LLM pour Aether Generate ?
Oui. BYOK dans Générer une utilisation, c'est-à-dire Apportez votre propre clé modèle est utilisé. Votre compte de fournisseur pris en charge et votre API Vous fournissez votre clé.
14GenerateLes frais d'utilisation du fournisseur d'IA sont-ils inclus dans le plan Aether ?
14
Generate
Les frais d'utilisation du fournisseur d'IA sont-ils inclus dans le plan Aether ?
Non. Le plan Aether couvre l'utilisation des jetons d'entrée traités via Aether. Le coût d'utilisation du modèle d'un fournisseur d'IA externe est facturé séparément sur votre compte fournisseur.
15APIComment intégrer Aether Compress ?
15
API
Comment intégrer Aether Compress ?
Vous envoyez le contexte à l'API Aether avant votre appel LLM existant. L'API renvoie le contexte optimisé. Ensuite, vous pouvez utiliser ce contexte dans votre appel de modèle existant.
16APIL'utilisation de Aether Compress nécessite-t-elle le SDK ?
16
API
L'utilisation de Aether Compress nécessite-t-elle le SDK ?
Non. L'intégration de base peut être effectuée via l'API HTTP. Le langage ou le framework d'application que vous utiliserez dépend de l'API. intégration tant qu'il peut envoyer une requête HTTP standard peut être réalisé.
17APIY a-t-il une limite au nombre de jetons que je peux envoyer en une seule demande ?
17
API
Y a-t-il une limite au nombre de jetons que je peux envoyer en une seule demande ?
Oui. La limite de jetons de requête unique varie en fonction du forfait que vous utilisez. 25K en plan gratuit, 50K en développeur, 100K en Pro, Jeton d'entrée de 200 000 dans Studio et 500 000 dans Business Il y a une limite.
18APILa limite tarifaire change-t-elle en fonction des projets ?
18
API
La limite tarifaire change-t-elle en fonction des projets ?
Oui. Plan de capacité de demande minute et de demande simultanée augmente à mesure qu'il augmente. Limites détaillées sur la page Tarifs. tu peux voir.
19APIDois-je utiliser Aether à la place du système RAG ?
19
API
Dois-je utiliser Aether à la place du système RAG ?
Non. Il ne remplace pas le système de récupération Aether. Le système RAG récupère le contenu pertinent, Aether Compress s'interpose entre le résultat de cette récupération et l'appel LLM pour optimiser le contexte.
20TarifsY a-t-il un plan gratuit ?
20
Tarifs
Y a-t-il un plan gratuit ?
Oui. Le forfait gratuit comprend 1 million de jetons d'entrée par mois. pour commencer aucune carte de crédit requise.
21TarifsComment le quota de tokens est-il calculé ?
21
Tarifs
Comment le quota de tokens est-il calculé ?
Le quota du plan est calculé en fonction du nombre de tokens d'entrée traités via Aether Compress.
22TarifsQuels plans incluent Aether Generate ?
22
Tarifs
Quels plans incluent Aether Generate ?
Aether Generate est disponible dans les plans payants. Le plan gratuit inclut uniquement l'utilisation de Aether Compress.
23TarifsQuel modèle dois-je utiliser avec un volume de tokens très élevé ?
23
Tarifs
Quel modèle dois-je utiliser avec un volume de tokens très élevé ?
Pour l'utilisation de 5 milliards de tokens par mois ou plus dans votre propre entreprise, la Technology License peut être envisagée. Si vous souhaitez proposer Aether à vos propres clients, le modèle Distribution Partner est une structure plus appropriée.
24TarifsQuelle est la différence entre un partenaire de distribution et une licence technologique ?
24
Tarifs
Quelle est la différence entre un partenaire de distribution et une licence technologique ?
La Technology License est destinée à utiliser Aether dans vos opérations à haut volume. Distribution Partner est destiné aux entreprises qui souhaitent proposer Aether à leurs clients et gérer une structure de sous-clients.
25vérificationComment Aether Compress a-t-il été testé ?
25
vérification
Comment Aether Compress a-t-il été testé ?
Aether Compress v1.0 a été testé avec un ensemble de validation local de 100 000 scénarios. Lors de ces tests, la conservation des informations et la réduction des entrées ont été évaluées ensemble.
26vérificationQue signifie une précision à 100 % ?
26
vérification
Que signifie une précision à 100 % ?
Dans l'ensemble des 500 scénarios sélectionnés pour la validation du modèle externe Le maintien de la réponse requise a été mesuré. Ce résultat testé appartient aux scénarios et est universel pour toutes les entrées possibles sans limite. ne veut pas dire garantie.
27vérificationQue signifie 3,48 ms ?
27
vérification
Que signifie 3,48 ms ?
3,48 ms, est le temps moyen de traitement Aether Compress mesuré dans un environnement de validation. Le délai réel peut varier en fonction du matériel, de l'infrastructure, de la taille de la requête et de l'environnement d'exécution.
28vérificationOù puis-je voir les résultats du benchmark ?
28
vérification
Où puis-je voir les résultats du benchmark ?
Résultats de mesure détaillés, méthodologie et limites de mesure Benchmark est publié sur la page.
29SécuritéOù puis-je consulter l'approche de sécurité de Aether ?
29
Sécurité
Où puis-je consulter l'approche de sécurité de Aether ?
Notre approche en matière de sécurité comprend le contrôle d'accès, la sécurité des infrastructures et Détails sur le processus de notification de sécurité Sécurité Vous pouvez le consulter sur la page.
30SécuritéOù sont les politiques concernant les données personnelles ?
30
Sécurité
Où sont les politiques concernant les données personnelles ?
Pour une approche générale en matière de confidentialité Politique de confidentialité, Concernant les processus de traitement des données personnelles en Turquie pour information Texte d'information KVKK incelenebilir.
Plus
Entrez dans les détails.
Produit
Aether Compress
Examinez comment le produit fonctionne et où il s'intègre dans l'architecture.
vérification
Benchmark
Voir les résultats de validation 100K et la méthodologie de mesure.
Planlar
Tarifs
Comparez les forfaits, les quotas de jetons et les modèles à volume élevé.
Senaryolar
Scénarios d'utilisation
Voyez dans quels flux de travail d'IA Aether Compress peut être utilisé.
Vous avez encore des questions ?
Répondre ensembleTrouvons-le.
Vous pouvez nous contacter pour l'intégration, l'utilisation à grand volume, la licence ou la compatibilité de Aether avec votre architecture.
