AETHER · Domande Frequenti
Se hai una domandala risposta potrebbe essere qui.
Aether Compress, uso dell'API, Aether Generate, prezzi, convalida e sicurezza: abbiamo raccolto tutte le domande più frequenti in un unico posto.
01GenelChe cos'è esattamente Aether Compress?
01
Genel
Che cos'è esattamente Aether Compress?
Aether Compress, è uno strato di ottimizzazione del contesto che funziona prima della chiamata LLM. Elabora il contesto che la tua applicazione invierà al modello, riduce il carico di input inutile che può essere ridotto e restituisce il contesto ottimizzato.
02GenelAether è un modello di intelligenza artificiale?
02
Genel
Aether è un modello di intelligenza artificiale?
No. Aether Compress non è un LLM e non chiama un altro modello di intelligenza artificiale per ottimizzare il contesto. È uno strato di ottimizzazione separato che funziona davanti alla tua architettura AI esistente.
03GenelCon quali modelli può essere utilizzato Aether?
03
Genel
Con quali modelli può essere utilizzato Aether?
Aether Compress produce un contesto ottimizzato. Per questo motivo il modello o il fornitore che utilizzerai nella fase successiva è indipendente da Aether Compress. Puoi utilizzare il contesto ottimizzato nel tuo flusso AI esistente.
04GenelDevo modificare la mia architettura AI esistente?
04
Genel
Devo modificare la mia architettura AI esistente?
Non è necessario modificare la tua architettura di modello di base. Aether Compress viene inserito tra la fase in cui viene creato il contesto e la chiamata LLM. La tua applicazione riceve il contesto ottimizzato e continua con il flusso esistente.
05CompressAether Compress effettua una chiamata LLM durante il funzionamento?
05
Compress
Aether Compress effettua una chiamata LLM durante il funzionamento?
No. Quando si utilizza solo Aether Compress, non viene inviata alcuna richiesta a nessun fornitore di AI. Il contesto viene ottimizzato e il risultato ritorna direttamente alla tua applicazione.
06CompressÈ obbligatorio inviare una query?
06
Compress
È obbligatorio inviare una query?
No. Se non invii una query, viene utilizzata l'ottimizzazione generale. Se invii una query, il contesto viene ottimizzato in modalità orientata alla query, tenendo conto della richiesta.
07CompressQual è la differenza tra General e Query-Aware?
07
Compress
Qual è la differenza tra General e Query-Aware?
La modalità generale si concentra sul mantenimento della disponibilità generale del contesto senza dipendere da una domanda specifica. Nella modalità Query-Aware, invece, la richiesta dell'utente viene inclusa nell'input di ottimizzazione e il contesto viene elaborato tenendo conto delle esigenze informative di quella richiesta.
08CompressAether riduce il contesto ad ogni richiesta?
08
Compress
Aether riduce il contesto ad ogni richiesta?
No. L'obiettivo non è produrre sempre output più piccoli. Quando non ci sono aree che possono essere ridotte in sicurezza, il contesto può restare invariato o cambiare molto poco.
09CompressLa riduzione del 40,65% dei token è garantita ad ogni richiesta?
09
Compress
La riduzione del 40,65% dei token è garantita ad ogni richiesta?
No. Il 40,65% è la riduzione media degli input misurata sul set di validazione di 100.000 scenari per Aether Compress v1.0. Il risultato reale può variare in base alla struttura del contesto, alla lunghezza e alla modalità di ottimizzazione.
10CompressQual è la riduzione massima misurata?
10
Compress
Qual è la riduzione massima misurata?
La riduzione massima degli input misurata sul set di validazione di 100.000 scenari è del 52,67%. Questo valore non è il tasso previsto o garantito per ogni richiesta.
11GenerateChe cos'è Aether Generate?
11
Generate
Che cos'è Aether Generate?
Aether Generate ottimizza prima il contesto con Aether Compress, poi lo invia al provider di AI selezionato e restituisce la risposta finale del modello alla tua applicazione in un unico flusso.
12GenerateQual è la differenza tra Compress e Generate?
12
Generate
Qual è la differenza tra Compress e Generate?
Compress Ottimizza solo il contesto e restituisce il contesto ottimizzato. Generate Dopo questa ottimizzazione, utilizza il proprio fornitore di AI per generare anche la risposta finale.
13GenerateDevo fornire la mia chiave API LLM per Aether Generate?
13
Generate
Devo fornire la mia chiave API LLM per Aether Generate?
Sì. Nell'uso di Generate si utilizza il modello BYOK, cioè Bring Your Own Key. Fornisci tu l'account del fornitore supportato e la chiave API.
14GenerateLa tariffa di utilizzo del fornitore di AI è inclusa nel piano Aether?
14
Generate
La tariffa di utilizzo del fornitore di AI è inclusa nel piano Aether?
No. Il piano Aether copre l'utilizzo dei token di input elaborati tramite Aether. Il costo dell'utilizzo del modello da parte di un fornitore di AI esterno viene addebitato separatamente sul tuo account del fornitore.
15APICome integro Aether Compress?
15
API
Come integro Aether Compress?
Prima della tua attuale chiamata LLM, invii il contesto all'API Aether. L'API restituisce il contesto ottimizzato. Successivamente, puoi utilizzare questo contesto nella tua chiamata al modello esistente.
16APIÈ obbligatorio utilizzare il SDK per Aether Compress?
16
API
È obbligatorio utilizzare il SDK per Aether Compress?
No. L'integrazione di base può essere effettuata tramite HTTP API. Il linguaggio di programmazione o il framework che utilizzate può integrarsi finché è in grado di inviare richieste HTTP standard all'API.
17APIIl numero di token che posso inviare in una singola richiesta è limitato?
17
API
Il numero di token che posso inviare in una singola richiesta è limitato?
Sì. Il limite di token per singola richiesta varia a seconda del piano che utilizzate. Nel piano Free è 25K, nel Developer 50K, nel Pro 100K, nello Studio 200K e nel Business 500K di token in input.
18APIIl limite di velocità varia in base ai piani?
18
API
Il limite di velocità varia in base ai piani?
Sì. La capacità di richieste al minuto e richieste simultanee aumenta con l'upgrade del piano. È possibile vedere i limiti dettagliati nella pagina dei Prezzi.
19APIDevo usare Aether al posto del sistema RAG?
19
API
Devo usare Aether al posto del sistema RAG?
No. Aether non sostituisce il sistema di retrieval. Il tuo sistema RAG recupera il contenuto pertinente, Aether Compress invece si inserisce tra il risultato del retrieval e la chiamata LLM per ottimizzare il contesto.
20PrezziEsiste un piano gratuito?
20
Prezzi
Esiste un piano gratuito?
Sì. Il piano gratuito include 1 milione di token input al mese. Non è necessaria la carta di credito per iniziare.
21PrezziSu cosa si basa il calcolo della quota di token?
21
Prezzi
Su cosa si basa il calcolo della quota di token?
La quota del piano è calcolata in base alla quantità di token input elaborati tramite Aether Compress.
22PrezziQuali piani includono Aether Generate?
22
Prezzi
Quali piani includono Aether Generate?
Aether Generate è disponibile nei piani a pagamento. Il piano gratuito include solo l'uso di Aether Compress.
23PrezziQuale modello dovrei usare per un volume di token molto elevato?
23
Prezzi
Quale modello dovrei usare per un volume di token molto elevato?
Per un utilizzo mensile di 5 miliardi di token o più nella tua azienda, può essere valutata la Technology License. Se vuoi offrire Aether ai tuoi clienti, il modello Distribution Partner è più adatto.
24PrezziQual è la differenza tra Distribution Partner e Technology License?
24
Prezzi
Qual è la differenza tra Distribution Partner e Technology License?
La Licenza Tecnologica è per utilizzare Aether nelle vostre operazioni ad alto volume. Il Partner di Distribuzione, invece, è rivolto alle aziende che vogliono offrire Aether ai loro clienti e gestire la struttura di clientela secondaria.
25VerificaCome è stato testato Aether Compress?
25
Verifica
Come è stato testato Aether Compress?
Aether Compress v1.0 è stato testato con un set di convalida locale di 100.000 scenari. In questi test sono stati valutati insieme la conservazione delle informazioni e la riduzione degli input.
26VerificaCosa significa il 100% di accuratezza?
26
Verifica
Cosa significa il 100% di accuratezza?
In tutti i 500 scenari selezionati per la convalida del modello esterno, è stata misurata la conservazione della risposta necessaria. Questo risultato si riferisce agli scenari testati e non implica una garanzia universale per tutti i possibili input illimitati.
27VerificaCosa indica 3,48 ms?
27
Verifica
Cosa indica 3,48 ms?
3,48 ms è il tempo medio di elaborazione Aether Compress misurato nell'ambiente di convalida. Il ritardo reale può variare in base all'hardware, all'infrastruttura, alla dimensione della richiesta e all'ambiente operativo.
28VerificaDove posso vedere i risultati del benchmark?
28
Verifica
Dove posso vedere i risultati del benchmark?
I risultati dettagliati delle misurazioni, la metodologia e i limiti delle misurazioni Benchmark saranno pubblicati nella pagina.
29SicurezzaDove posso esaminare l'approccio alla sicurezza di Aether?
29
Sicurezza
Dove posso esaminare l'approccio alla sicurezza di Aether?
Il nostro approccio alla sicurezza, i dettagli sul controllo degli accessi, la sicurezza dell'infrastruttura e il processo di notifica della sicurezza Sicurezza possono essere esaminati nella pagina.
30SicurezzaDove sono le politiche relative ai dati personali?
30
Sicurezza
Dove sono le politiche relative ai dati personali?
Per l'approccio generale alla privacy Informativa sulla privacy, Per le informazioni sui processi di trattamento dei dati personali in Turchia Testo Esplicativo KVKK incelenebilir.
Di più
Vai nei dettagli.
Prodotto
Aether Compress
Esamina come funziona il prodotto e dove si colloca nell'architettura.
Verifica
Benchmark
Esamina i risultati di convalida 100K e la metodologia di misurazione.
Planlar
Prezzi
Confronta i piani, le quote di token e i modelli ad alto volume.
Senaryolar
Casi d'uso
Guarda in quali flussi di lavoro AI può essere utilizzato Aether Compress.
Hai ancora domande?
Troviamo la risposta insiemetroviamo.
Per integrazione, utilizzo ad alto volume, licenze o la compatibilità di Aether con la vostra architettura potete contattarci.
