AETHER · Domande Frequenti

Se hai una domandala risposta potrebbe essere qui.

Aether Compress, uso dell'API, Aether Generate, prezzi, convalida e sicurezza: abbiamo raccolto tutte le domande più frequenti in un unico posto.

Genel
Che cos'è esattamente Aether Compress?
Aether Compress, è uno strato di ottimizzazione del contesto che funziona prima della chiamata LLM. Elabora il contesto che la tua applicazione invierà al modello, riduce il carico di input inutile che può essere ridotto e restituisce il contesto ottimizzato.
Genel
Aether è un modello di intelligenza artificiale?
No. Aether Compress non è un LLM e non chiama un altro modello di intelligenza artificiale per ottimizzare il contesto. È uno strato di ottimizzazione separato che funziona davanti alla tua architettura AI esistente.
Genel
Con quali modelli può essere utilizzato Aether?
Aether Compress produce un contesto ottimizzato. Per questo motivo il modello o il fornitore che utilizzerai nella fase successiva è indipendente da Aether Compress. Puoi utilizzare il contesto ottimizzato nel tuo flusso AI esistente.
Genel
Devo modificare la mia architettura AI esistente?
Non è necessario modificare la tua architettura di modello di base. Aether Compress viene inserito tra la fase in cui viene creato il contesto e la chiamata LLM. La tua applicazione riceve il contesto ottimizzato e continua con il flusso esistente.
Compress
Aether Compress effettua una chiamata LLM durante il funzionamento?
No. Quando si utilizza solo Aether Compress, non viene inviata alcuna richiesta a nessun fornitore di AI. Il contesto viene ottimizzato e il risultato ritorna direttamente alla tua applicazione.
Compress
È obbligatorio inviare una query?
No. Se non invii una query, viene utilizzata l'ottimizzazione generale. Se invii una query, il contesto viene ottimizzato in modalità orientata alla query, tenendo conto della richiesta.
Compress
Qual è la differenza tra General e Query-Aware?
La modalità generale si concentra sul mantenimento della disponibilità generale del contesto senza dipendere da una domanda specifica. Nella modalità Query-Aware, invece, la richiesta dell'utente viene inclusa nell'input di ottimizzazione e il contesto viene elaborato tenendo conto delle esigenze informative di quella richiesta.
Compress
Aether riduce il contesto ad ogni richiesta?
No. L'obiettivo non è produrre sempre output più piccoli. Quando non ci sono aree che possono essere ridotte in sicurezza, il contesto può restare invariato o cambiare molto poco.
Compress
La riduzione del 40,65% dei token è garantita ad ogni richiesta?
No. Il 40,65% è la riduzione media degli input misurata sul set di validazione di 100.000 scenari per Aether Compress v1.0. Il risultato reale può variare in base alla struttura del contesto, alla lunghezza e alla modalità di ottimizzazione.
Compress
Qual è la riduzione massima misurata?
La riduzione massima degli input misurata sul set di validazione di 100.000 scenari è del 52,67%. Questo valore non è il tasso previsto o garantito per ogni richiesta.
Generate
Che cos'è Aether Generate?
Aether Generate ottimizza prima il contesto con Aether Compress, poi lo invia al provider di AI selezionato e restituisce la risposta finale del modello alla tua applicazione in un unico flusso.
Generate
Qual è la differenza tra Compress e Generate?
Compress Ottimizza solo il contesto e restituisce il contesto ottimizzato. Generate Dopo questa ottimizzazione, utilizza il proprio fornitore di AI per generare anche la risposta finale.
Generate
Devo fornire la mia chiave API LLM per Aether Generate?
Sì. Nell'uso di Generate si utilizza il modello BYOK, cioè Bring Your Own Key. Fornisci tu l'account del fornitore supportato e la chiave API.
Generate
La tariffa di utilizzo del fornitore di AI è inclusa nel piano Aether?
No. Il piano Aether copre l'utilizzo dei token di input elaborati tramite Aether. Il costo dell'utilizzo del modello da parte di un fornitore di AI esterno viene addebitato separatamente sul tuo account del fornitore.
API
Come integro Aether Compress?
Prima della tua attuale chiamata LLM, invii il contesto all'API Aether. L'API restituisce il contesto ottimizzato. Successivamente, puoi utilizzare questo contesto nella tua chiamata al modello esistente.
API
È obbligatorio utilizzare il SDK per Aether Compress?
No. L'integrazione di base può essere effettuata tramite HTTP API. Il linguaggio di programmazione o il framework che utilizzate può integrarsi finché è in grado di inviare richieste HTTP standard all'API.
API
Il numero di token che posso inviare in una singola richiesta è limitato?
Sì. Il limite di token per singola richiesta varia a seconda del piano che utilizzate. Nel piano Free è 25K, nel Developer 50K, nel Pro 100K, nello Studio 200K e nel Business 500K di token in input.
API
Il limite di velocità varia in base ai piani?
Sì. La capacità di richieste al minuto e richieste simultanee aumenta con l'upgrade del piano. È possibile vedere i limiti dettagliati nella pagina dei Prezzi.
API
Devo usare Aether al posto del sistema RAG?
No. Aether non sostituisce il sistema di retrieval. Il tuo sistema RAG recupera il contenuto pertinente, Aether Compress invece si inserisce tra il risultato del retrieval e la chiamata LLM per ottimizzare il contesto.
Prezzi
Esiste un piano gratuito?
Sì. Il piano gratuito include 1 milione di token input al mese. Non è necessaria la carta di credito per iniziare.
Prezzi
Su cosa si basa il calcolo della quota di token?
La quota del piano è calcolata in base alla quantità di token input elaborati tramite Aether Compress.
Prezzi
Quali piani includono Aether Generate?
Aether Generate è disponibile nei piani a pagamento. Il piano gratuito include solo l'uso di Aether Compress.
Prezzi
Quale modello dovrei usare per un volume di token molto elevato?
Per un utilizzo mensile di 5 miliardi di token o più nella tua azienda, può essere valutata la Technology License. Se vuoi offrire Aether ai tuoi clienti, il modello Distribution Partner è più adatto.
Prezzi
Qual è la differenza tra Distribution Partner e Technology License?
La Licenza Tecnologica è per utilizzare Aether nelle vostre operazioni ad alto volume. Il Partner di Distribuzione, invece, è rivolto alle aziende che vogliono offrire Aether ai loro clienti e gestire la struttura di clientela secondaria.
Verifica
Come è stato testato Aether Compress?
Aether Compress v1.0 è stato testato con un set di convalida locale di 100.000 scenari. In questi test sono stati valutati insieme la conservazione delle informazioni e la riduzione degli input.
Verifica
Cosa significa il 100% di accuratezza?
In tutti i 500 scenari selezionati per la convalida del modello esterno, è stata misurata la conservazione della risposta necessaria. Questo risultato si riferisce agli scenari testati e non implica una garanzia universale per tutti i possibili input illimitati.
Verifica
Cosa indica 3,48 ms?
3,48 ms è il tempo medio di elaborazione Aether Compress misurato nell'ambiente di convalida. Il ritardo reale può variare in base all'hardware, all'infrastruttura, alla dimensione della richiesta e all'ambiente operativo.
Verifica
Dove posso vedere i risultati del benchmark?
I risultati dettagliati delle misurazioni, la metodologia e i limiti delle misurazioni Benchmark saranno pubblicati nella pagina.
Sicurezza
Dove posso esaminare l'approccio alla sicurezza di Aether?
Il nostro approccio alla sicurezza, i dettagli sul controllo degli accessi, la sicurezza dell'infrastruttura e il processo di notifica della sicurezza Sicurezza possono essere esaminati nella pagina.
Sicurezza
Dove sono le politiche relative ai dati personali?
Per l'approccio generale alla privacy Informativa sulla privacy, Per le informazioni sui processi di trattamento dei dati personali in Turchia Testo Esplicativo KVKK incelenebilir.
Hai ancora domande?

Troviamo la risposta insiemetroviamo.

Per integrazione, utilizzo ad alto volume, licenze o la compatibilità di Aether con la vostra architettura potete contattarci.