
Sei lo sviluppatore di questa app? Verifica la proprietà per gestire questa scheda.
OpenRelay è una piattaforma di infrastruttura AI per l'inferenza di modelli ospitati e il GPU computing on-demand. Consente a sviluppatori e team di eseguire carichi di lavoro AI tramite un'API unificata e compatibile con OpenAI, con accesso a modelli di provider come DeepSeek, Llama, Qwen, Mistral, Gemma e GPT-OSS. Le richieste possono essere instradate automaticamente in base a latenza, costo, disponibilità e prestazioni del modello.
La piattaforma supporta inferenza serverless, macchine virtuali GPU dedicate e lavori batch per carichi di lavoro interattivi e ad alto volume. Gli utenti possono selezionare le risorse GPU, distribuire ambienti personalizzati, connettersi tramite SSH e utilizzare volumi persistenti per i dati che sopravvivono ai riavvii. OpenRelay fornisce inoltre failover automatico e bilanciamento del carico sull'infrastruttura disponibile, insieme a integrazioni della riga di comando e MCP per la gestione di distribuzioni, utilizzo e risorse di elaborazione da strumenti di sviluppo o flussi di lavoro automatizzati.
Esclusione di responsabilità: WebCatalog non è affiliata, associata, autorizzata, approvata né in alcun modo ufficialmente collegata a OpenRelay. Tutti i nomi dei prodotti, i loghi e i marchi sono di proprietà dei rispettivi titolari.