
OpenRelay 提供托管模型推理和 GPU 虚拟机,通过兼容 OpenAI 的 API 运行多种模型,并支持按用量计费、批处理、持久存储及自动故障转移。
您是这款应用的开发者吗?验证所有权以管理此应用条目。
OpenRelay 是一个用于托管模型推理和按需 GPU 计算的 AI 基础设施平台。它使开发人员和团队能够通过统一的、兼容 OpenAI 的 API 运行 AI 工作负载,并可以访问来自 DeepSeek、Llama、Qwen、Mistral、Gemma 和 GPT-OSS 等提供商的模型。可以根据延迟、成本、可用性和模型性能自动路由请求。
该平台支持无服务器推理、专用 GPU 虚拟机以及交互式和大容量工作负载的批处理作业。用户可以选择 GPU 资源、部署自定义环境、通过 SSH 连接以及使用持久卷来保存重新启动后仍保留的数据。 OpenRelay 还提供跨可用基础设施的自动故障转移和负载平衡,以及命令行和 MCP 集成,用于通过开发工具或自动化工作流程管理部署、使用和计算资源。
免责声明:WebCatalog 与 OpenRelay 不存在任何隶属、关联、授权或认可关系,也未以任何方式与其建立官方联系。所有产品名称、徽标和品牌均为其各自所有者的财产。