
Вие ли сте разработчикът на това приложение? Потвърдете собствеността, за да управлявате тази страница.
lakeFS Cloud предоставя подобен на Git контрол на версиите за езера от данни, позволявайки на екипите да управляват мащабни масиви от данни с операции за разклоняване, ангажиране, сливане и връщане директно в обектно хранилище като Amazon S3, Google Cloud Storage или Azure Blob Storage.[1][2][3]
Той поддържа изолирани разклонения на данни за експериментиране, обучение на модели и отстраняване на неизправности, без да засяга производствените данни, като гарантира възпроизводимост в работните потоци на машинно обучение и намалява рисковете от отклонение на данните.[1][3] Ключовите възможности включват проследяване на произхода на данните, одит на промените и интегриране с инструменти като Apache Spark, Hive, Airflow и Apache Iceberg за мащабируема обработка и управление.[1][3][5][7]
lakeFS Cloud работи като защитен слой върху съществуващо хранилище, използвайки предварително подписани URL адреси за обработка на достъп до данни без пряка експозиция, поддържайки изолация дори в среди с множество клиенти, като същевременно спазва стандартите за сигурност като SOC2.[2] Тази настройка улеснява CI/CD за канали за данни, съвместни MLO и ефективно съхранение чрез функции като събиране на боклук и еквиваленти на плитко клониране.[2][3][6]
Съвместим с хибридни облачни настройки, Kubernetes платформи като Red Hat OpenShift AI и отворени таблични формати, той рационализира задачите за инженеринг на данни в локални, облачни и крайни среди.[5][7]
Отказ от отговорност: WebCatalog не е свързан, асоцииран, одобрен или официално свързан с lakeFS Cloud. Всички имена на продукти, лога и марки са собственост на съответните им притежатели.