OpenLake - High-Performance Storage for AI Workloads

Show HN: We Beat MLPerf: Modern Storage for KV Offload and LLM Training

OpenLake - High-Performance Storage for AI Workloads

OpenLake — это высокопроизводительная система хранения данных, созданная для ускорения обучения и вывода больших языковых моделей. Благодаря асинхронному движку ввода-вывода Infinity Core, использующему io_uring и GPUDirect Storage, OpenLake обеспечивает сверхнизкую задержку и высокую пропускную способность. В бенчмарке MLPerf Storage v3.0 OpenLake достиг наивысшей пропускной способности чтения и записи при контрольных точках Llama 3.1 8B, превзойдя ближайшего конкурента почти в два раза по скорости записи. Это сокращает простои GPU и ускоряет восстановление после сбоев, снижая затраты на обучение. OpenLake — открытый проект, доступный на GitHub.

Мы гордимся участием OpenLake в MLPerf Storage v3.0, включая новый рабочий процесс создания контрольных точек, чтобы помочь сообществу продвигать обучение ИИ. Надежные и проверенные результаты помогут клиентам выбрать правильные решения и оптимизировать свою инфраструктуру.