XetHub bringt blockbasierte Speicherung zum Hub
Zusammenfassung
XetHub schließt sich Hugging Face an, um große Modell- und Datensatzdateien effizienter zu versionieren. Inhaltsbasierte Deduplizierung soll geänderte Blöcke statt kompletter Dateien übertragen. Xet arbeitet mit blockbasierter, inhaltsadressierter Speicherung.
Ideen
- ML-Versionierung braucht Deduplizierung unterhalb riesiger monolithischer Dateien.
- Inhaltsadressierung kann Speicher und Übertragung über viele ähnliche Modellstände teilen.
Einsichten
- ML-Speicher muss große ähnliche Artefakte effizient bewegen, ohne Reproduzierbarkeit preiszugeben.
Fakten
- Xet arbeitet mit blockbasierter, inhaltsadressierter Speicherung.
- Die Technik wird in die Infrastruktur des Hugging Face Hub integriert.
Kritik
- Eine neue Speicherschicht erhöht Protokoll- und Anbieterabhängigkeit, solange Alternativwerkzeuge fehlen.
Empfehlungen
- Miss Upload, Checkout, Cachebedarf und Wiederherstellung mit deinen realen Modellrevisionen.
Referenzen
Originalbeitrag auf Hugging Face lesen →
Links zur Originalquelle und zum Webarchiv öffnen einen neuen Tab.