bk99.de entertain the web since 1997

XetHub bringt blockbasierte Speicherung zum Hub

Zusammenfassung

XetHub schließt sich Hugging Face an, um große Modell- und Datensatzdateien effizienter zu versionieren. Inhaltsbasierte Deduplizierung soll geänderte Blöcke statt kompletter Dateien übertragen. Xet arbeitet mit blockbasierter, inhaltsadressierter Speicherung.

Ideen

  • ML-Versionierung braucht Deduplizierung unterhalb riesiger monolithischer Dateien.
  • Inhaltsadressierung kann Speicher und Übertragung über viele ähnliche Modellstände teilen.

Einsichten

  • ML-Speicher muss große ähnliche Artefakte effizient bewegen, ohne Reproduzierbarkeit preiszugeben.

Fakten

  • Xet arbeitet mit blockbasierter, inhaltsadressierter Speicherung.
  • Die Technik wird in die Infrastruktur des Hugging Face Hub integriert.

Kritik

  • Eine neue Speicherschicht erhöht Protokoll- und Anbieterabhängigkeit, solange Alternativwerkzeuge fehlen.

Empfehlungen

  • Miss Upload, Checkout, Cachebedarf und Wiederherstellung mit deinen realen Modellrevisionen.

Referenzen

Originalbeitrag auf Hugging Face lesen →

Im Webarchiv suchen