Storage

Storage-Plattformen, die nicht ausfallen dürfen.

Wir planen, bauen und betreiben Block-, File- und Object-Storage auf Standard-Hardware: hochverfügbar, mandantenfähig und vollständig als Code. Ceph setzen wir seit 2016 produktiv ein.

Die Herausforderung

Datenmengen wachsen, Aufbewahrungspflichten werden strenger, und klassische Speichersysteme binden Sie an einen Hersteller. Gleichzeitig ist Storage die Schicht, deren Ausfall alles andere mitreißt. Wer hier Fehler bei Fehlerdomänen, Sizing oder Netzwerk macht, merkt es erst im Ernstfall.

Was wir können

Fähigkeiten im Detail

Architektur und Design

Fehlerdomänen und Datenplatzierung, Replikation oder Erasure Coding, Pool- und Placement-Group-Planung, Topologien über mehrere Verfügbarkeitszonen.

Block, File und Object

RBD für OpenStack, Kubernetes und Hypervisoren, NVMe/TCP und iSCSI; CephFS mit NFS-Export; S3 auf RGW mit Storage Classes, Versionierung und Lifecycle-Regeln.

Mandantenfähiger S3-Storage

Trennung über Namensräume, eingeschränkte Zugangsdaten, Placement Targets und Quotas pro Mandant; ein klares Modell für Identitäten, Rollen und Bucket Policies; wiederholbares Onboarding.

Compliance und Aufbewahrung

Object Lock (WORM), Versionierung und Lifecycle-Regeln als technische Kontrollen für Aufbewahrungspflichten.

Kapazität und Performance

Wachstumsmodelle aus Nutz-zu-Roh-Verhältnis, Replikations-Overhead und Rebuild-Reserve; Node-Sizing über CPU, RAM, NVMe und Netzwerk; Tuning nach Messung statt nach Annahme.

Storage-Netzwerk

Getrennte Netze für Client-, Cluster-, Management- und Out-of-Band-Verkehr, Port- und Protokollmatrizen, MTU-Vorgaben, Load-Balancer- und VIP-Design, S3-Endpunkte mit BGP und ECMP.

Backup und Disaster Recovery

Replikation über Zonen, Active/Active-Lastverteilung, Konzepte für Disaster Recovery und Business Continuity, automatisierte Wiederherstellung, die regelmäßig geübt wird.

Betrieb und Fehleranalyse

Upgrades und Rolling Maintenance, Nodes hinzufügen und entleeren, Rebalancing; Diagnose von degradierten Placement Groups, langsamen Requests, Platten- und Netzwerkfehlern.

Migration und Enterprise-Storage

NetApp ONTAP im Parallelbetrieb und als Ausgangspunkt für den Umstieg auf Software-Defined Storage, herstellerneutral geplant.

PoC, Validierung, Dokumentation

Hardware-PoC vor der Beschaffung, Testkampagnen für Stabilität, Skalierung, Redundanz und Performance, Architekturdokumente, die sich auf nummerierte Anforderungen zurückführen lassen.

Vorgehen

Von der Anforderung bis zum Betrieb.

  1. 01

    Anforderungen

    Leistung, Kapazität, Verfügbarkeit und Compliance werden messbar formuliert.

  2. 02

    PoC

    Hardware und Design werden unter realer Last geprüft, bevor beschafft wird.

  3. 03

    Design und Sizing

    Fehlerdomänen, Netzwerk, Kapazität und Wachstum werden festgelegt und dokumentiert.

  4. 04

    Aufbau als Code

    Unbeaufsichtigte Installation mit cephadm, Ansible und GitOps, auch in vom Internet getrennten Umgebungen.

  5. 05

    Abnahme

    Testkampagnen gegen vorher definierte Kriterien: Stabilität, Redundanz, Performance.

  6. 06

    Betrieb

    Monitoring, Kapazitätsberichte, Upgrades und Fehleranalyse, mit Runbooks für Ihr Team.

Technologien

  • Ceph
  • cephadm
  • Rook-Ceph
  • RGW / S3
  • RBD
  • CephFS
  • NVMe-oF
  • NFS-Ganesha
  • iSCSI
  • NetApp ONTAP
  • Ansible
  • Terraform
  • Prometheus
  • Grafana
  • MAAS

Leistungen im Detail

Wissen

Lassen Sie uns über Ihre Infrastruktur sprechen.

Ob Architektur-Review, Aufbau einer neuen Umgebung oder Unterstützung im Betrieb: Sprechen Sie direkt mit den Ingenieuren, die Ihr Vorhaben umsetzen.