Cluster Oversigt
Constellation er mit Proxmox-cluster: 6 fysiske nodes plus en ekstern QDevice, der tilsammen giver 7 quorum-stemmer. Setuppet kører high-availability virtualisering, et Ceph-baseret delt lager og automatisk failover for kritiske services. Adgang udefra går gennem en outbound-only tunnel med SSO og MFA, så der ikke åbnes en eneste indgående port på hjemmenetværket.
Distribueret Compute
6 Proxmox-nodes i ét cluster deler workloads via live migration. VM'er og LXC-containere kan flyttes mellem nodes uden nedetid, så hardware kan serviceres uden at tage services offline.
High Availability
En ekstern QDevice leverer den syvende, ulige quorum-stemme. En dedikeret kritisk-tier HA-gruppe holder de vigtigste services kørende på de små, strømbesparende nodes ved nodefejl.
Ceph Delt Lager
Et Ceph-cluster spænder SSD-diske på tværs af flere nodes med 3× replikering. Block-storage følger med VM'en uanset hvilken node den kører på, uden noget single point of failure.
Netværk & Adgang
Ét fladt L2-netværk uden VLAN. Adskillelsen sker fysisk via en dedikeret NIC pr. rolle og logisk via faste DHCP-reservationer og firewall-aliasser på pfSense.
Mgmt-net
Proxmox-webUI, pfSense og switch-/AP-administration. Kun tilgængeligt bag SSO.
Corosync-net
Dedikeret 1G pr. node til cluster-heartbeat. Lav båndbredde, men isoleret fra al anden trafik.
Ceph / storage-net
10G-backbone til Ceph-replikering, NFS og SMB, så storage-trafik aldrig deler link med LAN.
Cluster Nodes
Blandet flåde af genbrugt hardware, fra to OptiPlex Micro'er til en Dell R710, bundet sammen til ét cluster. Hver node har en klar rolle.
💧 Hydrax
Custom rackmount server
💻 Hardware
- CPUAMD Ryzen 7 3800X (8C / 16T)
- RAM64 GB DDR4
- Netværk2× 1G + 2× 10G
- Boot128 GB SATA M.2 (ZFS)
- Ceph OSD10 SSD'er · ~2,9 TB raw
🎯 Rolle i clusteret
Hydrax bærer størstedelen af Ceph SSD-poolen med 10 OSD-diske fordelt over HBA og onboard SATA. De to 10G-links kobler den på storage-backbonen, så replikeringstrafikken holdes væk fra det almindelige LAN.
🌟 Orion
HP EliteDesk 800 G2 SFF
💻 Hardware
- CPUIntel Core i7-6700 (4C / 8T)
- RAM32 GB DDR4
- Netværk3 NIC (2 passthrough til pfSense, 1 fri)
- Boot240 GB SATA SSD (ZFS)
- Ceph OSD1× 120 GB SSD
🎯 Rolle i clusteret
Orion hoster pfSense-VM'en med WAN- og LAN-NIC's sendt direkte igennem via PCI-passthrough. Fordi kun Orion er fysisk kablet til WAN, og passthrough-NIC's ikke kan live-migreres, er routing bevidst bundet til denne ene node.
📦 Skynet
Tidligere Unraid-serveren
💻 Hardware
- CPUAMD Ryzen 9 3900X (12C / 24T)
- RAM28 GB DDR4
- Netværk1× 1G
- Boot128 GB SATA M.2 (ZFS)
- GPUGTX 1650 Super (planlagt LXC-passthrough)
- Bulk-lager6 HDD (3× 1TB + 3× 2TB) via HBA-passthrough
🎯 Rolle i clusteret
Clusterets næststærkeste compute-node. HBA'en sendes igennem til en dedikeret storage-VM, TrueNAS SCALE, der deler NFS til clusteret og SMB til personlige enheder. Selve disk-arrayet røres ikke.
🗄️ Selesti
Dell PowerEdge R710
💻 Hardware
- CPU2× Intel Xeon X5650 (12C / 24T)
- RAM96 GB DDR3 ECC
- Netværk4× 1G onboard + iDRAC · 2× 10G PCIe
- Boot2× 300 GB SAS i mirror (ZFS)
- SAS-pool3× 10K + 1× 15K + 1× 1,2 TB
🎯 Rolle i clusteret
Den eneste rigtige server i flåden. SAS-poolen bliver enten en separat, disk-redundant Ceph-pool eller et lokalt Proxmox Backup Server-datastore. Beslutningen er ikke truffet endnu.
🔱 Triton
Dell OptiPlex 7040 Micro
💻 Hardware
- CPUIntel Core i5-6500T (4C / 4T)
- RAM8 GB (1 slot ledig)
- NetværkOnboard 1G
- Boot256 GB SATA SSD
🎯 Rolle i clusteret
Lille og strømbesparende. Kører Authentik (SSO via OIDC) og let monitorering, og er sammen med Callisto failover-mål for den kritiske HA-gruppe. Holdes uden for den almindelige workload-rebalancering.
🌙 Callisto
Dell OptiPlex 7040 Micro
💻 Hardware
- CPUIntel Core i5-6500T (4C / 4T)
- RAM8 GB (1 slot ledig)
- NetværkOnboard 1G
- Boot256 GB SATA SSD
🎯 Rolle i clusteret
Identisk hardware med Triton. Kører en sekundær Proxmox Backup Server (sync-mål fra den primære) og CrowdSec. Andet ben i den kritiske HA-gruppe for Airlock og Authentik.
🧭 Hyperion
Tidligere filserver og firewall · selvstændigt fejldomæne · pt. slukket
💻 Hardware
- CPUIntel Core i5-7400
- RAM16 GB
- LagerOverflow ZFS-pool (2 TB + 4 TB HDD)
🎯 Rolle i clusteret
Kører corosync-QDevice som en tjeneste direkte på maskinen, ikke en VM i clusteret, så den syvende quorum-stemme er reelt uafhængig af clusterets eget fejldomæne. Er samtidig den primære Proxmox Backup Server.
Samlet Cluster Kapacitet
Kombineret hardware på tværs af de 6 nodes plus Hyperion
Cluster Kapabiliteter
Byggeklodserne der holder Constellation kørende
Ceph Delt Lager
SSD-OSD'er på Hydrax, Orion og Skynet danner én Ceph-pool med 3× replikering, hvilket giver ca. 3 TB raw og ~1 TB brugbart. Block-storage følger VM'en, uanset hvilken node den lander på.
HA & Live Migration
Proxmox HA flytter VM'er og containere mellem nodes uden nedetid. En dedikeret kritisk-tier gruppe failover'er Airlock og Authentik til Triton/Callisto, og pfSense er undtaget, da passthrough-NIC'er ikke kan migreres.
Quorum & QDevice
6 nodes plus en ekstern QDevice giver 7 stemmer, så quorum altid er ulige. QDevice kører uden for clusteret, så et split-brain ikke kan tage tie-breakeren med sig.
Routing & Firewall
En pfSense-VM på Orion router hele det flade netværk, bevidst uden VLAN, med logisk opdeling via DHCP-reservationer og firewall-aliasser. WAN er default-deny; ingen indgående porte åbnes nogensinde.
Zero Trust-adgang
Airlock, mit selvhostede zero trust-adgangslag, rejser en outbound-only krypteret tunnel til en VPS, så udvalgte services kan nås udefra uden en eneste åben port hjemme. Hver forespørgsel skal gennem SSO og MFA (Authentik) før den rammer en intern service, og CrowdSec banner misbrug ved kanten.
Backup & Recovery
Proxmox Backup Server med deduplikering og point-in-time recovery. Den primære PBS står uden for clusteret; en sekundær sync-kopi ligger på Callisto, så backuppen selv har redundans.
Åbne Punkter
Constellation er under løbende opbygning. På listen lige nu:
- Anskaf en rack-UPS og sæt NUT op, så en onbattery-trigger migrerer Airlock + Authentik til kritisk-tier nodes og lukker de strømtunge nodes kontrolleret ned
- Selesti SAS-pool: separat Ceph-pool eller lokalt PBS-datastore, skal besluttes
- Flyt Hydrax' frigjorte 256 GB M.2 til Triton eller Callisto som Ceph-OSD
- Migrér resterende Cloudflare Tunnel- og NPM-tjenester til Airlock og nedlæg begge