ვირტუალიზაცია
ვირტუალიზაცია, რომელსაც ჰოსტის დაცემა არ სტოვებს ოფლაინში
VMware vSphere და Proxmox/KVM კლასტერები, საერთო საცავი, HA, მიგრაცია ერთი პლატფორმიდან მეორეზე და ტესტირებული აღდგენა — არა მხოლოდ დაყენება, არამედ ყოველდღიური ოპერირება.
პრობლემა
კლასტერი მანამ მუშაობს, სანამ პირველ ჰოსტს არ დაკარგავთ
ვირტუალიზაციის დაყენება მარტივია — რთულია ის, რაც შემდეგ ხდება. ლიცენზიები იწურება, საცავი ერთადერთი წერტილია, backup-ს არავინ ამოწმებს აღდგენით, ჰოსტების ვერსიები ერთმანეთს დაშორდა, და ცოცხალი მიგრაცია სწორედ მაშინ არ მუშაობს, როცა ის სჭირდებათ.
- საერთო საცავი ერთადერთი წერტილია
- backup არსებობს, აღდგენა არასდროს გატესტილა
- ჰოსტების ვერსიები და კონფიგურაცია განსხვავდება
- capacity არავის აქვს დათვლილი — N+1 მხოლოდ ქაღალდზეა
რას ვაწვდით
ვირტუალიზაცია, რომელსაც ჰოსტის დაცემა არ სტოვებს ოფლაინში
კლასტერის დიზაინი
ჰოსტების რაოდენობა, N+1, ქსელის სეგმენტაცია, საცავის ტოპოლოგია.
საცავი და მისი გამძლეობა
ZFS/RAID დონეები, NFS/iSCSI, სნეპშოტები და რეპლიკაცია.
HA და ცოცხალი მიგრაცია
ჰოსტის დაკარგვის სცენარი გატესტილი, არა ნავარაუდევი.
backup და აღდგენა
პოლიტიკა, შენახვის ვადები და აღდგენის რეპეტიცია განრიგით.
მიგრაცია
ფიზიკურიდან ვირტუალურზე ან VMware-დან Proxmox-ზე, ეტაპობრივად.
მრავალლოკაციური მართვა
რამდენიმე კლასტერი სხვადასხვა ლოკაციაზე — ერთი ხედი, ერთი პროცედურა, ერთი backup-პოლიტიკა.
დოკუმენტაცია და გადაცემა
runbook-ები, სქემები და თქვენი გუნდის ტრენინგი.
არქიტექტურა
არქიტექტურა
- 01ფიზიკური ფენა
- Redundant power
- Cooling
- OOB
- 02ქსელიleaf-spine
- EVPN-VXLAN
- LACP
- MTU 9000
- 03Computeვირტუალიზაციის კლასტერი
- KVM / Proxmox
- VMware
- HA
- 04საცავი
- Ceph
- ZFS
- NVMe
- 05აღდგენატესტირებული restore
- Snapshots
- Off-site
- DR runbook
საოპერაციო ეკრანები
საოპერაციო ეკრანები
ეს კონკრეტული სისტემები ჯგუფის რეალურ ინფრასტრუქტურაზე მუშაობს — სქრინშოტები დამუშავებულია გამოქვეყნებამდე.
ვირტუალიზაციის კლასტერი
მრავალკვანძიანი Proxmox კლასტერი: KVM ვირტუალური მანქანები და LXC კონტეინერები, NFS/HA საცავი, ცალკე backup-NAS და მიგრირებული ESXi ჰოსტები. ეს საიტიც ამ კლასტერზე მუშაობს — კონტეინერში, იმავე ინფრასტრუქტურაზე, რომელსაც ვყიდით.
8 კლასტერი ერთი ინტერფეისიდან
Proxmox Datacenter Manager აერთიანებს ერთმანეთისგან დამოუკიდებელ Proxmox VE კლასტერებს ერთ სივრცეში. ჩვენს ინფრასტრუქტურაში ის 8 კლასტერს მართავს — სხვადასხვა ფიზიკურ ლოკაციაზე, მათგან 3 საქართველოს ფარგლებს გარეთ. ეკრანზე ჩანს მასშტაბიც: 211 კვანძი ონლაინ, 1480 ვირტუალური მანქანა და 127 კონტეინერი — ერთი ხედით, ერთი პროცედურით.
vSphere — კლასტერი, ჰოსტები და სამუშაო დატვირთვები
vCenter რამდენიმე ESXi ჰოსტით და მათზე განთავსებული სერვისებით: ვებ, ბილინგი, დომენის კონტროლერი, backup აგენტები. ეს არის ის გარემო, სადაც VMware და Proxmox ერთდროულად ცხოვრობს — ნაწილი ჯერ კიდევ vSphere-ზეა, ნაწილი უკვე მიგრირებულია. ორივეს ერთი გუნდი ოპერირებს, ერთი backup-პოლიტიკით.
საცავი — ZFS პულები და რეპლიკაცია
ZFS საცავი RAIDZ2 ტოპოლოგიაზე — 12 დისკი ერთ vdev-ში, ~33 TiB სასარგებლო მოცულობა, ECC მეხსიერება და მისი დიდი ნაწილი ZFS ქეშად. აქვე ჩანს ის, რაც მთავარია: დისკები შეცდომებით — 0, scrub და scan შეცდომების გარეშე. ვირტუალიზაციის კლასტერისა და backup-ის ქვეშ სწორედ ეს ფენა დგას.
სარეზერვო ასლები და აღდგენა
ვირტუალური და ფიზიკური სისტემების ცენტრალიზებული backup: დაცული მანქანების სტატუსი, საცავის მოხმარების დინამიკა და ცალკე სია იმ ჰოსტებისა, რომლებმაც რეპორტინგი შეწყვიტეს. სწორედ ეს ბოლო სია ჰქმნის განსხვავებას — backup, რომელსაც არავინ აკვირდება, backup არ არის.
შესაძლებლობები
შესაძლებლობები
თითოეული პუნქტი აღნიშნულია: დადასტურებული პროდაქშენ გამოცდილება თუ საინჟინრო შესაძლებლობა.
VMware vSphere / ESXi
ProvenvCenter, მრავალჰოსტიანი კლასტერი, საერთო საცავი და სამუშაო დატვირთვების განთავსება — ჯგუფის საკუთარ ინფრასტრუქტურაში ყოველდღიურად ოპერირდება.
- vSphere
- ESXi
- vCenter
Proxmox VE და KVM/LXC
Provenმრავალკვანძიანი კლასტერი, NFS/HA საცავი, კონტეინერები და ვირტუალური მანქანები ერთ პლატფორმაზე.
- Proxmox VE
- KVM
- LXC
მრავალკლასტერული მართვა (Proxmox Datacenter Manager)
Provenერთმანეთისგან დამოუკიდებელი Proxmox VE კლასტერები ერთი ინტერფეისიდან: კვანძების მდგომარეობა, ვირტუალური მანქანები და კონტეინერები, CPU/RAM/საცავი და backup სერვერები. ჩვენს ინფრასტრუქტურაში 8 კლასტერს მართავს, სხვადასხვა ფიზიკურ ლოკაციაზე — მათგან 3 საქართველოს ფარგლებს გარეთ.
- Datacenter Manager
- multi-cluster
- PBS
მიგრაცია VMware-დან Proxmox-ზე
Provenეტაპობრივი გადატანა, სადაც ორივე პლატფორმა თანაარსებობს, სანამ ბოლო დატვირთვა არ გადავა — ლიცენზიის ვადა არ კარნახობს გრაფიკს.
- ESXi import
- qm importovf
- rsync
ZFS საცავი და რეპლიკაცია
ProvenRAIDZ პულები, სნეპშოტების განრიგი და დისკების ჯანმრთელობის მონიტორინგი.
- TrueNAS
- ZFS
- NFS
backup და ტესტირებული აღდგენა
Provenცენტრალიზებული backup აგენტებით, შენახვის პოლიტიკა და აღდგენის რეპეტიცია — რეპეტიციის გარეშე ეს backup არაა.
- Cyber Backup
- ZFS snapshots
HA და ავტომატური აღდგენა
Capabilityჰოსტის დაკარგვისას დატვირთვის ავტომატური აწევა სხვა კვანძზე.
- HA cluster
- Fencing
provisioning-ის ავტომატიზაცია
Capabilityშაბლონები, cloud-init და API — ხელით შექმნილი მანქანა გამონაკლისი უნდა იყოს.
- Terraform
- Ansible
- cloud-init
პროცესი
პროცესი
- 01
აუდიტი
არსებული ჰოსტები, საცავი, ლიცენზიები და დატვირთვები.
- 02
დიზაინი
სამიზნე კლასტერი, N+1 და საცავის ტოპოლოგია.
- 03
აწყობა
კვანძები, ქსელი, საცავი, backup — დოკუმენტირებულად.
- 04
მიგრაცია
ეტაპობრივად, rollback-ის გეგმით და შეთანხმებულ ფანჯრებში.
- 05
ვალიდაცია
ჰოსტის დაკარგვა და აღდგენა რეალურად სრულდება, არა იგულისხმება.
- 06
ოპერირება
მონიტორინგი, capacity და პატჩების ციკლი.
ტექნოლოგიური სტეკი
ტექნოლოგიური სტეკი
- ჰიპერვიზორი
- VMware vSphereESXiProxmox VEKVMLXC
- მართვა
- Proxmox Datacenter ManagervCenterProxmox Backup Server
- საცავი
- TrueNASZFSNFSiSCSIRAID 10 SSD
- backup
- Cyber BackupZFS snapshotsReplication
- ავტომატიზაცია
- AnsibleTerraformcloud-init
- მონიტორინგი
- ZabbixPrometheusGrafanaLibreNMS
თანამშრომლობის მოდელი
თანამშრომლობის მოდელი
პროექტი
ერთჯერადი scope: აუდიტი, მიგრაცია ან დანერგვა ფიქსირებული შედეგით.
რეტეინერი
ყოველთვიური საინჟინრო საათები — სპეციალისტზე წვდომა მოთხოვნისამებრ.
Co-Managed
NetWizard და თქვენი შიდა გუნდი ერთად, გაყოფილი პასუხისმგებლობით.
სრულად მართული
შეთანხმებულ საოპერაციო scope-ს მთლიანად ჩვენ ვფლობთ.
გამოყენების შემთხვევები
გამოყენების შემთხვევები
ლიცენზიის ვადა იწურება
VMware-ის განახლების ღირებულება გაიზარდა — დატვირთვების ნაწილი Proxmox-ზე გადადის, ნაწილი რჩება, და ორივე ერთი გუნდით ოპერირდება.
ერთი ჰოსტი, ნულოვანი მარაგი
ყველაფერი ერთ სერვერზეა. ვაშენებთ კლასტერს საერთო საცავით, სადაც ჰოსტის დაკარგვა ინციდენტია და არა კატასტროფა.
backup, რომელიც არასდროს აღდგენილა
ვაწყობთ პოლიტიკას, ვამოწმებთ აღდგენას scratch გარემოში და შედეგს ვაფიქსირებთ დოკუმენტში.
ხშირი კითხვები
ხშირი კითხვები
VMware თუ Proxmox?
ეს დამოკიდებულია არსებულ დატვირთვებზე, ლიცენზიის ბიუჯეტსა და გუნდის გამოცდილებაზე. ორივეს ვოპერირებთ პროდაქშენში და ვენდორის მიმართ ვალდებულება არ გვაქვს — არჩევანს აუდიტის შემდეგ ვამბობთ, არა მანამდე.
მიგრაცია გაჩერებას ნიშნავს?
დატვირთვების უმეტესობა შეთანხმებულ ფანჯარაში გადადის, ხოლო კრიტიკული სერვისები — რეპლიკაციით და მოკლე გადართვით. თითოეული ნაბიჯი rollback-ის გეგმით მიდის.
აღდგენას მართლა ამოწმებთ?
დიახ — აღდგენა ცალკე ბაზაში ან scratch გარემოში სრულდება და შედეგი ფიქსირდება. სანამ ეს არ გაკეთებულა, ჩვენთვის backup-ის სტატუსი „უცნობია“.
დაკავშირებული