მთავარ კონტენტზე გადასვლა

ვირტუალიზაცია

ვირტუალიზაცია, რომელსაც ჰოსტის დაცემა არ სტოვებს ოფლაინში

VMware vSphere და Proxmox/KVM კლასტერები, საერთო საცავი, HA, მიგრაცია ერთი პლატფორმიდან მეორეზე და ტესტირებული აღდგენა — არა მხოლოდ დაყენება, არამედ ყოველდღიური ოპერირება.

პრობლემა

კლასტერი მანამ მუშაობს, სანამ პირველ ჰოსტს არ დაკარგავთ

ვირტუალიზაციის დაყენება მარტივია — რთულია ის, რაც შემდეგ ხდება. ლიცენზიები იწურება, საცავი ერთადერთი წერტილია, backup-ს არავინ ამოწმებს აღდგენით, ჰოსტების ვერსიები ერთმანეთს დაშორდა, და ცოცხალი მიგრაცია სწორედ მაშინ არ მუშაობს, როცა ის სჭირდებათ.

  • საერთო საცავი ერთადერთი წერტილია
  • backup არსებობს, აღდგენა არასდროს გატესტილა
  • ჰოსტების ვერსიები და კონფიგურაცია განსხვავდება
  • capacity არავის აქვს დათვლილი — N+1 მხოლოდ ქაღალდზეა

რას ვაწვდით

ვირტუალიზაცია, რომელსაც ჰოსტის დაცემა არ სტოვებს ოფლაინში

კლასტერის დიზაინი

ჰოსტების რაოდენობა, N+1, ქსელის სეგმენტაცია, საცავის ტოპოლოგია.

საცავი და მისი გამძლეობა

ZFS/RAID დონეები, NFS/iSCSI, სნეპშოტები და რეპლიკაცია.

HA და ცოცხალი მიგრაცია

ჰოსტის დაკარგვის სცენარი გატესტილი, არა ნავარაუდევი.

backup და აღდგენა

პოლიტიკა, შენახვის ვადები და აღდგენის რეპეტიცია განრიგით.

მიგრაცია

ფიზიკურიდან ვირტუალურზე ან VMware-დან Proxmox-ზე, ეტაპობრივად.

მრავალლოკაციური მართვა

რამდენიმე კლასტერი სხვადასხვა ლოკაციაზე — ერთი ხედი, ერთი პროცედურა, ერთი backup-პოლიტიკა.

დოკუმენტაცია და გადაცემა

runbook-ები, სქემები და თქვენი გუნდის ტრენინგი.

არქიტექტურა

არქიტექტურა

  1. 01ფიზიკური ფენა
    • Redundant power
    • Cooling
    • OOB
  2. 02ქსელიleaf-spine
    • EVPN-VXLAN
    • LACP
    • MTU 9000
  3. 03Computeვირტუალიზაციის კლასტერი
    • KVM / Proxmox
    • VMware
    • HA
  4. 04საცავი
    • Ceph
    • ZFS
    • NVMe
  5. 05აღდგენატესტირებული restore
    • Snapshots
    • Off-site
    • DR runbook
დატაცენტრის fabric: compute, საცავი და ქსელი ერთ HA დომენში

საოპერაციო ეკრანები

საოპერაციო ეკრანები

ეს კონკრეტული სისტემები ჯგუფის რეალურ ინფრასტრუქტურაზე მუშაობს — სქრინშოტები დამუშავებულია გამოქვეყნებამდე.

დაბუნდოვნებული Proxmox VE ინტერფეისი კლასტერის კვანძებით, კონტეინერებითა და რესურსების მაჩვენებლებით.

ვირტუალიზაციის კლასტერი

მრავალკვანძიანი Proxmox კლასტერი: KVM ვირტუალური მანქანები და LXC კონტეინერები, NFS/HA საცავი, ცალკე backup-NAS და მიგრირებული ESXi ჰოსტები. ეს საიტიც ამ კლასტერზე მუშაობს — კონტეინერში, იმავე ინფრასტრუქტურაზე, რომელსაც ვყიდით.

Proxmox VEKVM / LXCHA storageESXi migration
დაბუნდოვნებული Proxmox Datacenter Manager — კვანძების, ვირტუალური მანქანების, კონტეინერებისა და backup სერვერების აგრეგირებული მდგომარეობა.

8 კლასტერი ერთი ინტერფეისიდან

Proxmox Datacenter Manager აერთიანებს ერთმანეთისგან დამოუკიდებელ Proxmox VE კლასტერებს ერთ სივრცეში. ჩვენს ინფრასტრუქტურაში ის 8 კლასტერს მართავს — სხვადასხვა ფიზიკურ ლოკაციაზე, მათგან 3 საქართველოს ფარგლებს გარეთ. ეკრანზე ჩანს მასშტაბიც: 211 კვანძი ონლაინ, 1480 ვირტუალური მანქანა და 127 კონტეინერი — ერთი ხედით, ერთი პროცედურით.

Proxmoxmulti-clustermulti-sitePBS
დაბუნდოვნებული vSphere Client — ვირტუალური მანქანების ინვენტარი და ერთი მანქანის რესურსების მაჩვენებლები.

vSphere — კლასტერი, ჰოსტები და სამუშაო დატვირთვები

vCenter რამდენიმე ESXi ჰოსტით და მათზე განთავსებული სერვისებით: ვებ, ბილინგი, დომენის კონტროლერი, backup აგენტები. ეს არის ის გარემო, სადაც VMware და Proxmox ერთდროულად ცხოვრობს — ნაწილი ჯერ კიდევ vSphere-ზეა, ნაწილი უკვე მიგრირებულია. ორივეს ერთი გუნდი ოპერირებს, ერთი backup-პოლიტიკით.

vSphereESXivCentermigration
დაბუნდოვნებული TrueNAS ინტერფეისი საცავის პულებითა და დისკების მდგომარეობით.

საცავი — ZFS პულები და რეპლიკაცია

ZFS საცავი RAIDZ2 ტოპოლოგიაზე — 12 დისკი ერთ vdev-ში, ~33 TiB სასარგებლო მოცულობა, ECC მეხსიერება და მისი დიდი ნაწილი ZFS ქეშად. აქვე ჩანს ის, რაც მთავარია: დისკები შეცდომებით — 0, scrub და scan შეცდომების გარეშე. ვირტუალიზაციის კლასტერისა და backup-ის ქვეშ სწორედ ეს ფენა დგას.

TrueNASZFSRAIDZ2ECC
დაბუნდოვნებული სარეზერვო ასლების დაშბორდი დაცული სისტემების სტატუსითა და საცავის მოხმარების გრაფიკით.

სარეზერვო ასლები და აღდგენა

ვირტუალური და ფიზიკური სისტემების ცენტრალიზებული backup: დაცული მანქანების სტატუსი, საცავის მოხმარების დინამიკა და ცალკე სია იმ ჰოსტებისა, რომლებმაც რეპორტინგი შეწყვიტეს. სწორედ ეს ბოლო სია ჰქმნის განსხვავებას — backup, რომელსაც არავინ აკვირდება, backup არ არის.

VM backupretentionrestore testalerting

შესაძლებლობები

შესაძლებლობები

თითოეული პუნქტი აღნიშნულია: დადასტურებული პროდაქშენ გამოცდილება თუ საინჟინრო შესაძლებლობა.

VMware vSphere / ESXi

Proven

vCenter, მრავალჰოსტიანი კლასტერი, საერთო საცავი და სამუშაო დატვირთვების განთავსება — ჯგუფის საკუთარ ინფრასტრუქტურაში ყოველდღიურად ოპერირდება.

  • vSphere
  • ESXi
  • vCenter

Proxmox VE და KVM/LXC

Proven

მრავალკვანძიანი კლასტერი, NFS/HA საცავი, კონტეინერები და ვირტუალური მანქანები ერთ პლატფორმაზე.

  • Proxmox VE
  • KVM
  • LXC

მრავალკლასტერული მართვა (Proxmox Datacenter Manager)

Proven

ერთმანეთისგან დამოუკიდებელი Proxmox VE კლასტერები ერთი ინტერფეისიდან: კვანძების მდგომარეობა, ვირტუალური მანქანები და კონტეინერები, CPU/RAM/საცავი და backup სერვერები. ჩვენს ინფრასტრუქტურაში 8 კლასტერს მართავს, სხვადასხვა ფიზიკურ ლოკაციაზე — მათგან 3 საქართველოს ფარგლებს გარეთ.

  • Datacenter Manager
  • multi-cluster
  • PBS

მიგრაცია VMware-დან Proxmox-ზე

Proven

ეტაპობრივი გადატანა, სადაც ორივე პლატფორმა თანაარსებობს, სანამ ბოლო დატვირთვა არ გადავა — ლიცენზიის ვადა არ კარნახობს გრაფიკს.

  • ESXi import
  • qm importovf
  • rsync

ZFS საცავი და რეპლიკაცია

Proven

RAIDZ პულები, სნეპშოტების განრიგი და დისკების ჯანმრთელობის მონიტორინგი.

  • TrueNAS
  • ZFS
  • NFS

backup და ტესტირებული აღდგენა

Proven

ცენტრალიზებული backup აგენტებით, შენახვის პოლიტიკა და აღდგენის რეპეტიცია — რეპეტიციის გარეშე ეს backup არაა.

  • Cyber Backup
  • ZFS snapshots

HA და ავტომატური აღდგენა

Capability

ჰოსტის დაკარგვისას დატვირთვის ავტომატური აწევა სხვა კვანძზე.

  • HA cluster
  • Fencing

provisioning-ის ავტომატიზაცია

Capability

შაბლონები, cloud-init და API — ხელით შექმნილი მანქანა გამონაკლისი უნდა იყოს.

  • Terraform
  • Ansible
  • cloud-init

პროცესი

პროცესი

  1. 01

    აუდიტი

    არსებული ჰოსტები, საცავი, ლიცენზიები და დატვირთვები.

  2. 02

    დიზაინი

    სამიზნე კლასტერი, N+1 და საცავის ტოპოლოგია.

  3. 03

    აწყობა

    კვანძები, ქსელი, საცავი, backup — დოკუმენტირებულად.

  4. 04

    მიგრაცია

    ეტაპობრივად, rollback-ის გეგმით და შეთანხმებულ ფანჯრებში.

  5. 05

    ვალიდაცია

    ჰოსტის დაკარგვა და აღდგენა რეალურად სრულდება, არა იგულისხმება.

  6. 06

    ოპერირება

    მონიტორინგი, capacity და პატჩების ციკლი.

ტექნოლოგიური სტეკი

ტექნოლოგიური სტეკი

ჰიპერვიზორი
VMware vSphereESXiProxmox VEKVMLXC
მართვა
Proxmox Datacenter ManagervCenterProxmox Backup Server
საცავი
TrueNASZFSNFSiSCSIRAID 10 SSD
backup
Cyber BackupZFS snapshotsReplication
ავტომატიზაცია
AnsibleTerraformcloud-init
მონიტორინგი
ZabbixPrometheusGrafanaLibreNMS

თანამშრომლობის მოდელი

თანამშრომლობის მოდელი

პროექტი

ერთჯერადი scope: აუდიტი, მიგრაცია ან დანერგვა ფიქსირებული შედეგით.

რეტეინერი

ყოველთვიური საინჟინრო საათები — სპეციალისტზე წვდომა მოთხოვნისამებრ.

Co-Managed

NetWizard და თქვენი შიდა გუნდი ერთად, გაყოფილი პასუხისმგებლობით.

სრულად მართული

შეთანხმებულ საოპერაციო scope-ს მთლიანად ჩვენ ვფლობთ.

გამოყენების შემთხვევები

გამოყენების შემთხვევები

ლიცენზიის ვადა იწურება

VMware-ის განახლების ღირებულება გაიზარდა — დატვირთვების ნაწილი Proxmox-ზე გადადის, ნაწილი რჩება, და ორივე ერთი გუნდით ოპერირდება.

ერთი ჰოსტი, ნულოვანი მარაგი

ყველაფერი ერთ სერვერზეა. ვაშენებთ კლასტერს საერთო საცავით, სადაც ჰოსტის დაკარგვა ინციდენტია და არა კატასტროფა.

backup, რომელიც არასდროს აღდგენილა

ვაწყობთ პოლიტიკას, ვამოწმებთ აღდგენას scratch გარემოში და შედეგს ვაფიქსირებთ დოკუმენტში.

ხშირი კითხვები

ხშირი კითხვები

VMware თუ Proxmox?

ეს დამოკიდებულია არსებულ დატვირთვებზე, ლიცენზიის ბიუჯეტსა და გუნდის გამოცდილებაზე. ორივეს ვოპერირებთ პროდაქშენში და ვენდორის მიმართ ვალდებულება არ გვაქვს — არჩევანს აუდიტის შემდეგ ვამბობთ, არა მანამდე.

მიგრაცია გაჩერებას ნიშნავს?

დატვირთვების უმეტესობა შეთანხმებულ ფანჯარაში გადადის, ხოლო კრიტიკული სერვისები — რეპლიკაციით და მოკლე გადართვით. თითოეული ნაბიჯი rollback-ის გეგმით მიდის.

აღდგენას მართლა ამოწმებთ?

დიახ — აღდგენა ცალკე ბაზაში ან scratch გარემოში სრულდება და შედეგი ფიქსირდება. სანამ ეს არ გაკეთებულა, ჩვენთვის backup-ის სტატუსი „უცნობია“.

დაგვიწერეთ თქვენი ინფრასტრუქტურის შესახებ