← 技術文章
虛擬化與機房 2026-08-14 · 約 9 分鐘

VMware 還是 Proxmox?2026 年的答案,跟兩年前不一樣了

Broadcom 收購後授權成本翻了數倍,問題已經不是「選哪個」,而是「怎麼遷、遷得動嗎」。本文用昶睿自家生產環境的實際經驗,談 Proxmox 真正會踩到的坑,以及什麼情況下你反而不該遷。

虛擬化Proxmox VEVMware vSphere地端基礎設施ZFSGPU 直通

兩年前我們寫過一篇比較 VMware 與 Proxmox 的文章。那時候的結論是「看需求選」。

2026 年再看,這個結論已經不太成立了——因為選項本身變了

先講已經發生的事

Broadcom 在 2023 年 11 月收購 VMware 之後,做了幾件對企業影響很大的事:

實際的價格影響,各家統計不一,但普遍落在漲幅 300% 到 1200% 之間。截至 2026 年 4 月的公開資料,vSphere Foundation 約為每 CPU 每年 4,500 美元起,VMware Cloud Foundation 則在 8,400 美元以上。

合作夥伴生態也在收縮:2025 年 6 月取消 Registered 等級,2026 年 1 月終止雲端服務供應商協議、改為邀請制。

對台灣的中小企業與政府機關來說,這件事的實質意義是:原本編列得出來的預算,現在編不出來了。

所以問題換了

2024 年的問題是「VMware 功能比較完整,Proxmox 比較便宜,怎麼選」。

2026 年的問題是三個:

  1. 續約的錢付不付得起?
  2. 如果不續,遷得動嗎?
  3. 遷過去之後,維運扛得住嗎?

第三個問題最少人談,卻最容易出事。下面這段是我們自己的經驗。

昶睿自己跑的是什麼

我們不是「評估過覺得不錯」,是整個公司的生產環境都跑在 Proxmox VE 上(以下規模僅作示意,不揭露實際組態):

換句話說,下面講的坑,都是我們自己踩過、修過、寫成內部規範的。

五個真的會出事的坑

一、NFS 掛載版本:一定要 vers=3

Proxmox 掛 QNAP 這類 NAS 時,如果走 NFS v4.1,會出現 lease 過期導致掛載變成 stale,接著備份任務整批失敗——而且失敗得很安靜,你可能好幾天後才發現。

我們的規範是一律指定 vers=3。這條規則是備份掛掉之後才寫進文件的。

二、ZFS ARC 沒設上限,會拖垮整個叢集

ZFS 的 ARC 快取預設會吃掉實體記憶體的一半。如果你又把虛擬機的記憶體開好開滿,ARC 加上 VM 會超過實體記憶體,觸發 OOM

問題在後面:節點 OOM 之後在叢集裡失去心跳,會連鎖 fence 掉其他節點。一台的設定失誤,整個叢集陪葬。

每台 PVE 主機都必須明確設定 zfs_arc_max 這不是調校,是必要設定。

三、GPU 直通:OVMF + q35,缺一不可

要把顯示卡直通給虛擬機,機器類型必須是 q35、BIOS 必須用 OVMF(UEFI)。用預設的 i440fx 會直通失敗,而錯誤訊息不會告訴你原因。

另外一個更陰險的問題:Ubuntu 的 unattended-upgrades 會自動升級 NVIDIA 驅動,但不會重載核心模組。結果是虛擬機裡 nvidia-smi 突然回報 0 張卡,服務全掛,而你什麼都沒動。我們的做法是把驅動版本鎖住,並且在監控裡加上 GPU 健康檢查。

四、HA 只能在同一個叢集內

這聽起來理所當然,但實際規劃時很容易忽略。我們的環境同時有多個叢集與獨立節點——跨叢集是沒有 HA 的。如果你把主要服務和備援放在不同叢集,那個「備援」是假的。

還有一個更難查的:控制面的虛擬機做線上遷移(live migrate)會出現 internal-error。我們的處理方式是改用 HA 冷啟動。這種事情在測試環境不會發生,只在你最需要它成功的時候發生。

五、單碟就是單點故障,HA 救不了資料

2026 年年中,我們一台主機的 NVMe 固態硬碟故障。HA 有發揮作用、服務有接手——但那台機器上的儲存池是單碟、沒有做鏡像

HA 保護的是「服務可用性」,不是「資料完整性」。ZFS 複製的 RPO 等於複製間隔,中間那段資料就是沒有了。

換碟並複驗通過之後,我們把「還有哪些單碟節點」列成待辦追蹤。這件事沒有捷徑,就是要花錢買第二顆碟。

那什麼時候不該遷?

如果只講 Proxmox 的好,那這篇就不誠實了。以下情況我們會建議客戶留在 VMware,或至少不要急:

我們建議的評估順序

  1. 先算清楚續約報價——拿到正式報價再談,不要用傳言估算
  2. 盤點你真正在用的 VMware 功能——多數環境用到的其實只有 vMotion、HA、快照、備份這四項,這些 Proxmox 都有
  3. 挑一個非關鍵系統做遷移試作——實際量測遷移工時,不要用廠商簡報的數字
  4. 確認維運能量——如果沒有 Linux 底子,先解決人的問題,或找有實績的夥伴
  5. 一定要有備份策略再遷——遷移中最容易出事的就是資料

最後

我們把公司自己的東西全部押在 Proxmox 上,不是因為它比較便宜,是因為我們有能力扛它的坑,而且我們的核心價值是「資料不出機房」——這需要一個能完全自己掌控的底層。

如果你正在評估這件事,我們可以直接跟你談實際的數字與工時,包含上面那些沒有人會在簡報裡講的部分。

關於這篇文章:本文改寫自 2024 年 7 月發表的〈VMware 與 Proxmox 虛擬化平台的選擇〉。原文的功能對照表在 2026 年已大幅過時(授權模式、價格、產品線都變了),因此改以「2026 現況+自身生產環境實際經驗」重寫。外部數據的出處與查證日期列於文末。

本文改寫自本站 2024-07-29 發表於 /vmware-and-proxmox-choose/ 的舊文,原文已停止維護。

需要有人幫你把這件事做完?

昶睿科技提供地端 AI 與基礎設施的規劃、建置與維運。資料不出機房、可稽核、廠牌中立。

預約 30 分鐘諮詢
昶睿 AI 客服×
由地端私有 LLM 即時回覆 · 資料不出機房 · 隱私權政策