适用场景:个人学习、云架构实操、多方案私有云对比实验
核心初衷:不重装系统、保留原有环境、多套云架构轮番实战学习
一、前言
很多新手学习云计算、虚拟化时,要么直接装成品 PVE 开箱即用,要么盲目部署复杂 OpenStack,没有一套循序渐进、可轮换、可对比、不折腾崩本机的实验规划。
我本人已有一台成品 PVE 物理机用于生产级虚拟机运行,因此这台 Ubuntu24.04.4 LTS 主力机 不做商用、不做稳定服务,专门用作云架构学习、多方案私有云搭建、虚拟化技术对比的实验工作台。
本文完整记录我的整机硬件配置、核心搭建思路、多套云实验方案、分工规划、取舍逻辑,适合个人玩家、运维新手参考复刻。
二、本机硬件与系统基础信息(真实实战环境)
系统版本:Ubuntu 24.04.4 LTS
显卡:AMD Radeon RX580 2048SP(amdgpu 驱动正常适配)
内存:16G 大内存(满足多套云组件、虚拟机、AI 推理运行)
磁盘规划:
系统盘 sda:119G,已用12%,剩余空间充足,用于存放系统、实验环境、镜像文件
数据盘 sdb:465G 闲置裸盘,可直通虚拟机、单独做虚拟机数据盘,不占用系统盘空间
核心硬件优势:16G内存 + RX580独显 + 双硬盘,同时满足 虚拟化实验 + 本地AI推理 双重需求。
三、核心搭建原则(个人专属实验理念)
这是整套方案的核心,所有搭建逻辑均围绕以下原则执行,完美适配个人学习场景:
1. 坚决不重装系统
保留原生 Ubuntu24.04 桌面环境,不换 PVE、不换服务器系统,不破坏现有工作环境,所有虚拟化、云组件全部嵌套部署,仅做实验使用。
2. 分时复用硬件,各司其职
RX580 显卡不支持单卡同时共享宿主机与虚拟机,因此采用分时切换逻辑:
AI 实验模式:关闭所有Windows游戏虚拟机,显卡归属宿主机,运行 llama.cpp 本地大模型推理
游戏/Windows实验模式:关闭AI服务,启动直通显卡的Windows虚拟机,实现原生显卡性能打游戏、跑桌面程序
3. 多套云方案轮换部署,不共存冲突
不一次性部署所有云架构,采用 一套学完、卸载干净、环境重置、再部署下一套 的模式,严格模拟生产环境迭代流程,规避组件冲突、资源抢占问题,在稳定的基础上对比学习不同私有云的架构差异、适用场景与运维规范。
4. 两套虚拟化分工,精准适配不同场景
区分「服务器云虚拟机」和「游戏桌面虚拟机」,两套虚拟化工具共存、各司其职,不混用、不冲突。
四、双虚拟化架构分工规划(核心设计)
针对我的使用需求,将虚拟化拆分为两套独立体系,完美区分实验场景:
1. LXD + LXD-UI:主力小型私有云实验平台
定位:模拟阿里云轻量云、企业小型IaaS私有云,纯实验、跑服务、练架构
核心能力:
网页可视化控制台,一键创建 Linux / Windows Server 虚拟机、容器
支持虚拟机快照、克隆、网桥网络、端口转发,完全复刻公有云操作逻辑
支持 sdb 465G 整块物理硬盘直通给云虚拟机做数据盘
资源占用低、部署简单、稳定性强,适合长期做云平台实操实验
使用场景:搭建测试服务器、网络实验、快照克隆实操、私有云运维流程练习、多实例集群测试。
2. Libvirt + Virt-Manager:专属Windows游戏虚拟机
定位:仅用于Windows桌面娱乐、独显游戏,不做云实验
核心能力:
支持VFIO硬件直通,可将RX580完整直通Windows虚拟机,拥有原生显卡性能
独立于LXD云平台,专门负责桌面游戏、Windows专属软件测试
使用场景:休闲游戏、Windows桌面程序测试,与云实验场景完全隔离。
五、多套私有云实验方案学习规划(由浅入深)
按照「简单→复杂、轻量→企业级」的顺序,轮番部署学习,覆盖市面上主流私有云架构:
方案一:LXD 轻量私有云(入门首选)
最简单易上手的IaaS私有云,适合新手理解虚拟机、容器、网络、快照、存储池核心概念,作为日常主力实验平台。
方案二:Cockpit + KVM 原生虚拟化
系统原生KVM虚拟化,极简网页管理,理解Linux底层QEMU/KVM虚拟化原理,无封装、更贴近底层技术。
方案三:K3s + Rancher 容器私有云(PaaS云)
模拟阿里云ACK容器服务,学习K8s集群、容器编排、负载均衡,适配AI容器化部署,可调用宿主机RX580显卡做容器AI推理。
方案四:OpenStack DevStack 企业级IaaS云(进阶核心)
真正公有云底层架构,包含Nova计算、Neutron网络、Glance镜像、Keystone身份认证全套组件。
实操规范(生产级思路):不在宿主机直接部署复杂组件,规避环境污染、系统不稳定问题。统一在LXD合规虚拟机内部部署DevStack,全程模拟企业隔离部署规范,实验出错可直接销毁实例、快速重置环境,既保证学习完整搭建流程,又保障宿主机基础环境长期稳定。
六、硬件资源最终分配方案 & AI推理专属规划
系统盘 119G:存放系统、云组件、虚拟机镜像、AI大模型权重文件、实验环境,充足空间满足多版本模型存储。
数据盘 465G:整块直通虚拟机,作为云虚拟机/游戏虚拟机专属数据盘,同时可划分独立目录,存放AI数据集、推理日志、模型缓存,不占用系统盘空间。
RX580 独显(核心AI算力):采用分时复用机制,专属服务本地AI推理,不与虚拟机争抢硬件资源。AI模式下完整归属宿主机,解锁完整显卡算力,用于llama.cpp本地大模型推理、轻量化AI测试。
16G大内存:支撑多虚拟机运行、K3s集群、OpenStack云实验,同时满足7B/13B轻量化大模型本地推理内存需求,兼顾虚拟化与AI算力场景。
七、本地AI推理整体搭建规划(核心新增场景)
本机搭载RX580 2048SP独显,是绝佳的个人本地AI推理实验设备,结合私有云实验场景,形成「云架构学习+本地AI部署」双向实验体系,全程基于Ubuntu24.04宿主机部署,不依赖虚拟机、不折腾系统。
1. AI推理核心运行原则
严格遵循硬件分时复用逻辑,和虚拟化场景完全隔离,规避资源冲突、显卡抢占问题:
AI推理模式:关闭所有Windows游戏虚拟机、闲置云虚拟机,RX580显卡完全归属宿主机,专属运行本地大模型推理,算力无损耗。
云实验/游戏模式:停止所有AI推理服务,释放显卡、内存资源,将硬件资源全权交付虚拟化场景,用于搭建私有云、虚拟机游戏。
场景互斥、互不干扰:不同时运行AI推理与显卡直通虚拟机,保证两类实验的稳定性和性能完整性。
2. AI实验适配方案
核心部署方式:宿主机原生部署llama.cpp框架,适配AMD RX580显卡,实现轻量化大模型本地推理,无需虚拟机嵌套,算力利用率最高。
云联动实验:可实现「云虚拟机调用本地AI服务」的联动场景,云平台搭建的Linux/Windows服务器虚拟机,通过内网HTTP接口,调用宿主机的AI推理服务,模拟企业「云端服务+本地AI算力」的架构。
容器化AI拓展:后续可通过K3s容器云,部署AI推理容器,实现容器化算力调度,结合私有云架构,完成从虚拟机服务到容器AI服务的全流程学习。
3. AI+私有云整体实验价值
区别于单纯的云搭建、单纯的AI跑模型,这套组合方案可以模拟小型企业真实架构:私有云承载业务服务,本地GPU承载AI算力,服务与算力分离、内网联动,极大提升实战学习的真实性和完整性。
八、整套规划总结
1. 本机定位明确:已有PVE生产机承载稳定业务,本机以「生产级规范、企业运维标准」为核心,做标准化云架构搭建与实操学习,所有实验均遵循生产环境逻辑,拒绝野路子配置,兼顾实验灵活性与规范性。
2. 坚守不重装系统原则,基于原生Ubuntu24.04搭建,所有实验可回溯、可清理、不破坏基础环境。
3. 双虚拟化分工:LXD做云平台实验、Libvirt做Windows游戏虚拟机,场景隔离、互不冲突。
4. 多套云方案循序渐进学习,覆盖轻量云、原生虚拟化、容器云、企业级OpenStack全场景。
5. 硬件分时复用、环境隔离的设计,贴合企业生产资源调度逻辑,在保证系统长期稳定、配置标准化、环境可回溯的前提下,兼顾私有云架构实验、本地GPU AI推理、虚拟机合规娱乐场景,一机多用、规范实操,完全对标小型企业私有云+AI算力的落地流程。
【云实验规划】Ubuntu24.04.4 LTS 个人小型私有云实验平台 整机搭建规划方案
本文采用 CC BY-NC-SA 4.0 许可协议,转载请注明出处。
评论交流
欢迎留下你的想法