SSD Nodes Learn
Посібники Matt ConnorВід Matt Connor · Оновлено 2026-07-24

Як створити найменш ефективний дата-центр

Гіпотетичний посібник з проектування дата-центру з PUE 4.0. Використовуємо RAID 0, сонячне тепло та один сервер для досягнення максимальної неефективності.

Що ви будуєте

Кожен посібник на цьому сайті вчить робити щось правильно: команди у правильному порядку, опис очікуваного результату та перелік можливих помилок. Цей посібник інший. Сьогодні, чисто гіпотетично, ми спроектуємо найменш ефективний дата-центр, який тільки можуть створити гроші, електроенергія та самовпевненість.

Нам потрібна метрика, тому ми запозичимо індустріальну: PUE, Power Usage Effectiveness — загальна потужність об'єкта, поділена на потужність, що фактично надходить на обчислювальне обладнання. Гіпермасштабований дата-центр працює з показником близько 1.1: майже кожен ватт виконує корисну роботу. Пристойний корпоративний серверний приміщення має 1.5. Наша ціль — 4.0 або вище, що означає, що на кожен ватт обчислень припадає ще три вати, які витрачаються даремно. Ми часто будемо звертатися до цього числа, так само як серйозні посібники звертаються до резервного копіювання.

Вибір місця: головне — це тепло

Охолодження — це найбільші витрати в реальному дата-центрі, тому наш буде боротися з термодинамікою на її ж полі. Ідеальне місце — горище. З вікнами на південь. В ідеалі — зі мансардним вікном, розташованим так, щоб сонячне світло падало прямо на сервер, аби машина отримувала і власне відпрацьоване тепло, і сонячне — результат співпраці вашого рахунку за електрику та зірки.

Взимку охолодження забезпечується відкриттям вікна. Реальні дата-центри використовують зовнішнє повітря — цей метод називається free cooling, він інженерно обробляється, фільтрується та контролюється за рівнем вологості. Ми ж використаємо його випадково, через вікно, через яке також потрапляють дощ, пилок та принаймні одна розгублена пташка щоквартально.

Для справжньої майстерності встановіть кондиціонер, а потім поставте обігрівач за два фути від його термостата, виставивши температуру на два градуси вищу за цільову температуру кондиціонера. Тепер обидва пристрої працюватимуть безперервно, вічно, у стані повної невідповідності. Компанія з постачання електроенергії надішле вам лист на Різдво.

Один сервер, великий та улюблений

Надмірність розмиває відданість справі. Наш дата-центр містить рівно один сервер, і він величезний, тому що одна машина з 512 GB RAM відчувається як інфраструктура, тоді як чотири маленькі — як список справ.

У сервера є ім'я. Не hostname — саме ім'я. Зазвичай Gandalf або Odin. Ви не можете вивести Odin з експлуатації. Odin працює вже п'ять років:

$ uptime
 09:14:02 up 1847 days,  3:22,  1 user,  load average: 6.41, 6.38, 6.40

Цей показник є предметом гордості, тому ви робите скриншот і публікуєте його, і саме тому кожен зловмисник, побачивши цей скриншот, також вважатиме його вражаючим: 1,847 днів uptime означає 1,847 днів вразливостей ядра, які ніхто не запатчив. Перезавантаження у будь-якому разі не розглядається — саме через перезавантаження ви дізнаєтеся, які сервіси були запущені вручну у 2021 році та так і не були прописані в unit для systemd. Ніхто не пам'ятає, які саме. Тепер сервер є опорним елементом в організаційній структурі.

Сховище: швидкість та інші способи втратити дані

Диски налаштовані у RAID 0 для продуктивності. Нуль означає кількість дисків, які можуть вийти з ладу. Для максимального ефекту об'єднайте масив із накопичувачів різного походження: два справжні SSD, один старий HDD та USB-накопичувач з конференції. Масив буде настільки ж надійним, наскільки надійний флешка з конференції, — у цьому і полягає задум.

Резервне копіювання здійснюється у директорію на тому ж масиві під назвою backup_final_v2_REAL, яка містить tarball попередньої схеми іменування. Зовнішнє резервне копіювання представлене стікером з написом "налаштувати off-site backups", який технічно зберігається поза межами об'єкта, коли ви забираєте його додому на кришці ноутбука.

Правильний результат виглядає так: df повідомляє про 97% використання та план дій на наступний спринт.

Мережа: одна нитка всього

DNS-сервер працює на самій машині, тому, коли сервер вийде з ладу, він забере з собою і DNS-запис, за допомогою якого ви намагалися з'ясувати причину. Це називається консолідацією.

Файрвол був вимкнений у 2021 році — тимчасово, для налагодження. Налагодження завершилося; файрвол не повернувся. Кожен порт на роутері прокинутий на сервер "щоб зекономити час пізніше", а панель адміністрування роутера доступна з боку WAN за заводським паролем для зручного віддаленого керування. Вашого та інших.

Останнім часом сервер працює незвично гаряче навіть за стандартами горища, а top показує, що найзайнятішим процесом є щось під назвою xmrig. Ми припускаємо, що це інструмент моніторингу, який ми використовуємо. Ми його не встановлювали — він з'явився сам собою невдовго після прокидання портів, що ми сприймаємо як ознаку процвітання екосистеми. Він моніторить систему цілодобово.

Електроенергія надходить через ланцюжок споживчих подовжувачів, чия загальна довжина перевищує відстань до щитка — що, у певному сенсі, ефективно, оскільки ви часто будете відвідувати щиток.

Надмірність через складність

Відмовившись від надмірності там, де це важливо, ми тепер додаємо її там, де це не потрібно. Головна сторінка компанії — один статичний HTML-файл — обслуговується кластером Kubernetes із дванадцяти вузлів. Це досягає того, що інженери називають архітектурою заради резюме: сторінка завантажується за ті самі сорок мілісекунд, які видав би nginx, але тепер вона може виходити з ладу так, що для вирішення проблеми знадобиться консультант.

Для ізоляції сам кластер працює всередині віртуальної машини всередині віртуальної машини всередині віртуальної машини, де кожен шар додає безпеки так само, як кожен шар turducken додає птиці. Форма зворотного зв'язку складається з дев'яти мікросервісів. Два з них ніколи не викликалися. Один із них є критично важливим, але ніхто не знає, який саме.

Опалення як сервіс

Сучасний сервер перетворює електрику на обчислення та тепло, і ми маємо намір максимізувати другий результат. медіасервер без GPU — це класичний прийом: CPU-транскодування одного 4K-потоку завантажить шістнадцять ядер і нагріє невелику спальню — обігрівач, який також відтворює фільми. Амбітні оператори переходять до запуску великої мовної моделі на CPU — обігрівача з 70 мільярдами параметрів та API, що генерує токени зі швидкістю, яку найкраще вимірювати сезонно.

Монітор спостерігає за собою

Спостережуваність має значення, тому ми розгортаємо self-hosted монітор аптайму — на тому самому сервері, який він моніторить. Коли Odin помирає, монітор помирає разом з ним, і ось тут починається елегантність: жодні сповіщення не надходять. Відсутність сповіщень означає відсутність інцидентів. Відсутність інцидентів означає ідеальний аптайм згідно з вимірюваннями. Щомісячний звіт ще ніколи не виглядав так добре.

Електронні листи з попередженнями, для повноти картини, ретранслюються через поштовий сервер, який також працює на Odin. Таким чином, конвеєр сповіщень є повністю автономним, подібно до змії, що їсть власний хвіст.

Неприємна частина

Ось розділ, який я постійно відкладав. Усе це не вигадка. Любимий незамінний сервер, RAID 0 з резервними копіями на тому ж томі, файрвол, вимкнений "тимчасово", кластер Kubernetes для однієї сторінки, монітор, що спостерігає за собою — я бачив усе це в продакшні. Деякі з цього я бачив цього року. Один або два я сам побудував на початку своєї кар'єри.

Те, як виглядає справжня ефективність, — це нудно, тому вона програє в суперечці в моменті, але перемагає протягом десятиліття: PUE, про який ви ніколи не думаєте, бо його розробив хтось інший. Обладнання, підібране під навантаження, а не під самовпевненість власника. Радіус ураження, продуманий до вибуху. Резервне копіювання, яке перевіряється відновленням за графіком, з нагадуванням у календарі та без героїзму. Надмірність, яка є нудною — два дешевих пристрої кращі за один величний у кожному випадку, коли мені приходить сповіщення про збій.

І найефективніший дата-центр, який ви можете запустити, — це той, який ви не запускаєте. VPS бере на себе питання живлення, охолодження, надмірності та апаратних збоїв о 3-й годині ночі, передаючи їх людям, які роблять це масштабно та нудно, що є найвищою похвалою для інфраструктури. Це залишає вам справді цікаву частину: запуск власних сервісів поверх неї на машині, яку ви можете дозволити собі втратити, — а це єдиний тип машин, на яких варто експериментувати.

FAQ

Чи варто мені насправді це робити?

Ні. Кожен розділ цього посібника — це задокументований антипатерн, що коштував багатьом вихідних. Якщо ваша поточна конфігурація нагадує більше двох розділів, перейдіть до останнього запитання в цьому FAQ — у порядку їхнього розташування, оскільки такий порядок є пріоритетним при сортуванні.

Який показник PUE є хорошим насправді?

Гіпермасштабовані дата-центри працюють з показником близько 1.1, добре налаштоване корпоративне приміщення має 1.4–1.6, а шафа без охолодження з обігрівачем може реально перевищити 3. Ви не зможете реально конкурувати з 1.1 вдома, що є вагомим економічним аргументом на користь оренди обчислювальних потужностей у тих, хто це вміє.

Чи є опалення будівлі за допомогою серверів реальним явищем?

Так — якщо це зроблено правильно. Проєкти централізованого опалення в кількох країнах використовують відпрацьоване тепло дата-центрів через теплообмінники та подають його в будинки за завдам, за допомогою інженерії та контрактів. Сатира вище полягає не в тому, що тепло серверів може зігріти кімнату; а в тому, що це стається випадково, і цей випадок називають стратегією.

Мій сервер вже виглядає так. Що мені робити насамперед?

Резервне копіювання — сьогодні ввечері, кудись, де немає сервера, а потім — тестове відновлення. Неперевірена резервна копія — це лише чутка. По-друге, патчі та перезавантаження, якого ви уникали, у запланований час, щоб ви побачили, що саме зламається, поки ви спостерігаєте. По-третє, усуньте єдину точку відмови: виведіть DNS та моніторинг з сервера. Все інше може почекати до спокійнішого тижня; ці три речі — ні.

#satire#datacenter#efficiency#self-hosting