Когда рабочий набор перестаёт помещаться
Каждый трюк из руководства по настройке перестаёт помогать в тот момент, когда ваши данные больше не помещаются в память. Эта линия существует, чтобы они продолжали помещаться: регистровая ECC DDR5, реальная серверная топология и достаточно ядер, чтобы использовать это.
When the working set stops fitting in RAM, nothing else you tune matters. This line exists so that it keeps fitting: ECC memory, real server topology, and enough cores to use it.
| Тариф | Выделенные ядра | 内存 | NVMe-хранилище | Скорость порта | Цена | |
|---|---|---|---|---|---|---|
| E-8 Entry into ECC | 8 | 64 GB | 500 GB | 25 Gbit/s | €89.00 /мес | Настроить |
| E-16Чаще всего берут The workhorse tier | 16 | 128 GB | 1 TB | 25 Gbit/s | €165.00 /мес | Настроить |
| E-32 A full socket | 32 | 256 GB | 2 TB | 25 Gbit/s | €310.00 /мес | Настроить |
| E-48 Half a terabyte of RAM | 48 | 512 GB | 4 TB | 25 Gbit/s | €580.00 /мес | Настроить |
Цены указаны без учёта НДС, где применимо. Трафик: Безлимит, fair use.
AMD EPYC 9354P · Zen 4 · 32C/64T · ECC DDR5-4800 · NUMA-aware pinning
Тридцать четыре города, двадцать девять стран
Значения задержки — это измеренные медианы с наших собственных зондов, а не данные из маркетинговых брошюр. Они меняются; страница обновляется, когда они меняются.
Для чего нужен серверный кремний
Десктопный процессор с большим кулером — это не сервер. Разница не в значке; дело в объёме памяти, коррекции памяти, количестве линий PCIe и способности одновременно загрузить все ядра работой.
EPYC 9354P, тридцать два ядра, двенадцать каналов памяти, один сокет.
9354P даёт нам тридцать два ядра Zen 4 и шестьдесят четыре потока на одном сокете, соединённых с двенадцатью каналами регистровой DDR5-4800. Двенадцать каналов — вот в чём суть. На двухканальной десктопной платформе шестнадцать занятых ядер проводят заметную долю дня в ожидании памяти, а не вычислениях; здесь — нет.
Односокетность также обдумана. Нет второго процессора, к которому нужно обращаться, нет межпроцессорной шины, которую можно перегрузить, и нет шанса, что планировщик разместит ваши потоки на одной стороне машины, а память — на другой. Меньше вещей, которые могут пойти не так, означает меньше тикетов в поддержку, начинающихся со слов «вчера всё работало».
Полтерабайта в одном инстансе
Верхний тариф несёт пятьсот двенадцать гигабайт корректирующей памяти. Аналитические базы данных, кэши в памяти, хипы JVM, которые никто не отважился профилировать, — всё это помещается без проекта по шардированию.
Ядра, которые остаются занятыми вместе
Сорок восемь потоков, выполняющих реальную работу, — это другая задача, нежели один быстрый поток. Пропускная способность на ядро — вот что делает возможным второй случай, и это показатель, который десктопные платформы не могут достичь ни при какой тактовой частоте.
Лишние линии PCIe
Достаточно линий, чтобы NVMe, сеть и устройства passthrough не конкурировали за один узкий путь. Именно поэтому здесь та же хост-платформа, что и в линиях GPU и хранилищ.
Предсказуемо, а не пиково
Тактовые частоты здесь ниже, чем на линейке Ryzen, и значительно более плоские. Для всего, где бюджет задержки измеряется 99-м перцентилем, плоскость стоит больше, чем скорость.
ECC и что оно на самом деле делает
Ошибки памяти не экзотика. На большом парке они случаются еженедельно, а на машине без коррекции они случаются невидимо, и это та часть, которая должна вас беспокоить.
Коррекция — это не галочка. Это лог, который можно читать.
Регистровая память ECC DDR5-4800 исправляет одноразрядные ошибки на лету и обнаруживает многоразрядные. Исправленная ошибка становится строкой в логе, а не неверным числом в вашем наборе результатов. Когда модуль начинает выдавать их с нежелательной частотой, его заменяют в плановое окно, до того как он станет неисправимой ошибкой и незапланированной перезагрузкой.
Практический довод в пользу этого — не теория надёжности. А то, что база данных с одним перевёрнутым битом в страничном кэше не падает: она записывает перевёрнутое значение на диск, верно реплицирует его на все резервные копии и позволяет обнаружить проблему через шесть недель, когда отчёт расходится сам с собой.
Счётчики коррекции для вашего инстанса видны в панели. Если предпочитаете следить за ними самостоятельно, те же цифры доступны через API.
Кому это не стоит покупать
Серверный кремний не автоматически лучший выбор. Он лучший для конкретного и довольно узкого круга задач.
Половина тех, кто просит EPYC, на самом деле хочет линейку Ryzen и хороший ночной сон.
Ваше узкое место — один поток
Ядро 9354P медленнее, чем ядро 9950X, и никакой объём памяти этого не изменит. Если ваш профилировщик показывает один поток на сто процентов, а тридцать одно ядро спит, вы закупаетесь не в той линейке.
Вы покупаете это ради бейджа
Ни одна рабочая нагрузка не становится корпоративной от того, что работает на процессоре с надписью EPYC. Покупайте это, когда реальным ограничением является объём памяти или количество ядер, а когда нет — покупайте более дешёвую линейку.
Вам нужно сорок терабайт
NVMe здесь в максимуме достигает нижних единиц терабайт. Массовые объёмы живут в линейке хранилищ, на той же хост-платформе, за долю стоимости за терабайт.
Вы хотите потом добавить GPU
Карты не добавляются в запущенные экземпляры EPYC. Линейка GPU существует потому, что для проброса требуется, чтобы хост был спроектирован под это с самого начала.
Вы хотите всю машину
Начиная с уровня E-32 вы получаете полный сокет, но гипервизор всё равно наш. Если вам нужны собственное ядро, собственный планировщик или вложенная виртуализация на полной скорости — покупайте выделенный сервер.
Выделение ресурсов и роль NUMA
Купить память легко. Убедиться, что ядра, которые её используют, физически рядом с ней — вот что отличает серверную платформу от таблицы характеристик.
Зафиксированные ядра, зарезервированная память, и всё на одной стороне машины.
Ядра закрепляются за физическими ядрами, один арендатор на ядро и его sibling-поток, точно так же, как в линейке Ryzen. Меняется размещение: ваша память выделяется из NUMA-домена, в котором находятся ваши ядра, поэтому обращение к памяти не пересекает fabric, чтобы достичь нужного адреса. Экземпляры, слишком большие для одного домена, закрепляются за минимальным числом доменов, способных их вместить, а топология пробрасывается, чтобы ваш собственный планировщик видел реальную картину.
Два ядра из тридцати двух зарезервированы под гипервизор, хранилище и мониторинг. Остальные продаются один раз. Когда они заканчиваются, сайт перестаёт показывать эту линейку в конфигураторе — это иногда раздражает и всегда честно.
| Ресурс | Как выделяется | Что разделяется |
|---|---|---|
| Ядра CPU | Закреплены в NUMA-домене, где позволяет размер | Ничего |
| 内存 | Резервируется при загрузке из локального домена. Registered ECC | Ничего |
| Топология | Пробрасывается, поэтому планировщик гостя видит реальные расстояния | Неприменимо |
| Ёмкость NVMe | Толстое выделение при создании | Ничего |
| Сетевой порт | Двадцать пять гигабит в секунду, выделенный | Внешний канал сайта, спроектирован с запасом сверх суммы |
| Накладные расходы гипервизора | Два зарезервированных ядра на узел, вне вашего выделения | Неприменимо |
Диски и сеть
Эталонный узел несёт четыре корпоративных NVMe-диска в зеркальных парах с резервным диском, а также два интерфейса на двадцать пять гигабит, объединённых в группу к разным коммутаторам.
Четыре NVMe Gen4 на узел, зеркалированные, на порту двадцать пять гигабит.
Зеркалирование с защитой от потери питания
Записи подтверждаются из кэша с защитой от сбоев питания. Сбой питания сбрасывает кэш, а не отбрасывает его — это разница между чистой перемоткой журнала и долгим вечером.
Объединённые uplink-и, отдельные коммутаторы
Два интерфейса в группе агрегации каналов, попадающие на разные коммутаторы. Перезагрузка коммутатора стоит вам нескольких потерянных пакетов, а не простоя.
Фильтрация уже включена
До двенадцати терабит в секунду фильтрации на периметре, постоянно на пути трафика. Включать при начале атаки нечего — она уже фильтрует, когда атака начинается.
Безлимитный, с опубликованной цифрой
Fair use на двадцатипятигигабитном порту — это сто пятьдесят терабайт в месяц. Цифра написана на странице с ценами, а не оставлена расплывчатой, чтобы потом использовать её против вас.
Приносите свои адреса
Начиная с тарифа E-32, на площадках, где апстрим это позволяет, вы можете анонсировать собственное IP-пространство. Откройте тикет с деталями объекта — мы ответим в течение суток.
Сорок гигабит, если нужно
Выделенный сорокагигабитный порт доступен на этой линейке везде, где на площадке есть запас пропускной способности. Это платная опция, цена указана на странице с ценами, и большинству она не нужна.
Где это работает и как переехать
Семь площадок — нет: Рейкьявик, София, Кишинёв, Панама-Сити, Сантьяго, Мумбаи и Йоханнесбург. Это площадки Ryzen и стораджа, и конфигуратор сообщит вам об этом до того, как вы привяжетесь к идее.
Двадцать семь из тридцати четырёх площадок располагают мощностями EPYC.
Всё остальное есть, включая все пять североамериканских площадок и каждую азиатскую, кроме Мумбаи. Во Франкфурте и Амстердаме больше всего мощностей, и новое железо туда приезжает первым. Цюрих имеет EPYC, но нормирует его, потому что стойко-место там стоит столько, сколько в Цюрихе стоит стойко-место.
- 01
Подбирайте по памяти, а не по ядрам
Определите рабочий набор в пике, добавьте то, что действительно зарабатывает ваш page cache, и берите тариф выше. Количество ядер в этой линейке обычно приходит как следствие объёма памяти, а не как отдельное решение.
- 02
Тестируйте на месячном тарифе
Возьмите один инстанс на месяц, прежде чем брать на два года по скидке. Семидневный возврат покрывает первую неделю, если ответ окажется «нет».
- 03
Переносите данные по сети
Двадцать пять гигабит и безлимитный трафик превращают копирование в несколько терабайт в задачу на ночь. Для чего-то большего спросите поддержку о seeded-переносе, а не придумывайте план с курьером.
- 04
Помните о топологии
Если ваше приложение закрепляет собственные потоки, читайте топологию, которую мы показываем, а не предполагайте, что машина плоская. Ошибка здесь — самая частая причина, по которой миграция выглядит медленнее, чем железо, которое она заменила.
- 05
Растите на месте, где можно
Память и NVMe расширяются на том же узле, если в нём есть место. Скачок, который узел не может поглотить, превращается в живую миграцию, согласованную с вами, обычно в пределах рабочего дня.
Когда отказывает узел
Крупные инстансы поднимаются дольше, потому что полтерабайта памяти нужно откуда-то заполнить. Мы предпочитаем сказать об этом прямо, а не делать вид, что иначе.
Тот же путь отказа, что и у остального флота, только памяти нужно заполнять больше.
Отказы дисков поглощаются зеркалом и горячей заменой, без перерыва в работе вашего инстанса. Вышедший из строя модуль памяти обычно ловится по растущим счётчикам коррекции до того, как станет некорректируемым, и заменяется в окно, согласованное с вами. Оба этих случая рутинны, и ни один из них не является инцидентом.
Полностью потерянный узел пересобирается на резервном железе в той же локации, ваши адреса переезжают следом. Перезапуск маленького инстанса занимает минуты. На самом крупном тарифе честная цифра ближе к получасу, и большая часть этого времени уходит на перенос данных, а не на решение, что делать.
Счётчики коррекции доступны вам
Вам не нужно верить нам на слово насчёт здоровья памяти под вашим инстансом. Счётчики есть в панели и в API.
Компенсация автоматическая
Контрактный uptime — 99.99% в месяц. Его недостижение автоматически зачисляет кредит на ваш аккаунт без формы заявки, звонка или спора о причинно-следственной связи.
Репликация лучше надежды
Один инстанс — это один инстанс, сколько бы ни стоило железо. Если нагрузка не может потерять полчаса, запустите standby на второй площадке и отрепетируйте переключение до того, как оно понадобится.
Вопросы об этой линии
Потому что это то, что мы можем купить, разместить в стойке и охлаждать в объёмах сегодня по цене, которая удерживает эту линейку на текущем уровне. 9354P — зрелый компонент с известным тепловым поведением и без сюрпризов в прошивке. Когда новое поколение серверов будет иметь смысл для парка, оно появится в журнале изменений, а не тихо под существующими инстансами.
Двенадцать модулей зарегистрированной DDR5-4800 на узел, коррекция включена, счётчики доступны. Читайте их в панели или через API. Любой, кто заявляет об ECC, не показывая счётчиков, просит вас довериться спецификации.
Начиная с уровня E-32 и выше — да, это поддерживаемый образ. Вложенная виртуализация работает, но несёт реальные издержки производительности. Если вложенные гости — это фактический продукт, честный ответ — выделенный сервер.
Если база данных помещается в памяти на Ryzen, а ваши запросы в основном однопоточные, Ryzen выигрывает по задержке и стоит меньше. Как только рабочий набор превышает сто двадцать восемь гигабайт или когда у вас много одновременных дорогих запросов, EPYC выигрывает с отрывом, который растёт с размером задачи.
Ваши ядра и память размещаются в одном домене, так что доступ не пересекает фабрику. Инстансы, слишком большие для одного домена, охватывают минимально возможное их число, и мы передаём реальную топологию, чтобы ваш собственный планировщик не гадал.
Начиная с уровня E-32 и выше, на площадках, где аплинк это позволяет. Отправьте детали объекта в тикет — и получите ответ в течение дня, включая прямой отказ, если площадка не может этого сделать.
Купите тот объём памяти, который вам действительно нужен
Выбирайте уровень по резидентному набору, а не по числу ядер, возьмите на месяц и переходите выше на месте, если число оказалось неверным. Оплата в монете, регистрация — это адрес электронной почты, а первая неделя возвращается без объяснения причин.