ЖИ инфрақұрылымы / Қазақстан

GPU-серверлер.
Идеяларыңызға
шектеусіз мүмкіндік.

Қазақстандағы бизнеске арналған GPU-серверлер.
NVIDIA HGX / NVL · AMD Instinct · Huawei Ascend
Сатып алу, жалға алу және іске қосуға дайындық.

«ОМНАР» ЖШС / ҚАЗАҚСТАН / B2B
OMNAR / COMPUTE
01 — 08
GPU жадының жалпы көлемі2 160 GB
Үдеткіштер08 GPU
ЭКОЖҮЙЕЛЕР МЕН ЖҮКТЕМЕЛЕРNVIDIA HGXAMD InstinctHuawei AscendLLM / ИНФЕРЕНСОҚЫТУ / HPC
01 / Жабдық

Ауқымыңызға сай қуат.

Платформаларды салыстырып, міндетіңізге сай конфигурацияны таңдаңыз.

Сипаттамалар тексерілді: 06.10.2026
13 / 13
NVIDIABlackwell Ultra
Supermicro SYS-822GS-NB3RT · сервер үлгісі

HGX B300 · 8 GPU

NVLink 5 Switch арқылы қосылған сегіз Blackwell Ultra GPU. Жинақтама мен салқындату режимі сервер өндірушісімен келісіледі.

Үдеткіштер жады
2 160 GB
Архитектура мен орта
SXM6 · NVLink 5 SwitchCUDA
$634 046 бастап
NVIDIABlackwell
Supermicro SYS-822GS-NBRT · сервер үлгісі

HGX B200 · 8 GPU

Бір NVLink доменіндегі сегіз Blackwell GPU. Сервер мен салқындату инфрақұрылымға сай таңдалады.

Үдеткіштер жады
1 440 GB
Архитектура мен орта
SXM6 · NVLink 5 SwitchCUDA
$480 285 бастап
NVIDIAҮлкен модельдер үшін
Supermicro SYS-821GE-TNHR · сервер үлгісі

HGX H200 · 8 GPU

Жоғары жылдамдықты байланысы бар сегіз үдеткіште оқыту және инференс.

Үдеткіштер жады
1 128 GB
Архитектура мен орта
SXM5 · NVSwitchCUDA
$404 504 бастап
NVIDIAИкемді платформа
Supermicro SYS-422GA-NRT · сервер үлгісі

H200 NVL · 8 GPU

Сегіз PCIe GPU: әрқайсысында төрт GPU бар екі NVLink домені. Сервер мен көпірлердің үйлесімділігі коммерциялық ұсыныста расталады.

Үдеткіштер жады
1 128 GB
Архитектура мен орта
PCIe · 2 × NVLinkCUDA
$469 168 бастап
AMD2.3 TB HBM3e
Supermicro AS-A126GS-TNMR · сервер үлгісі

Instinct MI355X · 8 GPU

Сегіз MI355X GPU. Салқындату түрі, қуат шектері және алаңға қойылатын талаптар серверге байланысты, коммерциялық ұсыныста келісіледі.

Үдеткіштер жады
2 304 GB
Архитектура мен орта
OAM · Infinity FabricROCm
$402 824 бастап
AMD2 TB HBM3e
Supermicro AS-8126GS-TNMR · сервер үлгісі

Instinct MI325X · 8 GPU

Жадқа жоғары талап қоятын міндеттерге арналған сегіз үдеткіш.

Үдеткіштер жады
2 048 GB
Архитектура мен орта
OAM · Infinity FabricROCm
Сұрау бойынша
Көрсетілді: 6 / 13

Суретте осы платформаға арналған дайын жүйе үлгісі берілген. Нақты корпус, орнатылған үдеткіштер саны мен конфигурация ұсыныста бекітіледі.

Бағалар бюджетті жоспарлауға арналған, оферта немесе қоймада бар екенін растау болып табылмайды. ҚҚС, нақты жиынтық, жеткізу, кепілдік және мерзім коммерциялық ұсыныста көрсетіледі. Үдеткіштер жадының жалпы көлемі берілген; оны пайдалану бағдарламалық жасақтама мен байланыс топологиясына байланысты.

Платформа таңдау

Модельді таңдаңыз. Жад пен бағаны салыстырыңыз.

Тек инференс

Платформалар 13

Сүзгілер
Платформа түрі
GLM-5.3 · FP8 / BF16 / F32 · Резерв: 128 GB · Жад: жеткілікті ең шағыны алдымен
ПлатформаЖадЕсеп нәтижесіКонфигурацияны талқылау
H200 NVL · 8 GPUNVIDIA · CUDA$469 168 бастап1 128 GBЖад көлемі жеткіліктіқалады 244,4 GB
HGX H200 · 8 GPUNVIDIA · CUDA$404 504 бастап1 128 GBЖад көлемі жеткіліктіқалады 244,4 GB
HGX B200 · 8 GPUNVIDIA · CUDA$480 285 бастап1 440 GBЖад көлемі жеткіліктіқалады 556,4 GB
Instinct MI300X · 8 GPUAMD · ROCm$356 168 бастап1 536 GBЖад көлемі жеткіліктіқалады 652,4 GB
Instinct MI325X · 8 GPUAMD · ROCmСұрау бойынша2 048 GBЖад көлемі жеткіліктіқалады 1 164,4 GB
HGX B300 · 8 GPUNVIDIA · CUDA$634 046 бастап2 160 GBЖад көлемі жеткіліктіқалады 1 276,4 GB
Көрсетілді 6/13

Номиналды жад көлемі сыйымдылықты бағалайды. Жинақтама, БҚ, топология және қолжетімділік бөлек тексеріледі.

Дереккөздерді тексеру:
LLM жадын қалай есептеу керек
Есеп және дереккөздер

GLM-5.3

753 млрд — чекпойнт параметрлері. 39 млрд — бір токенге белсенді.

Жарияланған чекпойнт: FP8 / BF16 / F32. Жарияланған чекпойнт немесе ресми нұсқаулықтағы салмақтар көлемі. Бұл — сақталған салмақтар көлемі, GPU жадының өлшемі емес: іске қосудағы түрлендіру оны арттыруы мүмкін. Резерв бөлек қосылады.

Салмақтар пішімі: Жарияланған чекпойнттан бастаңыз. Қосымша кванттау сапаға әсер етуі мүмкін; квантталған салмақтарды BF16-ға ауыстыру жоғалған дәлдікті қалпына келтірмейді.

Жұмыс резерві: Бір GPU үшін емес, бүкіл таңдалған конфигурациядағы KV-кэш, активациялар, жұмыс буферлері мен бос орынға арналған, салмақтардан бөлек жад. Контекст ұзындығы мен қатар орындалатын сұраулар санына қарай белгілеп, ең жоғары шығынды өлшеңіз. Дайын мәндер — мысалдар, әмбебап ұсыныстар емес.

Модель карточкасы ↗Жарияланған салмақтар көлемі ↗Жарияланған іске қосу нұсқаулығы ↗

Бұл — модель конфигурациясында көрсетілген шек; таңдалған жабдықта тексерілген контекст емес.

DSA ішінде kv_lora_rank=512 және full/shared индексаторлары қолданылады. Кэшті осы архитектураны ескеріп есептеу керек.

Модель config-і ↗

Контекст config-і тексерілді: .

Орындау ортасын тексеру қажет. Жарияланған іске қосу нұсқаулығы: HGX H200 · 8 GPU, Instinct MI355X · 8 GPU, Instinct MI325X · 8 GPU, Instinct MI300X · 8 GPU.

Есепті қалай оқу керек

Салмақтар = барлық параметр × бір параметрге байт: BF16 — 2, FP8 — 1, INT4 — 0,5. Бірлік — ондық GB. MoE үшін тек белсенді параметрлер емес, барлық сарапшылар есептеледі. Бұл — төменгі шек: кванттау масштабтары, квантталмаған қабаттар мен метадеректер бөлек есептелмейді; олар резервке сыюы тиіс.

Жасыл белгі — жадқа сыйымдылық бағасы, тексерілген іске қосу емес. Жад GPU арасында бөлінген. Тензорлық және сарапшылық параллелизмді, байланыстарды, есептеу ядролары мен фреймворк қолдауын тексеру керек. Ұзын контекст пен қатар жұмыс істейтін пайдаланушылар көбірек резервті талап етуі мүмкін. Үйрету және қосымша үйрету үшін бөлек есеп қажет.

KV-кэш контекст ұзындығына, қатар орындалатын сұрауларға, кэш дәлдігіне және модельдің назар аудару архитектурасына тәуелді. Жылжымалы терезе, сызықтық назар аудару және сығылған кэш бөлек бағалауды қажет етеді; ең жоғары шығын таңдалған орындау ортасында тексеріледі. Бұл өріс сервер баптауларын емес, сыйымдылық бағасын өзгертеді.

Hugging Face: KV-кэш стратегиялары ↗vLLM: Гибридті кэшті бөлу ↗
  • Жад көлемі жеткілікті. Есептік бюджет сыяды. БҚ, модельді бөлу және жылдамдық тексерілуі керек.
  • Бос жад аз. Осы резервпен 10%-дан аз жад қалады. Таңдау алдында нақты шығынды өлшеу қажет.
  • Жад жеткіліксіз. Сценарий GPU жадының жалпы көлемінен асады. Дәлдікті немесе платформаны өзгертіңіз.

BF16 / FP8 / INT4 — жад көлемінің сценарийлері. Формат атаулары GPU-дағы нативті қолдауды немесе модель сапасының бірдей болуын растамайды.

NVL үшін топология мен модельді бөлу бөлек тексеріледі: 8 GPU бар PCIe сервері HGX/NVSwitch жүйесіне тең емес. Іске қосар алдында ROCm ортасында нақты чекпойнт пен ядроларды тексеріңіз.

Huawei Ascend CANN стегін пайдаланады. Жад есебі таңдалған чекпойнттың, операторлардың немесе дәлдіктің осы платформаларда жұмыс істейтінін растамайды. Модель порты мен орындау ортасын тексеру қажет.

NVIDIA спецификациясына сай есепте HGX B300 үшін әр GPU-ға 270 GB, ал GB300 үшін 279 GB қолданылады. 288 GB мәні қолданылмайды. CPU жедел жады GPU жадына қосылмайды. NVIDIA Blackwell Ultra (PDF) ↗

02 / Инфрақұрылымды жалға алу

Сізге нәтиже керек.
Серверді иелену
міндетті емес.

Жүктемеңізге сай жеке конфигурацияны талқылаймыз. Жалға алу мерзімін, орналастыруды, қолжетімділікті және қолдау шарттарын іске қоспас бұрын келісеміз.

Жалға алу құнын есептеу↗
01
LLM және ЖИ инференсіМодельдер, RAG және корпоративтік ЖИ сервистері
02
Оқыту және fine-tuningЖадты, байланысты және сақтау жүйесін таңдау
03
Компьютерлік көру және HPCНақты жұмыс жүктемесіне сай есептеу
03 / Жұмыс тәртібі

Міндеттен —
конфигурацияға.

Алғашқы ерекшеліктен жабдықты тапсыруға дейін. Қазақстандағы компаниялармен жұмыс істеп, нақты жүктемеге сай инфрақұрылым таңдаймыз.

01 /

Жүктемені талдаймыз

Модель, дәлдік, жад көлемі, пайдаланушылар саны және мақсатты өнімділік.

02 /

Нұсқаларды салыстырамыз

NVIDIA, AMD немесе Huawei. Жадты, үдеткіштер байланысын, бағдарламалық үйлесімділікті және иелену құнын салыстырамыз.

03 /

Жеткізуді келісеміз

Сипаттама, жабдықты тексеру, шарт, шот бойынша төлем және кепілдік шарттары.

Қазақстан бойынша жеткізу

Жаһандық технологиялар.
Жергілікті серіктес.

OMNAR — Қазақстандағы GPU-серверлерді жеткізуші. Қазақстан компаниялары үшін жабдық таңдап, сатып алу және жеке серверді жалға алу бойынша ұсыныстар дайындаймыз.

01 / CONFIGUREЖобаМіндет және жинақтама
02 / OPERATEІске қосуЖеткізу және қабылдау
Ерекшелік → шарт → жеткізу → қабылдау
01

«Омнар» ЖШС-мен шарт

Қазақстандық заңды тұлға, теңгемен есептелген ұсыныс және шот бойынша төлем.

02

Құрамы түсінікті баға

Жабдық, жеткізу, салықтар және қосымша қызметтер коммерциялық ұсыныста көрсетіледі.

03

Сізге сай инфрақұрылым

Сіздің алаңыңыздағы сервер немесе орналасуы мен қолжетімділігі келісілген жеке серверді жалға алу.

Өз міндетіңізден бастаңыз.

Инфрақұрылымды талқылаудың үш бастапқы нүктесі.

01 /

Командаға арналған AI сервис

Модельді, контексті, пайдаланушылар санын және рұқсат етілген жауап уақытын белгілеңіз.

Не дайындау керек
02 /

Оқыту және эксперименттер

Деректерді, қосымша оқыту әдістерін және іске қосу ұзақтығын сипаттаңыз. Бір сценарийде сатып алу мен жалға алуды салыстырыңыз.

Не дайындау керек
03 /

Жеке инфрақұрылым

Серверлерді немесе тұтас тіректі келіспей тұрып алаңды, қуатты, салқындатуды және желіні тексеріңіз.

Не дайындау керек

Таңдауға көмектесетін жауаптар.

Алғашқы жад есебінен серверді қабылдауға дейінгі мәліметтер жеке нұсқаулықтарда жинақталған.

Жабдық таңдау5 мин оқу

GPU-серверге техникалық тапсырманы қалай дайындау керек

Ұсыныстарды салыстырып, тапсырыс алдында нәтижені тексеру үшін міндет, жүктеме және пайдалану туралы қандай мәліметтер қажет.

Нұсқаулықты оқу: GPU-серверге техникалық тапсырманы қалай дайындау керек
Барлық материалдар →
Бастайық

Қандай міндетті
шешкіңіз келеді?

Модель мен жоспарланған жүктеме туралы жазыңыз. Серверді сатып алуға немесе жалға алуға сұрау жіберіп, ұсыныс дайындауға қажетті мәліметтерді көрсетіңіз.

Ноутбукпен жұмыс істеп отырған AI-инфрақұрылым маманы
Сату бөліміsales@omnar.kzПошта іске қосуға дайындалуда. Сұрауды нысан арқылы жіберуге болады.

Барлық өрісті толтыру қажет.

Келісім жарнамалық хабарламаларды қамтымайды. Сұрау жіберу тапсырысты рәсімдемейді және сатып алуға міндеттемейді.

«Сұрау жіберу» түймесін басқанда деректер мен келісім OMNAR-ға жіберіледі. ЖСН, құжаттарды, құпиясөздерді және сұрауға қатысы жоқ мәліметтерді қоспаңыз.

Білген жөн

Алғашқы іске қосуға дейін.

NVIDIA, AMD және Huawei арасынан қалай таңдауға болады?

Модель мен бағдарламалық стектен бастаңыз: NVIDIA үшін CUDA, AMD үшін ROCm, Huawei үшін CANN. Содан кейін салмақ пішімін, жадты бөлуді және нақты жүктемедегі өнімділікті тексеріңіз. Жад көлемінің бірдей болуы платформалардың өзара алмастырылатынын білдірмейді.

Каталогтағы бағалар нені білдіреді?

Баға жинақтама мен жеткізу шарттарына байланысты. Теңгемен көрсетілген қорытынды баға, ҚҚС туралы мәлімет, жеткізу мерзімі және кепілдік қамтылған коммерциялық ұсынысты сұратыңыз. Қолжетімділік ұсыныста расталады.

8 × H200 NVL мен HGX айырмашылығы қандай?

HGX H200 — NVSwitch бар SXM платформасы. H200 NVL негізіндегі PCIe жинағының үйлесімділігін тексеру керек; ол төрт GPU-дан тұратын екі топтан құралуы мүмкін. Бұл HGX-тің сегіз GPU-ды біріктіретін байланыс жүйесіне тең емес.

Жалға алу қалай келісіледі?

Конфигурация, мерзім, деректер орталығы, қосылу, қолжетімділік режимі және қолдау нақтыланады. Қуаттың қолжетімділігі мен басталу күні жеке расталады; бірден іске қосуға уәде берілмейді.