300 құрылғы үшін Zabbix не Prometheus таңдауды парк шешеді
300 құрылғыға Zabbix не Prometheus таңдауды салыстырамыз: SNMP мен серверлер, бастапқы баптау, хабарламалар және әкімші біліктілігі.

Таңдауды 300 саны емес, осы 300 құрылғының құрамы мен команданың жұмыс тәсілі анықтайды. Паркте коммутатор, маршрутизатор, үздіксіз қуат көзі, принтер және кәдімгі сервер көп болса, Zabbix әрдайым дерлік тезірек іске қосылып, қолмен құрастыру жұмысын азайтады. Негізгі жүктеме метриканы дайын күйінде беретін сервистерде, контейнерлерде және қолданбаларда болса, Prometheus сұрау тілі жағынан мықтырақ әрі Git арқылы жұмыс істеу тәртібіне табиғи үйлеседі.
Мен әдемі таныстырылым экранына қарап шешім қабылдамас едім. Екі өнім де процессор жүктемесі мен тораптың қолжетімділігін оңай көрсетеді. Айырмашылық кейін байқалады: бейтаныс коммутатор моделін қосқанда, желі өзегі істен шыққаннан кейінгі хабарламалар тасқынын тоқтатқанда, сақтау орнының өсуін түсінгенде және PromQL жазбайтын әкімшіге кезекшілікті тапсырғанда.
Үш жүз құрылғы жүктемені анықтамайды
Құрылғы санының өзі мониторинг жүйесінің көлемі туралы ештеңе дерлік айтпайды. Агенті бар бір сервер жүз пайдалы көрсеткіш бере алады, ал жүздеген порты бар коммутатор интерфейстер анықталғаннан кейін әлдеқайда көп элемент немесе уақыттық қатар жасайды. Жиналатын көрсеткіш саны, сұрау аралығы, белгі саны, сақтау мерзімі және сұрауы тайм-аутты күтетін қолжетімсіз нысандардың үлесі маңызды.
Таңдау алдында паркті кемінде төрт топқа бөліңіз: SNMP арқылы бақыланатын желілік жабдық, серверлік операциялық жүйелер, дерекқор мен гипервизор сияқты инфрақұрылымдық сервистер және өз метрикасын беретін қолданбалар. Содан кейін әр топ үшін қол жеткізу тәсілі мен жауапты адамды жазыңыз. Мұндай кесте «300 құрылғыны қолдау» талабынан пайдалырақ, себебі қалыптан тыс жұмыстың көлемін бірден көрсетеді.
SNMP үшін корпус санын ғана емес, анықталатын нысандарды да есептеңіз: физикалық порттар, VLAN, қуат блоктары, датчиктер және қатынау нүктелері. Қолжетімді екен деп барлық MIB кестесін қоспаңыз. Әкімшілік жолмен өшірілген порттар мен уақытша интерфейстерді сұрау сақтау орнын ұлғайтып, ешкім талдамайтын оқиғалар жасайды. Zabbix шаблондарына арналған нұсқаулық төмен деңгейлі анықтауды қолданып, қажетсіз нысандарды сүзуді тікелей ұсынады. snmp_exporter генераторы да индекстерді тұрақты және динамикалық сүзуді қолдайды. Екі жағдайда да үнем мониторинг жүйесіне процессор қосудан емес, деректер моделінен басталады.
Серверлер үшін тек CPU, жад, диск және қолжетімділіктің негізгі көрсеткіштері керек пе, әлде сервистер, журналдар, аппараттық датчиктер, RAID күйі мен қолданбалық тексерулер де қажет пе, соны анықтаңыз. Prometheus белгілердің әрбір бірегей жиынтығын жеке уақыттық қатар деп есептейді. Сұрау немесе пайдаланушы идентификаторы бар шектеусіз белгі бүкіл парктен де көп жүктеме туғызуы мүмкін. Zabbix жүйесінде осыған ұқсас қате төмен деңгейлі анықтау құбылмалы тізімнен мыңдаған элемент пен триггер жасағанда пайда болады.
Іс жүзіндегі есепті жаңа мәндер ағынынан бастаңыз. Белсенді элементтер немесе қатарлар санын жинау жиілігіне көбейтіп, пилотта сақтау мерзімі мен дискідегі қорды тексеріңіз. Теориялық есеп виртуалды машинаның бастапқы көлемін таңдауға керек, бірақ нақты тұтынуды шаблондар, белгілер және деректердің өзгергіштігі анықтайды. Бос орнатылған өнімдерді салыстырудың мәні жоқ.
Аралас парк Zabbix жүйесінде тезірек іске қосылады
Бір әкімші желілік жабдық пен серверлерді ортақ хост моделінде көруі керек болса, Zabbix ыңғайлырақ. SNMP, ICMP, агенттік тексерулер, IPMI, веб-тексерулер және көптеген дайын шаблон бір өнімнің ішінде орналасқан. Хостқа интерфейс беріледі, оған шаблон байланыстырылып, төмен деңгейлі анықтау табылған порттар немесе файлдық жүйелер үшін элементтер, триггерлер мен графиктер жасайды.
Zabbix жүйесінің SNMP туралы ресми құжаттамасы дайын шаблондарды ұсынады және олардың нақты құрылғымен үйлесімділігін тексеруді ескертеді. Бұл ескерту маңызды. Шаблондағы өндіруші атауы әр өнім желісі мен микробағдарлама нұсқасында OID, индекс және күй бірдей болатынына кепіл емес. Мен әрдайым модельдің бір данасын snmpwalk командасымен тексеріп, нақты жауаптарды қараймын да, содан кейін ғана шаблонды жаппай байланыстырамын.
snmpwalk -v3 -l authPriv -u monitor -a SHA256 -A 'AUTH_PASS' \
-x AES -X 'PRIV_PASS' 192.0.2.15 1.3.6.1.2.1.2.2.1.8
IF-MIB::ifOperStatus.1 = INTEGER: up(1)
IF-MIB::ifOperStatus.2 = INTEGER: down(2)
Шығыс пішімі екі сұраққа бірден жауап береді: қажетті OID қолжетімді ме және құрылғы шын мәнінде қандай индекстерді қайтарады. Мысалдағы құпия деректерді қабықша тарихында қалдырмаңыз, жұмыс ортасында есептік деректерді қорғалған жолмен беріңіз. SNMPv1 және v2c нұсқаларында community жолы шифрланбай өтеді, сондықтан басқарылатын желіде аутентификациясы мен шифрлауы бар SNMPv3 қолданған дұрыс.
Prometheus жүйесінде желіні сұрау әдетте бөлек snmp_exporter арқылы құрылады. Prometheus оның HTTP нүктесіне жүгінеді, exporter мақсатты SNMP арқылы сұрап, индекстерді белгілерге айналдырады. Стандартты if_mib модулі интерфейс статистикасын тез береді, бірақ өндірушіге тән датчиктер мен кестелер үшін MIB жинап, generator.yml сипаттап, snmp.yml жасап, модуль таңдап, метрика атауларын тексеру керек. Жобаның README файлы дайын snmp.yml файлын қолмен түзетпеуді тікелей айтады: өзгерістер генератор конфигурациясына енгізіледі.
Linux серверлері үшін Prometheus жүйесіне node_exporter қажет, ал Windows үшін әдетте бөлек exporter қолданылады. Бұл қалыпты архитектура, бірақ компоненттерді орнату, жаңарту, қорғау және түгендеу керек. Zabbix агентін де орнату қажет, есесіне сервер, шаблондар, оқиғалар және хабарлама жеткізу бір әкімшілік ортада қалады. Аралас паркте осы тұтастық бастапқы жұмысты азайтады.
Prometheus қолданбалар жанында мықтырақ
Қолданбалар мен платформалар метриканы Prometheus пішімінде дайын жарияласа, Prometheus ұтады. Ол мәндерді HTTP арқылы алады, мақсат белгілерін қосады және көрсеткіштерді PromQL сұрауларымен байланыстыруға мүмкіндік береді. Kubernetes, сервистер және конфигурацияны Git арқылы басқаратын команда үшін бұл тәсілді бағдарламамен бірге кеңейту және тексеру оңай.
PromQL артықшылығы CPU графигінде емес, бірнеше нысанды байланыстыратын сұрақтарда көрінеді. Сервис бойынша қате үлесін есептеуге, сынақ ортасын алып тастауға, сұрау жылдамдығын қолжетімді даналармен салыстыруға және нәтижені команда не өңір бойынша біріктіруге болады. Zabbix жүйесіндегі есептелетін элементтер мен триггер өрнектері көптеген жұмыс міндетін шешеді, бірақ көп өлшемді метриканы еркін талдау Prometheus жүйесінде табиғи орындалады.
Мақсаттарды анықтау тәсілі де өнімнің шығу тегін көрсетеді. Prometheus нысандарды Kubernetes, Consul және басқа қолдау көрсетілетін механизмдерден ала алады, ал ұйымның өз есеп жүйесі үшін файлдық және HTTP арқылы анықтау бар. File-based service discovery туралы ресми нұсқаулық нысандар мен белгілер жазылған JSON тізімін көрсетеді. Prometheus файлды бақылап, өзгерістерді қайта іске қосусыз қабылдайды. Тұрақты сервер тізімі үшін бұл артық жұмыс сияқты көрінуі мүмкін, бірақ динамикалық платформада мұндай модель өзін тез ақтайды.
Команда Prometheus жүйесін коммутаторларды бақылайтын дайын жүйенің орнына қолданса, артықшылық жоғалады. Онда exporter, SNMP модульдері, жазу ережелері, дабыл ережелері, Alertmanager, алушылар және көрнекі интерфейсті өздері құрастыруы керек. Әр компонент өз міндетін жақсы атқарады, бірақ байланыс нүктелерінің саны азаймайды. Негізінен желілік жабдық пен кәдімгі серверлерден тұратын үш жүз нысан басқа себеп болмаса, мұндай жинақты сирек ақтайды.
Prometheus конфигурациясы YAML ішінде сақталады деген себеппен ғана оны таңдамаңыз. Git ішіндегі файл өздігінен сапалы болмайды. Рецензиялау, синтаксисті тексеру, ережелерді сынау және түсінікті шығару тәртібі қажет. Prometheus дабыл ережелерін модульдік сынауға арналған promtool test rules құралын береді. Команда оны қолданса, өзгерістерді қайталау мүмкіндігін алады. Файлдар тікелей серверде түзетілсе, Zabbix формаларымен салыстырғандағы артықшылықтың көбі жоғалады.
Бастапқы баптау қалыптан тыс нысандарға тәуелді
Іске қосу мерзімін мониторинг серверін орнату емес, лайықты шаблоны немесе exporter құралы жоқ нысан түрлерінің саны анықтайды. Екі өнімнің таза орнатылымы жобаның аз ғана бөлігін алады. Негізгі уақыт рұқсаттарға, жауаптылар картасына, интерфейстерді алып тастауға, шектерге, хабарлама бағыттарына және деректер атауы білдіретін мағынаға шынымен сәйкес келетінін тексеруге жұмсалады.
Пилотқа жаңа сервер мен кең тараған коммутаторды ғана емес, қолайсыз құрылғыларды да қосу керек. SNMP жұмысы түсініксіз ескі модельді, баяу арна артындағы торапты, бірнеше диск тобы бар серверді, бір маңызды дерекқорды және өз метрикасы бар қолданбаны алыңыз. Шешім осыларды игерсе, қайталанатын модельдерді жаппай қосу болжамды өтеді.
Әділ салыстыру үшін бірдей реттілікті орындаңыз:
- Әр кластың бір данасын қосып, қолмен жасалған барлық өзгерісті тіркеңіз.
- Бірдей аралықтарды, сақтау мерзімдерін және ең аз пайдалы көрсеткіштер жиынтығын баптаңыз.
- Тораптың жоғалуын, дисктің толуын, жоғары тұрған порттың істен шығуын және дерек келуінің тоқтауын модельдеңіз.
- Екінші нысанды қосу жұмысын басқа әкімшіге тек өз нұсқаулығыңызбен беріңіз.
- Шаблонды немесе ережені жаңартып, өзгерісті қауіпсіз кері қайтаруға болатынын тексеріңіз.
Zabbix жүйесінде өзгертілген шаблондарды экспорттап, жергілікті макростардың сипаттамасымен бірге сақтаған жөн. Әйтпесе маңызды шешімдер тек дерекқорда және автордың жадында қалады. Prometheus жүйесінде сұрау конфигурациясын, ережелерді, Alertmanager конфигурациясын, SNMP генераторын және сынақтарды бірге сақтаңыз. Бір репозиторий бір процесс дегенді білдірмейді: бұл файлдардың тексеру және қайта жүктеу тәсілдері әртүрлі.
Жұмысты шерту саны немесе YAML жолдарының санымен салыстырмаңыз. Әкімші жаңа құрылғы түрін қосқанда қанша түрлі артефакт өзгертетінін, қате қайда тексерілетінін және кері қайтару қалай жасалатынын жазыңыз. Zabbix күрделілігі көбіне шаблондардың мұрагерлігінде, макростарда және прототиптерде жасырылады. Prometheus күрделілігі relabeling, белгілер, exporter және бағыттарда көрінеді. Команда оны басқара алса, көрінетін күрделілік жасырын күрделіліктен қауіпсіздеу.
Zabbix хабарламалары ыңғайлы, Alertmanager икемдірек
Zabbix алынған мәннен кезекшіге жететін хабарламаға дейінгі тұтас тізбекті тезірек береді. Элемент көрсеткішті сақтайды, триггер күйді есептейді, әрекет алушы мен арнаны таңдайды, ал эскалация қадамдары хабарламаны қайталайды немесе басқа топқа береді. Жеткізу арналарына электрондық пошта, SMS, скрипт және webhook кіреді. Мұның бәрі бір интерфейсте бапталып, сол жерде көрінеді.
Prometheus икемділікті дабыл ережелері мен Alertmanager арасында бөледі. Prometheus өрнекті есептейді, қажет болса күйді for арқылы ұстап, оқиғаны Alertmanager жүйесіне жібереді. Ол оқиғаларды топтайды, қайталанғанын алып тастайды, басу ережесін қолданады, бағыттар ағашының тармағы мен алушыны таңдайды. team, service, site және severity сияқты белгілер жинау, ереже және жеткізу арасындағы келісімге айналады.
Қағаз жүзінде Alertmanager бағыттар ағашы көптеген бөлек әрекеттен таза көрінеді. Іс жүзінде ол белгілерді атауда тәртіп талап етеді. Бір ереже site=almaty, екіншісі location=almaty қойып, ал бағыт region күтсе, хабарламалар түбірлік алушыға кетеді. Синтаксис тексеруден өтеді, бірақ ұйымдастырушылық қате қалады. Сондықтан PromQL сұрауын ғана емес, әр бағыт тармағына арналған оқиға мысалдарын да тексеріңіз.
Желідегі әдеттегі ақау айырмашылықты анық көрсетеді. Магистральдық коммутатор жоғалады, артынан ондаған сервер, қатынау нүктесі және үздіксіз қуат көзі қолжетімсіз болады. Тәуелділіктер болмаса, Zabbix әр нысан үшін бөлек мәселе жасайды. Кезекші бастапқы себепті көруі үшін триггер тәуелділіктерін, сервис байланыстарын немесе корреляцияны алдын ала орнату қажет. Prometheus жүйесінде барлық нысан up=0 алады, кейін Alertmanager хабарламаларды алаң бойынша топтап, желілік торап дабылы белсенді кезде бағынысты дабылдарды баса алады. Бірақ бастапқы ереже мен бағынысты оқиғалардың белгілері сәйкес болғанда ғана басу жұмыс істейді.
Alertmanager ресми құжаттамасы group_wait параметрін бөлек түсіндіреді: қысқа күту бірінші хабарламаны тез жібереді, бірақ топ толық болмауы және басушы дабыл уақытында келмеуі мүмкін. Ұзақ күту корреляцияға уақыт береді, алайда сигналды кешіктіреді. Бұл параметрді басқа біреудің мысалынан көшіре салуға болмайды. Байланыстың үзілуі мен дисктің толуы әртүрлі кідіріске шыдайды.
Хабарламаларды бір жүйелік әкімші интерфейс арқылы баптаса, Zabbix қызмет көрсетуге ыңғайлырақ. Ережелер қолданба командаларына тиесілі болып, тексеруден өтіп, ортақ белгі жүйесін қолданса, Alertmanager икемдірек. Екі өнім де нашар шектерді өздігінен түземейді. Дабыл әрекет талап етуі, жауаптысы болуы және нені тексеру керегін түсіндіруі тиіс. Басқа сигналдарды панельде қалдырған дұрыс.
Әкімші біліктілігі жалпы шығынды өзгертеді
Zabbix бастапқы кедергіні азайтады, бірақ инженерлік білімнің орнын баспайды. Әкімші Linux, желі, SNMP, дерекқор, сұрау кезегі, кэш, сервер процестері және шаблондар мұрагерлігін түсінуі керек. Графикалық интерфейс нысанды тауып, қатені көруге көмектеседі, бірақ тәуелді элементтері мен JavaScript арқылы алдын ала өңдеуі бар күрделі шаблон мұқият жөндеуді талап етеді.
Prometheus үшін Linux, HTTP, уақыттық қатар моделі, PromQL, YAML, service discovery, relabeling және exporter қызметін жүргізу білімі керек. Сенімді хабарламалар үшін Alertmanager, хабарлама шаблондары және басу ережелері қосылады. Деректер қашықтағы сақтау орнына жіберілсе, команда сыйымдылығы мен ақаулары бөлек тағы бір ортаны алады. Мұндай жинақ SRE немесе платформа командасына сәйкес келеді, бірақ желі, есептік жазбалар және резервтік көшірумен де айналысатын кең бейінді әкімшіге артық жүк түсіреді.
Айырмашылық кезекшілікті тапсыру кезінде байқалады. Zabbix жүйесінде жаңа қызметкер интерфейс арқылы хосттан соңғы мәнге, триггерге және әрекетке өте алады. Prometheus жүйесінде ол нысанды service discovery, exporter, белгілер, ереже сұрауы және бағыттар ағашы арқылы бақылауы керек. Бұл жолды жақсы құжаттауға болады, бірақ оны шынымен жазу қажет. «Бәрі Git ішінде» деген түсініктеме relabeling неліктен белгіні алып тастайтынын немесе SNMP модулін қай генератор жасағанын түсіндірмейді.
Бір маманға тәуелділікті бағалаңыз. Екінші әкімшіден ешқандай ишарасыз құрылғы моделін қосуды, бір алаң үшін ғана шекті өзгертуді, қызмет көрсетуді жоспарлауды және жоғалған хабарламаны түсіндіруді сұраңыз. Жұмыс түсініксіз командаға немесе экранға келгенде тоқтаса, пайдалану тәуекелін таптыңыз. Бұл жерде өнім таңдаудан гөрі нұсқаулық пен қол жеткізу құқығын түзету маңыздырақ.
Жаңартулардың сипаты да бөлек. Zabbix жүйесінде серверді, интерфейсті, дерекқор схемасын, proxy және агенттерді үйлесімділік матрицасына сай келісіп жаңарту керек. Prometheus жинағында бөлек орындалатын файлдарды тәуелсіз жаңартуға болады, есесіне әр компонент үшін конфигурация үйлесімділігі мен интеграция әрекетін тексеру қажет. Біртұтас өнімде қозғалатын бөлік аз, компоненттер жинағы бір жаңартудың аумағын кішірейтеді. Ешқайсысы оңайлықты тегін бермейді.
Мониторингке арналған бөлек командасы жоқ ұйымда мен қызмет көрсетуді негізгі өлшем деп санаймын. Жүйе авторы демалысқа кеткенде, мердігер ауысқанда және жабдық моделі жаңарғанда да жұмыс істеуі керек. Қазіргі команда PromQL тілін еркін оқып, exporter құралдарын бұрыннан жүргізсе, Prometheus бөтен дағды қоспайды. Мұндай дағды жоқ болса, бағдарламаның лицензиясы тегін болған күннің өзінде оқыту шығынның бір бөлігіне айналады.
Сақтау орны брендке емес, дерекке сай есептеледі
300 құрылғы үшін көрсеткіштер жиынтығы ұқыпты таңдалса, екі жүйе де дұрыс өлшемдегі бір серверге сыяды, бірақ пилотсыз нақты көлем айтуға болмайды. Zabbix тарих пен трендтерді реляциялық дерекқорға жазады, ал өнімділік секундына келетін жаңа мәндерге, дерек түрлеріне, housekeeping жұмысына, кестелерді бөлуге және кэш баптауына тәуелді. Prometheus уақыттық қатарларды жергілікті TSDB ішінде сақтайды, ондағы көлем қатар санына, аралыққа, белгілер өзгерісіне және сақтау мерзіміне байланысты.
Prometheus ресми құжаттамасы жергілікті сақтау орны бір тораптың масштабталуы және беріктігімен шектелетінін ескертеді. Бұл 300 нысан үшін бірден таратылған жүйе қажет деген сөз емес. Алдымен уақыт немесе көлем бойынша сақтау мерзімін баптап, Prometheus жүйесінің өзін бақылаңыз және конфигурацияның резервтік көшірмесін жасаңыз. Ұзақ тарих, бірнеше дананың ортақ сақтау орны немесе қолжетімділікке ерекше талап үшін remote write және үйлесімді сыртқы сақтау орнын қарастыруға болады, бірақ ол пайдалану жұмысын көбейтеді.
Команда ауыр шаблондарды қосып, егжей-тегжейлі тарихты ұзақ сақтағанда, Zabbix дерекқоры көбіне алғашқы мәселеге айналады. Трендтер сандық деректердің біріктірілген мәндерін сақтап, ұзақ кезеңді арзанырақ қарауға көмектеседі, бірақ кез келген зерттеуде бастапқы мәндердің орнын баспайды. Тарих мерзімін дерек класына қарай белгілеңіз: порт күйі мен интерфейс жүктемесіне әртүрлі тереңдік қажет болуы мүмкін.
Өсуді пилотта нақты өлшеңіз. Анықтау тұрақтанғаннан кейін бірнеше күн бойы бір уақытта дерек көлемін жазып, белсенді элементтер немесе қатарлар санын белгілеңіз және күрт секірулерді іздеңіз. Prometheus жүйесінде TSDB ішкі метрикаларына сұрау қатар санын және үлгілердің қосылу жылдамдығын көрсетеді. Zabbix жүйесінде ішкі элементтер мен кезек poller және өңдеушілер мәндерді уақытында қабылдап жатқанын көрсетеді. Жалпы CPU пайызы мұның ешқайсысын түсіндірмейді.
Жоғары қолжетімділікті ерте күрделендіруге сылтау етпеңіз. Алдымен тарихтың қандай жоғалуына және хабарламасыз қанша уақытқа жол берілетінін анықтаңыз. Конфигурацияның резервтік көшірмесі метриканы сақтамайды, ал дерекқор репликасы webhook жеткізілуін тексермейді. Мониторинг жүйесіне бөлек ақау сынағы керек: негізгі процесті тоқтатып, ауысуды растаңыз және кезекші екі тораптан екі көшірме емес, бір түсінікті хабарлама алғанын тексеріңіз.
Желідегі орналасу интерфейстен маңыздырақ
Zabbix proxy қашықтағы алаңда дерек жинап, оны орталық серверге жіберудің түсінікті жолын береді. Proxy жергілікті нысандарды сұрайды, байланыс үзілгенде мәндерді буферге жинайды және сегменттер арасындағы рұқсат етілген ағындар санын азайтады. Филиалдар мен оқшауланған аймақтар үшін бұл панель ыңғайлылығынан жиі маңыздырақ.
Prometheus әдетте нысандарға жақын орналастырылады немесе оған аймақ шекарасы арқылы HTTP нүктелерін сұрауға рұқсат беріледі. snmp_exporter құралын бірнеше орталық машинаға орнатуға болады, оның құжаттамасы бұл компонентті SNMP үшін proxy тәрізді деп тікелей сипаттайды. Бірақ кәдімгі exporter HTTP жариялайды, сондықтан тыңдау мекенжайларын, желіаралық экрандарды, TLS және аутентификацияны ойластыру қажет. Қызметтік нүктелерді әдепкі күйде пайдаланушы желісіне ашпаңыз.
SNMP үшін де бөлек қауіп моделі қажет. v1 және v2c нұсқалары community жолын шифрламайды, ал v3 аутентификация мен құпиялылықты қолдайды. Тек оқуға арналған есептік жазба жасап, жабдықта дереккөз мекенжайларын шектеңіз және құпияларды жалпыға қолжетімді конфигурациядан тыс сақтаңыз. snmp_exporter құжаттамасы кеңейту жалаушасы қосылғанда пайдаланушы атын, парольді және шифрлау паролін орта айнымалыларынан алуға мүмкіндік береді. Бұл репозиторийдегі ашық мәтіннен жақсы, бірақ құпия процесс ішіне бәрібір қауіпсіз жетуі керек.
Агент арқылы қол жеткізу де ашық портпен шектелмейді. Байланысты кім бастайтынын, тараптар қалай тексерілетінін, қандай командаларға рұқсат барын және мониторинг сервері бұзылса не болатынын анықтаңыз. Орталық жүйе бүкіл паркті дерлік көреді және есептік деректерді сақтайды, сондықтан оның әкімшілік интерфейсі, резервтік көшірмелері мен журналдары кәдімгі панельге қарағанда қатаң қол жеткізуді талап етеді.
Орнату алдында ағындарды сызыңыз: сервер немесе proxy құрылғысынан SNMP-ге, Prometheus жүйесінен exporter-ге, агенттен серверге, жүйеден поштаға немесе webhook-ке дейін. Порттарды, бағытты, шифрлауды, ереже иесін және WAN жоғалғандағы әрекетті көрсетіңіз. Мұндай сызба пилот басталмай тұрып бір нұсқаны алып тастауы мүмкін. Саясат филиалдарды орталықтан HTTP арқылы сұрауға рұқсат бермесе, команда қалауына қарамастан жинауды нысандарға жақын орналастыру керек.
Гибридті әртүрлі дерек иелері ғана ақтайды
Zabbix пен Prometheus жүйесін бірге қолдану олардың міндеттері бөлек және әрқайсысының иесі бар кезде орынды. Zabbix желіні, аппараттық бөлікті, филиалдардың қолжетімділігін және кәдімгі серверлерді бақылай алады. Prometheus әзірлеушілер немесе SRE басқаратын қолданбалық метрика мен контейнерлік платформа көрсеткіштерін жинайды.
Нашар гибрид бірдей CPU, жад және қолжетімділікті екі жүйеде де «керек болып қалар» деп жинайды. Ол агенттерді, ережелерді, панельдерді және хабарламаларды екі еселейді, ал дерек сәйкес келмесе, дұрыс дереккөз туралы дау басталады. Жауапкершілікті жазбаша бөліңіз: торап бойынша дабылды қай өнім жасайды, ұзақ тарих қайда сақталады және белгілер не шаблон сапасына кім жауап береді.
Интеграция бір жүйені екіншісінің ретсіз тасымалдаушысына айналдырмауы тиіс. Zabbix Prometheus деректерін алып, оларды тәуелді элементтерге бөле алады, ал Prometheus лайықты exporter құралдарынан метрика қабылдайды, бірақ әр көрсеткішті көшіру бастапқы модельдің артықшылығын жояды. Тек ортақ кезекшілік бағыты немесе ортақ сервис көрінісі қажет сигналдарды беріңіз.
Гибридке резервтік көшірудің, жаңартудың және хабарламаларды тексерудің екі жинағы керек. Ұйымда бір әкімші болса, бұл оған қарсы күшті дәлел. Желі мен платформаны өзгеріс кезеңдері әртүрлі бөлек командалар басқарса, бөлек құралдар қақтығысты азайта алады. Шекара технология сәніне емес, адамдардың жауапкершілігіне сәйкес келуі керек.
Кәдімгі 300 құрылғы үшін Zabbix басым
Шағын инфрақұрылым командасы басқаратын желілік жабдық пен серверлер паркі үшін мен Zabbix таңдар едім. Ол бірнеше сервисті құрастырмай-ақ SNMP, агент деректерін, анықтауды, триггерлерді және хабарлама жеткізуді тез қамтиды. Кері қатынаста Prometheus таңдар едім: кәдімгі SNMP аз, қолданбалар мен контейнерлер көп, exporter дайын, Git процесі бар және қызметкерлер PromQL тілін сенімді жазады.
Шешім логикасы қарапайым:
- Коммутатор, үздіксіз қуат көзі және әртүрлі сервер көп болса, Zabbix таңдаңыз: ортақ хост моделі, кіріктірілген SNMP және шаблондар құрастыру жұмысын азайтады.
- Қолданба метрикасы мен динамикалық нысандар басым болса, Prometheus таңдаңыз: белгілер, PromQL және service discovery міндетке сай келеді.
- Хабарламаларды әкімші интерфейс арқылы басқарса, Zabbix триггерлерді, әрекеттерді, арналарды және эскалацияны бір жерде ұстайды.
- Ережелер командаларға тиесілі болып, тексеруден өтсе, Prometheus ережелер мен бағыттарды конфигурация ретінде тексеруге мүмкіндік береді.
- WAN желісінсіз ұзақ жұмыс істейтін филиалдар үшін Zabbix proxy штаттық жергілікті жинау мен буферлеуді береді.
Лицензия бағасы мәселені шешпейді, себебі екі нұсқаны да бағдарламалық кодтың өзі үшін төлемсіз бастауға болады. Жаңа құрылғы түріне, жоғалған деректерді зерттеуге, компоненттерді жаңартуға және екінші әкімшіні оқытуға кететін уақытты есептеңіз. Бір жылдан кейін шығынды осы жұмыстар қалыптастырады.
Ұйым серверлік инфрақұрылымын да жаңартып жатса, GSE.kz мониторинг таңдауын бір өндірушіге байламай, лайықты серверлік және деректер орталығы инфрақұрылымын жобалап, біріктіре алады. Шешімді бәрібір өз пилотыңыздың нәтижесімен қабылдаңыз, себебі коммутатор моделі, сегменттеу саясаты және ауысым дағдысы кез келген жалпы кестеден дәлірек.
Пилотты жоғары тұрған портты әдейі өшіріп, жұмысты басқа әкімшіге тапсырумен аяқтаңыз. Ол бастапқы себепті табатын, бір пайдалы хабарлама алатын және автор жанында болмаса да конфигурацияны түсіндіре алатын жүйені таңдаңыз. Аралас парк үшін бұл көбіне Zabbix болады; дайын метрикасы және жетілген SRE тәжірибесі бар платформада нәтиже басқаша болуы мүмкін.
FAQ
Zabbix 300 құрылғыға жарай ма?
Иә, көрсеткіштер жиынтығын шектеп, аралықтарды баптап, дерекқорды нақты мәндер ағынымен тексеру керек. Мұндай паркте хост санынан гөрі элементтер мен анықталған интерфейстер саны маңызды.
Prometheus желілік жабдық мониторингіне жарай ма?
Иә, әдетте snmp_exporter және if_mib модулі арқылы қолданылады. Өндірушіге тән OID үшін MIB, конфигурация генераторы, белгілер және өз дабыл ережелеріңіз қажет.
Zabbix пен Prometheus жүйесінің қайсысын басынан баптау оңай?
Серверлер мен желілік құрылғылар аралас паркте Zabbix әдетте оңай, себебі жинау, шаблондар, оқиғалар мен хабарламалар бір өнімде орналасқан. Exporter және конфигурацияны шығару процесі дайын ортада Prometheus оңайырақ.
Мониторингке бөлек әкімші алмай жұмыс істеуге бола ма?
Иә, пайдалы тексерулердің шағын жиынтығын таңдап, нысан қосу, жаңарту және дабылды талдау нұсқаулығын жазу керек. Иесі жоқ бірнеше компоненттен құралған жинақ сенімділігін тез жоғалтады.
Қай өнім SNMP арқылы жақсы жұмыс істейді?
Zabbix кіріктірілген элемент түрі, шаблондар және төмен деңгейлі анықтау арқылы қысқа жол береді. Prometheus snmp_exporter арқылы жақсы белгі моделін ұсынады, бірақ қалыптан тыс MIB үшін көбірек дайындық қажет.
Хабарламаларды қайда икемдірек баптауға болады?
Тәртіпті конфигурациясы бар ортада Alertmanager белгілер бойынша бағыттау, топтау және басу жағынан икемдірек. Бір әкімші триггерлерді, әрекеттерді, арналарды және эскалацияны ортақ интерфейсте жүргізсе, Zabbix ыңғайлырақ.
Zabbix agent әр серверге орнатылуы керек пе?
Жоқ, Zabbix бірнеше жинау тәсілін қолдайды, бірақ агент операциялық жүйенің егжей-тегжейлі әрі басқарылатын көрсеткіштерін береді. Шешім қауіпсіздік саясаты мен қажетті дерекке байланысты.
Prometheus үшін әр құрылғыға exporter керек пе?
Әр нысанға бөлек процесс міндетті емес. node_exporter әдетте сервердің өзінде жұмыс істейді, ал snmp_exporter бір данасы көп желілік құрылғыны сұрай алады.
Zabbix пен Prometheus жүйесін бірге іске қосқан дұрыс па?
Желі мен қолданбалық платформаның иелері бөлек және сигналдары анық бөлінген болса, дұрыс. Бір тексеру мен хабарламаны екі жүйеде қайталамаңыз.
Таңдау алдында әділ пилотты қалай өткізу керек?
Қолайсыз құрылғы модельдерін, бірдей аралықтарды және магистральдық порттың жоғалуын қамтитын ортақ ақаулар жиынтығын алыңыз. Содан кейін екінші әкімшіден конфигурация авторының көмегінсіз нысан қосып, хабарлама бағытын түсіндіруді сұраңыз.