Sobes.tech
Middle+
223

Kuidas teete serveri tõrkeotsingut kõrge koormuse korral? Milliseid näitajaid analüüsite ja milliseid utiliite kasutate?

Vastus AI-lt

sobes.tech AI

Alustan süsteemimõõdikute analüüsist, et tuvastada kõrge koormuse põhjused.

Peamised näitajad analüüsiks:

  • load average: keskmine protsesside arv, mis ootavad täitmist. Kõrge väärtus näitab CPU ülekoormust või sisend-väljund ootamist.
  • CPU utilization: protsessori kasutusprotsent. Aitab mõista, kui suur osa CPU-st on hõivatud kasutaja-, süsteemi- või tühikäiguprotsessidega.
  • Memory utilization: operatiivmälu kasutus. Kõrge kasutus võib põhjustada aktiivset vahetamist, mis oluliselt vähendab jõudlust.
  • Disk I/O: lugemis-/kirjutusoperatsioonide intensiivsus kettaseadmetel. Kõrge aktiivsus võib olla kitsaskoht.
  • Network activity: väljaminev ja sissetulev liiklus, võrguliikluse ühenduste arv. Kõrge koormus võib olla seotud võrguprobleemide või DoS-rünnakuga.
  • Process list: käivitatud protsesside nimekiri, nende ressursside kasutus, seisund. Aitab tuvastada konkreetset protsessi, mis koormust tekitab.

Diagnostikavahendid:

  • top / htop: interaktiivne süsteemi ressursside ja protsesside jälgimine reaalajas. Võimaldab sorteerida protsesse CPU, mälu jms kasutamise järgi.

    # top -c // kogu käsklusrida kuvamine
    
  • vmstat: virtuaalmälu, protsesside, CPU ja sisend-väljundaktiivsuse aruanne.

    # vmstat 1 // kuvab iga sekundi
    
  • iostat: ketta seadmete aktiivsuse ja jõudluse jälgimine.

    # iostat -xz 1 // laiendatud ketta ja CPU väljund, iga sekundi
    
  • netstat / ss: võrguliikluse, marsruutide, võrguliidese statistika teave.

    # netstat -tunapl // TCP/UDP ühendused, kuulavad soketid, pordid, PID
    # ss -tunapl
    
  • sar: süsteemi aktiivsuse kogumine, aruandlus ja analüüs (CPU, mälu, ketas, võrk). Kasutatakse sageli ajaloolise jõudluse analüüsiks.

    # sar -u 5 5 // CPU iga 5 sekundi järel, 5 korda
    # sar -d 5 5 // Ketas iga 5 sekundi järel, 5 korda
    # sar -n DEV 5 5 // Võrk iga 5 sekundi järel, 5 korda
    
  • iftop / nethogs: interaktiivne võrguliikluse jälgimine liideste või protsesside kaupa.

    # iftop -i eth0 // jälgimine eth0 liidesel
    # nethogs eth0 // liikluse jälgimine protsesside kaupa eth0-l
    
  • dstat: universaalne utiliit, mis ühendab vmstat, iostat, netstat võimalused.

    # dstat -c -m -d -n // CPU, mälu, ketas, võrk
    
  • strace / lsof: süsteemikutsumiste jälgimine ja avatud failide nimekiri konkreetse protsessi jaoks. Kasulik sügavamaks analüüsiks.

    # strace -p <PID> // jälgimine PID järgi
    # lsof -p <PID> // avatud failid PID järgi
    

Protseduur on iteratiivne: tuvastan kitsaskohad metrikate põhjal, kasutan sobivat tööriista detailsemaks analüüsiks, uurin põhjust (näiteks konkreetset protsessi), võtan korrektsed meetmed (näiteks taaskäivitamine või rakenduse optimeerimine, ressursside suurendamine). Samuti on oluline kontrollida rakenduste ja süsteemi logisid (journalctl, /var/log/*).