Monitoraggio e ottimizzazione delle performance - init.d
EN

Monitoraggio e ottimizzazione delle performance

Sapere come sta il sistema e intervenire prima del disservizio.

Un sistema che va giù di notte e viene scoperto solo la mattina dopo è un danno evitabile. Il monitoraggio serve esattamente a questo: sapere in ogni momento come stanno risorse e servizi, e avere il tempo di intervenire prima che il problema arrivi agli utenti. A questo affianchiamo l’analisi delle performance, per capire dove il sistema rallenta, e il tuning, per farlo andare più veloce senza comprare hardware a ogni picco di traffico.

Panoramica

Mettiamo occhi sul tuo sistema e li teniamo aperti nel tempo. Raccogliamo metriche su CPU, memoria, disco, rete, latenza applicativa e uptime; le rendiamo leggibili in dashboard chiare e configuriamo alert che avvisano la persona giusta al momento giusto, senza sommergerla di falsi allarmi. In parallelo misuriamo le performance reali - dal TTFB ai tempi di query, fino ai Core Web Vitals lato server - e interveniamo con caching e tuning dove i numeri dicono che conviene.

Lo stack di monitoraggio lo installiamo sulla tua infrastruttura, non su una piattaforma nostra: dashboard, alert e configurazioni restano tuoi, versionati e documentati. L’obiettivo non è riempire schermi di grafici, ma darti tre risposte concrete: il sistema sta bene? dove sta rallentando? cosa conviene sistemare per primo? Con queste risposte in mano i fermi si riducono e gli interventi diventano mirati, invece che gestiti d’emergenza.

Problemi tipici che risolviamo

  • Il sito va giù e lo scopri dai clienti → sonde di uptime esterne e alert immediati via email, chat o telefono.
  • Il server rallenta nelle ore di punta e nessuno sa perché → metriche storiche su CPU, memoria, I/O e query per individuare il collo di bottiglia.
  • Il TTFB è alto e le pagine si trascinano → analisi di web server, PHP e database, poi caching e tuning mirati.
  • Gli alert esistono ma sono così rumorosi che nessuno li legge più → soglie ricalibrate sui valori reali e notifiche solo quando serve davvero.
  • Un certificato scade e il sito mostra un errore di sicurezza → controllo automatico di certificati e scadenze, con preavviso.
  • Il disco si riempie di log fino a bloccare i servizi → alert predittivi sull’occupazione e rotazione configurata a dovere.
  • Il database cresce e le query lente si accumulano → analisi degli slow log, indici mancanti e ottimizzazione delle query peggiori.

Cosa include

  • Monitoraggio metriche: raccolta continua con Prometheus ed exporter dedicati per sistema operativo, web server, database e code.
  • Dashboard leggibili: pannelli Grafana costruiti per capire lo stato a colpo d’occhio, pensati anche per chi non è un sistemista.
  • Controllo uptime: sonde esterne su siti, API e servizi, con verifica di certificati TLS e relative scadenze.
  • Alert calibrati: soglie tarate sui valori reali del tuo sistema e notifiche via email, chat o telefono, senza il rumore dei falsi positivi.
  • Analisi performance: misura di TTFB, tempi di risposta e colli di bottiglia su applicazione, web server e database.
  • Caching e tuning: Redis, Varnish, ottimizzazione di web server, PHP-FPM e query per abbattere i tempi di risposta.
  • Report periodici: un riepilogo leggibile di cosa è successo, cosa abbiamo sistemato e cosa tenere d’occhio.

Stack e tecnologie

Raccogliamo le metriche con Prometheus e i suoi exporter - node_exporter per il sistema, exporter dedicati per MariaDB/MySQL, PostgreSQL, Nginx e le code - le visualizziamo con Grafana e gestiamo le notifiche con Alertmanager. Per l’uptime usiamo sonde esterne, che vedono il servizio come lo vede un utente e non come lo vede il server. Sul fronte performance lavoriamo con Redis per cache applicativa e sessioni, Varnish come cache HTTP davanti al sito, e mettiamo mano alla configurazione di Nginx, PHP-FPM e del database: indici, query lente, buffer e connessioni. Operiamo soprattutto su Debian e Ubuntu (su richiesta AlmaLinux, Rocky Linux, Arch Linux e altre), su server dedicati o su cloud come Google Cloud, AWS e DigitalOcean. Ogni configurazione resta versionata e documentata: sai sempre cosa è stato toccato e perché.

Un esempio d’intervento

Un e-commerce su WooCommerce ci ha contattati per pagine lente nelle ore di punta e due fermi non spiegati nel giro di un mese. Il server non aveva né metriche né alert: si andava a memoria. Abbiamo installato Prometheus e Grafana, e dopo pochi giorni i dati hanno mostrato il quadro: query lente a ogni rigenerazione del catalogo e memoria esaurita nei picchi, con l’OOM killer che spegneva i processi. Abbiamo aggiunto gli indici mancanti, introdotto Redis come object cache, ridimensionato i pool di PHP-FPM e impostato alert su memoria e slow query. Il TTFB nelle ore di punta è sceso in modo misurabile, i fermi non si sono più ripetuti e oggi un alert avvisa prima che la memoria torni a essere un problema.

A chi si rivolge

  • PMI e studi professionali che vogliono dormire tranquilli sapendo che qualcuno tiene d’occhio i sistemi.
  • E-commerce e SaaS che perdono soldi a ogni minuto di down e a ogni pagina lenta.
  • Agenzie e software house che hanno bisogno di un monitoraggio serio dietro i progetti dei clienti.
  • Chi ha già un sistema in produzione ma vola alla cieca, senza metriche né alert.

Come lavoriamo

Partiamo da cosa ti serve davvero sapere: quali servizi sono critici, quali soglie contano, chi va avvisato e quando. Installiamo lo stack sulla tua infrastruttura, calibriamo gli alert nelle prime settimane per eliminare il rumore e ti lasciamo dashboard e configurazioni documentate. Sul fronte performance misuriamo prima di toccare, cambiamo una cosa alla volta e verifichiamo l’effetto con i numeri. La copertura standard è lun-ven 10:00-18:00 con triage per priorità; per le emergenze di notti e weekend esistono piani di reperibilità a canone, a posti limitati. Per la gestione continuativa molti clienti usano i pacchetti ore, che non scadono. Referente unico, report leggibili e niente lock-in: il monitoraggio resta tuo.

Domande frequenti

Che differenza c’è tra monitoraggio e alert?

Il monitoraggio raccoglie metriche nel tempo - CPU, memoria, latenza, uptime - e le rende leggibili in dashboard. Gli alert scattano quando un valore supera una soglia e avvisano la persona giusta, così intervieni prima che il problema diventi un disservizio visibile agli utenti.

Riuscite a migliorare il TTFB e i Core Web Vitals del nostro sito?

Sì, sul lato server. Analizziamo TTFB, tempi di query e di rendering applicativo, poi interveniamo con caching e tuning di web server e database. La componente server dei Core Web Vitals migliora; per la parte front-end collaboriamo con chi cura il codice del sito.

Offrite reperibilità in caso di problemi notturni o nei weekend?

Sì, con un piano di reperibilità a canone mensile e posti limitati, riservato alle vere emergenze P1 sui sistemi che gestiamo noi: presa in carico entro un’ora anche di notte e nei festivi. Non vendiamo SLA gonfiati: prezzi e regole sono scritti nella pagina Reperibilità. Senza piano la copertura è lun-ven 10:00-18:00, e restano possibili i lavori notturni o festivi pianificati con almeno 20 giorni di anticipo.

Il monitoraggio resta vostro o è nostro?

È tuo. Installiamo Prometheus, Grafana e gli exporter sulla tua infrastruttura e ti lasciamo dashboard, alert e configurazioni versionate e documentate. Niente lock-in: se un domani vuoi gestire tutto internamente, hai già ogni cosa in mano.

Quanto costa mettere in piedi il monitoraggio?

La tariffa oraria è unica: 75 €/ora, oppure con pacchetti ore senza scadenza: 5 ore a 350 €, 10 a 660 €, 20 a 1.200 €. Un setup base su un singolo server richiede in genere poche ore. Il preventivo è gratuito, con risposta in giornata lavorativa.

Su quali sistemi e cloud installate lo stack di monitoraggio?

Lavoriamo prevalentemente su Debian e Ubuntu; su richiesta anche AlmaLinux, Rocky Linux, Arch Linux e altre distribuzioni. Sul cloud usiamo soprattutto Google Cloud, con AWS e DigitalOcean in alternativa; Azure, Hetzner e OVH su richiesta. Lo stack funziona anche su server dedicati o VPS già esistenti.

Serve una mano sulla tua infrastruttura?

Raccontaci il problema: rispondiamo con una proposta chiara e un preventivo.

Contattaci →