← Back
platform

Plattformoppdatering — presis varsling og e-postdomener

Denne runden handler om å gjøre varslingen troverdig og saksinntaket bredere. Ingenting av det endrer hvordan Ethica brukes til daglig — det endrer hvor mye du kan stole på det du får beskjed om.

Et varsel skal bety at noe er galt

Overvåkingen åpnet en hendelse på hver eneste feilende måling. Agentene pusher omtrent én gang i minuttet, og et enkelt tapt datapunkt var nok: sak opprettet, kritisk alvorlighetsgrad, og lukket igjen av neste push et minutt senere.

Resultatet var ikke følsom overvåking, det var støy. 1797 av 1855 saker kom fra én enkelt blaffende måling, med en median «nedetid» på 33 sekunder. Den virkelige kostnaden var ikke rotet: det var at et system som faktisk var nede lå begravd under 1844 rader og hadde gjort det i ukevis.

Nå må en tilstand vedvare før den blir et varsel. offline_since holder klokka fra første feilende måling, og alarmen utløses først når den har stått i ALERT_GRACE_SECONDS — 180 som standard, justerbart via miljøvariabel. Samme prinsipp som for:-klausulen i Prometheus: varsle på en tilstand som holdt seg, ikke på én dårlig avlesning.

Målt mot hele den registrerte historikken stopper det 1763 av 1789 alarmer og beholder alle 26 som varte lenger enn tre minutter, inkludert de tre som varte over ti. Ingenting som varer forsvinner. En operatør som setter status manuelt går utenom vinduet — et bevisst klikk er en beslutning, ikke en støyende måling.

Varselet sier hvilken maskin

Seks deployments het CPU, seks het Memory, seks het Disk / — én per agent. «Incident: CPU offline» kunne dermed bety seks forskjellige verter. Feltet agent_group lå i databasen, men ble aldri lest ut i varselet. Nå står maskinen i tittelen, i alarmmeldingen, i e-postemnet og i push-varselet: Mail Server — CPU.

Alvorlighetsgrad følger nå type. Vertsmålinger (kind=system) gir alarm og statusendring, men ingen sak, ingen e-post og ingen push — en CPU-topp er noe å se på, ikke arbeid som skal tildeles. Containere, domener og repoer åpner kritiske hendelser som før. Tidligere var alt critical, noe som gjorde ordet meningsløst.

Alarmoversikten viser det som brenner

Siden listet hver alarm som noen gang hadde utløst, og tegnet dem alle ved hvert sidevisning. Standardvisningen er nå åpne og kvitterte alarmer; avsluttede ligger under Historikk, med bulk-opprydding og sletting av enkeltalarmer. En alarm som fortsatt brenner kan ikke slettes — den må kvitteres eller løses først, ellers skjuler man et levende problem i stedet for å avslutte det. Saker overlever alarmen sin: hendelsen er dokumentasjonen på arbeidet, så den beholdes.

E-postdomener på bedriftskunder

Saksinntaket matchet avsenderens fulle adresse mot registrerte kontakter. En ansatt som aldri hadde skrevet inn før ble forkastet stille — ingen sak, intet autosvar, ingen loggføring.

Et firma kan nå ha egne e-postdomener, skrevet som *@ltd.no, *@ltd2.no. Oppføringene normaliseres, så *@ltd.no, ltd.no, @LTD.NO og en full URL ender likt. Ukjente avsendere fra et registrert domene adopteres: det opprettes en kontakt, slik at neste melding treffer eksakt og personen dukker opp i CRM-en.

Gratis e-postleverandører avvises — gmail.com som firmadomene ville rutet hver privatperson på jorda inn i én kundes sakskø. Sperren står både der domenet skrives inn og i inntaket; en rutingregel med den sprengkraften bør ikke hvile på én sjekk. Domener er unike på tvers av kunder, siden to firma som hevder samme domene betyr at den ene stille mottar den andres post.

Verdt å si rett ut: avsenderadresser kan forfalskes. Dette ruter, det autentiserer ikke. Det oppretter saker og gir ingen tilgang — portalinnlogging går fortsatt via SSO og eksplisitte brukere.

Nettstedet

Norsk er nå standardspråk, forsiden handler om support og drift framfor komponentbiblioteket, og det finnes en Om-side. Komponentdokumentasjonen er bevisst beholdt på engelsk.

Hver endring gikk gjennom den samme integrasjonssuiten som gater alle releaser — 185 sjekker, grønn fra start til slutt.