Standaryzacja logów - nudne rzeczy, które trzeba ustalić
“Moim faworytem była firma z 15 poziomami logów. Piętnaście.” Szymon opisuje chaos w organizacjach: zespoły szukają logów w czterech różnych miejscach, Elastic pożera budżety, a deweloperzy dodają logi “na czuja” bez strategii. A Łukasz doprecyzowuje problem: “Logi mają wredną tendencję - tylko je dodajemy, nigdy nie usuwamy.” Popularne “rozwiązania”? Sampling? “Zawsze będzie złem, bo odsampluje to, czego właśnie potrzebujecie.” Stdout jako standard? “Absolutne zło i ostateczność.” A wewnętrzne dyskusje o nazewnictwie? “Jeżeli macie dyskusję w firmie jak coś nazwać, oznacza to, że pierdolnik będzie kontynuowany.” Jak z tego wyjść? Rozwiązanie zaczyna się od fundamentów: structured logging w JSON, Open Telemetry jako standard (koniec kłótni o “fatal” vs “critical”), Open Telemetry Collector do wzbogacania i filtrowania. Plus dokument definiujący pola, retencja zamiast samplingu, tenanty zamiast jednego indeksu, budżety zamiast bezładnego logowania wszystkiego. Czy twoja organizacja tonie w logach, których nikt nie umie czytać? Sprawdź, zanim ktoś doda szesnasty poziom logowania. ⚠️ A teraz nie ma co się obijać! 👉 Wpadajcie na naszego Discorda: https://discord.gg/78zPcEaP22 ! 🔥Tam możecie się z nami pokłócić o przyspieszanie SQL-a, podyskutować o naiwnych nadziejach na AI albo po prostu podzielić się swoimi IT-owymi przemyśleniami. Słuchasz Patoarchitektów dzięki PROTOPII – firmie, w której Łukasz i Szymon działają na co dzień, wspierając zespoły IT na każdym etapie: od projektowania, przez wdrożenia i migracje, aż po optymalizację i zabezpieczenia. Oferujemy też mentoring i szkolenia dostosowane do potrzeb każdej firmy, niezależnie od wielkości. Sprawdź nas: 👉 protopia.tech - Nasze sociale i linki - Materiały do odcinka - Pato szkolenia
Dobrze, to tyle z parafialek, tak naprawdę. To lecimy. O czym dzisiaj? Dzisiaj, Szymonie, chcę cię przepytać z logów, bo pojawiło się gdzieś tam na zaprzyjaźnionym Discordzie pytanie też tam i dyskusje o logi. Nie oszukujmy się, to co widzimy, to twoja działka najczęściej, no to widzisz bałagan z nimi. Jaki jest główny problem z logami? Główny problem z logami to są właśnie dwa problemy. Pierwsze to jest to, że jest ich za dużo i po prostu organizacja zaczyna tonąć od ilości, od kosztów ich utrzymania. Elastik, elastik szczególnie, z tym nie oszukujmy się, bo to jest ten główny element. Drugi element to jest to, że okej, mamy logi i właściwie nie umiemy z nich korzystać, jak naprawdę. To jest szukanie, przepraszam za wrażenie, ale dosłownie napałem, byle coś znaleźć.
Koniec kropka. Tak, czyli jakieś szczegółowe i włączane on-demand raczej. Niż... Dla mnie to jest problem, że dla mnie to jest stara szkoła, że domyślnie trace debug jest włączany, kiedy jest potrzebny, albo jest składowany króciutko. O właśnie, do tego tu idziemy, bo na naszym Discordzie była uwaga, że nie poruszyliśmy tematu samplingu. Nie róbcie samplingu. Logujcie, tylko miejcie krótszą retencję. Sampling zawsze będzie złem, bo wam odsampluje to, co właśnie potrzebujecie i sampling jest trudny. I realnie jest praktycznie niedokonane, że to miało ręce i nogi. A jak macie awarię, to potrzebujecie mieć wszystkiego praktycznie, więc dawajcie bardzo krótką atencję.
Pokazano wszystkie 2 dopasowania. Transkrypcja generowana automatycznie i niesprawdzana ręcznie — może zawierać błędy.
Kliknij, aby znaleźć fragmenty, w których pada.