Что это простыми словами

Loki — это система, которая собирает и хранит логи со всех серверов компании в одном месте.

Аналогия: представьте, что у вас в компании сотня сотрудников, и каждый ведёт личный дневник событий. Чтобы найти, кто и когда совершил ошибку, вам пришлось бы обойти всех и перечитать их записи. Loki — это общая картотека, куда все дневники стекаются автоматически, и вы можете за секунды найти нужную запись поиском.

В ИТ-мире логи — это автоматические текстовые записи о том, что происходит внутри программы: ошибки, действия пользователей, нагрузка. Когда приложений много и они работают на многих серверах, вручную просматривать логи нереально. Loki решает эту проблему.

Официальное определение

Теперь, когда суть понятна, вот как Loki описывают в вакансиях и документации. Именно такую формулировку вы встретите в резюме DevOps-инженеров и в описании их стека.

«Grafana Loki — горизонтально масштабируемая, высокодоступная мультитенантная система агрегации логов, оптимизированная для хранения и поиска по меткам, а не по полному индексированию содержимого».

Разберём по словам. «Горизонтально масштабируемая» — когда данных становится больше, к системе просто добавляют новые серверы, как добавляют кассы в супермаркете в часы пик. «Высокодоступная» — система работает без остановок, даже если один сервер сломается. «Мультитенантная» — несколько команд или проектов могут хранить логи в одной системе, не видя чужих данных. «Агрегация логов» — сбор журналов из разных источников в одном месте. «Метки» — короткие ярлыки вроде «сервис: оплата» или «среда: продакшн», по которым Loki быстро находит нужные записи.

Какую задачу решает

Представьте: у компании упал сервис оплаты в 3 часа ночи. Нужно понять почему. Если логи разбросаны по десяткам серверов — это часы расследования. Loki собирает все записи в одно место и позволяет найти ошибку за минуты: набрал запрос, указал временной промежуток — и видишь, что именно пошло не так.

Главное преимущество Loki перед конкурентами: он не читает и не индексирует текст внутри каждой записи — только навешивает метки. Это как искать книгу в библиотеке по разделу и автору, а не перечитывать все книги подряд. Поэтому Loki хранит огромные объёмы логов дёшево, не занимая лишнего места.

Кто им пользуется

Loki не привязан к конкретному языку программирования. Его используют инженеры, которые отвечают за работоспособность и инфраструктуру:

  • DevOps-инженер — основной пользователь. Настраивает сбор логов, строит дашборды с алертами, расследует инциденты.

  • SRE-инженер (Site Reliability Engineer — инженер по надёжности) — следит за стабильностью сервисов и активно использует Loki для мониторинга и разбора сбоев.

В резюме Loki почти всегда стоит рядом с Grafana — это инструмент для визуализации данных, через который смотрят логи из Loki. Эти два инструмента работают в паре: Loki хранит, Grafana показывает.

Аналоги / чем заменяется

Loki решает ту же задачу, что и другие системы сбора логов:

  • ELK-стек (Elasticsearch + Logstash + Kibana) — мощный и гибкий, позволяет искать по содержимому логов, но требует значительно больше ресурсов и сложнее в обслуживании.

  • Splunk — платное корпоративное решение с расширенными возможностями аналитики.

  • Graylog — бесплатный аналог, ориентированный на удобный поиск по тексту логов.

Переход между этими системами требует времени: у каждой своя логика запросов, своя настройка агентов сбора. Однако инженер, понимающий, зачем нужна централизованная система логов, разберётся в новом инструменте значительно быстрее новичка.

Что не путать

  • Loki ≠ Grafana. Grafana — это экран, на котором видно данные. Loki — это хранилище, где данные лежат. Они работают вместе, но это разные инструменты с разными задачами.

  • Loki ≠ база данных. Обычная база хранит структурированные данные (таблицы, строки), а Loki заточен именно под текстовые журналы — длинные потоки событий с временными метками.

  • Loki ≠ система мониторинга метрик. Метрики — это цифры (нагрузка на CPU, число запросов в секунду). Логи — это текстовые записи событий. Для метрик чаще используют Prometheus, для логов — Loki. В связке Grafana + Loki + Prometheus всё это видно на одном экране.

  • Loki — не продукт Marvel. Это совпадение в названии. Инструмент разработан компанией Grafana Labs и назван независимо от популярного персонажа.

Насколько это важно при отборе

Для DevOps- и SRE-инженеров работа с логами — обязательный навык. Без умения разбирать логи нельзя расследовать инциденты и поддерживать работоспособность сервисов. Но вот конкретный инструмент — Loki или его аналог — уже менее критичен.

Когда Loki — жёсткое требование: если компания уже использует именно его и ищет человека, который выйдет и сразу начнёт работать. Особенно это важно для больших, сложных инфраструктур, где настройка занимает не день.

Когда требовать Loki конкретно — излишне: если кандидат уверенно работал с ELK-стеком или Graylog, понимает концепцию централизованного логирования и умеет расследовать инциденты — Loki он освоит за одну-две недели. Отсеивать такого специалиста из-за названия инструмента будет ошибкой.

Это общий ориентир. В разных компаниях требования отличаются, поэтому всегда сверяйтесь с текстом конкретной вакансии.