Почему 14% строк в ваших логах — мусор
Разбираем 4,2 млн строк из production-кластера: сколько записей не прошли валидацию, почему и что с ними делать до агрегации.
Читать · 7 мин →Журнал · v3.2 · 27 постов
Разбираем, как превращать сырые массивы в проверяемые выводы. Каждый материал подписан автором, ссылающийся на конкретные данные и метод, а не на «ощущения».
Последние посты
Три материала, опубликованные на этой неделе. Короткие, конкретные, с исходными данными и воспроизводимыми расчётами.
Разбираем 4,2 млн строк из production-кластера: сколько записей не прошли валидацию, почему и что с ними делать до агрегации.
Читать · 7 мин →Детерминированный подход к выбору порога отклонения. Пример на транзакциях e-commerce: от сырого ряда до взвешенного алерта за 90 секунд.
Читать · 11 мин →Три типичных приёма «украшения» осей: отрезанный нуль, скользящее среднее без погрешности и двойная шкала. Разбираем на реальных дашбордах.
Читать · 8 мин →Категории
Шесть направлений. Каждое ведёт к конкретному разделу архива с количеством материалов и датой последнего обновления.
Схемы, очистка, дедупликация. Как подготовить сырой массив к расчётам без потери значимых записей.
Статистические пороги, правила, ранжирование отклонений по влиянию на ключевые метрики.
Как рисовать графики, которые не преувеличивают. Оси, погрешность, источник данных — рядом с каждой цифрой.
Скользящие окна, группировки, погрешность среднего. Практические формулы без «примерно».
Подключение логов, транзакций, CRM и IoT. Какие форматы поддерживаются и как их сопоставить.
Разборы реальных задач клиентов: от сырого массива до финального отчёта. С цифрами и сроками.
Архив
27 публикаций за 2024–2025 годы. Ищите по названию, теме, автору или году. Результаты обновляются мгновенно.
Популярное
Пять материалов за последние 30 дней. Считаем не клики, а завершённые чтения — если читатель дошёл до конца, материал засчитан.
Полный разбор конвейера: от подключения источника до финального отчёта. С примерами на production-данных.
Читать · 14 мин →Разбираем, как среднее скрывает хвосты распределения. Альтернативы: медиана, квантиль, взвешенное среднее.
Читать · 9 мин →Семь правил, которые мы применяем к каждому отчёту Regexly. Почему мы убираем 80% виджетов из типового BI.
Читать · 11 мин →Рассылка
Каждую среду отправляем один материал и один разбор данных. Без «вау-цифр» и без пересыла чужих статей. Отписаться можно в один клик.
Авторы
Каждый материал подписан конкретным человеком. Ниже — пять постоянных авторов с их специализацией и контактами.
Ведущий аналитик. Пишет про нормализацию, валидацию и схемы данных. До Regexly — 8 лет в финтехе, специализация — транзакционные потоки.
12 постов · @akovalev →Старший инженер. Пишет про детекцию аномалий и статистические пороги. Автор 6 статей в журнале, включая разбор метода взвешенных отклонений.
6 постов · @mretin →Дизайнер данных. Пишет про честную визуализацию и оформление отчётов. До Regexly — 6 лет в BI-команде, специализация — осевые шкалы и погрешность.
5 постов · @isaveliev →Журнал · архив · 2024–2025
Напишите, что хотели бы разобрать — мы берём в работу материалы по запросу читателей. Последний выпуск рассылки вышел 02.06.2025.
Редакция: journal@regexly.app · публикуем каждую среду в 09:00 МСК