konfi://блог/методология
блог · открытые данные

Как мы собираем данные и что означают метки.

Разбор показывает, что говорят открытые данные, и отдельно — чего они не показывают. Ниже — как устроен расчёт и что делать, если данных не хватает.

Откуда данные

Источники — открытые: поисковый спрос из Яндекс Wordstat, публичные статистические файлы Банка России и Росстата. Платные выгрузки и клиентские данные в разборы не попадают.

Рядом с каждой таблицей и графиком стоит ссылка на первоисточник, дата обновления источника и дата выгрузки. Тот же список — в разделе «Источники» статьи.

Внутренние файлы проекта — пакет фактов, наблюдения, черновики — читателю не показываются: это расчёт, а не первоисточник.

Что означают метки

Каждое опубликованное число привязано к зафиксированному набору расчётов по сохранённым выгрузкам, поэтому его можно пересчитать и сверить.

Если факта не хватает, место помечается для проверки и число не публикуется: пометка видна редакции и в собранную страницу не попадает.

Пустая ячейка таблицы выводится как «н/д», а не как ноль: отсутствие данных — это не нулевое значение.

Разные ряды могут относиться к разным территориям и периодам. Это указано у каждого ряда, и складывать такие ряды нельзя.

Если данных нет

Блок появляется только тогда, когда данные проверены. Если данных нет, блок не выводится целиком — пустой рамки с нулём на странице не будет.

Если источник перестал отвечать или изменился, разбор не дополняется оценками: публикуется только проверенная часть, а расхождение фиксируется отдельно.

Запускать расчёт заново можно: наблюдения сохраняются вместе со ссылкой на источник, датой выгрузки и версией скрипта.

Чего мы не делаем

Не выводим причины там, где видно только совпадение динамики.

Не публикуем клиентские данные, персональные данные и заявки.

Не обещаем индексацию в поиске и не выдаём черновик за опубликованный материал.