1С отдаёт таблицу, где шапка размазана по трём строкам, ячейки объединены, а итоги сидят прямо внутри данных.
Прачка
грязных данных
Разбираем методику, по которой мы чистим выгрузки из 1С, CRM и Excel с помощью нейросетей: как устроен контур обработки, куда уходят кривые строки и чем всё это собрано.
80% работы с данными —
это стирка
Отчёт собирается за час, а сведение данных под него занимает два дня. Аналитика начинается только после стирки — вот что приезжает в файлах.
Один и тот же клиент записан в CRM десятком способов. В отчёте это десять разных контрагентов вместо одного.
Один и тот же день в каждом источнике записан по-своему. Сортировка и группировка по месяцам разваливаются.
Числа пишут текстом, ставят прочерки и примечания, добавляют свои колонки и строки. Формат ломается: сумма не считается, а настроенный отчёт падает.
Кому подойдёт
Для кого этот эфир
У которых полдня уходит на сведение выгрузок из разных систем.
Которые каждый месяц собирают отчёт из файлов от филиалов и подразделений.
Которым коллеги присылают таблицы, заполненные как получится.
И получил выдуманные цифры вместо результата.
Кому будет менее полезно. Если данные к вам уже приходят чистыми из настроенного хранилища, большую часть эфира вы, скорее всего, знаете. А если нужно, чтобы обработку настроили под ваши данные, это отдельная работа за рамками полутора часов.
Как это устроено
Методика очистки данных
через карантин
В основе — контур с правилами, которые настраиваются один раз. Он разбирает выгрузки из разных источников, приводит их к единому виду, а всё, что не сошлось, откладывает в карантин: кривые данные не ломают ни модель, ни отчёт.
Источники
система
CRMСделки
и клиенты
от коллег
- Разбирает структуру файла
- Сводит поля к одному справочнику
- Проверяет форматы, дубли и пропуски
Программа стирки
Что разберём за полтора часа
21 августа, 18:00 мск
-
Откуда берётся грязь
Типовые ошибки в выгрузках из 1С, CRM и в таблицах от коллег. Почему они появляются снова и снова, даже когда всех попросили заполнять аккуратно.
-
Методика: контур и карантин
Из чего состоит контур обработки и что происходит с данными на каждом этапе: разбор структуры, маппинг полей, проверки, карантин.
-
Как мы это сделали в своём проекте
Разбираем реализацию по шагам: что складывали в базу, как размечали поля, как выглядит интерфейс, из которого правят спорные строки.
-
Инструменты
Чем собран контур и что из этого можно повторить у себя — от скрипта под один файл до системы с базой и интерфейсом.
-
Ответы на вопросы
Разбираем ваши случаи: какие данные, где ломается, что с этим делать.
21 августа, 18:00 мск · запись остаётся у вас
Кто будет стирать
Ведут
Алексей Колоколов
Основатель Института бизнес-аналитики, международный эксперт по BI-дашбордам. Автор книг «Дашборд для директора», «Заставьте данные говорить» и «Синергия интеллектов».
Елена Шмаль
Автор курсов по финансовым отчётам в Power BI и Excel, преподаватель корпоративных программ по аналитике и курса «Аналитика с нейросетями».
Регистрация
Что вы получите
21 августа, 18:00 мск · онлайн
Это не продающий вебинар, а спецвыпуск в рамках нашего курса по ИИ-дашбордам — для тех, кто будет применять методику у себя.
- Методику очистки данных через карантин — целиком, по шагам.
- Разбор нашего проекта: как устроен контур изнутри.
- Список инструментов, которые можно повторить у себя.
- Как обрабатывать рабочие данные, не выкладывая их в облако.
- Ответы на вопросы экспертам и запись эфира.
1000 ₽
Запись остаётся у вас
Было и стало
Один раз собрать инструмент
вместо ежемесячной стирки
Логику обработки пишет нейросеть, а инструмент остаётся у вас: он знает ваши файлы, приводит их к нужному виду и показывает, где ошибка.
Как сейчас
2 днякаждый месяц, руками
С инструментом
1 минутана прогон, без разбора