Курсы Big Data,Arenadata,Greenplum, Kafka и Spark

16Май
2019

Data Preparation: полет нормальный – что такое нормализация данных и зачем она нужна

Автор Анна Вичуговав категории Machine Learning, Блог, Статьи

Нормализация данных – это одна из операций преобразования признаков (Feature Transformation), которая выполняется при их генерации (Feature Engineering) на этапе подготовки данных (Data Preparation). В этой статье мы расскажем, почему необходимо нормализовать значения переменных перед тем, как запустить моделирование для интеллектуального анализа данных (Data Mining). Что такое нормализация данных и чем она...

15Май
2019

Оцифровываем текст: как превратить слова в числа для Data Mining – 5 NLP-операций Feature Extraction

Автор Анна Вичуговав категории Machine Learning, Блог, Статьи

Извлечение признаков (Feature Extraction) из текста – часто встречающаяся задача Data Mining, а именно этапа генерации признаков. Интеллектуальный анализ текста получил название Text Mining. В этом случае Feature Extraction относится к сфере NLP, Natural Language Processing – обработка естественного языка. Это отдельное направление искусственного интеллекта и математической лингвистики [1]. Здесь...

12Май
2019

Это не баг, а фича: генерация признаков для Data Mining

Автор Анна Вичуговав категории Machine Learning, Блог, Статьи

Генерация признаков – пожалуй, самый творческий этап подготовки данных (Data Preparation) для машинного обучения (Machine Learning). Этот этап еще называют Feature Engineering. Он наступает после того, как выборка сформирована и очистка данных завершена. В этой статье мы поговорим о том, что такое признаки, какими они бывают и как Data Scientist...

10Май
2019

Зачем нужна очистка данных для Data Mining: 10 главных проблем подготовки датасета и способы их решения

Автор Анна Вичуговав категории Machine Learning, Блог, Статьи

Выборка, полученная в результате первого этапа подготовки данных (Data Preparation), еще пока не пригодна для обработки алгоритмами машинного обучения, поскольку информацию необходимо очистить. Сегодня мы расскажем, что такое очистка данных (Data Cleaning) для Data Mining, зачем она нужна и как выполнять этот этап Data Preparation. Что такое очистка данных для...

08Май
2019

Отберем то, что нужно Data Mining: как сформировать датасет для машинного обучения

Автор Анна Вичуговав категории Machine Learning, Блог, Статьи

выборка, датасет, Data Preparation, интеллектуальный анализ данных

Мы уже рассказывали о важности этапа подготовки данных (Data Preparation), результатом которого является обработанный набор очищенных данных, пригодных для обработки алгоритмами машинного обучения (Machine Learning). Такая выборка, называемая датасет (dataset), нужна для тренировки модели Machine Learning, чтобы обучить систему и затем использовать ее для решения реальных задач. Однако, поскольку в...

07Май
2019

Как подготовить данные к моделированию: 5 операций Data Preparation

Автор Анна Вичуговав категории Machine Learning, Блог, Статьи

CRISP-DM, статистика, обработка данных, Machine Learning, машинное обучение, Data Mining

CRISP-DM, SEMMA и другие стандарты Data Mining не случайно выделяют подготовку данных в отдельную фазу. Data Preparation - весьма трудоемкий итеративный процесс, который занимает до 80% всех затрат ресурсов и времени в жизненном цикле Data Mining и включает следующие задачи обработки исходных («сырых») данных [1]: Выборка данных – отбор признаков...

01Май
2019

Логистика высокой частоты: 5 примеров успешного использования RFID-технологий – интернет вещей (IoT) в России и за рубежом

Автор Анна Вичуговав категории Internet of Things, Use Cases, Блог, Цифровая трансформация

логистика, ритейл, бизнес, интернет вещей, Internet Of Things, IoT, RFID

Мы уже писали, как радиочастотные метки применяются в машиностроении, нефтегазовой отрасли, сельском хозяйстве и сфере безопасности. Продолжая серию публикаций об интернете вещей(IoT), мы представляем вам 5 кейсов отечественных и зарубежных компаний по использованию RFID-технологий в логистике и складском учете. RFID в легкой промышленности: международная логистика Немецкий производитель и продавец одежды,...

29Апр
2019

Радиочастотный интернет вещей в промышленности: как, где и зачем используются RFID-метки – 5 практических кейсов российских и зарубежных компаний

Автор Анна Вичуговав категории Internet of Things, Use Cases, Блог, Цифровая трансформация

бизнес, интернет вещей, Internet Of Things, IoT, RFID, нефтянка, нефтегазовая промышленность, промышленность, производство, машиностроение

Продолжая тему интернета вещей, мы нашли еще 5 примеров успешного применения RFID-меток в промышленности: машиностроении, нефтегазовой отрасли, сельском хозяйстве и для обеспечения безопасности на массовых мероприятиях. Сегодня в нашем материале отечественные и зарубежные компании делятся своим опытом использования этих технологий Internet Of Things. RFID на производстве реактивных двигателей Зарубежное предприятие...

22Апр
2019

Как интернет вещей и большие данные увеличивают прибыль оффлайн-магазинов: 5 практических кейсов

Автор Анна Вичуговав категории Internet of Things, Machine Learning, Use Cases, Блог, Цифровая трансформация

Big Data, Большие данные, машинное обучение, Machine Learning, ритейл, бизнес, интернет вещей, Internet Of Things, Wi-Fi, IoT

Интернет вещей (Internet Of Things) считает покупателей торговых центров, а средства больших данных (Big Data) и машинного обучения (Machine Learning) превращают эти цифры в реальную выгоду для бизнеса. Мы нашли еще 5 примеров успешного использования этих технологий в ритейле и делимся с вами опытом отечественных и зарубежных компаний. Интернет вещей...

20Апр
2019

И тебя посчитали: как интернет вещей и большие данные повышают офлайн-продажи, считая посетителей торговых центров

Автор Анна Вичуговав категории Internet of Things, Machine Learning, Use Cases, Блог, Цифровая трансформация

Big Data, Большие данные, машинное обучение, Machine Learning, ритейл, бизнес, интернет вещей, Internet Of Things, Wi-Fi, распознавание лиц

Мы уже описывали, как американская торговая сеть Macy’s успешно использует интернет вещей (Internet Of Things) для персонализированного маркетинга. Bluetooth-маячок определяет местоположение посетителя в магазине с точностью до нескольких сантиметров и подает сигнал в корпоративную CRM-систему. CRM отправляет клиенту на смартфон предложение со скидкой на товар, ближайший к потребителю в данный момент [1]. Сегодня мы...