25.17 USD
Наличие на складе:
Ожидаемое поступление (если вы сделаете заказ прямо сейчас): 22.07.2024; планируемая отправка: 23.07.2024
Ожидаемое поступление (если вы сделаете заказ прямо сейчас): 25.07.2024; планируемая отправка: 26.07.2024
Издательство: | Питер |
Серия: | Бестселлеры O'Reilly |
Дата выхода: | июнь 2024 |
ISBN: | 978-601-08-4037-9 |
Объём: | 288 страниц |
Масса: | 462 г |
Размеры(В x Ш x Т), см: | 24 x 17 x 2 |
Обложка: | мягкая |
Вы получили два разных, но связанных между собой набора данных? Что делать? Какие инструменты использовать для поиска совпадений? А если все, что у вас есть, — это доступ к базе данных с помощью запроса SQL SELECT? Джим Лемер познакомит вас с лучшими практиками, техниками и хитрыми приемами, которые помогут импортировать, очищать, сопоставлять, оценивать и осмысливать разнородные данные с помощью SQL.
Администраторы баз данных, разработчики, бизнес-аналитики и специалисты data science узнают, как выявлять и удалять дубликаты, парсить строки, извлекать данные из XML и JSON, упорядочивать данные, а также работать над качеством данных и выполнять операции ETL для поиска сходств и различий между разными представлениями одинаковых данных.
Примеры в книге содержат реальные кейсы и рабочий код.