Discover how to convert huge amounts of raw data into meaningful and actionable insights
Use Spark's unified analytics engine for end-to-end analytics, from data preparation to predictive analytics
Perform data ingestion, cleansing, and integration for ML, data analytics, and data visualization

Book Description

Apache Spark is a unified data analytics engine designed to process huge volumes of data quickly and efficiently. PySpark is Apache Spark's Python language API, which offers Python developers an easy-to-use scalable data analytics framework.

Essential PySpark for Scalable Data Analytics starts by exploring the distributed computing paradigm and provides a high-level overview of Apache Spark. You'll begin your analytics journey with the data engineering process, learning how to perform data ingestion, cleansing, and integration at scale. This book helps you build real-time analytics pipelines that help you gain insights faster. You'll then discover methods for building cloud-based data lakes, and explore Delta Lake, which brings reliability to data lakes. The book also covers Data Lakehouse, an emerging paradigm, which combines the structure and performance of a data warehouse with the scalability of cloud-based data lakes. Later, you'll perform scalable data science and machine learning tasks using PySpark, such as data preparation, feature engineering, and model training and productionization. Finally, you'll learn ways to scale out standard Python ML libraries along with a new pandas API on top of PySpark called Koalas.

By the end of this PySpark book, you'll be able to harness the power of PySpark to solve business problems.

What you will learn

Understand the role of distributed computing in the world of big data
Gain an appreciation for Apache Spark as the de facto go-to for big data processing
Scale out your data analytics process using Apache Spark
Build data pipelines using data lakes, and perform data visualization with PySpark and Spark SQL
Leverage the cloud to build truly scalable and real-time data analytics applications
Explore the applications of data science and scalable machine learning with PySpark
Integrate your clean and curated data with BI and SQL analysis tools

Who this book is for

This book is for practicing data engineers, data scientists, data analysts, and data enthusiasts who are already using data analytics to explore distributed and scalable data analytics. Basic to intermediate knowledge of the disciplines of data engineering, data science, and SQL analytics is expected. General proficiency in using any programming language, especially Python, and working knowledge of performing data analytics using frameworks such as pandas and SQL will help you to get the most out of this book.

Distributed Computing Primer
Data Ingestion
Data Cleansing and Integration
Real-time Data Analytics
Scalable Machine Learning with PySpark
Feature Engineering – Extraction, Transformation, and Selection
Supervised Machine Learning
Unsupervised Machine Learning
Machine Learning Life Cycle Management
Scaling Out Single-Node Machine Learning Using PySpark
Data Visualization with PySpark
Spark SQL Primer
Integrating External Tools with Spark SQL
The Data Lakehouse

Informazioni sull?autore

Sreeram Nudurupati is a data analytics professional with years of experience in designing and optimizing data analytics pipelines at scale. He has a history of helping enterprises, as well as digital natives, build optimized analytics pipelines by using the knowledge of the organization, infrastructure environment, and current technologies.

Le informazioni nella sezione "Su questo libro" possono far riferimento a edizioni diverse di questo titolo.

Descrizione libreria

We specialise in General Interest Books from South Asian countries.

Visita la pagina della libreria

Informazioni sull?azienda del venditore

BOOKS AND PERIODICALS AGENCY LTD
90 Barnet Gate Lane, Barnet, EN5 2AX, United Kingdom

Condizioni di vendita e spedizione

Condizioni di vendita

Returns accepted if you are not satisfied with the Service or Book.

Diritto di recesso

Se sei un consumatore, puoi esercitare il tuo diritto di recesso seguendo le istruzioni riportate di seguito. Per "consumatore" si intende qualsiasi persona fisica che agisca per fini che non rientrano nel quadro della sua attivit� commerciale, industriale, artigianale o professionale.

Informazioni relative al diritto di recesso

Diritto di recesso

Hai il diritto di recedere dal presente contratto, senza indicarne le ragioni, entro 14 giorni.

Il periodo di recesso scade dopo 14 giorni dal giorno in cui

tu acquisisci, o un terzo designato diverso dal vettore e da te acquisisce, il possesso fisico dell'ultimo bene o l'ultimo lotto o pezzo.

Per esercitare il diritto di recesso, sei tenuto a informare Majestic Books, 315 Chiswick High Road, W4 4HH, London, ,, United Kingdom, +44 02085704746, della tua decisione di recedere dal presente contratto tramite una dichiarazione esplicita (ad esempio lettera inviata per posta, fax o posta elettronica). A tal fine puoi utilizzare il modulo tipo di recesso, ma non e' obbligatorio. Puoi anche compilare e inviare elettronicamente il modulo tipo di recesso o qualsiasi altra esplicita dichiarazione sul nostro sito web, dalla sezione "Ordini" nel "Mio Account". Nel caso scegliessi questa opzione, ti trasmetteremo senza indugio una conferma di ricevimento su un supporto durevole (ad esempio per posta elettronica).

Per rispettare il termine di recesso, � sufficiente inviare la comunicazione relativa all'esercizio del diritto di recesso prima della scadenza del periodo di recesso.

Effetti del recesso

Se recedi dal presente contratto, ti saranno rimborsati tutti i pagamenti che hai effettuato a nostro favore, compresi i costi di consegna (ad eccezione dei costi supplementari derivanti dalla tua eventuale scelta di un tipo di consegna diverso dal tipo meno costoso di consegna standard da noi offerto). Potremo trattenere dal rimborso le somme derivanti da una diminuzione del valore del prodotto risultante da una tua non necessaria manipolazione.

I rimborsi verranno effettuati senza indebito ritardo e in ogni caso non oltre 14 giorni dal giorno in cui siamo stati informati della tua decisione di recedere dal presente contratto.

Detti rimborsi saranno effettuati utilizzando lo stesso mezzo di pagamento da te usato per la transazione iniziale, salvo che tu non abbia espressamente convenuto altrimenti; in ogni caso, non dovrai sostenere alcun costo quale conseguenza di tale rimborso. Il rimborso pu� essere sospeso fino al ricevimento dei beni oppure fino all'avvenuta dimostrazione da parte tua di aver rispedito i beni, se precedente.

Ti preghiamo di rispedire i beni o di consegnarli a Majestic Books, 315 Chiswick High Road, W4 4HH, London, ,, United Kingdom, +44 02085704746, senza indebiti ritardi e in ogni caso entro 14 giorni dal giorno in cui hai comunicato il tuo recesso dal presente contratto. Il termine � rispettato se rispedisci i beni prima della scadenza del periodo di 14 giorni. I costi diretti della restituzione dei beni saranno a tuo carico. Sei responsabile solo della diminuzione del valore dei beni risultante da una manipolazione del bene diversa da quella necessaria per stabilire la natura, le caratteristiche e il funzionamento dei beni.

Eccezioni al diritto di recesso

Il diritto di recesso non si applica in caso di:

fornitura di giornali, periodici e riviste ad eccezione dei contratti di abbonamento per la fornitura di tali pubblicazioni;
fornitura di contenuto digitale (inclusi applicazioni, software, ebook, MP3, ecc.) mediante un supporto non materiale (per esempio un CD o un DVD) se al momento dell'inoltro dell'ordine hai espressamente consentito all'inizio dell'esecuzione accettando la perdita del diritto di recesso in conseguenza dell'inizio di esecuzione.

Modulo di recesso tipo

(Compilare e restituire il presente modulo solo se si desidera recedere dal contratto)

Destinatario: (Majestic Books, 315 Chiswick High Road, W4 4HH, London, ,, United Kingdom, +44 02085704746)

Con la presente io/noi (*) notifichiamo il recesso dal mio/nostro (*) contratto di vendita dei seguenti beni/servizi (*)

Ordinato il (*) /ricevuto il (*)

Nome del/dei consumatore(i)

Indirizzo del/dei consumatore(i)

Firma del/dei consumatore(i) (solo se il presente modulo � notificato in versione cartacea)

Data

(*) Cancellare la dicitura inutile.

Condizioni di spedizione

Best packaging and fast delivery

Tariffe di spedizione da Regno Unito a U.S.A.

Tariffe di spedizione da Regno Unito a U.S.A.
Quantit� dell?ordine	Da 14 a 45 giorni lavorativi	Da 5 a 10 giorni lavorativi
Primo articolo	EUR 7.50	EUR 11.37

I tempi di consegna sono stabiliti dai venditori e variano in base al corriere e al paese. Gli ordini che devono attraversare una dogana possono subire ritardi e spetta agli acquirenti pagare eventuali tariffe o dazi associati. I venditori possono contattarti in merito ad addebiti aggiuntivi dovuti a eventuali maggiorazioni dei costi di spedizione dei tuoi articoli.