Serverless ETL and Analytics with AWS Glue: Design scalable data lakes, optimize ETL pipelines, and accelerate analytics on AWS
Langue : anglais
Edité par Packt Publishing, 2026
- Livre broché
- Neuf

Vendeur : California Books, Miami, FL, Etats-UnisCalifornia Books
Vendeur AbeBooks depuis 27 octobre 2023
Etat: Neuf
EUR 53,39
Quantité disponible : Plus de 20 disponibles
Ajouter au panierN° de réf. du vendeur I-9781835464847
- Titre
- Serverless ETL and Analytics with AWS Glue: Design scalable data lakes, optimize ETL pipelines, and accelerate analytics on AWS
- Auteur
- Noritaka Sekiyama; Albert Quiroga; Tomohiro Tanaka; Subramanya Vajiraya; Akira Ajisaka; Ishan Gaur
- Éditeur
- Packt Publishing
- Année de publication
- 2026
- État de l'article
- New
- Reliure
- Couverture souple
- Langue
- anglais
- ISBN à 10 chiffres
- 183546484X
- ISBN à 13 chiffres
- 9781835464847
- Édition
- 2ème Édition
Use AWS Glue to integrate growing data sources with serverless ETL, building secure, observable pipelines that support reliable analytics while managing performance and cost across a governed AWS data platform as workloads grow
Key Features
- Use runnable code, console walkthroughs, and downloadable examples for core AWS Glue workflows
- Apply DataOps practices with AWS CDK, Docker, and CI/CD in real-world scenarios
- Learn from six data specialists with AWS, Spark, Apache Iceberg, and data lake expertise
Book Description
Whether you build data pipelines, design cloud architectures, or deliver analytics on AWS, bringing data together is only part of the challenge. You must also keep this data clean, trustworthy, and available while controlling costs. AWS Glue offers serverless data integration, but using it effectively requires decisions about storage, metadata, security, orchestration, monitoring, and performance.
This book guides you from modern data management and core AWS Glue features through ingestion from files, streams, SaaS applications, and JDBC sources, preparation, storage layout, metadata, security, sharing, and pipeline operations. Console walkthroughs and runnable examples show how to manage schemas and lineage in AWS Glue Data Catalog, apply AWS Lake Formation access controls, monitor workloads, tune Spark jobs, troubleshoot failures, and manage development with AWS CDK, Docker, and CI/CD. You will also examine analytics, machine learning and generative AI integrations, real-world data lake scenarios, and cost optimization. Learn how Apache Iceberg, Apache Hudi, and Delta Lake add transactions, schema evolution, and efficient data management to data lakes.
By the end, you will be able to design, build, operate, and continuously improve a serverless data platform that fits your organization's scale, structure, and priorities.
What you will learn
- Design scalable serverless ETL pipelines with AWS Glue
- Ingest data from files, streams, SaaS, and JDBC sources
- Optimize file formats, partitions, compression, and layouts
- Manage schemas, partitions, and lineage in AWS Glue Data Catalog
- Secure data with access control, encryption, and auditing
- Automate testing and multi account CI/CD using AWS CDK and Docker
- Monitor, tune, and troubleshoot AWS Glue and Spark workloads
- Apply Apache Iceberg, Hudi, and Delta Lake to data lakes with AWS Glue
Who this book is for
This book is for data engineers, ETL developers, cloud architects, and analytics professionals who build or operate data platforms on AWS. It suits readers working on serverless data lakes, Spark ETL, governance, data sharing, reliability, or cost control. It is especially useful if you aim to improve pipeline reliability, governance, or cost visibility as workloads grow. Basic familiarity with the AWS Management Console, Amazon S3, and IAM is recommended. Experience with Python, SQL, or Apache Spark will help with the code examples, and an AWS account is useful for following the walkthroughs.
Table of Contents
- Data Management – Introduction and Concepts
- Introduction to Important AWS Glue Features
- Data Ingestion
- Data Preparation
- Data Layouts
- Data Management
- Implementing Resilient Metadata Management
- Data Security
- Data Sharing
- Data Pipeline Management
- Monitoring
- Tuning, Debugging, and Troubleshooting
- Data Analysis
- Machine Learning and Generative AI Integration
- Architecting Data Lakes for Real-World Scenarios and Edge Cases
- Managing End-to-End Development Lifecycle
- Open Table Formats
- Cost Optimization
« Synopsis » peut appartenir à une autre édition de cet ouvrage.
À propos de l’auteur
Noritaka Sekiyama is an experienced big data engineer working at a data and AI company. He is responsible for building scalable data platforms with unified governance in the cloud. He is passionate about software engineering, cloud computing, big data technologies, distributed systems, data platforms, system monitoring, and automation.
Albert Quiroga is a Senior Solutions Architect at Amazon, where he creates solutions and architectural designs for one of the largest data lakes in the world. Prior to that, he spent four years working at AWS, where he specialized in big data technologies such as Amazon EMR, Amazon Athena, AWS Glue, and Amazon SageMaker. His 11 years of experience in the industry have empowered him to work with several Fortune 500 companies to overcome large-scale data and analytics challenges, and he has helped launch and develop features for several AWS services.
Tomohiro Tanaka is a big data specialist with deep, hands-on expertise in data infrastructure. His expertise covers large-scale migrations, performance tuning, and production troubleshooting, with a focus on Apache Spark and Apache Iceberg. He contributes to the Apache Iceberg open-source project and speaks at community events and conferences to help teams adopt Apache Iceberg in practice.
Subramanya Vajiraya is a Senior Cloud Engineer at AWS Sydney specializing in AWS Glue. He obtained his Bachelor of Engineering degree in Information Science & Engineering from NMAM Institute of Technology, Nitte, KA, India, in 2015 and his Master of Information Technology degree in Internetworking from the University of New South Wales, Sydney, Australia, in 2017. He is passionate about helping customers solve challenging technical issues related to their ETL workloads and implement scalable data integration and analytics pipelines on AWS.
Akira Ajisaka is a software engineer with more than 10 years of engineering experience in big data. He enjoys troubleshooting and contributing to OSS.
Ishan Gaur has more than 17 years of IT experience in software development, data engineering, and cloud architecture, building distributed systems and highly scalable data processing pipelines using Apache Spark, Scala, and various AWS data services, such as AWS Glue, Amazon SageMaker Unified Studio, and Amazon EMR. He currently works at AWS as a Principal Cloud Engineer, where he is focused on AI/ML operations and proactive cloud optimization. He works with AWS enterprise customers to design resilient data pipelines, automate incident response, troubleshoot large-scale distributed data platforms, and adopt GenAI-powered services and operational tools. He is passionate about turning reactive support patterns into proactive, self-healing architectures.
« A propos de ce titre » peut appartenir à une autre édition de cet ouvrage.
California Books
Miami, FL, Etats-Unis
Vendeur AbeBooks depuis 27 octobre 2023
Frais d'expédition à l'intérieur de ce pays : Etats-Unis
| Article | 3 à 7 jours ouvrés | 2 à 5 jours ouvrés |
|---|---|---|
| Premier article | EUR 0,00 | EUR 10,54 |
Modes de paiement
Description de la boutique
We have 20 years experience selling books worldwide! Friendly customer support. Your satisfaction guaranteed!
Spécialité
All authorized categoriesProfil professionnel du vendeur
Miramar International Services LLC
FL, Etats-Unis
Droit de rétractation
Si vous êtes un consommateur, vous pouvez exercer votre droit de rétractation sur le contrat conformément à ce qui suit. Le mot « consommateur » désigne toute personne physique agissant à des fins qui n'entrent pas dans le cadre de son activité commerciale, artisanale ou professionnelle.
Informations concernant le droit de rétractation
Droit statutaire de rétractation
Vous avez le droit d'exercer votre droit de rétractation sur ce contrat dans les 14 jours sans donner de raison.
Le délai de rétractation expirera au bout de 14 jours à compter du jour où vous-même, ou un tiers autre que le transporteur et désigné par vous, prendrez physiquement possession de la dernière marchandise, du dernier lot ou de la dernière pièce.
Pour exercer votre droit de rétractation, remplissez électroniquement et envoyez une déclaration claire sur notre site Web, sous « Vos achats » dans « Votre compte ». Nous vous communiquerons sans délai un accusé de réception de cette rétractation sur un support durable (par exemple, par e-mail).
Pour respecter le délai de rétractation, il vous suffit d'envoyer votre message concernant l'exercice de votre droit de rétractation avant l'expiration du délai de rétractation.
Effets de la rétractation
Si vous exercez votre droit de rétractation sur ce contrat, nous vous rembourserons tous les paiements que vous avez effectués, y compris les frais de livraison (à l'exception des frais supplémentaires résultant du choix d'un mode de livraison autre que le type de livraison standard le moins cher que nous proposons).
Nous pouvons déduire du remboursement la perte de valeur de toute marchandise livrée, si la perte est le résultat d'une manipulation inutile de votre part.
Nous effectuerons le remboursement dans les meilleurs délais, et au plus tard 14 jours après le jour où nous aurons été informés de votre décision d'exercer votre droit de rétractation sur ce contrat.
Nous effectuerons le remboursement en utilisant le même moyen de paiement que celui que vous avez utilisé pour la transaction initiale, sauf si vous en avez expressément convenu autrement ; en tout état de cause, aucuns frais ne vous seront facturés à la suite d'un tel remboursement.
Nous pouvons suspendre le remboursement jusqu'à ce que nous ayons reçu les marchandises ou que vous ayez fourni la preuve que vous avez renvoyé les marchandises, en fonction de la première éventualité.
Vous devez renvoyer les marchandises ou les remettre à California Books, Fort Wayne, Indiana, U.S.A., sans retard injustifié et, en tout état de cause, au plus tard 14 jours à compter du jour où vous nous avez communiqué votre décision de rétractation du présent contrat. Le délai est respecté si vous renvoyez les marchandises avant l'expiration du délai de 14 jours. Vous devrez prendre en charge les frais directs du renvoi des marchandises. Vous n'êtes responsable que de toute diminution de valeur des marchandises résultant d'une manipulation autre que celle nécessaire pour établir la nature, les caractéristiques et le fonctionnement des marchandises.
Exceptions au droit de rétractation
Le droit de rétractation ne s'applique pas à ce qui suit :
- Distribution de journaux, de revues ou de magazines, à l'exception des contrats d'abonnement ; et
- Fourniture d'un contenu numérique qui n'est pas fourni sur un support matériel (par exemple, sur un CD ou un DVD) si vous avez accepté, lors de votre commande, que nous puissions commencer à le livrer et que vous ne puissiez pas exercer votre droit de rétractation une fois la livraison commencée.