<!-- mobian-agent-page publisher="dailydev" canonical="https://daily.dev/tags/spark" -->

---
title: Apache Spark News &amp; Updates | daily.dev
description: Apache Spark, a distributed engine for large-scale data processing. Readers can learn about the DataFrame and SQL APIs, execution planning and shuffles, structured streaming, memory and partition tuning, running on Kubernetes or managed services, and alternatives.
canonical: https://daily.dev/tags/spark
twitter:card: summary_large_image
twitter:site: @dailydotdev
og:url: https://daily.dev/tags/spark
og:type: website
og:site_name: daily.dev
og:title: Apache Spark News &amp; Updates | daily.dev
og:description: Apache Spark, a distributed engine for large-scale data processing. Readers can learn about the DataFrame and SQL APIs, execution planning and shuffles, structured streaming, memory and partition tuning, running on Kubernetes or managed services, and alternatives.
og:image: https://api.daily.dev/og/tags/spark.png
og:image:width: 1200
og:image:height: 630
---

## Roadmaps

[![roadmap.sh logo](https://media.daily.dev/image/upload/s--91LSaHRW--/f_auto,q_auto/v1717766368/roadmap_iambav)Comprehensive roadmap for Apache SparkBy roadmap.sh](https://roadmap.sh/data-analyst?ref=dailydev)

## Recommended Apache Spark stories

## Who to follow for Apache Spark

## Top sources covering Apache Spark

## Most upvoted Apache Spark posts

## Best discussed Apache Spark posts

## All posts about Apache Spark

```json
{"@context":"https://schema.org","@graph":[{"@type":"Organization","@id":"https://daily.dev/#organization","name":"daily.dev","url":"https://daily.dev","logo":{"@type":"ImageObject","url":"https://daily.dev/apple-touch-icon.png","width":180,"height":180},"sameAs":["https://twitter.com/dailydotdev","https://github.com/dailydotdev","https://www.linkedin.com/company/daily-dev-ltd"]},{"@type":"WebSite","@id":"https://daily.dev/#website","url":"https://daily.dev","name":"daily.dev","publisher":{"@id":"https://daily.dev/#organization"},"potentialAction":{"@type":"SearchAction","target":{"@type":"EntryPoint","urlTemplate":"https://daily.dev/search?q={search_term_string}"},"query-input":"required name=search_term_string"}}]}
{"@context":"https://schema.org","@graph":[{"@type":"CollectionPage","@id":"https://daily.dev/tags/spark#page","url":"https://daily.dev/tags/spark","name":"Apache Spark News & Updates","description":"Apache Spark, a distributed engine for large-scale data processing. Readers can learn about the DataFrame and SQL APIs, execution planning and shuffles, structured streaming, memory and partition tuning, running on Kubernetes or managed services, and alternatives.","isPartOf":{"@type":"WebSite","url":"https://daily.dev"}},{"@type":"ItemList","@id":"https://daily.dev/tags/spark#items","numberOfItems":10,"itemListElement":[{"@type":"ListItem","position":1,"url":"https://daily.dev/posts/deploy-an-on-premise-data-hub-with-canonical-maas-spark-kubernetes-and-ceph-zg6mfqmgy","name":"Deploy an on-premise data hub with Canonical MAAS, Spark, Kubernetes and Ceph"},{"@type":"ListItem","position":2,"url":"https://daily.dev/posts/apache-hadoop-and-apache-spark-for-big-data-analysis-yiunwtiqh","name":"Apache Hadoop and Apache Spark for Big Data Analysis"},{"@type":"ListItem","position":3,"url":"https://daily.dev/posts/amazon-emr-serverless-introduces-shuffle-optimized-disks-delivering-improved-performance-for-i-o-int-yk6uxk362","name":"Amazon EMR Serverless introduces Shuffle-optimized disks delivering improved performance for I/O intensive workloads"},{"@type":"ListItem","position":4,"url":"https://daily.dev/posts/amazon-emr-on-eks-now-supports-apache-livy-1gmk17ndg","name":"Amazon EMR on EKS now supports Apache Livy"},{"@type":"ListItem","position":5,"url":"https://daily.dev/posts/understanding-distributed-computing-4psu38fuw","name":"Understanding Distributed Computing"},{"@type":"ListItem","position":6,"url":"https://daily.dev/posts/iris---turning-observations-into-actionable-insights-for-enhanced-decision-making-v6axp1oy9","name":"Iris - Turning observations into actionable insights for enhanced decision making"},{"@type":"ListItem","position":7,"url":"https://daily.dev/posts/cost-optimization-strategies-for-scalable-data-lakehouse-g8zwtw2ga","name":"Cost Optimization Strategies for scalable Data Lakehouse"},{"@type":"ListItem","position":8,"url":"https://daily.dev/posts/enhancing-data-security-with-spark-a-guide-to-column-level-encryption---part-1-ivxuasift","name":"Enhancing Data Security with Spark: A Guide to Column-Level Encryption - Part 1"},{"@type":"ListItem","position":9,"url":"https://daily.dev/posts/sentiment-analysis-of-yelp-restaurants-reviews-in-real-time-ncpugwqne","name":"Sentiment Analysis of Yelp Restaurants Reviews in Real-Time"},{"@type":"ListItem","position":10,"url":"https://daily.dev/posts/enabling-near-real-time-data-analytics-on-the-data-lake-ijm6wwv1h","name":"Enabling near real-time data analytics on the data lake"}]},{"@type":"BreadcrumbList","itemListElement":[{"@type":"ListItem","position":1,"name":"Home","item":"https://daily.dev"},{"@type":"ListItem","position":2,"name":"Tags","item":"https://daily.dev/tags"},{"@type":"ListItem","position":3,"name":"Apache Spark"}]}]}
```

