# Sparkitecture

## Sparkitecture

- [Welcome to Sparkitecture!](https://www.sparkitecture.io/master.md)
- [Azure Storage](https://www.sparkitecture.io/cloud-service-integration/azure-storage.md): Storage is a managed service in Azure that provides highly available, secure, durable, scalable, and redundant storage for your data. Azure Storage includes both Blobs, Data Lake Store, and others.
- [Azure SQL Data Warehouse / Synapse](https://www.sparkitecture.io/cloud-service-integration/azure-sql-data-warehouse.md)
- [Azure Data Factory](https://www.sparkitecture.io/cloud-service-integration/azure-data-factory.md)
- [Reading and Writing Data](https://www.sparkitecture.io/data-preparation/reading-and-writing-data.md)
- [Shaping Data with Pipelines](https://www.sparkitecture.io/data-preparation/shaping-data-with-pipelines.md)
- [Other Common Tasks](https://www.sparkitecture.io/data-preparation/other-common-tasks.md)
- [About Spark MLlib](https://www.sparkitecture.io/machine-learning/about-spark-mllib.md): MLlib is Apache Spark's scalable machine learning library.
- [Classification](https://www.sparkitecture.io/machine-learning/classification.md)
- [Logistic Regression](https://www.sparkitecture.io/machine-learning/classification/logistic-regression.md)
- [Naïve Bayes](https://www.sparkitecture.io/machine-learning/classification/naive-bayes.md)
- [Decision Tree](https://www.sparkitecture.io/machine-learning/classification/decision-tree.md)
- [Random Forest](https://www.sparkitecture.io/machine-learning/classification/random-forest.md)
- [Gradient-Boosted Trees](https://www.sparkitecture.io/machine-learning/classification/gradient-boosted-trees.md)
- [Regression](https://www.sparkitecture.io/machine-learning/regression.md)
- [Linear Regression](https://www.sparkitecture.io/machine-learning/regression/linear-regression.md)
- [Decision Tree](https://www.sparkitecture.io/machine-learning/regression/decision-tree.md)
- [Random Forest](https://www.sparkitecture.io/machine-learning/regression/random-forest.md)
- [Gradient-Boosted Trees](https://www.sparkitecture.io/machine-learning/regression/gradient-boosted-trees.md)
- [MLflow](https://www.sparkitecture.io/machine-learning/mlflow.md): MLflow is an open source library by the Databricks team designed for managing the machine learning lifecycle. It allows for the creation of projects, tracking of metrics, and model versioning.
- [Feature Importance](https://www.sparkitecture.io/machine-learning/feature-importance.md)
- [Model Saving and Loading](https://www.sparkitecture.io/machine-learning/model-saving-and-loading.md)
- [Model Evaluation](https://www.sparkitecture.io/machine-learning/model-evaluation.md)
- [Structured Streaming](https://www.sparkitecture.io/streaming-data/structured-streaming.md)
- [API Serving](https://www.sparkitecture.io/operationalization/api-serving.md)
- [Batch Scoring](https://www.sparkitecture.io/operationalization/batch-scoring.md)
- [Text Data Preparation](https://www.sparkitecture.io/natural-language-processing/data-preparation.md)
- [Model Evaluation](https://www.sparkitecture.io/natural-language-processing/model-evaluation.md)
- [Glow](https://www.sparkitecture.io/bioinformatics-and-genomics/glow.md)
