Avro Open Source Projects
Browse 123 Avro open source projects, ranked by GitHub stars. Find the most popular Avro tools and libraries.
apache/hudi
Upserts, Deletes And Incremental Processing on Big Data.
Metrics details
| Stars | 6,193 |
apache/avro
Apache Avro is a data serialization system.
Metrics details
| Stars | 3,289 |
apache/parquet-mr
Apache Parquet
Metrics details
| Stars | 3,069 |
confluentinc/schema-registry
Confluent Schema Registry for Kafka
Metrics details
| Stars | 2,455 |
dflemstr/rq
Record Query - A tool for doing record analysis and transformation
Metrics details
| Stars | 2,302 |
confluentinc/examples
Apache Kafka, Apache Flink and Confluent Platform examples and demos
Metrics details
| Stars | 2,059 |
OBenner/data-engineering-interview-questions
More than 2000+ Data engineer interview questions.
Metrics details
| Stars | 1,693 |
capitalone/DataProfiler
What's in your data? Extract schema, statistics and entities from datasets
Metrics details
| Stars | 1,571 |
confluentinc/bottledwater-pg
Change data capture from PostgreSQL into Kafka
Metrics details
| Stars | 1,517 |
mtth/avsc
Avro for JavaScript :zap:
Metrics details
| Stars | 1,381 |
GoogleCloudPlatform/DataflowTemplates
Cloud Dataflow Google-provided templates for solving in-Cloud data tasks
Metrics details
| Stars | 1,308 |
pmacct/pmacct
pmacct is a small set of multi-purpose passive network monitoring tools [NetFlow IPFIX sFlow libpcap BGP BMP RPKI IGP Streaming Telemetry].
Metrics details
| Stars | 1,232 |
linkedin/goavro
Goavro is a library that encodes and decodes Avro data.
Metrics details
| Stars | 1,065 |
deviceinsight/kafkactl
Command Line Tool for managing Apache Kafka
Metrics details
| Stars | 1,064 |
bigdatagenomics/adam
ADAM is a genomics analysis platform with specialized file formats built using Apache Avro, Apache Spark, and Apache Parquet. Apache 2 licensed.
Metrics details
| Stars | 1,056 |
Cinchoo/ChoETL
ETL framework for .NET (Parser / Writer for CSV, Flat, Xml, JSON, Key-Value, Parquet, Yaml, Avro formatted files)
Metrics details
| Stars | 859 |
HariSekhon/DevOps-Python-tools
80+ DevOps & Data CLI Tools - AWS, GCP, GCF Python Cloud Functions, Log Anonymizer, Spark, Hadoop, HBase, Hive, Impala, Linux, Docker, Spark Data Converters & Validators (Avro/Parquet/JSON/CSV/INI/XML/YAML), Travis CI, AWS CloudFormation, Elasticsearch, Solr etc.
Metrics details
| Stars | 822 |
thekvs/cpp-serializers
Benchmark comparing various data serialization libraries (thrift, protobuf etc.) for C++
Metrics details
| Stars | 749 |
sksamuel/avro4s
Avro schema generation and serialization / deserialization for Scala
Metrics details
| Stars | 730 |
miguno/kafka-storm-starter
[PROJECT IS NO LONGER MAINTAINED] Code examples that show to integrate Apache Kafka 0.8+ with Apache Storm 0.9+ and Apache Spark Streaming 1.1+, while using Apache Avro as the data serialization format.
Metrics details
| Stars | 721 |
fastavro/fastavro
Fast Avro for Python
Metrics details
| Stars | 711 |
twitter/bijection
Reversible conversions between types
Metrics details
| Stars | 656 |
zarusz/SlimMessageBus
Lightweight message bus interface for .NET (pub/sub and request-response) with transport plugins for popular message brokers.
Metrics details
| Stars | 648 |
OpenBangla/OpenBangla-Keyboard
An OpenSource, Unicode compliant Bengali Input Method
Metrics details
| Stars | 596 |
xubo245/SparkLearning
Learning Apache spark,including code and data .Most part can run local.
Metrics details
| Stars | 595 |
RandomFractals/vscode-data-preview
Data Preview 🈸 extension for importing 📤 viewing 🔎 slicing 🔪 dicing 🎲 charting 📊 & exporting 📥 large JSON array/config, YAML, Apache Arrow, Avro, Parquet & Excel data files
Metrics details
| Stars | 593 |
banglakit/awesome-bangla
A collection of tools, datasets and resources on Bangla computing
Metrics details
| Stars | 573 |
Netflix/PigPen
Map-Reduce for Clojure
Metrics details
| Stars | 564 |
hortonworks-spark/shc
The Apache Spark - Apache HBase Connector is a library to support Spark accessing HBase table as external data source or sink.
Metrics details
| Stars | 546 |
databricks/spark-avro
Avro Data Source for Apache Spark
Metrics details
| Stars | 537 |
hamba/avro
A fast Go Avro codec
Metrics details
| Stars | 510 |
Netflix/iceberg
Iceberg is a table format for large, slow-moving tabular data
Metrics details
| Stars | 494 |
uber/marmaray
Generic Data Ingestion & Dispersal Library for Hadoop
Metrics details
| Stars | 482 |
gorillalabs/sparkling
A Clojure library for Apache Spark: fast, fully-features, and developer friendly
Metrics details
| Stars | 446 |
stanford-futuredata/sparser
Sparser: Raw Filtering for Faster Analytics over Raw Data
Metrics details
| Stars | 432 |
mardambey/mypipe
MySQL binary log consumer with the ability to act on changed rows and publish changes to different systems with emphasis on Apache Kafka.
Metrics details
| Stars | 428 |
lensesio/schema-registry-ui
Web tool for Avro Schema Registry |
Metrics details
| Stars | 425 |
phunt/avro-rpc-quickstart
Apache Avro RPC Quick Start.
Metrics details
| Stars | 414 |
Telefonica/prometheus-kafka-adapter
Use Kafka as a remote storage database for Prometheus (remote write only)
Metrics details
| Stars | 402 |
mongodb/mongo-kafka
MongoDB Kafka Connector
Metrics details
| Stars | 388 |
only-cliches/NoProto
Flexible, Fast & Compact Serialization with RPC
Metrics details
| Stars | 383 |
uber/storagetapper
StorageTapper is a scalable realtime MySQL change data streaming, logical backup and logical replication service
Metrics details
| Stars | 363 |
spotify/ratatool
A tool for data sampling, data generation, and data diffing
Metrics details
| Stars | 349 |
streamthoughts/kafka-connect-file-pulse
🔗 A multipurpose Kafka Connect connector that makes it easy to parse, transform and stream any file, in any format, into Apache Kafka
Metrics details
| Stars | 348 |
FasterXML/jackson-dataformats-binary
Uber-project for standard Jackson binary format backends: avro, cbor, ion, protobuf, smile
Metrics details
| Stars | 347 |
Altinity/clickhouse-sink-connector
Replicate data from MySQL, Postgres and MongoDB to ClickHouse®
Metrics details
| Stars | 343 |
linkedin/ml-ease
ADMM based large scale logistic regression
Metrics details
| Stars | 340 |
higherkindness/mu-haskell
Mu (μ) is a purely functional framework for building micro services.
Metrics details
| Stars | 333 |
davidmc24/gradle-avro-plugin
A Gradle plugin to allow easily performing Java code generation for Apache Avro. It supports JSON schema declaration files, JSON protocol declaration files, and Avro IDL files.
Metrics details
| Stars | 329 |
Eugene-Mark/bigdata-file-viewer
A cross-platform (Windows, MAC, Linux) desktop application to view common bigdata binary format like Parquet, ORC, AVRO, etc. Support local file system, HDFS, AWS S3, Azure Blob Storage ,etc.
Metrics details
| Stars | 307 |
allegro/json-avro-converter
JSON to Avro conversion tool designed to make migration to Avro easier.
Metrics details
| Stars | 289 |
sarim/ibus-avro
Avro phonetic bangla typing layout for ibus
Metrics details
| Stars | 283 |
divolte/divolte-collector
Divolte Collector
Metrics details
| Stars | 280 |
lhh2002/Framework-Of-BigData
大数据面试题,从0到1走向架构师之路。Flink、Spark、Hive、HBase、Hadoop、Kettle、Kafka...
Metrics details
| Stars | 277 |
mtth/hdfs
API and command line interface for HDFS
Metrics details
| Stars | 276 |
confluentinc/confluent-kafka-dotnet
Confluent's Apache Kafka .NET client
Metrics details
| Stars | 268 |
riferrei/srclient
Golang Client for Schema Registry
Metrics details
| Stars | 262 |
diegoceccarelli/json-wikipedia
Json Wikipedia, contains code to convert the Wikipedia xml dump into a json/avro dump
Metrics details
| Stars | 256 |
mugli/Avro-Keyboard
Unicode compliant native Bangla/Bengali Input Method Editor (IME) for Windows
Metrics details
| Stars | 255 |
marcosschroh/dataclasses-avroschema
Generate avro schemas from python dataclasses, Pydantic models and Faust Records. Code generation from avro schemas. Serialize/Deserialize python instances with avro schemas.
Metrics details
| Stars | 252 |
