.PARQUET Bestandsextensie
Parquet-dataset
| Ontwikkelaar | Apache |
| Populariteit |
3,3 | 3 stemmen |
Wat is een PARQUET-bestand?
Een PARQUET-bestand is een gegevensbestand dat is opgeslagen in de indeling Apache Parquet. Het slaat tabelgegevens op in een kolomgeoriënteerde indeling, waarbij rijen worden gegroepeerd en waarden voor elke kolom bij elkaar worden opgeslagen. Dankzij deze structuur kunnen toepassingen voor gegevensverwerking efficiënter alleen de kolommen ophalen die ze nodig hebben.
Meer informatie
Apache Parquet is oorspronkelijk ontwikkeld als onderdeel van het Hadoop-ecosysteem en wordt nu gebruikt door veel toepassingen voor gegevensverwerking en gegevensanalyse. Apache Hadoop is een open-source softwareframework dat is ontworpen om grote gegevenssets op meerdere computers op te slaan en te verwerken. Parquet wordt vaak gebruikt voor gegevensintensieve toepassingen die grote hoeveelheden informatie moeten verwerken en analyseren.
PARQUET-bestanden beginnen met het magische getal PAR1, een reeks tekens die toepassingen gebruiken om het bestand als een Parquet-bestand te identificeren. Ze bevatten een of meer rijgroepen die de gegevens van het bestand ordenen en bevatten metadata in een voettekst die de gegevens beschrijft, waaronder informatie over de kolommen en rijgroepen. Het magische getal PAR1 staat ook aan het einde van een PARQUET-bestand.
Een PARQUET-bestand openen
Je kunt Parquet-tools (multiplatform) gebruiken om PARQUET-bestanden te lezen en te bewerken. Deze tool is beschikbaar als zelfstandig programma en als onderdeel van Apache Hadoop. Ook DBConvert Parquet Viewer kan PARQUET-bestanden openen, zodat je ze lokaal in je webbrowser kunt lezen.