Wenn Sie eine globale Datenbank von unserer Plattform erwerben oder herunterladen, werden Sie feststellen, dass die meisten unserer Datensätze in drei gängigen Dateiformaten bereitgestellt werden: .XLSX, .CSV und .TXT. Für die allermeisten Aufgaben – wie das einfache Anzeigen, Suchen oder manuelle Bearbeiten Ihrer Daten – empfehlen wir dringend die Verwendung der .XLSX-Datei.
Je nach Projektanforderungen kann es jedoch sinnvoll sein, andere Dateitypen zu verwenden. Um Ihnen die Auswahl des optimalen Formats für Ihren Workflow zu erleichtern, finden Sie hier eine kurze Übersicht über die Funktionsweise der einzelnen Dateitypen, deren Öffnung und die Vermeidung häufiger Formatierungsfehler.
XLSX (Microsoft Excel-Tabelle)
Was es so großartig macht:
Benutzerfreundlich : Dies ist das intuitivste Format für die manuelle Ansicht. Alles ist sofort übersichtlich in einem visuellen Raster dargestellt.
Umfangreiche Formatierung : Es unterstützt nützliche Tabellenkalkulationsfunktionen wie Schriftarten, Spaltenfarben und integrierte Textfilter.
Erweiterte Funktionen : Sie können direkt im Tabellenblatt mathematische Formeln ausführen, Daten-Pivot-Tabellen erstellen oder Diagramme erstellen.
So öffnen Sie es:
Öffnen Sie die Datei direkt auf Ihrem Desktop mit Microsoft Excel oder WPS Office.
Laden Sie die Datei hoch und bearbeiten Sie sie online mit Google Sheets.
Als Entwickler können Sie die Daten auch programmatisch mithilfe spezialisierter Bibliotheken lesen und verarbeiten.
Am besten geeignet für:
Dieses Format eignet sich ideal, wenn Sie manuell Zeilen mit Postleitzahlen prüfen, bestimmte Regionen nachschlagen, interne Berichte erstellen oder Adressdaten stichprobenartig überprüfen müssen, ohne eine einzige Zeile Code zu verändern.
CSV (Komma-getrennte Werte)
Was es so großartig macht:
Einfache Struktur : Eine CSV-Datei ist nichts anderes als reiner Text. Jede einzelne Zeile repräsentiert einen Datensatz, und die verschiedenen Informationen (wie Stadtname und Postleitzahl) werden durch ein Komma getrennt.
Äußerst universell einsetzbar : Nahezu jeder Datenbankmanager, jedes Datenanalysetool und jede Programmiersprache der Welt kann eine CSV-Datei perfekt lesen.
Leichtgewichtig : Da auf jegliche visuelle Gestaltung verzichtet wird, ist die Dateigröße unglaublich klein. Dadurch eignet es sich perfekt für die Verarbeitung riesiger Datensätze mit Hunderttausenden von Zeilen.
So öffnen Sie es:
Öffnen Sie es sofort mit einfachen Textverarbeitungsprogrammen wie Notepad.
Importieren Sie die Daten in Tabellenkalkulationsprogramme wie Microsoft Excel oder Google Sheets, um sie zu filtern.
Importieren Sie es direkt in relationale Datenbankplattformen.
Am besten geeignet für:
CSV-Dateien sind der Branchenstandard für den Datenaustausch. Wenn Sie große Datenmengen aus unseren Dateien exportieren und in Ihre eigene Datenbank oder das Backend Ihrer Online-Anwendung einspielen müssen, ist CSV die schnellste Option. Es eignet sich auch hervorragend zum Laden von Daten in Datenanalyse-Tools wie R oder Python.
TXT (Klartext)
Was es so großartig macht:
Maximale Freiheit : Wie CSV-Dateien sind auch TXT-Dateien unformatierter Text. Sie erzwingen jedoch kein striktes Komma-Layout und ermöglichen so benutzerdefinierte Abstände und Trennzeichen.
Keine Datenbeschädigung : Klartextdateien sperren Sie niemals aufgrund von proprietären Dateifehlern oder Softwareversionsproblemen. Sie sind auf jedem Gerät vollständig lesbar.
So öffnen Sie es:
Verwenden Sie ein beliebiges Textverarbeitungsprogramm oder einen Code-Editor, der auf Ihrem System installiert ist, z. B. Notepad, TextEdit oder Visual Studio Code.
Am besten geeignet für:
TXT-Dateien eignen sich hervorragend als Ausweichlösung für benutzerdefinierte Skripte (wie Python-Parsing-Tools). Sie sind außerdem ideal zum Speichern einfacher Textkonfigurationen, Systemprotokolle oder zum Anzeigen übersichtlicher, lesbarer Referenzdaten, wenn strikte Datenbankspalten nicht erforderlich sind.
Wichtiger Einrichtungshinweis: Achten Sie auf Ihre Kodierungen und Texttypen.
Obwohl Flatfiles weitgehend kompatibel sind, kann das Öffnen großer internationaler Datensätze gelegentlich zu Darstellungsfehlern führen, wenn Ihre Softwareeinstellungen fehlerhaft sind. Beachten Sie daher folgende zwei Regeln:
1. Die Sprachkodierungsfalle (Die Korrektur chaotischer Symbole)
Because we provide data for over 100 different nations, our files use UTF-8 text encoding to preserve international characters, foreign language text, and local regional accents. If you open a file and see unreadable, corrupted text symbols, the data is not broken. Your spreadsheet software is simply trying to read it using an old default local region setting (like ANSI). To fix this, always choose UTF-8 in your program's file import wizard. For highly specific regional languages, make sure to cross-reference the text guidelines included in your product documentation.
2. Die Falle der fehlenden Nullen (Fehlerbehebung bei Postleitzahlen)
Standardmäßig versuchen Programme wie Microsoft Excel, Ihre Datentypen zu erraten. Enthält eine Spalte nur Zahlen, behandelt Excel sie als „Zahl“ und nicht als „Text“. Dies führt zu erheblichen Problemen bei Postleitzahlen. Lautet die Postleitzahl beispielsweise 0100, entfernt die Standardlogik von Excel die führende Null und zeigt sie fälschlicherweise als 100 an. Um diesen Datenverlust zu vermeiden, formatieren Sie Ihre Postleitzahlspalten beim Importieren von Dateien immer als „Text“ und nicht als „Zahlen“.