Amazon S3
In diesem Artikel wird beschrieben, wie Tableau mit dem treiberlosen Amazon S3-Connector verbunden und die Datenquelle eingerichtet wird.
Voraussetzungen
Bevor Sie beginnen, benötigen Sie die folgenden Verbindungsinformationen:
Die AWS-Region Ihres S3-Buckets
Den Namen des S3-Buckets.
Ihren AWS-IAM-Zugangsschlüssel für Ihren S3-Bucket (Schlüssel-ID und geheimer Zugangsschlüssel).
Berechtigungen
Stellen Sie sicher, dass Ihr AWS-IAM-Benutzer über Leseberechtigungen für Ihren S3-Bucket verfügt.
Empfehlungen
Die folgenden Empfehlungen können helfen, die Leistung zu steigern:
- Der Client wird in einer AWS-Umgebung ausgeführt wird (z. B. Tableau Server, installiert in einer EC2-Instanz, oder Verwendung von Tableau Cloud).
- Der Zugriff auf dieselbe Region hat eine bessere Leistung als die Unterstützung regionsübergreifender Buckets. Regionsübergreifende Buckets können zusätzliche Kosten aufgrund von Gebühren für den Datenausgang verursachen.
Herstellen der Verbindung und Einrichten der Datenquelle
- Starten Sie Tableau und wählen Sie unter Verbinden den Eintrag Amazon S3 in der Liste der zusätzlichen Connectoren aus
- Wählen Sie Installieren und Tableau neu starten aus, um den Connector zu installieren.
- Gehen Sie nach dem Neustart von Tableau zu Verbinden und wählen Sie Amazon S3 (Beta) aus der Liste der installierten Connectoren aus.
- Geben Sie Ihre Bucket-Region, Ihren Bucket-Namen, Ihre Zugangsschlüssel-ID und Ihren geheimen Zugangsschlüssel ein.
- Wählen Sie Anmelden aus.
- Wählen Sie im Inhalt Ihres Buckets eine Datei aus, mit der Sie eine Verbindung herstellen möchten.
- Wählen Sie Verbinden aus.
Einrichten der Datenquelle
Führen Sie die folgenden Schritte aus, um eine Datenquelle einzurichten.
- (Optional) Wählen Sie oben auf der Seite den Namen der Standarddatenquelle aus.
- Geben Sie einen eindeutigen Datenquellennamen zur Verwendung in Tableau ein.
- Ziehen Sie aus dem linken Bereich eine oder mehrere Dateien, mit denen Sie eine Verbindung herstellen möchten, in den Arbeitsbereich.
- Um Ihre Analyse zu starten, wählen Sie die Registerkarte "Blatt 1" aus.
Vereinigen von Daten
Sie können Dateien aus Ihrem S3-Bucket zusammenführen. Weitere Informationen zur Vereinigung finden Sie unter Vereinigen von Daten.
Platzhaltervereinigungen
Um eine Platzhaltervereinigung mit Dateien in Unterordnern durchzuführen, muss der Stammordner oder Bucket über mindestens eine Datei in der Vereinigung verfügen, die mit der Struktur der in den Unterordnern enthaltenen Dateien übereinstimmt. Diese Datei ist die erste Datei, mit der Sie beim Erstellen der Vereinigung eine Verbindung herstellen.
Platzhaltervereinigung funktioniert für CSV-Dateien, wird jedoch nicht für Excel-Dateien unterstützt.
Bekannte Probleme und Einschränkungen
In den folgenden Abschnitten werden bekannte Probleme und Einschränkungen beschrieben, die sich auf Ihren Erfolg bei der Verwendung des Amazon S3-Connectors auswirken können.
Hinweis: Dieser Connector wird derzeit in der Tableau Prep-Webdokumenterstellung und in virtuellen Verbindungen nicht unterstützt.
Bekannte Probleme und Einschränkungen bei der Authentifizierung
Unterstützt wird nur die Authentifizierung mit dem geheimen Schlüssel/Zugriffsschlüssel des Amazon-IAM-Benutzers ohne Sitzungstoken.
Bekannte Probleme und Einschränkungen bei der Veröffentlichung
Arbeitsmappen und Datenquellen müssen mit der Authentifizierungsoption "Eingebettetes Kennwort" veröffentlicht werden. "Benutzer auffordern" wird derzeit nicht unterstützt.
Bekannte Probleme und Einschränkungen bei der Vereinigung
- Nur Tableau Desktop unterstützt eine Platzhaltervereinigung.
- Die Webdokumenterstellung unterstützt nur die benutzerdefinierte manuelle Vereinigung (Ziehen von Dateien).
- Die Platzhaltervereinigung unterstützt keine Excel-Dateien.
Bekannte Probleme und Einschränkungen des Dateityps
- Derzeit werden Parquet-, CSV-, komprimierte .gz- und Excel-Dateien unterstützt.
- Alle Daten werden standardmäßig im Zeichenfolgenformat importiert.
- Nur UTF-8-Kodierung wird unterstützt.
- Es ist nicht möglich, mehrere Dateitypen in einer einzigen Verbindung zu vereinen oder zu verknüpfen (z. B. Parquet- und CSV-Dateien zusammen).
- Zum gegenwärtigen Zeitpunkt werden nur kommagetrennte CSV-Dateien unterstützt.
- Die maximale Dateigröße beträgt 15 GB.
- Der kumulierte Ergebnissatz einer Verknüpfung oder Vereinigung darf nicht größer als 15 GB sein.
- Aufgrund von Leistungsproblemen beim Excel-Dateiparser im Connector dürfen Excel-Dateien derzeit eine Größe von ca. 100 MB nicht überschreiten.
Weitere bekannte Probleme und Einschränkungen bei Parquet-Dateien
- Parquet-Dateien müssen in dem in unserer Hyper-API-Dokumentation beschriebenen Format vorliegen.
- Verschachtelte Spalten und daher die verschachtelten Typen MAP und LIST werden nicht unterstützt.
- Die Typen BSON, UUID und ENUM werden nicht unterstützt.
- Der physische Typ FIXED_LEN_BYTE_ARRAY ohne logischen oder konvertierten Typ wird nicht unterstützt.
- Der Typ DECIMAL wird nur bis zu 8 Byte (18 Dezimalstellen) unterstützt. Wenn Sie mehr als 18 Dezimalstellen benötigen, ist die Verwendung des doppelten Werts zu empfehlen.
- Die Typen TIME_MILLIS und TIME_NANOS werden nicht unterstützt. Erwägen Sie stattdessen die Verwendung von TIME_MICROS.
- Die veraltete BIT_PACKED-Codierung wird nicht unterstützt. Neuere Parquet-Dateien sollten diese Kodierung nicht verwenden, da sie seit über fünf Jahren veraltet ist.
- Die DELTA_LENGTH_BYTE_ARRAY-Codierung und die aktuelle BYTE_STREAM_SPLIT-Codierung werden nicht unterstützt, da sie von keiner Bibliothek geschrieben werden.
- Unterstützte Komprimierungen sind SNAPPY, GZIP, ZSTD und LZ4_RAW.
Herstellen einer Verbindung zu Daten in Regionen in China
Seit Version 2.1.4 des Amazon S3-Connectors ist die Verbindung zu Daten in AWS China-Regionen mit diesen Einschränkungen möglich:
Tableau Desktop, Tableau Server und Tableau Cloud können ohne Einschränkungen eine Verbindung zu Excel-Dateien herstellen.
Auf CSV- und Parquet-Dateien kann in Tableau Desktop und Tableau Cloud nicht zugegriffen werden.
Tableau Server kann mit dem folgenden TSM-Befehl für den Zugriff auf CSV- und Parquet-Dateien konfiguriert werden:
tsm configuration set -k hyper.external_allow_custom_endpoints -v 1 --force-keys
Siehe auch
- Einrichten von Datenquellen – fügen Sie dieser Datenquelle weitere Daten hinzu oder bereiten Sie Ihre Daten vor der Analyse vor.
- Erstellen von Diagrammen und Analysieren von Daten – Beginnen Sie mit Ihrer Datenanalyse.
- Optimieren der Amazon Redshift- und Tableau-Softwarebereitstellung für bessere Leistung(Link wird in neuem Fenster geöffnet) – Tableau-Whitepaper (Registrierung oder Anmeldung erforderlich)
- Untersuchen von Big Data-Analysen mit Amazon Redshift(Link wird in neuem Fenster geöffnet) – Tableau-On-Demand-Webinar (Registrierung oder Anmeldung erforderlich)
