Überblick
Der S3-Konnektor liest Objekte aus ausgewählten Amazon-S3-Buckets und macht unterstützte Inhalte in Novaplan AI durchsuchbar. Ein Bucket enthält Objekte mit eindeutigen Schlüsseln; vermeintliche Ordner sind Präfixe dieser Schlüssel. Der Konnektor verwendet eine AWS Access Key ID und einen Secret Access Key eines berechtigten IAM-Kontos. Novaplan unterstützt Sie bei der Einrichtung. Die IAM-Berechtigungen begrenzen, welche Buckets und Objekte der Konnektor lesen kann. Die Auswahl Personal oder Team steuert zusätzlich, wer synchronisierte Inhalte in Novaplan AI sehen kann; individuelle AWS-Rechte der späteren Workspace-Nutzenden werden nicht automatisch übernommen. Eine Team-Verbindung kann deshalb alle eingelesenen Objekte für berechtigte Workspace-Mitglieder sichtbar machen. Prüfen Sie Bucket-Auswahl und Zugriffsmodell mit Ihrer AWS-Administration und einem zweiten Testkonto, bevor Sie sie aktivieren.IAM-Zugang vorbereiten
- Öffnen Sie die AWS Management Console und wechseln Sie zu IAM → Users → Create user.
- Benennen Sie den Benutzer erkennbar, zum Beispiel
Novaplan-AI-S3-Connector. - Geben Sie nur die für die ausgewählten Buckets nötigen Leserechte. Die englische Quellanleitung verwendet AmazonS3ReadOnlyAccess als einfache Option; diese kann deutlich weiter reichen als ein einzelner Bucket. Lassen Sie für produktive Daten eine auf Ihre Buckets beschränkte Richtlinie prüfen.
- Öffnen Sie Security credentials → Access keys → Create access key und wählen Sie den passenden Anwendungsfall für eine außerhalb von AWS laufende Anwendung, sofern dies für Ihren Novaplan-Workspace zutrifft.
- Kopieren Sie Access Key ID und Secret Access Key sofort. Der geheime Teil wird nur einmal angezeigt.
s3:ListAllMyBuckets, s3:GetBucketLocation, s3:ListBucket und s3:GetObject relevant. Bucket-ARNs und Objekt-ARNs sind verschieden; beschränken Sie beide passend. Eine Richtlinie mit arn:aws:s3:::*/* würde Objektzugriff über alle Buckets ausdehnen und ist für eine einzelne Freigabe ungeeignet.
Beispielrichtlinie für einen Bucket
Die folgende IAM-Richtlinie erlaubt Lesezugriff auf Objekte in einem Bucket. Ersetzen Sieyour-bucket-name durch den freigegebenen Bucket und lassen Sie die Richtlinie von Ihrer AWS-Administration an Ihre Umgebung anpassen:
s3:ListAllMyBuckets ermöglicht es, alle Bucket-Namen des AWS-Kontos aufzulisten. Die Richtlinie begrenzt den Objektzugriff auf den angegebenen Bucket, verbirgt aber die Namen anderer Buckets nicht. Der Konnektor verwendet die Bucket-Erkennung; entfernen Sie diese Berechtigung erst, wenn Novaplan eine andere Erkennung für Ihre bereitgestellte Version bestätigt hat. Die AWS-Beispiele für S3-IAM-Richtlinien trennen ebenfalls Bucket- und Objekt-ARNs.
Unter IAM → Policies → Create policy können Sie die geprüfte JSON-Richtlinie anlegen und dem IAM-Benutzer zuweisen. Wenn mehrere Buckets zugelassen werden sollen, ergänzen Sie deren jeweilige Bucket- und Objekt-ARNs gezielt, statt einen Objekt-Wildcard für alle Buckets zu verwenden. Für mit SSE-KMS verschlüsselte Objekte sind zusätzlich passende KMS-Rechte erforderlich.
Konnektor einrichten
- Öffnen Sie in Novaplan AI Workspace Settings → Connectors für eine Teamverbindung oder unter Personal den Bereich Your Connectors für eine persönliche Verbindung. Suchen Sie S3 und wählen Sie + Setup.
- Geben Sie unter Authenticate Instance einen Instance name, die Access Key ID in Access Key und den geheimen Schlüssel in Secret Key ein.
- Wählen Sie Next und unter Configure Records Scheduled oder Manual. Ein geplanter Lauf kann beispielsweise alle 1 Hour stattfinden; bei großen, selten veränderten Buckets kann ein längeres Intervall sinnvoll sein.
- Begrenzen Sie die Synchronisierung unter Indexing & sync filters → + Add filter.
Ohne Filter werden alle für den IAM-Zugang erreichbaren Objekte berücksichtigt. Einen einzelnen Präfix-„Ordner“ innerhalb eines Buckets kann die Quellanleitung nicht direkt als Filter auswählen. Bei sensiblen Daten ist deshalb ein eng begrenzter IAM-Zugang und eine passende Bucket-Struktur wichtig.
- Speichern Sie mit Save Configuration und schalten Sie auf der Instanzkarte Sync Enabled ein, sofern sie Sync Paused zeigt.
- Prüfen Sie im Overview-Bereich Total, Processing, Not Started, Failed und Unsupported. Sync verarbeitet Änderungen; Full sync liest den gewählten Umfang erneut.
Dateitypen und besondere Speicherklassen
Dokumente, Textdateien und Quellcode können inhaltlich indexiert werden. Dazu zählen laut aktueller Upstream-Referenz EPUB-E-Books ohne Kopierschutz (DRM); ihr Text ist durchsuchbar, eine Vorschau ist nicht verfügbar. Bei Bildern hängt die Inhaltsauswertung von den im Workspace aktivierten Verarbeitungsfunktionen ab. Videos, Audio, Archive, unbekannte Binärdateien und passwortgeschützte Dateien sind nicht zuverlässig inhaltlich durchsuchbar und können als Unsupported erscheinen. Die Quellanleitung nennt Standard, Standard-IA, One Zone-IA und Intelligent-Tiering als unterstützte Speicherklassen. Glacier und Glacier Deep Archive benötigen vor dem Lesen einen Restore; Requester Pays und kundenseitig bereitgestellte Verschlüsselungsschlüssel (SSE-C) werden dort nicht unterstützt. Für SSE-KMS braucht der IAM-Zugang zusätzlich passende KMS-Rechte. Lassen Sie diese Punkte vor einer produktiven Verbindung prüfen. Diese Anleitung gilt für Amazon S3. Im S3-Konfigurationsdialog lässt sich keine eigene Endpoint-URL angeben. Wenn in Ihrem Workspace der separate MinIO-Konnektor verfügbar ist, verwenden Sie für MinIO diesen Konnektor und lassen Sie sich die Einrichtung bis zur Veröffentlichung seiner eigenen Anleitung von Novaplan Support erklären.Fehler beheben
Häufige Fragen
Wie lange dauert die erste Synchronisierung?
Wie lange dauert die erste Synchronisierung?
Das hängt von Anzahl, Größe und Typ der Objekte, den AWS-Grenzen, den Filtern und der Indexierungskapazität Ihres Workspaces ab. Beginnen Sie mit einem begrenzten Bucket oder Dateitypfilter und verfolgen Sie den Lauf unter Overview. Novaplan unterstützt Sie bei der Planung größerer Importe.
Kann ich mehrere AWS-Konten verbinden?
Kann ich mehrere AWS-Konten verbinden?
Eine Konnektor-Instanz verwendet die Zugangsdaten eines AWS-Kontos. Legen Sie für weitere Konten jeweils einen geeigneten IAM-Zugang und eine eigene S3-Instanz in Novaplan AI an. So lassen sich Buckets und Filter pro Konto getrennt verwalten.
Welche Dateitypen sind durchsuchbar?
Welche Dateitypen sind durchsuchbar?
Unterstützte Dokumente wie PDF, DOCX, XLSX, PPTX, ODT und RTF sowie Text- und Codeformate können inhaltlich indexiert werden. DRM-freie EPUB-Dateien sind nach der aktuellen Quellreferenz per Text durchsuchbar, aber nicht in der Vorschau verfügbar. Die Inhaltsauswertung von Bildern hängt von den aktivierten Workspace-Funktionen ab. Videos, Audio, Archive, unbekannte Binärdateien und passwortgeschützte Dateien sind nicht zuverlässig inhaltlich durchsuchbar. Prüfen Sie Unsupported und den Indexierungsstatus für konkrete Dateien.
Wie funktioniert ein Folgelauf?
Wie funktioniert ein Folgelauf?
Nach dem ersten Lauf speichert der Konnektor pro Bucket einen Synchronisierungsstand. Er listet die ausgewählten Buckets erneut, vergleicht die Änderungszeiten der Objekte mit diesem Stand und verarbeitet passende neue oder geänderte Objekte. Große Buckets können deshalb auch bei wenigen Änderungen Zeit benötigen. Prüfen Sie den tatsächlichen Lauf unter Overview und kontrollieren Sie gelöschte Quelldateien gesondert.
Kann ich archivierte Glacier-Objekte synchronisieren?
Kann ich archivierte Glacier-Objekte synchronisieren?
Der dokumentierte Konnektor unterstützt S3 Glacier Flexible Retrieval und Glacier Deep Archive nicht direkt. Eine AWS-Wiederherstellung macht eine temporäre Kopie nach Abschluss des Vorgangs lesbar; die Speicherklasse des archivierten Objekts ändert sich dadurch nicht. Gehen Sie nicht davon aus, dass der Konnektor diese temporäre Kopie indexiert. Lassen Sie das Verhalten der bereitgestellten Version von Novaplan bestätigen oder eine dauerhafte Kopie in einer unterstützten Speicherklasse mit einem begrenzten Lauf testen.
Was passiert, wenn ich eine Datei in S3 lösche?
Was passiert, wenn ich eine Datei in S3 lösche?
Eine Quelllöschung ist kein bestätigter sofortiger Widerruf der Suchbarkeit. Prüfen Sie besonders bei sensiblen Inhalten, ob der bereits indexierte Eintrag aus Novaplan AI verschwunden ist. Wenn er weiterhin erscheint, wenden Sie sich an Novaplan Support. Klären Sie Lösch- und Versionierungsverhalten der Enterprise-Version vorab.
Welche Verschlüsselung wird unterstützt?
Welche Verschlüsselung wird unterstützt?
SSE-S3 kann der IAM-Zugang mit normalen S3-Rechten lesen. Für SSE-KMS sind zusätzliche Berechtigungen am passenden KMS-Schlüssel erforderlich. Kundenseitig gelieferte Schlüssel (SSE-C) und vor dem Upload clientseitig verschlüsselte Inhalte werden in der Quellanleitung nicht als durchsuchbar unterstützt. Prüfen Sie die konkrete Bucket-Konfiguration mit Ihrer AWS-Administration.
Kann ich nur einen Ordner innerhalb eines Buckets auswählen?
Kann ich nur einen Ordner innerhalb eines Buckets auswählen?
Der dokumentierte Konnektor bietet keinen Filter für einzelne Präfix-„Ordner“. Sie können Buckets, Dateiendungen und Datumsbereiche filtern. Wenn Inhalte zwingend voneinander getrennt werden müssen, verwenden Sie eine passende Bucket-Struktur und einen entsprechend begrenzten IAM-Zugang.