Dateien & Anreicherung
Wie Dateien hochgeladen, gespeichert und mit Metadaten angereichert werden, bevor die Verifizierung stattfindet.
Dateien sind die primäre Eingabe für jede Verifizierungspipeline. Bevor eine Pipeline eine Datei analysieren kann, führt Crowdee einen Anreicherungsschritt durch, der strukturierte technische Metadaten extrahiert — Codec-Informationen, EXIF-Daten, Lautstärkepegel, Seitenzahlen und mehr. Bei den meisten Pipelines muss die Anreicherung abgeschlossen sein, bevor sie eine Ausführungsanfrage akzeptieren.
Diese Seite erläutert den vollständigen Lebenszyklus: Upload, Anreicherung und Zugriff auf die angereicherten Dateidaten.
Unterstützte Medientypen
| Typ | Formate | Hinweise |
|---|---|---|
| Bild | JPEG, PNG, WebP, TIFF, GIF | EXIF-Extraktion; Frames werden für animierte GIFs extrahiert |
| Audio | MP3, WAV, FLAC, OGG, M4A | Spektral- und Lautstärkeanalyse |
| Video | MP4, MOV, WebM, AVI | Frame-Extraktion und Analyse der Audiospur |
| Text | TXT, MD, HTML | Wort- und Zeichenanzahl |
| Dokument | Seitenanzahl, eingebettete Metadaten und Textextraktion |
Dateien hochladen
Laden Sie Dateien über eine multipart/form-data POST-Anfrage an den Projektdateien-Endpunkt hoch. Die project_id ist Teil des URL-Pfads — Dateien gehören immer zu einem bestimmten Projekt.
curl -X POST https://api.crowdee.ai/v2/projects/{projectId}/files \
-H "X-API-Key: crw_YOUR_API_KEY" \
-F "file=@photo.jpg"Beispielantwort:
{
"id": "file_xyz789",
"name": "photo.jpg",
"mimeType": "image/jpeg",
"size": 2048576,
"enrichmentStatus": "pending",
"privacyLevel": "private",
"createdAt": "2024-11-15T10:01:00Z"
}Speichern Sie die id — Sie verwenden sie als {fileId} in allen nachfolgenden Anfragen.
Anreicherungsprozess
Die Anreicherung startet unmittelbar nach dem Upload automatisch. Der Anreicherungs-Worker verarbeitet die Datei im Hintergrund und befüllt das Feld metadata mit strukturierten technischen Daten.
Upload abgeschlossen — der Dateidatensatz wird mit enrichmentStatus: "pending" erstellt.
Worker nimmt den Auftrag auf — der Anreicherungs-Worker dequeued die Datei und beginnt mit der Analyse. Der Status wechselt zu enrichmentStatus: "running".
Metadaten extrahiert — der Worker verwendet ffprobe (Medien) oder einen Dokumentenparser (PDF/Text), um strukturierte Felder zu extrahieren.
Anreicherung abgeschlossen — bei Erfolg wird enrichmentStatus zu "completed" und file.metadata wird befüllt. Bei einem Fehler wird enrichmentStatus zu "failed" und ein Feld enrichmentError wird gesetzt.
Pipelines geben einen Fehler 422 Unprocessable Entity zurück, wenn Sie versuchen, sie für eine Datei zu starten, deren enrichmentStatus nicht "completed" ist. Fragen Sie den Dateiendpunkt immer ab, bis die Anreicherung abgeschlossen ist, bevor Sie einen Verifizierungslauf erstellen.
Dateistatus abfragen:
curl https://api.crowdee.ai/v2/projects/{projectId}/files/{fileId} \
-H "X-API-Key: crw_YOUR_API_KEY"Anreicherungsfelder nach Medientyp
Nach Abschluss der Anreicherung enthält das Objekt file.metadata je nach Dateityp die folgenden Felder.
{
"width": 4032,
"height": 3024,
"format": "jpeg",
"exif": {
"gps": {
"latitude": 48.8566,
"longitude": 2.3522
},
"cameraModel": "iPhone 15 Pro",
"creationDate": "2024-11-14T16:42:00Z",
"software": "17.1.1"
}
}| Feld | Beschreibung |
|---|---|
width / height | Bildabmessungen in Pixeln |
format | Erkanntes Format (jpeg, png, webp, tiff, gif) |
exif.gps | In der Datei eingebettete GPS-Koordinaten, sofern vorhanden |
exif.cameraModel | Kamera- oder Gerätemodell aus EXIF |
exif.creationDate | Ursprünglicher Aufnahmezeitstempel aus EXIF |
exif.software | Software oder Firmware, die die Datei erstellt oder zuletzt bearbeitet hat |
Presigned-URL-Dateizugriff
Um die Originaldatei herunterzuladen, rufen Sie den Download-Endpunkt auf. Die API antwortet mit einer 302-Weiterleitung zu einer temporären Presigned-URL, die auf S3-kompatiblem Speicher gehostet wird.
# -L folgt der Weiterleitung automatisch
curl -L https://api.crowdee.ai/v2/files/{fileId}/download \
-H "X-API-Key: crw_YOUR_API_KEY" \
-o downloaded-file.jpgPresigned-URLs laufen nach 15 Minuten ab. Cachen oder teilen Sie die Weiterleitungs-URL nicht — rufen Sie stattdessen den Download-Endpunkt jedes Mal neu auf, wenn Sie auf die Datei zugreifen müssen.
Datei-Datenschutzstufen
Dateien sind standardmäßig privat. Das Feld privacyLevel steuert, wer auf eine Datei zugreifen kann:
| Stufe | Beschreibung |
|---|---|
private | Nur für Mitglieder der besitzenden Organisation zugänglich |
sensitive | Eingeschränkt auf Admin-Ebene und höher innerhalb der Organisation |
internal | Für alle authentifizierten Crowdee-Benutzer zugänglich |
public | Keine Authentifizierung erforderlich (nur für nicht sensible Inhalte verwenden) |
Fehlgeschlagene Anreicherung wiederholen
Wenn die Anreicherung aufgrund eines vorübergehenden Fehlers fehlschlägt (Dienst nicht verfügbar, temporäres Speicherproblem), wiederholen Sie sie ohne erneuten Upload:
curl -X POST \
https://api.crowdee.ai/v2/projects/{projectId}/files/{fileId}/enrichment/retry \
-H "X-API-Key: crw_YOUR_API_KEY"Die Datei durchläuft erneut den Zyklus pending → running → completed. Wenn die Anreicherung wiederholt fehlschlägt, prüfen Sie, ob das Dateiformat unterstützt wird und ob die Datei nicht beschädigt ist.
Wie hilfreich ist diese Seite?
Kernkonzepte
Die Bausteine hinter jedem Verifizierungslauf — Dateien, Datensätze, Bewertungen und die Stufentypen, die sie erzeugen.
Bewertungen & Konfidenzwerte
Die fünf Bewertungstypen, die Konfidenzberechnung und Prüfprotokolle verstehen.