Crowdee
Pipelines

Spracherkennung

Sprachen in Textdateien oder gesprochenen Audiodateien erkennen.

Für die Spracherkennung stehen zwei Pipelines zur Verfügung — eine für textbasierte Dateien und eine für Audio. Beide geben dasselbe Ausgabeschema zurück: erkannte Sprachen, Konfidenzwerte und eine primäre Sprache.

lt-language-id-text

Erkennt die in Text- und Dokumentdateien enthaltenen Sprachen mithilfe eines LLM. Verarbeitet mehrsprachige Dokumente und gibt eine gerankte Liste erkannter Sprachen zurück.

100 Credits pro Datei · ~1 Minute

Akzeptierte Dateien

TypMIME-Typen
Texttext/*
Dokumenteapplication/pdf, Word (.docx)

Bis zu 10 Dateien pro Run.

Kontextparameter

Keine.

API-Beispiel

POST /v2/lt-pipelines/project/{projectId}/run
{
  "pipelineSlug": "lt-language-id-text",
  "fileIds": ["file_abc123"],
  "contextData": {}
}

Ausgabe

Beide Pipelines verwenden dasselbe Ausgabeschema:

{
  "pipelineSlug": "lt-language-id-text",
  "output": {
    "detectedLanguages": [
      {
        "language": "German",
        "code": "de",
        "confidence": 0.95
      },
      {
        "language": "English",
        "code": "en",
        "confidence": 0.42
      }
    ],
    "primaryLanguage": "German",
    "primaryLanguageCode": "de",
    "multilingual": true
  },
  "rawText": "German"
}

Ausgabefelder

FeldTypBeschreibung
detectedLanguagesarrayGerankte Liste erkannter Sprachen mit Konfidenzwerten
detectedLanguages[].languagestringSprachname (z. B. "German")
detectedLanguages[].codestringISO-639-1-Code (z. B. "de")
detectedLanguages[].confidencenumberKonfidenzwert 0–1
primaryLanguagestringName der mit höchster Konfidenz erkannten Sprache
primaryLanguageCodestringISO-639-1-Code der primären Sprache
multilingualbooleantrue, wenn mehr als eine Sprache erkannt wurde
rawTextstringPrimärer Sprachname als Klartext

Wie hilfreich ist diese Seite?

© 2026 Crowdee GmbH. Alle Rechte vorbehalten.

On this page