Taldatauppsättning

Holländsk datauppsättning

Nederländska dataset

Högkvalitativ nederländsk datauppsättning för AI och talmodeller

Holländsk datauppsättning

Översikt

  • SpråkDutch
  • DatasettyperCallcenter, manusbaserad monolog
  • LandNederländerna

BESKRIVNING

Denna datauppsättning inkluderar oskriptade syntetiska telefonsamtal mellan agenter och kunder (5–15 minuter), naturliga telefonsamtal mellan människor (15–60 minuter) med transkriptioner, vilket tillhandahåller olika taldata för träning och utvärdering av tal- och språkteknik.

Dataset Höjdpunkter

  • SpråkDutch
  • Samplingshastighet48 kHz / 8 kHz
  • Totalt antal timmar119338:00:00
  • högtalare2,919+
  • KanalerMono
  • Varaktighetsintervall5–60 minuter

Use Cases

  • ASR (Automatisk taligenkänning)
  • Virtuella assistenter och chatbots
  • Konversations AI
  • Talanalys
  • TTS (Text-till-tal)
  • Språkmodellering

Specifikationer för exempeldataset

Dataset typCall CenterManusmonolog
Samplingshastighet8 kHz48 kHz
högtalare2 högtalare2 högtalare
KanalMonoMono
Totalt antal timmar3,250:00:00116,088:00:00
Totalt antal talarePå förfrågan2,919

Fördelar

  • Mångsidig och representativBred talarbevakning för inkluderande, verklighetsbaserad AI.
  • Ljud av hög kvalitetRena, balanserade inspelningar för pålitlig modellprestanda.
  • Redo för AI/MLStrukturerad och kommenterad för sömlös integration.
  • Skalbar och flexibelFlera längder, talare och domäner för att passa dina behov.

Utvalda klienter

Betrott av ledande AI-team och företag världen över.

  • Microsoft
  • Amazon Web Services
  • Google

Hittar du inte det du letar efter?

Nya färdiga datamängder samlas in för alla datatyper

Kontakta oss nu för att släppa dina bekymmer för insamling av ljud-/talträningsdata

  • Detta fält är för validering och bör lämnas oförändrad.
  • Genom att registrera mig godkänner jag Shaip Integritetspolicy och Användarvillkor och ge mitt samtycke till att ta emot B2B marknadsföringskommunikation från Shaip.