Taldatauppsättning

USA Kinesisk datauppsättning

Högkvalitativt amerikanskt kinesiskt callcenter och yttringsdataset för AI- och talmodeller

USA Kinesisk datauppsättning

Översikt

  • SpråkUSA-kinesiska
  • DatasettyperCallcenter, yttrande
  • LandUSA

BESKRIVNING

Denna datauppsättning innehåller oskriptade syntetiska agent-kund-telefonsamtal (5–15 minuter) och en yttrandedatauppsättning med korta talinspelningar, som erbjuder finkorniga data för träning och utvärdering av tal- och språkmodeller.

Dataset Höjdpunkter

  • SpråkUSA-kinesiska
  • Samplingshastighet8 kHz
  • Totalt antal timmar12:10:06
  • högtalare26+
  • KanalerDubbel
  • Varaktighetsintervall5–15 minuter

Use Cases

  • ASR (Automatisk taligenkänning)
  • Virtuella assistenter och chatbots
  • Konversations AI
  • Talanalys
  • TTS (Text-till-tal)
  • Språkmodellering

Specifikationer för exempeldataset

Dataset typCall CenterYttrande
Samplingshastighet8 kHz8 kHz
högtalare2 högtalare2 högtalare
KanalDubbelDubbel
Totalt antal timmar06:05:0306:05:03
Totalt antal talare242

Fördelar

  • Mångsidig och representativBred talarbevakning för inkluderande, verklighetsbaserad AI.
  • Ljud av hög kvalitetRena, balanserade inspelningar för pålitlig modellprestanda.
  • Redo för AI/MLStrukturerad och kommenterad för sömlös integration.
  • Skalbar och flexibelFlera längder, talare och domäner för att passa dina behov.

Utvalda klienter

Betrott av ledande AI-team och företag världen över.

  • Microsoft
  • Amazon Web Services
  • Google

Hittar du inte det du letar efter?

Nya färdiga datamängder samlas in för alla datatyper

Kontakta oss nu för att släppa dina bekymmer för insamling av ljud-/talträningsdata

  • Detta fält är för validering och bör lämnas oförändrad.
  • Genom att registrera mig godkänner jag Shaip Integritetspolicy och Användarvillkor och ge mitt samtycke till att ta emot B2B marknadsföringskommunikation från Shaip.