Taldatauppsättning

USA japansk datauppsättning

Högkvalitativt amerikanskt och japanskt callcenter och yttringsdataset för AI- och talmodeller

USA japansk datauppsättning

Översikt

  • Språkamerikanska japanska
  • DatasettyperCallcenter, yttrande
  • LandUSA

BESKRIVNING

Denna datauppsättning innehåller oskriptade syntetiska agent-kund-telefonsamtal (5–15 minuter) och en yttrandedatauppsättning med korta talinspelningar, som erbjuder finkorniga data för träning och utvärdering av tal- och språkmodeller.

Dataset Höjdpunkter

  • Språkamerikanska japanska
  • Samplingshastighet8 kHz
  • Totalt antal timmar4:05:42
  • högtalare14+
  • KanalerDubbel
  • Varaktighetsintervall5–15 minuter

Use Cases

  • ASR (Automatisk taligenkänning)
  • Virtuella assistenter och chatbots
  • Konversations AI
  • Talanalys
  • TTS (Text-till-tal)
  • Språkmodellering

Specifikationer för exempeldataset

Dataset typCall CenterYttrande
Samplingshastighet8 kHz8 kHz
högtalare2 högtalare2 högtalare
KanalDubbelDubbel
Totalt antal timmar02:02:5102:02:51
Totalt antal talare122

Fördelar

  • Mångsidig och representativBred talarbevakning för inkluderande, verklighetsbaserad AI.
  • Ljud av hög kvalitetRena, balanserade inspelningar för pålitlig modellprestanda.
  • Redo för AI/MLStrukturerad och kommenterad för sömlös integration.
  • Skalbar och flexibelFlera längder, talare och domäner för att passa dina behov.

Utvalda klienter

Betrott av ledande AI-team och företag världen över.

  • Microsoft
  • Amazon Web Services
  • Google

Hittar du inte det du letar efter?

Nya färdiga datamängder samlas in för alla datatyper

Kontakta oss nu för att släppa dina bekymmer för insamling av ljud-/talträningsdata

  • Detta fält är för validering och bör lämnas oförändrad.
  • Genom att registrera mig godkänner jag Shaip Integritetspolicy och Användarvillkor och ge mitt samtycke till att ta emot B2B marknadsföringskommunikation från Shaip.