Taldatauppsättning

Dataset för indianer

Högkvalitativt callcenter för infödda indianska indianer, yttrandedataset för AI och talmodeller

Dataset för indianer

Översikt

  • SpråkInfödd indian
  • DatasettyperCallcenter, yttrande
  • LandIndien

BESKRIVNING

Denna datauppsättning innehåller oskriptade, syntetiska telefonsamtal mellan Talare 1 och Talare 2 (5–15 minuter), tillsammans med inspelningar på yttrandenivå för detaljerad talanalys.

Dataset Höjdpunkter

  • SpråkInfödd indian
  • Samplingshastighet8 kHz
  • Totalt antal timmar81:36:24
  • högtalare142+
  • KanalerDubbel
  • Varaktighetsintervall5–15 minuter

Use Cases

  • ASR (Automatisk taligenkänning)
  • Virtuella assistenter och chatbots
  • Konversations AI
  • Talanalys
  • TTS (Text-till-tal)
  • Språkmodellering

Specifikationer för exempeldataset

Dataset typCall CenterYttrande
Samplingshastighet8 kHz8 kHz
högtalare2 högtalare2 högtalare
KanalDubbelDubbel
Totalt antal timmar40:48:1240:48:12
Totalt antal talare1357

Fördelar

  • Mångsidig och representativBred talarbevakning för inkluderande, verklighetsbaserad AI.
  • Ljud av hög kvalitetRena, balanserade inspelningar för pålitlig modellprestanda.
  • Redo för AI/MLStrukturerad och kommenterad för sömlös integration.
  • Skalbar och flexibelFlera längder, talare och domäner för att passa dina behov.

Utvalda klienter

Betrott av ledande AI-team och företag världen över.

  • Microsoft
  • Amazon Web Services
  • Google

Hittar du inte det du letar efter?

Nya färdiga datamängder samlas in för alla datatyper

Kontakta oss nu för att släppa dina bekymmer för insamling av ljud-/talträningsdata

  • Detta fält är för validering och bör lämnas oförändrad.
  • Genom att registrera mig godkänner jag Shaip Integritetspolicy och Användarvillkor och ge mitt samtycke till att ta emot B2B marknadsföringskommunikation från Shaip.