Taldatauppsättning

Wake Word indisk engelska datauppsättning

Indisk engelska datauppsättning

Indisk engelska Wake Word-dataset av hög kvalitet för AI- och talmodeller

Wake Word indisk engelska datauppsättning

Översikt

  • SpråkEngelska
  • DatasettyperWake Word / Keyphrase
  • LandIndisk engelska

BESKRIVNING

Väckningsord / Röstkommando / Utlösarord / Nyckelfras insamling av data 50 talare 4 unik nyckelfras per talare 10 ljudfiler per unik nyckelfras 40 inspelade yttranden totalt per talare

Dataset Höjdpunkter

  • SpråkEngelska
  • Samplingshastighet16 kHz
  • Totalt antal timmar2,000 XNUMX ljud
  • högtalare50+
  • Kanaler1 kanal

Use Cases

  • Wake Word Detektion
  • Röstkommando och utlösare
  • Sökord Spotting
  • Handsfree-aktivering
  • Röstgränssnitt på enheten

Specifikationer för exempeldataset

Dataset typWake Word
Samplingshastighet16 kHz
högtalare50 högtalare
Kanal1 kanal
Totalt antal timmar2,000 XNUMX ljud
Totalt antal talare50

Fördelar

  • Mångsidig och representativBred talarbevakning för inkluderande, verklighetsbaserad AI.
  • Ljud av hög kvalitetRena, balanserade inspelningar för pålitlig modellprestanda.
  • Redo för AI/MLStrukturerad och kommenterad för sömlös integration.
  • Skalbar och flexibelFlera längder, talare och domäner för att passa dina behov.

Tekniska detaljer

  • InspelningsplattformMobile App
  • Ljudformat. WAV
  • Transkriptionsformat.json
  • VI ÄR (%)5
  • KönsfördelningKvinnor 50 %, män 50 %
  • Åldersgrupp18-50

Utvalda klienter

Betrott av ledande AI-team och företag världen över.

  • Microsoft
  • Amazon Web Services
  • Google

Hittar du inte det du letar efter?

Nya färdiga datamängder samlas in för alla datatyper

Kontakta oss nu för att släppa dina bekymmer för insamling av ljud-/talträningsdata

  • Detta fält är för validering och bör lämnas oförändrad.
  • Genom att registrera mig godkänner jag Shaip Integritetspolicy och Användarvillkor och ge mitt samtycke till att ta emot B2B marknadsföringskommunikation från Shaip.