നിങ്ങളുടെ AI-യ്ക്കുള്ള ഏറ്റവും വിശ്വസനീയമായ സംഭാഷണ ഡാറ്റ ശേഖരണ സേവനങ്ങൾ

ഞങ്ങളുടെ ഓഡിയോ, സംഭാഷണ ഡാറ്റാ ശേഖരണ സേവനങ്ങൾ ഉപയോഗിച്ച് ഗുണനിലവാരമുള്ള സംഭാഷണ ഡാറ്റ ഉപയോഗിച്ച് നിങ്ങളുടെ NLP മോഡലുകൾ, VA-കൾ, TTS പ്രോട്ടോടൈപ്പുകൾ എന്നിവയും മറ്റും പരിശീലിപ്പിക്കുക

സംഭാഷണ ഡാറ്റ ശേഖരണം
രാജ്യങ്ങൾ
0 +
മണിക്കൂറുകൾ
സംഭാഷണ ഡാറ്റ
0 +
പ്രോജക്ടുകൾ
0 +
ഭാഷകൾ (100+ ഭാഷാഭേദങ്ങൾ)
0 +

8 / 16 / 44 / 48 kHz

സാമ്പിൾ നിരക്ക്

പ്രൊഫഷണൽ ഓഡിയോ / വോയ്സ് ഡാറ്റ ശേഖരണ സേവനങ്ങൾ

ഏതെങ്കിലും വിഷയം. ഏത് സാഹചര്യവും.

Shaip-ൽ, വ്യത്യസ്‌ത AI/ML ആവശ്യകതകൾക്കായി രൂപകൽപ്പന ചെയ്‌തിരിക്കുന്ന ഉയർന്ന നിലവാരമുള്ള സംഭാഷണ ഡാറ്റാസെറ്റുകൾ സൃഷ്‌ടിക്കുന്നതിലാണ് ഞങ്ങളുടെ വൈദഗ്ധ്യം. ഞങ്ങളുടെ ഡാറ്റാസെറ്റുകളെ സമഗ്രവും അനുയോജ്യവുമാക്കുന്ന തരത്തിൽ വൈവിധ്യമാർന്ന ക്രമീകരണങ്ങളിൽ ഞങ്ങൾ വിപുലമായ ഭാഷകളും റെക്കോർഡുകളും വാഗ്ദാനം ചെയ്യുന്നു. ഏറ്റവും കുറഞ്ഞ സമയത്തിനുള്ളിൽ, ഇഷ്‌ടാനുസൃത സംഭാഷണ ഡാറ്റയുടെ ഏറ്റവും ഉയർന്ന അളവിലുള്ള മോഡലുകൾക്ക് ഭക്ഷണം നൽകുന്നതിലാണ് ഞങ്ങളുടെ ശ്രദ്ധ. ഞങ്ങളോടൊപ്പം, നിങ്ങൾക്ക് പ്രതീക്ഷിക്കാം: 

പ്രസംഗ ശേഖരം
  • കൃത്യത മെച്ചപ്പെടുത്തുന്നതിന് ഉയർന്ന നിലവാരമുള്ള ബഹുഭാഷാ ഓഡിയോ / വോയ്‌സ് ഡാറ്റ ക്യൂറേറ്റുചെയ്‌തു
  • വൈവിധ്യമാർന്ന സാഹചര്യ സജ്ജീകരണം ടാർഗെറ്റുചെയ്യുന്നതിന് സാധ്യമായ ഏറ്റവും ഉയർന്ന ഡൊമെയ്ൻ സ്പെസിഫിറ്റി
  • വൈവിധ്യമാർന്ന ജനസംഖ്യാശാസ്‌ത്രത്തിനും ലംബങ്ങൾക്കും അനുയോജ്യമായ രീതിയിൽ നിങ്ങളുടെ ML മോഡൽ സ്‌കെയിൽ ചെയ്യുക
  • റെക്കോർഡിംഗ് പരിതസ്ഥിതികൾ: സ്റ്റുഡിയോ നിലവാരം, കുറഞ്ഞ പശ്ചാത്തല ശബ്ദത്തോടെ ക്രിസ്റ്റൽ ക്ലിയർ ഓഡിയോ ഫീച്ചർ ചെയ്യുന്നു, & പ്രകൃതി പരിസ്ഥിതികൾ, യഥാർത്ഥ ലോക സാഹചര്യങ്ങളെ അനുകരിക്കുന്നതിനായി ആംബിയന്റ് ശബ്ദങ്ങൾ റെക്കോർഡിംഗുകൾ ഉൾക്കൊള്ളുന്നു.

ഞങ്ങളുടെ വൈദഗ്ദ്ധ്യം

മികച്ച NLP മോഡലുകൾക്കായി ഓഡിയോ ഡാറ്റ വിന്യസിക്കുക

ലോകമെമ്പാടുമുള്ള വൈവിധ്യമാർന്ന പ്രേക്ഷകരെ തൃപ്തിപ്പെടുത്തുന്നതിന് വോയ്‌സ് പ്രാപ്‌തമാക്കിയ സാങ്കേതികവിദ്യകൾ പ്രാപ്‌തമാക്കുന്നതിന് 100+ ഭാഷകളിൽ എൻഡ്-ടു-എൻഡ് സ്പീച്ച്/ഓഡിയോ ഡാറ്റ ശേഖരണ സേവനങ്ങൾ Shaip വാഗ്ദാനം ചെയ്യുന്നു. ഏത് വ്യാപ്തിയിലും വലുപ്പത്തിലും ഉള്ള പ്രോജക്ടുകളിൽ ഞങ്ങൾക്ക് പ്രവർത്തിക്കാൻ കഴിയും; നിലവിലുള്ള ഓഫ്-ദി-ഷെൽഫ് ഓഡിയോ ഡാറ്റാസെറ്റുകൾക്ക് ലൈസൻസ് നൽകുന്നത് മുതൽ ഇഷ്‌ടാനുസൃത ഓഡിയോ ഡാറ്റ ശേഖരണം നിയന്ത്രിക്കുന്നത് വരെ, ഓഡിയോ ട്രാൻസ്ക്രിപ്ഷനും വ്യാഖ്യാനവും വരെ. നിങ്ങളുടെ സംഭാഷണ ഡാറ്റ ശേഖരണ പ്രോജക്റ്റ് എത്ര വലുതാണെങ്കിലും, പ്രാദേശിക ഭാഷകൾ, ടോണുകൾ, ഭാഷകൾ എന്നിവ ടാർഗെറ്റുചെയ്യുന്ന ഉയർന്ന നിലവാരമുള്ള NLP ഡാറ്റാസെറ്റുകൾ നിർമ്മിക്കുന്നതിന് നിങ്ങളുടെ ആവശ്യങ്ങൾക്ക് അനുയോജ്യമായ രീതിയിൽ ഓഡിയോ ശേഖരണ സേവനങ്ങൾ ഞങ്ങൾക്ക് ഇഷ്ടാനുസൃതമാക്കാനാകും. വോയ്‌സ് പ്രവർത്തനക്ഷമമാക്കുന്ന ഇന്റലിജന്റ് സജ്ജീകരണങ്ങൾക്കായി ഞങ്ങളുടെ വിശാലമായ സംഭാഷണ ഡാറ്റാസെറ്റുകളിൽ നിന്നും ഓഡിയോ ഡാറ്റ ശേഖരണ ഉറവിടങ്ങളിൽ നിന്നും തിരഞ്ഞെടുക്കുക.

മോണോലോഗ് പ്രസംഗം

മോണോലോഗ് സ്‌ക്രിപ്റ്റഡ് & സ്വതസിദ്ധമായ സംഭാഷണം

ഒരൊറ്റ സ്പീക്കറിൽ നിന്നുള്ള സംഭാഷണം പ്രോസസ്സ് ചെയ്യുന്നതിൽ ഇത് ശ്രദ്ധ കേന്ദ്രീകരിക്കുന്നു. സിംഗിൾ-ചാനൽ ഓഡിയോ ഫയലുകളിലേക്ക് ഫീഡ് ചെയ്യാൻ സ്‌ക്രിപ്റ്റ് ചെയ്‌ത നിർദ്ദേശങ്ങൾ പ്രയോജനപ്പെടുത്തുക, അതുല്യമായ സംഭാഷണ പാറ്റേണുകൾ, ടോണുകൾ, ആ വ്യക്തിക്ക് പ്രത്യേകമായ സൂക്ഷ്മതകൾ എന്നിവ പിടിച്ചെടുക്കുന്നത് ഉറപ്പാക്കുന്നു.

ഡയലോഗ് പ്രസംഗം

ഡയലോഗ് സ്ക്രിപ്റ്റഡ് & സ്വതസിദ്ധമായ സംഭാഷണം

ഇരട്ട-ചാനൽ ഫയലുകളും ട്രാൻസ്‌ക്രൈബ് ചെയ്‌ത ഉറവിടങ്ങളും വഴി ബഹുഭാഷാ എക്‌സ്‌പോഷർ ഉപയോഗിച്ച് യഥാർത്ഥ ലോക സംഭാഷണങ്ങളും ഡയലോഗുകളും ആവർത്തിക്കുന്ന രണ്ട് വ്യക്തികളുടെ ഇടപെടൽ.

ഒന്നിലധികം പാർട്ടി സംഭാഷണങ്ങൾ

ഗ്രൂപ്പ് / മ്യൂട്ടി പാർട്ടി
സംഭാഷണങ്ങൾ

സംഭാഷണ മാതൃകകളെ കൃത്യമായി പരിശീലിപ്പിക്കുന്നതിനായി ഒന്നിലധികം വ്യക്തി ചർച്ചകൾ, ഗ്രൂപ്പ് ഡൈനാമിക്‌സ്, ഓവർലാപ്പുകൾ, വൈവിധ്യമാർന്ന ടോണുകൾ എന്നിവ ക്യാപ്ചർ ചെയ്യുന്നു.

വേക്ക്-വേഡ് ഉച്ചാരണ ശേഖരം

വേക്ക്-വേഡ് / കീ പദപ്രയോഗം / ഉച്ചാരണ ശേഖരം

നൂതനമായ സ്വാഭാവിക ഭാഷാ സംസ്കരണത്തിനും മനസ്സിലാക്കലിനും വേണ്ടി വൈവിധ്യമാർന്നതും സമ്പന്നവും ആധികാരികവുമായ ഉച്ചാരണങ്ങൾ ഉപയോഗിച്ച് സമാന അർത്ഥങ്ങളുള്ള പ്രധാന വാക്യങ്ങൾ തിരിച്ചറിയുന്നതിനോ വാക്കുകളോ ഉച്ചാരണങ്ങളോ ഉണർത്തുന്നതിനോ AI-കളെ പരിശീലിപ്പിക്കുക.

അക്കോസ്റ്റിക് പ്രസംഗം

അക്കോസ്റ്റിക് ഡാറ്റ
ശേഖരണം

റെസ്റ്റോറന്റുകളോ ഓഫീസുകളോ വീടുകളോ അല്ലെങ്കിൽ വിവിധ പരിതസ്ഥിതികളിൽ നിന്നും ഭാഷകളിൽ നിന്നുമുള്ള സ്റ്റുഡിയോ നിലവാരമുള്ള ഓഡിയോ ഡാറ്റ ഞങ്ങൾക്ക് പ്രൊഫഷണലായി റെക്കോർഡ് ചെയ്യാൻ കഴിയും, അതേസമയം വിശാലമായ ശബ്ദ ശ്രേണി (സമഗ്ര ശബ്ദ ഡാറ്റാസെറ്റുകൾ) ഉൾക്കൊള്ളുന്നു.

യാന്ത്രിക സംഭാഷണ തിരിച്ചറിയൽ

ഓട്ടോമാറ്റിക് സ്പീച്ച് റെക്കഗ്നിഷൻ (എഎസ്ആർ)

ജനസംഖ്യാശാസ്‌ത്രത്തിന്റെ വിപുലമായ ശ്രേണിയിൽ നിന്ന് അത്യാധുനിക വൈവിദ്ധ്യമുള്ള സംഭാഷണ/ഓഡിയോ ഡാറ്റാസെറ്റുകളിലേക്ക് ആക്‌സസ്സ് ഉപയോഗിച്ച് നിങ്ങളുടെ ഓട്ടോമാറ്റിക് സ്‌പീച്ച് റെക്കഗ്‌നിഷൻ (എഎസ്ആർ) സിസ്റ്റങ്ങളുടെ കൃത്യത മെച്ചപ്പെടുത്തുക.

സ്വാഭാവിക ഭാഷാ ഉച്ചാരണം

ബഹുഭാഷാ സംഭാഷണ/ഓഡിയോ പരിശീലന ഡാറ്റ

ലോകമെമ്പാടുമുള്ള ഞങ്ങളുടെ വിദഗ്ദ്ധരായ ഭാഷാ പ്രൊഫഷണലുകൾ വിവിധ ഭാഷകളിലും ഭാഷകളിലും ബഹുഭാഷാ ഓഡിയോ/സംഭാഷണ ഡാറ്റ വാഗ്ദാനം ചെയ്യുന്നു. ഈ ശ്രമം ആഗോള ആശയവിനിമയം പ്രോത്സാഹിപ്പിക്കുകയും ഭാഷാ തടസ്സങ്ങളെ മറികടക്കുകയും ചെയ്യുന്നു, കൂടുതൽ ഉൾക്കൊള്ളുന്നതും ഫലപ്രദവുമായ AI പരിഹാരങ്ങൾക്ക് സംഭാവന നൽകുന്നു.

ഡിജിറ്റൽ വെർച്വൽ അസിസ്റ്റൻ്റുകൾ

ടെക്സ്റ്റ്-ടു-സ്പീച്ച്
(ടിടിഎസ്)

നിങ്ങളുടെ AI മോഡലുകൾ ഇൻ-കാർ നിയന്ത്രണങ്ങൾ മുതൽ ചാറ്റ്‌ബോട്ടുകൾ വരെ വർധിപ്പിക്കുന്നതിന് 150+ ഭാഷകളിലും ഭാഷകളിലും സംഭാഷണ ഡാറ്റ ശേഖരിക്കാൻ നിങ്ങളെ സഹായിക്കുന്ന ഞങ്ങളുടെ ആഗോള തൊഴിൽ ശക്തിയുടെ സഹായത്തോടെ ഒരു ടെക്‌സ്‌റ്റ്-ടു-സ്പീച്ച് (TTS) ബഹുഭാഷാ മോഡൽ നിർമ്മിക്കുക. നിലവാരമുള്ള ഓഡിയോ ഡാറ്റ.

കോൾ സെൻ്റർ റെക്കോർഡിംഗുകൾ

കോൾ സെന്റർ
സംഭാഷണങ്ങൾ

സ്പാനിഷ്, ജർമ്മൻ, അമേരിക്കൻ ഇംഗ്ലീഷ്, ബംഗാളി, ജാപ്പനീസ്, ചൈനീസ്, ഹിന്ദി തുടങ്ങിയ നിരവധി ഭാഷകളെ പിന്തുണയ്ക്കുന്ന, ഏജന്റുമാരും ക്ലയന്റുകളും തമ്മിലുള്ള യഥാർത്ഥ കൈമാറ്റം.

വിജയ കഥകൾ

3 ഭാഷകളിലായി 8k മണിക്കൂറിലധികം ഡാറ്റയുള്ള സംഭാഷണ AI ഡാറ്റാസെറ്റുകൾ

ഇന്ത്യൻ ഭാഷകൾക്കായി ഒരു ബഹുഭാഷാ പ്ലാറ്റ്‌ഫോം നിർമ്മിക്കാൻ നോക്കുമ്പോൾ, ഒന്നിലധികം ഇന്ത്യൻ ഭാഷകളിലുള്ള വലിയ ഡാറ്റാസെറ്റുകൾ ശേഖരിക്കുന്നതിനും വിഭജിക്കുന്നതിനും ട്രാൻസ്‌ക്രൈബ് ചെയ്യുന്നതിനും ക്ലയൻ്റ് ഷായ്‌പ്പുമായി സഹകരിച്ചു. ക്ലയൻ്റിൻ്റെ നൂതനമായ പുതിയ പ്ലാറ്റ്‌ഫോമിനെ ശക്തിപ്പെടുത്താൻ കഴിയുന്ന ഫലപ്രദമായ സംഭാഷണ മാതൃകകൾ വികസിപ്പിക്കാൻ ഇത് സഹായിക്കും.

പ്രശ്നം: 8 ഇന്ത്യൻ ഭാഷകളിലായി 3,000 മണിക്കൂറിലധികം ഓഡിയോ ഡാറ്റ ശേഖരിച്ചു, ഓട്ടോമാറ്റിക് സ്പീച്ച് റെക്കഗ്നിഷൻ വികസിപ്പിക്കുന്നതിനായി വേർതിരിച്ച് ട്രാൻസ്ക്രൈബ് ചെയ്തു.

പരിഹാരം: ഞങ്ങൾ ഡാറ്റ ശേഖരണം, സെഗ്മെന്റേഷൻ, ട്രാൻസ്ക്രിപ്ഷൻ എന്നിവ നൽകി, മെറ്റാഡാറ്റയോടുകൂടിയ JSON ഫയലുകൾ വിതരണം ചെയ്തു. ക്ലയന്റിന്റെ സ്പീച്ച് ടെക്നോളജി പ്രോജക്റ്റിനായി 8 ഇന്ത്യൻ ഭാഷകളിലായി 3000 മണിക്കൂർ ഓഡിയോ ഡാറ്റ ഞങ്ങൾ സ്കെയിലിൽ ശേഖരിച്ചു.

സംഭാഷണ ഡാറ്റ ശേഖരണ കേസ് പഠനം

നിങ്ങളുടെ വിശ്വസനീയമായ സംഭാഷണ ഡാറ്റ ശേഖരണ പങ്കാളിയായി ഷൈപ്പിനെ തിരഞ്ഞെടുക്കാനുള്ള കാരണങ്ങൾ

ആളുകൾ

ആളുകൾ

സമർപ്പിതവും പരിശീലനം ലഭിച്ചതുമായ ടീമുകൾ:

  • ഡാറ്റ സൃഷ്‌ടിക്കുന്നതിനും ലേബലിംഗ് ചെയ്യുന്നതിനും ക്യുഎയ്‌ക്കുമായി 30,000+ സഹകാരികൾ
  • യോഗ്യതയുള്ള പ്രോജക്ട് മാനേജ്മെന്റ് ടീം
  • പരിചയസമ്പന്നരായ ഉൽപ്പന്ന വികസന ടീം
  • ടാലന്റ് പൂൾ സോഴ്‌സിംഗ് & ഓൺബോർഡിംഗ് ടീം
പ്രോസസ്സ്

പ്രോസസ്സ്

ഏറ്റവും ഉയർന്ന പ്രോസസ്സ് കാര്യക്ഷമത ഉറപ്പുനൽകുന്നു:

  • കരുത്തുറ്റ 6 സിഗ്മ സ്റ്റേജ്-ഗേറ്റ് പ്രക്രിയ
  • 6 സിഗ്മ ബ്ലാക്ക് ബെൽറ്റുകളുടെ ഒരു സമർപ്പിത ടീം - പ്രധാന പ്രോസസ്സ് ഉടമകളും ഗുണനിലവാരം പാലിക്കലും
  • തുടർച്ചയായ മെച്ചപ്പെടുത്തലും ഫീഡ്‌ബാക്ക് ലൂപ്പും
പ്ലാറ്റ്ഫോം

പ്ലാറ്റ്ഫോം

പേറ്റന്റ് നേടിയ പ്ലാറ്റ്ഫോം ആനുകൂല്യങ്ങൾ വാഗ്ദാനം ചെയ്യുന്നു:

  • വെബ് അധിഷ്ഠിത എൻഡ്-ടു-എൻഡ് പ്ലാറ്റ്ഫോം
  • കുറ്റമറ്റ ഗുണനിലവാരം
  • വേഗതയേറിയ TAT
  • തടസ്സമില്ലാത്ത ഡെലിവറി

ഓഫ്-ദി-ഷെൽഫ് സ്പീച്ച് / ഓഡിയോ ഡാറ്റാസെറ്റുകൾ

ഭാഷാ ഡാറ്റാസെറ്റ്സാമ്പിൾ നിരക്ക്ഡാറ്റാസെറ്റ് തരംമൊത്തം ഓഡിയോ സമയം
+ആഫ്രിക്കൻ അമേരിക്കൻ പ്രാദേശിക ഭാഷക്സനുമ്ക്സ ഹേർട്സ്കോൾ-സെന്റർ211
ഹൃസ്വ വിവരണംആഫ്രിക്കൻ അമേരിക്കൻ വെർണാക്കുലർ കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ: 612, പുരുഷന്മാർ: 1242, അജ്ഞാതർ: 12
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്154
ഹൃസ്വ വിവരണംആഫ്രിക്കൻ അമേരിക്കൻ വെർണാക്കുലർ മീഡിയ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ: 151, പുരുഷന്മാർ: 150, അജ്ഞാതർ: 10
+ആഫ്രിക്കാൻസ്ക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം368
ഹൃസ്വ വിവരണംആഫ്രിക്കാൻസ് പൊതു സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംസ്ക്രിപ്റ്റ് ചെയ്യാത്ത രണ്ട് പേരുടെ ടെലിഫോൺ സംഭാഷണം. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) - 15-60 മിനിറ്റ്, ആഫ്രിക്കയിൽ സംസാരിക്കുന്ന ആഫ്രിക്കാൻസ്.
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ: 502, പുരുഷന്മാർ: 390, അജ്ഞാതർ: 2
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്658
ഹൃസ്വ വിവരണംആഫ്രിക്കാൻസ് മീഡിയ ഫയലുകൾ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ: 750, പുരുഷന്മാർ: 1278, അജ്ഞാതർ: 52
+അറബിക്ക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം292
ഹൃസ്വ വിവരണംഅറബിക് പൊതു സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംസ്ക്രിപ്റ്റ് ചെയ്യാത്ത രണ്ട് പേരുടെ ടെലിഫോൺ സംഭാഷണം. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) - 15-60 മിനിറ്റ്, ഗൾഫ് രാജ്യങ്ങളിൽ നിന്നുള്ള അറബിക്.
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ: 171, പുരുഷന്മാർ: 534, അജ്ഞാതർ: 1
+ക്സനുമ്ക്സ ഹേർട്സ്സ്ക്രിപ്റ്റഡ് മോണോലോഗ്1,947
ഹൃസ്വ വിവരണംഅറബി ലിപിയിലുള്ള മോണോലോഗ്
ഡാറ്റാസെറ്റ് വിവരണം5 മുതൽ 30 സെക്കൻഡ് വരെയുള്ള ശ്രേണിയിൽ വരുന്ന ഒറ്റ-ഉച്ചാരണ റെക്കോർഡിംഗുകൾ
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംമൊബൈൽ അപ്ലിക്കേഷൻ
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 838 പുരുഷൻ 1209 അജ്ഞാതം 78
+ആസാമീസ് (പൈപ്പ്‌ലൈനിൽ) കോൾ സെന്റർ60
ഹൃസ്വ വിവരണംഅസമീസ് (പൈപ്പ്‌ലൈനിൽ) കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പൊതു സംഭാഷണം100
ഹൃസ്വ വിവരണംഅസമീസ് (പൈപ്പ്‌ലൈനിൽ) പൊതുവായ സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പോഡ്കാസ്റ്റ്40
ഹൃസ്വ വിവരണംഅസമീസ് (പൈപ്പ്‌ലൈനിൽ) മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+ബംഗാളി (പൈപ്പ്‌ലൈനിൽ) കോൾ സെന്റർ60
ഹൃസ്വ വിവരണംബംഗാളി (പൈപ്പ്‌ലൈനിൽ) കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പൊതു സംഭാഷണം100
ഹൃസ്വ വിവരണംബംഗാളി (പൈപ്പ്‌ലൈനിൽ) പൊതുവായ സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പോഡ്കാസ്റ്റ്40
ഹൃസ്വ വിവരണംബംഗാളി (പൈപ്പ്‌ലൈനിൽ) മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+ബോസ്റ്റൺ ഇംഗ്ലീഷ്ക്സനുമ്ക്സ ഹേർട്സ്കോൾ സെന്റർ177
ഹൃസ്വ വിവരണംബോസ്റ്റൺ കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ: 605, പുരുഷന്മാർ: 711, അജ്ഞാതർ: 0
+ക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം32
ഹൃസ്വ വിവരണംബോസ്റ്റൺ ജനറൽ സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംരണ്ട് പേർ തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത ടെലിഫോൺ സംഭാഷണം. ഏകദേശം ഓഡിയോ ദൈർഘ്യം (പരിധി) - 15-60 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ: 53, പുരുഷന്മാർ: 83, അജ്ഞാതർ: 0
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്93
ഹൃസ്വ വിവരണംബോസ്റ്റൺ മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ: 43, പുരുഷന്മാർ: 181, അജ്ഞാതർ: 2
+കനേഡിയൻ ഫ്രഞ്ച്ക്സനുമ്ക്സ ഹേർട്സ്സ്ക്രിപ്റ്റഡ് മോണോലോഗ്1,222
ഹൃസ്വ വിവരണംകനേഡിയൻ ഫ്രഞ്ച്
ഡാറ്റാസെറ്റ് വിവരണം5 മുതൽ 30 സെക്കൻഡ് വരെയുള്ള ശ്രേണിയിൽ വരുന്ന ഒറ്റ-ഉച്ചാരണ റെക്കോർഡിംഗുകൾ
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംമൊബൈൽ അപ്ലിക്കേഷൻ
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 974 പുരുഷൻ 631 അജ്ഞാതം 1
+ചൈനീസ് ഇംഗ്ലീഷ്ക്സനുമ്ക്സ ഹേർട്സ്കോൾ സെന്റർ169
ഹൃസ്വ വിവരണംചൈനീസ് കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ: 1790, പുരുഷന്മാർ: 523, അജ്ഞാതർ: 13
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്249
ഹൃസ്വ വിവരണംചൈനീസ് മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ: 126, പുരുഷന്മാർ: 346, അജ്ഞാതർ: 6
+ചൈനീസ് ലളിതംക്സനുമ്ക്സ ഹേർട്സ്സ്ക്രിപ്റ്റഡ് മോണോലോഗ്2,762
ഹൃസ്വ വിവരണംചൈനീസ് ലളിതം
ഡാറ്റാസെറ്റ് വിവരണം5 മുതൽ 30 സെക്കൻഡ് വരെയുള്ള ശ്രേണിയിൽ വരുന്ന ഒറ്റ-ഉച്ചാരണ റെക്കോർഡിംഗുകൾ
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംമൊബൈൽ അപ്ലിക്കേഷൻ
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 1920 പുരുഷൻ 1535 അജ്ഞാതം 270
+ചൈനീസ് പാരമ്പര്യമായക്സനുമ്ക്സ ഹേർട്സ്സ്ക്രിപ്റ്റഡ് മോണോലോഗ്1,028
ഹൃസ്വ വിവരണംചൈനീസ് പാരമ്പര്യമായ
ഡാറ്റാസെറ്റ് വിവരണം5 മുതൽ 30 സെക്കൻഡ് വരെയുള്ള ശ്രേണിയിൽ വരുന്ന ഒറ്റ-ഉച്ചാരണ റെക്കോർഡിംഗുകൾ
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംമൊബൈൽ അപ്ലിക്കേഷൻ
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 1069 പുരുഷൻ 262 അജ്ഞാതം 3
+ഡാനിഷ്ക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം372
ഹൃസ്വ വിവരണംഡാനിഷ് പൊതു സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംരണ്ട് പേർ തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത ടെലിഫോൺ സംഭാഷണം. ഏകദേശം ഓഡിയോ ദൈർഘ്യം (പരിധി) - 15-60 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ: 311, പുരുഷന്മാർ: 417, അജ്ഞാതർ: 0
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്664
ഹൃസ്വ വിവരണംഡാനിഷ് മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ: 369, പുരുഷന്മാർ: 864, അജ്ഞാതർ: 27
+ക്സനുമ്ക്സ ഹേർട്സ്സ്ക്രിപ്റ്റഡ് മോണോലോഗ്2,579
ഹൃസ്വ വിവരണംഡാനിഷ് സ്ക്രിപ്റ്റഡ് മോണോലോഗ്
ഡാറ്റാസെറ്റ് വിവരണം5 മുതൽ 30 സെക്കൻഡ് വരെ ദൈർഘ്യമുള്ള ഒറ്റ-ഉച്ചാരണ റെക്കോർഡിംഗുകൾ, ഡെൻമാർക്കിൽ നിന്നുള്ള ഡാനിഷ്
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംമൊബൈൽ അപ്ലിക്കേഷൻ
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 1551 പുരുഷൻ 1233 അജ്ഞാതം 42
+ഇംഗ്ലീഷ് ഡീപ് സൗത്ത്ക്സനുമ്ക്സ ഹേർട്സ്കോൾ സെന്റർ151
ഹൃസ്വ വിവരണംഇംഗ്ലീഷ് ഡീപ് സൗത്ത് കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 221 , പുരുഷൻ 1004 , അജ്ഞാതം 7
+ക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം56
ഹൃസ്വ വിവരണംഇംഗ്ലീഷ് ഡീപ് സൗത്ത് ജനറൽ സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംരണ്ട് പേർ തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത ടെലിഫോൺ സംഭാഷണം. ഏകദേശം ഓഡിയോ ദൈർഘ്യം (പരിധി) - 15-60 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 99, പുരുഷൻ 31, അജ്ഞാതം 0
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്266
ഹൃസ്വ വിവരണംഇംഗ്ലീഷ് ഡീപ് സൗത്ത് മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 204, പുരുഷൻ 356, അജ്ഞാതം 21
+ജർമ്മൻക്സനുമ്ക്സ ഹേർട്സ്കോൾ സെന്റർ64
ഹൃസ്വ വിവരണംജർമ്മൻ കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 478 പുരുഷൻ 1440 അജ്ഞാതം 0
+ക്സനുമ്ക്സ ഹേർട്സ് IVR200
ഹൃസ്വ വിവരണംജർമ്മൻ IVR ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംമനുഷ്യനിൽ നിന്ന് മെഷീനിലേക്ക്. ഒരു IVR തരം ഫ്ലോ, അതിൽ ഒരു TTS പ്രോംപ്റ്റ് (ഉദാ. "ഞാൻ നിങ്ങളെ എങ്ങനെ സഹായിക്കാം") തുടർന്ന് ഒരു സ്വാഭാവിക മനുഷ്യ പ്രതികരണം ഉണ്ടാകും.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 10115 പുരുഷൻ 8750 അജ്ഞാതം 0
+ഗുജറാത്തി (പൈപ്പ്‌ലൈനിൽ) കോൾ സെന്റർ60
ഹൃസ്വ വിവരണംഗുജറാത്തി (പൈപ്പ്‌ലൈനിൽ) കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പൊതു സംഭാഷണം100
ഹൃസ്വ വിവരണംഗുജറാത്തി (പൈപ്പ്‌ലൈനിൽ) പൊതു സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പോഡ്കാസ്റ്റ്40
ഹൃസ്വ വിവരണംഗുജറാത്തി (പൈപ്പ്‌ലൈനിൽ) മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+ഹീബ്രുക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം399
ഹൃസ്വ വിവരണംഹീബ്രു പൊതു സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംസ്ക്രിപ്റ്റ് ചെയ്യാത്ത രണ്ട് പേരുടെ ടെലിഫോൺ സംഭാഷണം. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) - 15-60 മിനിറ്റ്, ഇസ്രായേലിലെ ഹീബ്രു.
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 414 , പുരുഷൻ 399 , അജ്ഞാതം 1
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്427
ഹൃസ്വ വിവരണംഹീബ്രു മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 361, പുരുഷൻ 513, അജ്ഞാതം 13
+ഹിന്ദിക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്219
ഹൃസ്വ വിവരണംഹിന്ദി മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 83, പുരുഷൻ 309, അജ്ഞാതം 0
+ക്സനുമ്ക്സ ഹേർട്സ്സ്ക്രിപ്റ്റഡ് മോണോലോഗ്2,867
ഹൃസ്വ വിവരണംഹിന്ദി തിരക്കഥാകൃത്തായ മോണോലോഗ്
ഡാറ്റാസെറ്റ് വിവരണം5 മുതൽ 30 സെക്കൻഡ് വരെയുള്ള ശ്രേണിയിൽ വരുന്ന ഒറ്റ-ഉച്ചാരണ റെക്കോർഡിംഗുകൾ
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംമൊബൈൽ അപ്ലിക്കേഷൻ
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 1977 പുരുഷൻ 1864 അജ്ഞാതം 147
+ഹിംഗ്ലീഷ്ക്സനുമ്ക്സ ഹേർട്സ്കോൾ സെന്റർ208
ഹൃസ്വ വിവരണംഹിംഗ്ലിഷ് കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 822, പുരുഷൻ 1262, അജ്ഞാതം 0
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്216
ഹൃസ്വ വിവരണംഹിംഗ്ലിഷ് മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 75, പുരുഷൻ 380, അജ്ഞാതം 0
+ഹിസ്പാനിക് ഇംഗ്ലീഷ്ക്സനുമ്ക്സ ഹേർട്സ്കോൾ സെന്റർ212
ഹൃസ്വ വിവരണംഹിസ്പാനിക് കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 822, പുരുഷൻ 1262, അജ്ഞാതൻ 0
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്155
ഹൃസ്വ വിവരണംഹിസ്പാനിക് കോൾ മീഡിയ ഓഡിയോ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 140, പുരുഷൻ 219, അജ്ഞാതൻ 5
+ഇന്തോനേഷ്യൻക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം496
ഹൃസ്വ വിവരണംഇന്തോനേഷ്യൻ പൊതു സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംസ്ക്രിപ്റ്റ് ചെയ്യാത്ത രണ്ട് പേരുടെ ടെലിഫോൺ സംഭാഷണം. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) - 15-60 മിനിറ്റ്, ബഹാസ ഇന്തോനേഷ്യൻ
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 524, പുരുഷൻ 454, അജ്ഞാതൻ 2
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്643
ഹൃസ്വ വിവരണംഇന്തോനേഷ്യൻ മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 746, പുരുഷൻ 1507, അജ്ഞാതൻ 129
+ഐറിഷ്ക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം192
ഹൃസ്വ വിവരണംഐറിഷ് പൊതു സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംരണ്ട് പേർ തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത ടെലിഫോൺ സംഭാഷണം. ഏകദേശം ഓഡിയോ ദൈർഘ്യം (പരിധി) - 15-60 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 213 , പുരുഷൻ 153 , അജ്ഞാതം 0
+ജാപ്പനീസ്ക്സനുമ്ക്സ ഹേർട്സ്സ്ക്രിപ്റ്റഡ് മോണോലോഗ്2,335
ഹൃസ്വ വിവരണംജാപ്പനീസ് സ്ക്രിപ്റ്റഡ് മോണോലോഗ്
ഡാറ്റാസെറ്റ് വിവരണം5 മുതൽ 30 സെക്കൻഡ് വരെയുള്ള ശ്രേണിയിൽ വരുന്ന ഒറ്റ-ഉച്ചാരണ റെക്കോർഡിംഗുകൾ
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംമൊബൈൽ അപ്ലിക്കേഷൻ
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 1460 പുരുഷൻ 1221 അജ്ഞാതം 194
+കന്നഡ (പൈപ്പ്‌ലൈനിൽ) കോൾ സെന്റർ60
ഹൃസ്വ വിവരണംകന്നഡ (പൈപ്പ്‌ലൈനിൽ) കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പൊതു സംഭാഷണം100
ഹൃസ്വ വിവരണംകന്നഡ (പൈപ്പ്‌ലൈനിൽ) പൊതുവായ സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പോഡ്കാസ്റ്റ്40
ഹൃസ്വ വിവരണംകന്നഡ (പൈപ്പ്‌ലൈനിൽ) മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+കൊറിയൻക്സനുമ്ക്സ ഹേർട്സ്കോൾ സെന്റർ107
ഹൃസ്വ വിവരണംകൊറിയൻ കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 1086, പുരുഷൻ 210, അജ്ഞാതം 4
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്204
ഹൃസ്വ വിവരണംകൊറിയൻ മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 70 പുരുഷൻ 303, അജ്ഞാതം 25
+ക്സനുമ്ക്സ ഹേർട്സ്സ്ക്രിപ്റ്റഡ് മോണോലോഗ്1,955
ഹൃസ്വ വിവരണംകൊറിയൻ സ്ക്രിപ്റ്റഡ് മോണോലോഗ്
ഡാറ്റാസെറ്റ് വിവരണം5 മുതൽ 30 സെക്കൻഡ് വരെയുള്ള ശ്രേണിയിൽ വരുന്ന ഒറ്റ-ഉച്ചാരണ റെക്കോർഡിംഗുകൾ
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംമൊബൈൽ അപ്ലിക്കേഷൻ
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 1195 പുരുഷൻ 1134 അജ്ഞാതം 122
+മലായ്ക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം266
ഹൃസ്വ വിവരണംമലായ് പൊതു സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംസ്ക്രിപ്റ്റ് ചെയ്യാത്ത രണ്ട് പേരുടെ ടെലിഫോൺ സംഭാഷണം. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) - 15-60 മിനിറ്റ്, മലേഷ്യയിലെ മലായ്.
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 316, പുരുഷൻ 176, അജ്ഞാതം 0
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്344
ഹൃസ്വ വിവരണംമലായ് മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 236, പുരുഷൻ 626, അജ്ഞാതം 47
+മലയാളം (പൈപ്പ്‌ലൈനിൽ) കോൾ സെന്റർ60
ഹൃസ്വ വിവരണംമലയാളം (പൈപ്പ്‌ലൈനിൽ) കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പൊതു സംഭാഷണം100
ഹൃസ്വ വിവരണംമലയാളം (പൈപ്പ്‌ലൈനിൽ) പൊതുവായ സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പോഡ്കാസ്റ്റ്40
ഹൃസ്വ വിവരണംമലയാളം (പൈപ്പ്‌ലൈനിൽ) മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+മറാത്തി (പൈപ്പ്‌ലൈനിൽ) കോൾ സെന്റർ60
ഹൃസ്വ വിവരണംമറാത്തി (പൈപ്പ്‌ലൈനിൽ) കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പൊതു സംഭാഷണം100
ഹൃസ്വ വിവരണംമറാത്തി (പൈപ്പ്‌ലൈനിൽ) പൊതുവായ സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പോഡ്കാസ്റ്റ്40
ഹൃസ്വ വിവരണംമറാത്തി (പൈപ്പ്‌ലൈനിൽ) മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+സ്പാനിഷ് (മെക്സിക്കോ)ക്സനുമ്ക്സ ഹേർട്സ്സ്ക്രിപ്റ്റഡ് മോണോലോഗ്1,492
ഹൃസ്വ വിവരണംമെക്സിക്കൻ സ്പാനിഷ് സ്ക്രിപ്റ്റഡ് മോണോലോഗ്
ഡാറ്റാസെറ്റ് വിവരണം5 മുതൽ 30 സെക്കൻഡ് വരെയുള്ള ശ്രേണിയിൽ വരുന്ന ഒറ്റ-ഉച്ചാരണ റെക്കോർഡിംഗുകൾ
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംമൊബൈൽ അപ്ലിക്കേഷൻ
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 1016 പുരുഷൻ 1069 അജ്ഞാതം 95
+ഡച്ച്ക്സനുമ്ക്സ ഹേർട്സ്സ്ക്രിപ്റ്റഡ് മോണോലോഗ്1,205
ഹൃസ്വ വിവരണംഡച്ച് സ്ക്രിപ്റ്റഡ് മോണോലോഗ്
ഡാറ്റാസെറ്റ് വിവരണം5 മുതൽ 30 സെക്കൻഡ് വരെയുള്ള ശ്രേണിയിൽ വരുന്ന ഒറ്റ-ഉച്ചാരണ റെക്കോർഡിംഗുകൾ
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംമൊബൈൽ അപ്ലിക്കേഷൻ
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 1285 പുരുഷൻ 531 അജ്ഞാതം 3
+ന്യൂയോർക്ക് ഇംഗ്ലീഷ്ക്സനുമ്ക്സ ഹേർട്സ്കോൾ സെന്റർ103
ഹൃസ്വ വിവരണംന്യൂയോർക്ക് ഇംഗ്ലീഷ് കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 610, പുരുഷൻ 532, അജ്ഞാതം 0
+ക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം107
ഹൃസ്വ വിവരണംന്യൂയോർക്ക് ഇംഗ്ലീഷ് ജനറൽ സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംരണ്ട് പേർ തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത ടെലിഫോൺ സംഭാഷണം. ഏകദേശം ഓഡിയോ ദൈർഘ്യം (പരിധി) - 15-60 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 118, പുരുഷൻ 114, അജ്ഞാതൻ 0
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്140
ഹൃസ്വ വിവരണംന്യൂയോർക്ക് ഇംഗ്ലീഷ് മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 66, പുരുഷൻ 230, അജ്ഞാതൻ 11
+ന്യൂസിലാന്റ് ഇംഗ്ലീഷ് ക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം148
ഹൃസ്വ വിവരണംന്യൂസിലാൻഡ് ഇംഗ്ലീഷ് പൊതു സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംരണ്ട് പേർ തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത ടെലിഫോൺ സംഭാഷണം. ഏകദേശം ഓഡിയോ ദൈർഘ്യം (പരിധി) - 15-60 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ 167, പുരുഷന്മാർ 121, അജ്ഞാതർ 4
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്400
ഹൃസ്വ വിവരണംന്യൂസിലാൻഡ് ഇംഗ്ലീഷ് മീഡിയ ഓഡിയോ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ 367, പുരുഷന്മാർ 678, അജ്ഞാതർ 26
+ഒറിയ (പൈപ്പ്‌ലൈനിൽ) കോൾ സെന്റർ60
ഹൃസ്വ വിവരണംഒറിയ (പൈപ്പ്‌ലൈനിൽ) കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പൊതു സംഭാഷണം100
ഹൃസ്വ വിവരണംഒറിയ (പൈപ്പ്‌ലൈനിൽ) പൊതു സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പോഡ്കാസ്റ്റ്40
ഹൃസ്വ വിവരണംഒറിയ (പൈപ്പ്‌ലൈനിൽ) മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+മിനുക്കുകക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്269
ഹൃസ്വ വിവരണംപോളിഷ് മീഡിയ ഓഡിയോ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 173 പുരുഷൻ 354 അജ്ഞാതൻ 6
+പോളിഷ് (പോളണ്ട്)ക്സനുമ്ക്സ ഹേർട്സ്സ്ക്രിപ്റ്റഡ് മോണോലോഗ്1,482
ഹൃസ്വ വിവരണംപോളിഷ് പോളണ്ട് - സ്ക്രിപ്റ്റഡ് മോണോലോഗ്
ഡാറ്റാസെറ്റ് വിവരണം5 മുതൽ 30 സെക്കൻഡ് വരെയുള്ള ശ്രേണിയിൽ വരുന്ന ഒറ്റ-ഉച്ചാരണ റെക്കോർഡിംഗുകൾ
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംമൊബൈൽ അപ്ലിക്കേഷൻ
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 1324 പുരുഷൻ 701 അജ്ഞാതം 24
+പഞ്ചാബി (പൈപ്പ്‌ലൈനിൽ) കോൾ സെന്റർ60
ഹൃസ്വ വിവരണംപഞ്ചാബി (പൈപ്പ്‌ലൈനിൽ) കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പൊതു സംഭാഷണം100
ഹൃസ്വ വിവരണംപഞ്ചാബി (പൈപ്പ്‌ലൈനിൽ) പൊതുവായ സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പോഡ്കാസ്റ്റ്40
ഹൃസ്വ വിവരണംപഞ്ചാബി (പൈപ്പ്‌ലൈനിൽ) മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+റഷ്യൻക്സനുമ്ക്സ ഹേർട്സ്സ്ക്രിപ്റ്റഡ് മോണോലോഗ്2,398
ഹൃസ്വ വിവരണംറഷ്യൻ സ്ക്രിപ്റ്റഡ് മോണോലോഗ്
ഡാറ്റാസെറ്റ് വിവരണം5 മുതൽ 30 സെക്കൻഡ് വരെയുള്ള ശ്രേണിയിൽ വരുന്ന ഒറ്റ-ഉച്ചാരണ റെക്കോർഡിംഗുകൾ
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംമൊബൈൽ അപ്ലിക്കേഷൻ
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 1689 പുരുഷൻ 1937 അജ്ഞാതം 214
+സ്കോട്ടിഷ് (ഇംഗ്ലീഷ് ഉച്ചാരണം)ക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം292
ഹൃസ്വ വിവരണംസ്കോട്ടിഷ് പൊതു സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംരണ്ട് പേർ തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത ടെലിഫോൺ സംഭാഷണം. ഏകദേശം ഓഡിയോ ദൈർഘ്യം (പരിധി) - 15-60 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 285, പുരുഷൻ 260, അജ്ഞാതം 3
+സിംഗപ്പൂർ ഇംഗ്ലീഷ്ക്സനുമ്ക്സ ഹേർട്സ്കോൾ സെന്റർ218
ഹൃസ്വ വിവരണംസിംഗപ്പൂർ കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 2139 , പുരുഷൻ 884, അജ്ഞാതം 21
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്247
ഹൃസ്വ വിവരണംസിംഗപ്പൂർ മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 160, പുരുഷൻ 455, അജ്ഞാതൻ 37
+ദക്ഷിണാഫ്രിക്കൻ ഇംഗ്ലീഷ്ക്സനുമ്ക്സ ഹേർട്സ്കോൾ സെന്റർ261
ഹൃസ്വ വിവരണംദക്ഷിണാഫ്രിക്കൻ ഇംഗ്ലീഷ് കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 1274 , പുരുഷൻ 935 , അജ്ഞാതം 1
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്251
ഹൃസ്വ വിവരണംദക്ഷിണാഫ്രിക്കൻ ഇംഗ്ലീഷ് മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 235, പുരുഷൻ 432, അജ്ഞാതൻ 36
+സ്വാഹിലിക്സനുമ്ക്സ ഹേർട്സ്കോൾ സെന്റർ230
ഹൃസ്വ വിവരണംസ്വാഹിലി കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 611, പുരുഷൻ 833, അജ്ഞാതൻ 0
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്265
ഹൃസ്വ വിവരണംസ്വാഹിലി മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 118, പുരുഷൻ 493, അജ്ഞാതൻ 25
+സ്വീഡിഷ്ക്സനുമ്ക്സ ഹേർട്സ്കോൾ സെന്റർ250
ഹൃസ്വ വിവരണംസ്വീഡിഷ് കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ 1581, പുരുഷന്മാർ 727, അജ്ഞാതർ 2
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്278
ഹൃസ്വ വിവരണംസ്വീഡിഷ് മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ 195, പുരുഷന്മാർ 500, അജ്ഞാതർ 21
+തമിഴ് (പൈപ്പ്‌ലൈനിൽ) കോൾ സെന്റർ60
ഹൃസ്വ വിവരണംതമിഴ് (പൈപ്പ്‌ലൈനിൽ) കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പൊതു സംഭാഷണം100
ഹൃസ്വ വിവരണംതമിഴ് (പൈപ്പ്‌ലൈനിൽ) പൊതുവായ സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പോഡ്കാസ്റ്റ്40
ഹൃസ്വ വിവരണംതമിഴ് (പൈപ്പ്‌ലൈനിൽ) മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+തെലുങ്ക്ക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം553
ഹൃസ്വ വിവരണംതെലുങ്ക് പൊതു സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംരണ്ട് പേർ തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത ടെലിഫോൺ സംഭാഷണം. ഏകദേശം ഓഡിയോ ദൈർഘ്യം (പരിധി) - 15-60 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 574 , പുരുഷൻ 564, അജ്ഞാതം 0
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്648
ഹൃസ്വ വിവരണംതെലുങ്ക് മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 207, പുരുഷൻ 963, അജ്ഞാതൻ 2
+തെലുങ്ക് (പൈപ്പ്‌ലൈനിൽ) കോൾ സെന്റർ30
ഹൃസ്വ വിവരണംതെലുങ്ക് (പൈപ്പ്‌ലൈനിൽ) കോൾ-സെന്റർ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പൊതു സംഭാഷണം50
ഹൃസ്വ വിവരണംതെലുങ്ക് (പൈപ്പ്‌ലൈനിൽ) പൊതുവായ സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+പോഡ്കാസ്റ്റ്20
ഹൃസ്വ വിവരണംതെലുങ്ക് (പൈപ്പ്‌ലൈനിൽ) മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണം
+തായ്ക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം183
ഹൃസ്വ വിവരണംതായ് പൊതു സംഭാഷണം
ഡാറ്റാസെറ്റ് വിവരണംരണ്ട് പേർ തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത ടെലിഫോൺ സംഭാഷണം. ഏകദേശം ഓഡിയോ ദൈർഘ്യം (പരിധി) - 15-60 മിനിറ്റ്, സുഹൃത്തുക്കൾക്കിടയിൽ ഉപയോഗിക്കുന്ന ഒരു അനൗപചാരിക രജിസ്റ്റർ.
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 338, പുരുഷൻ 96, അജ്ഞാതൻ 8
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്173
ഹൃസ്വ വിവരണംതായ് മീഡിയ ഓഡിയോ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 143, പുരുഷൻ 502, അജ്ഞാതൻ 26
+ടർക്കിഷ് തുർക്കിക്സനുമ്ക്സ ഹേർട്സ്സ്ക്രിപ്റ്റഡ് മോണോലോഗ്2,027
ഹൃസ്വ വിവരണംടർക്കിഷ് തുർക്കി
ഡാറ്റാസെറ്റ് വിവരണം5 മുതൽ 30 സെക്കൻഡ് വരെയുള്ള ശ്രേണിയിൽ വരുന്ന ഒറ്റ-ഉച്ചാരണ റെക്കോർഡിംഗുകൾ
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംമൊബൈൽ അപ്ലിക്കേഷൻ
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 1561 പുരുഷൻ 1241 അജ്ഞാതം 31
+വിയറ്റ്നാമീസ്ക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം295
ഹൃസ്വ വിവരണംവിയറ്റ്നാമീസ് പൊതു സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്, വടക്കൻ (ഉദാ. ഹനോയ്), മധ്യ, തെക്കൻ (ഉദാ. ഹോ ചി മിൻ സിറ്റി).
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ 400, പുരുഷന്മാർ 380, അജ്ഞാതർ 2
+ക്സനുമ്ക്സ ഹേർട്സ്പോഡ്കാസ്റ്റ്257
ഹൃസ്വ വിവരണംവിയറ്റ്നാമീസ് മീഡിയ ഓഡിയോ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണംലൈസൻസുള്ള പബ്ലിക് ഡൊമെയ്ൻ ഓഡിയോ/വീഡിയോ ഫയലുകൾ, ഉദാഹരണത്തിന് അഭിമുഖങ്ങൾ, പോഡ്‌കാസ്റ്റുകൾ മുതലായവ - 1 മുതൽ 5 വരെ ആളുകൾ. ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (ശ്രേണി) 15-60 മിനിറ്റ്.
ഓഡിയോ ചാനൽമോണോ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംവെബ് സോഴ്‌സിംഗ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീകൾ 249, പുരുഷന്മാർ 200, അജ്ഞാതർ 45
+വെൽഷ് (ഇംഗ്ലീഷ് ഉച്ചാരണം)ക്സനുമ്ക്സ ഹേർട്സ്പൊതു സംഭാഷണം278
ഹൃസ്വ വിവരണംവെൽഷ് പൊതു സംഭാഷണ ഡാറ്റ
ഡാറ്റാസെറ്റ് വിവരണം"ഏജന്റും" "ഉപഭോക്താവും" തമ്മിലുള്ള സ്ക്രിപ്റ്റ് ചെയ്യാത്ത, സിന്തറ്റിക് ടെലിഫോൺ സംഭാഷണം, ഏകദേശം. ഓഡിയോ ദൈർഘ്യം (പരിധി) 5-15 മിനിറ്റ്,
ഓഡിയോ ചാനൽഡ്യുവൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംഡെസ്ക്ടോപ്പ്
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംസ്ത്രീ 270, പുരുഷൻ 324, അജ്ഞാതൻ 0
+യുകെ ഇംഗ്ലീഷ്ക്സനുമ്ക്സ ഹേർട്സ്വേക്ക് വേഡ്200 സ്പീക്കറുകൾ
ഹൃസ്വ വിവരണംവേക്ക് വേഡ് യുകെ ഇംഗ്ലീഷ്
ഡാറ്റാസെറ്റ് വിവരണംകീഫ്രെയ്‌സുകൾ ഡാറ്റ ശേഖരണം
  • X സ്പീക്കർ
  • ഒരു സ്പീക്കറിന് 4 അദ്വിതീയ കീഫ്രേസുകൾ
  • ഓരോ അദ്വിതീയ കീഫ്രെയിസിലും 25-30 ആവർത്തിച്ചുള്ള കീഫ്രേസ് റെക്കോർഡിംഗുകൾ
  • ഒരു അദ്വിതീയ കീഫ്രെയ്‌സിന് 25-30 ഓഡിയോ ഫയലുകൾ
  • ഒരു സ്പീക്കറിന് ആകെ 120 റെക്കോർഡ് വാചകങ്ങൾ
ഓഡിയോ ചാനൽ1 ചാനൽ
റെക്കോർഡിംഗ് പ്ലാറ്റ്ഫോംമൊബൈൽ അപ്ലിക്കേഷൻ
WER (%)5.0
ഓഡിയോ ഫോർമാറ്റ്.WAV
ട്രാൻസ്ക്രിപ്ഷൻ ഫോർമാറ്റ്.ജസൺ
കേസ് ഉപയോഗിക്കുകASR, വെർച്വൽ അസിസ്റ്റന്റ്, ചാറ്റ്ബോട്ട്, സംഭാഷണ AI, സ്പീച്ച് അനലിറ്റിക്സ്, TTS, ലാംഗ്വേജ് മോഡലിംഗ്
സ്പീക്കറുകളുടെ എണ്ണംലിംഗഭേദം: 50% പുരുഷന്മാർ, 50% സ്ത്രീകൾ, +/- 10%.

നൽകിയ സേവനങ്ങൾ

സമഗ്രമായ AI സജ്ജീകരണങ്ങൾക്കായി വിദഗ്‌ധ ടെക്‌സ്‌റ്റ് ഡാറ്റ ശേഖരണം എല്ലായ്‌പ്പോഴും കൈകോർത്തിരിക്കുന്നതല്ല. Shaip-ൽ, മോഡലുകൾ പതിവിലും കൂടുതൽ വ്യാപകമാക്കാൻ നിങ്ങൾക്ക് ഇനിപ്പറയുന്ന സേവനങ്ങൾ പരിഗണിക്കാം:

ടെക്സ്റ്റ് ഡാറ്റ ശേഖരണം

ടെക്സ്റ്റ് ഡാറ്റ ശേഖരണ സേവനങ്ങൾ

Shaip കോഗ്നിറ്റീവ് ഡാറ്റ ശേഖരണ സേവനങ്ങളുടെ യഥാർത്ഥ മൂല്യം, ഘടനാരഹിതമായ ഡാറ്റയ്ക്കുള്ളിൽ കണ്ടെത്തിയ നിർണായക വിവരങ്ങൾ അൺലോക്ക് ചെയ്യുന്നതിനുള്ള താക്കോൽ ഓർഗനൈസേഷനുകൾക്ക് നൽകുന്നു എന്നതാണ്.

ചിത്ര ഡാറ്റ ശേഖരണം

ഇമേജ് ഡാറ്റ ശേഖരണ സേവനങ്ങൾ

ഭാവിയിലെ അടുത്ത തലമുറ AI മോഡലുകളെ തടസ്സമില്ലാതെ പരിശീലിപ്പിക്കുന്നതിന്, നിങ്ങളുടെ കമ്പ്യൂട്ടർ വിഷൻ മോഡൽ എല്ലാ ചിത്രങ്ങളും കൃത്യമായി തിരിച്ചറിയുന്നുവെന്ന് ഉറപ്പാക്കുക.

വീഡിയോ ഡാറ്റ ശേഖരണം

വീഡിയോ ഡാറ്റ ശേഖരണ സേവനങ്ങൾ

ഒബ്‌ജക്‌റ്റുകൾ, വ്യക്തികൾ, പ്രതിരോധങ്ങൾ, മറ്റ് ദൃശ്യ ഘടകങ്ങൾ എന്നിവയെ പൂർണതയിലേക്ക് തിരിച്ചറിയാൻ നിങ്ങളുടെ മോഡലുകളെ പരിശീലിപ്പിക്കുന്നതിന് ഇപ്പോൾ എൻ‌എൽ‌പിയ്‌ക്കൊപ്പം കമ്പ്യൂട്ടർ വിഷൻസിൽ ശ്രദ്ധ കേന്ദ്രീകരിക്കുക.

തിരഞ്ഞെടുത്ത ക്ലയന്റുകൾ

ലോകത്തെ മുൻ‌നിര AI ഉൽ‌പ്പന്നങ്ങൾ‌ നിർമ്മിക്കുന്നതിന് ടീമുകളെ പ്രാപ്തരാക്കുന്നു.

ഷാപ്പ് ഞങ്ങളെ ബന്ധപ്പെടുക

നിങ്ങളുടെ സ്വന്തം ഓഡിയോ ഡാറ്റാസെറ്റ് നിർമ്മിക്കാൻ ആഗ്രഹിക്കുന്നുണ്ടോ?

നിങ്ങളുടെ ആവശ്യത്തിന് ഏറ്റവും അനുയോജ്യമായ ഒരു ഓഡിയോ ശേഖരം സജ്ജീകരിക്കാൻ ഞങ്ങളുടെ ഇൻ-ഹൌസ് സ്പീച്ച് ഡാറ്റ കളക്ഷൻ വിദഗ്ധരുമായി ബന്ധപ്പെടുക

  • ഈ ഫീൽഡ് മൂല്യനിർണ്ണയ ഉദ്ദേശ്യത്തിനായിരിക്കും, അത് മാറ്റമില്ലാതെ നിലനിർത്തണം.
  • രജിസ്റ്റർ ചെയ്യുന്നതിലൂടെ, ഞാൻ ഷൈപ്പിനോട് യോജിക്കുന്നു സ്വകാര്യതാനയം ഒപ്പം സേവന നിബന്ധനകൾ Shaip-ൽ നിന്ന് B2B മാർക്കറ്റിംഗ് കമ്മ്യൂണിക്കേഷൻ സ്വീകരിക്കുന്നതിന് എന്റെ സമ്മതം നൽകുക.

ഒരു ML മോഡലിനായുള്ള സംഭാഷണ ഡാറ്റ ശേഖരണം സംസാരിക്കുന്ന ഭാഷയുടെ ഓഡിയോ റെക്കോർഡിംഗുകൾ ശേഖരിക്കുന്ന പ്രക്രിയയെ സൂചിപ്പിക്കുന്നു. ഈ ശേഖരം മെഷീൻ ലേണിംഗ് അൽഗോരിതങ്ങൾ പരിശീലിപ്പിക്കുന്നതിനും പരിഷ്കരിക്കുന്നതിനും സഹായിക്കുന്നു, പ്രത്യേകിച്ചും മനുഷ്യശബ്ദങ്ങൾ മനസ്സിലാക്കുന്നതിനും പ്രോസസ്സ് ചെയ്യുന്നതിനും കേന്ദ്രീകരിച്ചുള്ളവ.

ഓട്ടോമാറ്റിക് സ്പീച്ച് റെക്കഗ്നിഷനായി (എഎസ്ആർ) ഓഡിയോ ഡാറ്റ ശേഖരിക്കാൻ ലക്ഷ്യമിടുന്നപ്പോൾ, ആവശ്യമുള്ള ഭാഷ, ഉച്ചാരണം, സംഭാഷണ തരം എന്നിവ ഉൾപ്പെടെ നിങ്ങളുടെ പ്രോജക്റ്റിന്റെ നിർദ്ദിഷ്ട ആവശ്യങ്ങൾ നിർവചിച്ചുകൊണ്ട് നിങ്ങൾ ആരംഭിക്കണം. ഈ പാരാമീറ്ററുകൾ സജ്ജീകരിച്ച ശേഷം, ഉപയോക്തൃ സ്വകാര്യതയെ മാനിക്കുന്നതിന് ആവശ്യമായ എല്ലാ അനുമതികളും നിങ്ങൾക്ക് ലഭിച്ചിട്ടുണ്ടെന്ന് ഉറപ്പാക്കുക. തുടർന്ന്, വ്യക്തമായ ഓഡിയോ സാമ്പിളുകൾ പിടിച്ചെടുക്കാൻ ഉചിതമായ റെക്കോർഡിംഗ് ഉപകരണങ്ങളോ സോഫ്‌റ്റ്‌വെയറോ ഉപയോഗിക്കുക. ഓരോ റെക്കോർഡിംഗും അതിന്റെ ട്രാൻസ്ക്രിപ്ഷനോ മറ്റ് പ്രസക്തമായ മെറ്റാഡാറ്റയോ ഉപയോഗിച്ച് സൂക്ഷ്മമായി വ്യാഖ്യാനിക്കുകയും ആയാസരഹിതമായ ആക്‌സസ്സിനായി വ്യവസ്ഥാപിതമായി സംഭരിക്കുകയും വേണം.

മെഷീൻ ലേണിംഗിലെ ഒരു സ്പീച്ച് ഡാറ്റാസെറ്റ്, സംസാരിക്കുന്ന ഭാഷ തിരിച്ചറിയുന്നതിനും പകർത്തുന്നതിനും അല്ലെങ്കിൽ വ്യാഖ്യാനിക്കുന്നതിനും അനുയോജ്യമായ മോഡലുകളുടെ പരിശീലനത്തിനും പരിശോധനയ്ക്കും മൂല്യനിർണ്ണയത്തിനും പ്രധാനമാണ്. അത്തരം ഡാറ്റാസെറ്റുകൾ വോയ്‌സ് അസിസ്റ്റന്റുകളും ട്രാൻസ്‌ക്രിപ്ഷൻ സേവനങ്ങളും മുതൽ വോയ്‌സ് ബയോമെട്രിക്‌സ് വരെയുള്ള എണ്ണമറ്റ ആപ്ലിക്കേഷനുകൾക്ക് വഴിയൊരുക്കുന്നു.

വൈവിധ്യമാർന്ന ഭാഷകളിൽ നിന്നും ഉച്ചാരണങ്ങളിൽ നിന്നും കൃത്യമായ ഡാറ്റ ശേഖരിക്കുന്നതിന്, ആവശ്യമുള്ള ഭാഷാ പശ്ചാത്തലത്തിലുള്ള മാതൃഭാഷക്കാരുമായുള്ള സഹകരണം അത്യന്താപേക്ഷിതമാണ്. ജനസംഖ്യാപരമായ സൂക്ഷ്മതകളുടെ വിശാലമായ സ്പെക്ട്രം ഉൾക്കൊള്ളാൻ വൈവിധ്യമാർന്നതും പ്രാതിനിധ്യമുള്ളതുമായ സാമ്പിൾ ലക്ഷ്യമിടുന്നു. ഓഡിയോ സ്ഥിരത ഉറപ്പാക്കാൻ ഏകീകൃത പരിതസ്ഥിതിയിൽ സ്റ്റാൻഡേർഡ് റെക്കോർഡിംഗ് ഉപകരണങ്ങൾ ഉപയോഗിക്കുക. പ്രധാനമായി, ഓരോ ഡാറ്റാ ഭാഗവും വിശദമായ ട്രാൻസ്ക്രിപ്ഷനുകളും മെറ്റാഡാറ്റയും ഉപയോഗിച്ച് വ്യാഖ്യാനിക്കുക, നിർദ്ദിഷ്ട ഭാഷയും ഉച്ചാരണവും സൂചിപ്പിക്കുന്നു.