તમારા AI માટે સૌથી વિશ્વસનીય સ્પીચ ડેટા કલેક્શન સેવાઓ

અમારી ઑડિઓ અને સ્પીચ ડેટા કલેક્શન સેવાઓ સાથે, ગુણવત્તાયુક્ત વાતચીત ડેટા સાથે તમારા NLP મોડેલ્સ, VAs, TTS પ્રોટોટાઇપ્સ અને વધુને તાલીમ આપો.

વાણી ડેટા સંગ્રહ
દેશો
0 +
ના કલાકો
સ્પીચ ડેટા
0 +
પ્રોજેક્ટ્સ
0 +
ભાષાઓ (૧૦૦+ બોલીઓ)
0 +

8 / 16 / 44 / 48 કેએચઝેડ

નમૂના દર

વ્યાવસાયિક ઑડિઓ / વૉઇસ ડેટા સંગ્રહ સેવાઓ

કોઈપણ વિષય. કોઈપણ દૃશ્ય.

Shaip ખાતે, અમારી કુશળતા વિવિધ AI/ML જરૂરિયાતો માટે રચાયેલ ઉચ્ચ-ગુણવત્તાવાળા સ્પીચ ડેટાસેટ્સ બનાવવામાં રહેલી છે. અમે વિવિધ સેટિંગ્સમાં ભાષાઓ અને રેકોર્ડની વિશાળ શ્રેણી પ્રદાન કરીએ છીએ જે અમારા ડેટાસેટ્સને વ્યાપક અને અનુકૂલનશીલ બનાવે છે. અમારું ધ્યાન ઓછામાં ઓછા શક્ય સમયમાં કસ્ટમ સ્પીચ ડેટાના સૌથી વધુ જથ્થા સાથે મોડેલોને ફીડ કરવા પર છે. અમારી સાથે, તમે અપેક્ષા રાખી શકો છો: 

ભાષણ સંગ્રહ
  • ચોકસાઈ સુધારવા માટે ઉચ્ચ-ગુણવત્તાવાળા બહુભાષી ઑડિઓ / વૉઇસ ડેટાને ક્યુરેટ કર્યો
  • વિવિધ દૃશ્ય સેટઅપને લક્ષ્ય બનાવવા માટે ડોમેન વિશિષ્ટતાનું ઉચ્ચતમ શક્ય સ્તર
  • વિવિધ વસ્તી વિષયક અને વર્ટિકલ્સને અનુરૂપ તમારા ML મોડેલને સ્કેલ કરો
  • રેકોર્ડિંગ વાતાવરણ: સ્ટુડિયો ગુણવત્તા, ન્યૂનતમ પૃષ્ઠભૂમિ અવાજ સાથે સ્ફટિક-સ્પષ્ટ ઑડિઓ દર્શાવતા, & કુદરતી વાતાવરણ, જ્યાં રેકોર્ડિંગ્સ વાસ્તવિક દુનિયાની પરિસ્થિતિઓની નકલ કરવા માટે આસપાસના અવાજોનો સમાવેશ કરે છે.

અમારી કુશળતા

સ્માર્ટ NLP મોડેલ્સ માટે ઑડિઓ ડેટાને સંરેખિત કરો

Shaip 100 થી વધુ ભાષાઓમાં એન્ડ-ટુ-એન્ડ સ્પીચ/ઓડિયો ડેટા કલેક્શન સેવાઓ પ્રદાન કરે છે જેથી વિશ્વભરના વિવિધ પ્રેક્ષકોને વૉઇસ-સક્ષમ ટેકનોલોજીઓ મળી શકે. અમે કોઈપણ અવકાશ અને કદના પ્રોજેક્ટ્સ પર કામ કરી શકીએ છીએ; હાલના ઑફ-ધ-શેલ્ફ ઑડિઓ ડેટાસેટ્સને લાઇસન્સ આપવાથી લઈને કસ્ટમ ઑડિઓ ડેટા કલેક્શનનું સંચાલન કરવા, ઑડિઓ ટ્રાન્સક્રિપ્શન અને એનોટેશન સુધી. તમારો સ્પીચ ડેટા કલેક્શન પ્રોજેક્ટ ગમે તેટલો મોટો હોય, અમે બોલીઓ, સ્વર અને ભાષાઓને લક્ષ્ય બનાવતા ઉચ્ચ-ગુણવત્તાવાળા NLP ડેટાસેટ્સ બનાવવા માટે તમારી જરૂરિયાતોને અનુરૂપ ઑડિઓ કલેક્શન સેવાઓને કસ્ટમાઇઝ કરી શકીએ છીએ. વૉઇસ-સક્ષમ બુદ્ધિશાળી સેટઅપ્સ માટે, અમારા સ્પીચ ડેટાસેટ્સ અને ઑડિઓ ડેટા કલેક્શન સંસાધનોની વિશાળ શ્રેણીમાંથી પસંદ કરો.

એકપાત્રીય ભાષણ

એકપાત્રી નાટક સ્ક્રિપ્ટેડ અને સ્વયંભૂ ભાષણ

તે એક જ વક્તામાંથી ભાષણ પ્રક્રિયા કરવા પર ધ્યાન કેન્દ્રિત કરે છે. સિંગલ-ચેનલ ઓડિયો ફાઇલોમાં ફીડ કરવા માટે સ્ક્રિપ્ટેડ પ્રોમ્પ્ટનો ઉપયોગ કરો, જે તે વ્યક્તિ માટે વિશિષ્ટ ભાષણ પેટર્ન, સ્વર અને સૂક્ષ્મતા કેપ્ચર કરે છે તેની ખાતરી કરે છે.

સંવાદ ભાષણ

સંવાદ સ્ક્રિપ્ટેડ અને સ્વયંભૂ ભાષણ

બે વ્યક્તિની ક્રિયાપ્રતિક્રિયા, વાસ્તવિક દુનિયાની વાતચીતો અને સંવાદોની નકલ કરીને બહુભાષી એક્સપોઝર સાથે ડ્યુઅલ-ચેનલ ફાઇલો અને ટ્રાન્સક્રિપ્ટેડ સંસાધનો દ્વારા.

બહુપક્ષીય વાતચીતો

ગ્રુપ / મ્યુટી-પાર્ટી
વાતચીત

બહુ-વ્યક્તિ ચર્ચાઓ, જૂથ ગતિશીલતા, ઓવરલેપ અને વિવિધ સ્વરને કેપ્ચર કરીને જેથી ભાષણ મોડેલોને સચોટ રીતે તાલીમ આપી શકાય.

જાગતા શબ્દોના ઉચ્ચારણોનો સંગ્રહ

વેક-વર્ડ / કી શબ્દસમૂહો / ઉચ્ચારણો સંગ્રહ​

અદ્યતન કુદરતી ભાષા પ્રક્રિયા અને સમજણ માટે વૈવિધ્યસભર, સમૃદ્ધ અને અધિકૃત ઉચ્ચારણોનો ઉપયોગ કરીને મુખ્ય શબ્દસમૂહો અથવા સમાન અર્થ ધરાવતા શબ્દો અથવા ઉચ્ચારણો ઓળખવા માટે AI ને તાલીમ આપો.

શ્રાવ્ય ભાષણ

એકોસ્ટિક ડેટા
સંગ્રહ

અમે વ્યાવસાયિક રીતે સ્ટુડિયો-ગુણવત્તાવાળા ઓડિયો ડેટા રેકોર્ડ કરી શકીએ છીએ, પછી ભલે તે રેસ્ટોરન્ટ હોય, ઓફિસ હોય કે ઘર હોય કે વિવિધ વાતાવરણ અને ભાષાઓમાંથી હોય, અને તે પણ એક વિશાળ એકોસ્ટિક શ્રેણી (કોમ્પ્રીહેન્સિવ સાઉન્ડ ડેટાસેટ્સ) ને આવરી લે છે.

આપમેળે વાણી ઓળખ

ઓટોમેટિક સ્પીચ રેકગ્નિશન (ASR)

વસ્તી વિષયક માહિતીની વિશાળ શ્રેણીમાંથી, અત્યાધુનિક વૈવિધ્યસભર સ્પીચ/ઓડિયો ડેટાસેટ્સનો ઉપયોગ કરીને તમારી ઓટોમેટિક સ્પીચ રેકગ્નિશન (ASR) સિસ્ટમ્સની ચોકસાઈમાં સુધારો કરો.

કુદરતી ભાષા ઉચ્ચારણ

બહુભાષી ભાષણ/ધ્વનિ તાલીમ ડેટા

વિશ્વભરમાં અમારા કુશળ ભાષા વ્યાવસાયિકો વિવિધ ભાષાઓ અને બોલીઓમાં બહુભાષી ઑડિઓ/ભાષણ ડેટા પ્રદાન કરે છે. આ પ્રયાસ વૈશ્વિક સંદેશાવ્યવહારને પ્રોત્સાહન આપે છે અને ભાષા અવરોધોને દૂર કરે છે, વધુ સમાવિષ્ટ અને અસરકારક AI ઉકેલોમાં ફાળો આપે છે.

ડિજિટલ વર્ચ્યુઅલ સહાયકો

ટેક્સ્ટ-ટુ-સ્પીચ
(TTS)

અમારા વૈશ્વિક કાર્યબળની મદદથી ટેક્સ્ટ-ટુ-સ્પીચ (TTS) બહુભાષી મોડેલ બનાવો, જે તમને 150+ ભાષાઓ અને બોલીઓમાં સ્પીચ ડેટા એકત્રિત કરવામાં મદદ કરે છે જેથી તમારા AI મોડેલ્સને કારમાં નિયંત્રણોથી લઈને ચેટબોટ્સ અને ઉચ્ચ-ગુણવત્તાવાળા ઑડિઓ ડેટા સાથે શીખવાના ઉકેલો સુધી વધારી શકાય.

કોલ સેન્ટર રેકોર્ડિંગ્સ

કૉલ સેન્ટર
વાતચીત

એજન્ટો અને ગ્રાહકો વચ્ચે વાસ્તવિક આદાનપ્રદાન, સ્પેનિશ, જર્મન, અમેરિકન અંગ્રેજી, બંગાળી, જાપાનીઝ, ચાઇનીઝ અને હિન્દી જેવી અસંખ્ય ભાષાઓને સમર્થન આપે છે.

સફળતા વાર્તાઓ

3 ભાષાઓમાં 8k કલાકથી વધુ ડેટા સાથે વાતચીતાત્મક AI ડેટાસેટ્સ

ભારતીય ભાષાઓ માટે બહુભાષી પ્લેટફોર્મ બનાવવા માંગતા, ક્લાયન્ટે બહુવિધ ભારતીય ભાષાઓમાં મોટા ડેટાસેટ્સ એકત્રિત કરવા, વિભાજિત કરવા અને ટ્રાન્સક્રાઇબ કરવા માટે Shaip સાથે ભાગીદારી કરી. આનાથી અસરકારક સ્પીચ મોડેલ વિકસાવવામાં મદદ મળશે જે ક્લાયન્ટના નવીન નવા પ્લેટફોર્મને શક્તિ આપી શકે.

સમસ્યા: 8 ભારતીય ભાષાઓમાં 3,000 કલાકથી વધુનો ઓડિયો ડેટા એકત્રિત કરવામાં આવ્યો, જેને ઓટોમેટિક સ્પીચ રેકગ્નિશન વિકસાવવા માટે વિભાજિત અને ટ્રાન્સક્રાઇબ કરવામાં આવ્યો.

ઉકેલ: અમે ડેટા કલેક્શન, સેગ્મેન્ટેશન, ટ્રાન્સક્રિપ્શન અને મેટાડેટા સાથે JSON ફાઇલો પહોંચાડી. અમે ક્લાયન્ટના સ્પીચ ટેકનોલોજી પ્રોજેક્ટ માટે 8 ભારતીય ભાષાઓમાં 3000 કલાકનો ઓડિયો ડેટા સ્કેલ પર એકત્રિત કર્યો.

ભાષણ ડેટા સંગ્રહ કેસ સ્ટડી

શેપને તમારા વિશ્વસનીય સ્પીચ ડેટા કલેક્શન પાર્ટનર તરીકે પસંદ કરવાના કારણો

લોકો

લોકો

સમર્પિત અને પ્રશિક્ષિત ટીમો:

  • ડેટા ક્રિએશન, લેબલિંગ અને QA માટે 30,000+ સહયોગીઓ
  • પ્રમાણિત પ્રોજેક્ટ મેનેજમેન્ટ ટીમ
  • અનુભવી ઉત્પાદન વિકાસ ટીમ
  • ટેલેન્ટ પૂલ સોર્સિંગ અને ઓનબોર્ડિંગ ટીમ
પ્રક્રિયા

પ્રક્રિયા

ઉચ્ચતમ પ્રક્રિયા કાર્યક્ષમતા આના દ્વારા સુનિશ્ચિત થાય છે:

  • મજબૂત 6 સિગ્મા સ્ટેજ-ગેટ પ્રક્રિયા
  • 6 સિગ્મા બ્લેક બેલ્ટની સમર્પિત ટીમ - મુખ્ય પ્રક્રિયા માલિકો અને ગુણવત્તા પાલન
  • સતત સુધારણા અને પ્રતિસાદ લૂપ
પ્લેટફોર્મ

પ્લેટફોર્મ

પેટન્ટ કરાયેલ પ્લેટફોર્મ નીચેના ફાયદાઓ પ્રદાન કરે છે:

  • વેબ-આધારિત એન્ડ-ટુ-એન્ડ પ્લેટફોર્મ
  • દોષરહિત ગુણવત્તા
  • ઝડપી TAT
  • સીમલેસ ડિલિવરી

શેલ્ફની બહાર સ્પીચ / ઑડિઓ ડેટાસેટ્સ

ભાષા ડેટાસેટનમૂના દરડેટાસેટ પ્રકારકુલ ઑડિઓ કલાકો
+આફ્રિકન અમેરિકન વર્નાક્યુલર8 કિલોહર્ટઝકોલ-સેન્ટર211
ટૂંકું વર્ણનઆફ્રિકન અમેરિકન વર્નાક્યુલર કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી: ૬૧૨, પુરુષ: ૧૨૪૨, અને અજ્ઞાત: ૧૨
+16 કિલોહર્ટઝપોડકાસ્ટ154
ટૂંકું વર્ણનઆફ્રિકન અમેરિકન વર્નાક્યુલર મીડિયા ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી: ૬૧૨, પુરુષ: ૧૨૪૨, અને અજ્ઞાત: ૧૨
+afrikaans8 કિલોહર્ટઝસામાન્ય વાતચીત368
ટૂંકું વર્ણનઆફ્રિકન્સ સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણનબે લોકો વચ્ચે ટેલિફોન પર વાતચીત વગરની. આશરે ઓડિયો સમયગાળો (રેન્જ) - ૧૫-૬૦ મિનિટ, આફ્રિકામાં બોલાતી આફ્રિકન્સ ભાષા
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી: ૬૧૨, પુરુષ: ૧૨૪૨, અને અજ્ઞાત: ૧૨
+16 કિલોહર્ટઝપોડકાસ્ટ658
ટૂંકું વર્ણનઆફ્રિકન્સ મીડિયા ફાઇલો
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી: ૬૧૨, પુરુષ: ૧૨૪૨, અને અજ્ઞાત: ૧૨
+અરબી8 કિલોહર્ટઝસામાન્ય વાતચીત292
ટૂંકું વર્ણનઅરબી સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણનબે લોકો વચ્ચે ટેલિફોન પર વાતચીત વગરની. અંદાજિત ઓડિયો અવધિ (રેન્જ) - ૧૫-૬૦ મિનિટ, ગલ્ફ દેશોમાંથી અરબી ભાષામાં
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી: ૬૧૨, પુરુષ: ૧૨૪૨, અને અજ્ઞાત: ૧૨
+48 કિલોહર્ટઝસ્ક્રિપ્ટેડ મોનોલોગ1,947
ટૂંકું વર્ણનઅરબી સ્ક્રિપ્ટેડ એકપાત્રી નાટક
ડેટાસેટ વર્ણનએકલ-ઉચ્ચાર રેકોર્ડિંગ્સ, જે સામાન્ય રીતે 5 થી 30 સેકન્ડની રેન્જમાં આવે છે.
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મમોબાઇલ એપ્લિકેશન
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૫૬૧ પુરુષ ૧૨૪૧ અજ્ઞાત ૩૧
+આસામી (પાઇપલાઇનમાં) કૉલ-સેન્ટર60
ટૂંકું વર્ણનઆસામી (પાઇપલાઇનમાં) કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+સામાન્ય વાતચીત100
ટૂંકું વર્ણનઆસામી (પાઇપલાઇનમાં) સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+પોડકાસ્ટ40
ટૂંકું વર્ણનઆસામી (પાઇપલાઇનમાં) મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+બંગાળી (પાઇપલાઇનમાં) કૉલ-સેન્ટર60
ટૂંકું વર્ણનબંગાળી (પાઇપલાઇનમાં) કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+સામાન્ય વાતચીત100
ટૂંકું વર્ણનબંગાળી (પાઇપલાઇનમાં) સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+પોડકાસ્ટ40
ટૂંકું વર્ણનબંગાળી (પાઇપલાઇનમાં) મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+બોસ્ટન અંગ્રેજી8 કિલોહર્ટઝકૉલ-સેન્ટર177
ટૂંકું વર્ણનબોસ્ટન કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી: ૬૧૨, પુરુષ: ૧૨૪૨, અને અજ્ઞાત: ૧૨
+8 કિલોહર્ટઝસામાન્ય વાતચીત32
ટૂંકું વર્ણનબોસ્ટન જનરલ વાતચીત ડેટા
ડેટાસેટ વર્ણનબે લોકો વચ્ચે અનસ્ક્રિપ્ટેડ ટેલિફોનિક વાતચીત. આશરે ઓડિયો સમયગાળો (રેન્જ) - ૧૫-૬૦ મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી: ૬૧૨, પુરુષ: ૧૨૪૨, અને અજ્ઞાત: ૧૨
+16 કિલોહર્ટઝપોડકાસ્ટ93
ટૂંકું વર્ણનબોસ્ટન મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી: ૬૧૨, પુરુષ: ૧૨૪૨, અને અજ્ઞાત: ૧૨
+કેનેડિયન ફ્રેન્ચ48 કિલોહર્ટઝસ્ક્રિપ્ટેડ મોનોલોગ1,222
ટૂંકું વર્ણનકેનેડિયન ફ્રેન્ચ
ડેટાસેટ વર્ણનએકલ-ઉચ્ચાર રેકોર્ડિંગ્સ, જે સામાન્ય રીતે 5 થી 30 સેકન્ડની રેન્જમાં આવે છે.
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મમોબાઇલ એપ્લિકેશન
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૫૬૧ પુરુષ ૧૨૪૧ અજ્ઞાત ૩૧
+ચિની અંગ્રેજી8 કિલોહર્ટઝકૉલ-સેન્ટર169
ટૂંકું વર્ણનચાઇનીઝ કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી: ૧૨૬, પુરુષ: ૩૪૬ અને અજાણ્યા: ૬
+16 કિલોહર્ટઝપોડકાસ્ટ249
ટૂંકું વર્ણનચાઇનીઝ મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી: ૧૨૬, પુરુષ: ૩૪૬ અને અજાણ્યા: ૬
+ચિની સરળ48 કિલોહર્ટઝસ્ક્રિપ્ટેડ મોનોલોગ2,762
ટૂંકું વર્ણનચિની સરળ
ડેટાસેટ વર્ણનએકલ-ઉચ્ચાર રેકોર્ડિંગ્સ, જે સામાન્ય રીતે 5 થી 30 સેકન્ડની રેન્જમાં આવે છે.
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મમોબાઇલ એપ્લિકેશન
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૬૮૯ પુરુષ ૧૯૩૭ અજ્ઞાત ૨૧૪
+ચાઇનીઝ પરંપરાગત48 કિલોહર્ટઝસ્ક્રિપ્ટેડ મોનોલોગ1,028
ટૂંકું વર્ણનચાઇનીઝ પરંપરાગત
ડેટાસેટ વર્ણનએકલ-ઉચ્ચાર રેકોર્ડિંગ્સ, જે સામાન્ય રીતે 5 થી 30 સેકન્ડની રેન્જમાં આવે છે.
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મમોબાઇલ એપ્લિકેશન
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૫૬૧ પુરુષ ૧૨૪૧ અજ્ઞાત ૩૧
+ડેનિશ8 કિલોહર્ટઝસામાન્ય વાતચીત372
ટૂંકું વર્ણનડેનિશ સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણનબે લોકો વચ્ચે અનસ્ક્રિપ્ટેડ ટેલિફોનિક વાતચીત. આશરે ઓડિયો સમયગાળો (રેન્જ) - ૧૫-૬૦ મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી: ૩૬૯, પુરુષ: ૮૬૪, અજ્ઞાત: ૨૭
+16 કિલોહર્ટઝપોડકાસ્ટ664
ટૂંકું વર્ણનડેનિશ મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી: ૩૬૯, પુરુષ: ૮૬૪, અજ્ઞાત: ૨૭
+48 કિલોહર્ટઝસ્ક્રિપ્ટેડ મોનોલોગ2,579
ટૂંકું વર્ણનડેનિશ સ્ક્રિપ્ટેડ એકપાત્રી નાટક
ડેટાસેટ વર્ણનએકલ-ઉચ્ચાર રેકોર્ડિંગ્સ, જે 5 થી 30 સેકન્ડની રેન્જમાં આવે છે, ડેનમાર્કથી ડેનિશ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મમોબાઇલ એપ્લિકેશન
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૬૮૯ પુરુષ ૧૯૩૭ અજ્ઞાત ૨૧૪
+અંગ્રેજી ડીપ સાઉથ8 કિલોહર્ટઝકૉલ-સેન્ટર151
ટૂંકું વર્ણનઅંગ્રેજી ડીપ સાઉથ કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૨૨૧, પુરુષ ૧૦૦૪, અજ્ઞાત ૭
+8 કિલોહર્ટઝસામાન્ય વાતચીત56
ટૂંકું વર્ણનઅંગ્રેજી ડીપ સાઉથ જનરલ વાતચીત ડેટા
ડેટાસેટ વર્ણનબે લોકો વચ્ચે અનસ્ક્રિપ્ટેડ ટેલિફોનિક વાતચીત. આશરે ઓડિયો સમયગાળો (રેન્જ) - ૧૫-૬૦ મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૨૩૬, પુરુષ ૬૨૬, અજ્ઞાત ૪૭
+16 કિલોહર્ટઝપોડકાસ્ટ266
ટૂંકું વર્ણનઅંગ્રેજી ડીપ સાઉથ મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૨૩૬, પુરુષ ૬૨૬, અજ્ઞાત ૪૭
+જર્મન8 કિલોહર્ટઝકૉલ-સેન્ટર64
ટૂંકું વર્ણનજર્મન કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૪૭૮ પુરુષ ૧૪૪૦ અજ્ઞાત ૦
+8 કિલોહર્ટઝ આઇવીઆર200
ટૂંકું વર્ણનજર્મન IVR ડેટા
ડેટાસેટ વર્ણનમાનવથી મશીન સુધી. IVR પ્રકારનો પ્રવાહ જ્યાં TTS પ્રોમ્પ્ટ (દા.ત. "હું તમને કેવી રીતે મદદ કરી શકું") હોય છે અને ત્યારબાદ સ્વયંભૂ માનવ પ્રતિભાવ આવે છે.
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૧૫ પુરુષ ૮૭૫૦ અજ્ઞાત ૦
+ગુજરાતી (પાઇપલાઇનમાં) કૉલ-સેન્ટર60
ટૂંકું વર્ણનગુજરાતી (પાઇપલાઇનમાં) કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+સામાન્ય વાતચીત100
ટૂંકું વર્ણનગુજરાતી (પાઇપલાઇનમાં) સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+પોડકાસ્ટ40
ટૂંકું વર્ણનગુજરાતી (પાઇપલાઇનમાં) મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+Hebrew8 કિલોહર્ટઝસામાન્ય વાતચીત399
ટૂંકું વર્ણનહિબ્રુ સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણનબે લોકો વચ્ચે અનસ્ક્રિપ્ટેડ ટેલિફોનિક વાતચીત. આશરે ઑડિઓ અવધિ (રેન્જ) - 15-60 મિનિટ, ઇઝરાયલમાં હિબ્રુ
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૪૧૪, પુરુષ ૩૯૯, અજ્ઞાત ૧
+16 કિલોહર્ટઝપોડકાસ્ટ427
ટૂંકું વર્ણનહિબ્રુ મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૨૮૫, પુરુષ ૨૬૦, અજ્ઞાત ૩
+હિન્દી16 કિલોહર્ટઝપોડકાસ્ટ219
ટૂંકું વર્ણનહિન્દી મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૨૮૫, પુરુષ ૨૬૦, અજ્ઞાત ૩
+48 કિલોહર્ટઝસ્ક્રિપ્ટેડ મોનોલોગ2,867
ટૂંકું વર્ણનહિન્દી સ્ક્રિપ્ટેડ એકપાત્રી નાટક
ડેટાસેટ વર્ણનએકલ-ઉચ્ચાર રેકોર્ડિંગ્સ, જે સામાન્ય રીતે 5 થી 30 સેકન્ડની રેન્જમાં આવે છે.
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મમોબાઇલ એપ્લિકેશન
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૬૮૯ પુરુષ ૧૯૩૭ અજ્ઞાત ૨૧૪
+હિંગ્લિશ8 કિલોહર્ટઝકૉલ-સેન્ટર208
ટૂંકું વર્ણનહિંગલિશ કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૮૨૨, પુરુષ ૧૨૬૨, અજ્ઞાત ૦
+16 કિલોહર્ટઝપોડકાસ્ટ216
ટૂંકું વર્ણનહિંગલિશ મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૭૫, પુરુષ ૩૮૦, અજ્ઞાત ૦
+હિસ્પેનિક અંગ્રેજી8 કિલોહર્ટઝકૉલ-સેન્ટર212
ટૂંકું વર્ણનહિસ્પેનિક કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૬, પુરુષ ૧૦૬૯, અજ્ઞાત ૯૫
+16 કિલોહર્ટઝપોડકાસ્ટ155
ટૂંકું વર્ણનહિસ્પેનિક કૉલ મીડિયા ઑડિઓ
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૬, પુરુષ ૧૦૬૯, અજ્ઞાત ૯૫
+ઇન્ડોનેશિયન8 કિલોહર્ટઝસામાન્ય વાતચીત496
ટૂંકું વર્ણનઇન્ડોનેશિયન સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણનબે લોકો વચ્ચે અનસ્ક્રિપ્ટેડ ટેલિફોનિક વાતચીત. આશરે ઓડિયો સમયગાળો (રેન્જ) - ૧૫-૬૦ મિનિટ, બહાસા ઇન્ડોનેશિયન
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૬, પુરુષ ૧૦૬૯, અજ્ઞાત ૯૫
+16 કિલોહર્ટઝપોડકાસ્ટ643
ટૂંકું વર્ણનઇન્ડોનેશિયન મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૬, પુરુષ ૧૦૬૯, અજ્ઞાત ૯૫
+આઇરિશ8 કિલોહર્ટઝસામાન્ય વાતચીત192
ટૂંકું વર્ણનઆઇરિશ સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણનબે લોકો વચ્ચે અનસ્ક્રિપ્ટેડ ટેલિફોનિક વાતચીત. આશરે ઓડિયો સમયગાળો (રેન્જ) - ૧૫-૬૦ મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૨૭૪, પુરુષ ૯૩૫, અજ્ઞાત ૧
+જાપાનીઝ48 કિલોહર્ટઝસ્ક્રિપ્ટેડ મોનોલોગ2,335
ટૂંકું વર્ણનજાપાની સ્ક્રિપ્ટેડ એકપાત્રી નાટક
ડેટાસેટ વર્ણનએકલ-ઉચ્ચાર રેકોર્ડિંગ્સ, જે સામાન્ય રીતે 5 થી 30 સેકન્ડની રેન્જમાં આવે છે.
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મમોબાઇલ એપ્લિકેશન
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૬૮૯ પુરુષ ૧૯૩૭ અજ્ઞાત ૨૧૪
+કન્નડ (પાઇપલાઇનમાં) કૉલ-સેન્ટર60
ટૂંકું વર્ણનકન્નડ (પાઇપલાઇનમાં) કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+સામાન્ય વાતચીત100
ટૂંકું વર્ણનકન્નડ (પાઇપલાઇનમાં) સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+પોડકાસ્ટ40
ટૂંકું વર્ણનકન્નડ (પાઇપલાઇનમાં) મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+કોરિયન8 કિલોહર્ટઝકૉલ-સેન્ટર107
ટૂંકું વર્ણનકોરિયન કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૩૧૬, પુરુષ ૧૭૬, અજ્ઞાત ૦
+16 કિલોહર્ટઝપોડકાસ્ટ204
ટૂંકું વર્ણનકોરિયન મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૭૦ પુરુષ ૩૦૩, અજ્ઞાત ૨૫
+48 કિલોહર્ટઝસ્ક્રિપ્ટેડ મોનોલોગ1,955
ટૂંકું વર્ણનકોરિયન સ્ક્રિપ્ટેડ એકપાત્રી નાટક
ડેટાસેટ વર્ણનએકલ-ઉચ્ચાર રેકોર્ડિંગ્સ, જે સામાન્ય રીતે 5 થી 30 સેકન્ડની રેન્જમાં આવે છે.
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મમોબાઇલ એપ્લિકેશન
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૬૮૯ પુરુષ ૧૯૩૭ અજ્ઞાત ૨૧૪
+મલય8 કિલોહર્ટઝસામાન્ય વાતચીત266
ટૂંકું વર્ણનમલય સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણનબે લોકો વચ્ચે ટેલિફોન પર વાતચીત વગરની. આશરે ઓડિયો સમયગાળો (રેન્જ) - ૧૫-૬૦ મિનિટ, મલેશિયામાં મલય.
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૩૧૬, પુરુષ ૧૭૬, અજ્ઞાત ૦
+16 કિલોહર્ટઝપોડકાસ્ટ344
ટૂંકું વર્ણનમલય મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૨૩૬, પુરુષ ૬૨૬, અજ્ઞાત ૪૭
+મલયાલમ (પાઇપલાઇનમાં) કૉલ-સેન્ટર60
ટૂંકું વર્ણનમલયાલમ (પાઇપલાઇનમાં) કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+સામાન્ય વાતચીત100
ટૂંકું વર્ણનમલયાલમ (પાઇપલાઇનમાં) સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+પોડકાસ્ટ40
ટૂંકું વર્ણનમલયાલમ (પાઇપલાઇનમાં) મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+મરાઠી (પાઇપલાઇનમાં) કૉલ-સેન્ટર60
ટૂંકું વર્ણનમરાઠી (પાઇપલાઇનમાં) કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+સામાન્ય વાતચીત100
ટૂંકું વર્ણનમરાઠી (પાઇપલાઇનમાં) સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+પોડકાસ્ટ40
ટૂંકું વર્ણનમરાઠી (પાઇપલાઇનમાં) મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+સ્પેનિશ (મેક્સિકો)48 કિલોહર્ટઝસ્ક્રિપ્ટેડ મોનોલોગ1,492
ટૂંકું વર્ણનમેક્સીકન સ્પેનિશ સ્ક્રિપ્ટેડ એકપાત્રી નાટક
ડેટાસેટ વર્ણનએકલ-ઉચ્ચાર રેકોર્ડિંગ્સ, જે સામાન્ય રીતે 5 થી 30 સેકન્ડની રેન્જમાં આવે છે.
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મમોબાઇલ એપ્લિકેશન
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૫૬૧ પુરુષ ૧૨૪૧ અજ્ઞાત ૩૧
+ડચ48 કિલોહર્ટઝસ્ક્રિપ્ટેડ મોનોલોગ1,205
ટૂંકું વર્ણનડચ સ્ક્રિપ્ટેડ એકપાત્રી નાટક
ડેટાસેટ વર્ણનએકલ-ઉચ્ચાર રેકોર્ડિંગ્સ, જે સામાન્ય રીતે 5 થી 30 સેકન્ડની રેન્જમાં આવે છે.
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મમોબાઇલ એપ્લિકેશન
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૫૬૧ પુરુષ ૧૨૪૧ અજ્ઞાત ૩૧
+ન્યૂ યોર્ક અંગ્રેજી8 કિલોહર્ટઝકૉલ-સેન્ટર103
ટૂંકું વર્ણનન્યૂ યોર્ક અંગ્રેજી કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૬૧૦, પુરુષ ૫૩૨, અજાણ ૦
+8 કિલોહર્ટઝસામાન્ય વાતચીત107
ટૂંકું વર્ણનન્યૂ યોર્ક અંગ્રેજી સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણનબે લોકો વચ્ચે અનસ્ક્રિપ્ટેડ ટેલિફોનિક વાતચીત. આશરે ઓડિયો સમયગાળો (રેન્જ) - ૧૫-૬૦ મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૬, પુરુષ ૧૦૬૯, અજ્ઞાત ૯૫
+16 કિલોહર્ટઝપોડકાસ્ટ140
ટૂંકું વર્ણનન્યૂ યોર્ક અંગ્રેજી મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૬, પુરુષ ૧૦૬૯, અજ્ઞાત ૯૫
+ન્યુઝીલેન્ડ અંગ્રેજી 8 કિલોહર્ટઝસામાન્ય વાતચીત148
ટૂંકું વર્ણનન્યુઝીલેન્ડ અંગ્રેજી સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણનબે લોકો વચ્ચે અનસ્ક્રિપ્ટેડ ટેલિફોનિક વાતચીત. આશરે ઓડિયો સમયગાળો (રેન્જ) - ૧૫-૬૦ મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૫૮૧, પુરુષ ૭૨૭, અજ્ઞાત ૨
+16 કિલોહર્ટઝપોડકાસ્ટ400
ટૂંકું વર્ણનન્યુઝીલેન્ડ અંગ્રેજી મીડિયા ઓડિયો
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૫૮૧, પુરુષ ૭૨૭, અજ્ઞાત ૨
+ઉડિયા (પાઇપલાઇનમાં) કૉલ-સેન્ટર60
ટૂંકું વર્ણનઉડિયા (પાઇપલાઇનમાં) કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+સામાન્ય વાતચીત100
ટૂંકું વર્ણનઉડિયા (પાઇપલાઇનમાં) સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+પોડકાસ્ટ40
ટૂંકું વર્ણનઉડિયા (પાઇપલાઇનમાં) મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+પોલિશ16 કિલોહર્ટઝપોડકાસ્ટ269
ટૂંકું વર્ણનપોલિશ મીડિયા ઑડિઓ
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૮૩૮ પુરુષ ૧૨૦૯ અજ્ઞાત ૭૮
+પોલીશ (પોલેન્ડ)48 કિલોહર્ટઝસ્ક્રિપ્ટેડ મોનોલોગ1,482
ટૂંકું વર્ણનપોલેન્ડ પોલેન્ડ - સ્ક્રિપ્ટેડ મોનોલોગ
ડેટાસેટ વર્ણનએકલ-ઉચ્ચાર રેકોર્ડિંગ્સ, જે સામાન્ય રીતે 5 થી 30 સેકન્ડની રેન્જમાં આવે છે.
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મમોબાઇલ એપ્લિકેશન
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૫૬૧ પુરુષ ૧૨૪૧ અજ્ઞાત ૩૧
+પંજાબી (પાઇપલાઇનમાં) કૉલ-સેન્ટર60
ટૂંકું વર્ણનપંજાબી (પાઇપલાઇનમાં) કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+સામાન્ય વાતચીત100
ટૂંકું વર્ણનપંજાબી (પાઇપલાઇનમાં) સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+પોડકાસ્ટ40
ટૂંકું વર્ણનપંજાબી (પાઇપલાઇનમાં) મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+રશિયન48 કિલોહર્ટઝસ્ક્રિપ્ટેડ મોનોલોગ2,398
ટૂંકું વર્ણનરશિયન સ્ક્રિપ્ટેડ એકપાત્રી નાટક
ડેટાસેટ વર્ણનએકલ-ઉચ્ચાર રેકોર્ડિંગ્સ, જે સામાન્ય રીતે 5 થી 30 સેકન્ડની રેન્જમાં આવે છે.
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મમોબાઇલ એપ્લિકેશન
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૬૮૯ પુરુષ ૧૯૩૭ અજ્ઞાત ૨૧૪
+સ્કોટિશ (અંગ્રેજી ઉચ્ચાર)8 કિલોહર્ટઝસામાન્ય વાતચીત292
ટૂંકું વર્ણનસ્કોટિશ જનરલ વાતચીત ડેટા
ડેટાસેટ વર્ણનબે લોકો વચ્ચે અનસ્ક્રિપ્ટેડ ટેલિફોનિક વાતચીત. આશરે ઓડિયો સમયગાળો (રેન્જ) - ૧૫-૬૦ મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૨૮૫, પુરુષ ૨૬૦, અજ્ઞાત ૩
+સિંગાપોર અંગ્રેજી8 કિલોહર્ટઝકૉલ-સેન્ટર218
ટૂંકું વર્ણનસિંગાપોર કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૨૧૩૯, પુરુષ ૮૮૪, અજ્ઞાત ૨૧
+16 કિલોહર્ટઝપોડકાસ્ટ247
ટૂંકું વર્ણનસિંગાપોર મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૬, પુરુષ ૧૦૬૯, અજ્ઞાત ૯૫
+દક્ષિણ આફ્રિકન અંગ્રેજી8 કિલોહર્ટઝકૉલ-સેન્ટર261
ટૂંકું વર્ણનદક્ષિણ આફ્રિકન અંગ્રેજી કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૨૭૪, પુરુષ ૯૩૫, અજ્ઞાત ૧
+16 કિલોહર્ટઝપોડકાસ્ટ251
ટૂંકું વર્ણનદક્ષિણ આફ્રિકન અંગ્રેજી મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૬, પુરુષ ૧૦૬૯, અજ્ઞાત ૯૫
+સ્વાહિલી8 કિલોહર્ટઝકૉલ-સેન્ટર230
ટૂંકું વર્ણનસ્વાહિલી કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૬, પુરુષ ૧૦૬૯, અજ્ઞાત ૯૫
+16 કિલોહર્ટઝપોડકાસ્ટ265
ટૂંકું વર્ણનસ્વાહિલી મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૬, પુરુષ ૧૦૬૯, અજ્ઞાત ૯૫
+સ્વીડિશ8 કિલોહર્ટઝકૉલ-સેન્ટર250
ટૂંકું વર્ણનસ્વીડિશ કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૯૫, પુરુષ ૫૦૦, અજ્ઞાત ૨૧
+16 કિલોહર્ટઝપોડકાસ્ટ278
ટૂંકું વર્ણનસ્વીડિશ મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૯૫, પુરુષ ૫૦૦, અજ્ઞાત ૨૧
+તમિળ (પાઇપલાઇનમાં) કૉલ-સેન્ટર60
ટૂંકું વર્ણનતમિલ (પાઇપલાઇનમાં) કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+સામાન્ય વાતચીત100
ટૂંકું વર્ણનતમિલ (પાઇપલાઇનમાં) સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+પોડકાસ્ટ40
ટૂંકું વર્ણનતમિલ (પાઇપલાઇનમાં) મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+તેલુગુ8 કિલોહર્ટઝસામાન્ય વાતચીત553
ટૂંકું વર્ણનતેલુગુ સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણનબે લોકો વચ્ચે અનસ્ક્રિપ્ટેડ ટેલિફોનિક વાતચીત. આશરે ઓડિયો સમયગાળો (રેન્જ) - ૧૫-૬૦ મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૨૧૩૯, પુરુષ ૮૮૪, અજ્ઞાત ૨૧
+16 કિલોહર્ટઝપોડકાસ્ટ648
ટૂંકું વર્ણનતેલુગુ મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૬, પુરુષ ૧૦૬૯, અજ્ઞાત ૯૫
+તેલુગુ (પાઇપલાઇનમાં) કૉલ-સેન્ટર30
ટૂંકું વર્ણનતેલુગુ (પાઇપલાઇનમાં) કોલ-સેન્ટર ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+સામાન્ય વાતચીત50
ટૂંકું વર્ણનતેલુગુ (પાઇપલાઇનમાં) સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+પોડકાસ્ટ20
ટૂંકું વર્ણનતેલુગુ (પાઇપલાઇનમાં) મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યા
+થાઈ8 કિલોહર્ટઝસામાન્ય વાતચીત183
ટૂંકું વર્ણનથાઈ સામાન્ય વાતચીત
ડેટાસેટ વર્ણનબે લોકો વચ્ચે અનસ્ક્રિપ્ટેડ ટેલિફોનિક વાતચીત. આશરે ઓડિયો સમયગાળો (રેન્જ) - ૧૫-૬૦ મિનિટ, મિત્રો વચ્ચે ઉપયોગમાં લેવાતું અનૌપચારિક રજિસ્ટર.
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૬, પુરુષ ૧૦૬૯, અજ્ઞાત ૯૫
+16 કિલોહર્ટઝપોડકાસ્ટ173
ટૂંકું વર્ણનથાઈ મીડિયા ઓડિયો
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૬, પુરુષ ૧૦૬૯, અજ્ઞાત ૯૫
+ટર્કિશ ટર્કી48 કિલોહર્ટઝસ્ક્રિપ્ટેડ મોનોલોગ2,027
ટૂંકું વર્ણનટર્કિશ ટર્કી
ડેટાસેટ વર્ણનએકલ-ઉચ્ચાર રેકોર્ડિંગ્સ, જે સામાન્ય રીતે 5 થી 30 સેકન્ડની રેન્જમાં આવે છે.
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મમોબાઇલ એપ્લિકેશન
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૫૬૧ પુરુષ ૧૨૪૧ અજ્ઞાત ૩૧
+વિયેતનામીસ8 કિલોહર્ટઝસામાન્ય વાતચીત295
ટૂંકું વર્ણનવિયેતનામીઝ સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઓડિયો સમયગાળો (રેન્જ) 5-15 મિનિટ, ઉત્તરીય (દા.ત., હનોઈ), મધ્ય અને દક્ષિણ (દા.ત., હો ચી મિન્હ સિટી).
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૪૦૦, પુરુષ ૩૮૦, અજાણ્યા ૨
+16 કિલોહર્ટઝપોડકાસ્ટ257
ટૂંકું વર્ણનવિયેતનામીઝ મીડિયા ઓડિયો ડેટા
ડેટાસેટ વર્ણનલાઇસન્સ પ્રાપ્ત જાહેર ડોમેન ઑડિઓ/વિડિઓ ફાઇલો જેમ કે ઇન્ટરવ્યુ, પોડકાસ્ટ વગેરે - 1 થી 5 લોકો. આશરે ઑડિઓ અવધિ (રેન્જ) 15-60 મિનિટ
Audioડિઓ ચેનલમોનો
રેકોર્ડિંગ પ્લેટફોર્મવેબ સોર્સિંગ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૪૦૦, પુરુષ ૩૮૦, અજાણ્યા ૨
+વેલ્શ (અંગ્રેજી ઉચ્ચાર)8 કિલોહર્ટઝસામાન્ય વાતચીત278
ટૂંકું વર્ણનવેલ્શ સામાન્ય વાતચીત ડેટા
ડેટાસેટ વર્ણન"એજન્ટ" અને "ગ્રાહક" વચ્ચે અનસ્ક્રિપ્ટેડ, કૃત્રિમ ટેલિફોનિક વાતચીત, આશરે ઑડિઓ અવધિ (રેન્જ) 5-15 મિનિટ,
Audioડિઓ ચેનલડ્યુઅલ
રેકોર્ડિંગ પ્લેટફોર્મડેસ્કટોપ
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાસ્ત્રી ૧૦૧૬, પુરુષ ૧૦૬૯, અજ્ઞાત ૯૫
+યુકે અંગ્રેજી16 કિલોહર્ટઝવેક વર્ડ.200.૧ સ્પીકર્સ
ટૂંકું વર્ણનવેક વર્ડ યુકે અંગ્રેજી
ડેટાસેટ વર્ણનકીફ્રેઝ ડેટા સંગ્રહ
  • 200 સ્પીકર્સ
  • પ્રતિ વક્તા 4 અનન્ય કીફ્રેઝ
  • દરેક અનન્ય કીફ્રેઝ માટે 25-30 પુનરાવર્તિત કીફ્રેઝ રેકોર્ડિંગ્સ
  • અનન્ય કીફ્રેઝ દીઠ 25-30 ઑડિઓ ફાઇલો
  • પ્રતિ વક્તા કુલ 120 રેકોર્ડ કરેલા ઉચ્ચારણો
Audioડિઓ ચેનલ1 ચેનલ
રેકોર્ડિંગ પ્લેટફોર્મમોબાઇલ એપ્લિકેશન
WER (%)5.0
ઑડિઓ ફોર્મેટ.વાવ
ટ્રાન્સક્રિપ્શન ફોર્મેટ.json
કેસનો ઉપયોગ કરોASR, વર્ચ્યુઅલ આસિસ્ટન્ટ, ચેટબોટ, કન્વર્ઝેશનલ AI, સ્પીચ એનાલિટિક્સ, TTS, લેંગ્વેજ મોડેલિંગ
વક્તાઓની સંખ્યાલિંગ: ૫૦% પુરુષ, ૫૦% સ્ત્રી, +/- ૧૦%.

સેવાઓ આપવામાં આવે છે

વ્યાપક AI સેટઅપ્સ માટે નિષ્ણાત ટેક્સ્ટ ડેટા કલેક્શન એ ફક્ત એકલા હાથે કામ નથી. Shaip ખાતે, તમે મોડેલ્સને સામાન્ય કરતાં વધુ વ્યાપક બનાવવા માટે નીચેની સેવાઓનો પણ વિચાર કરી શકો છો:

ટેક્સ્ટ ડેટા સંગ્રહ

ટેક્સ્ટ ડેટા કલેક્શન સેવાઓ

શેપ જ્ઞાનાત્મક ડેટા સંગ્રહ સેવાઓનું સાચું મૂલ્ય એ છે કે તે સંસ્થાઓને અનસ્ટ્રક્ચર્ડ ડેટામાં મળતી મહત્વપૂર્ણ માહિતીને અનલૉક કરવાની ચાવી આપે છે.

છબી ડેટા સંગ્રહ

છબી ડેટા સંગ્રહ સેવાઓ

ખાતરી કરો કે તમારું કમ્પ્યુટર વિઝન મોડેલ દરેક છબીને સચોટ રીતે ઓળખે છે, જેથી ભવિષ્યના આગામી પેઢીના AI મોડેલ્સને સરળતાથી તાલીમ આપી શકાય.

વિડિઓ ડેટા સંગ્રહ

વિડિઓ ડેટા સંગ્રહ સેવાઓ

હવે તમારા મોડેલોને વસ્તુઓ, વ્યક્તિઓ, અવરોધકો અને અન્ય દ્રશ્ય તત્વોને સંપૂર્ણ રીતે ઓળખવા માટે તાલીમ આપવા માટે NLP ની સાથે કમ્પ્યુટર વિઝન પર ધ્યાન કેન્દ્રિત કરો.

ફીચર્ડ ક્લાયન્ટ્સ

વિશ્વ-અગ્રણી AI ઉત્પાદનો બનાવવા માટે ટીમોને સશક્ત બનાવવી.

શેપ અમારો સંપર્ક કરો

શું તમે તમારો પોતાનો ઓડિયો ડેટાસેટ બનાવવા માંગો છો?

તમારી જરૂરિયાતને શ્રેષ્ઠ રીતે બંધબેસતો ઓડિયો રિપોઝીટરી સેટ કરવા માટે અમારા ઇન-હાઉસ સ્પીચ ડેટા કલેક્શન નિષ્ણાત સાથે જોડાઓ.

  • આ ક્ષેત્ર માન્યતાની હેતુઓ માટે છે અને તેને બદલાશે નહીં.
  • નોંધણી કરાવીને, હું શેપ સાથે સંમત છું. ગોપનીયતા નીતિ અને સેવાની શરતો અને શેપ તરફથી B2B માર્કેટિંગ સંદેશાવ્યવહાર પ્રાપ્ત કરવા માટે મારી સંમતિ આપું છું.

એમએલ મોડેલ માટે સ્પીચ ડેટા કલેક્શન એ બોલાતી ભાષાના ઓડિયો રેકોર્ડિંગ્સ એકત્રિત કરવાની પ્રક્રિયાનો સંદર્ભ આપે છે. આ કલેક્શન મશીન લર્નિંગ અલ્ગોરિધમ્સને તાલીમ અને શુદ્ધિકરણમાં મદદ કરે છે, ખાસ કરીને જે માનવ અવાજોને સમજવા અને પ્રક્રિયા કરવા પર કેન્દ્રિત છે.

ઓટોમેટિક સ્પીચ રેકગ્નિશન (ASR) માટે ઓડિયો ડેટા એકત્રિત કરવાનું લક્ષ્ય રાખતી વખતે, તમારે તમારા પ્રોજેક્ટની ચોક્કસ જરૂરિયાતોને વ્યાખ્યાયિત કરીને શરૂઆત કરવી જોઈએ, જેમાં ઇચ્છિત ભાષા, ઉચ્ચારણ અને વાણીનો પ્રકાર શામેલ છે. આ પરિમાણો સેટ કર્યા પછી, ખાતરી કરો કે તમે વપરાશકર્તાની ગોપનીયતાનો આદર કરવા માટે બધી જરૂરી પરવાનગીઓ મેળવો છો. પછી, સ્પષ્ટ ઓડિયો નમૂનાઓ કેપ્ચર કરવા માટે યોગ્ય રેકોર્ડિંગ ઉપકરણો અથવા સોફ્ટવેરનો ઉપયોગ કરો. દરેક રેકોર્ડિંગને તેના ટ્રાન્સક્રિપ્શન અથવા અન્ય સંબંધિત મેટાડેટા સાથે કાળજીપૂર્વક એનોટેટ કરવી જોઈએ અને સરળતાથી ઍક્સેસ માટે વ્યવસ્થિત રીતે સંગ્રહિત કરવી જોઈએ.

મશીન લર્નિંગમાં સ્પીચ ડેટાસેટ બોલાતી ભાષાને ઓળખવા, ટ્રાન્સક્રાઇબ કરવા અથવા અર્થઘટન કરવા માટે તૈયાર કરાયેલા મોડેલોને તાલીમ આપવા, પરીક્ષણ કરવા અને માન્ય કરવા માટે મહત્વપૂર્ણ છે. આવા ડેટાસેટ્સ વૉઇસ સહાયકો અને ટ્રાન્સક્રિપ્શન સેવાઓથી લઈને વૉઇસ બાયોમેટ્રિક્સ સુધીની અસંખ્ય એપ્લિકેશનો માટે માર્ગ મોકળો કરે છે.

વિવિધ ભાષાઓ અને ઉચ્ચારણોમાંથી ચોક્કસ ડેટા એકત્રિત કરવા માટે, ઇચ્છિત ભાષાકીય પૃષ્ઠભૂમિના મૂળ બોલનારાઓ સાથે સહયોગ મહત્વપૂર્ણ છે. વસ્તી વિષયક ઘોંઘાટના વ્યાપક સ્પેક્ટ્રમને આવરી લેવા માટે વૈવિધ્યસભર અને પ્રતિનિધિ નમૂનાનો પ્રયાસ કરો. ઑડિઓ સુસંગતતા સુનિશ્ચિત કરવા માટે સમાન વાતાવરણમાં પ્રમાણિત રેકોર્ડિંગ સાધનોનો ઉપયોગ કરો. અને અગત્યનું, દરેક ડેટા પીસને વિગતવાર ટ્રાન્સક્રિપ્શન અને મેટાડેટા સાથે ટીકા કરો, જે ચોક્કસ ભાષા અને ઉચ્ચારણ દર્શાવે છે.