ભારતીય ભાષા ઓડિયો ટ્રાન્સક્રિપ્શન અને ટીકા: વાતચીત AI કેસ સ્ટડી

તેમના AI-સંચાલિત સ્પીચ પ્રોસેસિંગ એન્જિનને તાલીમ આપવા માટે ઉચ્ચ-ગુણવત્તાવાળી ઑડિઓ ટ્રાન્સક્રિપ્શન અને એનોટેશન સેવાઓ પ્રદાન કરી.

બહુભાષી વાતચીત AI

પ્રોજેક્ટ ઝાંખી: ભારતીય ભાષાઓ માટે બહુભાષી ભાષણ એન્જિનનું નિર્માણ 

ક્લાયન્ટ એ ભારતની અગ્રણી AI પ્રોડક્ટ લેબ છે જે યુએસ, ભારત, કેનેડા અને અન્ય ઘણા દેશોમાં બજારમાં હાજરી ધરાવે છે. તેમનું વિઝન ટેકનોલોજી દ્વારા માનવ ક્ષમતાને વધારવાનું છે. તેમની પાસે દસ વર્ષથી વધુ અદ્યતન NLP, આર્ટિફિશિયલ ઇન્ટેલિજન્સ, ML, એનાલિટિક્સ, વિઝ્યુલાઇઝેશન અને સંકળાયેલ ટેકનોલોજીમાં વૈજ્ઞાનિક સંશોધન છે.

તેઓ તેમના AI ઉત્પાદનો એટલે કે ICOG અને Autovox સાથે માનવ-મશીન ક્રિયાપ્રતિક્રિયામાં સીમાઓ આગળ ધપાવી રહ્યા છે. ICOG એ AI-આધારિત વ્યક્તિગત બુદ્ધિશાળી વર્ચ્યુઅલ લર્નિંગ સહાયક છે, જે કાર્યબળ શિક્ષણ અને પરિવર્તન લક્ષ્યો માટે છે, જ્યારે, Autovox એ AI-સંચાલિત સ્પીચ છે
ભારતીય ભાષાઓ માટે પ્રોસેસિંગ એન્જિન.

વાતચીત એ.આઈ

મુખ્ય પરિણામો: 6 ભાષાઓમાં 1,200 કલાકની ટિપ્પણી

ઑડિઓ ટ્રાન્સ્ક્રાઇબ કરેલ અને ટીકા કરેલ

1,200 કલાક

ની સંખ્યા
ભાષા

૬ (૨૦૦ કલાક x ૬ ભાષાઓ)

ટ્રાન્સક્રાઇબ કરેલી અને ટીકા કરેલી ભાષાઓ

ભારતીય અંગ્રેજી, હિન્દી, તમિલ, તેલુગુ, કન્નડ, મલયાલમ

પ્રોજેક્ટ
સમયરેખા

10 વીક્સ

પડકાર: ભારતીય ભાષાના ઓડિયો એનોટેશન માટે નિષ્ણાત ભાષાશાસ્ત્રીઓનો સ્ત્રોત

ગુણવત્તાયુક્ત ભાષાશાસ્ત્રીઓ, નિષ્ણાત ડેટા એનોટેટર્સ અને ટાઇમ-ટુ-માર્કેટ સુધી પહોંચનો અભાવ વાતચીતાત્મક AI ની પ્રગતિ અને અપનાવવામાં અવરોધ રહ્યો છે. ભાષાશાસ્ત્રીઓને સોર્સ કરવા, જરૂરી ગુણવત્તા સાથે મોટા જથ્થામાં ડેટાસેટનું ટ્રાન્સક્રિપ્શન અને ટીકા કરવી, જે AI ક્ષમતાઓ બનાવવા માટે પૂરતી છે, તે હંમેશા સમય માંગી લે તેવું, ખર્ચાળ કાર્ય રહ્યું છે જેને વિવિધ ક્ષેત્રોમાંથી કુશળ સંસાધનોની જરૂર પડે છે. ટીકાકારોની આંતરિક ટીમ હોવા છતાં, તેઓ સમયસર ડિલિવરી અને ટીકાની ગુણવત્તા સાથે સમસ્યાઓનો સામનો કરી રહ્યા હતા.

ક્લાયન્ટની મહત્વપૂર્ણ જરૂરિયાતો આ હતી:

  1. ગુણવત્તાયુક્ત ભાષાશાસ્ત્રીઓ સુધી પહોંચ: ભારતીય અંગ્રેજી, હિન્દી, તમિલ, તેલુગુ, કન્નડ, મલયાલમ જેવી ભારતીય ભાષાઓ માટે નિષ્ણાત ભાષાશાસ્ત્રીઓની પહોંચનો અભાવ.
  2. ઑડિઓ ટ્રાન્સક્રિપ્શન અને ટીકા: 95% ની ન્યૂનતમ ચોકસાઈ સાથે જટિલ ઓડિયો એનોટેશન અને ટ્રાન્સક્રિપ્શન માર્ગદર્શિકા
  3. ડેટા ડિલિવરી: ટ્રાન્સક્રિપ્ટ ફાઇલો 10 અઠવાડિયાની અંદર JSON ફોર્મેટમાં પહોંચાડવાની છે.

ઉકેલ: નિષ્ણાત ભાષાશાસ્ત્રીઓ દ્વારા ઑડિઓ ટ્રાન્સક્રિપ્શન અને ટીકા

વાતચીતના AI ની અમારી ઊંડી સમજણ સાથે, અમે ક્લાયન્ટને ભારતીય ભાષાઓ માટે તેમના AI-સંચાલિત સ્પીચ પ્રોસેસિંગ એન્જિનને તાલીમ આપવા માટે નિષ્ણાત ભાષાશાસ્ત્રીઓ અને ટીકાકારોની ટીમનો ઉપયોગ કરીને પ્રદાન કરેલા ડેટાસેટ્સને ટ્રાન્સક્રાઇબ અને ટીકા કરવામાં મદદ કરી.

ઘણા વિક્રેતાઓનું મૂલ્યાંકન કર્યા પછી (ઉદ્યોગમાં થોડા દિગ્ગજો સહિત), ક્લાયન્ટે કડક સમયમર્યાદામાં મોટા વાતચીતાત્મક AI પ્રોજેક્ટ્સ પૂર્ણ કરવાની અમારી કુશળતા અને સ્પર્ધાત્મક દરે અમે ઓફર કરેલી ગુણવત્તાને કારણે Shaip ને પસંદ કર્યું.

  1. ઑડિઓ ટ્રાન્સક્રિપ્શન અને ટીકા માર્ગદર્શિકા અનુસરવામાં આવી
    • સ્પીચ અને નોન-સ્પીચ તરીકે એનોટેટેડ ઑડિઓ પ્રકાર
    • જો પસંદ કરેલા સેગમેન્ટનો ઑડિઓ પ્રકાર ભાષણ તરીકે ચિહ્નિત થયેલ હોય, તો ભાષણનો પ્રકાર પસંદ કરવો આવશ્યક છે એટલે કે સ્વચ્છ ભાષણ, ભાષણ+સંગીત, ભાષણ+ઘોંઘાટ, અગમ્ય ભાષણ
    • પસંદ કરેલ ભાષણ વિભાગ ખાસ કરીને વક્તા દ્વારા બોલાતી ભાષા સાથે ટેગ થયેલ હોવો જોઈએ.
    • ટીકાકારે સ્પીકર ટેગ્સ સાથે પ્રદેશોને ચિહ્નિત કરવા જોઈએ. અલગ અલગ સ્પીકર્સ હોવા જોઈએ
      અલગ અલગ સ્પીકર ટૅગ્સ સાથે ચિહ્નિત થયેલ.
    • ટીકાકારે વક્તાનું લિંગ એટલે કે પુરુષ કે સ્ત્રી પસંદ કરવું આવશ્યક છે.
    • ટેક્સ્ટ ઑડિઓમાં બોલાયેલી રીતે લખાયેલ હોવો જોઈએ અને વ્યાકરણની રીતે યોગ્ય હોવો જોઈએ.
    • જો પસંદ કરેલ ઑડિઓ પ્રકાર નોન-સ્પીચ હોય, તો તેને લેબલમાંથી એક સોંપવું જોઈએ - નો-સ્પીચ, સંગીત, લિપ સ્મેક, શ્વાસ, ઉધરસ, હાસ્ય, રિંગ, DTMF, બડબડાટ, વાહનનો અવાજ અને તૂટક તૂટક ફોરગ્રાઉન્ડનો અવાજ.
    • ઑડિઓમાંના બધા સેગમેન્ટને ટૅગ્સથી ચિહ્નિત કરવા જોઈએ અને તે પછી જ તેને સિસ્ટમ પર અપલોડ કરી શકાય છે.
  2. ડેટા ડિલિવરી
    બધી ટ્રાન્સક્રિપ્ટ ફાઇલો 10 અઠવાડિયાની અંદર ઉલ્લેખિત મેટાડેટા આવશ્યકતાઓ અનુસાર JSON ફોર્મેટમાં વિતરિત કરવામાં આવી હતી.

પરિણામ: ઉત્પાદન માટે તૈયાર બહુભાષી વાર્તાલાપ AI એન્જિન

નિષ્ણાત ભાષાશાસ્ત્રીઓ દ્વારા આપવામાં આવેલા ઉચ્ચ-ગુણવત્તાવાળા એનોટેટેડ ઓડિયો ડેટાએ ક્લાયન્ટને તેમના AI-સંચાલિત સ્પીચ પ્રોસેસિંગ એન્જિનને 6 ભારતીય ભાષાઓ એટલે કે ભારતીય અંગ્રેજી, હિન્દી, તમિલ, તેલુગુ, કન્નડ, મલયાલમમાં નિર્ધારિત સમયમાં સચોટ રીતે તાલીમ આપવા માટે સક્ષમ બનાવ્યું.

ગોલ્ડ-સ્ટાન્ડર્ડ તાલીમ ડેટાસેટ્સ સાથે, ક્લાયન્ટ બહુભાષી ક્ષમતા સાથે એક બુદ્ધિશાળી અને મજબૂત સ્પીચ સિસ્ટમ પ્રદાન કરી શકશે જે વાસ્તવિક દુનિયાની સમસ્યાઓ ઉકેલવા માટે એન્ડ-ટુ-એન્ડ (E2E) અને હાઇબ્રિડ મોડેલ્સનો ઉપયોગ કરે છે. સરળ શબ્દોમાં કહીએ તો, ભારતીય ગ્રાહકોને ખાસ કરીને વાતચીત AI (જેમ કે એલેક્સા, સિરી) નું નિર્માણ કરવું.

ભાવ ચિહ્ન

શેપના મજબૂત વર્કફ્લો મેનેજમેન્ટ, ઝડપી ટર્નઅરાઉન્ડ સમય, વાતચીતના AI માં તેમનો અનુભવ અને નિષ્ણાત ભાષાશાસ્ત્રીઓના તેમના નેટવર્કથી અમને આનંદ થયો. વધુમાં, તેઓ જે ખર્ચ-મૂલ્ય નેતૃત્વ પ્રદાન કરે છે તે અનોખું છે.

★★★★★
ભાવ ચિહ્ન