ਭਾਰਤੀ ਭਾਸ਼ਾ ਆਡੀਓ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਅਤੇ ਐਨੋਟੇਸ਼ਨ: ਗੱਲਬਾਤ ਸੰਬੰਧੀ AI ਕੇਸ ਸਟੱਡੀ

ਆਪਣੇ ਏਆਈ-ਸੰਚਾਲਿਤ ਸਪੀਚ ਪ੍ਰੋਸੈਸਿੰਗ ਇੰਜਣ ਨੂੰ ਸਿਖਲਾਈ ਦੇਣ ਲਈ ਉੱਚ-ਗੁਣਵੱਤਾ ਵਾਲੀਆਂ ਆਡੀਓ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਅਤੇ ਐਨੋਟੇਸ਼ਨ ਸੇਵਾਵਾਂ ਦੀ ਪੇਸ਼ਕਸ਼ ਕੀਤੀ।

ਬਹੁ-ਭਾਸ਼ਾਈ ਗੱਲਬਾਤ ਏ.ਆਈ.

ਪ੍ਰੋਜੈਕਟ ਸੰਖੇਪ ਜਾਣਕਾਰੀ: ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਲਈ ਇੱਕ ਬਹੁਭਾਸ਼ਾਈ ਭਾਸ਼ਣ ਇੰਜਣ ਬਣਾਉਣਾ 

ਕਲਾਇੰਟ ਭਾਰਤ ਦੀ ਮੋਹਰੀ ਏਆਈ ਉਤਪਾਦ ਪ੍ਰਯੋਗਸ਼ਾਲਾ ਹੈ ਜਿਸਦੀ ਮਾਰਕੀਟ ਅਮਰੀਕਾ, ਭਾਰਤ, ਕੈਨੇਡਾ ਅਤੇ ਕਈ ਹੋਰ ਦੇਸ਼ਾਂ ਵਿੱਚ ਮੌਜੂਦਗੀ ਹੈ। ਉਨ੍ਹਾਂ ਦਾ ਦ੍ਰਿਸ਼ਟੀਕੋਣ ਤਕਨਾਲੋਜੀ ਰਾਹੀਂ ਮਨੁੱਖੀ ਸੰਭਾਵਨਾਵਾਂ ਨੂੰ ਵਧਾਉਣਾ ਹੈ। ਉਨ੍ਹਾਂ ਕੋਲ ਦਸ ਸਾਲਾਂ ਤੋਂ ਵੱਧ ਅਤਿ-ਆਧੁਨਿਕ ਐਨਐਲਪੀ, ਆਰਟੀਫੀਸ਼ੀਅਲ ਇੰਟੈਲੀਜੈਂਸ, ਐਮਐਲ, ਵਿਸ਼ਲੇਸ਼ਣ, ਵਿਜ਼ੂਅਲਾਈਜ਼ੇਸ਼ਨ ਅਤੇ ਸੰਬੰਧਿਤ ਤਕਨਾਲੋਜੀਆਂ ਵਿੱਚ ਵਿਗਿਆਨਕ ਖੋਜ ਹੈ।

ਉਹ ਆਪਣੇ AI ਉਤਪਾਦਾਂ ਜਿਵੇਂ ਕਿ ICOG ਅਤੇ Autovox ਨਾਲ ਮਨੁੱਖੀ-ਮਸ਼ੀਨ ਆਪਸੀ ਤਾਲਮੇਲ ਵਿੱਚ ਸੀਮਾਵਾਂ ਨੂੰ ਅੱਗੇ ਵਧਾ ਰਹੇ ਹਨ। ICOG ਇੱਕ AI-ਅਧਾਰਤ ਵਿਅਕਤੀਗਤ ਬੁੱਧੀਮਾਨ ਵਰਚੁਅਲ ਲਰਨਿੰਗ ਸਹਾਇਕ ਹੈ, ਜੋ ਕਿ ਵਰਕਫੋਰਸ ਲਰਨਿੰਗ ਅਤੇ ਪਰਿਵਰਤਨ ਟੀਚਿਆਂ ਲਈ ਹੈ, ਜਦੋਂ ਕਿ, Autovox ਇੱਕ AI-ਸੰਚਾਲਿਤ ਸਪੀਚ ਹੈ।
ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਲਈ ਪ੍ਰੋਸੈਸਿੰਗ ਇੰਜਣ।

ਗੱਲਬਾਤ ਏ.ਆਈ

ਮੁੱਖ ਨਤੀਜੇ: 6 ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ 1,200 ਘੰਟੇ ਐਨੋਟੇਟ ਕੀਤੇ ਗਏ

ਆਡੀਓ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬਡ ਅਤੇ ਐਨੋਟੇਟਡ

1,200 ਘੰਟੇ

ਦੀ ਗਿਣਤੀ
ਭਾਸ਼ਾ

6 (200 ਘੰਟੇ x 6 ਭਾਸ਼ਾਵਾਂ)

ਲਿਪੀਬੱਧ ਅਤੇ ਵਿਆਖਿਆ ਕੀਤੀਆਂ ਭਾਸ਼ਾਵਾਂ

ਭਾਰਤੀ ਅੰਗਰੇਜ਼ੀ, ਹਿੰਦੀ, ਤਾਮਿਲ, ਤੇਲਗੂ, ਕੰਨੜ, ਮਲਿਆਲਮ

ਪ੍ਰੋਜੈਕਟ
ਟਾਈਮਲਾਈਨ

10 ਹਫ਼ਤੇ

ਚੁਣੌਤੀ: ਭਾਰਤੀ ਭਾਸ਼ਾ ਆਡੀਓ ਐਨੋਟੇਸ਼ਨ ਲਈ ਮਾਹਰ ਭਾਸ਼ਾ ਵਿਗਿਆਨੀਆਂ ਦੀ ਸੋਰਸਿੰਗ

ਗੁਣਵੱਤਾ ਵਾਲੇ ਭਾਸ਼ਾ ਵਿਗਿਆਨੀਆਂ, ਮਾਹਰ ਡੇਟਾ ਐਨੋਟੇਟਰਾਂ ਅਤੇ ਟਾਈਮ-ਟੂ-ਮਾਰਕੀਟ ਤੱਕ ਪਹੁੰਚ ਦੀ ਘਾਟ ਗੱਲਬਾਤ ਵਾਲੇ AI ਦੀ ਪ੍ਰਗਤੀ ਅਤੇ ਅਪਣਾਉਣ ਵਿੱਚ ਇੱਕ ਰੁਕਾਵਟ ਰਹੀ ਹੈ। ਭਾਸ਼ਾ ਵਿਗਿਆਨੀਆਂ ਨੂੰ ਸੋਰਸ ਕਰਨਾ, ਲੋੜੀਂਦੀ ਗੁਣਵੱਤਾ ਦੇ ਨਾਲ ਵੱਡੇ ਪੱਧਰ 'ਤੇ ਡੇਟਾਸੈੱਟਾਂ ਨੂੰ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਕਰਨਾ ਅਤੇ ਐਨੋਟੇਟ ਕਰਨਾ, ਜੋ ਕਿ AI ਸਮਰੱਥਾਵਾਂ ਨੂੰ ਬਣਾਉਣ ਲਈ ਕਾਫ਼ੀ ਹੈ, ਹਮੇਸ਼ਾ ਇੱਕ ਸਮਾਂ ਲੈਣ ਵਾਲਾ, ਮਹਿੰਗਾ ਕੰਮ ਰਿਹਾ ਹੈ ਜਿਸ ਲਈ ਵੱਖ-ਵੱਖ ਖੇਤਰਾਂ ਤੋਂ ਹੁਨਰਮੰਦ ਸਰੋਤਾਂ ਦੀ ਲੋੜ ਹੁੰਦੀ ਹੈ। ਐਨੋਟੇਟਰਾਂ ਦੀ ਇੱਕ ਅੰਦਰੂਨੀ ਟੀਮ ਹੋਣ ਦੇ ਬਾਵਜੂਦ, ਉਹਨਾਂ ਨੂੰ ਸਮੇਂ ਸਿਰ ਡਿਲੀਵਰੀ ਅਤੇ ਐਨੋਟੇਟ ਦੀ ਗੁਣਵੱਤਾ ਨਾਲ ਸਮੱਸਿਆਵਾਂ ਦਾ ਸਾਹਮਣਾ ਕਰਨਾ ਪੈ ਰਿਹਾ ਸੀ।

ਗਾਹਕ ਦੀਆਂ ਮਹੱਤਵਪੂਰਨ ਲੋੜਾਂ ਸਨ:

  1. ਗੁਣਵੱਤਾ ਵਾਲੇ ਭਾਸ਼ਾ ਵਿਗਿਆਨੀਆਂ ਤੱਕ ਪਹੁੰਚ: ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਜਿਵੇਂ ਕਿ ਭਾਰਤੀ ਅੰਗਰੇਜ਼ੀ, ਹਿੰਦੀ, ਤਾਮਿਲ, ਤੇਲਗੂ, ਕੰਨੜ, ਮਲਿਆਲਮ ਲਈ ਮਾਹਰ ਭਾਸ਼ਾ ਵਿਗਿਆਨੀਆਂ ਤੱਕ ਪਹੁੰਚ ਦੀ ਘਾਟ।
  2. ਆਡੀਓ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਅਤੇ ਐਨੋਟੇਸ਼ਨ: 95% ਦੀ ਘੱਟੋ-ਘੱਟ ਸ਼ੁੱਧਤਾ ਦੇ ਨਾਲ ਗੁੰਝਲਦਾਰ ਆਡੀਓ ਐਨੋਟੇਸ਼ਨ ਅਤੇ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਦਿਸ਼ਾ-ਨਿਰਦੇਸ਼
  3. ਡਾਟਾ ਡਿਲੀਵਰੀ: ਟ੍ਰਾਂਸਕ੍ਰਿਪਟ ਫਾਈਲਾਂ 10 ਹਫ਼ਤਿਆਂ ਦੇ ਅੰਦਰ JSON ਫਾਰਮੈਟ ਵਿੱਚ ਡਿਲੀਵਰ ਕੀਤੀਆਂ ਜਾਣਗੀਆਂ।

ਹੱਲ: ਮਾਹਰ ਭਾਸ਼ਾ ਵਿਗਿਆਨੀਆਂ ਦੁਆਰਾ ਆਡੀਓ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਅਤੇ ਐਨੋਟੇਸ਼ਨ

ਗੱਲਬਾਤ ਵਾਲੇ AI ਦੀ ਸਾਡੀ ਡੂੰਘੀ ਸਮਝ ਦੇ ਨਾਲ, ਅਸੀਂ ਕਲਾਇੰਟ ਨੂੰ ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਲਈ ਆਪਣੇ AI-ਸੰਚਾਲਿਤ ਸਪੀਚ ਪ੍ਰੋਸੈਸਿੰਗ ਇੰਜਣ ਨੂੰ ਸਿਖਲਾਈ ਦੇਣ ਲਈ ਮਾਹਰ ਭਾਸ਼ਾ ਵਿਗਿਆਨੀਆਂ ਅਤੇ ਐਨੋਟੇਟਰਾਂ ਦੀ ਇੱਕ ਟੀਮ ਦੀ ਵਰਤੋਂ ਕਰਕੇ ਪ੍ਰਦਾਨ ਕੀਤੇ ਡੇਟਾਸੈੱਟਾਂ ਨੂੰ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਅਤੇ ਐਨੋਟੇਟ ਕਰਨ ਵਿੱਚ ਮਦਦ ਕੀਤੀ।

ਬਹੁਤ ਸਾਰੇ ਵਿਕਰੇਤਾਵਾਂ (ਉਦਯੋਗ ਦੇ ਅੰਦਰ ਕੁਝ ਦਿੱਗਜਾਂ ਸਮੇਤ) ਦਾ ਮੁਲਾਂਕਣ ਕਰਨ ਤੋਂ ਬਾਅਦ, ਕਲਾਇੰਟ ਨੇ ਸ਼ੇਪ ਨੂੰ ਸਖ਼ਤ ਸਮਾਂ-ਸੀਮਾਵਾਂ ਦੇ ਅੰਦਰ ਵੱਡੇ ਗੱਲਬਾਤ ਵਾਲੇ AI ਪ੍ਰੋਜੈਕਟਾਂ ਨੂੰ ਪੂਰਾ ਕਰਨ ਦੀ ਸਾਡੀ ਮੁਹਾਰਤ ਅਤੇ ਪ੍ਰਤੀਯੋਗੀ ਦਰਾਂ 'ਤੇ ਸਾਡੇ ਦੁਆਰਾ ਪੇਸ਼ ਕੀਤੀ ਗਈ ਗੁਣਵੱਤਾ ਦੇ ਕਾਰਨ ਚੁਣਿਆ।

  1. ਆਡੀਓ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਅਤੇ ਐਨੋਟੇਸ਼ਨ ਦਿਸ਼ਾ-ਨਿਰਦੇਸ਼ਾਂ ਦੀ ਪਾਲਣਾ ਕੀਤੀ ਗਈ
    • ਸਪੀਚ ਅਤੇ ਨਾਨ-ਸਪੀਚ ਦੇ ਤੌਰ 'ਤੇ ਐਨੋਟੇਟਿਡ ਆਡੀਓ ਕਿਸਮ
    • ਜੇਕਰ ਚੁਣੇ ਹੋਏ ਹਿੱਸੇ ਦੀ ਆਡੀਓ ਕਿਸਮ ਨੂੰ ਸਪੀਚ ਵਜੋਂ ਚਿੰਨ੍ਹਿਤ ਕੀਤਾ ਗਿਆ ਹੈ, ਤਾਂ ਸਪੀਚ ਦੀ ਕਿਸਮ ਚੁਣਨੀ ਚਾਹੀਦੀ ਹੈ ਜਿਵੇਂ ਕਿ ਸਾਫ਼ ਸਪੀਚ, ਸਪੀਚ+ਸੰਗੀਤ, ਸਪੀਚ+ਸ਼ੋਰ, ਸਮਝ ਤੋਂ ਬਾਹਰ ਸਪੀਚ।
    • ਚੁਣੇ ਹੋਏ ਭਾਸ਼ਣ ਹਿੱਸੇ ਨੂੰ ਖਾਸ ਤੌਰ 'ਤੇ ਬੁਲਾਰੇ ਦੁਆਰਾ ਬੋਲੀ ਜਾਣ ਵਾਲੀ ਭਾਸ਼ਾ ਨਾਲ ਟੈਗ ਕੀਤਾ ਜਾਣਾ ਚਾਹੀਦਾ ਹੈ।
    • ਐਨੋਟੇਟਰ ਨੂੰ ਖੇਤਰਾਂ ਨੂੰ ਸਪੀਕਰ ਟੈਗਾਂ ਨਾਲ ਚਿੰਨ੍ਹਿਤ ਕਰਨਾ ਚਾਹੀਦਾ ਹੈ। ਵੱਖ-ਵੱਖ ਸਪੀਕਰ ਹੋਣੇ ਚਾਹੀਦੇ ਹਨ
      ਵੱਖ-ਵੱਖ ਸਪੀਕਰ ਟੈਗਾਂ ਨਾਲ ਚਿੰਨ੍ਹਿਤ।
    • ਐਨੋਟੇਟਰ ਨੂੰ ਬੁਲਾਰੇ ਦਾ ਲਿੰਗ ਚੁਣਨਾ ਚਾਹੀਦਾ ਹੈ, ਭਾਵ ਮਰਦ ਜਾਂ ਔਰਤ।
    • ਟੈਕਸਟ ਆਡੀਓ ਵਿੱਚ ਬੋਲੇ ​​ਗਏ ਤਰੀਕੇ ਨਾਲ ਲਿਖਿਆ ਜਾਣਾ ਚਾਹੀਦਾ ਹੈ ਅਤੇ ਵਿਆਕਰਨਿਕ ਤੌਰ 'ਤੇ ਸਹੀ ਹੋਣਾ ਚਾਹੀਦਾ ਹੈ।
    • ਜੇਕਰ ਚੁਣੀ ਗਈ ਆਡੀਓ ਕਿਸਮ ਗੈਰ-ਬੋਲੀ ਹੈ, ਤਾਂ ਇਸਨੂੰ ਲੇਬਲਾਂ ਵਿੱਚੋਂ ਇੱਕ ਦਿੱਤਾ ਜਾਣਾ ਚਾਹੀਦਾ ਹੈ - ਨੋ-ਬੋਲੀ, ਸੰਗੀਤ, ਲਿਪ ਸਮੈਕ, ਸਾਹ, ਖੰਘ, ਹਾਸਾ, ਰਿੰਗ, DTMF, ਬਕਵਾਸ, ਵਾਹਨ ਦਾ ਸ਼ੋਰ, ਅਤੇ ਰੁਕ-ਰੁਕ ਕੇ ਫੋਰਗ੍ਰਾਉਂਡ ਸ਼ੋਰ।
    • ਆਡੀਓ ਦੇ ਸਾਰੇ ਹਿੱਸੇ ਨੂੰ ਟੈਗਾਂ ਨਾਲ ਚਿੰਨ੍ਹਿਤ ਕੀਤਾ ਜਾਣਾ ਚਾਹੀਦਾ ਹੈ ਅਤੇ ਫਿਰ ਹੀ ਸਿਸਟਮ 'ਤੇ ਅਪਲੋਡ ਕੀਤਾ ਜਾ ਸਕਦਾ ਹੈ।
  2. ਡਾਟਾ ਡਿਲਿਵਰੀ
    ਸਾਰੀਆਂ ਟ੍ਰਾਂਸਕ੍ਰਿਪਟ ਫਾਈਲਾਂ 10 ਹਫ਼ਤਿਆਂ ਦੇ ਅੰਦਰ ਨਿਰਧਾਰਤ ਮੈਟਾਡੇਟਾ ਜ਼ਰੂਰਤਾਂ ਦੇ ਅਨੁਸਾਰ JSON ਫਾਰਮੈਟ ਵਿੱਚ ਡਿਲੀਵਰ ਕੀਤੀਆਂ ਗਈਆਂ ਸਨ।

ਨਤੀਜਾ: ਇੱਕ ਉਤਪਾਦਨ-ਤਿਆਰ ਬਹੁ-ਭਾਸ਼ਾਈ ਗੱਲਬਾਤ ਵਾਲਾ AI ਇੰਜਣ

ਮਾਹਰ ਭਾਸ਼ਾ ਵਿਗਿਆਨੀਆਂ ਦੇ ਉੱਚ-ਗੁਣਵੱਤਾ ਵਾਲੇ ਐਨੋਟੇਟਿਡ ਆਡੀਓ ਡੇਟਾ ਨੇ ਕਲਾਇੰਟ ਨੂੰ ਆਪਣੇ ਏਆਈ-ਸੰਚਾਲਿਤ ਸਪੀਚ ਪ੍ਰੋਸੈਸਿੰਗ ਇੰਜਣ ਨੂੰ 6 ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਜਿਵੇਂ ਕਿ ਭਾਰਤੀ ਅੰਗਰੇਜ਼ੀ, ਹਿੰਦੀ, ਤਾਮਿਲ, ਤੇਲਗੂ, ਕੰਨੜ, ਮਲਿਆਲਮ ਵਿੱਚ ਨਿਰਧਾਰਤ ਸਮੇਂ ਵਿੱਚ ਸਹੀ ਢੰਗ ਨਾਲ ਸਿਖਲਾਈ ਦੇਣ ਲਈ ਸ਼ਕਤੀ ਪ੍ਰਦਾਨ ਕੀਤੀ।

ਸੁਨਹਿਰੀ-ਮਿਆਰੀ ਸਿਖਲਾਈ ਡੇਟਾਸੈਟਾਂ ਦੇ ਨਾਲ, ਕਲਾਇੰਟ ਬਹੁ-ਭਾਸ਼ਾਈ ਸਮਰੱਥਾ ਵਾਲਾ ਇੱਕ ਬੁੱਧੀਮਾਨ ਅਤੇ ਮਜ਼ਬੂਤ ​​ਸਪੀਚ ਸਿਸਟਮ ਪੇਸ਼ ਕਰਨ ਦੇ ਯੋਗ ਹੋਵੇਗਾ ਜੋ ਅਸਲ-ਸੰਸਾਰ ਦੀਆਂ ਸਮੱਸਿਆਵਾਂ ਨੂੰ ਹੱਲ ਕਰਨ ਲਈ ਐਂਡ-ਟੂ-ਐਂਡ (E2E) ਅਤੇ ਹਾਈਬ੍ਰਿਡ ਮਾਡਲਾਂ ਦੀ ਵਰਤੋਂ ਕਰਦਾ ਹੈ। ਸਰਲ ਸ਼ਬਦਾਂ ਵਿੱਚ, ਭਾਰਤੀ ਖਪਤਕਾਰਾਂ ਲਈ ਖਾਸ ਤੌਰ 'ਤੇ ਗੱਲਬਾਤ ਸੰਬੰਧੀ AI (ਜਿਵੇਂ ਕਿ ਅਲੈਕਸਾ, ਸਿਰੀ) ਬਣਾਉਣਾ।

ਹਵਾਲਾ ਪ੍ਰਤੀਕ

ਅਸੀਂ ਸ਼ਾਈਪ ਦੇ ਮਜ਼ਬੂਤ ਵਰਕਫਲੋ ਪ੍ਰਬੰਧਨ, ਤੇਜ਼ ਟਰਨਅਰਾਊਂਡ ਸਮਾਂ, ਗੱਲਬਾਤ ਸੰਬੰਧੀ AI ਵਿੱਚ ਉਨ੍ਹਾਂ ਦੇ ਤਜ਼ਰਬੇ, ਅਤੇ ਮਾਹਰ ਭਾਸ਼ਾ ਵਿਗਿਆਨੀਆਂ ਦੇ ਉਨ੍ਹਾਂ ਦੇ ਨੈੱਟਵਰਕ ਤੋਂ ਸੁਖਦ ਤੌਰ 'ਤੇ ਹੈਰਾਨ ਸੀ। ਇਸ ਤੋਂ ਇਲਾਵਾ, ਉਨ੍ਹਾਂ ਦੁਆਰਾ ਪੇਸ਼ ਕੀਤੀ ਜਾਣ ਵਾਲੀ ਲਾਗਤ ਮੁੱਲ ਲੀਡਰਸ਼ਿਪ ਕਿਸੇ ਤੋਂ ਘੱਟ ਨਹੀਂ ਹੈ।

★★★★★
ਹਵਾਲਾ ਪ੍ਰਤੀਕ