ਤੁਹਾਡੇ AI ਲਈ ਸਭ ਤੋਂ ਭਰੋਸੇਮੰਦ ਸਪੀਚ ਡਾਟਾ ਕਲੈਕਸ਼ਨ ਸੇਵਾਵਾਂ

ਸਾਡੀਆਂ ਆਡੀਓ ਅਤੇ ਸਪੀਚ ਡਾਟਾ ਕਲੈਕਸ਼ਨ ਸੇਵਾਵਾਂ ਦੇ ਨਾਲ, ਆਪਣੇ NLP ਮਾਡਲਾਂ, VAs, TTS ਪ੍ਰੋਟੋਟਾਈਪਾਂ, ਅਤੇ ਹੋਰ ਬਹੁਤ ਕੁਝ ਨੂੰ ਗੁਣਵੱਤਾ ਸੰਵਾਦ ਸੰਬੰਧੀ ਡੇਟਾ ਨਾਲ ਸਿਖਲਾਈ ਦਿਓ।

ਸਪੀਚ ਡਾਟਾ ਕਲੈਕਸ਼ਨ
ਦੇਸ਼
0 +
ਦੇ ਘੰਟੇ
ਸਪੀਚ ਡਾਟਾ
0 +
ਪ੍ਰਾਜੈਕਟ
0 +
ਭਾਸ਼ਾਵਾਂ (100+ ਉਪਭਾਸ਼ਾਵਾਂ)
0 +

8 / 16 / 44 / 48 kHz

ਸੈਂਪਲਿੰਗ ਰੇਟ

ਪੇਸ਼ੇਵਰ ਆਡੀਓ / ਵੌਇਸ ਡੇਟਾ ਕਲੈਕਸ਼ਨ ਸੇਵਾਵਾਂ

ਕੋਈ ਵੀ ਵਿਸ਼ਾ। ਕੋਈ ਵੀ ਦ੍ਰਿਸ਼।

ਸ਼ੈਪ 'ਤੇ, ਸਾਡੀ ਮੁਹਾਰਤ ਵੱਖ-ਵੱਖ AI/ML ਲੋੜਾਂ ਲਈ ਤਿਆਰ ਕੀਤੇ ਗਏ ਉੱਚ-ਗੁਣਵੱਤਾ ਵਾਲੇ ਭਾਸ਼ਣ ਡੇਟਾਸੇਟ ਬਣਾਉਣ ਵਿੱਚ ਹੈ। ਅਸੀਂ ਵੱਖ-ਵੱਖ ਸੈਟਿੰਗਾਂ ਵਿੱਚ ਭਾਸ਼ਾਵਾਂ ਅਤੇ ਰਿਕਾਰਡਾਂ ਦੀ ਇੱਕ ਵਿਸ਼ਾਲ ਸ਼੍ਰੇਣੀ ਦੀ ਪੇਸ਼ਕਸ਼ ਕਰਦੇ ਹਾਂ ਜੋ ਸਾਡੇ ਡੇਟਾਸੈਟਾਂ ਨੂੰ ਵਿਆਪਕ ਅਤੇ ਅਨੁਕੂਲ ਬਣਾਉਂਦੇ ਹਨ। ਸਾਡਾ ਧਿਆਨ ਘੱਟ ਤੋਂ ਘੱਟ ਸੰਭਵ ਸਮੇਂ ਵਿੱਚ, ਕਸਟਮ ਸਪੀਚ ਡੇਟਾ ਦੀ ਸਭ ਤੋਂ ਵੱਧ ਮਾਤਰਾ ਵਾਲੇ ਮਾਡਲਾਂ ਨੂੰ ਫੀਡ ਕਰਨ 'ਤੇ ਹੈ। ਸਾਡੇ ਨਾਲ ਬੋਰਡ 'ਤੇ, ਤੁਸੀਂ ਉਮੀਦ ਕਰ ਸਕਦੇ ਹੋ: 

ਭਾਸ਼ਣ ਸੰਗ੍ਰਹਿ
  • ਸ਼ੁੱਧਤਾ ਨੂੰ ਬਿਹਤਰ ਬਣਾਉਣ ਲਈ ਉੱਚ-ਗੁਣਵੱਤਾ ਵਾਲੇ ਬਹੁ-ਭਾਸ਼ਾਈ ਆਡੀਓ / ਵੌਇਸ ਡੇਟਾ ਨੂੰ ਚੁਣਿਆ ਗਿਆ
  • ਵਿਭਿੰਨ ਦ੍ਰਿਸ਼ ਸੈੱਟਅੱਪ ਨੂੰ ਨਿਸ਼ਾਨਾ ਬਣਾਉਣ ਲਈ ਡੋਮੇਨ ਵਿਸ਼ੇਸ਼ਤਾ ਦਾ ਉੱਚਤਮ ਪੱਧਰ
  • ਵਿਭਿੰਨ ਜਨਸੰਖਿਆ ਅਤੇ ਵਰਟੀਕਲ ਦੇ ਅਨੁਕੂਲ ਹੋਣ ਲਈ ਆਪਣੇ ML ਮਾਡਲ ਨੂੰ ਸਕੇਲ ਕਰੋ
  • ਰਿਕਾਰਡਿੰਗ ਵਾਤਾਵਰਣ: ਸਟੂਡੀਓ ਗੁਣਵੱਤਾ, ਘੱਟੋ-ਘੱਟ ਬੈਕਗਰਾਊਂਡ ਸ਼ੋਰ ਦੇ ਨਾਲ ਕ੍ਰਿਸਟਲ-ਸਪੱਸ਼ਟ ਆਡੀਓ ਦੀ ਵਿਸ਼ੇਸ਼ਤਾ, ਅਤੇ ਕੁਦਰਤੀ ਵਾਤਾਵਰਣ, ਜਿੱਥੇ ਰਿਕਾਰਡਿੰਗਾਂ ਅਸਲ-ਸੰਸਾਰ ਦੀਆਂ ਸਥਿਤੀਆਂ ਦੀ ਨਕਲ ਕਰਨ ਲਈ ਅੰਬੀਨਟ ਆਵਾਜ਼ਾਂ ਨੂੰ ਸ਼ਾਮਲ ਕਰਦੀਆਂ ਹਨ।

ਸਾਡੀ ਮਹਾਰਤ

ਸਮਾਰਟ NLP ਮਾਡਲਾਂ ਲਈ ਆਡੀਓ ਡੇਟਾ ਨੂੰ ਇਕਸਾਰ ਕਰੋ

Shaip ਦੁਨੀਆ ਭਰ ਦੇ ਦਰਸ਼ਕਾਂ ਦੇ ਵਿਭਿੰਨ ਸਮੂਹ ਨੂੰ ਪੂਰਾ ਕਰਨ ਲਈ ਆਵਾਜ਼-ਸਮਰੱਥ ਤਕਨਾਲੋਜੀਆਂ ਨੂੰ ਸਮਰੱਥ ਬਣਾਉਣ ਲਈ 100+ ਤੋਂ ਵੱਧ ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ ਅੰਤ-ਤੋਂ-ਅੰਤ ਭਾਸ਼ਣ/ਆਡੀਓ ਡਾਟਾ ਇਕੱਤਰ ਕਰਨ ਦੀਆਂ ਸੇਵਾਵਾਂ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ। ਅਸੀਂ ਕਿਸੇ ਵੀ ਸਕੋਪ ਅਤੇ ਆਕਾਰ ਦੇ ਪ੍ਰੋਜੈਕਟਾਂ 'ਤੇ ਕੰਮ ਕਰ ਸਕਦੇ ਹਾਂ; ਮੌਜੂਦਾ ਆਫ-ਦੀ-ਸ਼ੈਲਫ ਆਡੀਓ ਡੇਟਾਸੈਟਾਂ ਨੂੰ ਲਾਇਸੈਂਸ ਦੇਣ ਤੋਂ ਲੈ ਕੇ, ਕਸਟਮ ਆਡੀਓ ਡੇਟਾ ਸੰਗ੍ਰਹਿ ਦਾ ਪ੍ਰਬੰਧਨ ਕਰਨ ਲਈ, ਆਡੀਓ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਅਤੇ ਐਨੋਟੇਸ਼ਨ ਤੱਕ। ਤੁਹਾਡਾ ਸਪੀਚ ਡਾਟਾ ਕਲੈਕਸ਼ਨ ਪ੍ਰੋਜੈਕਟ ਕਿੰਨਾ ਵੀ ਵੱਡਾ ਕਿਉਂ ਨਾ ਹੋਵੇ, ਅਸੀਂ ਉੱਚ-ਗੁਣਵੱਤਾ ਵਾਲੇ NLP ਡਾਟਾਸੈਟਾਂ ਨੂੰ ਬਣਾਉਣ ਲਈ ਤੁਹਾਡੀਆਂ ਲੋੜਾਂ ਮੁਤਾਬਕ ਆਡੀਓ ਕਲੈਕਸ਼ਨ ਸੇਵਾਵਾਂ ਨੂੰ ਅਨੁਕੂਲਿਤ ਕਰ ਸਕਦੇ ਹਾਂ ਜੋ ਉਪਭਾਸ਼ਾਵਾਂ, ਟੋਨਾਂ ਅਤੇ ਭਾਸ਼ਾਵਾਂ ਨੂੰ ਨਿਸ਼ਾਨਾ ਬਣਾਉਂਦੇ ਹਨ। ਵੌਇਸ-ਸਮਰੱਥ ਬੁੱਧੀਮਾਨ ਸੈਟਅਪਾਂ ਲਈ, ਸਾਡੇ ਸਪੀਚ ਡੇਟਾਸੈਟਾਂ ਅਤੇ ਆਡੀਓ ਡੇਟਾ ਸੰਗ੍ਰਹਿ ਸਰੋਤਾਂ ਦੀ ਵਿਸ਼ਾਲ ਸ਼੍ਰੇਣੀ ਵਿੱਚੋਂ ਚੁਣੋ।

ਮੋਨੋਲੋਗ ਭਾਸ਼ਣ

ਮੋਨੋਲੋਗ ਸਕ੍ਰਿਪਟਡ ਅਤੇ ਸਪੋਟੈਨੀਅਸ ਸਪੀਚ

ਇਹ ਇੱਕ ਸਿੰਗਲ ਸਪੀਕਰ ਤੋਂ ਭਾਸ਼ਣ ਦੀ ਪ੍ਰਕਿਰਿਆ ਕਰਨ 'ਤੇ ਕੇਂਦ੍ਰਤ ਕਰਦਾ ਹੈ। ਸਿੰਗਲ-ਚੈਨਲ ਆਡੀਓ ਫਾਈਲਾਂ ਵਿੱਚ ਫੀਡ ਕਰਨ ਲਈ ਸਕ੍ਰਿਪਟਡ ਪ੍ਰੋਂਪਟ ਦੀ ਵਰਤੋਂ ਕਰੋ, ਇਹ ਯਕੀਨੀ ਬਣਾਉਂਦੇ ਹੋਏ ਕਿ ਉਸ ਵਿਅਕਤੀ ਲਈ ਵਿਲੱਖਣ ਬੋਲਣ ਦੇ ਪੈਟਰਨਾਂ, ਟੋਨਾਂ ਅਤੇ ਸੂਖਮਤਾਵਾਂ ਨੂੰ ਕੈਪਚਰ ਕਰਨਾ ਯਕੀਨੀ ਬਣਾਓ।

ਸੰਵਾਦ ਭਾਸ਼ਣ

ਵਾਰਤਾਲਾਪ ਸਕ੍ਰਿਪਟ ਅਤੇ ਸੁਭਾਵਿਕ ਭਾਸ਼ਣ

ਦੋ-ਵਿਅਕਤੀ ਦੀ ਆਪਸੀ ਤਾਲਮੇਲ, ਦੋਹਰੇ-ਚੈਨਲ ਫਾਈਲਾਂ ਅਤੇ ਪ੍ਰਤੀਲਿਪੀ ਸਰੋਤਾਂ ਦੁਆਰਾ ਬਹੁ-ਭਾਸ਼ਾਈ ਐਕਸਪੋਜ਼ਰ ਦੇ ਨਾਲ ਅਸਲ-ਸੰਸਾਰ ਗੱਲਬਾਤ ਅਤੇ ਸੰਵਾਦਾਂ ਦੀ ਨਕਲ ਕਰਨਾ।

ਬਹੁ-ਪਾਰਟੀ ਗੱਲਬਾਤ

ਸਮੂਹ/ਮੁਟੀ-ਪਾਰਟੀ
ਗੱਲਬਾਤ

ਬਹੁ-ਵਿਅਕਤੀ ਵਿਚਾਰ-ਵਟਾਂਦਰੇ, ਸਮੂਹ ਦੀ ਗਤੀਸ਼ੀਲਤਾ ਨੂੰ ਕੈਪਚਰ ਕਰਨਾ, ਓਵਰਲੈਪ, ਅਤੇ ਵੱਖੋ-ਵੱਖਰੇ ਟੋਨ ਤਾਂ ਜੋ ਸਪੀਚ ਮਾਡਲਾਂ ਨੂੰ ਸਹੀ ਢੰਗ ਨਾਲ ਸਿਖਲਾਈ ਦਿੱਤੀ ਜਾ ਸਕੇ।

ਵੇਕ-ਸ਼ਬਦ ਉਚਾਰਨ ਸੰਗ੍ਰਹਿ

ਵੇਕ-ਸ਼ਬਦ / ਮੁੱਖ ਵਾਕਾਂਸ਼ / ਵਾਕਾਂਸ਼ ਸੰਗ੍ਰਹਿ

ਉੱਨਤ ਕੁਦਰਤੀ ਭਾਸ਼ਾ ਦੀ ਪ੍ਰਕਿਰਿਆ ਅਤੇ ਸਮਝ ਲਈ ਵਿਭਿੰਨ, ਅਮੀਰ ਅਤੇ ਪ੍ਰਮਾਣਿਕ ​​ਵਾਕਾਂਸ਼ਾਂ ਦੀ ਵਰਤੋਂ ਕਰਦੇ ਹੋਏ ਮੁੱਖ ਵਾਕਾਂਸ਼ਾਂ ਜਾਂ ਸ਼ਬਦਾਂ ਜਾਂ ਵਾਕਾਂਸ਼ਾਂ ਨੂੰ ਇੱਕੋ ਜਿਹੇ ਅਰਥਾਂ ਦੀ ਪਛਾਣ ਕਰਨ ਲਈ AIs ਨੂੰ ਸਿਖਲਾਈ ਦਿਓ।

ਧੁਨੀ ਭਾਸ਼ਣ

ਧੁਨੀ ਡਾਟਾ
ਭੰਡਾਰ

ਅਸੀਂ ਪੇਸ਼ੇਵਰ ਤੌਰ 'ਤੇ ਸਟੂਡੀਓ-ਗੁਣਵੱਤਾ ਵਾਲੇ ਆਡੀਓ ਡੇਟਾ ਨੂੰ ਰਿਕਾਰਡ ਕਰ ਸਕਦੇ ਹਾਂ ਭਾਵੇਂ ਇਹ ਰੈਸਟੋਰੈਂਟਾਂ, ਦਫਤਰਾਂ, ਜਾਂ ਘਰਾਂ ਜਾਂ ਵੱਖ-ਵੱਖ ਵਾਤਾਵਰਣਾਂ ਅਤੇ ਭਾਸ਼ਾਵਾਂ ਤੋਂ ਹੋਵੇ, ਜਦੋਂ ਕਿ ਇੱਕ ਵਿਸ਼ਾਲ ਧੁਨੀ ਸੀਮਾ (ਵਿਆਪਕ ਧੁਨੀ ਡੇਟਾਸੇਟਸ) ਨੂੰ ਕਵਰ ਕਰਦੇ ਹੋਏ।

ਆਟੋਮੈਟਿਕ ਸਪੀਚ ਪਛਾਣ

ਆਟੋਮੈਟਿਕ ਸਪੀਚ ਰਿਕੋਗਨੀਸ਼ਨ (ASR)

ਜਨਸੰਖਿਆ ਦੀ ਵਿਸ਼ਾਲ ਸ਼੍ਰੇਣੀ ਤੋਂ, ਅਤਿ-ਆਧੁਨਿਕ ਵਿਭਿੰਨ ਸਪੀਚ/ਆਡੀਓ ਡੇਟਾਸੇਟਾਂ ਤੱਕ ਪਹੁੰਚ ਪ੍ਰਾਪਤ ਕਰਕੇ ਆਪਣੇ ਆਟੋਮੈਟਿਕ ਸਪੀਚ ਰਿਕੋਗਨੀਸ਼ਨ (ASR) ਸਿਸਟਮਾਂ ਦੀ ਸ਼ੁੱਧਤਾ ਵਿੱਚ ਸੁਧਾਰ ਕਰੋ।

ਕੁਦਰਤੀ ਭਾਸ਼ਾ ਉਚਾਰਨ

ਬਹੁ-ਭਾਸ਼ਾਈ ਭਾਸ਼ਣ/ਆਡੀਓ ਸਿਖਲਾਈ ਡੇਟਾ

ਸਾਡੇ ਹੁਨਰਮੰਦ ਭਾਸ਼ਾ ਪੇਸ਼ੇਵਰ, ਵਿਸ਼ਵ ਭਰ ਵਿੱਚ ਵੱਖ-ਵੱਖ ਭਾਸ਼ਾਵਾਂ ਅਤੇ ਉਪਭਾਸ਼ਾਵਾਂ ਵਿੱਚ ਬਹੁ-ਭਾਸ਼ਾਈ ਆਡੀਓ/ਸਪੀਚ ਡੇਟਾ ਪੇਸ਼ ਕਰਦੇ ਹਨ। ਇਹ ਯਤਨ ਵਿਸ਼ਵਵਿਆਪੀ ਸੰਚਾਰ ਨੂੰ ਉਤਸ਼ਾਹਿਤ ਕਰਦਾ ਹੈ ਅਤੇ ਭਾਸ਼ਾ ਦੀਆਂ ਰੁਕਾਵਟਾਂ ਨੂੰ ਦੂਰ ਕਰਦਾ ਹੈ, ਵਧੇਰੇ ਸੰਮਲਿਤ ਅਤੇ ਪ੍ਰਭਾਵਸ਼ਾਲੀ AI ਹੱਲਾਂ ਵਿੱਚ ਯੋਗਦਾਨ ਪਾਉਂਦਾ ਹੈ।

ਡਿਜੀਟਲ ਵਰਚੁਅਲ ਸਹਾਇਕ

ਟੈਕਸਟ-ਟੂ-ਸਪੀਚ
(TTS)

ਸਾਡੇ ਗਲੋਬਲ ਕਰਮਚਾਰੀਆਂ ਦੀ ਮਦਦ ਨਾਲ ਇੱਕ ਟੈਕਸਟ-ਟੂ-ਸਪੀਚ (TTS) ਬਹੁ-ਭਾਸ਼ਾਈ ਮਾਡਲ ਬਣਾਓ, ਜੋ 150+ ਭਾਸ਼ਾਵਾਂ ਅਤੇ ਉਪਭਾਸ਼ਾਵਾਂ ਵਿੱਚ ਸਪੀਚ ਡਾਟਾ ਇਕੱਠਾ ਕਰਨ ਵਿੱਚ ਤੁਹਾਡੀ ਮਦਦ ਕਰਦਾ ਹੈ ਤਾਂ ਜੋ ਤੁਹਾਡੇ AI ਮਾਡਲਾਂ ਨੂੰ ਕਾਰ-ਵਿੱਚ ਕੰਟਰੋਲ ਤੋਂ ਲੈ ਕੇ ਚੈਟਬੋਟਸ ਤੱਕ ਅਤੇ ਉੱਚ-ਸਿੱਖਣ ਦੇ ਹੱਲਾਂ ਨਾਲ ਬਿਹਤਰ ਬਣਾਇਆ ਜਾ ਸਕੇ। ਗੁਣਵੱਤਾ ਆਡੀਓ ਡਾਟਾ.

ਕਾਲ ਸੈਂਟਰ ਰਿਕਾਰਡਿੰਗ

ਕਾਲ ਸੈਂਟਰ
ਗੱਲਬਾਤ

ਸਪੈਨਿਸ਼, ਜਰਮਨ, ਅਮਰੀਕਨ ਅੰਗਰੇਜ਼ੀ, ਬੰਗਾਲੀ, ਜਾਪਾਨੀ, ਚੀਨੀ ਅਤੇ ਹਿੰਦੀ ਵਰਗੀਆਂ ਕਈ ਭਾਸ਼ਾਵਾਂ ਦਾ ਸਮਰਥਨ ਕਰਦੇ ਹੋਏ ਏਜੰਟਾਂ ਅਤੇ ਗਾਹਕਾਂ ਵਿਚਕਾਰ ਅਸਲੀ ਆਦਾਨ-ਪ੍ਰਦਾਨ।

ਸਫਲਤਾ ਦੀਆਂ ਕਹਾਣੀਆਂ

3 ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ 8k ਘੰਟਿਆਂ ਤੋਂ ਵੱਧ ਡੇਟਾ ਦੇ ਨਾਲ ਗੱਲਬਾਤ ਕਰਨ ਵਾਲਾ AI ਡੇਟਾਸੈੱਟ

ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਲਈ ਇੱਕ ਬਹੁ-ਭਾਸ਼ਾਈ ਪਲੇਟਫਾਰਮ ਬਣਾਉਣ ਦੀ ਕੋਸ਼ਿਸ਼ ਕਰਦੇ ਹੋਏ, ਕਲਾਇੰਟ ਨੇ ਕਈ ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ ਵੱਡੇ ਡੇਟਾਸੇਟਾਂ ਨੂੰ ਇਕੱਤਰ ਕਰਨ, ਵੰਡਣ ਅਤੇ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਕਰਨ ਲਈ ਸ਼ੈਪ ਨਾਲ ਸਾਂਝੇਦਾਰੀ ਕੀਤੀ। ਇਹ ਪ੍ਰਭਾਵਸ਼ਾਲੀ ਭਾਸ਼ਣ ਮਾਡਲਾਂ ਨੂੰ ਵਿਕਸਤ ਕਰਨ ਵਿੱਚ ਮਦਦ ਕਰੇਗਾ ਜੋ ਗਾਹਕ ਦੇ ਨਵੀਨਤਾਕਾਰੀ ਨਵੇਂ ਪਲੇਟਫਾਰਮ ਨੂੰ ਤਾਕਤ ਦੇ ਸਕਦੇ ਹਨ।

ਸਮੱਸਿਆ: 8 ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ 3,000 ਘੰਟਿਆਂ ਤੋਂ ਵੱਧ ਆਡੀਓ ਡੇਟਾ ਇਕੱਠਾ ਕੀਤਾ ਗਿਆ, ਆਟੋਮੈਟਿਕ ਸਪੀਚ ਪਛਾਣ ਵਿਕਸਤ ਕਰਨ ਲਈ ਵੰਡਿਆ ਅਤੇ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਕੀਤਾ ਗਿਆ।

ਹੱਲ: ਅਸੀਂ ਡੇਟਾ ਸੰਗ੍ਰਹਿ, ਸੈਗਮੈਂਟੇਸ਼ਨ, ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਪ੍ਰਦਾਨ ਕੀਤੇ, ਅਤੇ ਮੈਟਾਡੇਟਾ ਦੇ ਨਾਲ JSON ਫਾਈਲਾਂ ਪ੍ਰਦਾਨ ਕੀਤੀਆਂ। ਅਸੀਂ ਕਲਾਇੰਟ ਦੇ ਸਪੀਚ ਟੈਕਨਾਲੋਜੀ ਪ੍ਰੋਜੈਕਟ ਲਈ 8 ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ 3000 ਘੰਟੇ ਦਾ ਆਡੀਓ ਡੇਟਾ ਇਕੱਠਾ ਕੀਤਾ।

ਸਪੀਚ ਡਾਟਾ ਕਲੈਕਸ਼ਨ ਕੇਸ ਸਟੱਡੀ

ਸ਼ੈਪ ਨੂੰ ਤੁਹਾਡੇ ਭਰੋਸੇਮੰਦ ਸਪੀਚ ਡੇਟਾ ਕਲੈਕਸ਼ਨ ਪਾਰਟਨਰ ਵਜੋਂ ਚੁਣਨ ਦੇ ਕਾਰਨ

ਲੋਕ

ਲੋਕ

ਸਮਰਪਿਤ ਅਤੇ ਸਿਖਲਾਈ ਪ੍ਰਾਪਤ ਟੀਮਾਂ:

  • ਡਾਟਾ ਬਣਾਉਣ, ਲੇਬਲਿੰਗ ਅਤੇ QA ਲਈ 30,000+ ਸਹਿਯੋਗੀ
  • ਪ੍ਰਮਾਣਿਤ ਪ੍ਰੋਜੈਕਟ ਪ੍ਰਬੰਧਨ ਟੀਮ
  • ਤਜਰਬੇਕਾਰ ਉਤਪਾਦ ਵਿਕਾਸ ਟੀਮ
  • ਟੇਲੈਂਟ ਪੂਲ ਸੋਰਸਿੰਗ ਅਤੇ ਆਨਬੋਰਡਿੰਗ ਟੀਮ
ਕਾਰਵਾਈ

ਕਾਰਵਾਈ

ਉੱਚਤਮ ਪ੍ਰਕਿਰਿਆ ਦੀ ਕੁਸ਼ਲਤਾ ਨੂੰ ਇਸ ਨਾਲ ਯਕੀਨੀ ਬਣਾਇਆ ਜਾਂਦਾ ਹੈ:

  • ਮਜਬੂਤ 6 ਸਿਗਮਾ ਸਟੇਜ-ਗੇਟ ਪ੍ਰਕਿਰਿਆ
  • 6 ਸਿਗਮਾ ਬਲੈਕ ਬੈਲਟਾਂ ਦੀ ਇੱਕ ਸਮਰਪਿਤ ਟੀਮ - ਮੁੱਖ ਪ੍ਰਕਿਰਿਆ ਦੇ ਮਾਲਕ ਅਤੇ ਗੁਣਵੱਤਾ ਦੀ ਪਾਲਣਾ
  • ਨਿਰੰਤਰ ਸੁਧਾਰ ਅਤੇ ਫੀਡਬੈਕ ਲੂਪ
ਪਲੇਟਫਾਰਮ

ਪਲੇਟਫਾਰਮ

ਪੇਟੈਂਟ ਪਲੇਟਫਾਰਮ ਲਾਭਾਂ ਦੀ ਪੇਸ਼ਕਸ਼ ਕਰਦਾ ਹੈ:

  • ਵੈੱਬ-ਅਧਾਰਿਤ ਐਂਡ-ਟੂ-ਐਂਡ ਪਲੇਟਫਾਰਮ
  • ਨਿਰਦੋਸ਼ ਗੁਣਵੱਤਾ
  • ਤੇਜ਼ TAT
  • ਸਹਿਜ ਡਿਲਿਵਰੀ

ਆਫ-ਦੀ-ਸ਼ੈਲਫ ਸਪੀਚ / ਆਡੀਓ ਡਾਟਾਸੈੱਟ

ਭਾਸ਼ਾ ਡੇਟਾਸੈਟਨਮੂਨਾ ਦਰਡਾਟਾਸੈੱਟ ਦੀ ਕਿਸਮਕੁੱਲ ਆਡੀਓ ਘੰਟੇ
+ਅਫਰੀਕਨ ਅਮਰੀਕਨ ਵਰਨਾਕੂਲਰ8 driver ਵਰਤਣਕਾਲ-ਸੈਂਟਰ211
ਛੋਟੇ ਵਰਣਨਅਫ਼ਰੀਕੀ ਅਮਰੀਕੀ ਵਰਨਾਕੂਲਰ ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ: 612, ਮਰਦ: 1242, ਅਤੇ ਅਣਜਾਣ: 12
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ154
ਛੋਟੇ ਵਰਣਨਅਫ਼ਰੀਕੀ ਅਮਰੀਕੀ ਵਰਨਾਕੂਲਰ ਮੀਡੀਆ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ: 151, ਮਰਦ: 150, ਅਤੇ ਅਣਜਾਣ: 10
+ਅਫ੍ਰੀਕਨਸ8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ368
ਛੋਟੇ ਵਰਣਨਅਫ਼ਰੀਕੀ ਆਮ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਦੋ ਲੋਕਾਂ ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ ਟੈਲੀਫ਼ੋਨ ਗੱਲਬਾਤ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) - 15-60 ਮਿੰਟ, ਅਫ਼ਰੀਕਾ ਵਿੱਚ ਬੋਲੀ ਜਾਂਦੀ ਅਫ਼ਰੀਕੀ ਭਾਸ਼ਾ।
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ: 502, ਮਰਦ: 390, ਅਤੇ ਅਣਜਾਣ: 2
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ658
ਛੋਟੇ ਵਰਣਨਅਫ਼ਰੀਕੀ ਮੀਡੀਆ ਫਾਈਲਾਂ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ: 750, ਮਰਦ: 1278, ਅਤੇ ਅਣਜਾਣ: 52
+ਅਰਬੀ ਵਿਚ8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ292
ਛੋਟੇ ਵਰਣਨਅਰਬੀ ਆਮ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਦੋ ਲੋਕਾਂ ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ ਟੈਲੀਫ਼ੋਨ ਗੱਲਬਾਤ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) - 15-60 ਮਿੰਟ, ਖਾੜੀ ਦੇਸ਼ਾਂ ਤੋਂ ਅਰਬੀ।
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ: 171, ਮਰਦ: 534, ਅਤੇ ਅਣਜਾਣ: 1
+48 driver ਵਰਤਣਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ1,947
ਛੋਟੇ ਵਰਣਨਅਰਬੀ ਲਿਪੀ ਵਾਲਾ ਮੋਨੋਲੋਗ
ਡਾਟਾਸੈਟ ਵਰਣਨਇੱਕ-ਉਚਾਰਨ ਰਿਕਾਰਡਿੰਗਾਂ, ਜੋ ਕਿ 5 ਤੋਂ 30 ਸਕਿੰਟ ਦੀ ਰੇਂਜ ਵਿੱਚ ਆਉਂਦੀਆਂ ਹਨ।
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਮੋਬਾਈਲ ਐਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 838 ਮਰਦ 1209 ਅਣਜਾਣ 78
+ਅਸਾਮੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ60
ਛੋਟੇ ਵਰਣਨਅਸਾਮੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਆਮ ਗੱਲਬਾਤ100
ਛੋਟੇ ਵਰਣਨਅਸਾਮੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਆਮ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਪੋਡਕਾਸਟ40
ਛੋਟੇ ਵਰਣਨਅਸਾਮੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਮੀਡੀਆ ਆਡੀਓ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਬੰਗਾਲੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ60
ਛੋਟੇ ਵਰਣਨਬੰਗਾਲੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਆਮ ਗੱਲਬਾਤ100
ਛੋਟੇ ਵਰਣਨਬੰਗਾਲੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਆਮ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਪੋਡਕਾਸਟ40
ਛੋਟੇ ਵਰਣਨਬੰਗਾਲੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਬੋਸਟਨ ਅੰਗਰੇਜ਼ੀ8 driver ਵਰਤਣਕਾਲ-ਸੈਂਟਰ177
ਛੋਟੇ ਵਰਣਨਬੋਸਟਨ ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ: 605, ਮਰਦ: 711, ਅਤੇ ਅਣਜਾਣ: 0
+8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ32
ਛੋਟੇ ਵਰਣਨਬੋਸਟਨ ਜਨਰਲ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਦੋ ਲੋਕਾਂ ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ ਟੈਲੀਫ਼ੋਨ ਗੱਲਬਾਤ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) - 15-60 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ: 53, ਮਰਦ: 83, ਅਤੇ ਅਣਜਾਣ: 0
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ93
ਛੋਟੇ ਵਰਣਨਬੋਸਟਨ ਮੀਡੀਆ ਆਡੀਓ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ: 43, ਮਰਦ: 181, ਅਤੇ ਅਣਜਾਣ: 2
+ਕੈਨੇਡੀਅਨ ਫ੍ਰੈਂਚ48 driver ਵਰਤਣਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ1,222
ਛੋਟੇ ਵਰਣਨਕੈਨੇਡੀਅਨ ਫ੍ਰੈਂਚ
ਡਾਟਾਸੈਟ ਵਰਣਨਇੱਕ-ਉਚਾਰਨ ਰਿਕਾਰਡਿੰਗਾਂ, ਜੋ ਕਿ 5 ਤੋਂ 30 ਸਕਿੰਟ ਦੀ ਰੇਂਜ ਵਿੱਚ ਆਉਂਦੀਆਂ ਹਨ।
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਮੋਬਾਈਲ ਐਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 974 ਮਰਦ 631 ਅਣਜਾਣ 1
+ਚੀਨੀ ਅੰਗਰੇਜ਼ੀ8 driver ਵਰਤਣਕਾਲ-ਸੈਂਟਰ169
ਛੋਟੇ ਵਰਣਨਚੀਨੀ ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤਾਂ: 1790, ਮਰਦ: 523 ਅਤੇ ਅਣਜਾਣ: 13
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ249
ਛੋਟੇ ਵਰਣਨਚੀਨੀ ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤਾਂ: 126, ਮਰਦ: 346 ਅਤੇ ਅਣਜਾਣ: 6
+ਚੀਨੀ ਸਧਾਰਨ48 driver ਵਰਤਣਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ2,762
ਛੋਟੇ ਵਰਣਨਚੀਨੀ ਸਧਾਰਨ
ਡਾਟਾਸੈਟ ਵਰਣਨਇੱਕ-ਉਚਾਰਨ ਰਿਕਾਰਡਿੰਗਾਂ, ਜੋ ਕਿ 5 ਤੋਂ 30 ਸਕਿੰਟ ਦੀ ਰੇਂਜ ਵਿੱਚ ਆਉਂਦੀਆਂ ਹਨ।
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਮੋਬਾਈਲ ਐਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 1920 ਮਰਦ 1535 ਅਣਜਾਣ 270
+ਚੀਨੀ ਪਰੰਪਰਿਕ48 driver ਵਰਤਣਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ1,028
ਛੋਟੇ ਵਰਣਨਚੀਨੀ ਪਰੰਪਰਿਕ
ਡਾਟਾਸੈਟ ਵਰਣਨਇੱਕ-ਉਚਾਰਨ ਰਿਕਾਰਡਿੰਗਾਂ, ਜੋ ਕਿ 5 ਤੋਂ 30 ਸਕਿੰਟ ਦੀ ਰੇਂਜ ਵਿੱਚ ਆਉਂਦੀਆਂ ਹਨ।
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਮੋਬਾਈਲ ਐਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 1069 ਮਰਦ 262 ਅਣਜਾਣ 3
+ਡੈੱਨਮਾਰਕੀ8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ372
ਛੋਟੇ ਵਰਣਨਡੈਨਿਸ਼ ਜਨਰਲ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਦੋ ਲੋਕਾਂ ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ ਟੈਲੀਫ਼ੋਨ ਗੱਲਬਾਤ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) - 15-60 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤਾਂ: 311, ਮਰਦ: 417, ਅਣਜਾਣ: 0
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ664
ਛੋਟੇ ਵਰਣਨਡੈਨਿਸ਼ ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤਾਂ: 369, ਮਰਦ: 864, ਅਣਜਾਣ: 27
+48 driver ਵਰਤਣਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ2,579
ਛੋਟੇ ਵਰਣਨਡੈਨਿਸ਼ ਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ
ਡਾਟਾਸੈਟ ਵਰਣਨਸਿੰਗਲ-ਉਚਾਰਨ ਰਿਕਾਰਡਿੰਗਾਂ, ਜੋ ਕਿ 5 ਤੋਂ 30 ਸਕਿੰਟ ਦੀ ਰੇਂਜ ਵਿੱਚ ਆਉਂਦੀਆਂ ਹਨ, ਡੈਨਮਾਰਕ ਤੋਂ ਡੈਨਿਸ਼
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਮੋਬਾਈਲ ਐਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 1551 ਮਰਦ 1233 ਅਣਜਾਣ 42
+ਅੰਗਰੇਜ਼ੀ ਦੀਪ ਦੱਖਣੀ8 driver ਵਰਤਣਕਾਲ-ਸੈਂਟਰ151
ਛੋਟੇ ਵਰਣਨਅੰਗਰੇਜ਼ੀ ਡੀਪ ਸਾਊਥ ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 221, ਮਰਦ 1004, ਅਣਜਾਣ 7
+8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ56
ਛੋਟੇ ਵਰਣਨਅੰਗਰੇਜ਼ੀ ਡੀਪ ਸਾਊਥ ਜਨਰਲ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਦੋ ਲੋਕਾਂ ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ ਟੈਲੀਫ਼ੋਨ ਗੱਲਬਾਤ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) - 15-60 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 99, ਮਰਦ 31, ਅਣਜਾਣ 0
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ266
ਛੋਟੇ ਵਰਣਨਅੰਗਰੇਜ਼ੀ ਦੀਪ ਸਾਊਥ ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 204, ਮਰਦ 356, ਅਣਜਾਣ 21
+ਜਰਮਨ ਵਿਚ8 driver ਵਰਤਣਕਾਲ-ਸੈਂਟਰ64
ਛੋਟੇ ਵਰਣਨਜਰਮਨ ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 478 ਮਰਦ 1440 ਅਣਜਾਣ 0
+8 driver ਵਰਤਣ ਆਈਵੀਆਰ200
ਛੋਟੇ ਵਰਣਨਜਰਮਨ IVR ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਮਨੁੱਖ ਤੋਂ ਮਸ਼ੀਨ ਤੱਕ। ਇੱਕ IVR ਕਿਸਮ ਦਾ ਪ੍ਰਵਾਹ ਜਿੱਥੇ ਇੱਕ TTS ਪ੍ਰੋਂਪਟ (ਜਿਵੇਂ ਕਿ "ਮੈਂ ਤੁਹਾਡੀ ਕਿਵੇਂ ਮਦਦ ਕਰ ਸਕਦਾ ਹਾਂ") ਹੁੰਦਾ ਹੈ ਅਤੇ ਉਸ ਤੋਂ ਬਾਅਦ ਇੱਕ ਸਵੈਚਲਿਤ ਮਨੁੱਖੀ ਪ੍ਰਤੀਕਿਰਿਆ ਹੁੰਦੀ ਹੈ।
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 10115 ਮਰਦ 8750 ਅਣਜਾਣ 0
+ਗੁਜਰਾਤੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ60
ਛੋਟੇ ਵਰਣਨਗੁਜਰਾਤੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਆਮ ਗੱਲਬਾਤ100
ਛੋਟੇ ਵਰਣਨਗੁਜਰਾਤੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਆਮ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਪੋਡਕਾਸਟ40
ਛੋਟੇ ਵਰਣਨਗੁਜਰਾਤੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਹਿਬਰੂ8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ399
ਛੋਟੇ ਵਰਣਨਹਿਬਰੂ ਜਨਰਲ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਦੋ ਲੋਕਾਂ ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ ਟੈਲੀਫ਼ੋਨ ਗੱਲਬਾਤ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) - 15-60 ਮਿੰਟ, ਇਜ਼ਰਾਈਲ ਵਿੱਚ ਹਿਬਰੂ।
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 414, ਮਰਦ 399, ਅਣਜਾਣ 1
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ427
ਛੋਟੇ ਵਰਣਨਹਿਬਰੂ ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 361, ਮਰਦ 513, ਅਣਜਾਣ 13
+ਦਾ ਹਿੰਦੀ16 driver ਵਰਤਣਪੋਡਕਾਸਟ219
ਛੋਟੇ ਵਰਣਨਹਿੰਦੀ ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 83, ਮਰਦ 309, ਅਣਜਾਣ 0
+48 driver ਵਰਤਣਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ2,867
ਛੋਟੇ ਵਰਣਨਹਿੰਦੀ ਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ
ਡਾਟਾਸੈਟ ਵਰਣਨਇੱਕ-ਉਚਾਰਨ ਰਿਕਾਰਡਿੰਗਾਂ, ਜੋ ਕਿ 5 ਤੋਂ 30 ਸਕਿੰਟ ਦੀ ਰੇਂਜ ਵਿੱਚ ਆਉਂਦੀਆਂ ਹਨ।
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਮੋਬਾਈਲ ਐਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 1977 ਮਰਦ 1864 ਅਣਜਾਣ 147
+ਹਿੰਗਲਿਸ਼8 driver ਵਰਤਣਕਾਲ-ਸੈਂਟਰ208
ਛੋਟੇ ਵਰਣਨਹਿੰਗਲਿਸ਼ ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 822, ਮਰਦ 1262, ਅਣਜਾਣ 0
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ216
ਛੋਟੇ ਵਰਣਨਹਿੰਗਲਿਸ਼ ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 75, ਮਰਦ 380, ਅਣਜਾਣ 0
+ਹਿਸਪੈਨਿਕ ਅੰਗਰੇਜ਼ੀ8 driver ਵਰਤਣਕਾਲ-ਸੈਂਟਰ212
ਛੋਟੇ ਵਰਣਨਹਿਸਪੈਨਿਕ ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 822, ਮਰਦ 1262, ਅਣਜਾਣ 0
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ155
ਛੋਟੇ ਵਰਣਨਹਿਸਪੈਨਿਕ ਕਾਲ ਮੀਡੀਆ ਆਡੀਓ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 140, ਮਰਦ 219, ਅਣਜਾਣ 5
+ਇੰਡੋਨੇਸ਼ੀਆਈ ਵਿਚ8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ496
ਛੋਟੇ ਵਰਣਨਇੰਡੋਨੇਸ਼ੀਆਈ ਜਨਰਲ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਦੋ ਲੋਕਾਂ ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ ਟੈਲੀਫ਼ੋਨ ਗੱਲਬਾਤ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) - 15-60 ਮਿੰਟ, ਬਹਾਸਾ ਇੰਡੋਨੇਸ਼ੀਆਈ
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 524, ਮਰਦ 454, ਅਣਜਾਣ 2
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ643
ਛੋਟੇ ਵਰਣਨਇੰਡੋਨੇਸ਼ੀਆਈ ਮੀਡੀਆ ਆਡੀਓ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 746, ਮਰਦ 1507, ਅਣਜਾਣ 129
+ਆਇਰਿਸ਼8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ192
ਛੋਟੇ ਵਰਣਨਆਇਰਿਸ਼ ਜਨਰਲ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਦੋ ਲੋਕਾਂ ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ ਟੈਲੀਫ਼ੋਨ ਗੱਲਬਾਤ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) - 15-60 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 213, ਮਰਦ 153, ਅਣਜਾਣ 0
+ਜਪਾਨੀ48 driver ਵਰਤਣਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ2,335
ਛੋਟੇ ਵਰਣਨਜਪਾਨੀ ਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ
ਡਾਟਾਸੈਟ ਵਰਣਨਇੱਕ-ਉਚਾਰਨ ਰਿਕਾਰਡਿੰਗਾਂ, ਜੋ ਕਿ 5 ਤੋਂ 30 ਸਕਿੰਟ ਦੀ ਰੇਂਜ ਵਿੱਚ ਆਉਂਦੀਆਂ ਹਨ।
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਮੋਬਾਈਲ ਐਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 1460 ਮਰਦ 1221 ਅਣਜਾਣ 194
+ਕੰਨੜ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ60
ਛੋਟੇ ਵਰਣਨਕੰਨੜ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਆਮ ਗੱਲਬਾਤ100
ਛੋਟੇ ਵਰਣਨਕੰਨੜ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਆਮ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਪੋਡਕਾਸਟ40
ਛੋਟੇ ਵਰਣਨਕੰਨੜ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਕੋਰੀਆਈ8 driver ਵਰਤਣਕਾਲ-ਸੈਂਟਰ107
ਛੋਟੇ ਵਰਣਨਕੋਰੀਆਈ ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 1086, ਮਰਦ 210, ਅਗਿਆਤ 4
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ204
ਛੋਟੇ ਵਰਣਨਕੋਰੀਆਈ ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 70 ਮਰਦ 303, ਅਣਜਾਣ 25
+48 driver ਵਰਤਣਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ1,955
ਛੋਟੇ ਵਰਣਨਕੋਰੀਆਈ ਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ
ਡਾਟਾਸੈਟ ਵਰਣਨਇੱਕ-ਉਚਾਰਨ ਰਿਕਾਰਡਿੰਗਾਂ, ਜੋ ਕਿ 5 ਤੋਂ 30 ਸਕਿੰਟ ਦੀ ਰੇਂਜ ਵਿੱਚ ਆਉਂਦੀਆਂ ਹਨ।
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਮੋਬਾਈਲ ਐਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 1195 ਮਰਦ 1134 ਅਣਜਾਣ 122
+ਮਾਲੇਈ8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ266
ਛੋਟੇ ਵਰਣਨਮਲੇਈ ਜਨਰਲ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਦੋ ਲੋਕਾਂ ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ ਟੈਲੀਫ਼ੋਨ ਗੱਲਬਾਤ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) - 15-60 ਮਿੰਟ, ਮਲੇਸ਼ੀਆ ਵਿੱਚ ਮਲੇ
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 316, ਮਰਦ 176, ਅਣਜਾਣ 0
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ344
ਛੋਟੇ ਵਰਣਨਮਾਲੇਈ ਮੀਡੀਆ ਆਡੀਓ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 236, ਮਰਦ 626, ਅਣਜਾਣ 47
+ਮਲਿਆਲਮ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ60
ਛੋਟੇ ਵਰਣਨਮਲਿਆਲਮ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਆਮ ਗੱਲਬਾਤ100
ਛੋਟੇ ਵਰਣਨਮਲਿਆਲਮ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਆਮ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਪੋਡਕਾਸਟ40
ਛੋਟੇ ਵਰਣਨਮਲਿਆਲਮ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਮਰਾਠੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ60
ਛੋਟੇ ਵਰਣਨਮਰਾਠੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਆਮ ਗੱਲਬਾਤ100
ਛੋਟੇ ਵਰਣਨਮਰਾਠੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਆਮ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਪੋਡਕਾਸਟ40
ਛੋਟੇ ਵਰਣਨਮਰਾਠੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਮੀਡੀਆ ਆਡੀਓ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਸਪੈਨਿਸ਼ (ਮੈਕਸੀਕੋ)48 driver ਵਰਤਣਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ1,492
ਛੋਟੇ ਵਰਣਨਮੈਕਸੀਕਨ ਸਪੈਨਿਸ਼ ਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ
ਡਾਟਾਸੈਟ ਵਰਣਨਇੱਕ-ਉਚਾਰਨ ਰਿਕਾਰਡਿੰਗਾਂ, ਜੋ ਕਿ 5 ਤੋਂ 30 ਸਕਿੰਟ ਦੀ ਰੇਂਜ ਵਿੱਚ ਆਉਂਦੀਆਂ ਹਨ।
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਮੋਬਾਈਲ ਐਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 1016 ਮਰਦ 1069 ਅਣਜਾਣ 95
+ਡੱਚ ਵਿਚ48 driver ਵਰਤਣਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ1,205
ਛੋਟੇ ਵਰਣਨਡੱਚ ਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ
ਡਾਟਾਸੈਟ ਵਰਣਨਇੱਕ-ਉਚਾਰਨ ਰਿਕਾਰਡਿੰਗਾਂ, ਜੋ ਕਿ 5 ਤੋਂ 30 ਸਕਿੰਟ ਦੀ ਰੇਂਜ ਵਿੱਚ ਆਉਂਦੀਆਂ ਹਨ।
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਮੋਬਾਈਲ ਐਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 1285 ਮਰਦ 531 ਅਣਜਾਣ 3
+ਨਿਊਯਾਰਕ ਅੰਗਰੇਜ਼ੀ8 driver ਵਰਤਣਕਾਲ-ਸੈਂਟਰ103
ਛੋਟੇ ਵਰਣਨਨਿਊਯਾਰਕ ਅੰਗਰੇਜ਼ੀ ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 610, ਮਰਦ 532, ਅਣਜਾਣ 0
+8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ107
ਛੋਟੇ ਵਰਣਨਨਿਊਯਾਰਕ ਅੰਗਰੇਜ਼ੀ ਜਨਰਲ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਦੋ ਲੋਕਾਂ ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ ਟੈਲੀਫ਼ੋਨ ਗੱਲਬਾਤ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) - 15-60 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 118, ਮਰਦ 114, ਅਣਜਾਣ 0
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ140
ਛੋਟੇ ਵਰਣਨਨਿਊਯਾਰਕ ਇੰਗਲਿਸ਼ ਮੀਡੀਆ ਆਡੀਓ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 66, ਮਰਦ 230, ਅਣਜਾਣ 11
+ਨਿ Zealandਜ਼ੀਲੈਂਡ ਇੰਗਲਿਸ਼ 8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ148
ਛੋਟੇ ਵਰਣਨਨਿਊਜ਼ੀਲੈਂਡ ਅੰਗਰੇਜ਼ੀ ਜਨਰਲ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਦੋ ਲੋਕਾਂ ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ ਟੈਲੀਫ਼ੋਨ ਗੱਲਬਾਤ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) - 15-60 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਇਸਤਰੀ 167, ਪੁਰਸ਼ 121, ਅਗਿਆਤ 4
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ400
ਛੋਟੇ ਵਰਣਨਨਿਊਜ਼ੀਲੈਂਡ ਇੰਗਲਿਸ਼ ਮੀਡੀਆ ਆਡੀਓ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਇਸਤਰੀ 367, ਪੁਰਸ਼ 678, ਅਗਿਆਤ 26
+ਉੜੀਆ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ60
ਛੋਟੇ ਵਰਣਨਉੜੀਆ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਆਮ ਗੱਲਬਾਤ100
ਛੋਟੇ ਵਰਣਨਉੜੀਆ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਆਮ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਪੋਡਕਾਸਟ40
ਛੋਟੇ ਵਰਣਨਉੜੀਆ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਮੀਡੀਆ ਆਡੀਓ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਪੋਲਿਸ਼16 driver ਵਰਤਣਪੋਡਕਾਸਟ269
ਛੋਟੇ ਵਰਣਨਪੋਲਿਸ਼ ਮੀਡੀਆ ਆਡੀਓ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 173 ਮਰਦ 354 ਅਣਜਾਣ 6
+ਪੋਲਿਸ਼ (ਪੋਲੈਂਡ)48 driver ਵਰਤਣਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ1,482
ਛੋਟੇ ਵਰਣਨਪੋਲਿਸ਼ ਪੋਲੈਂਡ - ਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ
ਡਾਟਾਸੈਟ ਵਰਣਨਇੱਕ-ਉਚਾਰਨ ਰਿਕਾਰਡਿੰਗਾਂ, ਜੋ ਕਿ 5 ਤੋਂ 30 ਸਕਿੰਟ ਦੀ ਰੇਂਜ ਵਿੱਚ ਆਉਂਦੀਆਂ ਹਨ।
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਮੋਬਾਈਲ ਐਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 1324 ਮਰਦ 701 ਅਣਜਾਣ 24
+ਪੰਜਾਬੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ60
ਛੋਟੇ ਵਰਣਨਪੰਜਾਬੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਆਮ ਗੱਲਬਾਤ100
ਛੋਟੇ ਵਰਣਨਪੰਜਾਬੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਆਮ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਪੋਡਕਾਸਟ40
ਛੋਟੇ ਵਰਣਨਪੰਜਾਬੀ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਰੂਸੀ48 driver ਵਰਤਣਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ2,398
ਛੋਟੇ ਵਰਣਨਰੂਸੀ ਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ
ਡਾਟਾਸੈਟ ਵਰਣਨਇੱਕ-ਉਚਾਰਨ ਰਿਕਾਰਡਿੰਗਾਂ, ਜੋ ਕਿ 5 ਤੋਂ 30 ਸਕਿੰਟ ਦੀ ਰੇਂਜ ਵਿੱਚ ਆਉਂਦੀਆਂ ਹਨ।
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਮੋਬਾਈਲ ਐਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 1689 ਮਰਦ 1937 ਅਣਜਾਣ 214
+ਸਕਾਟਿਸ਼ (ਅੰਗਰੇਜ਼ੀ ਲਹਿਜ਼ਾ)8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ292
ਛੋਟੇ ਵਰਣਨਸਕਾਟਿਸ਼ ਜਨਰਲ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਦੋ ਲੋਕਾਂ ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ ਟੈਲੀਫ਼ੋਨ ਗੱਲਬਾਤ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) - 15-60 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 285, ਮਰਦ 260, ਅਣਜਾਣ 3
+ਸਿੰਗਾਪੁਰ ਅੰਗਰੇਜ਼ੀ8 driver ਵਰਤਣਕਾਲ-ਸੈਂਟਰ218
ਛੋਟੇ ਵਰਣਨਸਿੰਗਾਪੁਰ ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 2139, ਮਰਦ 884, ਅਣਜਾਣ 21
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ247
ਛੋਟੇ ਵਰਣਨਸਿੰਗਾਪੁਰ ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 160, ਮਰਦ 455, ਅਣਜਾਣ 37
+ਦੱਖਣੀ ਅਫ਼ਰੀਕੀ ਅੰਗਰੇਜ਼ੀ8 driver ਵਰਤਣਕਾਲ-ਸੈਂਟਰ261
ਛੋਟੇ ਵਰਣਨਦੱਖਣੀ ਅਫ਼ਰੀਕੀ ਅੰਗਰੇਜ਼ੀ ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 1274, ਮਰਦ 935, ਅਣਜਾਣ 1
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ251
ਛੋਟੇ ਵਰਣਨਦੱਖਣੀ ਅਫ਼ਰੀਕੀ ਅੰਗਰੇਜ਼ੀ ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 235, ਮਰਦ 432, ਅਣਜਾਣ 36
+ਸਵਾਹਿਲੀ8 driver ਵਰਤਣਕਾਲ-ਸੈਂਟਰ230
ਛੋਟੇ ਵਰਣਨਸਵਾਹਿਲੀ ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 611, ਮਰਦ 833, ਅਣਜਾਣ 0
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ265
ਛੋਟੇ ਵਰਣਨਸਵਾਹਿਲੀ ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 118, ਮਰਦ 493, ਅਣਜਾਣ 25
+ਸਵੀਡਨੀ8 driver ਵਰਤਣਕਾਲ-ਸੈਂਟਰ250
ਛੋਟੇ ਵਰਣਨਸਵੀਡਿਸ਼ ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 1581, ਮਰਦ 727, ਅਣਜਾਣ 2
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ278
ਛੋਟੇ ਵਰਣਨਸਵੀਡਿਸ਼ ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 195, ਮਰਦ 500, ਅਣਜਾਣ 21
+ਤਮਿਲ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ60
ਛੋਟੇ ਵਰਣਨਤਮਿਲ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਆਮ ਗੱਲਬਾਤ100
ਛੋਟੇ ਵਰਣਨਤਮਿਲ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਆਮ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਪੋਡਕਾਸਟ40
ਛੋਟੇ ਵਰਣਨਤਮਿਲ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਮੀਡੀਆ ਆਡੀਓ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਤੇਲਗੂ8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ553
ਛੋਟੇ ਵਰਣਨਤੇਲਗੂ ਜਨਰਲ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਦੋ ਲੋਕਾਂ ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ ਟੈਲੀਫ਼ੋਨ ਗੱਲਬਾਤ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) - 15-60 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 574, ਮਰਦ 564, ਅਣਜਾਣ 0
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ648
ਛੋਟੇ ਵਰਣਨਤੇਲਗੂ ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 207, ਮਰਦ 963, ਅਣਜਾਣ 2
+ਤੇਲਗੂ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ30
ਛੋਟੇ ਵਰਣਨਤੇਲਗੂ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਕਾਲ-ਸੈਂਟਰ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਆਮ ਗੱਲਬਾਤ50
ਛੋਟੇ ਵਰਣਨਤੇਲਗੂ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਆਮ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਪੋਡਕਾਸਟ20
ਛੋਟੇ ਵਰਣਨਤੇਲਗੂ (ਪਾਈਪਲਾਈਨ ਵਿੱਚ) ਮੀਡੀਆ ਆਡੀਓ ਡਾਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀ
+ਦਾ ਥਾਈ8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ183
ਛੋਟੇ ਵਰਣਨਥਾਈ ਜਨਰਲ ਗੱਲਬਾਤ
ਡਾਟਾਸੈਟ ਵਰਣਨਦੋ ਲੋਕਾਂ ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ ਟੈਲੀਫ਼ੋਨ ਗੱਲਬਾਤ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) - 15-60 ਮਿੰਟ, ਦੋਸਤਾਂ ਵਿਚਕਾਰ ਵਰਤਿਆ ਜਾਣ ਵਾਲਾ ਇੱਕ ਗੈਰ-ਰਸਮੀ ਰਜਿਸਟਰ।
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 338, ਮਰਦ 96, ਅਣਜਾਣ 8
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ173
ਛੋਟੇ ਵਰਣਨਥਾਈ ਮੀਡੀਆ ਆਡੀਓ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 143, ਮਰਦ 502, ਅਣਜਾਣ 26
+ਤੁਰਕੀ ਤੁਰਕੀ48 driver ਵਰਤਣਸਕ੍ਰਿਪਟਡ ਮੋਨੋਲੋਗ2,027
ਛੋਟੇ ਵਰਣਨਤੁਰਕੀ ਤੁਰਕੀ
ਡਾਟਾਸੈਟ ਵਰਣਨਇੱਕ-ਉਚਾਰਨ ਰਿਕਾਰਡਿੰਗਾਂ, ਜੋ ਕਿ 5 ਤੋਂ 30 ਸਕਿੰਟ ਦੀ ਰੇਂਜ ਵਿੱਚ ਆਉਂਦੀਆਂ ਹਨ।
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਮੋਬਾਈਲ ਐਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 1561 ਮਰਦ 1241 ਅਣਜਾਣ 31
+ਵੀਅਤਨਾਮੀ8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ295
ਛੋਟੇ ਵਰਣਨਵੀਅਤਨਾਮੀ ਆਮ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ, ਉੱਤਰੀ (ਜਿਵੇਂ ਕਿ, ਹਨੋਈ), ਕੇਂਦਰੀ, ਅਤੇ ਦੱਖਣੀ (ਜਿਵੇਂ ਕਿ, ਹੋ ਚੀ ਮਿਨਹ ਸਿਟੀ)।
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤਾਂ 400, ਪੁਰਸ਼ 380, ਅਣਜਾਣ 2
+16 driver ਵਰਤਣਪੋਡਕਾਸਟ257
ਛੋਟੇ ਵਰਣਨਵੀਅਤਨਾਮੀ ਮੀਡੀਆ ਆਡੀਓ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨਲਾਇਸੈਂਸਯੋਗ ਜਨਤਕ ਡੋਮੇਨ ਆਡੀਓ/ਵੀਡੀਓ ਫਾਈਲਾਂ ਜਿਵੇਂ ਕਿ ਇੰਟਰਵਿਊ, ਪੋਡਕਾਸਟ ਆਦਿ - 1 ਤੋਂ 5 ਲੋਕ। ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 15-60 ਮਿੰਟ
ਆਡੀਓ ਚੈਨਲਮੋਨੋ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਵੈੱਬ ਸੋਰਸਿੰਗ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤਾਂ 249, ਪੁਰਸ਼ 200, ਅਣਜਾਣ 45
+ਵੈਲਸ਼ (ਅੰਗਰੇਜ਼ੀ ਲਹਿਜ਼ਾ)8 driver ਵਰਤਣਆਮ ਗੱਲਬਾਤ278
ਛੋਟੇ ਵਰਣਨਵੈਲਸ਼ ਜਨਰਲ ਗੱਲਬਾਤ ਡੇਟਾ
ਡਾਟਾਸੈਟ ਵਰਣਨ"ਏਜੰਟ" ਅਤੇ "ਗਾਹਕ" ਵਿਚਕਾਰ ਬਿਨਾਂ ਲਿਖਤ, ਸਿੰਥੈਟਿਕ ਟੈਲੀਫੋਨ ਗੱਲਬਾਤ, ਲਗਭਗ ਆਡੀਓ ਮਿਆਦ (ਰੇਂਜ) 5-15 ਮਿੰਟ,
ਆਡੀਓ ਚੈਨਲਡਿਊਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਡੈਸਕਟਾਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਔਰਤ 270, ਮਰਦ 324, ਅਣਜਾਣ 0
+ਯੂਕੇ ਇੰਗਲਿਸ਼16 driver ਵਰਤਣਸ਼ਬਦ ਨੂੰ ਜਗਾਓ.200..XNUMX ਸਪੀਕਰ
ਛੋਟੇ ਵਰਣਨਵੇਕ ਵਰਡ ਯੂਕੇ ਅੰਗਰੇਜ਼ੀ
ਡਾਟਾਸੈਟ ਵਰਣਨਕੀਫ੍ਰੇਜ਼ ਡੇਟਾ ਦਾ ਸੰਗ੍ਰਹਿ
  • 200 ਸਪੀਕਰ
  • ਪ੍ਰਤੀ ਸਪੀਕਰ 4 ਵਿਲੱਖਣ ਕੀਫ੍ਰੇਜ਼
  • 25-30 ਦੁਹਰਾਇਆ ਗਿਆ ਕੀਫ੍ਰੇਜ਼ ਪ੍ਰਤੀ ਵਿਲੱਖਣ ਕੀਫ੍ਰੇਜ਼ ਰਿਕਾਰਡਿੰਗ
  • 25-30 ਔਡੀਓ ਫਾਈਲਾਂ ਪ੍ਰਤੀ ਵਿਲੱਖਣ ਕੀਫ੍ਰੇਜ਼
  • ਪ੍ਰਤੀ ਸਪੀਕਰ 120 ਕੁੱਲ ਰਿਕਾਰਡ ਕੀਤੇ ਵਾਕ
ਆਡੀਓ ਚੈਨਲ1 ਚੈਨਲ
ਰਿਕਾਰਡਿੰਗ ਪਲੇਟਫਾਰਮਮੋਬਾਈਲ ਐਪ
WER (%)5.0
ਆਡੀਓ ਫਾਰਮੈਟ.ਵਾਵ
ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਫਾਰਮੈਟ.json
ਕੇਸ ਵਰਤੋASR, ਵਰਚੁਅਲ ਅਸਿਸਟੈਂਟ, ਚੈਟਬੋਟ, ਕਨਵਰਸੇਸ਼ਨਲ AI, ਸਪੀਚ ਐਨਾਲਿਟਿਕਸ, TTS, ਲੈਂਗੂਏਜ ਮਾਡਲਿੰਗ
ਬੋਲਣ ਵਾਲਿਆਂ ਦੀ ਗਿਣਤੀਲਿੰਗ: 50% ਮਰਦ, 50% ਔਰਤ, +/- 10%।

ਪੇਸ਼ਕਸ਼ ਸੇਵਾਵਾਂ

ਵਿਸਤ੍ਰਿਤ AI ਸੈਟਅਪਾਂ ਲਈ ਮਾਹਰ ਟੈਕਸਟ ਡੇਟਾ ਕਲੈਕਸ਼ਨ ਆਲ-ਹੈਂਡ-ਆਨ-ਡੇਕ ਨਹੀਂ ਹੈ। Shaip ਵਿਖੇ, ਤੁਸੀਂ ਮਾਡਲਾਂ ਨੂੰ ਆਮ ਨਾਲੋਂ ਵਧੇਰੇ ਵਿਆਪਕ ਬਣਾਉਣ ਲਈ ਹੇਠਾਂ ਦਿੱਤੀਆਂ ਸੇਵਾਵਾਂ 'ਤੇ ਵੀ ਵਿਚਾਰ ਕਰ ਸਕਦੇ ਹੋ:

ਟੈਕਸਟ ਡਾਟਾ ਇਕੱਠਾ ਕਰਨਾ

ਟੈਕਸਟ ਡਾਟਾ ਕਲੈਕਸ਼ਨ ਸੇਵਾਵਾਂ

ਸ਼ੈਪ ਬੋਧਾਤਮਕ ਡੇਟਾ ਇਕੱਤਰ ਕਰਨ ਦੀਆਂ ਸੇਵਾਵਾਂ ਦਾ ਅਸਲ ਮੁੱਲ ਇਹ ਹੈ ਕਿ ਇਹ ਸੰਗਠਨਾਂ ਨੂੰ ਗੈਰ-ਸੰਗਠਿਤ ਡੇਟਾ ਦੇ ਅੰਦਰ ਪਾਈ ਗਈ ਮਹੱਤਵਪੂਰਣ ਜਾਣਕਾਰੀ ਨੂੰ ਅਨਲੌਕ ਕਰਨ ਦੀ ਕੁੰਜੀ ਦਿੰਦਾ ਹੈ

ਚਿੱਤਰ ਡੇਟਾ ਸੰਗ੍ਰਹਿ

ਚਿੱਤਰ ਡੇਟਾ ਕਲੈਕਸ਼ਨ ਸੇਵਾਵਾਂ

ਯਕੀਨੀ ਬਣਾਓ ਕਿ ਤੁਹਾਡਾ ਕੰਪਿਊਟਰ ਵਿਜ਼ਨ ਮਾਡਲ ਹਰ ਚਿੱਤਰ ਦੀ ਸਹੀ ਪਛਾਣ ਕਰਦਾ ਹੈ, ਭਵਿੱਖ ਦੇ ਅਗਲੇ ਪੀੜ੍ਹੀ ਦੇ AI ਮਾਡਲਾਂ ਨੂੰ ਸਹਿਜੇ ਹੀ ਸਿਖਲਾਈ ਦੇਣ ਲਈ

ਵੀਡੀਓ ਡਾਟਾ ਇਕੱਠਾ

ਵੀਡੀਓ ਡਾਟਾ ਕਲੈਕਸ਼ਨ ਸੇਵਾਵਾਂ

ਹੁਣ ਆਪਣੇ ਮਾਡਲਾਂ ਨੂੰ ਵਸਤੂਆਂ, ਵਿਅਕਤੀਆਂ, ਰੁਕਾਵਟਾਂ ਅਤੇ ਹੋਰ ਵਿਜ਼ੂਅਲ ਤੱਤਾਂ ਦੀ ਪਛਾਣ ਕਰਨ ਲਈ ਸਿਖਲਾਈ ਦੇਣ ਲਈ NLP ਦੇ ਨਾਲ ਕੰਪਿਊਟਰ ਵਿਜ਼ਨ 'ਤੇ ਧਿਆਨ ਕੇਂਦਰਤ ਕਰੋ।

ਫੀਚਰਡ ਕਲਾਇੰਟ

ਵਿਸ਼ਵ-ਮੋਹਰੀ ਏਆਈ ਉਤਪਾਦਾਂ ਨੂੰ ਬਣਾਉਣ ਲਈ ਟੀਮਾਂ ਨੂੰ ਸ਼ਕਤੀ ਪ੍ਰਦਾਨ ਕਰਨਾ.

Shaip ਸਾਡੇ ਨਾਲ ਸੰਪਰਕ ਕਰੋ

ਕੀ ਤੁਸੀਂ ਆਪਣਾ ਆਡੀਓ ਡੇਟਾਸੈਟ ਬਣਾਉਣਾ ਚਾਹੁੰਦੇ ਹੋ?

ਇੱਕ ਆਡੀਓ ਰਿਪੋਜ਼ਟਰੀ ਸਥਾਪਤ ਕਰਨ ਲਈ ਸਾਡੇ ਇਨ-ਹਾਊਸ ਸਪੀਚ ਡੇਟਾ ਕਲੈਕਸ਼ਨ ਮਾਹਰ ਨਾਲ ਜੁੜੋ ਜੋ ਤੁਹਾਡੀ ਜ਼ਰੂਰਤ ਦੇ ਅਨੁਕੂਲ ਹੋਵੇ

  • ਇਹ ਖੇਤਰ ਪ੍ਰਮਾਣਿਕਤਾ ਦੇ ਉਦੇਸ਼ਾਂ ਲਈ ਹੈ ਅਤੇ ਇਸ ਵਿੱਚ ਕੋਈ ਤਬਦੀਲੀ ਨਹੀਂ ਕੀਤੀ ਜਾਣੀ ਚਾਹੀਦੀ.
  • ਰਜਿਸਟਰ ਕਰਕੇ, ਮੈਂ ਸ਼ੈਪ ਨਾਲ ਸਹਿਮਤ ਹਾਂ ਪਰਦੇਦਾਰੀ ਨੀਤੀ ਅਤੇ ਸੇਵਾ ਦੀਆਂ ਸ਼ਰਤਾਂ ਅਤੇ Shaip ਤੋਂ B2B ਮਾਰਕੀਟਿੰਗ ਸੰਚਾਰ ਪ੍ਰਾਪਤ ਕਰਨ ਲਈ ਮੇਰੀ ਸਹਿਮਤੀ ਪ੍ਰਦਾਨ ਕਰੋ।

ਇੱਕ ML ਮਾਡਲ ਲਈ ਸਪੀਚ ਡੇਟਾ ਸੰਗ੍ਰਹਿ ਬੋਲੀ ਜਾਣ ਵਾਲੀ ਭਾਸ਼ਾ ਦੀਆਂ ਆਡੀਓ ਰਿਕਾਰਡਿੰਗਾਂ ਨੂੰ ਇਕੱਠਾ ਕਰਨ ਦੀ ਪ੍ਰਕਿਰਿਆ ਨੂੰ ਦਰਸਾਉਂਦਾ ਹੈ। ਇਹ ਸੰਗ੍ਰਹਿ ਮਸ਼ੀਨ ਸਿਖਲਾਈ ਐਲਗੋਰਿਦਮ ਨੂੰ ਸਿਖਲਾਈ ਅਤੇ ਸ਼ੁੱਧ ਕਰਨ ਵਿੱਚ ਸਹਾਇਤਾ ਕਰਦਾ ਹੈ, ਖਾਸ ਤੌਰ 'ਤੇ ਮਨੁੱਖੀ ਆਵਾਜ਼ਾਂ ਨੂੰ ਸਮਝਣ ਅਤੇ ਪ੍ਰਕਿਰਿਆ ਕਰਨ 'ਤੇ ਕੇਂਦਰਿਤ।

ਜਦੋਂ ਆਟੋਮੈਟਿਕ ਸਪੀਚ ਰਿਕੋਗਨੀਸ਼ਨ (ASR) ਲਈ ਆਡੀਓ ਡਾਟਾ ਇਕੱਠਾ ਕਰਨ ਦਾ ਟੀਚਾ ਰੱਖਦੇ ਹੋ, ਤਾਂ ਤੁਹਾਨੂੰ ਆਪਣੇ ਪ੍ਰੋਜੈਕਟ ਦੀਆਂ ਖਾਸ ਲੋੜਾਂ ਨੂੰ ਪਰਿਭਾਸ਼ਿਤ ਕਰਕੇ ਸ਼ੁਰੂ ਕਰਨਾ ਚਾਹੀਦਾ ਹੈ, ਜਿਸ ਵਿੱਚ ਲੋੜੀਂਦੀ ਭਾਸ਼ਾ, ਲਹਿਜ਼ਾ ਅਤੇ ਬੋਲੀ ਦੀ ਕਿਸਮ ਸ਼ਾਮਲ ਹੈ। ਇਹਨਾਂ ਪੈਰਾਮੀਟਰਾਂ ਨੂੰ ਸੈੱਟ ਕਰਨ ਤੋਂ ਬਾਅਦ, ਯਕੀਨੀ ਬਣਾਓ ਕਿ ਤੁਸੀਂ ਉਪਭੋਗਤਾ ਦੀ ਗੋਪਨੀਯਤਾ ਦਾ ਆਦਰ ਕਰਨ ਲਈ ਸਾਰੀਆਂ ਲੋੜੀਂਦੀਆਂ ਇਜਾਜ਼ਤਾਂ ਪ੍ਰਾਪਤ ਕਰ ਲਈਆਂ ਹਨ। ਫਿਰ, ਸਪਸ਼ਟ ਆਡੀਓ ਨਮੂਨੇ ਹਾਸਲ ਕਰਨ ਲਈ ਉਚਿਤ ਰਿਕਾਰਡਿੰਗ ਡਿਵਾਈਸਾਂ ਜਾਂ ਸੌਫਟਵੇਅਰ ਦੀ ਵਰਤੋਂ ਕਰੋ। ਹਰੇਕ ਰਿਕਾਰਡਿੰਗ ਨੂੰ ਇਸਦੇ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਜਾਂ ਹੋਰ ਢੁਕਵੇਂ ਮੈਟਾਡੇਟਾ ਦੇ ਨਾਲ ਸਾਵਧਾਨੀ ਨਾਲ ਐਨੋਟੇਟ ਕੀਤਾ ਜਾਣਾ ਚਾਹੀਦਾ ਹੈ ਅਤੇ ਆਸਾਨ ਪਹੁੰਚ ਲਈ ਯੋਜਨਾਬੱਧ ਢੰਗ ਨਾਲ ਸਟੋਰ ਕੀਤਾ ਜਾਣਾ ਚਾਹੀਦਾ ਹੈ।

ਮਸ਼ੀਨ ਲਰਨਿੰਗ ਵਿੱਚ ਇੱਕ ਸਪੀਚ ਡੇਟਾਸੈਟ, ਬੋਲੀ ਜਾਣ ਵਾਲੀ ਭਾਸ਼ਾ ਨੂੰ ਪਛਾਣਨ, ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਕਰਨ ਜਾਂ ਵਿਆਖਿਆ ਕਰਨ ਲਈ ਤਿਆਰ ਕੀਤੇ ਗਏ ਮਾਡਲਾਂ ਦੀ ਸਿਖਲਾਈ, ਟੈਸਟਿੰਗ ਅਤੇ ਪ੍ਰਮਾਣਿਤ ਕਰਨ ਲਈ ਮਹੱਤਵਪੂਰਨ ਹੈ। ਅਜਿਹੇ ਡੇਟਾਸੇਟਸ ਵੌਇਸ ਅਸਿਸਟੈਂਟਸ ਅਤੇ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਸੇਵਾਵਾਂ ਤੋਂ ਲੈ ਕੇ ਵੌਇਸ ਬਾਇਓਮੈਟ੍ਰਿਕਸ ਤੱਕ, ਅਣਗਿਣਤ ਐਪਲੀਕੇਸ਼ਨਾਂ ਲਈ ਰਾਹ ਪੱਧਰਾ ਕਰਦੇ ਹਨ।

ਵਿਭਿੰਨ ਭਾਸ਼ਾਵਾਂ ਅਤੇ ਲਹਿਜ਼ੇ ਤੋਂ ਸਟੀਕ ਡੇਟਾ ਇਕੱਤਰ ਕਰਨ ਲਈ, ਲੋੜੀਂਦੇ ਭਾਸ਼ਾਈ ਪਿਛੋਕੜ ਵਾਲੇ ਮੂਲ ਬੁਲਾਰਿਆਂ ਨਾਲ ਸਹਿਯੋਗ ਜ਼ਰੂਰੀ ਹੈ। ਜਨਸੰਖਿਆ ਸੰਬੰਧੀ ਸੂਖਮਤਾਵਾਂ ਦੇ ਇੱਕ ਵਿਸ਼ਾਲ ਸਪੈਕਟ੍ਰਮ ਨੂੰ ਕਵਰ ਕਰਨ ਲਈ ਇੱਕ ਵਿਭਿੰਨ ਅਤੇ ਪ੍ਰਤੀਨਿਧ ਨਮੂਨੇ ਲਈ ਟੀਚਾ ਰੱਖੋ। ਆਡੀਓ ਇਕਸਾਰਤਾ ਨੂੰ ਯਕੀਨੀ ਬਣਾਉਣ ਲਈ ਇਕਸਾਰ ਵਾਤਾਵਰਨ ਵਿੱਚ ਮਿਆਰੀ ਰਿਕਾਰਡਿੰਗ ਉਪਕਰਨ ਲਗਾਓ। ਅਤੇ ਮਹੱਤਵਪੂਰਨ ਤੌਰ 'ਤੇ, ਖਾਸ ਭਾਸ਼ਾ ਅਤੇ ਲਹਿਜ਼ੇ ਨੂੰ ਦਰਸਾਉਂਦੇ ਹੋਏ, ਵਿਸਤ੍ਰਿਤ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਅਤੇ ਮੈਟਾਡੇਟਾ ਦੇ ਨਾਲ ਹਰੇਕ ਡੇਟਾ ਟੁਕੜੇ ਨੂੰ ਐਨੋਟੇਟ ਕਰੋ।