- ਸ਼ਹਿਰ ਚੁਣੋ
- ਈ-ਪੇਪਰ
- ਵੈੱਬ ਸਟੋਰੀਜ਼
ਮੈਟਾ ਨੇ 'ਮਿਊਜ਼ ਵੌਇਸ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ' ਲਾਂਚ ਕੀਤਾ ਹੈ, ਜੋ ਕਿ ਹਿੰਦੀ, ਤਾਮਿਲ, ਤੇਲਗੂ, ਕੰਨੜ ਅਤੇ ਮਲਿਆਲਮ ਵਰਗੀਆਂ ਪੰਜ ਪ੍ਰਮੁੱਖ ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਦੇ ਨਾਲ-ਨਾਲ ਵਿਸ਼ਵ ਪੱਧਰ 'ਤੇ 70 ਤੋਂ ਵੱਧ ਭਾਸ਼ਾਵਾਂ ਦਾ ਸਮਰਥਨ ਕਰਦਾ ਹੈ।

ਟੈਕਨਾਲੋਜੀ ਡੈਸਕ, ਨਵੀਂ ਦਿੱਲੀ : ਮੈਟਾ ਨੇ 'ਮਿਊਜ਼ ਵੌਇਸ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ' ਲਾਂਚ ਕੀਤਾ ਹੈ, ਜੋ ਕਿ ਹਿੰਦੀ, ਤਾਮਿਲ, ਤੇਲਗੂ, ਕੰਨੜ ਅਤੇ ਮਲਿਆਲਮ ਵਰਗੀਆਂ ਪੰਜ ਪ੍ਰਮੁੱਖ ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਦੇ ਨਾਲ-ਨਾਲ ਵਿਸ਼ਵ ਪੱਧਰ 'ਤੇ 70 ਤੋਂ ਵੱਧ ਭਾਸ਼ਾਵਾਂ ਦਾ ਸਮਰਥਨ ਕਰਦਾ ਹੈ। ਇਹ ਮੈਟਾ ਸੁਪਰਇੰਟੈਲੀਜੈਂਸ ਲੈਬਜ਼ ਦੁਆਰਾ ਵਿਕਸਤ ਕੀਤਾ ਗਿਆ ਪਹਿਲਾ ਰੀਅਲ-ਟਾਈਮ ਆਡੀਓ ਧਾਰਨਾ ਮਾਡਲ ਹੈ। ਇਹ ਇੱਕ ਸਿੰਗਲ ਸਿਸਟਮ ਵਿੱਚ ਲਾਈਵ ਸਪੀਚ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ, ਸਪੀਕਰ ਪਛਾਣ ਅਤੇ ਐਂਡਪੁਆਇੰਟਿੰਗ ਵਰਗੀਆਂ ਵਿਸ਼ੇਸ਼ਤਾਵਾਂ ਨੂੰ ਇਕੱਠਾ ਕਰਦਾ ਹੈ, ਅਤੇ 20 ਲੋਕਾਂ ਤੱਕ ਕੋਡ-ਸਵਿਚਿੰਗ ਅਤੇ ਗੱਲਬਾਤ ਨੂੰ ਵੀ ਸੰਭਾਲਦਾ ਹੈ।
ਮੈਟਾ ਮਿਊਜ਼ ਵੌਇਸ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਰੀਅਲ-ਟਾਈਮ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਲਿਆਉਂਦਾ ਹੈ
ਕੰਪਨੀ ਨੇ ਇੱਕ ਬਲੌਗ ਪੋਸਟ ਵਿੱਚ ਦੱਸਿਆ ਕਿ ਮਿਊਜ਼ ਵੌਇਸ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਕਿਸੇ ਦੇ ਬੋਲਣ ਦੇ ਨਾਲ ਹੀ ਆਵਾਜ਼ ਨੂੰ ਟੈਕਸਟ ਵਿੱਚ ਬਦਲ ਸਕਦਾ ਹੈ, ਪੂਰੀ ਰਿਕਾਰਡਿੰਗ ਖਤਮ ਹੋਣ ਦੀ ਉਡੀਕ ਕਰਨ ਦੀ ਬਜਾਏ। ਇਹ ਵਿਅਕਤੀਗਤ ਸਪੀਕਰਾਂ ਦੀ ਪਛਾਣ ਕਰ ਸਕਦਾ ਹੈ ਅਤੇ ਜਦੋਂ ਕੋਈ ਬੋਲਣਾ ਸ਼ੁਰੂ ਕਰਦਾ ਹੈ ਅਤੇ ਬੰਦ ਕਰਦਾ ਹੈ ਤਾਂ ਉਸਨੂੰ ਕੈਪਚਰ ਵੀ ਕਰ ਸਕਦਾ ਹੈ। ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ, ਸਪੀਕਰ ਪਛਾਣ, ਅਤੇ ਐਂਡਪੁਆਇੰਟਿੰਗ ਆਡੀਓ ਆਉਂਦੇ ਹੀ ਲਾਈਵ ਹੋ ਜਾਂਦੇ ਹਨ, ਜਿਸ ਨਾਲ ਬਾਅਦ ਵਿੱਚ ਵਾਧੂ ਪ੍ਰਕਿਰਿਆ ਦੀ ਜ਼ਰੂਰਤ ਖਤਮ ਹੋ ਜਾਂਦੀ ਹੈ।
ਮੈਟਾ ਦੇ ਅਨੁਸਾਰ, ਇਹ ਇੱਕ ਰਿਕਾਰਡਿੰਗ ਵਿੱਚ 20 ਤੋਂ ਵੱਧ ਲੋਕਾਂ ਦੀਆਂ ਆਵਾਜ਼ਾਂ ਵਿੱਚ ਫਰਕ ਕਰ ਸਕਦਾ ਹੈ ਅਤੇ ਇੱਕ ਘੰਟੇ ਤੋਂ ਵੱਧ ਸਮੇਂ ਤੱਕ ਆਡੀਓ ਨੂੰ ਪ੍ਰੋਸੈਸ ਕਰ ਸਕਦਾ ਹੈ। ਇਹ ਇਸਨੂੰ ਪੂਰੀ ਗੱਲਬਾਤ ਨੂੰ ਛੋਟੇ ਕਲਿੱਪਾਂ ਵਿੱਚ ਵੰਡੇ ਬਿਨਾਂ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਕਰਨ ਦੀ ਆਗਿਆ ਦਿੰਦਾ ਹੈ।
ਇਹ ਮਾਡਲ ਛੋਟੇ, 80-ਮਿਲੀਸਕਿੰਟ ਦੇ ਹਿੱਸਿਆਂ ਵਿੱਚ ਆਡੀਓ ਦੀ ਪ੍ਰਕਿਰਿਆ ਕਰਦਾ ਹੈ ਅਤੇ ਇਹ ਨਿਰਧਾਰਤ ਕਰਦਾ ਹੈ ਕਿ ਕੀ ਇਸ ਕੋਲ ਹਰੇਕ ਸ਼ਬਦ ਨੂੰ ਲਿਖਣ ਲਈ ਕਾਫ਼ੀ ਜਾਣਕਾਰੀ ਹੈ। ਇਹ ਉਹਨਾਂ ਸ਼ਬਦਾਂ ਲਈ ਥੋੜ੍ਹਾ ਇੰਤਜ਼ਾਰ ਕਰ ਸਕਦਾ ਹੈ ਜਿਨ੍ਹਾਂ ਨੂੰ ਪਛਾਣਨਾ ਵਧੇਰੇ ਮੁਸ਼ਕਲ ਹੁੰਦਾ ਹੈ, ਜਦੋਂ ਕਿ ਇਹ ਆਸਾਨ ਸ਼ਬਦਾਂ ਨੂੰ ਤੁਰੰਤ ਲਿਖਦਾ ਹੈ। ਮੈਟਾ ਦਾ ਕਹਿਣਾ ਹੈ ਕਿ ਮਾਡਲ ਰੀਨਫੋਰਸਮੈਂਟ ਲਰਨਿੰਗ ਦੀ ਵਰਤੋਂ ਕਰਕੇ ਆਪਣੇ ਆਪ ਹੀ ਇਹ ਫੈਸਲੇ ਲੈਂਦਾ ਹੈ, ਜਿਸ ਨਾਲ ਗਲਤੀ ਦੀ ਸੰਭਾਵਨਾ ਕਾਫ਼ੀ ਘੱਟ ਜਾਂਦੀ ਹੈ।
ਮੈਟਾ ਨੇ ਮਾਡਲ ਨੂੰ 70 ਤੋਂ ਵੱਧ ਭਾਸ਼ਾਵਾਂ ਵਿੱਚ ਸਿਖਲਾਈ ਦਿੱਤੀ ਅਤੇ ਸ਼ੁਰੂਆਤੀ ਰਿਲੀਜ਼ ਲਈ ਇਨ੍ਹਾਂ ਵਿੱਚੋਂ 25 ਦੀ ਸਖ਼ਤੀ ਨਾਲ ਜਾਂਚ ਕੀਤੀ। ਕੰਪਨੀ ਨੇ ਇੱਕ ਪ੍ਰੈਸ ਰਿਲੀਜ਼ ਵਿੱਚ ਕਿਹਾ ਕਿ ਇਸ ਵਿੱਚ ਪੰਜ ਪ੍ਰਮੁੱਖ ਭਾਰਤੀ ਭਾਸ਼ਾਵਾਂ ਸ਼ਾਮਲ ਹਨ: ਹਿੰਦੀ, ਤਾਮਿਲ, ਤੇਲਗੂ, ਕੰਨੜ ਅਤੇ ਮਲਿਆਲਮ।
ਇਸ ਤੋਂ ਇਲਾਵਾ, ਜੇਕਰ ਲੋਕ ਗੱਲਬਾਤ ਦੌਰਾਨ ਭਾਸ਼ਾਵਾਂ ਬਦਲਦੇ ਹਨ - ਭਾਵੇਂ ਵਾਕ ਦੇ ਵਿਚਕਾਰ ਇੱਕ ਵੱਖਰੀ ਭਾਸ਼ਾ ਬੋਲਦੇ ਹੋਣ - ਤਾਂ ਮਾਡਲ ਇਸਨੂੰ ਆਸਾਨੀ ਨਾਲ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਕਰ ਦਿੰਦਾ ਹੈ। ਉਪਭੋਗਤਾਵਾਂ ਨੂੰ ਹਰ ਵਾਰ ਭਾਸ਼ਾਵਾਂ ਬਦਲਣ 'ਤੇ ਸੈਟਿੰਗਾਂ ਨੂੰ ਹੱਥੀਂ ਐਡਜਸਟ ਕਰਨ ਦੀ ਲੋੜ ਨਹੀਂ ਹੁੰਦੀ ਹੈ। ਮਾਡਲ ਭਾਸ਼ਾ, ਕੀਵਰਡ ਅਤੇ ਸੰਦਰਭ ਪੱਖਪਾਤ ਦਾ ਸਮਰਥਨ ਕਰਦਾ ਹੈ, ਜੋ ਇਸਨੂੰ ਗੱਲਬਾਤ ਦੇ ਸੰਦਰਭ ਦੇ ਆਧਾਰ 'ਤੇ ਸਭ ਤੋਂ ਸਹੀ ਸ਼ਬਦਾਂ ਦੀ ਚੋਣ ਕਰਨ ਵਿੱਚ ਮਦਦ ਕਰਦਾ ਹੈ।
ਮੈਟਾ ਮਿਊਜ਼ ਵੌਇਸ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਕੀਮਤ ਅਤੇ ਉਪਲਬਧਤਾ
ਮੈਟਾ ਨੇ ਮੈਟਾ ਮਾਡਲ API ਰਾਹੀਂ ਮਿਊਜ਼ ਵੌਇਸ ਟ੍ਰਾਂਸਕ੍ਰਾਈਬ ਉਪਲਬਧ ਕਰਵਾਇਆ ਹੈ, ਜਿਸ ਨਾਲ ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਆਪਣੇ ਐਪਸ ਵਿੱਚ ਸਪੀਚ ਟ੍ਰਾਂਸਕ੍ਰਿਪਸ਼ਨ ਲਈ ਇਸਦੀ ਵਰਤੋਂ ਕਰਨ ਦੀ ਆਗਿਆ ਮਿਲਦੀ ਹੈ। ਮੈਟਾ ਏਆਈ ਅਤੇ ਮਿਊਜ਼ ਕੋਡ ਫਾਰ ਮੈਕ ਪਹਿਲਾਂ ਹੀ ਇਸਨੂੰ ਡਿਕਟੇਸ਼ਨ ਲਈ ਵਰਤਦੇ ਹਨ। API ਦੀ ਕੀਮਤ $3 (ਲਗਭਗ 300 ਰੁਪਏ) ਪ੍ਰਤੀ 1,000 ਆਡੀਓ ਮਿੰਟ ਹੈ, ਜੋ ਕਿ ਲਗਭਗ $0.18 (ਲਗਭਗ 17 ਰੁਪਏ) ਪ੍ਰਤੀ ਘੰਟਾ ਬਣਦੀ ਹੈ।