പ്രതീകാത്മക ചിത്രം
ന്യൂഡൽഹി: ആളുകൾ സംസാരിക്കുന്നത് തത്സമയം കൃത്യതയോടെ ടെക്സ്റ്റാക്കി മാറ്റാൻ ശേഷിയുള്ള പുതിയ ആർട്ടിഫിഷ്യൽ ഇന്റലിജൻസ് മോഡലായ 'മ്യൂസ് വോയ്സ് ട്രാൻസ്ക്രിബ്' (Muse Voice Transcribe) അവതരിപ്പിച്ച് മെറ്റാ. മെറ്റാ സൂപ്പർ ഇന്റലിജൻസ് ലാബ്സ് പുറത്തിറക്കുന്ന ആദ്യത്തെ റിയൽ-ടൈം ഓഡിയോ പെർസെപ്ഷൻ മോഡലാണിത്.
മലയാളം, ഹിന്ദി, തമിഴ്, തെലുങ്ക്, കന്നഡ എന്നീ 5 പ്രധാന ഇന്ത്യൻ ഭാഷകൾ ഉൾപ്പെടെ 70ലധികം ഭാഷകളിലെ സംഭാഷണങ്ങൾ കൃത്യമായി പ്രോസസ്സ് ചെയ്യാൻ ഇതിന് കഴിയും.
സംസാരിക്കുന്നതിനിടയിൽ ഇംഗ്ലീഷിൽ നിന്നും പ്രാദേശിക ഭാഷകളിലേക്ക് മാറ്റി മാറ്റി സംസാരിച്ചാലും യാതൊരു തടസ്സവുമില്ലാതെ കൃത്യമായി ടെക്സ്റ്റാക്കി മാറ്റാൻ ഈ മോഡലിന് സാധിക്കും.
ഒരേ സമയം 20ലധികം ആളുകൾ സംസാരിക്കുന്ന ഒരു മണിക്കൂറിൽ കൂടുതൽ ദൈർഘ്യമുള്ള റിക്കാർഡിംഗുകളിൽ പോലും ഓരോരുത്തരുടെയും ശബ്ദങ്ങൾ വേർതിരിച്ച് ട്രാൻസ്ക്രിപ്ഷൻ നടത്താൻ ഇതിന് ശേഷിയുണ്ട്.
വാചകങ്ങൾ പൂർത്തിയാകാൻ കാത്തുനിൽക്കാതെ സംസാരിക്കുന്ന വേഗതയിൽ തന്നെ ടെക്സ്റ്റ് സ്ക്രീനിൽ തെളിയും. പ്രയാസമേറിയ വാക്കുകൾക്ക് കൂടുതൽ സമയം നൽകുകയും ലളിതമായ വാക്കുകൾ വേഗത്തിൽ പ്രോസസ്സ് ചെയ്യുകയും ചെയ്യുന്ന പ്രത്യേക സാങ്കേതികവിദ്യയാണ് മെറ്റാ ഇതിൽ ഉപയോഗിച്ചിരിക്കുന്നത്.
മെറ്റാ എഐ ഫോർ മാക്, മ്യൂസ് കോഡ് എന്നിവയിൽ ഈ ഫീച്ചർ ലഭ്യമാക്കി തുടങ്ങിയിട്ടുണ്ട്. കൂടാതെ ഡെവലപ്പർമാർക്കായി മെറ്റായുടെ 'മോഡൽ എപിഐ' വഴി 1,000 ഓഡിയോ മിനിറ്റിന് $3 (ഏകദേശം 250 രൂപ) എന്ന നിരക്കിൽ സേവനം ലഭ്യമാണ്.
ആർട്ടിഫിഷ്യൽ അനാലിസിസ് റിയൽ-ടൈം വോയ്സ് ലീഡർബോർഡിൽ ഒന്നാം സ്ഥാനത്താണ് മ്യൂസ് വോയ്സ് ട്രാൻസ്ക്രിബ് നിലവിൽ റാങ്ക് ചെയ്തിരിക്കുന്നത്.
Tags : technology meta musevoicetrasncribe indianlanguages artificialintelligence