ന്യൂഡൽഹി: ആളുകൾ സംസാരിക്കുന്നത് തത്സമയം കൃത്യതയോടെ ടെക്സ്റ്റാക്കി മാറ്റാൻ ശേഷിയുള്ള പുതിയ ആർട്ടിഫിഷ്യൽ ഇന്റലിജൻസ് മോഡലായ 'മ്യൂസ് വോയ്സ് ട്രാൻസ്ക്രിബ്' (Muse Voice Transcribe) അവതരിപ്പിച്ച് മെറ്റാ. മെറ്റാ സൂപ്പർ ഇന്റലിജൻസ് ലാബ്സ് പുറത്തിറക്കുന്ന ആദ്യത്തെ റിയൽ-ടൈം ഓഡിയോ പെർസെപ്ഷൻ മോഡലാണിത്.
മലയാളം, ഹിന്ദി, തമിഴ്, തെലുങ്ക്, കന്നഡ എന്നീ 5 പ്രധാന ഇന്ത്യൻ ഭാഷകൾ ഉൾപ്പെടെ 70ലധികം ഭാഷകളിലെ സംഭാഷണങ്ങൾ കൃത്യമായി പ്രോസസ്സ് ചെയ്യാൻ ഇതിന് കഴിയും.
സംസാരിക്കുന്നതിനിടയിൽ ഇംഗ്ലീഷിൽ നിന്നും പ്രാദേശിക ഭാഷകളിലേക്ക് മാറ്റി മാറ്റി സംസാരിച്ചാലും യാതൊരു തടസ്സവുമില്ലാതെ കൃത്യമായി ടെക്സ്റ്റാക്കി മാറ്റാൻ ഈ മോഡലിന് സാധിക്കും.
ഒരേ സമയം 20ലധികം ആളുകൾ സംസാരിക്കുന്ന ഒരു മണിക്കൂറിൽ കൂടുതൽ ദൈർഘ്യമുള്ള റിക്കാർഡിംഗുകളിൽ പോലും ഓരോരുത്തരുടെയും ശബ്ദങ്ങൾ വേർതിരിച്ച് ട്രാൻസ്ക്രിപ്ഷൻ നടത്താൻ ഇതിന് ശേഷിയുണ്ട്.
വാചകങ്ങൾ പൂർത്തിയാകാൻ കാത്തുനിൽക്കാതെ സംസാരിക്കുന്ന വേഗതയിൽ തന്നെ ടെക്സ്റ്റ് സ്ക്രീനിൽ തെളിയും. പ്രയാസമേറിയ വാക്കുകൾക്ക് കൂടുതൽ സമയം നൽകുകയും ലളിതമായ വാക്കുകൾ വേഗത്തിൽ പ്രോസസ്സ് ചെയ്യുകയും ചെയ്യുന്ന പ്രത്യേക സാങ്കേതികവിദ്യയാണ് മെറ്റാ ഇതിൽ ഉപയോഗിച്ചിരിക്കുന്നത്.
മെറ്റാ എഐ ഫോർ മാക്, മ്യൂസ് കോഡ് എന്നിവയിൽ ഈ ഫീച്ചർ ലഭ്യമാക്കി തുടങ്ങിയിട്ടുണ്ട്. കൂടാതെ ഡെവലപ്പർമാർക്കായി മെറ്റായുടെ 'മോഡൽ എപിഐ' വഴി 1,000 ഓഡിയോ മിനിറ്റിന് $3 (ഏകദേശം 250 രൂപ) എന്ന നിരക്കിൽ സേവനം ലഭ്യമാണ്.
ആർട്ടിഫിഷ്യൽ അനാലിസിസ് റിയൽ-ടൈം വോയ്സ് ലീഡർബോർഡിൽ ഒന്നാം സ്ഥാനത്താണ് മ്യൂസ് വോയ്സ് ട്രാൻസ്ക്രിബ് നിലവിൽ റാങ്ക് ചെയ്തിരിക്കുന്നത്.