ಬೆಂಗಳೂರು: ದೇಶೀಯ ಭಾಷಾ ತಂತ್ರಜ್ಞಾನದಲ್ಲಿ ಐತಿಹಾಸಿಕ ಮೈಲಿಗಲ್ಲೊಂದನ್ನು ಸ್ಥಾಪಿಸಿರುವ ಬೆಂಗಳೂರಿನ ಭಾರತೀಯ ವಿಜ್ಞಾನ ಸಂಸ್ಥೆ (IISc), ಭಾರತದ ೬೫ ಭಾಷೆಗಳು ಮತ್ತು ಸ್ಥಳೀಯ ಉಪಭಾಷೆಗಳಲ್ಲಿ ಮಾತನಾಡುವ ಶಬ್ದಗಳನ್ನು ಲಿಖಿತ ರೂಪಕ್ಕೆ (Speech-to-Text) ಪರಿವರ್ತಿಸುವ ಕೃತಕ ಬುದ್ಧಿಮತ್ತೆ ಆಧಾರಿತ ಮುಕ್ತ ಮಾದರಿ ‘ಶ್ರವಾಣಿ’ (SraVaani) ಅನ್ನು ಆಗಸ್ಟ್ 13, 2026 ರಂದು ಲೋಕಾರ್ಪಣೆಗೊಳಿಸಿದೆ.
ಈ ನೂತನ ಎಐ ಮಾದರಿಯನ್ನು ಐಐಎಸ್ಸಿಯ ಸ್ಪೈರ್ ಲ್ಯಾಬ್ (SPIRE Lab), ಕರ್ನಾಟಕ ಸರ್ಕಾರದ ಆರ್ಟ್ಪಾರ್ಕ್ (ARTPARK – AI & Robotics Technology Park) ಹಾಗೂ ಜಾಗತಿಕ ಟೆಕ್ ದೈತ್ಯ ಗೂಗಲ್ (Google) ಸಹಯೋಗದೊಂದಿಗೆ ಅಭಿವೃದ್ಧಿಪಡಿಸಲಾಗಿದೆ.
೧. ‘ಶ್ರವಾಣಿ’ (SraVaani) ಎಐ ಮಾದರಿಯ ಪ್ರಮುಖ ವೈಶಿಷ್ಟ್ಯಗಳು:
-
೬೫ ಭಾಷೆಗಳು ಮತ್ತು ಉಪಭಾಷೆಗಳ ಬೆಂಬಲ: ಸಂವಿಧಾನದ ೮ನೇ ಅನುಚ್ಛೇದದಲ್ಲಿರುವ ೨೦ ನಿಗದಿತ ಭಾಷೆಗಳು (Scheduled Languages) ಹಾಗೂ ಯಾವುದೇ ಎಐ ತಂತ್ರಜ್ಞಾನ ಲಭ್ಯವಿಲ್ಲದಿದ್ದ ೪೫ ಪ್ರಾದೇಶಿಕ/ಬುಡಕಟ್ಟು ಉಪಭಾಷೆಗಳನ್ನು (ಉದಾ: ತುಳು, ಗಾರೋ, ಅಂಗಿಕಾ, ಚಕ್ಮಾ, ಕೊಕ್ಬೊರೊಕ್, ಬುಂದೇಲಿ, ಬಜ್ಜಿಕಾ ಇತ್ಯಾದಿ) ಇದು ಬೆಂಬಲಿಸುತ್ತದೆ.
-
ಸ್ವಯಂಚಾಲಿತ ಭಾಷಾ ಗುರುತಿಸುವಿಕೆ (Automatic Language Identification): ಬಳಕೆದಾರರು ತಾವೇ ಭಾಷೆಯನ್ನು ಆಯ್ಕೆ ಮಾಡುವ ಅಗತ್ಯವಿಲ್ಲ; ವ್ಯಕ್ತಿ ಮಾತನಾಡುತ್ತಿದ್ದಂತೆಯೇ ಅದು ಯಾವ ಭಾಷೆ ಎಂಬುದನ್ನು ತಂತ್ರಾಂಶವೇ ಸ್ವಯಂಚಾಲಿತವಾಗಿ ಗುರುತಿಸಿ ಪಠ್ಯವಾಗಿ ಪರಿವರ್ತಿಸುತ್ತದೆ.
-
೧೦ ಲಿಪಿಗಳ ಬೆಂಬಲ (10 Scripts): ಭಾರತದ ಪ್ರಮುಖ 10 ಲಿಪಿಗಳಲ್ಲಿ ಪಠ್ಯವನ್ನು ನಿಖರವಾಗಿ ಮೂಡಿಸುವ ಸಾಮರ್ಥ್ಯ ಹೊಂದಿದೆ.
-
ಮುಕ್ತ ಲೈಸೆನ್ಸ್ (Open-Source under MIT): ಈ ಮಾದರಿಯನ್ನು ಜಾಗತಿಕ ಕೃತಕ ಬುದ್ಧಿಮತ್ತೆ ವೇದಿಕೆಯಾದ ‘ಹಗ್ಗಿಂಗ್ ಫೇಸ್’ (Hugging Face) ನಲ್ಲಿ MIT ಪರವಾನಗಿ ಅಡಿಯಲ್ಲಿ ಮುಕ್ತವಾಗಿ ಲಭ್ಯವಾಗುವಂತೆ ಮಾಡಲಾಗಿದ್ದು, ನವೋದ್ಯಮಗಳು, ಸಂಶೋಧಕರು ಮತ್ತು ಆ್ಯಪ್ ಡೆವಲಪರ್ಗಳು ಉಚಿತವಾಗಿ ಬಳಸಿಕೊಳ್ಳಬಹುದು.
೨. ‘ಪ್ರಾಜೆಕ್ಟ್ ವಾಣಿ’ (Project Vaani) ಡೇಟಾಸೆಟ್ ಹಿನ್ನೆಲೆ:
-
ಬೃಹತ್ ಧ್ವನಿ ಸಂಗ್ರಹ: ಭಾರತದ 28 ರಾಜ್ಯಗಳು ಮತ್ತು 3 ಕೇಂದ್ರಾಡಳಿತ ಪ್ರದೇಶಗಳ 165 ಜಿಲ್ಲೆಗಳಿಂದ 1,56,000 ಕ್ಕೂ ಹೆಚ್ಚು ನಾಗರಿಕರ ನೈಜ ಸಂಭಾಷಣೆಯ ಸುಮಾರು 31,000+ ಗಂಟೆಗಳ ಧ್ವನಿ ಮಾದರಿಗಳನ್ನು ಒಳಗೊಂಡ ‘ಪ್ರಾಜೆಕ್ಟ್ ವಾಣಿ’ ದತ್ತಾಂಶದ ಮೂಲಕ ಈ ಎಐ ಮಾದರಿಗೆ ತರಬೇತಿ ನೀಡಲಾಗಿದೆ.
-
ಅತ್ಯುನ್ನತ ನಿಖರತೆ (Lowest Error Rate): ಈಶಾನ್ಯ ಭಾರತದ ‘ಗಾರೋ’ (Garo) ಭಾಷೆಯ ಪರೀಕ್ಷೆಯಲ್ಲಿ ಕೇವಲ 9.5% ವರ್ಡ್ ಎರರ್ ರೇಟ್ (Word Error Rate – WER) ದಾಖಲಿಸಿದೆ (ಇತರ ಅತ್ಯುತ್ತಮ ವ್ಯವಸ್ಥೆಗಳು ಇದೇ ಭಾಷೆಯಲ್ಲಿ 69.4% ದೋಷ ದರ ಹೊಂದಿದ್ದವು).
೩. ಡಿಜಿಟಲ್ ಒಳಗೊಳ್ಳುವಿಕೆಗೆ ಮಹತ್ವದ ಕೊಡುಗೆ:
ಭಾರತದ 2011 ರ ಜನಗಣತಿಯ ಪ್ರಕಾರ, ಸುಮಾರು ೨೫ ಕೋಟಿ ಜನರು ಮಾತನಾಡುವ ಪ್ರಾದೇಶಿಕ ಭಾಷೆಗಳಿಗೆ ಇಂದಿಗೂ ಯಾವುದೇ ವಾಯ್ಸ್ ಅಸಿಸ್ಟೆಂಟ್ ಅಥವಾ ಸ್ಪೀಚ್-ಟು-ಟೆಕ್ಸ್ಟ್ ಡಿಜಿಟಲ್ ಪರಿಕರಗಳಿಲ್ಲ. ಐಐಎಸ್ಸಿಯ ‘ಶ್ರವಾಣಿ’ ಮಾದರಿಯು ಈ ಡಿಜಿಟಲ್ ಅಂತರವನ್ನು ನಿವಾರಿಸಿ, ಗ್ರಾಮೀಣ ಹಾಗೂ ಬುಡಕಟ್ಟು ಜನರಿಗೆ ತಮ್ಮ ಮಾತೃಭಾಷೆಯಲ್ಲೇ ಡಿಜಿಟಲ್ ಸೇವೆಗಳನ್ನು ಪಡೆಯಲು ರಹದಾರಿ ಕಲ್ಪಿಸಲಿದೆ.
ಪರೀಕ್ಷಾ ದೃಷ್ಟಿಯಿಂದ ಪ್ರಮುಖಾಂಶಗಳು:
-
IISc: Indian Institute of Science (ಬೆಂಗಳೂರಿನಲ್ಲಿರುವ ಭಾರತದ ಅಗ್ರಮಾನ್ಯ ವಿಜ್ಞಾನ ಸಂಶೋಧನಾ ಸಂಸ್ಥೆ).
-
ARTPARK: AI and Robotics Technology Park (ಕರ್ನಾಟಕ ಸರ್ಕಾರ ಮತ್ತು IISc ಉಪಕ್ರಮದ ನಾವೀನ್ಯತಾ ಕೇಂದ್ರ).
-
ಸ್ಪೀಚ್ ರೆಕಗ್ನಿಷನ್ (Speech Recognition): ಮಾತನಾಡುವ ಶಬ್ದಗಳನ್ನು ಯಂತ್ರ ಓದಬಲ್ಲ (Machine-readable) ಲಿಖಿತ ಪಠ್ಯವಾಗಿ ಪರಿವರ್ತಿಸುವ ಕೃತಕ ಬುದ್ಧಿಮತ್ತೆ ತಂತ್ರಜ್ಞಾನ.
-
೮ನೇ ಅನುಚ್ಛೇದ (Eighth Schedule): ಭಾರತೀಯ ಸಂವಿಧಾನವು ಅಧಿಕೃತವಾಗಿ ಮಾನ್ಯ ಮಾಡಿರುವ 22 ಭಾಷೆಗಳ ಪಟ್ಟಿ.
-
MIT License: ತಂತ್ರಾಂಶಗಳನ್ನು ಮುಕ್ತವಾಗಿ ಮಾರ್ಪಡಿಸಲು, ಬಳಸಲು ಮತ್ತು ಹಂಚಿಕೊಳ್ಳಲು ಅನುಮತಿಸುವ ಸಾಫ್ಟ್ವೇರ್ ಲೈಸೆನ್ಸ್.
