印度欽奈訊——印度理工學院馬德拉斯分校(IIT Madras)旗下的Bodhan AI教育人工智慧卓越中心,正式推出四款開源人工智慧模型,旨在強化印度多語言教育,並協助機構、新創企業及研究人員為印度語言開發各類應用程式。
這四款模型由Bodhan AI與AI4Bharat合作開發,涵蓋四大核心領域:語音辨識(ASR)、語音生成(TTS)、機器翻譯以及光學字元辨識(OCR)。這些模型支援22至27種印度語言,並以「數位公共財」(Digital Public Goods)的形式釋出,提供開源權重(open-weight)模型及API介接,運行於印度主權數位基礎設施之上。
這些模型是「Bharat EduAI Stack」的一部分,後者為一項主權數位公共基礎設施倡議,旨在為印度教育生態系建立統一的AI應用層。透過開放原始碼的策略,開發者與機構可直接將模型調整應用於自身場景,無需從頭建置語言模型,進而減少資源重複投入。
IIT Madras校長Kamakoti表示,印度的AI發展歷程必須奠基於能夠理解該國語言多樣性的技術之上。Bodhan AI首席研究員Mitesh Khapra指出,該計畫旨在與更廣泛的生態系協作,打造共同技術層,同時降低重複開發的資源浪費。
此次發布同時推出兩款教育應用工具。其一為「學生TutorBot」,專為6至12年級學生設計,支援22種印度語言的文字與語音互動,能依據教科書內容提供解題說明、練習題與學習評量。
另一款為「教師助理Bot」,旨在協助教師準備教案、學習單、測驗題與評量內容。教師將保有對AI生成內容的最終主導權,可自行審核、修改或捨棄AI產出的教材。
技術層面上,這些模型採用NVIDIA Nemotron開源模型進行訓練與優化,預期將為印度教育領域的多語言AI應用奠定技術基礎,推動涵蓋學習輔助、行政自動化等多項場景的AI解決方案發展。