• 熱門
  • 地方
  • 生活
  • 產經
  • 綜合
  • 娛樂
  • 文教
  • 身心𩆜
  • 醫藥健康
  • 旅遊
  • 美食
  • 體育
  • 法律天地
  • 合作媒體
  • 熱門
  • 地方
  • 生活
  • 產經
  • 綜合
  • 娛樂
  • 文教
  • 身心𩆜
  • 醫藥健康
  • 旅遊
  • 美食
  • 體育
  • 法律天地
  • 合作媒體
最新新聞
2026高雄奶茶節9/19、20鹽埕登場  70家品牌打造秋日奶茶美食派對 串聯鹽埕街區展現高雄飲食觀光魅力
新北7位教師獲教育部卓越特教人員獎 用專業陪孩子找到自己的光
「5搶1」競爭最激烈南市東區崇誨里 36歲洪茗謚誓要翻轉老舊眷村 讓社區展現新風貌
百大文化在南投 濁水沃土蘊六藝 六大文化基地串聯啟動 打造南投文化品牌新亮點
雄崎電梯捐車助仁家 長者無礙出行 98歲人瑞回贈卡片道謝
S__121495564
S__120643731
首頁 » 印度新創Sarvam AI模型獲Google執行長盛讚 展現多語言處理實力
合作媒體

印度新創Sarvam AI模型獲Google執行長盛讚 展現多語言處理實力

商傳媒
商傳媒
Published: 2026/03/21
Share
6 Min Read
印度新創Sarvam AI模型獲Google執行長盛讚 展現多語言處理實力
印度新創Sarvam AI模型獲Google執行長盛讚 展現多語言處理實力
圖/本報資料庫

商傳媒|葉安庭/綜合外電報導

印度新創公司Sarvam AI近日獲得Google執行長桑德爾·皮蔡(Sundar Pichai)的高度肯定,其開發的人工智慧模型在處理印度多元語言和視覺理解任務方面展現卓越能力。該模型旨在深入發掘印度本地知識,並解決全球主流模型對印度語言支援不足的問題。

Sarvam AI的核心視覺語言模型(VLM)是一個高效能的3B狀態空間模型,不僅具備圖像標註、場景文字識別、圖表解讀及複雜表格解析等視覺理解功能,更在涵蓋22種官方印度語言的高品質資料集上進行訓練。據Sarvam AI執行長普拉蒂尤什·庫馬爾(Pratyush Kumar)指出,Sarvam Vision在olmcOCR-Bench(僅限英語子集)上達到84.3%的領先準確度,超越了Gemini 3 Pro等頂尖模型。

除了視覺理解,Sarvam AI的語音辨識模型支援10種印度語言,擁有7400萬個參數,僅佔約294MB的裝置空間。此模型能自動識別所說語言,並以約8.5倍於即時的速度處理語音,在Qualcomm Snapdragon 8 Gen 3晶片上的首次詞元生成時間少於300毫秒。其語音合成模型則有2400萬個參數和約60MB的裝置空間,可進行客製化語音複製,僅需約一小時的音訊資料即可部署。

此外,Sarvam AI的翻譯模型擁有1.5億個參數,在裝置上的佔用空間約為334MB。該模型能處理110種語言對的雙向翻譯,其中包括10種印度語言和英語,並且無需透過中介語言。這項技術對於解鎖實體文件、掃描檔案及歷史文獻中的印度知識至關重要。該公司於2023年8月成立,其文件智慧API曾免費提供至2026年2月,供使用者探索和建構Sarvam Vision應用。

Previous Article 美國50年首座大型煉油廠動土在即 川普宣示強化能源自主 美國50年首座大型煉油廠動土在即 川普宣示強化能源自主
Next Article AI科技浪潮衝擊人類尊嚴定義 哲學與倫理挑戰浮現 AI科技浪潮衝擊人類尊嚴定義 哲學與倫理挑戰浮現
  • 關於我們
  • 隱私權政策
  • 聯絡我們
  • 關於我們
  • 隱私權政策
  • 聯絡我們
Copyright©MORE News
Welcome Back!

Sign in to your account

Username or Email Address
Password

Lost your password?

為了帶給你更好的瀏覽體驗我們的網站中有使用Cookie,幫助我們改善網站的結構和行銷分析。如果你同意使用請點擊了解,我們會權利提供你更完善的服務!