Chitrarth-1:Krutrim AI實驗室的多語言VLM
印度的AI景觀正在迅速發展,並有重大的進步和創新。 OLA集團公司Krutrim AI Labs是這一增長的關鍵參與者,最近揭示了Chitrarth-1,這是一種開創性的視覺語言模型(VLM)。 Chitrarth-1專為印度多樣化的語言和文化背景而設計,支持十種主要的印度語言以及英語,這是針對多語言AI解決方案的關鍵需求。本文深入研究了Chitrarth-1及其對印度不斷擴展的AI功能的影響。 目錄的
表什麼是chitrarth-1?
- > chitrarth-1體系結構和規格
- 培訓數據和方法
- 階段1:適配器預訓練
- >階段2:指令調整
- >訪問Chitrarth-1
- > Chitrarth-1在Action
中 結論 - 什麼是chitrarth-1?
> chitrarth-1(結合“ chitra” - 圖像和“ artha” - 含義)是一個7.5億個參數VLM,集成了先進的語言和視覺處理。 它為滿足印度多種語言需求而建造的支持印地語,孟加拉語,泰盧固語,泰米爾語,馬拉地語,古吉拉特語,卡納達語,馬拉雅拉姆語,奧迪亞,阿薩姆語和英語。 該模型體現了克魯特里姆(Krutrim)對“為我們的國家,國家和我們的公民開發AI的承諾”。 它使用豐富的多語言數據集可以最大程度地減少偏見,並確保跨指示語言和英語的穩健性能,從而促進公平的AI訪問。 Chitrarth-1的研究發表在領先的學術期刊上,包括Neurips和第九次機器翻譯會議。
>
> chitrarth-1利用krutrim-7b llm作為基礎,通過基於siglip(siglip-so400m-patch14-384)模型的視覺編碼器增強。 關鍵建築組件包括:
>用於圖像特徵提取的預訓練的siglip視覺編碼器。>可訓練的線性映射層,以將項目圖像特徵到LLM的令牌空間中。
- 培訓數據和方法 Chitrarth-1的培訓涉及兩個階段,使用了龐大的多語言數據集:
階段1:適配器預訓練
- 在使用開源模型轉換為多種指示語言的不同數據集上進行了預先訓練。
- 維持英語和指示語言的平衡表示,以確保公平的表現。 旨在避免對任何單一語言的偏見,優化效率和魯棒性。
- >
階段2:指令調整
在復雜的指令數據集上進行了微調,以增強多模式推理功能。- >利用了基於英語的指令調查數據集及其多語言翻譯。 >
- 包括一個視覺語言數據集,其中包含不同的印度圖像(個性,紀念碑,藝術品,美食)。
- 合併平衡域表示的高質量專有英語文本數據。
- 性能和基準測試
Chitrarth-1對IdeFics 2(7b)和Palo 7b等領先的VLM進行了嚴格的測試,在各種基准上表現不佳,同時在諸如TextVQA和Vizwiz等任務上保持競爭力。它還超過了關鍵指標中的Llama 3.2 11B視覺指導。 克魯特里姆(Krutrim)推出了Bharatbench,這是一個新的評估套件,用於在三個任務中使用十種資源不足的指示語言,為將來的研究建立了基線,並突出了Chitrarth-1有效地處理這些語言的能力。 樣本Bharatbench結果如下所示:
有關更多詳細信息,請單擊此處。
>訪問Chitrarth-1
> Chitrarth-1可以通過以下方式訪問:
- >擁抱面:直接使用或微調。 (單擊此處訪問)
- github:(原始文章中提供的代碼) >
- krutrim雲:(單擊此處探索) >
> Chitrarth-1在Action
結論
OLA集團的一個部門> krutrim AI實驗室致力於建立AI計算的未來。 以Chitrarth-1以及其他產品(例如GPU)作為服務,AI工作室等等,他們正在建立一個新的包容性,具有文化敏感的AI的標準,從而促進了更公平的技術景觀。
以上是Chitrarth-1:Krutrim AI實驗室的多語言VLM的詳細內容。更多資訊請關注PHP中文網其他相關文章!

熱AI工具

Undresser.AI Undress
人工智慧驅動的應用程序,用於創建逼真的裸體照片

AI Clothes Remover
用於從照片中去除衣服的線上人工智慧工具。

Undress AI Tool
免費脫衣圖片

Clothoff.io
AI脫衣器

Video Face Swap
使用我們完全免費的人工智慧換臉工具,輕鬆在任何影片中換臉!

熱門文章

熱工具

記事本++7.3.1
好用且免費的程式碼編輯器

SublimeText3漢化版
中文版,非常好用

禪工作室 13.0.1
強大的PHP整合開發環境

Dreamweaver CS6
視覺化網頁開發工具

SublimeText3 Mac版
神級程式碼編輯軟體(SublimeText3)

Meta的Llama 3.2:多模式和移動AI的飛躍 Meta最近公佈了Llama 3.2,這是AI的重大進步,具有強大的視覺功能和針對移動設備優化的輕量級文本模型。 以成功為基礎

嘿,編碼忍者!您當天計劃哪些與編碼有關的任務?在您進一步研究此博客之前,我希望您考慮所有與編碼相關的困境,這是將其列出的。 完畢? - 讓&#8217

本週的AI景觀:進步,道德考慮和監管辯論的旋風。 OpenAI,Google,Meta和Microsoft等主要參與者已經釋放了一系列更新,從開創性的新車型到LE的關鍵轉變

Shopify首席執行官TobiLütke最近的備忘錄大膽地宣布AI對每位員工的基本期望是公司內部的重大文化轉變。 這不是短暫的趨勢。這是整合到P中的新操作範式

介紹 想像一下,穿過美術館,周圍是生動的繪畫和雕塑。現在,如果您可以向每一部分提出一個問題並獲得有意義的答案,該怎麼辦?您可能會問:“您在講什麼故事?

介紹 Openai已根據備受期待的“草莓”建築發布了其新模型。這種稱為O1的創新模型增強了推理能力,使其可以通過問題進行思考

SQL的Alter表語句:動態地將列添加到數據庫 在數據管理中,SQL的適應性至關重要。 需要即時調整數據庫結構嗎? Alter表語句是您的解決方案。本指南的詳細信息添加了Colu

對於那些可能是我專欄新手的人,我廣泛探討了AI的最新進展,包括體現AI,AI推理,AI中的高科技突破,及時的工程,AI培訓,AI,AI RE RE等主題
