Chitrarth-1: VLM berbilang bahasa oleh Makmal Krutrim AI-AI-php.cn

Rumah

Peranti teknologi

Chitrarth-1: VLM berbilang bahasa oleh Makmal Krutrim AI

Joseph Gordon-Levitt

Mar 03, 2025 pm 06:22 PM

Landskap AI India berkembang pesat, dengan kemajuan dan inovasi yang ketara muncul. Krutrim AI Labs, sebuah syarikat kumpulan Ola, adalah pemain utama dalam pertumbuhan ini, baru-baru ini melancarkan Chitrarth-1, model bahasa penglihatan yang terobosan (VLM). Direka untuk konteks linguistik dan budaya India yang pelbagai, Chitrarth-1 menyokong sepuluh bahasa India utama ditambah bahasa Inggeris, menangani keperluan kritikal untuk penyelesaian AI berbilang bahasa. Artikel ini menyelidiki Chitrarth-1 dan implikasinya untuk keupayaan AI yang berkembang di India.

Jadual Kandungan

Apa itu Chitrarth-1?

data latihan dan metodologi

Prestasi dan penanda aras

Mengakses Chitrarth-1

chitrarth-1 dalam tindakan

Kesimpulan

Apa itu Chitrarth-1?

Chitrarth-1 (menggabungkan "chitra"-imej dan "artha"-makna) adalah parameter 7.5 bilion VLM yang mengintegrasikan bahasa lanjutan dan pemprosesan penglihatan. Dibina untuk memenuhi keperluan linguistik India yang pelbagai, ia menyokong Hindi, Bengali, Telugu, Tamil, Marathi, Gujarati, Kannada, Malayalam, Odia, Assam, dan Inggeris. Model ini merangkumi komitmen Krutrim untuk membangunkan AI "untuk negara kita, negara kita, dan bagi warganegara kita." Penggunaan dataset yang kaya dan berbilang bahasa meminimumkan kecenderungan dan memastikan prestasi yang mantap merentasi bahasa indik dan bahasa Inggeris, mempromosikan akses AI yang saksama. Penyelidikan mengenai Chitrarth-1 diterbitkan dalam jurnal akademik terkemuka, termasuk Neurips dan Persidangan Kesembilan mengenai Terjemahan Mesin.

Chitrarth-1 menggunakan Krutrim-7b LLM sebagai asasnya, dipertingkatkan oleh pengekod penglihatan berdasarkan model SIGLIP (SIGLIP-SO400M-PATCH14-384). Komponen seni bina utama termasuk:

pengekod visi siglip pra-terlatih untuk pengekstrakan ciri imej.

Latihan Chitrarth-1 melibatkan dua fasa menggunakan dataset yang luas dan berbilang bahasa:

Fasa 1: Penyesuai Pra-Training Chitrarth-1: A Multilingual VLM by Krutrim AI Labs

pra-terlatih pada dataset yang pelbagai diterjemahkan ke dalam pelbagai bahasa indik menggunakan model sumber terbuka.
mengekalkan perwakilan bahasa Inggeris dan indik yang seimbang untuk memastikan prestasi yang saksama.
Direka untuk mengelakkan kecenderungan ke arah mana -mana bahasa tunggal, mengoptimumkan untuk kecekapan dan keteguhan.

Fasa 2: Penalaan Arahan

disesuaikan dengan dataset arahan yang kompleks untuk meningkatkan keupayaan penalaran multimodal.
menggunakan dataset penalaan arahan berasaskan Inggeris dan terjemahan berbilang bahasa.
termasuk dataset bahasa penglihatan yang memaparkan imej India yang pelbagai (personaliti, monumen, karya seni, masakan).
menggabungkan data teks bahasa Inggeris berkualiti tinggi untuk perwakilan domain yang seimbang.

Prestasi dan penanda aras

Chitrarth-1: A Multilingual VLM by Krutrim AI Labs

Chitrarth-1 telah diuji dengan ketat terhadap VLMs terkemuka seperti Idefics 2 (7B) dan Palo 7B, secara konsisten mengatasi mereka pada pelbagai tanda aras sambil mengekalkan daya saing mengenai tugas-tugas seperti TextVQA dan Vizwiz. Ia juga melampaui Llama 3.2 11B Visi Mengarah dalam metrik utama. Krutrim memperkenalkan Bharatbench, sebuah suite penilaian baru untuk sepuluh bahasa indik yang kurang mendapat sumber dalam tiga tugas, mewujudkan garis dasar untuk penyelidikan masa depan dan menonjolkan keupayaan Chitrarth-1 untuk mengendalikan bahasa-bahasa ini dengan berkesan. Contoh hasil bharatbench ditunjukkan di bawah:

Untuk maklumat lanjut, klik di sini.

Mengakses Chitrarth-1

Chitrarth-1 boleh diakses melalui:

Pakaian muka: Penggunaan langsung atau penalaan halus. (Klik di sini untuk melawat)
github: (kod yang disediakan dalam artikel asal)
awan krutrim: (klik di sini untuk meneroka)

chitrarth-1 dalam tindakan

Contoh keupayaan Chitrarth-1 termasuk analisis imej, generasi kapsyen imej, dan analisis skrin UI/UX (imej yang disediakan dalam artikel asal).

Chitrarth-1: A Multilingual VLM by Krutrim AI Labs

Kesimpulan

Krutrim AI Labs, pembahagian kumpulan OLA, komited untuk membina masa depan pengkomputeran AI. Dengan Chitrarth-1, dan persembahan lain seperti GPU sebagai perkhidmatan, AI Studio, dan banyak lagi, mereka mewujudkan standard baru untuk AI yang sensitif, budaya, memupuk landskap teknologi yang lebih adil.

Atas ialah kandungan terperinci Chitrarth-1: VLM berbilang bahasa oleh Makmal Krutrim AI. Untuk maklumat lanjut, sila ikut artikel berkaitan lain di laman web China PHP!

Kenyataan

Kandungan artikel ini disumbangkan secara sukarela oleh netizen, dan hak cipta adalah milik pengarang asal. Laman web ini tidak memikul tanggungjawab undang-undang yang sepadan. Jika anda menemui sebarang kandungan yang disyaki plagiarisme atau pelanggaran, sila hubungi admin@php.cn

Artikel Berkaitan

Panduan Pemimpin Perniagaan untuk Pengoptimuman Enjin Generatif (GEO)May 03, 2025 am 11:14 AM

Google mengetuai peralihan ini. Ciri "AI Gambaran Keseluruhan" sudah melayani lebih daripada satu bilion pengguna, memberikan jawapan lengkap sebelum ada yang mengklik pautan. [^2] Pemain lain juga mendapat tanah dengan cepat. Chatgpt, microsoft copilot, dan pe

Permulaan ini menggunakan ejen AI untuk melawan iklan jahat dan akaun peniruMay 03, 2025 am 11:13 AM

Pada tahun 2022, beliau mengasaskan permulaan pertahanan kejuruteraan sosial Doppel untuk berbuat demikian. Dan sebagai penjenayah siber memanfaatkan model AI yang lebih maju untuk mengatasi serangan mereka, sistem AI Doppel telah membantu perniagaan memerangi mereka secara lebih cepat dan lebih cepat dan lebih cepat

Bagaimana model dunia secara radikal membentuk semula masa depan AI dan LLM generatifMay 03, 2025 am 11:12 AM

Voila, melalui berinteraksi dengan model dunia yang sesuai, AI generatif dan LLMs boleh didorong secara substansial. Mari kita bercakap mengenainya. Analisis terobosan AI yang inovatif ini adalah sebahagian daripada liputan lajur Forbes yang berterusan pada AI terkini, termasuk

May Day 2050: Apa yang kita tinggalkan untuk meraikan?May 03, 2025 am 11:11 AM

Hari Buruh 2050. Taman di seluruh negara mengisi dengan keluarga yang menikmati barbeku tradisional manakala perarakan nostalgia angin melalui jalan -jalan bandar. Namun perayaan kini membawa kualiti muzium seperti muzium-reenactment bersejarah dan bukannya peringatan c

Pengesan DeepFake yang tidak pernah anda dengar tentang itu 98% tepatMay 03, 2025 am 11:10 AM

Untuk membantu menangani trend yang mendesak dan mengganggu ini, artikel yang dikaji semula dalam edisi Februari 2025 TEM Journal menyediakan salah satu penilaian yang paling jelas dan didorong oleh data mengenai tempat yang dihadapi oleh Deepfake teknologi pada masa ini. Penyelidik

Kuantum Bakat Perang: Krisis Tersembunyi Teknologi Mengancam ' s Frontier SeterusnyaMay 03, 2025 am 11:09 AM

Dari mengurangkan masa yang diperlukan untuk merumuskan ubat -ubatan baru untuk mewujudkan tenaga yang lebih hijau, akan ada peluang besar bagi perniagaan untuk memecahkan tanah baru. Terdapat masalah besar, walaupun: ada kekurangan orang yang teruk dengan kemahiran BUSI

Prototaip: Bakteria ini dapat menjana elektrikMay 03, 2025 am 11:08 AM

Bertahun -tahun yang lalu, saintis mendapati bahawa jenis bakteria tertentu kelihatan bernafas dengan menjana elektrik, dan bukannya mengambil oksigen, tetapi bagaimana mereka melakukannya adalah misteri. Kajian baru yang diterbitkan dalam jurnal Cell mengenal pasti bagaimana ini berlaku: mikrob

AI dan Cybersecurity: Perhitungan 100 Hari Pentadbiran BaruMay 03, 2025 am 11:07 AM

Pada persidangan RSAC 2025 minggu ini, Snyk menganjurkan panel yang tepat pada masanya bertajuk "The First 100 Days: How AI, Dasar & Cybersecurity Collide," yang menampilkan barisan All-Star: Jen Easterly, bekas pengarah CISA; Nicole Perlroth, bekas wartawan dan Partne

See all articles