Gemma 3 4B

मुफ़्त

Google से 4 बिलियन मापदंडों और 128K टोकन संदर्भ विंडो के साथ मल्टीमॉडल भाषा मॉडल।.

अवलोकन

जेमा 3 4 बी

जेमा 3 4B तंत्रिका नेटवर्क का विवरण

जेमा 3 4B गूगल द्वारा विकसित एक ओपन सोर्स मल्टीमॉडल भाषा मॉडल है। मॉडल 4 अरब मापदंडों से लैस है और एक साथ पाठ्य और दृश्य जानकारी दोनों के साथ काम कर सकता है, जिससे इसे कृत्रिम बुद्धि कार्यों की एक विस्तृत श्रृंखला के लिए बहुमुखी उपकरण बनाया जा सकता है।

मुख्य विशेषता - खुले वजन

कई व्यावसायिक मॉडलों के विपरीत, जेमा 3 4 बी खुले वजन के साथ वितरित किया जाता है। इसका मतलब यह है कि डेवलपर्स न केवल मॉडल का उपयोग कर सकते हैं, बल्कि अपने स्वयं के परिदृश्यों के लिए भी इसे ठीक कर सकते हैं, जो अपनी परियोजनाओं के विनिर्देशों के लिए तंत्रिका नेटवर्क के व्यवहार को अनुकूलित करते हैं।

बहुसंख्यकता और भाषा समर्थन

मॉडल पाठ प्रश्नों और छवियों दोनों को संसाधित करता है, पाठ प्रतिक्रियाओं को उत्पन्न करता है। यह उन परिदृश्यों में उपयोग करने की अनुमति देता है जिन्हें दृश्य सामग्री विश्लेषण की आवश्यकता होती है: छवियों का वर्णन करना, चार्ट और आरेख से जानकारी निकालना और स्कैन किए गए दस्तावेजों के साथ काम करना। इसके अलावा, मॉडल कई भाषाओं का समर्थन करता है, इसके अनुप्रयोगों की भौगोलिक पहुंच का विस्तार करता है।

रिलीज की तारीख और ज्ञान कटऑफ

जेम्मा 3 4 बी 12 मार्च 2025 को जारी किया गया था। मॉडल का ज्ञान कटऑफ अगस्त 1, 2024 है, जिसका अर्थ है तंत्रिका नेटवर्क को डेटा चालू करने पर प्रशिक्षित किया गया था। उस तारीख तक।

Gemma 3 4B विनिर्देशों

विशेषतामूल्य
प्रकारमल्टीमॉडल भाषा मॉडल
डेवलपरगूगल
मापदंडों की संख्या4.0B
संदर्भ विंडो128K tokens (131.1K on the page)
रिलीज़ की तारीखमार्च 12, 2025
प्रशिक्षण टोकन4.0T टोकन
ज्ञान कटऑफअगस्त 1, 2024
औसत स्कोर (ZeroEval)53.0%
अधिकतम इनपुट टोकन131.1K
अधिकतम उत्पादन टोकन131.1K
लाइसेंसमणि
इनपुट टोकन मूल्य (प्रति 1M)$0.02
उत्पादन टोकन मूल्य (प्रति 1M)$0.04
समर्थित क्षमताओंसमारोह कॉलिंग, संरचित आउटपुट, कोड निष्पादन, वेब सर्च, बैच इनफरेंस, ललित ट्यूनिंग

कौन जेमा 3 4B तंत्रिका नेटवर्क के लिए उपयुक्त है?

सॉफ्टवेयर डेवलपर्स और मशीन लर्निंग इंजीनियरों

जेमा 3 4B मुख्य रूप से उन पेशेवरों के लिए है जो एआई समाधान का निर्माण और तैनाती करते हैं। खुले वजन विशिष्ट व्यावसायिक कार्यों के लिए मॉडल को ठीक ट्यून करने की अनुमति देते हैं - चैटबॉट से दस्तावेज़ विश्लेषण प्रणाली तक। फंक्शन कॉलिंग और कोड एक्सीक्यूशन के लिए समर्थन मॉडल को सॉफ़्टवेयर उत्पादों में एकीकरण के लिए उपयुक्त बनाता है जिसके लिए कोड निष्पादन या बाहरी कार्यों के साथ बातचीत की आवश्यकता होती है।

एआई शोधकर्ताओं और उत्साही

अनुसंधान कार्यों के लिए, मॉडल अपने कॉम्पैक्ट आकार (4B मापदंडों) और बहुसंख्यकता के कारण दिलचस्प है। यह महत्वपूर्ण कंप्यूटिंग संसाधनों की आवश्यकता के बिना छवि और पाठ समझ कार्यों पर छोटे मॉडल के व्यवहार का अध्ययन करना संभव बनाता है। कम लागत भी प्रयोगों के लिए सुलभ बनाता है।

दृश्य सामग्री के साथ काम करने वाली टीम

विशेषज्ञ जिन्हें छवियों का विश्लेषण करने की आवश्यकता होती है - विपणक से तकनीकी विशेषज्ञों तक - फ़ोटो, स्क्रीनशॉट, आरेख और चार्ट से स्वचालित विवरण, वर्गीकरण और डेटा निष्कर्षण के लिए मॉडल का उपयोग कर सकते हैं।

जेमा 3 4B तंत्रिका नेटवर्क का उपयोग कैसे करें?

वाया एपीआई और क्लाउड सेवाएं

मॉडल पे-ए-यू-गो मूल्य निर्धारण के साथ एपीआई के माध्यम से कॉल करने के लिए उपलब्ध है - $0.02 प्रति 1 मिलियन इनपुट टोकन और $0.04 प्रति 1 मिलियन आउटपुट टोकन। यह आपको अपने स्वयं के बुनियादी ढांचे पर मॉडल को तैनात किए बिना कार्यक्षमता का परीक्षण करने की अनुमति देता है।

स्थानीय तैनाती और ठीक ट्यूनिंग

खुले वजन के लिए धन्यवाद, मॉडल को स्थानीय रूप से डाउनलोड और चलाया जा सकता है। इसके लिए पर्याप्त वीडियो मेमोरी वाले GPU की आवश्यकता होती है। बैच इनफरेंस - अनुरोधों का बैच प्रसंस्करण - समर्थित है, जो उत्पादन परिदृश्यों में काम को तेज करता है। ललित ट्यूनिंग तंत्र मॉडल को एक संकीर्ण विषय क्षेत्र के अनुकूल होने की अनुमति देता है।

वेब सर्च के साथ इंटरफेस के माध्यम से

मॉडल वेब खोज का समर्थन करता है, जिससे अनुरोधों का जवाब देते समय इंटरनेट से अद्यतन जानकारी प्राप्त करने की अनुमति मिलती है। यह विशेष रूप से उन कार्यों के लिए उपयोगी है जिन्हें मॉडल के ज्ञान कटऑफ से परे ताजा डेटा की आवश्यकता होती है।

जेमा 3 4B की मुख्य विशेषताएं

पाठ और छवि प्रसंस्करण

जेमा 3 4B दोनों पाठ और छवियों को इनपुट के रूप में स्वीकार करता है और पाठ प्रतिक्रियाओं को वापस करता है। यह कोर मल्टीमोडल फंक्शन है जो अन्य सभी क्षमताओं को कम करता है।

समारोह कॉलिंग और संरचित आउटपुट

मॉडल बाहरी कार्यों को कॉल कर सकता है, जो अन्य सेवाओं और डेटाबेस के साथ एकीकरण को सक्षम बनाता है। संरचित आउटपुट समर्थन यह सुनिश्चित करता है कि मॉडल प्रतिक्रियाओं को एक निर्दिष्ट प्रारूप (जैसे, JSON) में लौटा दिया जाता है, जिससे परिणाम की प्रोग्रामेटिक प्रोसेसिंग को सरल बनाया जा सकता है।

कोड एक्सीक्यूशन और बैच इनफरेंस

अंतर्निहित कोड निष्पादन क्षमता मॉडल को कम्प्यूटेशनल कार्यों और प्रक्रिया एल्गोरिदम को हल करने की अनुमति देती है। बैच इनफरेंस बैचों में मॉडल को अनुरोध भेजने, बड़े पैमाने पर डेटा प्रोसेसिंग के दौरान समय बचाने में सक्षम बनाता है।

जेमा 3 4B के लाभ

बड़े संदर्भ खिड़की

128 हजार टोकनों की संदर्भ खिड़की कॉम्पैक्ट मॉडलों में सबसे बड़ा है। यह लंबे दस्तावेज़, वार्तालाप लॉग, बड़ी परियोजनाओं का स्रोत कोड और संदर्भ खोए बिना सूचना के अन्य बड़े संस्करणों को संसाधित करने की अनुमति देता है।

अत्यधिक कम लागत

$0.02 प्रति 1 मिलियन इनपुट टोकन और $0.04 प्रति 1 मिलियन आउटपुट टोकन की कीमत बाजार पर सबसे अधिक लागत प्रभावी मॉडल बनाता है। बड़ी प्रसंस्करण मात्रा में, यह अधिक महंगी विकल्पों की तुलना में महत्वपूर्ण बचत प्रदान करता है।

खुले वजन और बहुसंख्यकता

मॉडल को ठीक करने की क्षमता और खुले वजन होने के दौरान इसे छवियों के साथ उपयोग करने की क्षमता एक दुर्लभ संयोजन है। अधिकांश कॉम्पैक्ट मल्टीमॉडल मॉडल में या तो ओपन कोड या लागत अधिक नहीं होती है।

जेमा 3 4B के नुकसान

मापदंडों की सीमित संख्या

4 अरब पैरामीटर एक कॉम्पैक्ट आकार है जो जटिल तार्किक कार्यों पर प्रतिक्रियाओं की समान गुणवत्ता प्रदान नहीं कर सकता है और बड़े मॉडल (उदाहरण के लिए, 70B या 100B +) के रूप में गहरी तर्क दिया जा सकता है। अत्यधिक विशिष्ट या जटिल परिदृश्यों को ठीक ट्यूनिंग की आवश्यकता हो सकती है।

औसत बेंचमार्क स्कोर

औसत ZeroEval स्कोर 53.0% है, जो अतिरिक्त ट्यूनिंग के बिना विशिष्ट परीक्षण कार्यों पर औसत परिणाम दर्शाता है। कुछ परिदृश्यों में, मॉडल ठीक-ट्यूनिंग के बिना बड़े या अधिक विशेष समकक्षों से कम हो सकता है।

जेमा 3 4B क्या कार्य करता है?

सवाल जवाब और संक्षेपण

मॉडल पाठ्य और दृश्य सामग्री पर विस्तृत जवाब प्रदान कर सकता है, साथ ही साथ लंबे ग्रंथों के संक्षिप्त सारांश (अनुच्छेदन) का उत्पादन भी कर सकता है। बड़ी संदर्भ खिड़की पूरे लेख या पुस्तक अध्यायों को इनपुट के रूप में खिलाया जा सकता है।

तार्किक तर्क और विश्लेषण

जेम्मा 3 4B उन कार्यों के लिए उपयुक्त है जिन्हें कारण और प्रभाव संबंधों के निर्माण, डेटा की तुलना और प्रदान की गई जानकारी से निष्कर्ष निकालने की आवश्यकता होती है। इसमें टेबल या चार्ट से संख्यात्मक डेटा के विशुद्ध रूप से पाठ्यात्मक श्रृंखला और विश्लेषण दोनों शामिल हैं।

छवि समझ

तंत्रिका नेटवर्क दृश्य जानकारी का विश्लेषण कर सकता है: छवियों में ऑब्जेक्ट्स को पहचानना, दृश्यों का वर्णन करना और आरेख और चार्ट की व्याख्या करना। यह दस्तावेज़ प्रवाह स्वचालन, संग्रह और मीडिया सामग्री के साथ काम करने से संबंधित कार्यों में मांग है।

जेमा 3 4B मूल्य निर्धारण

मॉडल एक टोकन आधारित भुगतान मॉडल का उपयोग करता है। इनपुट टोकन (टेक्स्ट और छवियों को इनपुट के रूप में पारित किया गया) की लागत $0.02 प्रति 1 मिलियन टोकन है। आउटपुट टोकन (generated प्रतिक्रियाओं) की लागत प्रति 1 मिलियन डॉलर टोकन है। यह मॉडल को अपनी कक्षा में सबसे सस्ता बनाता है। छवियों के लिए सटीक कीमतें (टोकन समतुल्य) चित्रों के रिज़ॉल्यूशन और विस्तार पर निर्भर करती हैं।

जेमा 3 4B के लिए उपयोग की शर्तें

मॉडल को रत्न लाइसेंस के तहत वितरित किया जाता है। यह मुफ्त में डाउनलोड और उपयोग के लिए उपलब्ध है। खुले वजन मॉडल को लाइसेंस शर्तों के अधीन वाणिज्यिक परियोजनाओं में ठीक-ट्यून और उपयोग करने की अनुमति देते हैं। डेवलपर्स को व्यावसायिक उपयोग शुरू करने से पहले पूर्ण लाइसेंस पाठ की समीक्षा करने की सलाह दी जाती है।

Gemma 3 4B की उपलब्धता

जेमा 3 4B गूगल और तीसरे पक्ष के प्रदाताओं से एपीआई के माध्यम से उपलब्ध है जो मॉडल का समर्थन करते हैं। मॉडल को स्थानीय तैनाती के लिए आधिकारिक भंडार से सीधे डाउनलोड किया जा सकता है। विभिन्न ढांचे के लिए inference और ठीक ट्यूनिंग समर्थित हैं। वेब सर्च, बैच इनफरेंस और अन्य क्षमताओं की उपलब्धता विशिष्ट तैनाती विधि पर निर्भर करती है।

कैसे जेमा 3 4B समकक्षों से अलग है

जेमा 3n मॉडल के साथ तुलना

जेम्मा 3 परिवार के भीतर विभिन्न विन्यास हैं: जेम्मा 3n E2B, जेम्मा 3n E4B, साथ ही निर्देशित और हल्के संस्करण (Instructed लाइटआरटी पूर्वावलोकन)। जेमा 3 4B 4 बिलियन मापदंडों के साथ आधार संस्करण है। "n" suffix के साथ संस्करण वास्तुकला और प्रदर्शन में भिन्न हो सकते हैं। लाइटआरटी संस्करण सीमित संसाधनों के साथ उपकरणों पर संचालन के लिए अनुकूलित हैं।

MedGemma 4B IT के साथ तुलना

MedGemma 4B IT एक विशेष संस्करण है जो चिकित्सा डेटा पर ठीक-ट्यून किया गया है। इसके विपरीत, जेमा 3 4B एक सामान्य उद्देश्य वाला मॉडल है जो किसी विशिष्ट विषय क्षेत्र के अनुरूप नहीं है, लेकिन यह किसी भी डोमेन के लिए स्वतंत्र ठीक ट्यूनिंग की अनुमति देता है।

मिथुन 1.5 फ्लैश 8B के साथ तुलना

मिथुन 1.5 फ्लैश 8B गूगल (8B मापदंडों) से एक बड़ा मॉडल है जो गति और कम विलंबता पर केंद्रित है। जेमा 3 4 बी पैरामीटर की संख्या में इसे खो देता है लेकिन ओपन वेट और फुल कस्टमाइजेशन क्षमता के लिए धन्यवाद जीतता है। दोनों मॉडल बहुविधता और एक बड़ी संदर्भ खिड़की का समर्थन करते हैं।

निष्कर्ष

जेमा 3 4B गूगल से खुले वजन के साथ एक कॉम्पैक्ट मल्टीमॉडल मॉडल है, जिसमें 128 हजार टोकन और कम उपयोग लागत की एक बड़ी संदर्भ खिड़की है। यह उत्तर देने, संक्षेपण, तार्किक तर्क और दृश्य सूचना विश्लेषण के लिए उपयुक्त है। इसके ओपन-सोर्स कोड के लिए धन्यवाद, फंक्शन कॉलिंग, कोड एक्सीक्यूशन और ठीक ट्यूनिंग क्षमताओं के लिए समर्थन, मॉडल है डेवलपर्स, शोधकर्ताओं और टीमों के लिए रूचि की अभिव्यक्ति पाठ्य और दृश्य सामग्री के साथ स्वतः काम करती है। कम कीमत ($0.02 प्रति 1M इनपुट टोकन) इसे बड़े पैमाने पर उपयोग के लिए एक लागत प्रभावी विकल्प बनाता है।

प्रश्नों के उत्तर उत्पन्न करना
पाठ सारांशीकरण
छवि विश्लेषण
तार्किक तर्क

अक्सर पूछे जाने वाले प्रश्न

यह भी देखें

ChatINFO

ChatINFO

5.0
मुफ़्तकृपया अनुवाद के लिए मूल पाठ प्रदान करें।

रूसी भाषा का GPT-आधारित AI चैट-बॉट, जो जानकारी खोजने और टेक्स्ट निर्माण के लिए है।

Anxiety Simulator

Anxiety Simulator

5.0
मुफ़्त

वेब सिम्युलेटर जो चिंता का अनुभव कर रहे व्यक्ति के साथ सहायक संवाद का अभ्यास करने के लिए है।

AgentX

AgentX

5.0
मुफ़्त

ग्राहक सहायता और लीड जनरेशन को स्वचालित करने के लिए मल्टी-एजेंट एआई सिस्टम और चैटबॉट बनाने का मंच।.

NameSnack

NameSnack

5.0
मुफ़्तकृपया अनुवाद के लिए मूल पाठ प्रदान करें।

डोमेन उपलब्धता जाँच के साथ AI व्यवसाय का नाम जनरेटर।.

David One

David One

5.0

सार्वभौमिक AI सहायक जो वीडियो और वेब पेजों का विश्लेषण करता है, सवालों के जवाब देता है और नोट्स बनाता है।

Averi

Averi

5.0

एवेरी — मार्केटिंग प्लेटफ़ॉर्म जो कैंपेन प्लानिंग, कंटेंट निर्माण और एनालिटिक्स को एक ही इंटरफ़ेस में जोड़ता है।

Anakin.ai

Anakin.ai

5.0
मुफ़्तपरीक्षण अवधि

अनाकिन.एआई एक लो-कोड प्लेटफ़ॉर्म है जो विभिन्न AI मॉडलों को एकीकृत करता है, जिससे बिना प्रोग्रामिंग के कंटेंट निर्माण और वर्कफ़्लो स्वचालन संभव होता है।

SoulGen

SoulGen

5.0
मुफ़्तकृपया अनुवाद के लिए मूल पाठ प्रदान करें।

पाठ विवरण से छवियों को उत्पन्न करने और आभासी पात्रों के साथ संवाद करने के लिए वेब सेवा।.

जेमा 3 4B - गूगल के बहुमॉडल तंत्रिका नेटवर्क का अवलोकन