Gemma 3 27B
27 अरब मापदंडों के साथ गूगल की बहुमॉडल भाषा मॉडल, पाठ और छवियों को संसाधित करने में सक्षम है।.
अवलोकन
जेमा 3 27B
जेमा 3 27B तंत्रिका नेटवर्क का विवरण
जेमा 3 27B गूगल द्वारा विकसित खुले वजन के साथ एक बहुमॉडल भाषा मॉडल है। मॉडल में 27 अरब पैरामीटर हैं और पाठ प्रतिक्रियाओं को उत्पन्न करते समय पाठ्य जानकारी और छवियों दोनों को संसाधित कर सकते हैं। इसके 128,000-टोकन संदर्भ विंडो के लिए धन्यवाद, जेम्मा 3 27B स्मृति में डेटा की बड़ी मात्रा को बनाए रख सकता है, जो लंबे दस्तावेजों, बहु-चरण तर्क और जटिल संवादों के साथ काम करने के लिए विशेष रूप से महत्वपूर्ण है।
मॉडल को 14 ट्रिलियन टोकन पर प्रशिक्षित किया गया और 12 मार्च 2025 को जारी किया गया। खुले वजन डेवलपर्स को अपने स्वयं के अनुप्रयोगों में जेमा 3 27B को एकीकृत करने की अनुमति देते हैं, इसे विशिष्ट कार्यों के लिए ठीक-ट्यून करते हैं, और इसे तैनात करते हैं। पर उनका स्वयं का बुनियादी ढांचा। मॉडल कई भाषाओं के साथ काम करता है, इसे अंतरराष्ट्रीय परियोजनाओं के लिए उपयुक्त बनाता है।
जेमा 3 27B निर्दिष्टीकरण
| विशेषता | मूल्य |
|---|---|
| प्रकार | मल्टीमॉडल भाषा मॉडल |
| डेवलपर | गूगल |
| पैरामीटर | 27.0B |
| संदर्भ विंडो | 131.1K tokens |
| रिलीज़ की तारीख | मार्च 12, 2025 |
| लाइसेंस | मणि |
| पर प्रशिक्षित | 14.0T tokens |
| औसत स्कोर | 65.4% |
| समर्थित सुविधाएँ | समारोह कॉलिंग, संरचित आउटपुट, कोड निष्पादन, वेब सर्च, बैच इनफरेंस, ललित ट्यूनिंग |
किसके लिए जेमा 3 27B तंत्रिका नेटवर्क है?
डेवलपर्स और एमएल इंजीनियरों
जेमा 3 27B मुख्य रूप से डेवलपर्स के उद्देश्य से है जिन्हें एक शक्तिशाली ओपन सोर्स भाषा मॉडल की आवश्यकता है। ठीक ट्यूनिंग, कोड निष्पादन और फ़ंक्शन कॉलिंग के लिए समर्थन करने के लिए धन्यवाद, मॉडल को स्वचालन, डेटा प्रसंस्करण और बुद्धिमान सहायकों के निर्माण के लिए अनुप्रयोगों में एम्बेड किया जा सकता है। खुले वजन मॉडल को स्थानीय रूप से तैनात करने की अनुमति देते हैं, जो डेटा गोपनीयता आवश्यकताओं के साथ परियोजनाओं के लिए महत्वपूर्ण है।
शोधकर्ता और विश्लेषक
पाठ और दृश्य सूचना की बड़ी मात्रा के साथ काम करने वाले विशेषज्ञ दस्तावेज़ों को संक्षेप में प्रस्तुत करने, तथ्यों को निकालने, छवियों का विश्लेषण करने और तार्किक श्रृंखला बनाने के लिए मॉडल का उपयोग कर सकते हैं। 128K-token संदर्भ विंडो लंबी रिपोर्ट, वैज्ञानिक लेख और प्रसंस्करण की अनुमति देती है संदर्भ खोने के बिना पत्राचार
टीम निर्माण chatbots और सहायक
मॉडल संवाद प्रणालियों के निर्माण के लिए उपयुक्त है जो कई भाषाओं में काम करते हैं। छवियों को संसाधित करने की क्षमता मामलों का विस्तार करती है - एक बातचीत के भीतर चार्ट और आरेखों का विश्लेषण करने के लिए तस्वीरों का वर्णन करने से।
जेमा 3 27B तंत्रिका नेटवर्क का उपयोग कैसे करें?
वाया एपीआई
जेमा 3 27B पे-प्रति टोकन मूल्य निर्धारण के साथ एक एपीआई के माध्यम से उपलब्ध है। इनपुट प्रोसेसिंग लागत $0.11 प्रति 1 मिलियन टोकन, और उत्पादन उत्पादन लागत $0.20 प्रति 1 मिलियन टोकन। यह प्रारूप उन लोगों को सूट करता है जो अपने स्वयं के बुनियादी ढांचे का प्रबंधन नहीं करना चाहते हैं।
स्थानीय तैनाती
खुले वजन के लिए धन्यवाद, मॉडल को डाउनलोड किया जा सकता है और अपने खुद के हार्डवेयर पर चला सकता है। यह डेटा पर पूर्ण नियंत्रण प्रदान करता है और डेटा को ठीक करने की अनुमति देता है विशिष्ट कार्यों के लिए मॉडल। 27 बिलियन मापदंडों के साथ काम करने के लिए महत्वपूर्ण कंप्यूटिंग संसाधनों की आवश्यकता होती है, खासकर जब अधिकतम संदर्भ विंडो का उपयोग किया जाता है।
बैच प्रसंस्करण और ठीक ट्यूनिंग
मॉडल बैच inference का समर्थन करता है, जो बड़े डेटा सेट को संसाधित करने के लिए सुविधाजनक है। ललित ट्यूनिंग सुविधा एक विशिष्ट डोमेन, कॉर्पोरेट शैली या अद्वितीय उपयोग मामलों के लिए मॉडल के व्यवहार को अनुकूलित करना संभव बनाती है।
जेमा 3 27B की मुख्य विशेषताएं
बहुसंख्यक
जेमा 3 27B दोनों पाठ और छवियों को इनपुट के रूप में स्वीकार करता है। प्राप्त दृश्य आंकड़ों के आधार पर, मॉडल एक पाठ विवरण उत्पन्न करता है, छवि की सामग्री के बारे में जवाब देता है, या छवि विश्लेषण करता है। यह पूरी तरह से पाठ आधारित कार्यों से परे मॉडल के अनुप्रयोग का विस्तार करता है।
128K-token संदर्भ विंडो
एक बड़ी संदर्भ विंडो के लिए समर्थन मॉडल को स्मृति में लंबी बातचीत, बड़े दस्तावेज़ या बातचीत इतिहास को बनाए रखने की अनुमति देता है। यह विशेष रूप से मूल्यवान है जब बहु-खंड रिपोर्टों, कानूनी ग्रंथों, या व्यापक परामर्श का विश्लेषण किया जाता है।
समारोह कॉलिंग और संरचित आउटपुट
मॉडल बाहरी कार्यों को कॉल कर सकता है, इसे अनुमति देता है डेटाबेस, तीसरे पक्ष के एपीआई और स्वचालन उपकरण के साथ एकीकृत करने के लिए। संरचित आउटपुट एकीकरण को सरल बनाता है - मॉडल केवल फ्री-फॉर्म टेक्स्ट के बजाय एक निर्दिष्ट प्रारूप (JSON, टेबल) में डेटा वापस कर सकता है।
कोड निष्पादन और वेब खोज
जेमा 3 27B कोड निष्पादन का समर्थन करता है, जो प्रोग्रामिंग, डीबगिंग या डेटा विश्लेषण कार्यों के लिए उपयोगी है। वेब खोज क्षमता मॉडल को उत्तर तैयार करते समय इंटरनेट से अद्यतन जानकारी तक पहुंचने की अनुमति देती है।
जेमा 3 27B के लाभ
खुले वजन
मॉडल के मुख्य लाभों में से एक इसका खुला वजन है। डेवलपर्स एक विशिष्ट क्लाउड प्रदाता से बंधे बिना मॉडल को स्वतंत्र रूप से डाउनलोड, उपयोग और ठीक ट्यून कर सकते हैं। यह तैनाती और डेटा नियंत्रण में लचीलापन प्रदान करता है।
बहुभाषी और बहुसंख्यकता
मॉडल कई भाषाओं और प्रक्रियाओं छवियों के साथ काम करता है, इसे अंतरराष्ट्रीय परियोजनाओं और दृश्य सामग्री से जुड़े कार्यों के लिए एक बहुमुखी उपकरण बनाता है।
बड़े संदर्भ खिड़की
संदर्भ के 128,000 टोकन समान आकार के मॉडल के बीच उच्चतम आंकड़े में से एक है। यह मॉडल को लंबे ग्रंथों और जटिल संवादों के साथ प्रभावी ढंग से काम करने की अनुमति देता है, बिना सुसंगतता खोए।
जेमा 3 27B के नुकसान
उच्च संसाधन आवश्यकताओं
27 बिलियन मापदंडों के साथ मॉडल को स्थानीय तैनाती के लिए महत्वपूर्ण कंप्यूटिंग शक्ति की आवश्यकता होती है। प्रत्येक टीम के पास पूरी तरह से लोड किए गए संदर्भ विंडो के साथ स्वीकार्य अनुमान गति प्रदान करने में सक्षम हार्डवेयर नहीं है।
औसत कुल स्कोर 65.4%
संयुक्त बेंचमार्क के पार, मॉडल 65.4% का औसत परिणाम दिखाता है, जो कुछ बंद वाणिज्यिक विकल्पों की तुलना में कम है। कई परिदृश्यों में, इसका मतलब अतिरिक्त सूक्ष्म ट्यूनिंग की आवश्यकता हो सकती है या अधिक प्रदर्शनकारी समाधानों का उपयोग किया जाना चाहिए।
जेमा लाइसेंस प्रतिबंध
मॉडल को रत्न लाइसेंस के तहत वितरित किया जाता है, जो वाणिज्यिक उपयोग, ठीक ट्यूनिंग और वितरण पर कुछ शर्तों को लागू करता है। इसे व्यावसायिक उत्पाद में एकीकृत करने से पहले आपको पूर्ण लाइसेंस पाठ की समीक्षा करनी चाहिए।
जेमा 3 27B क्या कार्य करता है?
सवाल जवाब देने और परामर्श
मॉडल सवाल उठाने वाली प्रणालियों के निर्माण के लिए उपयुक्त है जो संदर्भ के लिए संलग्न छवियों सहित विभिन्न भाषाओं में प्रश्नों को संभाल सकता है।
पाठ सारांशीकरण
अपनी बड़ी संदर्भ खिड़की के लिए धन्यवाद, जेमा 3 27B लंबे दस्तावेज़ों, वैज्ञानिक लेखों को संपीड़ित कर सकता है, और मुख्य तथ्यों और तार्किक प्रवाह को संरक्षित करते समय संक्षिप्त, सार्थक सारांश में रिपोर्ट कर सकता है।
तार्किक तर्क और विश्लेषण
मॉडल उन कार्यों को संभालता है जिन्हें बहु-चरण तर्क की आवश्यकता होती है, प्रदान किए गए डेटा से निष्कर्ष निकालना और परिकल्पना का परीक्षण करना। यह विश्लेषण, अनुसंधान और शैक्षिक अनुप्रयोगों में उपयोगी है।
छवि समझ
जेम्मा 3 27B छवियों का विश्लेषण करता है: यह चित्रों में ऑब्जेक्ट्स, दृश्य और टेक्स्ट को पहचानता है और दृश्य सामग्री के बारे में जवाब देता है। यह परिदृश्यों को खोलता है जैसे कि फोटो, दस्तावेजों की जांच, या दृश्य हानि वाले लोगों की सहायता करना।
जेमा 3 27B मूल्य निर्धारण
मॉडल को एक फ्रीमियम मॉडल के तहत वितरित किया जाता है। एपीआई के माध्यम से पहुंच निम्नानुसार बिल है:
- इनपुट टोकन: $0.11 प्रति 1 मिलियन टोकन।
- आउटपुट टोकन: $ 0.20 प्रति 1 मिलियन टोकन।
स्थानीय रूप से खुले वजन का उपयोग करते समय, लागत में कंप्यूटिंग संसाधन (GPU / TPU), बिजली और बुनियादी ढांचा रखरखाव शामिल है।
जेमा 3 27B के लिए उपयोग की शर्तें
मॉडल को रत्न लाइसेंस के तहत वितरित किया जाता है। इसका मतलब यह है कि गूगल द्वारा स्थापित शर्तों के भीतर उपयोग, प्रतिलिपि, संशोधन और वितरण की अनुमति है। डेवलपर्स को वाणिज्यिक उपयोग या ठीक ट्यूनिंग से पहले आधिकारिक लाइसेंस पाठ की समीक्षा करने की आवश्यकता है। लाइसेंस कुछ क्षेत्रों में उपयोग पर प्रतिबंधों को निर्दिष्ट कर सकता है, निषेध आवश्यकताओं और व्युत्पन्न मॉडलों को वितरित करने के लिए नियम।
Gemma 3 27B की उपलब्धता
मॉडल 12 मार्च 2025 को जारी किया गया था। यह खुले वजन के साथ डाउनलोड करने के लिए उपलब्ध है, जिससे इसे अपने सर्वर और क्लाउड वातावरण में इस्तेमाल किया जा सकता है। इसके अलावा, जेमा 3 27B को एपीआई के माध्यम से इस मॉडल का समर्थन करने वाले प्रदाताओं से एक्सेस किया जा सकता है। मॉडल को वितरण के मामले में स्वतंत्र माना जाता है -बेसिक एक्सेस को सदस्यता खरीदने की आवश्यकता नहीं होती है, लेकिन एपीआई उपयोग को अलग से बिल किया जाता है।
कैसे जेमा 3 27B विकल्प से अलग है
जेमा 3 12B और जेमा 2 27B के साथ तुलना
छोटे जेम्मा 3 12 बी की तुलना में, 27 बिलियन-पैरामीटर संस्करण काफी अधिक सटीकता, गहरी संदर्भ समझ और पाठ और छवियों दोनों को संसाधित करने की क्षमता प्रदान करता है। नया संस्करण अपनी बहुसंख्यकता में जेमा 2 27B से अलग है (दूसरा संस्करण केवल पाठ के साथ काम किया) और एक बड़ा संदर्भ विंडो।
जेमिनी 1.5 फ्लैश और जेमिनी 2.0 फ्लैश से अंतर
गूगल के मिथुन मॉडल बंद कर दिए गए हैं और केवल क्लाउड एपीआई के माध्यम से उपलब्ध हैं। इसके विपरीत, जेमा 3 27B में खुले वजन होते हैं, जिससे स्थानीय रूप से और ठीक-ट्यून को तैनात किया जा सकता है। उसी समय, मिथुन वाणिज्यिक मॉडल अक्सर उच्च बेंचमार्क परिणाम प्राप्त करते हैं, लेकिन वे नियंत्रण और लचीलेपन के समान स्तर की पेशकश नहीं करते हैं।
GPT OSS 20B से अंतर
GPT OSS 20B एक अन्य ओपन-वेट मॉडल है, लेकिन यह आकार में छोटा है (20 बिलियन पैरामीटर बनाम 27 बिलियन) बहुसंख्यकता का समर्थन नहीं करता है, और इसमें मामूली संदर्भ विंडो है। जेमा 3 27B ने बड़ी संख्या में मापदंडों, छवि प्रसंस्करण क्षमता और फंक्शन कॉलिंग और कोड एक्सीक्यूशन जैसे उन्नत सुविधाओं के लिए समर्थन के लिए धन्यवाद जीता।
निष्कर्ष
जेमा 3 27B गूगल से 27 अरब मापदंडों, खुले वजन और 128,000 टोकन संदर्भ विंडो के साथ एक बहुमॉडल भाषा मॉडल है। यह कार्यों की एक विस्तृत श्रृंखला के लिए उपयुक्त है: चैटबॉट के निर्माण और छवि विश्लेषण और तार्किक तर्क के लिए पाठों को संक्षेप में प्रस्तुत करने से। मॉडल एक भुगतान एपीआई के माध्यम से और स्थानीय तैनाती के लिए दोनों उपलब्ध है, जिससे डेवलपर्स को बुनियादी ढांचे का चयन करने में लचीलापन मिलता है। सामान्य बेंचमार्क में उच्च कंप्यूटिंग संसाधन आवश्यकताओं और औसत परिणामों के बावजूद, जेमा 3 27B ओपन मल्टीमॉडल मॉडल सेगमेंट में सबसे कार्यात्मक समाधानों में से एक है।