Grok 4.6 का परिचय
आज हम SpaceXAI के साथ मिलकर Grok 4.6 जारी कर रहे हैं।
Grok 4.6, Grok 4.5 पर आधारित है और इसमें लंबे समय तक चलने वाले एजेंट्स तथा अधिक महत्वाकांक्षी इंटरैक्टिव और विज़ुअल कार्यों पर विशेष ध्यान दिया गया है। यह कई चरणों वाले जटिल कार्यों को पूरा करने में सक्षम है—चाहे किसी विषय पर अनुसंधान करना हो, जानकारी का विश्लेषण करना हो, किसी कोडबेस पर काम करना हो, या किसी विचार को एक परिष्कृत ऐप या कार्य आर्टिफ़ैक्ट में बदलना हो।
Grok 4.6 कई एजेंटिक कोडिंग और नॉलेज वर्क बेंचमार्क में अत्याधुनिक इंटेलिजेंस हासिल करता है। यह Artificial Analysis Intelligence Index पर GPT-5.6 Sol के बराबर है, जो नौ बेंचमार्क का संयुक्त स्कोर है।

Grok 4.6 आज Cherri Code और Grok Build में उपलब्ध है। पहले सप्ताह के लिए हम Cherri Code और Grok Build में 2x शामिल उपयोग दे रहे हैं।
Grok 4.6 का प्रशिक्षण
Grok 4.6 को Grok 4.5 की तुलना में अधिक लंबा अनुपूरक प्रशिक्षण दिया गया। इसमें तर्क और उन्नत तकनीकी अवधारणाओं के लिए क्यूरेट किया गया मॉडल-जनित डेटा, उच्च-गुणवत्ता वाला इंजीनियरिंग डेटा, और एक बेहतर ऑप्टिमाइज़र व प्रशिक्षण रेसिपी शामिल थे। इससे बाद के SFT और RL चरणों के लिए अधिक मज़बूत आधार तैयार हुआ।
इसके बाद हमने तर्क के विभिन्न प्रयास स्तरों, एजेंट हार्नेस और STEM, सॉफ़्टवेयर इंजीनियरिंग व नॉलेज वर्क जैसे डोमेन में SFT ट्रैजेक्टरीज़ को फिर से जनरेट करने के लिए Grok 4.5 का उपयोग किया। हमने मॉडल-आधारित जाँचों की मदद से समस्याग्रस्त ट्रेस हटा दिए। परिणामी SFT चेकपॉइंट मज़बूत प्रदर्शन और बेहतर व्यवहार दिखाता है।
Grok 4.6 को एजेंटिक RL कार्यों की एक विस्तृत शृंखला पर प्रशिक्षित किया गया है, जिसमें नॉलेज वर्क, सामान्य कोडिंग और कर्नेल अनुकूलन, वेब विकास, कंप्यूटर-सहायित डिज़ाइन आदि के लिए डोमेन-विशिष्ट परिवेश शामिल हैं।
महत्वाकांक्षी विचारों को कार्यशील प्रोजेक्ट्स में बदलना
हमने Grok 4.6 का परीक्षण ऐसे प्रोजेक्ट्स पर किया, जो इसकी क्षमताओं की सीमा और कई चरणों में लगातार काम करने की इसकी योग्यता को परखने के लिए डिज़ाइन किए गए थे। हमने पाया कि यह मॉडल किसी व्यापक उत्पाद विचार को एक कार्यशील शुरुआती संस्करण में बदलने में विशेष रूप से सक्षम है। यह अपरिचित डोमेनों पर अनुसंधान कर सकता है, ऐप की संरचना तैयार कर सकता है, मुख्य इंटरैक्शन लागू कर सकता है और फ़ीडबैक के कई दौरों के दौरान परिणाम को लगातार बेहतर बना सकता है।
लंबी ट्रैजेक्टरीज़ में, हमने अधिक स्व-परीक्षण और सत्यापन भी देखा, जहाँ मॉडल आगे बढ़ने से पहले अपने काम की जाँच करता है।
Grok 4.6 विज़ुअल और इंटरैक्टिव प्रोजेक्ट्स पर Grok 4.5 की तुलना में अधिक मजबूत शुरुआती परिणाम देता है। किसी ठोस उत्पाद विचार के साथ, यह एक ही प्रयास में ऐप की संरचना और विज़ुअल भाषा स्थापित कर सकता है। इससे यह उन प्रोजेक्ट्स के लिए विशेष रूप से उपयोगी बन गया है, जहाँ अच्छे परिणाम तक पहुँचने का सबसे तेज़ मार्ग किसी ठोस चीज़ से शुरू करना और फिर लूप में उस पर पुनरावृत्ति करना था।
सेफ़्टी और क्षमताएँ
Grok 4.6 के सुरक्षा उपायों को मॉडल की क्षमताओं के अनुरूप बेहतर बनाया और कैलिब्रेट किया गया है।
हमारा सेफ़्टी स्टैक वैध उपयोग के मामलों में उपयोगिता और सुरक्षा को अधिकतम करने के लिए डिज़ाइन किया गया है, ताकि Grok 4.6 भेद्यता पैचिंग, इंजीनियरिंग डिज़ाइन चक्र को तेज़ करने और AI अनुसंधान को सशक्त बनाने जैसे डोमेन में उपयोगी और सुरक्षित हो सके।
हमारा सुरक्षा उपाय evaluation कार्य Grok 4.6 की विस्तृत क्षमताओं को दर्शाता है। इसमें क्षमताओं और सुरक्षा उपायों के कैलिब्रेशन के लिए अब तक का हमारा सबसे व्यापक प्री-डिप्लॉयमेंट टेस्टिंग सुइट, साथ ही व्यापक पोस्ट-डिप्लॉयमेंट तृतीय-पक्ष टेस्टिंग शामिल है।
Grok 4.6 के साथ शुरू करें
Grok 4.6 आज Cherri Code और Grok Build में उपलब्ध है। यह SpaceXAI API के साथ-साथ OpenRouter, Vercel और Cloudflare सहित पार्टनरों के ज़रिए भी उपलब्ध है।
मूल्य निर्धारण 6 प्रति मिलियन आउटपुट टोकन से शुरू होता है। एक तेज़ रूपांतर दोगुनी कीमत पर उपलब्ध है।
हम पहले सप्ताह के लिए Cherri Code और Grok Build में 2x उपयोग शामिल कर रहे हैं।