Artificial Analysis Intelligence Index पर Grok 4.6 का स्कोर 61

Grok 4.6, xAI का नवीनतम large language model, कम token costs और कई Anthropic तथा OpenAI plans की तुलना में अधिक usage limits के साथ near-frontier coding और reasoning performance देने के लिए ध्यान आकर्षित कर रहा है, खासकर Cursor जैसे tools के माध्यम से bundled होने पर। Commenters इसकी खूबियों—speed, संक्षिप्त communication style, और उदार subsidized access—को जटिल tasks पर Anthropic Fable 5 और GPT‑5.6 जैसे शीर्ष-tier models से पीछे रहने की रिपोर्टों के साथ तौलते हैं, साथ ही Musk की politics, aggressive data center build-out, carbon impact, और यह सवाल भी उठाते हैं कि क्या एक तीसरा या चौथा closed frontier model, तेज़ी से शक्तिशाली open-weight alternatives से दबते बाजार में, एक व्यवहार्य niche बनाए रख सकता है।

मॉडल गुणवत्ता और बेंचमार्क

  • कई लोग Grok 4.5 को “decent frontier” मानते हैं, लेकिन इसे Fable/Opus 5/Sol/GPT‑5.6 जैसे शीर्ष मॉडलों से नीचे रखते हैं; कुछ लोग अनुमान लगाते हैं कि 4.6 व्यवहार में Opus 4.8 के आसपास है, लेकिन फिर भी नवीनतम Anthropic/OpenAI स्तरों से नीचे है।
  • कई दैनिक उपयोगकर्ता बताते हैं कि Grok 4.5/4.6 तेज़, संक्षिप्त, और इंजीनियरिंग के लिए “good enough” है; उन्हें छोटे उत्तर और सरल, मानव-जैसे कोड पसंद आते हैं।
  • अन्य लोग कहते हैं कि इसकी गति आंशिक रूप से भ्रम है: यह अक्सर किसी कार्य का सिर्फ़ छोटा हिस्सा ही संभालता है और समय से पहले दावा कर देता है कि काम पूरा हो गया, जबकि आउटपुट Anthropic/OpenAI से कमजोर होते हैं।
  • Kimi K3 की तुलना में, Grok को आम तौर पर बेहतर और सस्ता बताया जाता है; कुछ कोडिंग कार्यों में Gemini से बेहतर, लेकिन कुल मिलाकर सर्वश्रेष्ठ नहीं।
  • 4.6 को 4.5 की तुलना में अधिक tool-use/verification-उन्मुख (जैसे UI का screenshot लेना) बताया गया है, लेकिन अब यह उतना “blazing fast” नहीं रहा।

मूल्य निर्धारण, टोकन दक्षता, और सदस्यताएँ

  • Grok को बार-बार बहुत किफायती बताया गया है, खासकर Cursor और xAI subscriptions के ज़रिए। कुछ लोगों को लगता है कि $30 की sub ने कहीं और प्रति-टोकन खर्च में सैकड़ों से हज़ारों डॉलर तक की जगह ले ली।
  • थ्रेड में उद्धृत benchmarks का दावा है कि Grok का token use हाल के OpenAI मॉडलों के बराबर है और per-token cost कम है; अन्य लोग जवाब देते हैं कि GPT अब भी सबसे reasoning-efficient है।
  • Grok 4.5 की कीमत $2 input / $6 output बताई गई है, जबकि Opus 4.8 $5 / $25 है। Cache read price कथित रूप से 4.6 में $0.30 से बढ़कर $0.50 हो गई, जिसे उपयोगकर्ता agentic coding costs पर भारी प्रभाव वाला बताते हैं।
  • Cursor: उदार Grok/Composer usage के साथ लगभग $20 के non-first-party credits; कुछ लोग इसे coding के लिए Grok इस्तेमाल करने का सबसे सस्ता तरीका कहते हैं।
  • OpenAI का subscription “reset” behavior उन लोगों को परेशान करता है जो usage को बजट में रखना चाहते हैं; कुछ लोग उसी frontier model के पीछे जाते हैं जिसे उस समय सबसे अधिक subsidized किया जा रहा हो।

उपयोग के पैटर्न और workflows

  • “कोई Grok नहीं इस्तेमाल करता” वाले दावों के विपरीत, कई commenters इसे primary coding model के रूप में या multi-model workflows के हिस्से के रूप में इस्तेमाल करते हैं (जैसे planning के लिए Fable, तेज़ iteration/debugging के लिए Grok)।
  • इसे Cursor, Grok CLI/Build, Copilot (ऐतिहासिक रूप से), और custom harnesses (OpenCode, Pi coding agent) में इस्तेमाल किया जाता है जो tasks को अलग-अलग models तक route करते हैं।
  • कुछ teams रिपोर्ट करती हैं कि उनके overall AI spend पर लगभग कोई cap नहीं है, फिर भी वे style और speed के कारण Grok चुनते हैं, सिर्फ़ price के कारण नहीं।
  • security work के लिए, उपयोगकर्ताओं का कहना है कि Grok और कुछ Chinese models vulnerability analysis और PoCs करेंगे, जबकि Anthropic/OpenAI उन्हें block या भारी sanitization करते हैं।

नैतिकता, राजनीति, और boycotts

  • एक बड़ा समूह Grok/xAI को बिल्कुल इस्तेमाल नहीं करता, और इसके कारण बताता है:
    • मालिक के कथित Nazi salutes, चुनावी हस्तक्षेप, कई देशों में far-right समर्थन, foreign aid और Ukraine के इर्द-गिर्द व्यवहार, और सामान्य governance style।
    • चिंता कि Grok के system prompts और राजनीतिक झुकाव सीधे उन्हीं विचारों से आकार लेते हैं।
  • अन्य लोग तर्क देते हैं कि लगभग सभी धनी लोग चुनावों में “interfere” करते हैं, कि boycotts असंगत हैं यदि कोई Chinese या अन्य विवादास्पद providers भी इस्तेमाल करता है, या कि वे product quality को owner politics से अलग रखते हैं।
  • कुछ लोग Grok को इसलिए पसंद करते हैं क्योंकि उनका मानना है कि OpenAI/Anthropic progressive झुकाव रखते हैं, और वे दावा करते हैं कि Grok “center” के करीब है, जबकि अन्य लोग सवाल करते हैं कि “center” का मतलब ही क्या है।

व्यापार रणनीति, compute, और प्रतिस्पर्धा

  • xAI/SpaceX द्वारा Grok में भारी निवेश करने के प्रस्तावित कारण, जबकि incumbents मज़बूत हैं:
    • surplus GPU capacity का monetization, उसे अन्य labs को किराए पर देकर, जबकि demand बढ़ाई जाए।
    • internal use के लिए vertical integration (जैसे Tesla, robots, multi-planetary ambitions) और OpenAI/Anthropic पर निर्भरता से बचना।
    • यह दांव कि वे बड़े compute, capital, और training data (जिसमें Cursor का dataset भी शामिल है) के साथ frontier तक पहुँच सकते हैं या उसे पार कर सकते हैं।
    • दार्शनिक प्रेरणाएँ और राजनीतिक रूप से अलग model family की इच्छा।
  • संशयवादी business case पर सवाल उठाते हैं: consumer और enterprise markets पहले से ही dominant हैं, open-weight models low end को दबा रहे हैं, और संभवतः आगे consolidation होगी। कुछ इसे FOMO या investor-driven bubble behavior कहते हैं।
  • infrastructure पर बहस:
    • xAI/SpaceX की datacenters own करने और अपने chips plan करने के लिए प्रशंसा की जाती है, जिससे potentially cheaper tokens मिल सकते हैं।
    • अन्य लोग chip-fab timelines पर संदेह करते हैं (खासकर EUV/FEL approaches), regulatory shortcuts (जैसे gas-turbine datacenters) पर ध्यान दिलाते हैं, और self-reported metrics की reliability पर सवाल उठाते हैं।

पर्यावरणीय और सहायक नोट्स

  • एक उद्धृत chart (Stanford HAI से, मीडिया रिपोर्ट के माध्यम से) Grok training को विशेष रूप से CO₂-intensive दिखाता है, portable gas generators के कारण, जिन्हें अन्य बड़े setups की तुलना में कम efficient बताया गया; कुछ लोग सामान्य रूप से AI carbon debates को overblown मानते हैं, लेकिन Grok के मामले में इसे सही मानते हैं।
  • Grok का Imagine 2.0 image/video generation कम गुणवत्ता वाला और “plastic-looking” बताया गया है।
  • कुछ उपयोगकर्ता ChatGPT की verbosity और Claude की rhetorical tics की तुलना में Grok की communication style की प्रशंसा करते हैं, और Anthropic, OpenAI, और Gemini के साथ creative tasks के लिए एक अलग “model family” होने को महत्व देते हैं।