Bard के नवीनतम अपडेट: Gemini Pro तक वैश्विक पहुँच और इमेज जनरेशन
Google का Bard के लिए नवीनतम अपग्रेड, जिसमें Gemini Pro access और image generation जोड़े गए हैं, को OpenAI के GPT‑4 और अन्य प्रतिस्पर्धियों की तुलना में व्यापक रूप से निराशाजनक माना जा रहा है। टिप्पणीकार असमान उपलब्धता पर ध्यान देते हैं (खासकर कनाडा को बाहर रखना और यूरोप के बड़े हिस्से में image generation), कठोर censorship और safety filters, और असंगत व्यवहार, जो वास्तविक दुनिया की उपयोगिता को कम करता है। कई लोगों के अनुसार ये समस्याएँ Google की regulatory caution और आंतरिक असंतुलन के लक्षण हैं, जिससे यह सवाल उठता है कि शुरुआती AI research बढ़त होने के बावजूद क्या कंपनी large language models में पकड़ बना पाएगी।
उपलब्धता और “वैश्विक” रोलआउट
- कई टिप्पणीकारों का कहना है कि Google द्वारा पहुँच को “वैश्विक” कहने के बावजूद Bard अभी भी कनाडा में उपलब्ध नहीं है।
- Google support के अनुसार इमेज जनरेशन (Imagen 2) भी EEA, Switzerland, और UK में ब्लॉक है, जिससे उन उपयोगकर्ताओं में भ्रम पैदा हो रहा है जिन्हें फीचर की घोषणाएँ तो मिलीं, लेकिन वे उन्हें उपयोग नहीं कर सकते।
- व्याख्याओं पर बहस हुई: Canadian bills (C‑18, C‑27), Quebec का Bill 64, OpenAI की जाँच कर रहे privacy commissioners, “छोटा बाज़ार” तर्क, और सामान्य regulatory uncertainty।
- अन्य लोगों ने जवाब दिया कि Bard कहीं अधिक सख्त jurisdictions (EU) में चलता है, OpenAI/Microsoft कनाडा में काम करते हैं, और Google ने अपने कारण स्पष्ट रूप से नहीं बताए हैं।
मॉडल की गुणवत्ता बनाम GPT-4 / बेंचमार्क
- कई उपयोगकर्ताओं की रिपोर्ट है कि Bard/Gemini Pro reasoning, coding, और complex tasks में GPT‑4 से और अक्सर GPT‑3.5 से भी खराब प्रदर्शन करता है; hallucinations और “bureaucratic” जवाब आम शिकायतें हैं।
- कुछ लोगों को Bard creative writing या legal-style drafts के लिए बेहतर लगता है, और वे नोट करते हैं कि मुफ्त GPT‑3.5, paid GPT‑4 की तुलना में “कचरा” है।
- Gemini Pro की मजबूत LMsys leaderboard स्थिति को कुछ लोग संदेह की नज़र से देखते हैं, जिन्हें benchmark overfitting या special variants का शक है; अन्य इसे updated fine-tuning और internet access से जोड़ते हैं और एक ही leaderboard पर अत्यधिक निर्भर न रहने की चेतावनी देते हैं।
- Ultra (वह मॉडल जो सीधे GPT‑4 से प्रतिस्पर्धा करने के लिए है) अभी उपलब्ध नहीं है, इसलिए कुछ लोग अभी निर्णय सुरक्षित रखते हैं।
इमेज जनरेशन और सुरक्षा फ़िल्टर
- Bard की image generation की गति की सराहना की जाती है, लेकिन गुणवत्ता को अक्सर DALL‑E 3 और Midjourney से कमतर माना जाता है, जिसमें शैलीगत विविधता सीमित है और जटिल compositions में दिक्कत आती है।
- सुरक्षा फ़िल्टरों को असामान्य रूप से आक्रामक और असंगत बताया गया है: bikinis, sadness, knives, कुछ racial descriptors, और कभी-कभी किसी भी लोगों या जानवरों को भी ब्लॉक कर देना।
- उपयोगकर्ताओं ने समय के साथ बदलते व्यवहार की रिपोर्ट की है (कभी “images generate नहीं कर सकता,” कभी केवल बहुत सीमित ones)।
- Google के SynthID watermarking का उल्लेख किया गया है; सार्वजनिक detection tools की उपलब्धता स्पष्ट नहीं है।
सेंसरशिप, सुरक्षा, और UX
- Bard अक्सर tasks से इनकार कर देता है (legal drafting, API code, profanity के साथ translations, technical torque tables), safety, liability, या policy का हवाला देते हुए।
- कई लोग इसे प्रतिस्पर्धियों की तुलना में अधिक कठोर मानते हैं; अन्य लोग Bing और GPT‑3.5 में भी ऐसी ही समस्याओं की ओर इशारा करते हैं।
- transparent model-version indicators और कम भ्रमित करने वाले rollouts (A/B testing, staged releases) की माँग आम है।
Google की रणनीति और प्रतिस्पर्धी स्थिति
- टिप्पणीकार बहस करते हैं कि क्या Google की देरी mismanagement, अपने search/ads business को बाधित करने के डर, या legal/reputational risk tolerance में अधिक सावधानी के कारण है।
- कुछ लोग उपयोगकर्ताओं के GPT‑4/Perplexity/Bing की ओर जाने के साथ long-term decline की भविष्यवाणी करते हैं; अन्य लोग Google के scale, infrastructure, और cautious approach को तर्कसंगत लेकिन धीमा मानते हैं।