HI ▾

अपने इमेज पाइपलाइन के लिए अनसेंस्ड टेक्स्ट API

API कुंजी पाएँ

प्रॉम्प्ट इंजीनियरिंग के लिए GPT इमेज API का उपयोग करने का अंतिम गाइड

एक GPT इमेज API आमतौर पर LLM का उपयोग करके Midjourney या Stable Diffusion जैसे इमेज मॉडल के लिए प्रॉम्प्ट जनरेट करने को संदर्भित करता है, न कि सीधे इमेज जनरेट करना। यह गाइड समझाता है कि बेहतर नियंत्रण, अनसेंस्ड कंटेंट और लागत दक्षता के लिए टेक्स्ट-जनरेशन APIs को अपने इमेज पाइपलाइन में कैसे इंटीग्रेट करें।

अपडेटेड

मुख्य बिंदु

  • LLMs टेक्स्ट प्रॉम्प्ट जनरेट करते हैं, जबकि अलग-अलग इंजन इमेज रेंडर करते हैं।
  • अनसेंस्ड मॉडल मनमाने मनाही के बिना वयस्क या निश कंटेंट की अनुमति देते हैं।
  • पे-एज़-यू-गो प्राइसिंग मासिक शुल्क और उपयोग न किए गए क्रेडिट की बर्बादी से बचाती है।
  • जब प्रॉम्प्ट को ट्रेनिंग के लिए उपयोग नहीं किया जाता है तो गोपनीयता बनाए रखी जाती है।

टेक्स्ट मॉडल के लिए 'GPT इमेज API' एक गलत नाम है

जब डेवलपर्स एक GPT इमेज API की तलाश करते हैं, तो वे अक्सर सेवा से एक छवि फ़ाइल की उम्मीद करते हैं। हालाँकि, इस नाम वाली अधिकांश सेवाएं वास्तव में टेक्स्ट-आधारित LLMs हैं जो प्रॉम्प्ट लिखने के लिए डिज़ाइन की गई हैं। ये मॉडल एक अवधारणा लेते हैं और विवरणपूर्ण टेक्स्ट आउटपुट करते हैं, जिसे बाद में DALL·E, Midjourney या Stable Diffusion जैसे इमेज जनरेटर में दिया जाता है।

यह भेद महत्वपूर्ण है क्योंकि टेक्स्ट मॉडल पिक्सेल हैंडल नहीं करता है। यह भाषा हैंडल करता है। प्रॉम्प्ट इंजीनियरिंग के लिए एक समर्पित टेक्स्ट API का उपयोग करने से आपको शैली, संरचना और लाइटिंग विवरण पर अधिक नियंत्रण मिलता है, बिना इमेज मॉडल की मूल प्रॉम्प्ट सिंटैक्स से सीमित हुए। टेक्स्ट API मानव इरादे और इमेज जनरेटर की आवश्यकताओं के बीच एक अनुवादक की तरह कार्य करता है।

उन पाइपलाइनों के लिए जिनमें उच्च मात्रा की आवश्यकता होती है, एक टेक्स्ट API हर अनुरोध को एक मल्टीमोडल मॉडल के माध्यम से भेजने की तुलना में सस्ता और तेज़ होता है। आप रेंडरिंग लागत से स्वतंत्र रूप से प्रॉम्प्ट टेक्स्ट पर इटरेट कर सकते हैं। इस चिंताओं का अलगात आपको रचनात्मकता और सटीकता के लिए टेक्स्ट जनरेशन को अनुकूलित करने की अनुमति देता है, जबकि इमेज रेंडरिंग का भारी काम विशेष ग्राफिक्स इंजनों को छोड़ देता है।

इमेज जनरेशन पाइपलाइन में LLM की भूमिका

LLMs आधुनिक इमेज पाइपलाइन में कई जगहों पर रचनात्मक इंजन के रूप में कार्य करते हैं। वे एक सरल उपयोगकर्ता विचार लेते हैं और इसे एक विस्तृत प्रॉम्प्ट में विस्तारित करते हैं जिसमें शैली संकेत, कैमरा एंगल, लाइटिंग स्थितियां और कलात्मक संदर्भ शामिल होते हैं। इस प्रक्रिया को प्रॉम्प्ट इंजीनियरिंग कहा जाता है, जो इमेज जनरेटरों से स्थिर परिणाम प्राप्त करने के लिए महत्वपूर्ण है।

  • प्रॉम्प्ट विस्तार: 'एक बिल्ली' को 'एक विंडोसिल पर बैठा एक फोटोरियलिस्टिक टैबी बिल्ली, गोल्डन आवर लाइटिंग, 85mm लेंस, शैलो डेप्थ ऑफ फील्ड' में बदलना।
  • स्टाइल ट्रांसफर: प्रॉम्प्ट टेक्स्ट पर 'ऑयल पेंटिंग', 'साइबरपंक' या 'वॉटरकलर' जैसे विशिष्ट कलात्मक शैलियों को लागू करना।
  • पैरामीटर फॉर्मेटिंग: प्राकृतिक भाषा के अनुरोधों को Stable Diffusion या Midjourney द्वारा आवश्यक विशिष्ट सिंटैक्स में बदलना, जैसे कि वेट पैरामीटर या नेगेटिव प्रॉम्प्ट्स जोड़ना।

LLM का उपयोग करके, आप अपने प्रॉम्प्ट की गुणवत्ता को मानकीकृत कर सकते हैं। मैनुअल प्रॉम्प्ट लेखन पर निर्भर रहने के बजाय, आप प्रक्रिया को स्वचालित कर सकते हैं, यह सुनिश्चित करते हुए कि हर इमेज अनुरोध में एक विस्तृत, अच्छी तरह से संरचित प्रॉम्प्ट हो। इससे ट्रायल-एंड-एरर की आवश्यकता कम हो जाती है और अंतिम इमेज जनरेशन की सफलता दर बढ़ जाती है।

वयस्क या रचनात्मक कंटेंट के लिए अनसेंस्ड मॉडल

मानक LLM अक्सर कंटेंट फिल्टर के कारण वयस्क, विवादास्पद या निश विषयों के लिए प्रॉम्प्ट जनरेट करने से इनकार कर देते हैं। विशिष्ट शैलियों में काम करने वाले क्रिएटर्स के लिए, यह एक बड़ी सीमा हो सकती है। एक अनसेंस्ड LLM मॉडल इन फिल्टरों को लागू नहीं करता है, जिससे आपको कानूनी वयस्क कंटेंट, फंतासी हिंसा या असाधारण कलात्मक शैलियों के लिए प्रॉम्प्ट जनरेट करने की अनुमति मिलती है बिना रुकावट के।

ये मॉडल कानूनी उपयोग के लिए बिना मनाही के जवाब देने के लिए ट्यून्ड किए गए हैं। ये GPT, Claude, Gemini, Grok या DeepSeek नहीं हैं। ये समर्पित GPU सर्वर पर होस्ट किए गए ओपन-वेट मॉडल हैं, जो विशेष रूप से रचनात्मक स्वतंत्रता के लिए डिज़ाइन किए गए हैं। एकमात्र कठोर सीमा जो हमेशा लागू होती है वह किशोरों के साथ यौन सामग्री की मनाही है।

एक अनसेंस्ड API का उपयोग करने से सुनिश्चित होता है कि आपकी पाइपलाइन आप जिस भी रचनात्मक दिशा का चयन करती है, उसे हैंडल कर सकती है। चाहे आप इरोटिक कला, डार्क फंतासी या प्रयोगात्मक डिज़ाइन के लिए प्रॉम्प्ट जनरेट कर रहे हों, मॉडल बिना सब्जेक्टिव कंटेंट पॉलिसी के आधार पर ब्लॉक किए बिना टेक्स्ट उत्पादित करेगा। यह उन वाणिज्यिक पाइपलाइन के लिए विशेष रूप से मूल्यवान है जहां कंटेंट विविधता मुख्य है।

प्रॉम्प्ट जनरेशन बनाम सीधे इमेज जनरेशन

सीधे इमेज जनरेशन APIs, जैसे DALL·E या Midjourney, टेक्स्ट-टू-टेक्स्ट और टेक्स्ट-टू-इमेज प्रक्रियाओं को एक ही सेवा में जोड़ते हैं। जबकि सुविधाजनक, वे अक्सर इमेज आउटपुट साइज और रिज़ॉल्यूशन के आधार पर चार्ज करते हैं, जो उच्च-वॉल्यूम उपयोग के लिए महंगा हो सकता है। इसके अतिरिक्त, इन सेवाओं में कठोर कंटेंट फिल्टर हो सकते हैं जो आपकी रचनात्मक विकल्पों को सीमित कर सकते हैं।

इसके विपरीत, एक प्रॉम्प्ट जनरेशन API केवल टेक्स्ट पर केंद्रित है। इससे आपको केवल टेक्स्ट टोकन के लिए भुगतान करने की अनुमति मिलती है, जो इमेज जनरेशन टोकन की तुलना में काफी सस्ते हैं। आप फिर उत्पन्न प्रॉम्प्ट को किसी भी इमेज जनरेटर को भेज सकते हैं जिसका आप पसंद करते हैं, जिससे आपको लागत या गुणवत्ता के आधार पर इंजनों को बदलने की लचीलापन मिलता है।

यह दृष्टिकोण रचनात्मक लेखन को रेंडरिंग से अलग भी करता है। यदि आप एकल इमेज के लिए कई प्रॉम्प्ट वैरिएशन टेस्ट करना चाहते हैं, तो आप टेक्स्ट API का उपयोग करके इसे तेजी से और सस्ते में कर सकते हैं। केवल तभी जब आपके पास सबसे अच्छा प्रॉम्प्ट हो, तभी आप इमेज जनरेशन के लिए भुगतान करते हैं। यह अनुकूलन कुल लागत को कम करता है और प्रयोगात्मक गति बढ़ाता है।

टेक्स्ट APIs को इमेज जनरेटरों के साथ इंटीग्रेट करना

एक टेक्स्ट API को इमेज जनरेटर के साथ इंटीग्रेट करने में एक सरल वर्कफ्लो शामिल है: LLM प्रॉम्प्ट जनरेट करता है, और इमेज API इसे रेंडर करता है। इसे स्क्रिप्ट्स या नो-कोड टूल्स का उपयोग करके स्वचालित किया जा सकता है। टेक्स्ट API मानक OpenAI-कम्पैटिबल फॉर्मेट का उपयोग करता है, जिससे इसे मौजूदा SDKs के साथ आसानी से इंटीग्रेट किया जा सकता है।

इंटीग्रेट करने के लिए, आपको बेस URL को अपने टेक्स्ट API प्रदाता पर सेट करने और उचित API कुंजी का उपयोग करने की आवश्यकता है। मॉडल ID आमतौर पर 'uncensored' होती है। आप रियल-टाइम प्रॉम्प्ट जनरेशन के लिए स्ट्रीमिंग (SSE) या बैच प्रोसेसिंग के लिए स्टैंडर्ड रिस्पॉन्स का उपयोग कर सकते हैं। टूल कॉलिंग समर्थित है, जिससे आप आउटपुट को JSON में संरचित कर सकते हैं ताकि आपका इमेज जनरेटर इसे आसानी से पार्स कर सके।

यहाँ बताया गया है कि आप एक अनुरोध को कैसे संरचित कर सकते हैं:

from openai import OpenAI

client = OpenAI(base_url="https://api.imagegenapi.com/v1", api_key="YOUR_KEY")

resp = client.chat.completions.create(
    model="uncensored",
    messages=[{"role": "user", "content": "Summarise this thread without softening it."}],
)
print(resp.choices[0].message.content)

कुंजी टेक्स्ट API को एक प्रॉम्प्ट ऑप्टिमाइजर के रूप में मानना है। आप LLM को आपकी विशिष्ट इमेज जनरेटर द्वारा आवश्यक शैली या फॉर्मेट पर मार्गदर्शन करने के लिए सिस्टम निर्देश जोड़ सकते हैं। उदाहरण के लिए, आप इसे Midjourney सिंटैक्स या Stable Diffusion पैरामीटर का उपयोग करने के लिए निर्देशित कर सकते हैं। यह सुनिश्चित करता है कि आउटपुट आगे संपादन के बिना तुरंत उपयोग के लिए तैयार है।

लंबे प्रॉम्प्ट के लिए कॉन्टेक्स्ट विंडो हैंडल करना

कॉन्टेक्स्ट विंडो निर्धारित करते हैं कि LLM एकल अनुरोध में कितनी जानकारी प्रोसेस कर सकता है। हमारी API एक 100,000-टोकन कॉन्टेक्स्ट विंडो प्रदान करती है, जो अधिकांश प्रॉम्प्ट इंजीनियरिंग कार्यों के लिए पर्याप्त है। इससे आपको विस्तृत पृष्ठभूमि जानकारी, शैली गाइड या प्रॉम्प्ट में कई उदाहरण प्रदान करने की अनुमति मिलती है।

एक बड़ी कॉन्टेक्स्ट विंडो उन जटिल प्रोजेक्टों के लिए उपयोगी है जहां आप चाहते हैं कि LLM जनरेशन प्रक्रिया के दौरान विशिष्ट प्रतिबंधों या शैलियों को याद रखे। उदाहरण के लिए, आप किरदार विवरण की एक सूत्र प्रदान कर सकते हैं और LLM से अनुरोध कर सकते हैं कि वे अलग-अलग दृश्यों में स्थिरता बनाए रखते हुए प्रॉम्प्ट जनरेट करें।

यदि आपके उपयोग मामले में और अधिक कॉन्टेक्स्ट की आवश्यकता होती है, तो आप अनुरोध को कई कॉल में विभाजित कर सकते हैं या एक सारांश चरण का उपयोग कर सकते हैं। हालांकि, अधिकांश इमेज जनरेशन पाइपलाइन के लिए, 100k टोकन विस्तृत प्रॉम्प्ट, नेगेटिव प्रॉम्प्ट और शैली संदर्भों को हैंडल करने के लिए सीमाओं को हिट किए बिना काफी से अधिक है।

हाई-वॉल्यूम पाइपलाइन के लिए लागत प्रभावी स्केलिंग

अपनी इमेज पाइपलाइन को स्केल करने के लिए एक लागत प्रभावी टेक्स्ट API की आवश्यकता होती है। हमारी प्राइसिंग स्पष्ट है: $0.25 प्रति 1M इनपुट टोकन और $1.00 प्रति 1M आउटपुट टोकन। कोई मासिक शुल्क या सब्सक्रिप्शन नहीं है, और प्रीपेड क्रेडिट कभी समाप्त नहीं होता। यह पे-एज़-यू-गो मॉडल वेरिएबल डिमांड वाले प्रोजेक्टों के लिए आदर्श है।

आप क्रिप्टो (USDT या USDC) का उपयोग करके न्यूनतम $10 के साथ अपने खाते को टॉप-अप कर सकते हैं। बड़े टॉप-अप के लिए बोनस क्रेडिट उपलब्ध हैं: $50 के लिए +5% और $100 के लिए +10%। यह हाई-वॉल्यूम उपयोग को और भी सस्ता बनाता है।

तुलना के लिए, मानक LLM अक्सर प्रति टोकन उच्च दरें चार्ज करते हैं। एक अनसेंस्ड, समर्पित टेक्स्ट API का उपयोग करके, आप अपनी टेक्स्ट जनरेशन लागत को काफी कम कर सकते हैं। इससे आपको अपनी बजट का अधिक हिस्सा इमेज जनरेशन पर आवंटित करने की अनुमति मिलती है, जो आमतौर पर पाइपलाइन का अधिक महंगा हिस्सा होता है।

गोपनीयता: अपने प्रॉम्प्ट को निजी रखना

रचनात्मक कार्य के लिए LLM का उपयोग करते समय, गोपनीयता महत्वपूर्ण है। हमारी API आपके प्रॉम्प्ट को ट्रेनिंग के लिए उपयोग नहीं करती है। आपका डेटा निजी रहता है, और आप बिना चिंता किए कंटेंट जनरेट कर सकते हैं कि इसे अन्य मॉडल को बेहतर बनाने के लिए उपयोग नहीं किया जाएगा। यह उन वाणिज्यिक प्रोजेक्टों के लिए महत्वपूर्ण है जहां प्रॉम्प्ट शैली या कंटेंट प्रोप्राइटरी हो सकता है।

साइन अप करना सरल है: आपको केवल एक ईमेल और पासवर्ड की आवश्यकता है। ट्रायल क्रेडिट के लिए फोन नंबर या क्रेडिट कार्ड की आवश्यकता नहीं है, जो $0.50 है और 7 दिनों के लिए वैध है। आप साइन अप के तुरंत बाद अपनी API कुंजी जनरेट कर सकते हैं।

प्रत्येक खाते में एक API कुंजी होती है, जिसे किसी भी समय पुनः जनरेट किया जा सकता है। यदि एक कुंजी संक्रमित हो जाती है, तो आप इसे तुरंत रद्द कर सकते हैं। यह सुनिश्चित करता है कि आपकी पाइपलाइन सुरक्षित रहती है और केवल अधिकृत अनुरोध प्रोसेस किए जाते हैं। प्रति कुंजी प्रति मिनट 300 अनुरोध की सीमा भी दुरुपयोग को रोकने और स्थिर प्रदर्शन को सुनिश्चित करने में मदद करती है।

प्रश्न और उत्तर

क्या अनसेंस्ड मॉडल GPT है?

नहीं। मॉडल एक ओपन-वेट मॉडल है जो हमारे अपने GPU सर्वर पर चलाया जाता है। यह GPT, Claude, Gemini, Grok या DeepSeek नहीं है। इसे विशेष रूप से बिना सेंसर टेक्स्ट जनरेशन के लिए ट्यून्ड किया गया है।

क्या API छवियाँ जनरेट करता है?

नहीं। API एक केवल-टेक्स्ट चैट-कम्प्लीशन्स सेवा है। यह टेक्स्ट प्रॉम्प्ट जनरेट करता है जिन्हें आप फिर Midjourney या Stable Diffusion जैसी इमेज जनरेटर को भेजते हैं।

API के साथ शुरुआत कैसे करें?

अपनी API कुंजी प्राप्त करने के लिए ईमेल और पासवर्ड के साथ साइन अप करें। आपको 7 दिनों के लिए वैध $0.50 का मुफ़्त ट्रायल क्रेडिट प्राप्त होता है। शुरुआत करने के लिए क्रेडिट कार्ड की आवश्यकता नहीं है। फिर आप किसी भी OpenAI-कम्पैटिबल SDK के साथ कुंजी का उपयोग कर सकते हैं।

API के लिए मूल्य निर्धारण क्या है?

API का मूल्य $0.25 प्रति 1M इनपुट टोकन और $1.00 प्रति 1M आउटपुट टोकन है। कोई मासिक शुल्क नहीं है, और प्रीपेड क्रेडिट कभी समाप्त नहीं होता। टॉप-अप $10 से शुरू होता है।

आपकी कुंजी बस एक फ़ॉर्म दूर है

एक खाता बनाएं, कुंजी कॉपी करें, बेस URL बदलें। सेटअप यही है।

API कुंजी पाएँ