लेख निर्देशिका
मैं कुछ दिन पहले एक निजी प्रोजेक्ट पर काम कर रहा था, और मैं एक चीज़ बनाना चाहता था...AIसहायक को बड़े मॉडल कॉल करने की आवश्यकता है। जब मैंने कीमत के बारे में पूछा, तो मुझे आश्चर्य हुआ, GPT-4o को किए गए प्रत्येक कॉल की कीमत कुछ सेंट ही है। यदि हमारा प्रोजेक्ट वास्तव में चलता है, तो केवल API शुल्क ही प्रति माह कई हज़ार डॉलर तक पहुंच जाएगा।
हमने सोचा कि क्या कोई सस्ता तरीका है।
फिर हमें क्लाउडफ्लेयर वर्कर्स एआई के बारे में पता चला। हम पहले से जानते थे कि क्लाउडफ्लेयर एआई इन्फरेंस में शामिल है, लेकिन हमने इसे गंभीरता से नहीं लिया, यह सोचकर कि बड़ी कंपनियां अपने उत्पादों के लिए शुल्क लेती होंगी। लेकिन पता चला, वाह! वे हर दिन 10000 न्यूरॉन्स मुफ्त में दे रहे हैं।
10000 न्यूरॉन्स का क्या मतलब है? इसका मतलब है लगभग हर दिन कुछ सौ संवाद या कुछ सौ इमेज जनरेशन सेशन। एक व्यक्ति के लिए इतने न्यूरॉन्स के साथ प्रयोग करना काफी है।
मैं बहुत उत्साहित हो गया और तुरंत इस पर शोध करना शुरू कर दिया।
क्लाउडफ्लेयर वर्कर्स एआई क्या है?

क्लाउडफ्लेयर वर्कर्स एआई, खैर, मुझे लगता है कि यह...पोजिशनिंगयह वाकई दिलचस्प है। यह सिर्फ एक साधारण मॉडल प्रदाता नहीं है; यह क्लाउडफ्लेयर के वैश्विक एज नेटवर्क पर चलने वाला एक एआई इन्फरेंस प्लेटफॉर्म है। 300 से अधिक शहरों में एज नोड्स के साथ, यह उपयोगकर्ताओं के बेहद करीब है।
ज़रा सोचिए: जब आप OpenAI के API का इस्तेमाल करते हैं, तो अनुरोध पहले अमेरिका जाता है, वहाँ प्रोसेस होता है और फिर वापस आता है, जिसमें तीन से चार सौ मिलीसेकंड का समय लगता है। दूसरी ओर, Cloudflare एक CDN प्रदाता है जिसके नोड्स पूरी दुनिया में फैले हुए हैं। आप कहीं भी हों, यह मॉडल को सबसे नज़दीकी नोड पर चलाता है।
सामान्य प्रतिक्रिया समय 100 मिलीसेकंड से कम है। यह अंतर उपयोगकर्ता को स्पष्ट रूप से दिखाई देता है।
इसकी सबसे खास बात यह है कि इसका कोल्ड स्टार्ट मिलीसेकंड में होता है और यह अपने आप ही स्पीड को एडजस्ट कर लेता है। अचानक ट्रैफिक बढ़ने पर भी यह धीमा नहीं पड़ता, जबकि कुछ प्लेटफॉर्म रात के 3 बजे जब कोई इस्तेमाल नहीं कर रहा होता है तब तो बहुत तेज चलते हैं, लेकिन दिन के व्यस्त समय में पूरी तरह क्रैश हो जाते हैं।
50 से अधिक मॉडल, सभी परिदृश्यों को कवर करते हुए
कई समर्थित मॉडल भी हैं; जून 2026 तक, इनकी संख्या पहले से ही 50 से अधिक हो चुकी है।
टेक्स्ट आधारित संवाद के लिए, Llama 3, Llama 4, Mistral, GLM, Qwen, Gemma और Deepseek-r1 उपलब्ध हैं। इमेज जनरेशन के लिए Stable Diffusion, FLUX और Pixverse मौजूद हैं। स्पीच के लिए, स्पीच-टू-टेक्स्ट के लिए Whisper, टेक्स्ट-टू-स्पीच के लिए TTS और वीडियो जनरेशन की सुविधा भी उपलब्ध है।
इसके अलावा, इसका API बेहद सरल और सुव्यवस्थित तरीके से डिज़ाइन किया गया है। चाहे कोई भी मॉडल इस्तेमाल किया जाए, यह एक एकीकृत इंटरफ़ेस का उपयोग करता है; आपको केवल मॉडल का नाम बदलना होता है।
env.AI.run(“मॉडल नाम”, {…})
कोड की सिर्फ एक लाइन से मॉडल को बदलना बहुत सुविधाजनक है।
बेहद किफायती कीमत, उदार मुफ्त क्रेडिट सीमा
मैंने मूल्य निर्धारण भी कर लिया है। मुफ़्त दैनिक भत्ता 10000 न्यूरॉन्स है, जो व्यक्तिगत प्रयोग के लिए पर्याप्त से अधिक है। यदि आप भुगतान करना चाहते हैं, तो यह प्रति 1000 न्यूरॉन्स $0.011 है, जो OpenAI से 60% से 90% तक सस्ता है। साथ ही, इसका बिल न्यूरॉन्स के आधार पर लिया जाता है, टोकन के आधार पर नहीं, जिससे यह छोटे वार्तालापों के लिए अधिक लागत प्रभावी हो जाता है।
सच कहूँ तो, मुझे लगता है कि यह बिलिंग विधि काफी उचित है। आप जितने न्यूरॉन्स खर्च करते हैं, वह इस बात पर निर्भर करता है कि आप एक साधारण बातचीत कर रहे हैं या बहुत लंबी बातचीत, लेकिन टोकन-आधारित बिलिंग की तुलना में यह अंतर उतना अधिक नहीं है।
इस बिंदु पर, आप सोच रहे होंगे कि वास्तव में इसका उपयोग कैसे किया जाता है?
मैंने खुद इस प्रक्रिया से गुजरकर देखा है, चलिए मैं आपको इसके बारे में बताता हूँ।
पंजीकरण करें और एपीआई टोकन बनाएं
पहला चरण क्लाउडफ्लेयर खाता पंजीकृत करना है। यदि आपके पास पहले से खाता है, तो बस लॉग इन करें। यदि नहीं, तो पंजीकरण आसान है; बस एक ईमेल पता भरें और एक पासवर्ड सेट करें।
लॉग इन करने के बाद, बाईं ओर के मेनू में AI पर क्लिक करें, फिर Workers AI पर क्लिक करें।

अंदर जाने पर आपको एपीआई टोकन बनाने का बटन दिखाई देगा। टोकन जनरेट करने के लिए उस पर क्लिक करें।

ध्यान देने योग्य एक बात: जनरेट किया गया टोकन केवल खाते बनाते समय ही दिखाई देगा, इसलिए इसे सहेज कर रखें। पेज आपको एक खाता आईडी भी देगा; आपको बाद में इन दोनों की आवश्यकता होगी।

सेव करने के बाद, आपको पेज के नीचे एक उपयोग का उदाहरण दिखाई देगा, जो कर्ल कमांड है। बस इसे अपने अकाउंट आईडी और एपीआईकी से बदल दें। कमांड इस प्रकार दिखती है:
curl \
https://api.cloudflare.com/client/v4/accounts/账户ID/ai/run/@cf/模型ID \
-H "Authorization: Bearer 刚才生成的APIKEY" \
-d '{"messages":[{"role":"system","content":"You are a friendly assistant that helps write stories"},{"role":"user","content":"Write a short story about a llama that goes on a journey to find an orange cloud"}]}'उपलब्ध मॉडलों की सूची देखें
फिर सवाल उठता है: मॉडल आईडी कहां मिलेगी?
वर्कर्स एआई पेज के दाईं ओर एक डॉक्यूमेंट बटन है।

"मॉडल" श्रेणी पर क्लिक करें; वहां आपको सभी मॉडलों की सूची मिल जाएगी।

आप जिस मॉडल का उपयोग करना चाहते हैं उसे चुनें, और उस पर क्लिक करके आप मॉडल आईडी देख सकते हैं।

किमि 2.6 मॉडल को कॉल करने का परीक्षण करें
मैं परीक्षण के लिए Kimi 2.6 का उपयोग करूँगा। मॉडल आईडी को कॉपी करें और इसे कर्ल कमांड में @cf/ से शुरू करके बदलें।
अनुरोध भेजा गया और परिणाम शीघ्र ही प्राप्त हो गया।

प्रतिक्रिया की गति वास्तव में बहुत तेज है, मेरी अपेक्षा से कहीं अधिक सुगम है।
सच कहूँ तो, मैं बस यह देखना चाहता था कि इस मुफ़्त क्रेडिट से क्या-क्या किया जा सकता है, और पता चला कि यह काफ़ी शक्तिशाली है। यह रोज़मर्रा की चैटिंग, कंटेंट जनरेशन, अनुवाद और कोडिंग के लिए बिल्कुल उपयुक्त है।
ज़रा सोचिए: यह सिस्टम एज नोड्स पर चलता है। आप देश भर में या यहाँ तक कि दुनिया भर में उपयोगकर्ताओं के लिए एक AI एप्लिकेशन तैनात कर सकते हैं, और क्षेत्रीय तैनाती संबंधी समस्याओं की चिंता किए बिना प्रतिक्रिया गति स्थिर बनी रहती है। यह व्यक्तिगत डेवलपर्स और छोटी टीमों के लिए बेहद आकर्षक है।
पहले, अगर आपको कोई मॉडल चलाना होता था, तो या तो आपको एक GPU खरीदना पड़ता था और खुद बनाना पड़ता था, जो बेहद महंगा था, या फिर किसी क्लाउड प्रोवाइडर से GPU इंस्टेंस लेना पड़ता था, जिसे कॉन्फ़िगर करना मुश्किल था। दूसरी तरफ, Cloudflare ने आपके लिए सब कुछ आसान कर दिया है। आपको बस इसे कॉल करने के लिए कोड लिखना होता है, और यह आपके लिए सारी झंझटें खुद ही संभाल लेता है।
मुझे लगता है कि यह सोच सही है। एआई की क्षमताएं धीरे-धीरे पानी और बिजली जैसी बुनियादी सुविधाओं की तरह हो जाएंगी; आपको यह जानने की ज़रूरत नहीं होगी कि बिजली कैसे पैदा होती है, आप बस इसे प्लग इन करके इस्तेमाल कर सकते हैं। क्लाउडफ्लेयर वर्कर्स एआई इस "प्लग एंड प्ले" अवधारणा को और भी चरम स्तर पर ले जाता है।
बेशक, इसके कुछ नुकसान भी हैं। मुफ़्त कोटा केवल 10000 न्यूरॉन्स का है, इसलिए अगर आप इसे ज़्यादा ट्रैफ़िक वाले प्रोडक्शन एनवायरनमेंट में इस्तेमाल करना चाहते हैं तो आपको भुगतान करना होगा। साथ ही, 50 से ज़्यादा मॉडल होने के बावजूद, OpenAI के व्यापक इकोसिस्टम की तुलना में, कुछ खास या नए मॉडल समर्थित नहीं हैं।
लेकिन व्यक्तिगत परियोजनाओं, छोटे उपकरणों या सिर्फ जिज्ञासा से प्रेरित प्रयोगों के लिए, मुझे लगता है कि यह काफी है।
अधिक विस्तृत जानकारी के साथ-साथ क्लाउडफ्लेयर के लिए बुनियादी यूआरएल और एपीआई कॉन्फ़िगरेशन विधियों के लिए, बस जोड़ें... Telegram आप चैनल में पिन किए गए 【टूलकिट】 को देखकर इसे प्राप्त कर सकते हैं ▼
ये मेरे वास्तविक अनुभव हैं। चूंकि आपने इसे यहाँ तक पढ़ा है, अगर आपको यह उपयोगी लगा हो, तो कृपया इसे लाइक और शेयर करें। अगर आप सबसे पहले अपडेट पाना चाहते हैं, तो आप मुझे फॉलो भी कर सकते हैं ⭐~
मेरा लेख पढ़ने के लिए धन्यवाद। फिर मिलेंगे।
होप चेन वेइलियांग ब्लॉग ( https://www.chenweiliang.com/ यहां साझा किया गया लेख "क्लाउडफ्लेयर वर्कर्स एआई फ्री एपीआई कॉल प्रक्रिया: एक ही चरण में पंजीकरण, कॉन्फ़िगरेशन और परिनियोजन" आपके लिए उपयोगी हो सकता है।
इस लेख का लिंक साझा करने के लिए आपका स्वागत है:https://www.chenweiliang.com/cwl-34244.html
