क्या है GPT API Cost Calculator?
▾
GPT API लागत कैलकुलेटर मॉडल चयन, इनपुट और आउटपुट टोकन उपयोग और मासिक कॉल वॉल्यूम के आधार पर आपके कुल OpenAI API व्यय का अनुमान लगाता है। ओपनएआई एक विभाजित मूल्य निर्धारण मॉडल का उपयोग करता है जहां इनपुट टोकन (आपके संकेत) और आउटपुट टोकन (मॉडल प्रतिक्रियाएं) अलग-अलग दरों पर चार्ज किए जाते हैं, आउटपुट टोकन की कीमत आमतौर पर इनपुट टोकन से 2 से 4 गुना अधिक होती है। 2025 तक, GPT-4o की कीमत $2.50 प्रति मिलियन इनपुट टोकन और $10.00 प्रति मिलियन आउटपुट टोकन है, जबकि बजट-अनुकूल GPT-4o-मिनी की कीमत केवल $0.15 प्रति मिलियन इनपुट टोकन और $0.60 प्रति मिलियन आउटपुट टोकन है। यह कैलकुलेटर सॉफ्टवेयर इंजीनियरों, उत्पाद प्रबंधकों और वित्त टीमों के लिए आवश्यक है, जिन्हें सुविधाओं को लॉन्च करने से पहले या त्रैमासिक बजट योजना के दौरान एआई बुनियादी ढांचे की लागत का पूर्वानुमान लगाने की आवश्यकता होती है। 1,000 इनपुट टोकन और 500 आउटपुट टोकन के औसत संकेतों के साथ प्रति माह 100,000 एपीआई कॉल करने वाले एक सामान्य SaaS एप्लिकेशन की लागत GPT-4o पर लगभग $750 प्रति माह होगी, लेकिन GPT-4o-मिनी पर केवल $22.50 होगी। इन मॉडलों के बीच अंतर यह निर्धारित कर सकता है कि एआई सुविधा आर्थिक रूप से व्यवहार्य है या नहीं। ओपनएआई एक बैच एपीआई भी प्रदान करता है जो 24 घंटे तक पूरा होने का समय स्वीकार करने के बदले में सभी मॉडल मूल्य निर्धारण पर 50 प्रतिशत की छूट प्रदान करता है। ऐसे कार्यभार के लिए जो विलंबता-संवेदनशील नहीं हैं, जैसे सामग्री निर्माण पाइपलाइन, डेटा निष्कर्षण और मूल्यांकन कार्य, बैच एपीआई लागत को आधा कर सकता है। कैलकुलेटर इन सभी मूल्य निर्धारण स्तरों को मॉडल करता है और टीमों को मॉडल की गुणवत्ता, गति और लागत का इष्टतम संयोजन खोजने में मदद करता है।
DigiCalcs delivers precision-engineered tools for engineers and STEM professionals.
सूत्र
▾
मासिक लागत = ((प्रति अनुरोध इनपुट टोकन x अनुरोधों की संख्या x इनपुट मूल्य प्रति 1M टोकन) + (प्रति अनुरोध आउटपुट टोकन x अनुरोधों की संख्या x आउटपुट मूल्य प्रति 1M टोकन)) / 1,000,000। उदाहरण के लिए, 50,000 मासिक अनुरोधों में 800 इनपुट टोकन और 400 आउटपुट टोकन के साथ GPT-4o का उपयोग करना: इनपुट लागत = (800 x 50,000 x $2.50) / 1,000,000 = $100.00। आउटपुट लागत = (400 x 50,000 x $10.00) / 1,000,000 = $200.00। कुल मासिक लागत = $300.00.चर विवरण
▾
| प्रतीक | नाम | इकाई | विवरण |
|---|---|---|---|
| T_in | प्रति अनुरोध इनपुट टोकन | tokens | प्रत्येक अनुरोध में एपीआई को भेजे गए टोकन की कुल संख्या, जिसमें सिस्टम प्रॉम्प्ट, उपयोगकर्ता संदेश, कुछ-शॉट उदाहरण और पिछले दौरों से कोई वार्तालाप इतिहास शामिल है। |
| T_out | प्रति अनुरोध आउटपुट टोकन | tokens | प्रत्येक प्रतिक्रिया में मॉडल द्वारा उत्पन्न टोकन की औसत संख्या, अप्रत्याशित रूप से लंबी और महंगी पूर्णताओं को रोकने के लिए max_tokens पैरामीटर के माध्यम से नियंत्रित की जाती है। |
| N | मासिक अनुरोध संख्या | requests per month | एक बिलिंग अवधि में किए गए एपीआई कॉल की कुल संख्या, जिसमें पुनः प्रयास, त्रुटि प्रबंधन कॉल और किसी भी आंतरिक परीक्षण या निगरानी अनुरोध शामिल होने चाहिए। |
| P_in | इनपुट टोकन मूल्य | USD per 1M tokens | चयनित मॉडल के लिए प्रति मिलियन इनपुट टोकन पर शुल्क लिया जाता है, जैसे GPT-4o के लिए $2.50 या GPT-4o-मिनी के लिए $0.15। |
| P_out | आउटपुट टोकन मूल्य | USD per 1M tokens | चयनित मॉडल के लिए प्रति मिलियन आउटपुट टोकन पर लिया जाने वाला मूल्य, जैसे GPT-4o के लिए $10.00 या GPT-4o-मिनी के लिए $0.60। |
| B | बैच डिस्काउंट फैक्टर | multiplier (0.5 or 1.0) | ओपनएआई बैच एपीआई का उपयोग करते समय छूट गुणक लागू होता है, वर्तमान में 50 प्रतिशत छूट के लिए 0.5, या मानक वास्तविक समय एपीआई मूल्य निर्धारण के लिए 1.0। |
कैसे GPT API Cost Calculator
▾
- 1उपलब्ध विकल्पों में से अपना OpenAI मॉडल चुनें। GPT-4o प्रमुख मॉडल है जो $2.50/$10.00 प्रति मिलियन इनपुट/आउटपुट टोकन पर सर्वोत्तम प्रदर्शन प्रदान करता है। GPT-4o-मिनी $0.15/$0.60 की लागत के एक अंश पर मजबूत क्षमताएं प्रदान करता है। O1 रीज़निंग मॉडल की कीमत $15.00/$60.00 है और इसे जटिल बहु-चरणीय समस्याओं के लिए डिज़ाइन किया गया है। ओ3-मिनी रीज़निंग मॉडल की कीमत $1.10/$4.40 है और यह अधिक सुलभ मूल्य बिंदु पर रीज़निंग क्षमताएं प्रदान करता है।
- 2प्रति अनुरोध अपना औसत इनपुट टोकन दर्ज करें। इसमें सिस्टम प्रॉम्प्ट, उपयोगकर्ता संदेश, कुछ-शॉट उदाहरण और मल्टी-टर्न चैट के लिए वार्तालाप इतिहास शामिल है। एक महत्वपूर्ण विवरण जो कई डेवलपर्स भूल जाते हैं वह यह है कि सिस्टम प्रॉम्प्ट हर एक एपीआई कॉल के साथ भेजा जाता है, इसलिए 100,000 मासिक कॉलों पर 500-टोकन सिस्टम प्रॉम्प्ट आपके बिल में 50 मिलियन इनपुट टोकन जोड़ता है। अपने वास्तविक संकेत आकार को मापने के लिए OpenAI टोकनाइज़र या टिकटोकन लाइब्रेरी का उपयोग करें।
- 3प्रति प्रतिक्रिया अपना औसत आउटपुट टोकन दर्ज करें। यह मॉडल पूरा होने की लंबाई है. लघु वर्गीकरण कार्यों में 10 से 50 आउटपुट टोकन का उपयोग हो सकता है, जबकि दीर्घकालिक सामग्री निर्माण में 1,000 से 4,000 टोकन का उपयोग किया जा सकता है। आप आउटपुट लंबाई को सीमित करने के लिए अपने एपीआई कॉल में max_tokens पैरामीटर सेट कर सकते हैं और अप्रत्याशित रूप से वर्बोज़ प्रतिक्रियाओं से होने वाली लागत को रोक सकते हैं।
- 4अपनी मासिक एपीआई कॉल मात्रा निर्दिष्ट करें। वर्तमान उपयोग और अनुमानित वृद्धि दोनों पर विचार करें। यदि आप ग्राहक-सामना करने वाली सुविधा का निर्माण कर रहे हैं, तो अलग-अलग अपनाने के परिदृश्यों को मॉडल करें जैसे लॉन्च महीने के लिए 10,000 कॉल, तीसरे महीने के लिए 50,000 और छठे महीने के लिए 200,000। यह दूरंदेशी प्रक्षेपण उचित बजट अनुमोदन सुरक्षित करने में मदद करता है।
- 5इनपुट और आउटपुट खर्चों के बीच लागत विभाजन की समीक्षा करें। अधिकांश अनुप्रयोगों में, आउटपुट टोकन बिल पर हावी होते हैं क्योंकि उनकी लागत इनपुट की तुलना में प्रति टोकन 3 से 4 गुना अधिक होती है। यदि आउटपुट लागत असंगत रूप से अधिक है, तो संरचित JSON स्कीमा के साथ आउटपुट को सीमित करने, छोटे प्रतिक्रिया प्रारूपों का उपयोग करने, या उन कार्यों के लिए GPT-4o-मिनी पर स्विच करने जैसी तकनीकों पर विचार करें जिनके लिए GPT-4o की पूर्ण क्षमता की आवश्यकता नहीं है।
- 6मूल्यांकन करें कि बैच एपीआई छूट आपके कार्यभार पर लागू होती है या नहीं। बैच एपीआई इनपुट और आउटपुट दोनों टोकन कीमतों पर 50 प्रतिशत की छूट प्रदान करता है, लेकिन 24 घंटे तक पूरा होने के समय के साथ अतुल्यकालिक रूप से अनुरोधों को संसाधित करता है। रातोंरात सामग्री निर्माण, साप्ताहिक रिपोर्ट निर्माण, या डेटा संवर्धन पाइपलाइनों के लिए, यह बिना किसी गुणवत्ता व्यापार के आपकी लागत को आधा कर देता है। कैलकुलेटर वास्तविक समय बनाम बैच प्रोसेसिंग के लिए साथ-साथ लागत दिखाता है।
- 7वैकल्पिक मॉडलों और प्रदाताओं से अंतिम लागत की तुलना करें। कैलकुलेटर आपको एक सूचित विकल्प बनाने में मदद करने के लिए क्लाउड सॉनेट 4, जेमिनी प्रो और ओपन-सोर्स विकल्पों पर समतुल्य लागत दिखा सकता है। कई कार्यभार के लिए, GPT-4o-मिनी $0.15/$0.60 पर 94 प्रतिशत कम लागत पर 90 प्रतिशत GPT-4o गुणवत्ता प्रदान करता है, जो इसे लागत-सचेत अनुप्रयोगों के लिए इष्टतम डिफ़ॉल्ट बनाता है।
हल किए गए उदाहरण
▾
इनपुट लागत 1,200 गुना 80,000 को 1,000,000 गुना $2.50 से विभाजित करने पर $240.00 के बराबर होती है। आउटपुट लागत 400 गुना 80,000 को 1,000,000 गुना $10.00 से विभाजित करने पर $320.00 के बराबर होती है। आउटपुट टोकन, कम होने के बावजूद, 4x मूल्य प्रीमियम के कारण कुल बिल का 57 प्रतिशत हिस्सा हैं।
वर्गीकरण कार्यों के लिए जिनमें केवल छोटे आउटपुट की आवश्यकता होती है, GPT-4o-मिनी बेहद लागत प्रभावी है। एक मिलियन मासिक अनुरोधों के लिए इनपुट लागत $75.00 है और आउटपुट लागत केवल $12.00 है। यह प्रति वर्गीकरण $0.000087 बैठता है, जिससे AI-संचालित वर्गीकरण किसी भी मैन्युअल विकल्प से सस्ता हो जाता है।
बैच एपीआई सभी टोकन कीमतों को आधा कर देता है। रातोंरात ब्लॉग ड्राफ्ट तैयार करने वाली सामग्री निर्माण पाइपलाइन के लिए, इससे गुणवत्ता में कोई अंतर नहीं होने पर प्रति माह 200 डॉलर की बचत होती है। एकमात्र समाधान परिणामों के लिए 24 घंटों तक प्रतीक्षा करना है, जो निर्धारित प्रकाशन वर्कफ़्लो के लिए स्वीकार्य है।
प्रत्येक मोड़ संपूर्ण वार्तालाप इतिहास को पुनः भेजता है, इसलिए इनपुट टोकन रैखिक रूप से बढ़ते हैं। संचित इतिहास को ध्यान में रखते हुए सभी मोड़ों पर औसत इनपुट लगभग 2,100 टोकन है। 60,000 कुल घुमावों और बढ़ते संदर्भ के साथ, वास्तविक इनपुट टोकन कुल लगभग 126 मिलियन है, इनपुट के लिए $315 और आउटपुट के लिए $480 की लागत आती है।
वास्तविक अनुप्रयोग
▾
SaaS कंपनियां AI-संचालित खोज, सामग्री सारांश और बुद्धिमान अनुशंसाओं जैसी सुविधाओं के लिए अपने उत्पादों में GPT-4o को एकीकृत करती हैं। 50,000 मासिक सक्रिय उपयोगकर्ताओं वाला एक मध्यम आकार का SaaS, जो 800 इनपुट और 300 आउटपुट टोकन पर प्रति माह औसतन 3 AI-सहायता वाली कार्रवाइयां करता है, GPT-4o पर प्रति माह लगभग 1,875 डॉलर खर्च करेगा। यह लागत आम तौर पर सदस्यता मूल्य में बनाई जाती है, जो इकाई अर्थशास्त्र में प्रति उपयोगकर्ता प्रति माह $0.04 जोड़ती है, जिसे अधिकांश मूल्य निर्धारण मॉडल आराम से अवशोषित कर सकते हैं।
ई-कॉमर्स प्लेटफ़ॉर्म बड़े पैमाने पर उत्पाद विवरण तैयार करने के लिए GPT-4o-मिनी का उपयोग करते हैं। 200,000 उत्पाद सूची वाला एक बाज़ार 600-टोकन प्रॉम्प्ट टेम्पलेट और 250-टोकन आउटपुट का उपयोग करके लगभग $33 कुल के लिए अद्वितीय, एसईओ-अनुकूलित विवरण उत्पन्न कर सकता है। सामग्री को ताज़ा रखने के लिए विवरण को त्रैमासिक रूप से पुनर्जीवित करने पर प्रति वर्ष $132 का खर्च आता है, अन्यथा इसके स्थान पर सामग्री लेखकों की एक टीम की आवश्यकता होती है जिसकी लागत सालाना $50,000 या अधिक होती है।
वित्तीय सेवा कंपनियाँ दस्तावेज़ विश्लेषण और रिपोर्ट निर्माण के लिए GPT-4o का उपयोग करती हैं। प्रति तिमाही 10,000 आय कॉल प्रतिलेखों को संसाधित करने में, 2,000-टोकन सारांश आउटपुट के साथ प्रत्येक औसतन 8,000 इनपुट टोकन की लागत लगभग $400 प्रति तिमाही होती है। वैकल्पिक रूप से, मानव विश्लेषक प्रति प्रतिलेख 75 डॉलर प्रति घंटे की दर से 30 मिनट खर्च करते हैं, जिसकी लागत $375,000 होगी। एआई दृष्टिकोण सुसंगत, तत्काल विश्लेषण प्रदान करते हुए 99.9 प्रतिशत लागत में कमी लाता है।
डेवलपर टूल और कोड समीक्षा प्लेटफ़ॉर्म स्वचालित कोड समीक्षा सुझाव प्रदान करने के लिए GPT-4o को एकीकृत करते हैं। प्रति माह औसतन 20 पुल अनुरोधों की समीक्षा करने वाले 5,000 डेवलपर्स की सेवा करने वाला एक प्लेटफ़ॉर्म, जिसमें प्रत्येक समीक्षा में 3,000 इनपुट टोकन (कोड संदर्भ) और 800 आउटपुट टोकन (समीक्षा टिप्पणियाँ) की खपत होती है, प्रति माह लगभग $5,750 खर्च करेगा। $1.15 प्रति डेवलपर प्रति माह पर, यह लागत सामान्य रूप से $20 से $50 प्रति सीट मूल्य निर्धारण में समाहित हो जाती है।
विशेष मामले
▾
फ़ाइल खोज या कोड दुभाषिया के साथ OpenAI Assistants API का उपयोग करते समय
फ़ाइल खोज या कोड दुभाषिया टूल के साथ ओपनएआई असिस्टेंट एपीआई का उपयोग करते समय, मानक टोकन मूल्य निर्धारण से परे अतिरिक्त लागत लागू होती है। फ़ाइल खोज शुल्क $0.10 प्रति जीबी वेक्टर स्टोर स्टोरेज प्रति दिन है, और कोड दुभाषिया सत्र शुल्क $0.03 प्रति सत्र है। ये पूरक लागत उन अनुप्रयोगों के लिए महत्वपूर्ण हो सकती हैं जो बड़े फ़ाइल स्टोर बनाए रखते हैं या अक्सर कोड निष्पादित करते हैं। 10 जीबी वेक्टर स्टोर की लागत आपके टोकन शुल्क के अलावा $1 प्रति दिन या $30 प्रति माह है।
उन अनुप्रयोगों के लिए जो शीघ्र कैशिंग का भारी उपयोग करते हैं, OpenAI स्वचालित रूप से
उन अनुप्रयोगों के लिए जो शीघ्र कैशिंग का भारी उपयोग करते हैं, ओपनएआई स्वचालित रूप से 1,024 टोकन से अधिक लंबे संकेतों को कैश करता है और बाद के अनुरोधों पर कैश्ड भागों के लिए इनपुट टोकन मूल्य का केवल 50 प्रतिशत शुल्क लेता है। यह विशेष रूप से लंबे, बार-बार सिस्टम संकेतों या कुछ-शॉट उदाहरण ब्लॉक वाले अनुप्रयोगों के लिए फायदेमंद है। यदि आपका 2,000-टोकन सिस्टम प्रॉम्प्ट कैश्ड है, तो आप GPT-4o पर प्रति मिलियन कैश्ड टोकन पर $2.50 बचाते हैं, जो बड़े पैमाने पर प्रति माह सैकड़ों डॉलर जोड़ता है।
GPT-4o के साथ दृष्टि क्षमताओं का उपयोग करते समय, छवि इनपुट को रिज़ॉल्यूशन के आधार पर टोकन में परिवर्तित किया जाता है।
एक कम-रिज़ॉल्यूशन वाली छवि की लागत निश्चित 85 टोकन होती है, जबकि एक उच्च-रिज़ॉल्यूशन वाली छवि अपने आयामों के आधार पर 170 से 1,105 टोकन का उपभोग कर सकती है। प्रति माह हजारों छवियों को संसाधित करने वाले अनुप्रयोगों के लिए, ये विज़ुअल टोकन इनपुट लागत के एक बड़े हिस्से का प्रतिनिधित्व कर सकते हैं और इन्हें लागत अनुमानों में शामिल किया जाना चाहिए।
ओपनएआई मॉडल मूल्य निर्धारण तुलना (2025)
▾
| नमूना | इनपुट (प्रति 1M टोकन) | आउटपुट (प्रति 1M टोकन) | प्रसंग विंडो | बैच इनपुट | बैच आउटपुट |
|---|---|---|---|---|---|
| GPT-4o | $2.50 | $10.00 | 128K | $1.25 | $5.00 |
| GPT-4o-मिनी | $0.15 | $0.60 | 128K | $0.075 | $0.30 |
| o1 | $15.00 | $60.00 | 200K | $7.50 | $30.00 |
| o3-मिनी | $1.10 | $4.40 | 200K | $0.55 | $2.20 |
| GPT-4-टर्बो | $10.00 | $30.00 | 128K | N/A | N/A |
| जीपीटी-3.5-टर्बो | $0.50 | $1.50 | 16K | $0.25 | $0.75 |
अक्सर पूछे जाने वाले प्रश्न
▾
एक GPT-4o API कॉल की लागत कितनी है?
500 इनपुट टोकन और 300 आउटपुट टोकन के साथ एक सामान्य GPT-4o कॉल की लागत $0.00425 (एक पैसे का लगभग चार-दसवां हिस्सा) होती है। इनपुट भाग 500 को 1,000,000 गुना $2.50 से विभाजित करके $0.00125 के बराबर है, और आउटपुट भाग 300 को 1,000,000 गुना $10.00 से विभाजित करके $0.00300 के बराबर है। इस दर पर, आप प्रति डॉलर लगभग 235 कॉल कर सकते हैं। समान टोकन गणना वाले GPT-4o-मिनी के लिए, लागत घटकर $0.000255 प्रति कॉल हो जाती है, जिससे प्रति डॉलर लगभग 3,920 कॉल की अनुमति मिलती है।
क्या GPT-4o-मिनी उत्पादन में उपयोग के लिए पर्याप्त है?
कई उत्पादन कार्यभार के लिए, GPT-4o-मिनी नाटकीय रूप से कम लागत पर उत्कृष्ट गुणवत्ता प्रदान करता है। यह अधिकांश बेंचमार्क पर GPT-4o के 5 से 10 प्रतिशत के भीतर प्रदर्शन करता है जबकि लागत 94 प्रतिशत कम है। GPT-4o-मिनी के लिए उपयुक्त कार्यों में पाठ वर्गीकरण, इकाई निष्कर्षण, सरल सारांश और संरचित डेटा परिवर्तन शामिल हैं। पूर्ण GPT-4o से लाभान्वित होने वाले कार्यों में जटिल तर्क, रचनात्मक लेखन, सूक्ष्म विश्लेषण और जटिल प्रणालियों के लिए कोड निर्माण शामिल हैं।
बैच एपीआई कैसे काम करता है और मुझे इसका उपयोग कब करना चाहिए?
बैच एपीआई आपको एपीआई अनुरोधों की एक फ़ाइल सबमिट करने की सुविधा देता है जिसे ओपनएआई सभी टोकन कीमतों पर 50 प्रतिशत की छूट पर 24 घंटे की विंडो के भीतर अतुल्यकालिक रूप से संसाधित करता है। इसका उपयोग गैर-समय-संवेदनशील कार्यभार जैसे रात्रिकालीन सामग्री निर्माण, साप्ताहिक डेटा संवर्धन, थोक वर्गीकरण, या मूल्यांकन पाइपलाइनों के लिए करें। आप अनुरोधों की एक JSONL फ़ाइल सबमिट करते हैं, एक बैच आईडी प्राप्त करते हैं, और पूरा करने के लिए मतदान करते हैं। 24 घंटे के एसएलए के बावजूद अधिकांश बैच 1 से 6 घंटे के भीतर समाप्त हो जाते हैं।
मैं अपनी GPT API लागतें कैसे कम कर सकता हूँ?
सबसे प्रभावशाली रणनीतियाँ हैं: सबसे पहले, उन कार्यों के लिए GPT-4o-मिनी का उपयोग करें जिनके लिए शीर्ष स्तरीय तर्क (अक्सर 70 से 80 प्रतिशत कार्यभार) की आवश्यकता नहीं होती है। दूसरा, सिस्टम प्रॉम्प्ट की लंबाई कम से कम करें क्योंकि यह हर कॉल के साथ भेजी जाती है। तीसरा, मल्टी-टर्न चैट के लिए वार्तालाप इतिहास में कटौती या सारांश लागू करें। चौथा, 50 प्रतिशत छूट पाने के लिए गैर-वास्तविक समय के कार्यभार के लिए बैच एपीआई का उपयोग करें। पांचवां, अनावश्यक एपीआई कॉल से बचने के लिए सामान्य प्रतिक्रियाओं को कैश करें। छठा, प्रतिक्रिया की लंबाई सीमित करने के लिए संरचित आउटपुट स्कीमा का उपयोग करें।
OpenAI दर सीमाएँ क्या हैं और वे लागत को कैसे प्रभावित करती हैं?
ओपनएआई अनुरोध प्रति मिनट (आरपीएम) और टोकन प्रति मिनट (टीपीएम) में मापी गई दर सीमाएं लगाता है। फ्री टियर उपयोगकर्ताओं को GPT-4o के लिए 3 RPM और 40,000 TPM मिलते हैं। टियर 1 भुगतान वाले उपयोगकर्ताओं को 500 RPM और 30,000 TPM मिलते हैं। ऊंचे स्तर अधिक क्षमता को अनलॉक करते हैं। दर सीमाएं सीधे लागत में वृद्धि नहीं करती हैं, लेकिन वे आपको अनुरोधों को कतारबद्ध करने के लिए बाध्य कर सकती हैं, जिससे विलंबता बढ़ जाती है। यदि आपको अधिक थ्रूपुट की आवश्यकता है, तो आप OpenAI डैशबोर्ड के माध्यम से सीमा बढ़ाने का अनुरोध कर सकते हैं या विभिन्न परियोजनाओं में एकाधिक एपीआई कुंजियों का उपयोग कर सकते हैं।
एपीआई कॉल करने से पहले मैं टोकन गणना का अनुमान कैसे लगाऊं?
GPT-4o और GPT-4o-मिनी मॉडल के लिए cl100k_base एन्कोडिंग के साथ टिकटोकन पायथन लाइब्रेरी का उपयोग करें। एक त्वरित नियम यह है कि एक टोकन लगभग चार अंग्रेजी अक्षरों या 0.75 शब्दों का होता है। 1,000 शब्दों का दस्तावेज़ लगभग 1,333 टोकन के बराबर होता है। उत्पादन प्रणालियों के लिए, अनुरोध भेजने से पहले लागत का अनुमान लगाने और अप्रत्याशित रूप से महंगी कॉल को रोकने के लिए प्रति-अनुरोध बजट लागू करने के लिए अपनी प्रीप्रोसेसिंग पाइपलाइन में टोकन गिनती लागू करें।
क्या JSON मोड या फ़ंक्शन कॉलिंग का उपयोग करने से लागत बदल जाती है?
JSON मोड और फ़ंक्शन कॉलिंग में अधिभार नहीं जुड़ता है, लेकिन वे टोकन गणना को प्रभावित करते हैं। टूल के रूप में भेजी जाने वाली फ़ंक्शन परिभाषाएँ आपके इनपुट टोकन में जुड़ जाती हैं, प्रत्येक फ़ंक्शन परिभाषा जटिलता के आधार पर 50 से 200 टोकन का उपभोग करती है। JSON मोड संरचित आउटपुट ओवरहेड फ़ॉर्मेटिंग के कारण आउटपुट टोकन को थोड़ा बढ़ा सकता है। हालाँकि, संरचित आउटपुट अक्सर फ्री-फॉर्म टेक्स्ट प्रतिक्रियाओं से छोटे होते हैं, इसलिए शुद्ध प्रभाव अक्सर आउटपुट लागत में कमी होता है।
सामान्य गलतियां जिनसे बचना है
▾
- !इनपुट और आउटपुट टोकन के लिए समान मूल्य का उपयोग करना:
- !बड़े पैमाने पर सिस्टम प्रॉम्प्ट टोकन लागतों को अनदेखा करना:
- !चैट अनुप्रयोगों में वार्तालाप इतिहास की वृद्धि को ध्यान में नहीं रखना:
विशेष टिप
OpenAI डैशबोर्ड में प्रति-प्रोजेक्ट खर्च सीमा निर्धारित करें और प्रत्येक API कॉल में max_tokens कैप लागू करें। उत्पादन में एक अनंत लूप बग मिनटों में हजारों डॉलर बर्बाद कर सकता है। प्रति उपयोगकर्ता सत्र के लिए एक टोकन बजट लागू करने पर भी विचार करें जो बजट के उपभोग के साथ-साथ शालीनता से घटता है (जीपीटी-4ओ-मिनी पर स्विच करता है या प्रतिक्रिया लंबाई को सीमित करता है), जिससे किसी भी एकल उपयोगकर्ता को अत्यधिक लागत उत्पन्न करने से रोका जा सके।
क्या आप जानते हैं?
$0.15 प्रति मिलियन इनपुट टोकन के GPT-4o-मिनी मूल्य निर्धारण पर, आप सभी सात हैरी पॉटर पुस्तकों के संपूर्ण पाठ (लगभग 1.08 मिलियन शब्द या 1.44 मिलियन टोकन) को केवल $0.000216 में इनपुट के रूप में संसाधित कर सकते हैं, जो एक पैसे के चालीसवें हिस्से से भी कम है। शेक्सपियर के संपूर्ण कार्यों की लागत लगभग $0.00014 से भी कम होगी।
Regional Guides
▾
North America▾
Europe▾
Asia-Pacific▾
संदर्भ
साप्ताहिक गणित युक्तियाँ प्राप्त करें
12,000+ सब्सक्राइबर्स से जुड़ें जिन्हें हर हफ्ते कैलकुलेटर टिप्स मिलते हैं।