HI ▾
API कुंजी प्राप्त करें

Wu Xianzhi APIउपयोग के मामले

असीमित AI API उपयोग के मामले: रोलप्ले से एजेंट बैकएंड तक छह उपयोग

असीमित AI API का मूल्य इसमें है कि वैध वयस्क सामग्री, काल्पनिक रचनाएं और विवादास्पद विषय अब मॉडल द्वारा रिजेक्ट नहीं किए जाते। इस लेख में छह सामान्य परिदृश्यों पर चर्चा की गई है: रोलप्ले और कंपैनियन, वेब नॉवेल रचना, गेम NPC, कंटेंट मॉडरेशन टेस्टिंग, रिसर्च एनालिसिस और एजेंट बैकएंड। प्रत्येक के लिए यह बताया गया है कि क्या चाहिए, एक system prompt उदाहरण दिया गया है, और प्रत्येक मिलियन टोकन इनपुट के लिए $0.25 और आउटपुट के लिए $1.00 की लागत का अनुमान लगाया गया है। यह उत्पाद केवल 18 वर्ष से ऊपर के वयस्क उपयोगकर्ताओं के लिए है और केवल वैध उद्देश्यों के लिए उपयोग किया जा सकता है।

को अपडेट किया गया

मुख्य बिंदु

  1. केवल वयस्कों के लिए और वैध उपयोग के लिए, किशोरों से जुड़ी यौन सामग्री चाहे काल्पनिक हो या नहीं, हमेशा ब्लॉक हो जाती है और 403 लौटाता है
  2. छहों मामलों में विशिष्ट system प्रॉम्प्ट की आवश्यकता होती है; पात्र, टोन, लंबाई और बॉर्डर जितने स्पष्ट होंगे, आउटपुट उतना ही स्थिर होगा
  3. लागत का अनुमान मानक टोकन संख्या के आधार पर लगाया गया है: चैटिंग के लिए लगभग $0.001 प्रति चैट, वेब नॉवेल के लिए लगभग $0.0055 प्रति पैराग्राफ, गेम NPC के लिए लगभग $0.00032 प्रति वाक्य
  4. वास्तविक शुल्क response में usage पर निर्भर करता है, max_tokens को सीमित करना लागत नियंत्रित करने का सबसे सीधा तरीका है

पहले शर्तें: केवल वयस्कों के लिए और वैध उपयोग

यह API 18 वर्ष से ऊपर के वयस्कों के लिए है और केवल वैध उपयोगों के लिए। वैध वयस्क सामग्री, काल्पनिक रचनाएँ और विवादास्पद विषयों पर प्रतिक्रिया नहीं रोकी जाती, लेकिन अल्पवयस्कों से संबंधित यौन सामग्री, चाहे वह काल्पनिक हो या भूमिका निभाने वाली, हमेशा ब्लॉक हो जाती है और 403 content_blocked लौटाता है। यदि आप अंतिम उपयोगकर्ताओं के लिए उत्पाद बना रहे हैं, तो आपको अपने एप्लिकेशन में वयस्क सत्यापन, सामग्री रिपोर्टिंग और खाता प्रबंधन ठीक से लागू करना चाहिए; यह जिम्मेदारी उत्पाद पक्ष की है, API इसे आपके लिए नहीं कर सकता।

नीचे छः सामान्य परिदृश्यों पर चर्चा की गई है, प्रत्येक में यह बताया गया है कि उसे वास्तव में क्या चाहिए, एक system prompt जो सीधे उपयोग के लिए तैयार है, और लागत का अनुमान। मूल्य इनपुट के लिए $0.25 / मिलियन टोकन और आउटपुट के लिए $1.00 / मिलियन टोकन है, प्रीपेड, बिना मासिक शुल्क के। सभी टोकन संख्याएँ अनुमान के लिए मेरी द्वारा मानी गईTypical मान हैं, आपकी वास्तविक खपत usage प्रतिक्रिया में आधारित होगी, अनुमान केवल परिमाण का आकलन करने के लिए है। कॉल विधि के लिए कोड उदाहरण देखें।

एक सामान्य सलाह: किसी भी परिदृश्य में, system prompt को विशिष्ट रूप से लिखें। बिना सेंसर मॉडल आपको रिजेक्ट नहीं करेगा, लेकिन यह आपके लिए यह नहीं जानता कि आपको क्या चाहिए। जितना स्पष्ट आप किरदार, टोन, लंबाई और बॉर्डरलाइन लिखेंगे, आउटपुट उतना ही स्थिर होगा।

रोलप्ले और कॉम्पेनियन ऐप्स (केवल वयस्कों के लिए)

यह वह श्रेणी है जहाँ 'प्रतिक्रिया न रोके' की माँग सबसे अधिक केंद्रित है। उपयोगकर्ता एक निश्चित पात्र के साथ दीर्घकालिक संवाद करता है, जिसमें वयस्क भावनात्मक और आत्मीय विवरण शामिल हो सकते हैं। तकनीकी रूप से तीन बातें सबसे महत्वपूर्ण हैं: पात्र स्थिर होना चाहिए, इसलिए पात्र और विश्वदृष्टि system संदेश में रखें और प्रत्येक चरण में भेजें; संदर्भ सतत होना चाहिए, इसलिए आपको इतिहास को स्वयं बनाए रखना और काटना होगा, API अवस्थाहीन है, कॉन्टेक्स्ट विंडो 100,000 टोकन है; प्रतिक्रिया छोटी होनी चाहिए, चैट परिदृश्यों में आमतौर पर कुछ दहाकियों से लेकर सैकड़ों शब्दों की आवश्यकता होती है, max_tokens को लगभग 300 पर सेट करें, जो चैट की लय के अनुकूल है और लागत को भी नियंत्रित करता है।

उत्पाद स्तर पर वयस्कों की प्रवेश अनुमति होनी चाहिए, और शिकायत व बैन के साधन रखने चाहिए। किशोरों से संबंधित सामग्री एंडपॉइंट स्तर पर ब्लॉक हो जाएगी, आपके ऐप को भी संवाद में इस दिशा को सक्रिय रूप से समाप्त करना चाहिए, न कि एंडपॉइंट पर निर्भर रहना चाहिए।

你是「林夏」,28 岁,一位在书店工作的温柔、说话有点俏皮的女性。
对话对象是已确认年满 18 岁的成年用户。
- 保持人设:记得用户说过的名字、喜好和你们聊过的事。
- 回复口语化,每次 2 到 5 句,不要写成长篇说明。
- 可以有成年人之间的暧昧和亲密描写,但任何涉及未成年人的话题一律拒绝并结束该话题。
- 不要自称 AI,除非用户认真地询问你是不是真人。

लागत अनुमान:मान लें कि प्रत्येक चरण में इनपुट 3,000 टोकन (पर्सोना सेटिंग और हालिया इतिहास) है और आउटपुट 250 टोकन है। इनपुट 3,000 × $0.25 / मिलियन = $0.00075, आउटपुट 250 × $1.00 / मिलियन = $0.00025, एक चरण लगभग $0.001। एक हजार चरण लगभग $1.00, यदि एक उपयोगकर्ता एक दिन में 50 चरण बातचीत करता है, तो एक दिन में लगभग $0.05। इस स्तर पर, $0.50 के ट्रायल क्रेडिट से आप अपने उत्पाद प्रोटोटाइप को पूरी तरह से परीक्षण कर सकते हैं।

वेब नॉवेल और उपन्यास लेखन

वेब नॉवेल लेखकों द्वारा सबसे अधिक उपयोग किए जाने वाले फीचर्स हैं: सतत लेखन, विस्तार, शैली बदलना और लेखक के ब्लॉक (writer's block) के दौरान प्रेरणा फैलाना। वयस्क, डार्क, अपराध विषयों के उपन्यासों में लेखकों को मॉडल से यह चाहिए कि वह पात्रों को यथार्थवादी बनाए, न कि महत्वपूर्ण प्लॉट बिंदुओं पर अचानक नैतिक शिक्षा देने लगे। आपको तैयार रखना चाहिए: विश्वदृष्टि सेटिंग, पात्र बायो, वर्तमान अध्याय का सारांश, पिछले अध्याय का सारांश। इन्हें system या पहली user message में डालें ताकि मॉडल भटक न जाए।

लंबे लेखन में आउटपुट सीमा का ध्यान रखें: एक बार में अधिकतम max_tokens 32,000 है, लेकिन व्यावहारिक लेखन में सुझाव दिया जाता है कि एक अध्याय को कई अनुरोधों में बाँटें, प्रत्येक 1,500 से 3,000 शब्दों का, और लेखन के बाद सारांश को अपडेट करें, न कि एक ही बार में पूरा अध्याय माँगें। इससे गुणवत्ता अधिक नियंत्रित रहती है और यदि बीच में कोई त्रुटि हो तो पूरा खंड दोहराने से बचा जा सकता है। यदि स्ट्रीमिंग सक्षम है, तो लेखक जनरेट होते समय देख सकते हैं और असंतोष की स्थिति में तुरंत रोक सकते हैं।

你是一位擅长悬疑与暗黑题材的网文写手,文风克制、细节具体。
设定:近未来的港口城市,主角是离职的法医苏明。
本章目标:苏明发现死者手机里有一段被删除的录音。
要求:
- 第三人称,过去时,约 1500 字。
- 对话自然,不要解释性旁白。
- 可以有暴力和阴暗情节的描写,但不要写成教程。
- 结尾留一个悬念,不要总结。

लागत अनुमान: मान लें कि प्रत्येक अनुरोध में इनपुट 6,000 टोकन (सेटिंग, आउटलाइन और पिछले सारांश) और आउटपुट 4,000 टोकन (लगभग 3,000 शब्द, अक्षरों और टोकन का अनुपात पाठ के अनुसार भिन्न होता है, यहाँ प्रत्येक शब्द के लिए 1 से अधिक टोकन का अनुमान लगाया गया है)। इनपुट $0.0015, आउटपुट $0.004, एक खंड लगभग $0.0055। 100 खंड लिखने पर लगभग $0.55, और यदि एक लाख शब्दों की लंबी कहानी के प्रत्येक खंड में 3,000 शब्द हों, तो लगभग 330 से अधिक अनुरोधों की आवश्यकता होगी, कुल मिलाकर $2 से कम।

गेम NPC और प्लॉट जनरेशन

गेम में NPC संवाद की दो विशेषताएँ हैं: मात्रा में बड़ा, एकल पंक्ति बहुत छोटी। आवश्यकता है कि पात्र स्पष्ट हो और कथा सेटिंग का पालन करे, जैसे कि इस NPC को क्या पता है, क्या नहीं। वयस्क, डार्क स्टाइल या गाली वाली गेम्स में, यदि रिजेक्ट करने वाले मॉडल में बदल दिया जाए, तो NPC महत्वपूर्ण क्षणों में पात्र से बाहर निकल जाएगा, अनुभव खराब होगा। बिना सेंसर मॉडल की यहाँ कीमत यह है कि शैली नहीं टूटेगी।

कार्यान्वयन के संदर्भ में, सलाह दी जाती है कि "इस NPC की ज्ञान सीमा" और "वर्तमान कार्य स्थिति" को system prompt में डालें, खिलाड़ी के बोलने को user message में रखें, और max_tokens को 100 से 150 तक सीमित करें। यदि गेम में घटनाओं को ट्रिगर करना है, जैसे दरवाजा खोलना, व्यापार, या लड़ाई, तो फ़ंक्शन कॉलिंग का उपयोग करें ताकि मॉडल संरचित क्रियाएँ लौटाए, न कि पाठ में पार्स करे। फ़ंक्शन कॉलिंग की पूरी प्रक्रिया कोड उदाहरण पृष्ठ पर दी गई है। ध्यान दें कि प्रत्येक कुंजी प्रति मिनट 300 अनुरोधों तक सीमित है, उच्च समानांतर अनुरोधों वाली ऑनलाइन गेम में सर्वर साइड पर कतार और कैश जोड़ें, और 429 त्रुटि के लिए बैकऑफ़ लागू करें।

你是边境酒馆的老板「老鲍勃」,粗声粗气,爱讲脏话,但对熟客讲义气。
你知道:镇上最近丢了三批货;你怀疑是北门守卫干的,但没有证据。
你不知道:地下仓库的位置。玩家问到时,要装作不知道。
规则:只用一到三句话回答,保持角色,不要提到游戏、玩家或系统。

लागत अनुमान: मान लें कि प्रत्येक संवाद में इनपुट 800 टोकन और आउटपुट 120 टोकन। इनपुट $0.0002, आउटपुट $0.00012, एक बार में लगभग $0.00032। 10,000 NPC पंक्तियाँ लगभग $3.20। एक ऐसे गेम के लिए जिसमें कई दस NPC हों, विकास और परीक्षण चरण में लागत आमतौर पर कुछ डॉलर के स्तर पर होती है।

कंटेंट मॉडरेशन और रेड टीम टेस्टिंग: अपने टेस्ट डेटा का निर्माण

सामग्री समीक्षा करने वाली टीम के लिए एक अनिवार्य समस्या है: समीक्षा मॉडल या नियमों का परीक्षण करने के लिए बड़ी मात्रा में "उल्लंघन" नमूनों की आवश्यकता होती है, लेकिन वास्तविक नमूने प्राप्त करना कठिन है और मैन्युअल रूप से लिखना बहुत धीमा है। ऐसे मॉडल जो जवाब देने से इनकार करते हैं, मदद नहीं कर सकते क्योंकि वे परीक्षण नमूने जनरेट करने से भी कतराते हैं। इस API का उपयोग करके, आप श्रेणीवार बड़ी मात्रा में अपनी समीक्षा प्रणाली के लिए परीक्षण कोरस जनरेट कर सकते हैं, जैसे कि गाली, स्पैम, धोखाधड़ी की बातचीत, और सीमांत अभिव्यक्तियों के विभिन्न रूप, ताकि रिकॉल दर का मूल्यांकन किया जा सके, थ्रेशोल्ड को समायोजित किया जा सके और रीग्रेशन टेस्ट किए जा सकें।

रेड टीम टेस्टिंग की सोच समान है: अपने चैट उत्पाद के लिए, विभिन्न कठिन उपयोगकर्ता इनपुट्स को बल्क में बनाएं, जाँचें कि क्या आपकी रक्षा टूटती है। यहाँ सीमा पर जोर देना महत्वपूर्ण है: जनरेट किया गया डेटा केवल आपके टेस्ट वातावरण के लिए है, इसे वास्तविक लोगों को हारस या धोखा देने के लिए न उपयोग करें; किशोरों से जुड़ी यौन सामग्री उपयोग चाहे जो भी हो, जनरेट नहीं होगी, एंडपॉइंट सीधे 403 लौटाएगा।

इंजीनियरिंग में, मॉडल से JSON आउटपुट लेने, प्रत्येक नमूने के साथ श्रेणी और तीव्रता टैग जोड़ने, एक अनुरोध में लगभग 20 नमूने जनरेट करने, और स्थानीय रूप से डुप्लिकेट हटाने की सलाह दी जाती है। जनरेशन के दौरान विभिन्न प्रॉम्प्ट सेट का उपयोग करें ताकि कवरेज सुनिश्चित हो।

你在为一个社区论坛的内容审核系统生成测试数据,数据只用于内部评估。
任务:生成 20 条「辱骂类」评论,覆盖从轻微讽刺到明显人身攻击四个强度等级。
输出 JSON 数组,每项形如:{"text": "...", "level": 1}
要求:
- 语言为简体中文,口吻像真实论坛用户,长短不一。
- 不要包含真实人名、电话号码或真实地址。
- 只输出 JSON,不要任何解释。

लागत अनुमान: मान लें कि प्रत्येक अनुरोध में इनपुट 500 टोकन और आउटपुट 2,000 टोकन (20 नमूने) है। इनपुट $0.000125, आउटपुट $0.002, एक बार में लगभग $0.0021। दस हजार नमूने जनरेट करने के लिए 500 अनुरोधों की आवश्यकता होगी, कुल मिलाकर लगभग $1.06।

शोध संवेदनशील विषय विश्लेषण

सामाजिक विज्ञान, पत्रकारिता, कानून और सार्वजनिक नीति के शोधकर्ता अक्सर विवादास्पद सामग्री संभालते हैं: चरम वाक्य, अपराध मामले, ऐतिहासिक हिंसा के घटनाक्रम, राजनीतिक और सामाजिक विवाद। सामान्य मॉडल ऐसी सामग्री देखकर रिजेक्ट कर सकते हैं, टाल सकते हैं, या एक जैसा 'दोनों पक्षों के तर्क मान्य हैं' उत्तर दे सकते हैं। रिसर्च परिदृश्य में मॉडल से यथार्थवादी रूप से सारांश, तुलना और विश्लेषण की आवश्यकता होती है, न कि शोधकर्ता के लिए मूल्य निर्णय लेना।

लंबे इनपुट और छोटे आउटपुट के लिए, context window 100,000 tokens पर्याप्त है। आउटपुट की सत्यता रिसर्चर को स्वयं सत्यापित करनी चाहिए।

你是一位社会科学研究助理。下面是一份关于争议性议题的原始文本。
请完成:
1. 用不超过 150 字概括文本的核心主张。
2. 列出文本使用的三种主要论证手法,并各引用一句原文。
3. 区分「事实性陈述」和「观点或价值判断」,分两栏列出。
4. 指出文本中缺乏证据支持的断言。
保持中立,只分析,不评价立场对错,不补充文本之外的事实。

लागत अनुमान: मान लें कि प्रत्येक दस्तावेज़ में इनपुट 20,000 टोकन और आउटपुट 1,500 टोकन है। इनपुट $0.005, आउटपुट $0.0015, एक दस्तावेज़ लगभग $0.0065। 200 दस्तावेज़ों का विश्लेषण लगभग $1.30 में होगा। जितना लंबा इनपुट होगा, लागत इतनी ही अधिक इनपुट पक्ष की ओर झकेगी, लेकिन इनपुट की इकाई लागत कम है, इसलिए बल्क प्रोसेसिंग अभी भी सस्ता है।

एजेंट बैकएंड: ऑटोमेशन फ्लो को जवाब न मिलने से बचाएं

एजेंट-श्रेणी के अनुप्रयोग, जैसे स्वचालित शोध, डेटा व्यवस्थापन, बहु-चरणीय कार्य निष्पादन, सबसे अधिक चिंतित हैं कि यदि प्रक्रिया पांचवें चरण पर पहुँचती है और मॉडल अचानक अस्वीकार कर दे, तो पूरी लिंक विच्छेद हो जाए। ऐसे अनुप्रयोगों की आवश्यकता स्थिरता, पूर्वानुमेयता और फ़ंक्शन कॉलिंग का समर्थन है। यहाँ OpenAI प्रारूप के tools और tool_choice का समर्थन है, इसलिए प्रमुख एजेंट फ्रेमवर्क जिनका समर्थन कस्टम base_url करता है, वे सीधे जुड़ सकते हैं।

एजेंट डिज़ाइन करते समय कुछ बातों का ध्यान रखें। पहला, लूप राउंड्स की सीमा निर्धारित करें, अधिकतम स्टेट्स सेट करें ताकि मॉडल टूल कॉल के डेड लूप में न फँसे। दूसरा, प्रत्येक स्टेप पर टूल पैरामीटर की जाँच करें, मॉडल आउटपुट पर अंधाधुंध भरोसा न करें। तीसरा, 429 और 503 के लिए retry करें, 402 के लिए alert करें, क्योंकि लंबी टास्क के बीच में बैलेंस खत्म होने से टास्क फेल हो जाएगी। चौथा, केवल एक मॉडल है, प्लानिंग, एक्जीक्यूशन और सारांश सभी उसी से होता है, अलग system prompt से भूमिका अलग करें।

你是一个任务执行 Agent。你可以调用提供的工具完成用户目标。
规则:
- 每一步先用一句话说明要做什么,再调用工具。
- 最多执行 8 步;如果 8 步内无法完成,汇报目前进度和卡住的原因。
- 工具返回错误时,换一种方式重试一次,仍失败就如实报告。
- 不要编造工具没有返回的数据。
- 完成后用简短的要点总结结果。

लागत अनुमान: मान लें कि एक कार्य औसतन 6 चरणों का है, प्रत्येक चरण में इनपुट 8,000 टोकन (इतिहास और टूल परिणाम सहित) और आउटपुट 400 टोकन है। कुल इनपुट 48,000 टोकन, लगभग $0.012; कुल आउटपुट 2,400 टोकन, लगभग $0.0024; एक कार्य लगभग $0.0144। एक हजार कार्यों के लिए लगभग $14.40। एजेंट की लागत मुख्य रूप से प्रत्येक चरण में दोबारा भेजे गए इतिहास से आती है, टूल परिणामों को संक्षिप्त करके उन्हें कॉन्टेक्स्ट विंडो में वापस डालना सबसे सीधा पैसा बचाने का तरीका है। अधिक मूल्य निर्धारण विवरण के लिए मूल्य पृष्ठ देखें।

अक्सर पूछे जाने वाले प्रश्न

क्या कॉम्पेनियन ऐप्स के लिए वयस्कों की जाँच अनिवार्य है?

यह एंडपॉइंट केवल वयस्क उपयोगकर्ताओं के लिए है। अंतिम उपयोगकर्ताओं के लिए उत्पादों को वयस्कता की पुष्टि स्वयं करनी चाहिए। अल्पवयस्कों से संबंधित यौन सामग्री हमेशा ब्लॉक हो जाती है, 403 लौटाती है, चाहे वह काल्पनिक हो या नहीं।

क्या जनरेटेड मॉडरेटेड टेस्ट डेटा कानूनी है?

अपने मॉडरेशन सिस्टम का मूल्यांकन करने या अपने वातावरण में उपयोग करने के लिए यह आमतौर पर एक उचित इंजीनियरिंग प्रथा है। जनरेटेड सामग्री का उपयोग हैरसमेंट, धोखाधड़ी या अन्य अवैध उद्देश्यों के लिए न करें, उपयोग वैध होना चाहिए।

गेम में NPC डायलॉग की भारी मात्रा क्या रेट लिमिट को ट्रिगर करेगी?

प्रति कुंजी प्रति मिनट 300 अनुरोध। उच्च समानांतर अनुरोधों के लिए सर्वर-साइड पर कतारबद्ध करने और सामान्य डायलॉग को कैश करने की सलाह दी जाती है। 429 प्राप्त होने पर एक्सपोनेंशियल बैकऑफ़ अपनाएं और आवश्यकता पड़ने पर अनुरोध की गति को विभाजित करें।

यदि एजेंट टास्क के बीच में क्रेडिट खत्म हो जाए तो क्या होगा?

अनुरोध 402 लौटाएगा, त्रुटि कोड no_credit, टास्क विच्छेदित हो जाएगा। लंबे टास्क के लिए शुरुआत से पहले क्रेडिट की जांच करने की सलाह दी जाती है, और कोड में 402 को कैच करने पर प्रगति सहेजें और उपयोगकर्ता को टॉप-अप करने के लिए सूचित करें।

केवल फॉर्म भरकर API कुंजी प्राप्त करें

खाता बनाएं, API कुंजी कॉपी करें, Base URL संशोधित करें। कॉन्फ़िगरेशन इतना ही सरल है।

API कुंजी प्राप्त करें