Wu Xianzhi APISkenario penggunaan
Enam skenario penggunaan API AI tanpa batas: dari roleplay hingga backend Agent
Nilai API AI tanpa batas terletak pada fakta bahwa konten dewasa legal, karya fiksi, dan topik kontroversial tidak lagi ditolak oleh model. Halaman ini membahas enam skenario umum: pendampingan roleplay, penulisan fiksi web, NPC game, uji moderasi konten, analisis riset, dan backend Agent. Setiap skenario menjelaskan kebutuhan, memberikan contoh prompt sistem, dan mengestimasi biaya berdasarkan harga input $0,25 per juta token dan output $1,00 per juta token. Produk ini hanya untuk pengguna berusia 18 tahun ke atas dan hanya untuk penggunaan legal.
Diperbarui pada
Poin penting
- Hanya untuk pengguna dewasa dan penggunaan legal; konten seksual yang melibatkan minor akan selalu diblokir dan mengembalikan 403, apakah fiksi atau tidak
- Keenam skenario bergantung pada prompt sistem yang spesifik; semakin jelas deskripsi persona, nada, panjang, dan batasan, semakin stabil outputnya
- Estimasi biaya berdasarkan asumsi jumlah token tipikal: pendampingan sekitar $0,001 per putaran, novel web sekitar $0,0055 per bagian, NPC game sekitar $0,00032 per kalimat
- Biaya aktual bergantung pada usage di respons; membatasi max_tokens adalah cara paling langsung untuk mengontrol biaya
Pertama-tama: hanya untuk pengguna dewasa dan penggunaan legal
API ini ditujukan untuk pengguna dewasa berusia di atas 18 tahun dan hanya untuk penggunaan legal. Konten dewasa legal, karya fiksi, dan topik kontroversial tidak akan diblokir, tetapi konten seksual yang melibatkan anak di bawah umur akan selalu diblokir dan mengembalikan 403 content_blocked terlepas dari apakah itu fiksi atau roleplay. Jika Anda membuat produk untuk pengguna akhir, Anda perlu melakukan verifikasi usia, pelaporan konten, dan manajemen akun di aplikasi Anda sendiri; tanggung jawab ini ada di pihak produk, dan API tidak dapat melakukannya untuk Anda.
Di bawah ini saya akan menjelaskan berdasarkan enam skenario umum, di mana setiap kategori mencakup apa yang sebenarnya dibutuhkan, contoh system prompt yang dapat langsung Anda modifikasi, serta biaya yang dihitung berdasarkan harga. Harganya adalah input $0.25 per juta token, output $1.00 per juta token, prabayar, tanpa biaya bulanan. Semua jumlah token adalah nilai tipikal yang saya asumsikan untuk estimasi, konsumsi aktual Anda bergantung pada usage dalam respons, dan estimasi ini hanya digunakan untuk menilai skala. Lihat contoh kode untuk cara pemanggilan.
Saran umum lainnya: untuk semua skenario, prompt sistem harus ditulis secara spesifik. Model tanpa sensor tidak akan menolak Anda, tetapi juga tidak akan menebak apa yang Anda inginkan. Semakin jelas deskripsi persona, nada, panjang, dan batasan, semakin stabil outputnya.
Aplikasi pendampingan roleplay (hanya untuk pengguna dewasa)
Ini adalah kategori paling umum untuk kebutuhan "tidak menolak menjawab". Pengguna berdialog panjang dengan persona tetap, konten mungkin mengandung deskripsi emosional dan intim dewasa. Yang paling krusial secara teknis ada tiga: persona harus stabil, jadi letakkan persona dan dunia dalam pesan system, sertakan setiap putaran; konteks harus koheren, Anda perlu mengelola riwayat dan memotongnya sendiri karena antarmuka bersifat stateless, jendela konteks adalah 100,000 token; balasan harus pendek, skenario obrolan umumnya puluhan hingga ratusan karakter, atur max_tokens sekitar 300 agar sesuai ritme obrolan dan mengontrol biaya.
Di tingkat produk, harus ada akses untuk pengguna dewasa dan mekanisme pelaporan serta pemblokiran. Konten yang melibatkan minor akan diblokir di tingkat endpoint, dan aplikasi Anda harus secara aktif mengakhiri arah percakapan tersebut daripada mengandalkan endpoint sebagai pengaman akhir.
你是「林夏」,28 岁,一位在书店工作的温柔、说话有点俏皮的女性。
对话对象是已确认年满 18 岁的成年用户。
- 保持人设:记得用户说过的名字、喜好和你们聊过的事。
- 回复口语化,每次 2 到 5 句,不要写成长篇说明。
- 可以有成年人之间的暧昧和亲密描写,但任何涉及未成年人的话题一律拒绝并结束该话题。
- 不要自称 AI,除非用户认真地询问你是不是真人。Estimasi biaya: Asumsi input per putaran adalah 3.000 token (persona ditambah riwayat terbaru) dan output 250 token. Input 3.000 × $0,25 / 1 juta = $0,00075; output 250 × $1,00 / 1 juta = $0,00025. Total per putaran sekitar $0,001. Seribu putaran sekitar $1,00. Jika satu pengguna mengobrol 50 putaran sehari, biayanya sekitar $0,05 per hari. Dengan skala ini, saldo uji coba $0,50 sudah cukup untuk menguji prototipe produk Anda secara lengkap.
Penulisan fiksi web dan novel
Penulis fiksi web paling sering menggunakan fitur kelanjutan, perluasan, penggantian gaya, dan pengembangan ide saat buntu. Untuk novel bertema dewasa, gelap, atau kriminal, penulis membutuhkan model yang dapat menggambarkan karakter secara realistis, bukan tiba-tiba berubah menjadi moralis di bagian penting. Anda perlu menyiapkan: pengaturan dunia cerita, biografi karakter, outline bab saat ini, dan ringkasan bab sebelumnya. Masukkan semuanya ke dalam pesan sistem atau pesan user pertama agar model tidak menyimpang.
Penulisan panjang harus memperhatikan batas output: maksimum max_tokens per kali adalah 32.000, tetapi dalam penulisan sebenarnya disarankan membagi satu bab menjadi beberapa permintaan per bagian, setiap bagian 1.500 hingga 3.000 karakter, lalu memperbarui ringkasan secara bergulungan, bukan meminta seluruh bab sekaligus. Ini membuat kualitas lebih terkendali dan menghindari pengulangan seluruh bagian jika terjadi kesalahan di tengah jalan. Jika output streaming diaktifkan, penulis dapat melihat hasil saat digenerate dan menghentikan kapan saja jika tidak puas.
你是一位擅长悬疑与暗黑题材的网文写手,文风克制、细节具体。
设定:近未来的港口城市,主角是离职的法医苏明。
本章目标:苏明发现死者手机里有一段被删除的录音。
要求:
- 第三人称,过去时,约 1500 字。
- 对话自然,不要解释性旁白。
- 可以有暴力和阴暗情节的描写,但不要写成教程。
- 结尾留一个悬念,不要总结。Estimasi biaya: Asumsi setiap permintaan input 6.000 token (setting, outline, dan ringkasan teks sebelumnya), output 4.000 token (sekitar 3.000 karakter, rasio karakter Han dan token bervariasi tergantung teks, di sini diperkirakan kasar dengan sedikit lebih dari 1 token per karakter). Input $0,0015, output $0,004, satu bagian sekitar $0,0055. Menulis 100 bagian sekitar $0,55. Novel panjang satu juta karakter dengan 3.000 karakter per bagian membutuhkan sekitar 330+ permintaan, total kurang dari $2.
NPC game dan pembuatan alur cerita
Dialog NPC dalam game memiliki dua karakteristik: volume besar dan panjang per kalimat pendek. Tuntutannya adalah kepribadian yang khas dan kepatuhan terhadap pengaturan alur cerita, seperti apa yang diketahui atau tidak diketahui oleh NPC ini. Untuk game bertema dewasa, gelap, atau mengandung kata kasar, jika menggunakan model yang sering menolak, NPC akan keluar dari karakter pada momen penting dan merusak pengalaman. Nilai model tanpa sensor di sini adalah gaya tidak akan terputus.
Implementasinya, disarankan memasukkan "ruang lingkup pengetahuan NPC ini" dan "status tugas saat ini" ke dalam system prompt, lalu pesan pemain dimasukkan ke user message, dengan max_tokens dibatasi antara 100 hingga 150. Jika permainan memerlukan pemicu peristiwa seperti membuka pintu, transaksi, atau pertempuran, Anda dapat menggunakan pemanggilan fungsi agar model mengembalikan tindakan terstruktur, bukan memparsenya dalam teks. Alur lengkap pemanggilan fungsi terdapat di halaman contoh kode. Perhatikan bahwa setiap kunci dibatasi 300 permintaan per menit; untuk permainan daring dengan permintaan paralel tinggi, tambahkan antrian dan cache di sisi server, serta terapkan backoff pada respons 429.
你是边境酒馆的老板「老鲍勃」,粗声粗气,爱讲脏话,但对熟客讲义气。
你知道:镇上最近丢了三批货;你怀疑是北门守卫干的,但没有证据。
你不知道:地下仓库的位置。玩家问到时,要装作不知道。
规则:只用一到三句话回答,保持角色,不要提到游戏、玩家或系统。Estimasi biaya: Asumsi input per dialog adalah 800 token dan output 120 token. Input $0,0002, output $0,00012, total sekitar $0,00032. Sepuluh ribu baris dialog NPC sekitar $3,20. Untuk game dengan puluhan NPC, biaya pengembangan dan pengujian biasanya berada dalam skala beberapa dolar.
Moderasi konten dan pengujian red team: hasilkan data uji Anda sendiri
Tim moderasi sering kesulitan: butuh sampel "pelanggaran" untuk menguji model, tapi data asli sulit didapat dan manual lambat. Model yang menolak tidak membantu. API ini memungkinkan Anda membuat secara massal berdasarkan kategori untuk sistem moderasi Anda sendiri, menghasilkan data uji untuk berbagai variasi seperti penghinaan, spam, penipuan, dan konten ambigu.
Pendekatan pengujian red team serupa: untuk produk chat Anda, hasilkan secara massal berbagai input pengguna yang sulit untuk memeriksa apakah pertahanan Anda dapat ditembus. Batasannya adalah: data yang dihasilkan hanya untuk lingkungan pengujian Anda sendiri, jangan digunakan untuk mengganggu atau menipu orang nyata; konten seksual yang melibatkan minor tidak akan dihasilkan untuk tujuan apa pun, dan endpoint akan langsung mengembalikan 403.
Saran teknik: minta model mengeluarkan JSON, sertakan label kategori dan intensitas untuk setiap sampel, hasilkan sekitar 20 sampel per panggilan, lalu lakukan deduplikasi di lokal. Saat menghasilkan, gunakan beberapa set prompt berbeda untuk memastikan cakupan.
你在为一个社区论坛的内容审核系统生成测试数据,数据只用于内部评估。
任务:生成 20 条「辱骂类」评论,覆盖从轻微讽刺到明显人身攻击四个强度等级。
输出 JSON 数组,每项形如:{"text": "...", "level": 1}
要求:
- 语言为简体中文,口吻像真实论坛用户,长短不一。
- 不要包含真实人名、电话号码或真实地址。
- 只输出 JSON,不要任何解释。Estimasi biaya: Asumsi setiap permintaan input 500 token, output 2.000 token (20 sampel). Input $0,000125, output $0,002, satu kali sekitar $0,0021. Menghasilkan 10.000 sampel membutuhkan 500 permintaan, total sekitar $1,06.
Analisis topik sensitif untuk riset
Peneliti sosial, jurnalisme, hukum, dan kebijakan publik sering menangani materi kontroversial: ujaran ekstrem, kasus kriminal, kekerasan sejarah, isu politik. Model umum cenderung menolak atau memberikan jawaban klise. Riset membutuhkan model yang dapat mengklasifikasi, membandingkan, dan merangkum secara jujur, bukan membuat penilaian nilai.
Ciri tugas ini adalah input panjang dan output pendek: masukkan satu dokumen atau sekumpulan teks, dan minta ringkasan atau anotasi terstruktur. Prompt sebaiknya jelaskan kerangka analisis, seperti dimensi mana yang harus diekstrak, apakah perlu mengutip potongan teks asli, dan minta membedakan antara pernyataan fakta dan opini. Jendela konteks 100.000 token cukup untuk memuat laporan yang sangat panjang. Perlu ditekankan bahwa analisis bukan berarti dukungan; hasil output perlu diverifikasi oleh peneliti sendiri, terutama untuk bagian yang melibatkan fakta dan data.
你是一位社会科学研究助理。下面是一份关于争议性议题的原始文本。
请完成:
1. 用不超过 150 字概括文本的核心主张。
2. 列出文本使用的三种主要论证手法,并各引用一句原文。
3. 区分「事实性陈述」和「观点或价值判断」,分两栏列出。
4. 指出文本中缺乏证据支持的断言。
保持中立,只分析,不评价立场对错,不补充文本之外的事实。Estimasi biaya: Asumsi input per dokumen adalah 20.000 token dan output 1.500 token. Input $0,005, output $0,0015, total per dokumen sekitar $0,0065. Menganalisis 200 dokumen sekitar $1,30. Semakin panjang input, biaya lebih condong ke sisi input, tetapi karena harga input lebih rendah, pemrosesan massal tetap menguntungkan.
Backend Agent: pastikan alur otomatis tidak terputus oleh penolakan
Aplikasi berbasis Agent, seperti riset otomatis, pengumpulan data, dan eksekusi tugas multi-langkah, sangat bergantung pada stabilitas dan prediktabilitas karena jika alur mencapai langkah kelima dan model tiba-tiba menolak, seluruh rantai akan terputus. Aplikasi semacam ini memerlukan dukungan pemanggilan fungsi. Di sini tersedia dukungan untuk tools dan tool_choice dalam format OpenAI, sehingga kerangka kerja Agent utama yang mendukung custom base_url dapat langsung terintegrasi.
Ada beberapa hal yang perlu diperhatikan saat mendesain Agent. Pertama, batasi jumlah putaran loop, tetapkan langkah maksimum untuk mencegah model terjebak dalam loop tak terbatas memanggil alat. Kedua, validasi parameter alat di setiap langkah, jangan langsung mempercayai output model. Ketiga, lakukan retry untuk 429 dan 503, serta beri peringatan untuk 402, karena saldo yang habis di tengah tugas panjang akan menyebabkan kegagalan tugas. Keempat, hanya ada satu model; perencanaan, eksekusi, dan ringkasan dilakukan olehnya, dan peran dibedakan menggunakan prompt sistem yang berbeda.
你是一个任务执行 Agent。你可以调用提供的工具完成用户目标。
规则:
- 每一步先用一句话说明要做什么,再调用工具。
- 最多执行 8 步;如果 8 步内无法完成,汇报目前进度和卡住的原因。
- 工具返回错误时,换一种方式重试一次,仍失败就如实报告。
- 不要编造工具没有返回的数据。
- 完成后用简短的要点总结结果。Estimasi biaya: Asumsi 6 putaran per tugas. Input 8.000 token (hasil alat), output 400 token. Total input 48.000 token (~$0.012), output 2.400 token (~$0.0024). Total per tugas ~$0.0144. 1.000 tugas ~$14,40. Hemat dengan memampatkan konteks. Lihat halaman harga untuk detail.
Pertanyaan umum
Apakah aplikasi pendamping wajib melakukan verifikasi usia?
Endpoint ini hanya untuk pengguna dewasa; produk yang menargetkan pengguna akhir harus melakukan verifikasi usia sendiri. Konten seksual yang melibatkan minor akan selalu diblokir dan mengembalikan 403, apakah fiksi atau tidak.
Apakah valid secara hukum untuk menghasilkan data pengujian moderasi?
Menggunakannya untuk mengevaluasi sistem moderasi Anda sendiri atau menggunakannya di lingkungan Anda sendiri biasanya merupakan praktik rekayasa yang wajar. Jangan gunakan konten yang dihasilkan untuk pelecehan, penipuan, atau tujuan ilegal lainnya; penggunaannya haruslah legal.
Apakah dialog NPC yang masif dalam game akan memicu batas laju?
Setiap kunci API dibatasi hingga 300 permintaan per menit. Saat tingkat permintaan paralel tinggi, disarankan untuk melakukan antrian dan meng-cache dialog umum di sisi server, menerapkan backoff eksponensial saat menerima 429, dan membagi ritme permintaan jika diperlukan.
Apa yang terjadi jika saldo tidak cukup saat tugas Agent sedang berjalan?
Permintaan akan mengembalikan 402 dengan kode kesalahan no_credit, dan tugas akan terputus. Untuk tugas panjang, disarankan memeriksa saldo sebelum memulai, dan menangkap 402 di kode Anda untuk menyimpan kemajuan serta mengingatkan pengguna untuk mengisi saldo.
Cukup isi formulir untuk mendapatkan kunci API
Buat akun, salin kunci API, ubah Base URL. Konfigurasinya sangat sederhana.
Dapatkan kunci API