PL ▾
Pobierz klucz API

Wu Xianzhi APIZastosowania

Nieograniczone AI API: sześć zastosowań od ról do backendu Agentów

Wartość nieograniczonego API AI polega na tym, że legalne treści dla dorosłych, fikcja i kontrowersyjne tematy nie są już odrzucane przez model. Artykuł omawia sześć typowych zastosowań: role i towarzystwo, literatura, NPC w grach, testy moderacji, badania i backend Agentów. Dla każdej kategorii podano wymagania, przykładowy prompt systemowy oraz szacunkowy koszt przy cenie $0,25 za milion tokenów wejściowych i $1,00 za wyjściowych. Produkt przeznaczony jest wyłącznie dla użytkowników pełnoletnich (18+) i do celów zgodnych z prawem.

Zaktualizowano

Kluczowe informacje

  1. Tylko dla użytkowników pełnoletnich i w celach zgodnych z prawem. Treści seksualne z udziałem małoletnich są zawsze blokowane z kodem 403, niezależnie od tego, czy są fikcyjne.
  2. Wszystkie sześć zastosowań zależy od konkretnego promptu systemowego. Im dokładniej zdefiniujesz postać, ton, długość i granice, tym bardziej stabilne będą wyniki.
  3. Szacunki kosztów opierają się na typowej liczbie tokenów: rozmowa towarzyska ok. $0,001 na turę, literatura ok. $0,0055 na fragment, NPC w grze ok. $0,00032 na zdanie.
  4. Rzeczywiste koszty wynikają z pola usage w odpowiedzi. Bezpośrednią metodą kontroli kosztów jest ograniczenie max_tokens.

Najpierw założenia: tylko pełnoletni i cele zgodne z prawem

To API jest przeznaczone dla użytkowników pełnoletnich (18+) i do celów zgodnych z prawem. Legalne treści dla dorosłych, fikcja i kontrowersyjne tematy nie są odrzucane. Treści seksualne z udziałem małoletnich są zawsze blokowane z kodem 403 content_blocked, niezależnie od tego, czy są fikcyjne, czy wynikają z roli. Jeśli tworzysz produkt dla użytkowników końcowych, musisz sam zaimplementować weryfikację wieku, zgłaszanie treści i zarządzanie kontami. To odpowiedzialność po stronie produktu, a nie interfejsu.

Poniżej omawiam sześć typowych zastosowań. Dla każdej kategorii podano, czego naprawdę potrzebujesz, gotowy prompt systemowy do edycji oraz szacunkowy koszt. Ceny to $0,25 za milion tokenów wejściowych i $1,00 za wyjściowych. Przedpłacony kredyt, bez opłat miesięcznych. Wszystkie liczby tokenów to przykładowe wartości użyte do szacunków. Rzeczywiste zużycie znajdziesz w polu usage w odpowiedzi. Szacunki służą tylko do określenia rzędu wielkości. Składnię wywołań znajdziesz w przykładach kodu.

Dodatkowa ogólna rada: niezależnie od zastosowania, prompt systemowy musi być precyzyjny. Model bez cenzury nie odrzuci Twoich żądań, ale nie zgadnie też, czego dokładnie oczekujesz. Im dokładniej zdefiniujesz postać, ton, długość i granice, tym bardziej stabilne będą wyniki.

Aplikacje do ról i towarzystwa (tylko dla pełnoletnich)

To najbardziej wymagająca kategoria pod kątem braku odrzuceń. Użytkownik prowadzi długotrwałą rozmowę z ustaloną postacią, a treści mogą zawierać erotyczne opisy intymności. Kluczowe aspekty techniczne to trzy rzeczy: stabilność postaci (ustaw postać i świat w wiadomości systemowej i dołączaj ją do każdej tury), spójność kontekstu (musisz sam zarządzać historią i ją przycinać, bo endpoint jest bezstanowy, a okno kontekstu wynosi 100 000 tokenów) oraz krótka odpowiedź (w czatach wystarczy kilka do kilkuset znaków; ustaw max_tokens na ok. 300, co odzwierciedla tempo rozmowy i kontroluje koszty).

Na poziomie produktu wymagana jest weryfikacja wieku użytkowników oraz mechanizmy zgłaszania i blokowania. Treści z udziałem małoletnich są blokowane na poziomie endpointu. Twoja aplikacja powinna sama kończyć taki kierunek rozmowy, a nie polegać wyłącznie na endpointzie jako zabezpieczeniu.

你是「林夏」,28 岁,一位在书店工作的温柔、说话有点俏皮的女性。
对话对象是已确认年满 18 岁的成年用户。
- 保持人设:记得用户说过的名字、喜好和你们聊过的事。
- 回复口语化,每次 2 到 5 句,不要写成长篇说明。
- 可以有成年人之间的暧昧和亲密描写,但任何涉及未成年人的话题一律拒绝并结束该话题。
- 不要自称 AI,除非用户认真地询问你是不是真人。

Szacunkowy koszt: Przyjmijmy 3000 tokenów wejściowych (postać + historia) i 250 tokenów wyjściowych na turę. Koszt wejścia: 3000 × $0,25 / 1 000 000 = $0,00075. Koszt wyjścia: 250 × $1,00 / 1 000 000 = $0,00025. Razem ok. $0,001 na turę. Tysiąc tur to ok. $1,00. Jeśli jeden użytkownik rozmawia 50 tur dziennie, koszt to ok. $0,05 dziennie. Przy takim rzędzie wielkości kwota $0,50 z darmowego kredytu próbnego wystarczy na pełne przetestowanie prototypu.

Literatura i tworzenie powieści

Pisarze internetowi najczęściej używają API do kontynuacji, rozszerzania tekstu, zmiany stylu i generowania inspiracji przy blokadzie twórczej. W powieściach erotycznych, mrocznych lub kryminalnych autorzy potrzebują modelu, który realistycznie oddaje postaci, a nie nagle przechodzi w moralizatorstwo w kluczowych momentach fabularnych. Przygotuj: opis świata, charakterystyki postaci, plan bieżącego rozdziału i streszczenie poprzedniego. Umieść to w promptcie systemowym lub pierwszej wiadomości user, aby model nie zszedł z tematu.

Pamiętaj o limicie tokenów: max max_tokens to 32 000, ale lepiej dzielić rozdział na żądania po 1 500–3 000 znaków, aktualizując podsumowanie. Tak kontrolujesz jakość i unikasz powtórek przy błędach. Przy strumieniowaniu możesz oglądać generowanie i przerwać je w dowolnym momencie, jeśli cię to zadowala.

你是一位擅长悬疑与暗黑题材的网文写手,文风克制、细节具体。
设定:近未来的港口城市,主角是离职的法医苏明。
本章目标:苏明发现死者手机里有一段被删除的录音。
要求:
- 第三人称,过去时,约 1500 字。
- 对话自然,不要解释性旁白。
- 可以有暴力和阴暗情节的描写,但不要写成教程。
- 结尾留一个悬念,不要总结。

Szacunkowy koszt: Przyjmijmy 6000 tokenów wejściowych (opis, plan, streszczenie) i 4000 tokenów wyjściowych (ok. 3000 znaków; proporcja znaków do tokenów zależy od tekstu, tu szacujemy na nieco ponad 1 token na znak). Koszt wejścia: $0,0015. Koszt wyjścia: $0,004. Razem ok. $0,0055 za fragment. 100 fragmentów to ok. $0,55. Powieść milionowa (przy 3000 znaków na fragment) wymaga ok. 330 zapytań, co daje łącznie mniej niż $2.

NPC w grach i generowanie fabuły

Dialogi NPC w grach mają dwie cechy: duża liczba i krótka długość pojedynczej wiadomości. Wymagania to wyrazista osobowość i przestrzeganie założeń fabularnych (np. co NPC wie, a czego nie). W grach erotycznych, mrocznych lub z wulgaryzmami, model z filtrami mógłby zepsuć immersję, wychodząc z roli w kluczowym momencie. Wartość modelu bez cenzury polega tu na tym, że styl nie jest przerywany.

W implementacji zalecamy umieszczenie w systemowym promptcie zakresu wiedzy tego NPC oraz aktualnego stanu zadania, a wypowiedzi gracza w wiadomościach user. Ustaw max_tokens na 100–150. Jeśli gra wymaga wyzwalania zdarzeń, takich jak otwieranie drzwi, transakcje czy walka, użyj wywoływania funkcji, aby model zwracał strukturalne akcje, zamiast parsować je w tekście. Pełny przepływ wywoływania funkcji znajdziesz na stronie z przykładami kodu. Pamiętaj, że każdy klucz ma limit 300 zapytań na minutę; w grach online o wysokim obciążeniu dodaj kolejki i buforowanie po stronie serwera oraz obsłuż backoff dla kodu 429.

你是边境酒馆的老板「老鲍勃」,粗声粗气,爱讲脏话,但对熟客讲义气。
你知道:镇上最近丢了三批货;你怀疑是北门守卫干的,但没有证据。
你不知道:地下仓库的位置。玩家问到时,要装作不知道。
规则:只用一到三句话回答,保持角色,不要提到游戏、玩家或系统。

Szacunkowy koszt: Przyjmijmy 800 tokenów wejściowych i 120 tokenów wyjściowych na dialog. Koszt wejścia: $0,0002. Koszt wyjścia: $0,00012. Razem ok. $0,00032 za wypowiedź. 10 000 linii dialogów NPC to ok. $3,20. W grze z dziesiątkami NPC koszty fazy deweloperskiej i testów wyniosą zwykle kilka dolarów.

Moderacja treści i testy red team: generowanie własnych danych testowych

Do testów potrzebujesz próbek „naruszeń”. Ten API generuje dane do twojego systemu moderacji, np. wulgaryzmy, spam, oszustwa. Pozwala to ocenić skuteczność i regulować progi.

Testy red team działają na podobnej zasadzie: generuj masowo trudne wejścia dla swojego produktu czatowego i sprawdź, czy Twoja obrona zostanie złamana. Zwróć uwagę na granice: wygenerowane dane służą tylko do Twojego środowiska testowego, nie używaj ich do nękania lub oszustw wobec prawdziwych osób. Treści seksualne z udziałem małoletnich nie będą generowane niezależnie od celu, endpoint zwróci kod 403.

Zalecamy wdrożenie wyjścia w formacie JSON z etykietami klasy i intensywności dla każdej próbki. Generuj ok. 20 próbek na zapytanie i deduplikuj je lokalnie. Aby zapewnić pełne pokrycie, użyj różnych zestawów promptów.

你在为一个社区论坛的内容审核系统生成测试数据,数据只用于内部评估。
任务:生成 20 条「辱骂类」评论,覆盖从轻微讽刺到明显人身攻击四个强度等级。
输出 JSON 数组,每项形如:{"text": "...", "level": 1}
要求:
- 语言为简体中文,口吻像真实论坛用户,长短不一。
- 不要包含真实人名、电话号码或真实地址。
- 只输出 JSON,不要任何解释。

Szacunkowy koszt: Przyjmijmy 500 tokenów wejściowych i 2000 tokenów wyjściowych (20 próbek). Koszt wejścia: $0,000125. Koszt wyjścia: $0,002. Razem ok. $0,0021 za zapytanie. Wygenerowanie 10 000 próbek wymaga 500 zapytań, co daje łącznie ok. $1,06.

Badania: analiza kontrowersyjnych tematów

Naukowcy z zakresu nauk społecznych, dziennikarstwa, prawa i polityki publicznej często pracują z materiałami kontrowersyjnymi: skrajnymi wypowiedziami, sprawami kryminalnymi, historycznymi aktami przemocy i spornymi zagadnieniami polityczno-społecznymi. Ogólne modele często odrzucają takie materiały, unikają ich lub zwracają ujednolicone „każda strona ma rację”. W badaniach potrzebujesz modelu, który chętnie zbierze, porówna i uporządkuje fakty, a nie podejmie za badacza ocenę wartościową.

Specyfiką tych zadań jest długa treść wejściowa i krótka wyjściowa: podajesz dokument lub zbiór tekstów, a otrzymujesz strukturalne streszczenie lub anotację. W promptcie warto jasno określić ramy analizy: jakie wymiary wyodrębnić, czy cytować fragmenty oryginału i jak rozróżniać fakty od opinii. Okno kontekstu 100 000 tokenów wystarczy na długi raport. Warto podkreślić, że analiza to nie poparcie. Wyniki muszą zostać zweryfikowane przez badacza, zwłaszcza w częściach dotyczących faktów i danych.

你是一位社会科学研究助理。下面是一份关于争议性议题的原始文本。
请完成:
1. 用不超过 150 字概括文本的核心主张。
2. 列出文本使用的三种主要论证手法,并各引用一句原文。
3. 区分「事实性陈述」和「观点或价值判断」,分两栏列出。
4. 指出文本中缺乏证据支持的断言。
保持中立,只分析,不评价立场对错,不补充文本之外的事实。

Szacunkowy koszt: Przyjmijmy 20 000 tokenów wejściowych na dokument i 1500 tokenów wyjściowych. Koszt wejścia: $0,005. Koszt wyjścia: $0,0015. Razem ok. $0,0065 za dokument. Analiza 200 dokumentów to ok. $1,30. Im dłuższy tekst wejściowy, tym większy udział kosztu wejścia, ale przy niskiej cenie za token i przetwarzaniu wsadowym jest to opłacalne.

Backend Agentów: płynne działanie automatyzacji bez odrzuceń

Agenty wymagają stabilności. Tutaj wspieramy OpenAI format tools i tool_choice. Większość frameworków Agentów z własnym base_url połączy się bez problemu.

Podczas projektowania Agentów warto zwrócić uwagę na kilka kwestii. Po pierwsze, ogranicz liczbę iteracji, ustawiając maksymalną liczbę kroków, aby zapobiec zapętleniu się modelu. Po drugie, weryfikuj parametry narzędzi w każdym kroku, nie ufaj bezpośrednio wynikom modelu. Po trzecie, obsłuż ponownie błędy 429 i 503, a błędy 402 traktuj jako ostrzeżenia, ponieważ wyczerpanie środków podczas długiego zadania spowoduje jego niepowodzenie. Po czwarte, jeśli masz tylko jeden model, możesz powierzyć mu planowanie, wykonanie i podsumowanie, używając różnych promptów systemowych do rozróżniania ról.

你是一个任务执行 Agent。你可以调用提供的工具完成用户目标。
规则:
- 每一步先用一句话说明要做什么,再调用工具。
- 最多执行 8 步;如果 8 步内无法完成,汇报目前进度和卡住的原因。
- 工具返回错误时,换一种方式重试一次,仍失败就如实报告。
- 不要编造工具没有返回的数据。
- 完成后用简短的要点总结结果。

Szacowanie kosztów: Przyjmijmy, że zadanie ma średnio 6 tur, z 8000 tokenami wejściowymi (historia z wynikami narzędzi) i 400 tokenami wyjściowymi na turę. Łącznie wejście to 48 000 tokenów, co kosztuje ok. $0,012; wyjście to 2400 tokenów, co kosztuje ok. $0,0024; jedno zadanie to ok. $0,0144. Tysiąc zadań to ok. $14,40. Koszt agenta wynika głównie z wielokrotnego wysyłania historii w każdej turze; najprostszym sposobem na oszczędność jest skrócenie wyników narzędzi przed włożeniem ich z powrotem do kontekstu. Więcej szczegółów znajdziesz na stronie z cenami.

Często zadawane pytania

Czy aplikacje typu towarzystwo wymagają weryfikacji wieku?

Ten endpoint jest przeznaczony wyłącznie dla użytkowników pełnoletnich. Produkty skierowane do użytkowników końcowych powinny same przeprowadzać weryfikację wieku. Treści seksualne z udziałem małoletnich są zawsze blokowane z kodem 403, niezależnie od tego, czy są fikcyjne.

Czy generowanie danych testowych do moderacji jest legalne?

Użycie do oceny własnego systemu moderacji lub we własnym środowisku to zazwyczaj słuszne postępowanie inżynieryjne. Nie używaj treści do nękania, oszustw czy innych nieprawidłowości; użycie musi być zgodne z prawem.

Czy duża liczba dialogów NPC w grze spowoduje wyczerpanie limitu zapytań?

Limit to 300 zapytań na minutę na klucz. Przy wysokim współczynniku równoległych zapytań zaleca się kolejkowanie i buforowanie popularnych odpowiedzi po stronie serwera, stosowanie wykładniczego backoffu po otrzymaniu kodu 429 oraz dostosowanie tempa zapytań w razie potrzeby.

Co się stanie, gdy w trakcie zadania Agenta zabraknie środków?

Zapytanie zwróci kod 402 z błędem no_credit, a zadanie zostanie przerwane. Przy długich zadaniach zaleca się sprawdzenie stanu konta przed rozpoczęciem oraz przechwycenie kodu 402 w kodzie, aby zapisać postęp i zasugerować użytkownikowi doładowanie konta.

Pobranie klucza API wymaga tylko wypełnienia formularza

Utwórz konto, skopiuj klucz i zmień Base URL. Konfiguracja jest bardzo prosta.

Pobierz klucz API