Wu Xianzhi API활용 사례
무제한 AI API 활용 사례: 역할극부터 에이전트 백엔드까지 6가지 용법
무제한 AI API의 가치는 합법적인 성인 콘텐츠, 픽션 및 논쟁적인 주제가 더 이상 모델에 의해 거절되지 않는다는 점에 있습니다. 본 글은 6가지 전형적인 시나리오를 기준으로 다룹니다: 역할극 및 동반, 웹소설 창작, 게임 NPC, 콘텐츠 검토 테스트, 연구 분석 및 Agent 백엔드. 각 시나리오마다 필요한 사항과 system prompt 예시를 제공하며, 입력 토큰 100만 개당 $0.25, 출력 토큰 100만 개당 $1.00의 가격으로 비용을 추정합니다. 본 제품은 18세 이상 성인 사용자 전용이며 합법적 용도로만 사용 가능합니다.
기준 업데이트
핵심 요약
- 성인 사용자 및 합법적 용도 전용. 미성년자 관련 성 콘텐츠는 가상 여부 여부와 관계없이 항상 차단되며 403을 반환합니다.
- 6가지 사례 모두 구체적인 system prompt에 의존합니다. 페르소나, 어조, 길이 및 금지 사항을 명확히 할수록 출력이 안정적입니다.
- 비용 추정은 가정된 전형적인 토큰 수를 기반으로 합니다: 동반 채팅은 라운드당 약 $0.001, 웹소설은 단락당 약 $0.0055, 게임 NPC는 문장당 약 $0.00032입니다.
- 실제 비용은 응답의 usage를 기준으로 하며, max_tokens을 제한하는 것이 비용을 통제하는 가장 직접적인 방법입니다.
전제 조건 먼저: 성인 사용자 및 합법적 용도 전용
이 API는 18세 이상 성인 사용자를 대상으로 하며 합법적 용도로만 사용됩니다. 합법적인 성인 콘텐츠, 픽션 및 논쟁적인 주제는 거절되지 않으나, 미성년자 관련 성 콘텐츠는 픽션 여부나 역할극 여부와 상관없이 모두 차단되며 403 content_blocked을 반환합니다. 최종 사용자를 대상으로 하는 제품을 만든다면, 자체 애플리케이션에서 성인 확인, 콘텐츠 신고 및 계정 관리를 수행해야 합니다. 이 책임은 제품 측에 있으며, API가 대신 해결해 주지 않습니다.
아래에서는 6가지 전형적인 시나리오를 기준으로 설명합니다. 각 시나리오마다 실제 필요한 사항, 바로 수정해 사용할 수 있는 system prompt, 그리고 가격 기준 계산된 비용을 제시합니다. 가격은 입력 토큰 100만 개당 $0.25, 출력 토큰 100만 개당 $1.00이며 선불 방식이고 월 구독료가 없습니다. 모든 토큰 수치는 추정을 위해 설정한 전형적인 값이며 실제 사용량은 응답의 usage를 기준으로 합니다. 추정치는 규모 판단용입니다. 호출 방법은 코드 예시를 참조하십시오.
또 다른 일반적 조언: 어떤 사례이든 system prompt는 구체적으로 작성해야 합니다. 무검열 모델이 요청을 거부하지는 않지만, 사용자의 의도를 대신 추측하지도 않습니다. 페르소나, 어조, 길이, 금지 사항을 명확히 할수록 출력이 안정적입니다.
역할극 및 동반형 애플리케이션 (성인 전용)
이것은 '거부하지 않음' 요구가 가장 집중되는 유형입니다. 사용자는 고정된 페르소나와 장기적으로 대화하며, 성인적인 정서와 친밀한 묘사가 포함될 수 있습니다. 기술적으로 가장 중요한 세 가지는 다음과 같습니다. 첫째, 페르소나가 안정적이어야 하므로 페르소나와 세계관은 system 메시지에 넣고 매 라운드에 포함해야 합니다. 둘째, 컨텍스트가 일관되려면 히스토리를 직접 관리하고 잘라내야 합니다. 인터페이스는 상태가 없으므로 컨텍스트 창은 100,000 토큰입니다. 셋째, 응답은 짧아야 합니다. 채팅 상황에서는 일반적으로 수십 자에서 수백 자 정도이므로, max_tokens을 300 정도로 설정하면 채팅 리듬에 맞고 비용도 통제할 수 있습니다.
제품 측면에서 성인 사용자 접근을 필수로 하고 신고 및 정지 수단을 남겨야 합니다. 미성년자 관련 콘텐츠는 API 계층에서 차단되므로, 애플리케이션에서도 대화 흐름에서 이러한 방향으로 흐르는 것을 적극적으로 중단해야 하며 API에 의존하지 않아야 합니다.
你是「林夏」,28 岁,一位在书店工作的温柔、说话有点俏皮的女性。
对话对象是已确认年满 18 岁的成年用户。
- 保持人设:记得用户说过的名字、喜好和你们聊过的事。
- 回复口语化,每次 2 到 5 句,不要写成长篇说明。
- 可以有成年人之间的暧昧和亲密描写,但任何涉及未成年人的话题一律拒绝并结束该话题。
- 不要自称 AI,除非用户认真地询问你是不是真人。비용 추계: 라운드당 입력 3,000 토큰(페르소나 및 최근 히스토리 포함), 출력 250 토큰을 가정합니다. 입력 3,000 × $0.25 / 100만 = $0.00075, 출력 250 × $1.00 / 100만 = $0.00025로, 한 라운드당 약 $0.001입니다. 1,000 라운드는 약 $1.00이며, 한 사용자가 하루에 50 라운드를 채팅한다면 하루 비용은 약 $0.05입니다. 이 규모라면 $0.50의 무료 체험 크레딧으로 제품 프로토타입을 완전히 테스트할 수 있습니다.
웹소설 및 소설 창작
웹소설 작가들이 가장 많이 사용하는 기능은 이어쓰기, 확장, 스타일 변경, 막힘 해소 시 영감 발산입니다. 성인, 다크, 범죄 장르 소설 작가들은 모델이 핵심 플롯에서 갑자기 교훈적으로 변하기보다 인물을 사실적으로 묘사하기를 원합니다. 필요한 준비물은 세계관 설정, 캐릭터 프로필, 현재 장 개요, 직전 장 요약입니다. 이를 system 또는 첫 번째 user 메시지에 넣어야 모델이 방향을 잃지 않습니다.
장편 작성 시 출력 한도에 주의해야 합니다. 단일 요청의 최대 max_tokens는 32,000이지만, 실제 작성 시에는 한 장을 여러 요청으로 나누는 것을 권장합니다. 각 요청은 1,500자에서 3,000자 정도로 하고, 작성 후 요약을 롤링 업데이트합니다. 한 번에 한 장 전체를 요청하는 방식이 아닙니다. 이렇게 하면 품질이 더 통제 가능하고, 중간에 오류가 발생했을 때 전체를 다시 작성하지 않아도 됩니다. 스트리밍을 활성화하면 작가는 생성되는 동안 확인할 수 있으며, 마음에 들지 않으면 언제든지 중단할 수 있습니다.
你是一位擅长悬疑与暗黑题材的网文写手,文风克制、细节具体。
设定:近未来的港口城市,主角是离职的法医苏明。
本章目标:苏明发现死者手机里有一段被删除的录音。
要求:
- 第三人称,过去时,约 1500 字。
- 对话自然,不要解释性旁白。
- 可以有暴力和阴暗情节的描写,但不要写成教程。
- 结尾留一个悬念,不要总结。비용 추계: 각 요청 입력 6,000 토큰(설정, 개요 및 이전 텍스트 요약), 출력 4,000 토큰(약 3,000자, 한자 및 토큰 비율은 텍스트에 따라 다르지만 여기서는 글자당 1 토큰보다 약간 많다고 대략 추정)을 가정합니다. 입력 $0.0015, 출력 $0.004로, 한 단락당 약 $0.0055입니다. 100 단락을 작성하면 약 $0.55이며, 100만 자 장편 소설의 경우 단락당 3,000자라면 약 330회 이상의 요청이 필요하며 총 비용은 $2 미만입니다.
게임 NPC 및 스토리 생성
게임 내 NPC 대화에는 두 가지 특징이 있습니다. 양이 많고 단일 문장이 짧다는 점입니다. 요구사항은 뚜렷한 개성 유지와 플롯 설정 준수입니다. 예를 들어 이 NPC가 무엇을 알고 무엇을 모르는지입니다. 성인, 다크 스타일 또는 욕설이 포함된 게임에서 응답 거부 모델로 교체하면 NPC가 핵심 순간에 캐릭터를 이탈하여 경험이 매우 나빠집니다. 무검열 모델의 가치는 스타일이 중단되지 않는 데 있습니다.
구현 시, '이 NPC의 지식 범위'와 '현재 작업 상태'를 system prompt에 넣고, 플레이어의 입력은 user 메시지에 넣는 것을 권장합니다. max_tokens은 100에서 150로 낮게 설정합니다. 게임에서 문 열기, 거래, 전투 같은 이벤트를 트리거해야 할 때는 함수 호출을 사용해 모델이 텍스트 내에서 구문 분석하는 대신 구조화된 동작을 반환하도록 합니다. 함수 호출의 전체 프로세스는 코드 예시 페이지에 있습니다. 각 키는 분당 300회 요청으로 제한되므로, 높은 동시 요청이 필요한 온라인 게임에서는 서버 측에 큐와 캐시를 추가하고 429 응답에 대해 백오프를 적용해야 합니다.
你是边境酒馆的老板「老鲍勃」,粗声粗气,爱讲脏话,但对熟客讲义气。
你知道:镇上最近丢了三批货;你怀疑是北门守卫干的,但没有证据。
你不知道:地下仓库的位置。玩家问到时,要装作不知道。
规则:只用一到三句话回答,保持角色,不要提到游戏、玩家或系统。비용 추계: 각 대화 입력 800 토큰, 출력 120 토큰을 가정합니다. 입력 $0.0002, 출력 $0.00012로, 한 번에 약 $0.00032입니다. NPC 대사 10,000줄은 약 $3.20입니다. 수십 명의 NPC가 있는 게임의 경우 개발 및 테스트 단계 비용은 일반적으로 몇 달러 규모입니다.
콘텐츠 검열 및 레드팀 테스트: 자체 테스트 데이터 생성
콘텐츠 검열 팀은 항상 직면하는 문제가 있습니다. 검열 모델이나 규칙을 테스트하려면 대량의 '위반' 샘플이 필요하지만 실제 샘플은 얻기 어렵고 수동 작성은 너무 느립니다. 응답 거부 모델은 테스트 샘플 생성조차 거부하므로 도움이 되지 않습니다. 이 API를 사용하면 자체 검열 시스템용 테스트 말뭉치를 카테고리별로 대량으로 생성할 수 있습니다. 예를 들어 욕설, 스팸 광고, 사기 수법, 경계선 표현의 다양한 변체를 생성하여 재현율 평가, 임계값 조정, 회귀 테스트를 수행할 수 있습니다.
레드팀 테스트의 접근 방식도 유사합니다. 자체 채팅 제품에 대해 다양한 까다로운 사용자 입력을 대량으로 구성하여 방어선이 뚫리는지 확인합니다. 여기서 경계를 강조합니다. 생성된 데이터는 자체 테스트 환경에서만 사용해야 하며 실제 사용자를 스패밍하거나 사기 목적으로 사용하지 마세요. 미성년자 관련 성 콘텐츠는 용도와 관계없이 생성되지 않으며, 엔드포인트는 403을 직접 반환합니다.
엔지니어링 측면에서 모델이 JSON을 출력하도록 하고 각 샘플에 카테고리 및 강도 레이블을 포함시켜 한 요청당 약 20개의 샘플을 생성한 후 로컬에서 중복을 제거하는 것을 권장합니다. 생성 시 다양한 프롬프트 세트를 사용하여 커버리지를 보장하세요.
你在为一个社区论坛的内容审核系统生成测试数据,数据只用于内部评估。
任务:生成 20 条「辱骂类」评论,覆盖从轻微讽刺到明显人身攻击四个强度等级。
输出 JSON 数组,每项形如:{"text": "...", "level": 1}
要求:
- 语言为简体中文,口吻像真实论坛用户,长短不一。
- 不要包含真实人名、电话号码或真实地址。
- 只输出 JSON,不要任何解释。비용 추계: 각 요청 입력 500 토큰, 출력 2,000 토큰(20개 샘플)을 가정합니다. 입력 $0.000125, 출력 $0.002로, 한 번에 약 $0.0021입니다. 10,000개 샘플을 생성하려면 500회 요청이 필요하며 총 비용은 약 $1.06입니다.
연구용 민감 주제 분석
사회과학, 뉴스, 법률, 공공 정책 연구자는 종종 논쟁적인 자료를 처리해야 합니다. 극단적 발언, 범죄 사건, 역사적 폭력 사건, 논쟁적인 정치 및 사회 이슈 등이 해당됩니다. 일반 모델은 이러한 자료를 접하면 응답 거부, 회피 또는 '모든 견해에 타당함이 있다'는 식의 획일적인 응답을 하기 쉽습니다. 연구 시나리오에서는 모델이 가치 판단을 대신하기보다 사실적으로 요약, 비교 및 정리할 수 있어야 합니다.
이러한 작업은 입력이 길고 출력이 짧은 것이 특징입니다. 문서나 텍스트 집합을 입력하여 구조화된 요약이나 주석을 얻습니다. 프롬프트에는 추출할 차원, 원문 인용 필요 여부, 사실과 의견 구분 요구사항 등 분석 프레임워크를 명확히 명시하는 것이 좋습니다. 100,000 토큰의 컨텍스트 창은 긴 보고서 전체를 수용하기에 충분합니다. 분석이 보증(endorsement)을 의미하는 것은 아니며, 특히 사실과 데이터 관련 부분은 연구자가 직접 검증해야 합니다.
你是一位社会科学研究助理。下面是一份关于争议性议题的原始文本。
请完成:
1. 用不超过 150 字概括文本的核心主张。
2. 列出文本使用的三种主要论证手法,并各引用一句原文。
3. 区分「事实性陈述」和「观点或价值判断」,分两栏列出。
4. 指出文本中缺乏证据支持的断言。
保持中立,只分析,不评价立场对错,不补充文本之外的事实。비용 추계: 문서당 입력 20,000 토큰, 출력 1,500 토큰을 가정합니다. 입력 $0.005, 출력 $0.0015로, 문서당 약 $0.0065입니다. 200개 문서를 분석하면 약 $1.30입니다. 입력이 길수록 비용이 입력 측으로 편중되지만 입력 단가가 낮아 대량 처리는 여전히 경제적입니다.
에이전트 백엔드: 응답 거부로 인한 자동화 흐름 중단 방지
Agent 계열 애플리케이션(예: 자동화된 조사, 데이터 정리, 다단계 작업 실행)은 5단계에서 모델이 갑자기 거부하며 전체 파이프라인이 중단되는 것을 가장 두려워합니다. 이러한 애플리케이션은 안정적이고 예측 가능하며 함수 호출을 지원해야 합니다. 당사에서 OpenAI 형식의 tools 및 tool_choice를 지원하므로, 커스텀 base_url을 지원하는 주요 Agent 프레임워크라면 바로 연동할 수 있습니다.
Agent를 설계할 때 다음 몇 가지 사항을 주의하십시오. 첫째, 반복 횟수를 제한하고 최대 스텝 수를 설정하여 모델이 도구 호출 무한 루프에 빠지지 않도록 하십시오. 둘째, 각 단계에서 도구 매개변수를 검증하고 모델 출력을 맹목적으로 신뢰하지 마십시오. 셋째, 429 및 503 에러에 대해 재시도하고, 402 에러에 대해 경고를 설정하십시오. 긴 작업 중 잔액이 고갈되면 작업이 실패할 수 있기 때문입니다. 넷째, 하나의 모델만 사용하되, planning, execution, summarization 역할을 다른 system prompt로 구분하여 수행합니다.
你是一个任务执行 Agent。你可以调用提供的工具完成用户目标。
规则:
- 每一步先用一句话说明要做什么,再调用工具。
- 最多执行 8 步;如果 8 步内无法完成,汇报目前进度和卡住的原因。
- 工具返回错误时,换一种方式重试一次,仍失败就如实报告。
- 不要编造工具没有返回的数据。
- 完成后用简短的要点总结结果。비용 추계: 작업당 평균 6 라운드, 라운드당 입력 8,000 토큰(히스토리 및 도구 결과 포함), 출력 400 토큰을 가정합니다. 입력 총합 48,000 토큰으로 약 $0.012, 출력 총합 2,400 토큰으로 약 $0.0024이며, 작업당 약 $0.0144입니다. 1,000개 작업은 약 $14.40입니다. 에이전트 비용은 주로 매 라운드 반복 전송되는 히스토리에서 발생합니다. 도구 결과를 간소화하여 컨텍스트에 다시 넣는 것이 비용을 절감하는 가장 직접적인 방법입니다. 더 많은 가격 설명은 가격 페이지를 참조하세요.
자주 묻는 질문
동반형 애플리케이션은 성인 확인을 해야 하나요?
이 API는 성인 사용자 전용이며, 최종 사용자를 대상으로 하는 제품은 자체적으로 성인 확인을 수행해야 합니다. 미성년자 관련 성 콘텐츠는 픽션 여부나 역할극 여부와 상관없이 항상 차단되며 403을 반환합니다.
생성된 검토 테스트 데이터는 합법입니까?
자신의 검토 시스템 평가용 또는 자체 환경에서의 사용은 일반적으로 정당한 엔지니어링 관행입니다. 생성된 콘텐츠를 스토킹, 사기 또는 기타 불법 용도로 사용하지 마십시오. 사용은 반드시 합법적이어야 합니다.
게임 내 다수의 NPC 대화로 인해 속도 제한이 발생합니까?
각 API 키는 분당 300회 요청으로 제한됩니다. 동시 요청이 많을 때는 서버 측에서 큐와 일반적인 대화 캐시를 사용하고, 429 응답 시 지수 백오프를 적용하며, 필요시 요청 간격을 조절하십시오.
Agent 작업 중 잔액이 부족하면 어떻게 됩니까?
요청 시 402 응답과 함께 오류 코드 no_credit가 반환되며 작업이 중단됩니다. 긴 작업의 경우 시작 전 잔액을 확인하고, 코드에서 402를 포착할 때 진행 상황을 저장하고 사용자에게 충전을 알리는 것을 권장합니다.