RU ▾
Получить API-ключ

Wu Xianzhi APIСценарии использования

Неограниченный AI API: шесть сценариев использования — от ролевых игр до бэкенда агентов

Ценность неограниченного AI API в том, что легальный взрослый контент, художественные произведения и спорные темы больше не вызывают отказов модели. Статья разобрана по шести сценариям: ролевые игры, написание романов, NPC в играх, тестирование модерации, исследования и бэкенд агентов. Для каждого сценария указано, что требуется, приведен пример system prompt и оценена стоимость при цене $0,25 за входные и $1,00 за выходные токены на миллион. Продукт только для пользователей старше 18 лет и для законных целей.

Обновлено

Ключевые моменты

  1. Только для взрослых и в законных целях. Сексуальный контент с участием несовершеннолетних всегда блокируется с кодом 403, независимо от вымышленности.
  2. Во всех сценариях важны конкретные system prompt. Чем четче заданы персонаж, тон, длина и границы, тем стабильнее вывод.
  3. Расчет стоимости основан на типичном количестве токенов: диалог-компаньон ~ $0,001 за раунд, роман ~ $0,0055 за фрагмент, NPC в игре ~ $0,00032 за реплику.
  4. Реальная стоимость определяется полем usage в ответе. Ограничение max_tokens — самый прямой способ контроля затрат.

Важно: только для взрослых и в законных целях

Этот API предназначен для пользователей старше 18 лет и используется только в законных целях. Законный контент для взрослых, художественные произведения и дискуссионные темы не блокируются, но контент сексуального характера с участием несовершеннолетних (независимо от того, вымышлен он или основан на ролевой игре) всегда блокируется с возвратом статуса 403 content_blocked. Если вы разрабатываете продукт для конечных пользователей, вы должны самостоятельно реализовать проверку возраста, механизм жалоб на контент и управление аккаунтами в своём приложении — эта ответственность лежит на стороне продукта, API не выполнит её за вас.

Ниже мы разберём шесть распространённых сценариев. Для каждого описано, что именно требуется, приведён system prompt, который можно сразу изменить, и рассчитана стоимость. Цены: ввод $0,25 за миллион токенов, вывод $1,00 за миллион токенов. Предоплаченный баланс, без абонентской платы. Все значения в токенах — это типичные значения, которые я предположил для оценки. Ваши реальные расходы определяются полем usage в ответе; расчёты нужны лишь для понимания порядка величин. Синтаксис вызова см. в примерах кода.

Общий совет: для любого сценария system prompt должен быть конкретным. Модель без цензуры не откажет вам, но и не угадает ваши желания. Чем четче заданы роль, тон, длина и границы, тем стабильнее вывод.

Приложения для ролевых игр и компаньонов (только для взрослых)

Это самый востребованный сценарий «без отказов от ответа». Пользователь ведёт долгосрочный диалог с фиксированным персонажем, где возможны описания романтических и интимных сцен. С технической точки зрения критически важны три вещи: устойчивость персонажа — его описание и сеттинг помещаются в system-сообщение и передаются на каждом шаге; связность контекста — требуется самостоятельно поддерживать историю и обрезать её, так как API не хранит состояние, а контекстное окно ограничено 100 000 токенов; краткость ответов — в чат-сценариях обычно достаточно десятков или сотен символов, поэтому max_tokens следует установить около 300, чтобы соответствовать темпу общения и контролировать расходы.

На уровне продукта необходима проверка возраста и возможность жалоб/блокировок. Контент с участием несовершеннолетних блокируется на уровне API, но ваше приложение должно самостоятельно пресекать такие сценарии в диалоге, а не полагаться на API как на последнюю линию защиты.

你是「林夏」,28 岁,一位在书店工作的温柔、说话有点俏皮的女性。
对话对象是已确认年满 18 岁的成年用户。
- 保持人设:记得用户说过的名字、喜好和你们聊过的事。
- 回复口语化,每次 2 到 5 句,不要写成长篇说明。
- 可以有成年人之间的暧昧和亲密描写,但任何涉及未成年人的话题一律拒绝并结束该话题。
- 不要自称 AI,除非用户认真地询问你是不是真人。

Оценка стоимости: Предположим, что на каждом шаге ввод составляет 3 000 токенов (описание персонажа и недавняя история), а вывод — 250 токенов. Ввод: 3 000 × $0,25 / млн = $0,00075. Вывод: 250 × $1,00 / млн = $0,00025. На один шаг требуется около $0,001. За тысячу шагов — около $1,00. Если пользователь общается 50 раз в день, стоимость составляет примерно $0,05 в день. При таком объёме тестового баланса в $0,50 достаточно для полного тестирования прототипа вашего продукта.

Написание романов и художественной литературы

Писатели используют API для продолжения, расширения, смены стиля и поиска идей при творческом кризисе. Для романов взрослых, мрачных или криминальных жанров важно, чтобы модель создавала реалистичных персонажей, а не начинала поучать в ключевых моментах. Вам нужно подготовить: сеттинг, биографии персонажей, план текущей главы и резюме предыдущей. Поместите их в system или первое user-сообщение, чтобы модель не отклонилась от курса.

При написании длинных текстов обращайте внимание на ограничения вывода: максимальное значение max_tokens за один запрос составляет 32 000, но на практике рекомендуется разбивать главу на несколько запросов по 1 500–3 000 символов. После завершения части текста обновляйте сводку, а не запрашивайте сразу всю главу. Это обеспечивает более контролируемое качество и позволяет избежать полной переписывания, если в середине возникнет ошибка. Если включена потоковая передача, автор может следить за генерацией в реальном времени и прервать её в любой момент.

你是一位擅长悬疑与暗黑题材的网文写手,文风克制、细节具体。
设定:近未来的港口城市,主角是离职的法医苏明。
本章目标:苏明发现死者手机里有一段被删除的录音。
要求:
- 第三人称,过去时,约 1500 字。
- 对话自然,不要解释性旁白。
- 可以有暴力和阴暗情节的描写,但不要写成教程。
- 结尾留一个悬念,不要总结。

Расчёт: Ввод 6,000 токенов ($0.0015), вывод 4,000 токенов ($0.004). Итого ~$0.0055 за сегмент. 100 сегментов = $0.55. На роман в 1 млн слов (по 3,000 слов) уйдет ~330 запросов, что дешевле $2.

NPC в играх и генерация сюжета

Диалоги NPC в играх характеризуются большим объемом и краткостью каждой реплики. Требуется яркая личность и соблюдение сеттинга (что NPC знает, а что нет). В играх взрослых, мрачного стиля или с матами модель с отказами может сломать образ в ключевой момент, что ухудшит опыт. Ценность модели без цензуры здесь в том, что стиль не прерывается.

С технической точки зрения рекомендуется помещать «знания этого NPC» и «текущий статус задачи» в system-промпт, а реплики игрока — в user-сообщения. Ограничьте max_tokens до 100–150. Если в игре нужно запускать события (открытие дверей, торговля, бой), используйте вызов функций, чтобы модель возвращала структурированные действия, а не парсила их в тексте. Полный процесс вызова функций описан в примерах кода. Обратите внимание: лимит запросов составляет 300 запросов в минуту на один API-ключ. Для многопользовательских онлайн-игр с высокой нагрузкой добавьте на стороне сервера очереди и кэширование, а также реализуйте экспоненциальное отступление при получении кода 429.

你是边境酒馆的老板「老鲍勃」,粗声粗气,爱讲脏话,但对熟客讲义气。
你知道:镇上最近丢了三批货;你怀疑是北门守卫干的,但没有证据。
你不知道:地下仓库的位置。玩家问到时,要装作不知道。
规则:只用一到三句话回答,保持角色,不要提到游戏、玩家或系统。

Расчёт: Ввод 800 токенов ($0.0002), вывод 120 токенов ($0.00012). Итого ~$0.00032 за запрос. 10,000 реплик NPC ≈ $3.20. Расходы на разработку и тестирование для игры с десятком NPC будут в пределах нескольких долларов.

Модерация контента и Red Teaming: генерация собственных тестовых данных

У команд, занимающихся модерацией контента, есть неизбежная проблема: для тестирования моделей или правил модерации нужны большие наборы «неконформных» примеров, но реальные данные трудно получить, а ручная разметка занимает слишком много времени. Модели, которые отказываются от ответов, здесь не помогут, так как они могут отказаться даже генерировать тестовые примеры. С помощью этого API вы можете массово генерировать тестовые данные для собственной системы модерации по категориям: оскорбления, спам, мошеннические фразы, эротические подтексты и их вариации. Это позволяет оценивать полноту выявления (recall), настраивать пороги и проводить регрессионное тестирование.

Подход Red Teaming аналогичен: массовая генерация сложных входов для вашего чат-продукта, чтобы проверить, не будет ли пробита защита. Важно: генерируемые данные используются только в вашей тестовой среде. Не используйте их для преследования или мошенничества. Сексуальный контент с участием несовершеннолетних не генерируется ни при каких условиях, API вернет 403.

Рекомендуется выводить данные в формате JSON с метками категории и интенсивности. Генерируйте около 20 образцов за запрос, затем дедублицируйте локально. Используйте разные промпты для обеспечения покрытия.

你在为一个社区论坛的内容审核系统生成测试数据,数据只用于内部评估。
任务:生成 20 条「辱骂类」评论,覆盖从轻微讽刺到明显人身攻击四个强度等级。
输出 JSON 数组,每项形如:{"text": "...", "level": 1}
要求:
- 语言为简体中文,口吻像真实论坛用户,长短不一。
- 不要包含真实人名、电话号码或真实地址。
- 只输出 JSON,不要任何解释。

Расчёт: Ввод 500 токенов ($0.000125), вывод 2,000 токенов ($0.002). Итого ~$0.0021 за запрос. Для 10,000 образцов нужно 500 запросов, итого ~$1.06.

Анализ чувствительных тем в исследованиях

Исследователи в социальных науках, журналистике, праве и госполитике часто работают с противоречивыми материалами: экстремистские высказывания, уголовные дела, историческое насилие, спорные политические и социальные вопросы. Общие модели часто отказываются от таких материалов или дают шаблонные ответы. В исследованиях нужно, чтобы модель честно обобщала, сравнивала и структурировала информацию, а не навязывала ценностные суждения.

Особенность задач: длинные входы, короткие выходы. Поместите документ или набор текстов, получите структурированное резюме или аннотацию. В промпте укажите рамки анализа: какие извлекать измерения, нужно ли цитировать фрагменты, как отличать факты от мнений. Контекстное окно в 100 000 токенов позволяет загрузить длинный отчет. Важно: анализ не означает одобрение. Результаты нужно проверять исследователю самостоятельно, особенно в части фактов и данных.

你是一位社会科学研究助理。下面是一份关于争议性议题的原始文本。
请完成:
1. 用不超过 150 字概括文本的核心主张。
2. 列出文本使用的三种主要论证手法,并各引用一句原文。
3. 区分「事实性陈述」和「观点或价值判断」,分两栏列出。
4. 指出文本中缺乏证据支持的断言。
保持中立,只分析,不评价立场对错,不补充文本之外的事实。

Оценка стоимости: Предположим, что обработка одного документа требует 20 000 входных токенов и 1 500 выходных токенов. Стоимость входа: $0,005, выхода: $0,0015. Итого за документ около $0,0065. Обработка 200 документов обойдётся примерно в $1,30. При увеличении длины входных данных доля расходов смещается в сторону входа, но поскольку входной токен стоит дешевле, массовая обработка всё равно остаётся экономически выгодной.

Бэкенд агентов: предотвращение прерывания автоматизированных процессов отказами

Для приложений класса Agent (например, автоматизированный сбор данных, обработка информации, выполнение многошаговых задач) главная проблема — когда на пятом шаге модель внезапно отказывается генерировать ответ, и вся цепочка прерывается. Для таких приложений важна стабильность, предсказуемость и поддержка вызова функций. Здесь поддерживаются форматы OpenAI tools и tool_choice, поэтому основные фреймворки для агентов, поддерживающие пользовательский base_url, могут подключиться напрямую.

При проектировании агентов следует учитывать несколько моментов. Во-первых, ограничьте количество итераций, установив максимальное число шагов, чтобы предотвратить зацикливание модели при вызове инструментов. Во-вторых, проверяйте параметры инструментов на каждом шаге, не доверяя выводам модели слепо. В-третьих, реализуйте повторные попытки при ошибках 429 и 503 и настройте оповещения при ошибке 402, так как исчерпание баланса во время длительной задачи приведёт к её сбою. В-четвёртых, все задачи — планирование, выполнение и обобщение результатов — выполняет одна модель; различайте роли с помощью разных system prompt.

你是一个任务执行 Agent。你可以调用提供的工具完成用户目标。
规则:
- 每一步先用一句话说明要做什么,再调用工具。
- 最多执行 8 步;如果 8 步内无法完成,汇报目前进度和卡住的原因。
- 工具返回错误时,换一种方式重试一次,仍失败就如实报告。
- 不要编造工具没有返回的数据。
- 完成后用简短的要点总结结果。

Оценка стоимости: Предположим, что одна задача в среднем занимает 6 запросов. В каждом запросе 8 000 входных токенов (история + результаты инструментов) и 400 выходных токенов. Итого за задачу: 48 000 входных токенов (около $0,012) и 2 400 выходных токенов (около $0,0024). Стоимость одной задачи — около $0,0144. За 1 000 задач — $14,40. Основная стоимость Agent-приложений связана с повторной отправкой истории в каждом запросе. Самый эффективный способ сэкономить — сжимать результаты инструментов перед их помещением в контекст. Подробнее о ценах см. на странице с ценами.

Часто задаваемые вопросы

Обязательна ли проверка возраста для приложений-компаньонов?

Этот эндпоинт предназначен только для взрослых. Продукты для конечных пользователей должны самостоятельно проверять возраст. Сексуальный контент с участием несовершеннолетних всегда блокируется с кодом 403, независимо от вымышленности.

Генерация тестовых данных для модерации — это законно?

Использование для оценки собственной системы модерации или работы в собственной среде — обычная инженерная практика. Не используйте сгенерированный контент для преследования, мошенничества или других незаконных действий; использование должно быть законным.

Не приведёт ли большое количество диалогов NPC в игре к срабатыванию лимита запросов?

300 запросов в минуту на каждый API-ключ. При высокой нагрузке рекомендуется организовать очередь и кэширование популярных диалогов на стороне сервера, при получении 429 использовать экспоненциальное замедление и при необходимости разбить запросы по времени.

Что произойдёт, если предоплаченного баланса не хватит во время выполнения задачи агента?

Запрос вернёт код 402 с ошибкой no_credit, задача прервётся. Для длинных задач рекомендуется проверять баланс перед запуском и в коде перехватывать 402, чтобы сохранить прогресс и уведомить пользователя о необходимости пополнить баланс.

Получите API-ключ, просто заполнив форму

Создайте аккаунт, скопируйте API-ключ, измените Base URL. Настройка настолько проста.

Получить API-ключ