Перейти к основному содержимому

Действие «Нейросеть»

«Нейросеть» — действие в сценарии действий, которое подключает к боту LLM. Поддерживает 8 типов запросов: чат, ассистенты с файлами, генерация и анализ изображений, расшифровка и анализ аудио.

Используется для:

  • умных ответов на свободные вопросы клиента;
  • классификации обращений (продажа/поддержка/возврат);
  • автогенерации текстов под клиента;
  • анализа присланных клиентом фото и аудио;
  • генерации изображений по описанию.

Провайдеры

ПровайдерМодель по умолчанию (на вашем ключе)Особенности
Grok (xAI)grok-4.5На нём же работает бот, когда ключа нет
ChatGPT (OpenAI)gpt-4.1
Claude (Anthropic)claude-sonnet-5Картинок и звука не умеет
Gemini (Google)gemini-3.6-flashУмеет анализ аудио обычной моделью
DeepSeekуказывается: deepseek-chat, deepseek-reasoner
Kimi (Moonshot)kimi-k3Картинок и звука не умеет
YandexGPTобязательно: b1g.../yandexgpt/latestВ названии модели — идентификатор каталога
RouterAIлюбая модель шлюза с префиксом: openai/gpt-4.1-miniШлюз-посредник
AITunnel, LowRouterлюбая модель шлюза без префикса: gpt-4o, claude-opus-5Шлюз-посредник

Шлюз — посредник, через который доступны модели разных разработчиков по одному ключу. Нейросеть у шлюза выбирается именно полем «Модель»: без него запрос уйдёт к модели шлюза по умолчанию.

Выбор провайдера имеет смысл только со своим ключом

Пока ключ не указан, запрос в любом случае уходит через Grok на аккаунте Квесчи — вместе с адресом и моделью. Выбранное в поле «Нейросеть» начнёт работать, как только вы впишете свой ключ.

Что нужно перед использованием

  1. Ничего — действие работает сразу, с баланса аккаунта (нужно не меньше 5 ₽).
  2. Чтобы работала выбранная нейросеть и платили вы напрямую: аккаунт у провайдера и API-ключ из его личного кабинета.
  3. Для типа «Assistant» — созданный ассистент и Vector Store с файлами в OpenAI Storage.
  4. Для типа «Ответ по файлу» — загруженный файл в раздел «Файлы» в Квесче.

Как добавить

В сценарии действий«Добавить действие»«Нейросеть».

Добавление действия Нейросеть

Скриншот 1. Действие «Нейросеть».

Поля «Нейросеть» (провайдер) и «Тип запроса» определяют дальнейший набор настроек.


Часть 1. Типы запросов — кратко

ТипЧто делаетКогда выбирать
ResponseБазовый чат через /v1/responses APIУниверсальный диалог с поддержкой контекста
CompletionЧат через классический /v1/chat/completionsЕсли нужен полный контроль через массив сообщений
Ответ по файлуОтвет по файлу, загруженному в КвесчуПростая база знаний без OpenAI Storage
AssistantЗапрос к OpenAI-ассистенту с Vector StoreБольшие базы знаний, сложная база FAQ
ImageГенерация изображений (DALL-E 2/3)По описанию сгенерировать картинку
Анализ изображенияЧто нарисовано/написано на картинкеРаспознавание чеков, документов, фото
Аудио в текстРасшифровка голоса в текстГолосовые сообщения → текст для поиска
Анализ аудиоВопрос по голосовому сообщению: звук уходит в нейросеть вместе с вопросом«О чём просит клиент», «какое настроение у записи»

Разница между двумя аудио-типами: «Аудио в текст» возвращает расшифровку и ничего больше, «Анализ аудио» отвечает на ваш вопрос о самой записи, не пересказывая её.

ТипГде работает
Аудио в текстRouterAI и AITunnel — на их моделях распознавания, Gemini — обычной моделью
Анализ аудиоRouterAI, AITunnel, LowRouter и Gemini — на мультимодальных моделях

Часть 2. Общие настройки

API-ключ

Правило одно, и оно не про провайдера, а про то, чей ключ:

Ключ указанЧто происходит
ДаРаботает выбранная вами нейросеть, запрос идёт на вашем ключе. Платите вы напрямую провайдеру, с баланса Квесчи ничего не списывается
НетЗапрос уходит через Grok на аккаунте Квесчи и оплачивается с баланса. Выбранные провайдер и модель при этом не используются — Grok их заменить не может

Поле «API ключ» лежит в «Расширенные настройки».

На балансе нужно не меньше 5 ₽

Без своего ключа запрос идёт за счёт платформы, поэтому баланс проверяется до отправки. Меньше 5 ₽ — запрос не уйдёт, а в переменную результата запишется 0. Обработайте это условием, чтобы бот сказал что-то внятное вместо молчания.

Что нельзя сделать без своего ключа

Grok подменяет собой любого провайдера, но не любой тип запроса:

ТипПочему нужен свой ключ
AssistantИспользуется ваш ассистент и ваш Vector Store в вашем аккаунте OpenAI или Grok
ImageСвоей модели картинок у xAI нет
Аудио в текстУ xAI нет расшифровки — она есть у шлюзов и Gemini
Анализ аудиоНужны мультимодальные модели шлюзов или Gemini

Без ключа такой запрос не уходит вовсе, а в переменную результата пишется 0.

Тип «Ответ по файлу» идёт своим путём: провайдер и ключ берутся у самого файла на странице «Списки».

Поле «API ключ» находится в «Расширенные настройки» (для Assistant — на виду, так как обязательно). Хранится зашифрованно.

Не хардкодьте токен в коде

Прочитайте токен в список и сохраните в первом блоке в переменную #{g_openai_token} — при ротации меняете в одном месте.

Модель

Поле «Модель нейросети» лежит в «Расширенные настройки». У ChatGPT его можно не заполнять — подставится рабочее значение по умолчанию:

Тип запросаМодель по умолчанию (ChatGPT)
Response, Completion, Анализ изображенияgpt-4.1
Imagedall-e-3
Аудио в текстgpt-4o-transcribe
Assistantберётся из вашего ассистента
Ответ по файлумодель шлюза, указанного у файла

У остальных провайдеров значения по умолчанию свои — они перечислены в таблице провайдеров выше. Подсказка под полем всегда показывает то, что подставится при выбранном провайдере.

У шлюзов модель — это выбор нейросети

У RouterAI, AITunnel и LowRouter поле «Модель» определяет, к какой нейросети уйдёт запрос. У RouterAI название пишется с префиксом разработчика (openai/gpt-4.1-mini, anthropic/claude-sonnet-4.5), у AITunnel и LowRouter — без него (gpt-4o, claude-opus-5, gemini-3-6-flash).

У YandexGPT в название модели входит идентификатор каталога: b1g.../yandexgpt/latest. Без него запрос не уйдёт.

Указывайте свою модель, только если нужна другая:

ТипПримеры моделей
Response/Completiongpt-5.2, gpt-4.1, gpt-4o, claude-opus-5, gemini-3.1-pro, deepseek-reasoner, grok-4.5
Imagedall-e-3, dall-e-2
Анализ изображенияgpt-5, gpt-4.1, gpt-4o, gpt-4o-mini
Аудио в текстgpt-4o-transcribe, gpt-4o-mini-transcribe, whisper-1
Assistant(опционально, иначе берётся из настроек ассистента)

Запрос

Поле «Запрос» — сам промпт. Поддерживает шаблоны замен и переменные:

Клиент пишет: [Answer1]. 
Дай вежливый ответ на русском.
Стиль: дружелюбный, без капса.
Ограничения: до 300 символов.

Параметры качества

ПолеЗначение
Ограничение ответа в токенахМаксимальное число токенов в ответе. Меньше = быстрее и дешевле
Температура0..1. 0 — детерминированно, 1 — максимально случайно. Для FAQ — 0, для генерации текстов — 0.5-0.7

Сохранение результата

ПеременнаяЧто содержит
Имя переменной (ответ)answervar — текстовый ответ нейросети
Имя переменной (результат)resultvar1 если ответ получен, 0 если ошибка
Имя переменной (JSON)responsevar — полный JSON ответа нейросети для анализа

Часть 3. Тип «Response» — базовый чат

Самый универсальный тип. Подходит для большинства задач.

Контекст беседы

Галочка «Контекст» — нейросеть помнит предыдущие реплики клиента. Это создаёт ощущение настоящего диалога.

  • ID беседы хранится в переменной _responseId (или вашей).
  • Максимальная сумма токенов беседы — когда лимит превышен, бот начинает беседу заново.
Лимит окна модели

maxcontexttokens не может быть больше контекстного окна модели (например, у gpt-4o-mini это 128К). При превышении API вернёт ошибку.

Кто помнит беседу сам, а кто нет

ПровайдерКак хранится переписка
ChatGPT, GrokБеседу помнит сам провайдер, бот передаёт только её идентификатор
Claude, Gemini, YandexGPT, DeepSeek, Kimi, RouterAI, AITunnel, LowRouterПереписку ведёт само действие: она складывается в переменную сценария и уезжает целиком с каждым запросом

На результат это не влияет — контекст работает у всех. Разница в расходе: у второй группы каждый следующий запрос везёт с собой всю беседу, поэтому токенов уходит больше. Ограничивайте «Максимальную сумму токенов беседы» — она же и режет этот рост.

Галочка «Контекст» не показывается там, где смысла в ней нет: у генерации изображений и у расшифровки аудио.

Инструкции

Поле «Инструкции» — системный промпт. Задаёт «характер» бота:

Ты — менеджер магазина электроники Квесча. 
Отвечай дружелюбно, на русском, кратко (1-2 предложения).
Не выдумывай товары, которых нет в каталоге.
Если не знаешь — предложи связаться с человеком.

Часть 4. Тип «Completion» — классический чат

Аналог Response, но через API /v1/chat/completions. Отличается полем «Контекст» — там задаётся весь массив сообщений в формате OpenAI:

[
{ "role": "system", "content": "Ты помощник магазина" },
{ "role": "user", "content": "Привет!" },
{ "role": "assistant", "content": "Здравствуйте! Чем помочь?" },
{ "role": "user", "content": "#{client_question}" }
]

Используйте, если нужен полный контроль над историей беседы (например, в списке хранится переписка и собирается JSON через JS код).


Часть 5. Тип «Assistant» — база знаний на OpenAI

Использует OpenAI Assistants API + Vector Store — собственное файловое хранилище у OpenAI.

Подготовка

  1. Зайдите в OpenAI Platform → Storage → создайте Vector Store.
  2. Прикрепите к нему документы (PDF, DOCX, TXT) с информацией для бота.
  3. Скопируйте Vector Store ID.

Настройка в Квесче

  • Токен — ключ OpenAI;
  • Vector Store ID - ID хранилища;
  • Модель — можно переопределить ту, что у ассистента (опционально);
  • Запрос — вопрос клиента;
  • Контекст — включить для непрерывной беседы;
  • Инструкции — дополнительный системный промпт.

Идеально для FAQ, базы знаний компании, технических документов.


Часть 6. Тип «Ответ по файлу»

Упрощённая база знаний. Файлы загружаются на странице «Списки / WebApp» в раздел «Ответ по файлу», в действии выбираются из выпадающего списка.

  • Файл — выбор загруженного файла;
  • Запрос — вопрос по содержимому файла;
  • Контекст — поддержка диалога.

Файл хранится у нас и передаётся нейросети ссылкой при каждом запросе — ждать индексации не нужно, хранилища на стороне провайдера нет.

Шлюз и ключ берутся у файла

Для этого типа выбранная в действии нейросеть и поле «API ключ» не используются. Шлюз (RouterAI, AITunnel или LowRouter) и ключ указываются у самого файла — кнопка «Шлюз и ключ» на странице «Списки / WebApp». Запросы идут на вашем ключе и за ваш счёт; без ключа действие завершится с результатом 0.

Из действия берётся только модель: пусто — модель шлюза по умолчанию.


Часть 7. Тип «Image» — генерация изображений

Создание картинок через DALL-E.

ПолеЗначение
Модельdall-e-3 (одна картинка, лучшее качество) или dall-e-2
Число изображений1-10 (для dall-e-3 только 1)
Качествоhd — только для dall-e-3. Лучше, но дороже
Размерdall-e-2: 256x256, 512x512, 1024x1024. dall-e-3: 1024x1024, 1792x1024, 1024x1792
Стильvivid (контрастно) или natural (естественно) — только dall-e-3

Сохранение результата

  • «Сохранить все url через запятую» — все ссылки в одной строке;
  • «Сохранить один url» + «Порядковый номер» — конкретное изображение (1-10) в свою переменную.

Дальше URL подставляется в блок как картинка (тип медиа = ссылка).

Пример запроса

Профессиональная фотография корзины с яблоками сорта Антоновка 
на деревянном столе. Утренний свет от окна. Натюрморт, реализм.

Часть 8. Тип «Анализ изображения»

Распознавание содержимого картинки (Vision).

  • URL изображения — ссылка на картинку. Обычно — переменная #{media_url} после приёма медиа.
  • Запрос — что распознать: «Какой номер на чеке?», «Что изображено?», «Прочитай рукописный текст».
  • Модельgpt-4o, gpt-4.1, gpt-5.

Применения

  • Распознать чек/документ от клиента;
  • Понять, что на фото: продукт, человек, документ;
  • Извлечь номер заказа, паспорта, штрих-кода;
  • Описать товар на фото для каталога.

Часть 9. Тип «Аудио в текст»

Транскрибация голосовых сообщений и аудио.

  • URL аудио — обычно #{media_url} после приёма голосового от клиента;
  • Модельwhisper-1, gpt-4o-transcribe, gpt-4o-mini-transcribe.

Сценарий «голосовой бот»

  1. Подписчик присылает голосовое.
  2. Действие медиа сохраняет URL в #{media_url}.
  3. Действие «Нейросеть» (Аудио в текст) → answervar = voice_text.
  4. Дальше работаем с #{voice_text} как с обычным текстовым ответом — отправляем в Response для содержательного ответа.

Расшифровка работает у RouterAI и AITunnel на их моделях распознавания, у Gemini — обычной моделью.


Часть 9а. Тип «Анализ аудио»

Вопрос по голосовому сообщению: звук уходит в нейросеть вместе с вопросом, и она отвечает не пересказом, а по существу.

  • URL аудио — тот же #{media_url};
  • Запрос — что нужно узнать: «О чём просит клиент, одной фразой», «Это жалоба или заказ?», «Какое настроение у говорящего?».

Работает у RouterAI, AITunnel, LowRouter и Gemini на мультимодальных моделях.

Когда это дешевле расшифровки

Если из голосового нужен только вывод («жалоба/заказ/вопрос»), «Анализ аудио» даёт его одним запросом. Расшифровка ради классификации — это два запроса вместо одного и лишний текст, который потом всё равно никто не читает.


Часть 10. Архитектура

Принцип 1. Чёткие инструкции — лучшее качество

Чем подробнее системный промпт (поле «Инструкции») — тем стабильнее ответы. Указывайте:

  • роль (кто бот);
  • стиль ответа;
  • ограничения по длине;
  • что нельзя делать.

Принцип 2. Используйте контекст там, где он нужен

«Контекст» хранит беседу, но платите за каждый запрос как за весь объём беседы. Для разовых запросов (классификация, перевод) — выключайте контекст.

Принцип 3. Классификация — простой и дешёвый способ

Не давайте нейросети писать ответ — пусть классифицирует:

Запрос: "[Answer1]"
Определи категорию из списка:
- "доставка"
- "возврат"
- "оплата"
- "другое"
Верни одно слово.

Сохраните в переменную category → ветвите блок по #{category}.

Принцип 4. Лимит токенов — не пренебрегайте

Без лимита нейросеть может выдать сочинение на 2000 токенов. В мессенджере это раздражает + дорого. Ставьте 200-500 для коротких ответов.

Принцип 5. Обрабатывайте ошибки

Сеть может не ответить. Используйте resultvar (= 0 при ошибке) для ветвления: если 0 → «Попробуйте чуть позже» или передача в чат менеджеру.

Принцип 6. Не отправляйте чувствительные данные

Не передавайте в промпт #{client_phone}, паспорта, медицинские данные. Сначала фильтруйте.

Принцип 7. Тестируйте температуру

  • 0 — для FAQ, классификации, технической помощи;
  • 0.5 — для писем, креатива на основе фактов;
  • 0.7-1 — для рекламных текстов, идей.

Часть 11. Типовые сценарии

Сценарий 1. Умный FAQ через Assistant

  1. Создайте ассистента OpenAI с Vector Store, прикрепите PDF с инструкциями.
  2. Цепочка «Поддержка» с триггером «сообщение не обработано».
  3. Действие «Нейросеть» — Assistant, запрос = [Answer], контекст вкл.
  4. Блок показывает #{answer}.

Сценарий 2. Распознавание чека

  1. Блок «Пришлите фото чека».
  2. Действие медиа сохраняет URL.
  3. Действие «Нейросеть» (Анализ изображения), запрос: «Извлеки сумму и дату из чека в формате сумма|дата».
  4. Действие JS код: разобрать #{answer} по | в #{sum} и #{date}.
  5. Блок: «Принято: сумма #{sum} от #{date}».

Сценарий 3. Голосовой бот

  1. Подписчик присылает voice.
  2. Медиа#{media_url}.
  3. Нейросеть «Аудио в текст» → #{voice_text}.
  4. Нейросеть Response с инструкцией ассистента → ответ.
  5. (Опционально) Нейросеть Image для генерации картинки по запросу.

Сценарий 4. Классификатор обращений

  1. Цепочка «Распределитель» (триггер: начало диалога).
  2. Действие «Нейросеть» Response — запрос: «Категория обращения из: продажа/поддержка/жалоба. Запрос: [Answer1]. Верни одно слово.»
  3. По #{category} ставим теги → клиент идёт в нужную цепочку.

Частые ошибки

  • resultvar = 0 — проверьте токен, баланс на API-аккаунте, корректность модели.
  • «Чушь в ответе» — недостаточно конкретный запрос. Добавьте «Инструкции», конкретные примеры, ограничения.
  • Дорого — снизьте maxtokens, используйте gpt-4o-mini вместо gpt-4o, отключите контекст где не нужен.
  • Контекст не сохраняется между сообщениями — у клиента нет _responseId после первого запроса. Проверьте, что responseid сохраняется в переменную, которая живёт между блоками.
  • Анализ картинки возвращает «не вижу» — модель не поддерживает Vision. Используйте gpt-4o / gpt-4.1 / gpt-5.
  • DALL-E генерирует не то — улучшайте промпт, добавляйте стиль (vivid / natural), детали.

Что дальше