Рекомендации по настройке систем вайб-кодинга и плагинов для IDE (VS Code, Claude Code...)
Claude Code и прочие системы разработки (далее – инструменты вайбкодинга) обычно довольно хорошо работают с VseGPT – но мы рекомендуем прочитать несколько рекомендаций ниже, чтобы настроить ваш аккаунт побыстрее.
Данные рекомендации применимы также к большинству других сторонних приложений, работающих по API – если это не простой чат, конечно. Поэтому при настройке любого стороннего приложения мы также рекомендуем их почитать.
Крайне рекомендуется
1. Пополнить баланс
Инструменты вайбкодинга, как правило, отсылают большие системные промты и файлы при запросе. VseGPT оценивает стоимость запроса – и, если она выходит за ваш баланс, отклоняет его с ошибкой 400.
Поэтому – даже если вы находитесь на Тестовом тарифе – рекомендуем пополнить баланс хотя бы на 250 р. Это снизит число отклонений.
2. Увеличить лимит на 1 запрос
Аналогично предыдущему – VseGPT отклоняет запрос, если его оценочная стоимость выше, чем указанный
В случае вайбкодинга запросы могут быть большие; рекомендуем сразу установить лимит в 100 кр., чтобы избежать ошибок при запросе.
3. Установите пропускание отсутствия max_tokens
Ряд инструментов вайбкодинга пропускает указание max_tokens (т.е. максимального размера ответа) при запросе. VseGPT по умолчанию в этом случае ставит размер в 4096 (или другое число), что может помешать полному ответу, или дать 0 ответ при глубоких раздумьях.
Это настраивается в
Другой вариант – установить в 16000 или 32000 – обычно ответы укладываются в этот объем даже с размышлениями на современных нейросетях.
Рекомендуется
Пробовать на дешевых моделях наладку
Для начала – используйте только дешевые модели типа openai/gpt-4o-mini или deepseek/deepseek-v4-flash. Во-первых, с ними меньше вероятность наткнуться на лимиты на 1 запрос. Во-вторых, первые тесты как правило потратят у вас прилично денег, потому что среда еще не настроена.
Ну, и конечно, проверяйте, что модель доступна на вашем тарифном плане – для этого поищите ее на странице модели, и посмотрите беджик – какой тарифный план требуется. Или просто проверьте её доступность на вашем аккаунте в нашем веб-чате.
Установить X-Title в имени модели для тегирования запросов в статистике использования
Вы можете модифицировать ID модели так, чтобы в статистике использования на сайте отображалась информацию о том, откуда был запрос.
Пример использования: – укажите модель как openai/gpt-4o-mini:x-title=Chat GPT Box
Описание фичи и пример
Установить секретные строки в настройках пользователя, чтобы предотвратить утечку ваших секретов
Предположим, у вас есть секретные ключи API от нашего или других сервисов. Вы, скорее всего, храните их в папке проекта – в коде, или в файле .env. В этом случае, у вас очевидно есть риск, что ваш вайб-кодинг-агент в какой-то момент может прочитать файл с ними, и отошлет их на обработку в нейросеть – т.е. на чужие сервера, где могут сохраняться логи; и ваш секрет утечет.
С этим явлением не так просто бороться (это лучше делать на вашей инфраструктуре), но мы кое-что сделали со своей стороны.
При включении начинает проверять отсутствие секретных строк в запросе – которые перечислены в списке «секретные строки».
В
Важно: понятно, что вы можете не очень доверять VseGPT, как хранилищу ваших секретов – и это в целом правильно с точки зрения безопасности. Тем не менее, вы по-прежнему можете использовать этот инструмент.
Возьмите ваш секретный ключ – предположим это sk-aaaaabbbbb. Разместите в секретных строках только ПЕРВУЮ часть ключа – sk-aaaaa. Этим вы решите сразу две задачи:
1. Мы заблокируем полный ключ sk-aaaaabbbbb, если он придет в запросе.
2. Мы НЕ будем знать ваш полный ключ – и не сможем им воспользоваться.
Возьмите ваш секретный ключ – предположим это sk-aaaaabbbbb. Разместите в секретных строках только ПЕРВУЮ часть ключа – sk-aaaaa. Этим вы решите сразу две задачи:
1. Мы заблокируем полный ключ sk-aaaaabbbbb, если он придет в запросе.
2. Мы НЕ будем знать ваш полный ключ – и не сможем им воспользоваться.
Ограничение ответственности: инструмент «секретные строки» является вспомогательным и не является универсальным. Если ваш секрет придет в виде закодированной строки, картинки, PDF-файла и проч., мы не сможем его идентифицировать. Мы предлагаем инструмент как есть, и не несем ответственности за результаты его использования/неиспользования
Отладка – что делать, если коннект не работает
Официальная процедура отладки
У нас есть официальная документация по отладке ошибок. Если что – лучше работать с ней, но мы чуть ниже дадим ряд вещей, применимых конкретно к вайб-агентам.
Соображения, применительные конкретно к вайб-агентам
1. Пожалуйста, проверьте, что запросы действительно уходят на наш сервер. Какой-нибудь Cursor очень любит, если вы не указали модель, отсылать запросы на сервера себе, и выдавать свои ошибки – а мы к ним отношения не имеем. В любом случае, постарайтесь получить текст ошибки – только по нему можно будет что-то сказать. Ну, или отправьте запрос на отладочный сервер (см. офиц документацию) – может, станет проще.
2. Некоторые системы кодинга (типа Continue и пр.) смотрят на префикс модели и, бывает, самостоятельно отправляют запрос на тот сервер, который считают подходящим по префиксу. Например, anthropic/claude-sonnet-4.6 будет отправлен на сервера Anthropic – что, естественно, бессмысленно.
Решение: Зайдите в
Ошибка: This endpoint 'v1/responses' is not provided...
Такое тоже бывает.
Суть ошибки: программа пытается вызвать OpenAI API Responses – новую версию OpenAI API, которая, в частности, ориентирована на хранение части данных на серверах. Мы, и ряд других опенсорс-провайдеров нейросетей, считают это небезопасным; и в связи с этим предоставляют старый проверенный OpenAI API Chat Completions, который заставляет программу отсылать каждый раз всю информацию при запросе.
Решение проблемы: в типе точки доступ выбрать не OpenAI, а OpenAI-compatible, или OpenAI Chat Completions, или попытаться найти флаг «использовать Chat Completions. Другой вариант – использовать тип провайдера типа xAI или Ollamа, с установлением кастомной точки доступа, чтобы явно использовался Chat Completions интерфейс (пример этот взят из настройки Continue, где проблема доступа решается именно так.
Также, как вариант – обратитесь к документации по вашему инструменту, обычно там явно есть раздел Custom providers, который объясняет, как подключить провайдера, предоставляющего Chat Completions (это мы).