Разработчикам: API без VPN
Как это работает
II Proxy — доступ к ИИ и AI без VPN: запросы идут на наш сервер, списывается стоимость с баланса аккаунта и
вызов проксируется к моделям через OpenAI-совместимый интерфейс (чат и эмбеддинги).
Нужны ключ iip_… и ID модели из нашего каталога
(например, openai/gpt-5.4).
Актуальные модели и тарифы смотри в: «Тарифы».
Ключи доступа
Сгенерируйте ключ ниже (нужна авторизация). Ключ показывается только один раз — сохраните строку; восстановить нельзя, только отозвать и выпустить новый.
Примеры
Авторизация:
Authorization: Bearer <iip_…>
Ключ — в разделе «Ключи доступа».
Каталог моделей для запросов: GET …/api/models. Удобнее смотреть названия и цены в ₽ за
1 млн токенов на странице «Тарифы»:
Загрузка…
Чат приложения — POST /api/v1/messages, в теле поле modelSlug (как в примерах ниже и в ответе GET /api/models; не путать с именем поля model в OpenAI Chat Completions).
Опционально: temperature и max_tokens или maxTokens — те же поля
уходят в запрос к модели; для IDE используйте POST …/v1/chat/completions с
temperature и max_tokens в стиле OpenAI.
Загрузка…
Поток SSE при "stream": true. Один JSON без событий data: — при
"stream": false.
Для внутренних интеграций: заголовки X-Internal-Secret и X-User-Id поддерживаются там
же, где Bearer iip_….
Python
Загрузка…
Озвучка и изображения
Озвучка ответа (опционально)
В POST …/api/v1/messages можно передать "ttsVoice": "nova" и т.д. — те же голоса,
что во встроенном чате: alloy, echo, fable, onyx,
nova, shimmer.
{
"modelSlug": "…",
"stream": true,
"ttsVoice": "nova",
"messages": [ … ]
}
Генерация изображений
Тот же POST …/api/v1/messages, модель с supportsImageGeneration — см.
«Тарифы» или GET /api/models. Прокси включает
modalities: ["image", "text"].
Загрузка…
На Python:
Загрузка…
Поток: curl -N или цикл по строкам, как в примере с потоком в разделе «Примеры».
Vibe coding
Вайб-кодинг — когда вы формулируете задачу на естественном языке, а агент в IDE сам предлагает правки (diff), запускает команды и ведёт диалог в чате. Для этого подходят расширения с профилем OpenAI-compatible: ниже — настройка на примере Kilo Code и Cline (аналогично работают Roo Code и другие плагины с тем же протоколом).
В настройках провайдера укажите Base URL ровно как в блоке ниже (без хвоста
/chat/completions и без лишнего / в конце) и API Key — ваш
iip_… (ключи доступа).
Загрузка…
Kilo Code
Установите расширение из маркетплейса VS Code (или аналог для поддерживаемой IDE). Откройте панель Kilo Code → шестерёнка → раздел «Провайдеры» → внизу «Пользовательский провайдер» → «Подключить».
Заполните поля: короткий ID провайдера латиницей (например iiproxy),
отображаемое имя на ваш вкус, базовый URL — строка из блока выше,
API-ключ — iip_…. Затем добавьте модель:
в model-id вставьте ID из «Тарифов» (тот же id, что в
GET /api/models), в «отображаемое имя» — удобное название для списка в чате.
Подойдет любая модель из раздела "Текст и чат" на странице "Тарифы", но рекомендуем использовать "сильную" модель, например "anthropic/claude-opus-4.7" или "openai/gpt-5.5".
После сохранения внизу чата Kilo Code должен появиться выбранный провайдер и модель. Для дисциплины ответов можно завести правила в файле проекта (см. документацию Kilo Code) — например стиль кода и как запускать команды в вашем окружении.
Cline
Установите в IDE расширение Cline из маркетплейса. При первом запуске выберите вариант вроде «Bring my own API key» / свой ключ.
API Provider: OpenAI Compatible. Укажите
Base URL из блока выше, API Key — iip_…,
Model ID — ID модели целиком. Подойдет любая модель из раздела "Текст и чат" на странице "Тарифы", но рекомендуем использовать "сильную" модель, например "anthropic/claude-opus-4.7" или "openai/gpt-5.5".
Правила проекта можно задать через интерфейс Cline (иконка весов в чате)
или файлы вроде .clinerules — см. документацию расширения.
Агенты расходуют много контекста: по завершении крупной задачи начинайте новый чат / задачу, чтобы не пересылать лишнюю историю при каждом запросе.
Каталог чат-моделей и цены — «Тарифы» и выпадающий список на
главной после входа; JSON для интеграций — GET /api/models. Проверка API:
с тем же ключом должен открываться GET …/v1/models (см. раздел «Примеры» и curl к
/api/models).
Embeddings
Эмбеддинги — поиск по смыслу, RAG и т.п. Запрос в формате, совместимом с OpenAI Embeddings API. Нужна модель с
supportsEmbeddings: true в ответе GET /api/models (на тарифах —
вкладка «Эмбеддинги»).
Справочник API
| Метод | Путь | Назначение |
|---|---|---|
POST |
/api/v1/embeddings |
Основной URL в документации II Proxy |
POST |
/v1/embeddings |
Тот же обработчик — удобно, если клиент ожидает префикс /v1 (как в OpenAI SDK:
base_url = … + "/v1")
|
Заголовки:
Authorization: Bearer <iip_…> Content-Type: application/json; charset=utf-8
Тело JSON (обязательные поля):
| Поле | Тип | Описание |
|---|---|---|
model |
string | Slug модели из каталога с поддержкой эмбеддингов |
input |
string или массив строк | Текст для векторизации; массив — несколько строк за один запрос (лимиты по размеру элементов и числу элементов см. на сервере) |
Дополнительные поля из OpenAI Embeddings (encoding_format, dimensions,
user и т.д.) проксируются к провайдеру, если присутствуют в теле.
Типовые ответы ошибок: 401 — неверный или отозванный ключ;
402 — недостаточно баланса; 400 — нет поля model/input,
модель не для эмбеддингов или неизвестный slug.
Примеры запросов
curl к /api/v1/embeddings:
Загрузка…
Тот же запрос к OpenAI-стилю /v1/embeddings:
Загрузка…
Python (requests):
Загрузка…