Глубокое исследование
Добавьте deep_research: true к обычному completion. Прокси запускает тот же цикл, что и чат: планирует несколько поисков, читает публичные страницы и просит вашу модель написать отчёт со ссылками.
curl https://api.proxy.gonka.gg/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer sk-your-api-key-here" \
-d '{
"model": "deepseek-ai/DeepSeek-V4-Flash-0731",
"deep_research": true,
"messages": [
{"role": "user", "content": "What moved Brent crude prices in 2026?"}
]
}'Запрос ждёт, пока исследование идёт — часто минуту или две, — и возвращает обычный chat completion. stream: true стримит этот отчёт. Прогресс поиска в стрим не попадает.
Таймауты
Поставьте таймаут клиента не меньше 5 минут. Пока поиски не закончатся, байты не уходят, даже при stream: true, так что первый байт может прийти через одну–две минуты. Таймаут в 60 секунд оборвёт запрос до начала отчёта.
client = OpenAI(
base_url="https://api.proxy.gonka.gg/v1",
api_key="sk-your-api-key-here",
timeout=300,
)curl --max-time 300 https://api.proxy.gonka.gg/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer sk-your-api-key-here" \
-d '{
"model": "deepseek-ai/DeepSeek-V4-Flash-0731",
"deep_research": true,
"stream": true,
"messages": [
{"role": "user", "content": "What moved Brent crude prices in 2026?"}
]
}'SDK
SDK OpenAI могут выкинуть неизвестные ключи. Кладёте флаг в extra_body:
client.chat.completions.create(
model="deepseek-ai/DeepSeek-V4-Flash-0731",
messages=[{"role": "user", "content": "What moved Brent crude prices in 2026?"}],
extra_body={"deep_research": True},
)Псевдо-инструмент
Клиенты, которые умеют слать только массив tools, могут передать {"type":"deep_research"}. Прокси забирает его и не пересылает этот tool наверх.
Стоимость
Списываются токены модели, которую вы указали: вызовы планирования и финальный отчёт, по ставке этой модели. Сам поиск отдельной строкой не тарифицируется.
Jev решает, какие страницы оставить. Это внутреннее использование цикла, как в чате. Оно не тарифицируется и не требует порога в 100 000 000 токенов, который нужен для прямого вызова Jev. Не указывайте jev в model. Отчёт пишет не Jev.
С чем это не совмещается
web_search в том же запросе игнорируется. Глубокое исследование ищет само. MCP-инструменты в том же запросе не вызываются.