Inference net

Inference.net: Schematron V2 Turbo

быстрыеновые
Подключить по API

О модели Inference.net: Schematron V2 Turbo

Schematron V2 Turbo — модель извлечения данных из HTML в JSON на 3 млрд параметров от Inference.net, оптимизированная под пропускную способность на больших объёмах извлечения. Инструкции по извлечению передаются JSON-схемой в response_format, а не текстом промпта. Принимает текст, отвечает текстом. Контекст 128 000 токенов, вывод до 8 192.

Характеристики и цены

Контекстное окно128 000 токенов
Максимальный ответ8 192 токенов
Входные данныетекст
Результаттекст
Цена за 1 млн токенов (вход)6 ₽
Цена за 1 млн токенов (выход)30 ₽
Чтение из кэша (за 1 млн токенов)6 ₽
Дата выхода12 сентября 2026 г.

Цены указаны в рублях и уже включают все комиссии. Оплата с российских карт, без VPN.

Использование через API

Модель доступна через OpenAI-совместимый API. Укажите идентификатор модели в поле model:

curl https://llmost.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $LLMOST_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "inference-net/schematron-v2-turbo-20260902",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'

Полная документация API →

Другие модели Inference net