Inference net
Inference.net: Schematron V2 Turbo
быстрыеновые
О модели Inference.net: Schematron V2 Turbo
Schematron V2 Turbo — модель извлечения данных из HTML в JSON на 3 млрд параметров от Inference.net, оптимизированная под пропускную способность на больших объёмах извлечения. Инструкции по извлечению передаются JSON-схемой в response_format, а не текстом промпта. Принимает текст, отвечает текстом. Контекст 128 000 токенов, вывод до 8 192.
Характеристики и цены
| Контекстное окно | 128 000 токенов |
|---|---|
| Максимальный ответ | 8 192 токенов |
| Входные данные | текст |
| Результат | текст |
| Цена за 1 млн токенов (вход) | 6 ₽ |
| Цена за 1 млн токенов (выход) | 30 ₽ |
| Чтение из кэша (за 1 млн токенов) | 6 ₽ |
| Дата выхода | 12 сентября 2026 г. |
Цены указаны в рублях и уже включают все комиссии. Оплата с российских карт, без VPN.
Использование через API
Модель доступна через OpenAI-совместимый API. Укажите идентификатор модели в поле model:
curl https://llmost.ru/api/v1/chat/completions \
-H "Authorization: Bearer $LLMOST_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "inference-net/schematron-v2-turbo-20260902",
"messages": [{"role": "user", "content": "Привет!"}]
}'Другие модели Inference net
- Inference.net: Schematron V2 Small0.00001 ₽ / 0.000046 ₽