Inclusionai

inclusionAI: Ling-3.0-flash

быстрыеповседневныеновые
Подключить по API

О модели inclusionAI: Ling-3.0-flash

Ling-3.0-flash — mixture-of-experts модель от inclusionAI на 124 млрд параметров с ~5.1 млрд активных на токен. Спроектирована с упором на токенную эффективность и продакшн-масштабы агентского инференса: очень низкая цена, контекст 262 144 токена, поддержка инструментов. Подходит для массовых недорогих сценариев — классификация, извлечение данных, повседневные диалоги и высоконагруженные пайплайны.

Характеристики и цены

Контекстное окно262 144 токенов
Максимальный ответ32 768 токенов
Входные данныетекст
Результаттекст
Цена за 1 млн токенов (вход)4.2 ₽
Цена за 1 млн токенов (выход)12.6 ₽
Чтение из кэша (за 1 млн токенов)0.84 ₽
Дата выхода23 июля 2026 г.

Цены указаны в рублях и уже включают все комиссии. Оплата с российских карт, без VPN.

Использование через API

Модель доступна через OpenAI-совместимый API. Укажите идентификатор модели в поле model:

curl https://llmost.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $LLMOST_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "inclusionai/ling-3.0-flash-20260723",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'

Полная документация API →

Другие модели Inclusionai