Inception

Inception: Mercury 2.5 Preview

быстрыеповседневныеновые
Подключить по API

О модели Inception: Mercury 2.5 Preview

Mercury 2.5 — самая быстрая модель рассуждений от Inception и новейшая диффузионная языковая модель (dLLM). Вместо последовательной генерации токенов она создаёт и уточняет сразу несколько токенов параллельно, за счёт чего отвечает в разы быстрее обычных моделей. Контекст 260 000 токенов, потолок вывода 65 536. Хороший выбор, когда важна скорость ответа.

Характеристики и цены

Контекстное окно260 000 токенов
Максимальный ответ65 536 токенов
Входные данныетекст
Результаттекст
Цена за 1 млн токенов (вход)8 ₽
Цена за 1 млн токенов (выход)30 ₽
Чтение из кэша (за 1 млн токенов)0.8 ₽
Дата выхода31 августа 2026 г.

Цены указаны в рублях и уже включают все комиссии. Оплата с российских карт, без VPN.

Использование через API

Модель доступна через OpenAI-совместимый API. Укажите идентификатор модели в поле model:

curl https://llmost.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $LLMOST_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "inception/mercury-2.5-preview-20260831",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'

Полная документация API →

Другие модели Inception