Inception
Inception: Mercury 2
О модели Inception: Mercury 2
Mercury 2 — чрезвычайно быстрая рассуждающая языковая модель и первая рассуждающая диффузионная LLM (dLLM). Вместо последовательной генерации токенов Mercury 2 производит и уточняет несколько токенов параллельно, достигая скорости >1000 токенов/сек на стандартных GPU. Mercury 2 более чем в 5 раз быстрее ведущих скоростных LLM, таких как Claude 4.5 Haiku и GPT 5 Mini, при значительно меньших затратах. Mercury 2 поддерживает настраиваемые уровни рассуждения, контекст 128К токенов, нативное использование инструментов и вывод JSON с выравниванием по схеме. Создана для рабочих процессов программирования, где задержка накапливается, голосовых/поисковых сервисов в реальном времени и агентных циклов. Совместима с OpenAI API.
Характеристики и цены
| Контекстное окно | 128 000 токенов |
|---|---|
| Максимальный ответ | 50 000 токенов |
| Входные данные | текст |
| Результат | текст |
| Цена за 1 млн токенов (вход) | 50 ₽ |
| Цена за 1 млн токенов (выход) | 150 ₽ |
| Чтение из кэша (за 1 млн токенов) | 5 ₽ |
| Дата выхода | 4 марта 2026 г. |
Цены указаны в рублях и уже включают все комиссии. Оплата с российских карт, без VPN.
Использование через API
Модель доступна через OpenAI-совместимый API. Укажите идентификатор модели в поле model:
curl https://llmost.ru/api/v1/chat/completions \
-H "Authorization: Bearer $LLMOST_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "inception/mercury-2-20260304",
"messages": [{"role": "user", "content": "Привет!"}]
}'