Inceptiononline
Mercury 2.5 Preview
mercury-2.5-preview
×1.3
Mercury 2.5 — это самая быстрая модель LLM с логическим выводом и новейшая модель LLM с диффузионным выводом (dLLM) от Inception.
Вместо последовательной генерации токенов, Mercury 2.5 производит и обрабатывает множество токенов параллельно, достигая производительности 1107 токенов/сек на стандартных графических процессорах. Она обеспечивает прирост интеллекта более чем на 10 пунктов по сравнению с Mercury 2, сравнимый по качеству с оптимизированными по стоимости моделями, такими как GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5.
Mercury 2.5 поддерживает настраиваемые уровни логического вывода, параллельные вызовы инструментов и вывод JSON, выровненный по схеме. Она создана для производственных рабочих нагрузок, где задержка увеличивается: поисковые агенты, голосовые конвейеры и субагенты кодирования.
Контекст 260K токенов