Каталог AI-моделей Tokenator
Здесь собраны все нейросети, доступные через Tokenator. Передайте ID модели в параметре model при запросе — Tokenator сам направит трафик на подходящего апстрим-провайдера. Коэффициент рядом с моделью показывает, во сколько раз её токены дороже или дешевле базовых.
Sonnet 5 — это самая мощная модель класса Sonnet от Anthropic, демонстрирующая передовые показатели производительности в программировании, работе с агентами и профессиональной деятельности.
Claude Opus 5 — флагманская модель Anthropic для сложных задач логического мышления, программирования и работы с агентами в долгосрочной перспективе. Она особенно эффективна в сквозных задачах разработки программного обеспечения, проверке кода и поиске ошибок, визуальном анализе диаграмм и документов, выполнении сложных офисных задач и координации параллельных субагентов. Модель сохраняет высокую эффективность в выполнении инструкций и использовании инструментов в рамках длительных задач, оставаясь при этом эффективной и в условиях меньших усилий для рабочих нагрузок, в которых приоритет отдается задержке и эффективности использования токенов.
GPT-5.6 Sol — флагманская модель в серии GPT-5.6 от OpenAI. Она подходит для сложных задач логического мышления, программирования и работы с агентами, и особенно эффективна в задачах командной строки и многоэтапного программирования, а также в решении задач с длительным горизонтом планирования.
Sonnet 4.6 — это самая мощная модель класса Sonnet от Anthropic на сегодняшний день, демонстрирующая передовые показатели производительности в программировании, работе с агентами и профессиональной деятельности.
GPT-5.5 — это передовая модель OpenAI, разработанная для сложных профессиональных задач, основанная на GPT-5.4 и обладающая более сильной логической основой, повышенной надежностью и улучшенной эффективностью использования токенов при решении сложных задач.
DeepSeek V4 Pro 0813 — это масштабная модель от DeepSeek, разработанная с использованием смешанного подхода к тестированию. Это общедоступная версия DeepSeek V4 Pro.
Claude Fable 5 — это модель класса Mythos от Anthropic, созданная для автономной работы с знаниями и программирования.
Эта модель предоставляется на бесплатном тарифе с установленными лимитами использования. Gemini 3.7 Flash — это мультимодальная модель от Google, предназначенная для быстрых рабочих процессов, программирования и сложных многоэтапных рассуждений. Она сочетает высокую скорость работы с надежным решением задач, требующих последовательного анализа и выполнения нескольких шагов.
Эта модель предоставляется на бесплатном тарифе с установленными лимитами использования. Grok 4.6 — самая интеллектуальная модель SpaceXAI, демонстрирующая передовые результаты в программировании, интеллектуальном труде и STEM-образовании.
Gemini 3.7 Flash — это многомодальная модель от Google, предназначенная для быстрых рабочих процессов, программирования и сложных многоэтапных рассуждений. Она разработана для задач, требующих высокой производительности и надежного многоэтапного решения проблем.
Эта модель предоставляется на бесплатном тарифе с установленными лимитами использования. Claude Opus 5 — флагманская модель Anthropic для сложных задач логического мышления, программирования и долгосрочной работы с агентами. Она особенно эффективна в комплексной разработке программного обеспечения, проверке и поиске ошибок в коде, анализе документов и диаграмм, выполнении сложных офисных задач и координации нескольких параллельно работающих субагентов. Claude Opus 5 стабильно следует инструкциям и эффективно использует инструменты даже в длительных многоэтапных задачах. При этом модель хорошо подходит и для сценариев, где важны низкая задержка и более экономное использование токенов.
Эта модель предоставляется на бесплатном тарифе с установленными лимитами использования. MiniMax-M3 — это мультимодальная базовая модель от MiniMax, ориентированная на долгосрочную работу с агентами, программирование и использование инструментов. Она поддерживает текст, изображения и видео на входе, текстовый вывод и контекстное окно до 1 миллиона токенов. Модель построена на механизме MiniMax Sparse Attention (MSA), который вместо полного внимания использует выбор KV-блоков. Благодаря этому вычислительные затраты при работе с большим контекстом значительно снижаются — примерно в 20 раз по сравнению с предыдущим поколением при контексте в 1 миллион токенов, одновременно ускоряя предварительное заполнение и декодирование. MiniMax-M3 изначально обучалась как мультимодальная модель на чередующихся данных и дополнительно оптимизирована для длительного многоэтапного взаимодействия. Поэтому она особенно хорошо подходит для сложных агентных сценариев, где требуется последовательно выполнять большое количество действий, работать с инструментами и сохранять контекст на протяжении всей задачи.
DeepSeek V4 Flash 0731 — это разреженная модель смешанных экспертов от DeepSeek, имеющая 13 миллиардов активных параметров из 284 миллиардов общих. Эта переобученная версия подходит для программирования, логического мышления и рабочих процессов агентов.
Ox Alpha — это модель логического мышления, разработанная для программирования, длительной работы агентов и производственных нагрузок. Она подходит для разработки программного обеспечения в долгосрочной перспективе, сложных логических рассуждений и рабочих процессов, сочетающих текст с визуальным контекстом. Ox Alpha — это скрытая модель. Она разработана и управляется сторонним поставщиком, который предпочел остаться анонимным во время этого предварительного просмотра. OpenRouter направляет запросы к ней и не является ее разработчиком, владельцем или поставщиком. Подсказки и автодополнения сохраняются поставщиком и не используются для обучения; любое другое использование регулируется Условиями использования скрытой модели (открывается в новой вкладке).
GPT-5.4 mini переносит основные возможности GPT-5.4 в более быструю и эффективную модель, оптимизированную для высокопроизводительных рабочих нагрузок.
Claude Haiku 4.5 — это самая быстрая и эффективная модель от Anthropic, обеспечивающая возможности интеллекта, близкие к передовым, при значительно меньших затратах и меньшей задержке по сравнению с более крупными моделями Claude.
Opus 4.6 — это самая совершенная модель Anthropic для программирования и решения долгосрочных профессиональных задач.
Opus 4.7 — это следующее поколение семейства Opus от Anthropic, созданное для длительно работающих асинхронных агентов.
Claude Opus 4.8 — это самая функциональная общедоступная модель семейства Opus от Anthropic. Она поддерживает ввод текста, изображений и файлов с выводом текста, имеет функцию логического вывода и контекстное окно на 1 миллион токенов.
Это проприетарная модель, специально оптимизированная для программирования и агентных задач. Она хорошо справляется с генерацией, рефакторингом, анализом и отладкой кода, поддерживает tool calling. Модель показывает сильные результаты на SWE-Bench и LiveCodeBench и совместима с OpenAI API через ряд сервисов.
Это облегчённая и высокопроизводительная мультимодальная модель общего назначения. Она оптимизирована для низкой задержки, массовых запросов и корпоративных нагрузок, сохраняя поддержку рассуждений, Agent-сценариев, программирования и работы с инструментами при значительно меньшей стоимости.
Это компактная мультимодальная модель общего назначения, оптимизированная для низкой задержки, высокой пропускной способности и массовых нагрузок. Поддерживает четыре уровня интенсивности рассуждений, подходит для чат-ботов, агентных задач, программирования и корпоративных приложений, где важны скорость и стоимость.
Это флагманская мультимодальная модель общего назначения для сложных рассуждений, агентных сценариев, анализа документов, программирования и работы с длинным контекстом. Поддерживает tool/function calling, структурированный вывод и контекст до 256K токенов.
Gemini 3.1 Flash Lite — это высокоэффективная многомодальная модель Google GA, оптимизированная для рабочих нагрузок с низкой задержкой и большим объемом данных.
Gemini 3.1 Pro Preview — это передовая модель логического мышления от Google, обеспечивающая улучшенную производительность разработки программного обеспечения, повышенную надежность работы агентов и более эффективное использование токенов в сложных рабочих процессах. Основываясь на многомодальной базе серии Gemini 3, она сочетает высокоточное логическое мышление с обработкой текста, изображений, видео, аудио и кода, используя контекстное окно в 1 миллион токенов. Разработанная для продвинутой разработки и агентных систем, Gemini 3.1 Pro Preview повышает стабильность в долгосрочной перспективе и улучшает оркестрацию инструментов, одновременно повышая эффективность использования токенов. Она представляет новый средний уровень мышления для лучшего баланса между стоимостью, скоростью и производительностью. Модель превосходно подходит для агентного кодирования, структурированного планирования, многомодального анализа и автоматизации рабочих процессов, что делает её хорошо подходящей для автономных агентов, финансового моделирования, автоматизации электронных таблиц и высококонтекстных корпоративных задач.
Gemini 3.5 Flash — это высокоэффективная многомодальная модель от Google, обеспечивающая кодирование и логическое мышление на уровне, близком к профессиональному, по цене и с той же скоростью, что и Flash.
Gemini 3.6 Flash — это высокоэффективная модель от Google для программирования, агентных рабочих процессов, а также веб- и мобильной разработки. Она разработана для получения высококачественных результатов с меньшим количеством ненужных правок и хеджирования, одновременно сокращая использование токенов и количество вызовов модели, необходимых для выполнения задачи.
GLM 5.2 — это крупномасштабная модель рассуждений от компании Z.ai. Он поддерживает ввод и вывод текста с контекстным окном в 1 миллион токенов и подходит для долгосрочных рабочих процессов агентов, разработки программного обеспечения на уровне проектов и сложной многоэтапной автоматизации.
GLM 5.3 — это новейшая крупномасштабная модель логического мышления от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1 миллион токенов и предназначена для долгосрочных рабочих процессов агентов, разработки программного обеспечения на уровне проектов и сложной многоэтапной автоматизации.
GPT Image 2 сочетает в себе модель GPT-5.4 от OpenAI с передовыми возможностями генерации изображений из GPT Image 2.
GPT-4o mini — это новейшая модель OpenAI после GPT-4 Omni, поддерживающая ввод текста и изображений с выводом текста. Как самая передовая компактная модель компании, она во много раз доступнее по цене, чем другие модели последних лет, и более чем на 60% дешевле, чем GPT-3.5 Turbo. Она сохраняет передовые интеллектуальные возможности, будучи при этом значительно более экономичной.
GPT-5.6 Luna — это быстрая и экономичная модель из серии GPT-5.6 от OpenAI. Она подходит для задач с большим объемом данных, чувствительных к задержке, таких как чаты, классификация и облегченные рабочие процессы с участием агентов, и обеспечивает обоснованное решение, соответствующее ее ценовой категории.
GPT-5.6 Terra — это сбалансированная модель в серии GPT-5.6 от OpenAI, занимающая промежуточное положение между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневных задач программирования, логического мышления и работы с агентами, где необходимо сбалансировать возможности и стоимость, предлагая высокую производительность примерно за половину стоимости Sol.
Grok 4.5 — это самая интеллектуальная модель SpaceXAI, демонстрирующая передовые результаты в программировании, интеллектуальном труде и STEM-образовании.
Grok 4.6 — это самая интеллектуальная модель SpaceXAI, демонстрирующая передовые результаты в программировании, интеллектуальном труде и STEM-образовании.
Grok Build 0.1 — это быстрая модель кодирования от SpaceXAI, специально разработанная для рабочих процессов разработки программного обеспечения с использованием агентов. Она поддерживает ввод текста и изображений с текстовым выводом и оптимизирована для интерактивных агентов кодирования, использования инструментов и многоэтапных задач разработки. Модель лежит в основе интерфейса командной строки Grok Build от SpaceXAI и имеет контекстное окно размером 256 КБ без ограничения на вывод текста, что делает её хорошо подходящей для долгосрочных рабочих процессов кодирования и автоматизации. В настоящее время находится в стадии раннего доступа.
Grok Imagine Image 2.0 — это модель генерации и редактирования изображений от xAI. Она подходит для создания изображений по текстовым подсказкам и редактирования изображений по референсам, с режимами низкого и среднего качества.
Hy-MT2-1.8B — это компактная модель перевода с 1,8 миллиардами параметров от Tencent. Она поддерживает 33 языковые пары и пять пар китайских диалектов и языков национальных меньшинств, с рабочими процессами для структурированного, основанного на разделителях, контекстного, основанного на глоссарии и стилистически управляемого перевода.
Hy-MT2-30B-A3B — это флагманская модель перевода от Tencent в семействе Hy-MT2. Она поддерживает 33 языковые пары и пять пар китайских диалектов и языков национальных меньшинств, с рабочими процессами для структурированного, основанного на разделителях, контекстного, основанного на глоссарии и стилистически управляемого перевода. Она использует 3 миллиарда активных параметров из 30 миллиардов.
Hy-MT2-7B — это модель перевода с 7B параметрами от Tencent. Она поддерживает 33 языковые пары и пять пар китайских диалектов и языков национальных меньшинств, с рабочими процессами для структурированного, основанного на разделителях, контекстного, основанного на глоссарии и стилистически управляемого перевода.
Hy3 — это модель смешанных экспертов с 295 миллиардами параметров от Tencent (21 миллиард активных экспертов, 192 эксперта с маршрутизацией по топ-8), разработанная для логического мышления, рабочих процессов агентов и реального использования в производственной среде. Она поддерживает настраиваемый режим логического мышления: прямой режим без размышлений по умолчанию, а также режимы с низкой и высокой цепочкой рассуждений для сложных математических вычислений, программирования и многошаговых задач. С контекстным окном в 256 тысяч параметров Hy3 ориентирована на задачи с длительным горизонтом планирования, включая улучшенное разрешение кореференции, отслеживание ограничений в несколько этапов и стабильный вызов инструментов, обобщающийся на различные структуры агентов. Tencent позиционирует её как надёжный и экономически эффективный вариант для программирования, обработки документов, финансового анализа, разработки игр и фронтенд-дизайна, с сильным акцентом на обоснованное, антигаллюцинаторное поведение, которое отвечает, когда обосновано, и указывает на отсутствие доказательств, а не выдумывает их.
MoonshotAI: Kimi K2.7 Code — это модель, ориентированная на программирование, входящая в семейство Kimi K2 от Moonshot AI, созданная для надежного выполнения сквозных задач программирования в течение длительных периодов времени.
Kimi K3 — это модель многомодального рассуждения с открытыми весами и 2,8 ТБ параметров от Moonshot AI. Она подходит для сложного программирования, работы с интеллектуальными данными и долгосрочных агентных рабочих процессов, и особенно эффективна при работе с большими репозиториями, использовании инструментов, отладке и итерациях с изображениями, логами, тестами и обратной связью во время выполнения. В её архитектуре используются KDA и Attention Residuals для повышения вычислительной эффективности.
MiMo-V2.5 — это нативная омнимодальная модель от Xiaomi. Она обеспечивает производительность агента профессионального уровня примерно вдвое меньшие затраты на вывод, превосходя при этом MiMo-V2-Omni в многомодальном восприятии в задачах понимания изображений и видео. Ее контекстное окно размером 1 миллион поддерживает целые документы, расширенные диалоги и сложные контексты задач за один проход, что делает ее идеальной для интеграции с агентскими фреймворками, где важны сильные рассуждения, богатое восприятие и экономичность.
MiMo-V2.5-Pro — флагманская модель Xiaomi, демонстрирующая высокую производительность в общих задачах управления агентами, разработке сложного программного обеспечения и решении долгосрочных задач, занимая лидирующие позиции в таких бенчмарках, как ClawEval, GDPVal и SWE-bench Pro. Она способна самостоятельно и автономно выполнять профессиональные задачи, на решение которых у специалистов-людей ушли бы дни или недели, включая более тысячи вызовов инструментов. Длина контекста до 1 млн делает её хорошо подходящей для интеграции с широким спектром фреймворков для управления агентами.
MiniMax-M3 — это многомодальная базовая модель от MiniMax. Она поддерживает ввод текста, изображений и видео с текстовым выводом, контекстное окно в 1 миллион токенов и подходит для долгосрочной работы с агентами, программирования и использования инструментов. Она построена на основе механизма MiniMax Sparse Attention (MSA), который заменяет полное внимание выбором KV-блоков, что сокращает вычислительные затраты на каждый токен при большом контексте — примерно в 20 раз меньше, чем у предыдущего поколения при 1 миллионе токенов, с существенно более быстрым предварительным заполнением и декодированием при сохранении качества в большинстве задач. Модель, обученная как нативная многомодальная модель на чередующихся данных и настроенная для многоэтапного, подобного производственному, сотрудничества с помощью интерактивной пользовательской симуляционной среды, ориентирована на устойчивые многошаговые задачи, а не на выполнение за один ход.
Muse Spark 1.2 — это модель логического вывода от Meta, разработанная для сложных задач, выполняемых агентами. Она принимает текст, изображения, видео, аудио и PDF-документы, возвращает текст и предлагает контекстное окно в 1 миллион токенов. Модель создана для поддержки многоагентных рабочих процессов, будь то в качестве основного агента, планирующего и делегирующего задачи, или в качестве субагента, выполняющегося параллельно. Она работает с различными программными средствами и поддерживает структурированный вывод, параллельный вызов функций и настраиваемые усилия логического вывода. В ходе тестирования Meta она показала хорошие результаты при многофайловой рефакторизации, длительных сеансах отладки, генерации всего репозитория и задачах, выходящих далеко за рамки одного запроса.
Gemini 3.1 Flash Image Preview, также известный как Nano Banana 2, — это новейшая передовая модель генерации и редактирования изображений от Google, обеспечивающая визуальное качество профессионального уровня на скорости Flash.
Nano Banana Pro — это самая передовая модель генерации и редактирования изображений от Google, созданная на основе Gemini 3 Pro. Она расширяет возможности оригинальной Nano Banana, значительно улучшая многомодальное мышление, привязку к реальному миру и высококачественный визуальный синтез. Модель генерирует контекстно-насыщенную графику, от инфографики и диаграмм до кинематографических композиций, и может включать информацию в реальном времени благодаря привязке к поиску.
Qwen3.7-Max — флагманская модель в серии Qwen3.7 от Alibaba. Она поддерживает ввод и вывод текста и разработана для рабочих нагрузок, ориентированных на агентов, с особым акцентом на программирование, офисные и продуктивное выполнение задач, а также автономное выполнение в долгосрочной перспективе. Модель демонстрирует заметное повышение производительности программирования и работы агентов по сравнению с предыдущими поколениями Qwen и поддерживает явное кэширование подсказок для эффективного использования контекста при повторном использовании.
Qwen3.7-Plus — это экономичная модель из серии Qwen3.7 от Alibaba. Она поддерживает ввод текста и изображений, а также вывод текста, расширяя возможности серии в области обработки текста за счет комплексного обновления возможностей обработки изображений и языка, сохраняя при этом полнофункциональный интеллект на уровне агента для программирования, использования инструментов и повышения производительности. Ее отличительной чертой является многомодальная интерактивная гибридная агентская способность: она может распознавать сцены реального мира, считывать экраны и взаимодействовать с графическими интерфейсами, генерировать код на основе визуальных данных и выполнять сквозную навигацию в мобильных приложениях.
Qwen 3.8 Max — флагманская модель Alibaba нового поколения, созданная для сложных задач программирования, аналитики и профессиональной работы. Она отлично подходит для full-stack разработки, анализа данных, автоматизации офисных процессов и выполнения длительных многоэтапных задач.
Seedream 5.0 Lite — это модель генерации изображений от ByteDance Seed. Она подходит для профессионального создания визуальной информации, которая выигрывает от доступа к данным через Интернет, понимания сложных запросов, визуальных ссылок и широкого охвата знаний.
Seedream 5.0 Pro — это модель для генерации и редактирования изображений от ByteDance Seed. Она подходит для коммерческих рабочих процессов визуального производства, требующих точного контроля редактирования, реалистичных сцен и естественного рендеринга.
Solar Pro 4 — это экономичная языковая модель Upstage с большим объемом памяти, включающая контекстное окно в 524К. Она разработана для задач с длительным горизонтом планирования и агентских рабочих процессов, обладая широкими возможностями в области офисной работы, работы с документами и программирования.
Усовершенствованный инструмент авто-агента в редакторе кода, предназначенный для сквозной разработки на уровне проекта.
LongCat 2.0 — это разреженная языковая модель от Meituan, использующая комбинацию экспертов, с 48 миллиардами активных параметров из 1,6 миллиарда. Она подходит для программирования, внесения изменений на уровне репозитория, решения задач с длительным горизонтом планирования и агентных рабочих процессов.
57 моделей в каталоге, доступно 55, 17 разработчиков моделей, 6 для генерации изображений, контекст до 1.05M токенов
Модели по разработчикам: