Хостинг-провайдер

Azure

Azure обслуживает эти модели как инфраструктурный провайдер. Авторы моделей указаны отдельно в списке.

52

моделей в каталоге

Модели на хостинге Azure

В списке показаны только включённые модели из публичного каталога GoRouter.

Anthropic: Claude Fable 5.1

anthropic/claude-fable-5.1

Claude Fable 5.1 превосходит Claude Fable 5 по всем направлениям, при этом наибольший прогресс наблюдается в агентном программировании, длительных агентных рабочих процессах и интеллектуальной работе: особенно в длительном рефакторинге кода, генерации front-end и визуального кода, а также в финансовых и аналитических задачах. Он также, как правило, более лаконичен, чем Fable 5, в своих планах и сводках. Мы рекомендуем протестировать его как прямое обновление везде, где вы сегодня используете Fable 5, а также вместе с Opus 5 для задач, требующих сложных рассуждений.

автор anthropic1 сент. 2026 г.1 237,76 ₽ / 1 млн входных6 188,78 ₽ / 1 млн выходных
Claude Opus 5

anthropic/claude-opus-5

Claude Opus 5 — флагманская модель компании Anthropic для сложных задач рассуждения, программирования и длительной агентной работы. Она особенно сильна в сквозных программных задачах, ревью кода и поиске ошибок, визуальном анализе диаграмм и документов, подготовке сложных офисных результатов и координации параллельных субагентов. Модель сохраняет высокое качество следования инструкциям и использования инструментов при выполнении длительных задач, оставаясь эффективной в условиях пониженных вычислительных затрат для рабочих нагрузок, где важны задержка и эффективность использования токенов.

автор anthropic24 июл. 2026 г.618,88 ₽ / 1 млн входных3 094,39 ₽ / 1 млн выходных
Microsoft: MAI-Image-2.5 Pro

microsoft/mai-image-2.5-pro

MAI-Image-2.5 от Microsoft — это высококачественная модель генерации изображений, доступная через Azure AI Foundry. Она создает фотореалистичные и художественные изображения по текстовым запросам с поддержкой различных соотношений сторон.

автор microsoft23 июл. 2026 г.13 367,76 ₽ за 1 млн токенов
Microsoft: MAI-Voice-2-Flash

microsoft/mai-voice-2-flash

MAI-Voice-2-Flash — это модель преобразования текста в речь с низкой задержкой от Microsoft для голосовых агентов, ассистентов, контакт-центров, озвучивания, доступности и других интерактивных приложений. Она генерирует выразительную монофоническую речь 24 kHz на 15 языках и в 18 локалях с точным контролем тона и подачи. Голосовой промптинг и клонирование требуют доступа, одобренного Microsoft, и соответствующего согласия говорящего.

автор microsoft23 июл. 2026 г.1 856,63 ₽ за 1 млн символов
OpenAI: GPT-5.6 Luna Pro

openai/gpt-5.6-luna-pro

GPT-5.6 Luna Pro — это та же базовая модель, что и GPT-5.6 Luna, обслуживаемая с параметром reasoning.mode, установленным в значение pro, для получения более качественных ответов на сложных задачах. Подробнее в документации OpenAI: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

автор openai9 июл. 2026 г.от 12,38 ₽ / 1 млн входныхот 74,27 ₽ / 1 млн выходных
OpenAI: GPT-5.6 Luna

openai/gpt-5.6-luna

GPT-5.6 Luna — это быстрая и экономически эффективная модель в серии OpenAI GPT-5.6. Она подходит для высоконагруженных задач, чувствительных к задержке, таких как чат, классификация и лёгкие агентные рабочие процессы, обеспечивая достойные рассуждения для своего ценового сегмента.

автор openai9 июл. 2026 г.от 12,38 ₽ / 1 млн входныхот 74,27 ₽ / 1 млн выходных
OpenAI: GPT-5.6 Terra Pro

openai/gpt-5.6-terra-pro

GPT-5.6 Terra Pro — это та же базовая модель, что и GPT-5.6 Terra, предоставляемая с reasoning.mode, установленным в pro, для более качественных ответов на сложных задачах. Подробнее в документации OpenAI: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

автор openai9 июл. 2026 г.от 123,78 ₽ / 1 млн входныхот 742,65 ₽ / 1 млн выходных
OpenAI: GPT-5.6 Terra

openai/gpt-5.6-terra

GPT-5.6 Terra — сбалансированная модель в серии OpenAI GPT-5.6, занимающая позицию между флагманским уровнем Sol и экономичным уровнем Luna. Она подходит для повседневных задач программирования, рассуждений и агентных сценариев, где требуется баланс между производительностью и стоимостью, обеспечивая высокую эффективность примерно вдвое дешевле, чем Sol.

автор openai9 июл. 2026 г.от 123,78 ₽ / 1 млн входныхот 742,65 ₽ / 1 млн выходных
OpenAI: GPT-5.6 Sol Pro

openai/gpt-5.6-sol-pro

GPT-5.6 Sol Pro — это та же базовая модель, что и GPT-5.6 Sol, предоставляемая с параметром reasoning.mode, установленным в pro, для более качественных ответов на сложных задачах. Узнайте больше в документации OpenAI: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode

автор openai9 июл. 2026 г.от 247,55 ₽ / 1 млн входныхот 1 237,76 ₽ / 1 млн выходных
OpenAI: GPT-5.6 Sol

openai/gpt-5.6-sol

GPT-5.6 Sol — флагманская модель в серии GPT-5.6 от OpenAI. Она подходит для сложных рассуждений, написания кода и агентских рабочих процессов, и особенно сильна в задачах командной строки, многошаговых задачах кодирования и решении задач с длинным горизонтом.

автор openai9 июл. 2026 г.от 123,78 ₽ / 1 млн входныхот 618,88 ₽ / 1 млн выходных
Anthropic: Claude Sonnet 5

anthropic/claude-sonnet-5

Sonnet 5 — это самая мощная модель Anthropic класса Sonnet, с передовой производительностью в программировании, агентных задачах и профессиональной работе. Она поддерживает адаптивное мышление с выбираемым уровнем рассуждений (низкий, средний, высокий, максимальный и сверхвысокий), контекстное окно на 1M токенов, а также ввод текста, изображений и файлов. Sonnet 5 использует обновлённый токенизатор и включает киберзащиту в реальном времени, блокирующую определённые виды деятельности двойного назначения с высоким риском.

автор anthropic30 июн. 2026 г.247,55 ₽ / 1 млн входных1 237,76 ₽ / 1 млн выходных
Anthropic: Claude Fable 5

anthropic/claude-fable-5

Claude Fable 5 — это модель класса Mythos от Anthropic, созданная для автономной работы со знаниями и кодирования. Она поддерживает ввод текста, изображений и файлов с выводом текста, поддержку рассуждений и окно контекста на 1M токенов. Она подходит для длительных, сложных и асинхронных задач, которые ранее требовали частых проверок человеком. Она особенно сильна в сквозной работе, которая в противном случае заняла бы у человека часы, дни или недели — берясь за проблемы, которые являются длительными, неоднозначными или многоэтапными. Она выполняет четко очерченные задачи с небольшим количеством ошибок, автоматически самокорректируется через циклы проверки и поставляется с надежными мерами защиты.

автор anthropic9 июн. 2026 г.1 237,76 ₽ / 1 млн входных6 188,78 ₽ / 1 млн выходных
Microsoft: MAI-Voice-2

microsoft/mai-voice-2

MAI-Voice-2 — это выразительная модель синтеза речи от Microsoft. Она подходит для разговорных ассистентов, озвучивания медиа, доступности, образования и других голосовых приложений длинного формата. Она поддерживает 15 языков в 18 локалях, обеспечивает детальную настройку тона и подачи, многоголосую генерацию и генерацию по голосовому образцу из коротких аудиофрагментов без дообучения. Модель ставит естественность и выразительность выше генерации, критичной к задержке.

автор microsoft2 июн. 2026 г.2 723,06 ₽ за 1 млн символов
Microsoft: MAI-Transcribe 1.5

microsoft/mai-transcribe-1.5

MAI-Transcribe 1.5 — это многоязычная модель преобразования речи в текст от Microsoft AI. Она подходит для субтитров, транскрибации звонков, создания субтитров, обеспечения доступности и других голосовых приложений, обеспечивая надежную транскрибацию на 43 языках, различных акцентах и зашумленном реальном аудио. Она поддерживает автоматическое определение языка и смещение ключевых слов для доменной терминологии, а также повышает скорость транскрибации длинных аудио по сравнению с MAI-Transcribe-1. Диаризация говорящих не поддерживается.

автор microsoft2 июн. 2026 г.44,56 ₽ за час
Microsoft: MAI-Image-2.5

microsoft/mai-image-2.5

MAI-Image-2.5 от Microsoft — это высококачественная модель генерации изображений, доступная через Azure AI Foundry. Она создаёт фотореалистичные и художественные изображения по текстовым запросам с поддержкой различных соотношений сторон.

автор microsoft2 июн. 2026 г.5 817,45 ₽ за 1 млн токенов
Anthropic: Claude Opus 4.8

anthropic/claude-opus-4.8

Claude Opus 4.8 — это наиболее мощная общедоступная модель в семействе Opus от Anthropic. Она поддерживает ввод текста, изображений и файлов с выводом текста, поддерживает рассуждения и контекстное окно на 1M токенов. Она подходит для высокоавтономных агентов, долгосрочной агентной работы, работы со знаниями и задач, связанных с памятью, где важна согласованность в течение длительных сессий. Она особенно сильна в многошаговых рассуждениях, сложном кодировании и сквозной оркестрации проектов - больших базах кода, многоэтапной отладке и длительных асинхронных конвейерах агентов. Помимо кодирования, она справляется с работой со знаниями, такой как составление документов, создание презентаций и анализ данных, сохраняя качество при очень длинных выводах.

автор anthropic27 мая 2026 г.618,88 ₽ / 1 млн входных3 094,39 ₽ / 1 млн выходных
OpenAI: GPT-5.5

openai/gpt-5.5

GPT-5.5 — это фронтирная модель от OpenAI, разработанная для сложных профессиональных задач, развивающаяся на основе GPT-5.4 с более сильными рассуждениями, повышенной надёжностью и улучшенной эффективностью токенов на сложных задачах. Она оснащена контекстным окном размером 1M+ токенов (922K на вход, 128K на выход) с поддержкой текстовых и графических входных данных, что обеспечивает масштабные рассуждения, программирование и мультимодальные рабочие процессы в одной системе.

автор openai24 апр. 2026 г.от 618,88 ₽ / 1 млн входныхот 3 713,27 ₽ / 1 млн выходных
DeepSeek: DeepSeek V4 Pro 0423

deepseek/deepseek-v4-pro

DeepSeek V4 Pro — это крупномасштабная модель смеси экспертов от DeepSeek с общим количеством параметров 1.6T и активными параметрами 49B, поддерживающая контекстное окно в 1M токенов. Модель предназначена для сложных задач рассуждения, программирования и длительных агентных сценариев, демонстрируя высокую производительность в области знаний, математики и программной инженерии. Основанная на той же архитектуре, что и DeepSeek V4 Flash, она использует гибридную систему внимания для эффективной обработки длинных контекстов. Поддерживаются уровни рассуждения high и xhigh; xhigh соответствует максимальному режиму рассуждения. Модель хорошо подходит для ресурсоёмких задач, таких как анализ всего кодового репозитория, многошаговая автоматизация и крупномасштабный синтез информации, где критически важны как производительность, так и эффективность.

автор deepseek24 апр. 2026 г.129,75 ₽ / 1 млн входных259,49 ₽ / 1 млн выходных
DeepSeek: DeepSeek V4 Flash 0423

deepseek/deepseek-v4-flash

DeepSeek V4 Flash — это оптимизированная по эффективности модель Mixture-of-Experts от DeepSeek с 284B общим количеством параметров и 13B активируемых параметров, поддерживающая контекстное окно в 1M токенов. Она предназначена для быстрого вывода и высокопроизводительных рабочих нагрузок, сохраняя при этом высокую производительность в рассуждениях и написании кода. Модель включает гибридное внимание для эффективной обработки длинного контекста. Поддерживаются режимы рассуждений high и xhigh; xhigh соответствует максимальному режиму рассуждений. Она хорошо подходит для таких приложений, как ассистенты программирования, чат-системы и агентные рабочие процессы, где важны отзывчивость и экономическая эффективность.

автор deepseek24 апр. 2026 г.10,59 ₽ / 1 млн входных21,18 ₽ / 1 млн выходных
Anthropic: Claude Opus 4.7

anthropic/claude-opus-4.7

Opus 4.7 — это следующее поколение семейства Anthropic's Opus, созданное для долгоиграющих асинхронных агентов. Опираясь на сильные стороны кодирования и агентности Opus 4.6, оно обеспечивает более высокую производительность в сложных многошаговых задачах и более надежное агентное выполнение в расширенных рабочих процессах. Особенно эффективно для асинхронных агентных конвейеров, где задачи разворачиваются во времени — большие кодовые базы, многоэтапная отладка и сквозная оркестрация проектов. Помимо кодирования, Opus 4.7 расширяет возможности интеллектуальной работы — от составления документов и создания презентаций до анализа данных. Он поддерживает согласованность в очень длинных выводах и длительных сессиях, что делает его надежным выбором по умолчанию для задач, требующих настойчивости, суждения и доведения до конца. Для пользователей, переходящих с более ранних версий Opus, см. официальное руководство по миграции здесь.

автор anthropic16 апр. 2026 г.618,88 ₽ / 1 млн входных3 094,39 ₽ / 1 млн выходных
OpenAI: GPT-5.4 Nano

openai/gpt-5.4-nano

GPT-5.4 nano — самый легковесный и экономичный вариант семейства GPT-5.4, оптимизированный для задач, критичных к скорости и большим объёмам. Он поддерживает ввод текста и изображений и предназначен для сценариев с низкой задержкой, таких как классификация, извлечение данных, ранжирование и выполнение субагентов. Модель ставит приоритет на отзывчивость и эффективность, а не на глубокое рассуждение, что делает её идеальной для конвейеров, требующих быстрых и надёжных результатов в масштабе. GPT-5.4 nano хорошо подходит для фоновых задач, систем реального времени и распределённых агентных архитектур, где минимизация затрат и задержек критически важна.

автор openai17 мар. 2026 г.24,76 ₽ / 1 млн входных154,72 ₽ / 1 млн выходных
OpenAI: GPT-5.4 Mini

openai/gpt-5.4-mini

GPT-5.4 mini переносит основные возможности GPT-5.4 в более быструю и эффективную модель, оптимизированную для высоконагруженных рабочих нагрузок. Она поддерживает ввод текста и изображений, обеспечивая высокую производительность в рассуждениях, написании кода и использовании инструментов, при этом снижая задержку и стоимость для масштабных развертываний. Модель предназначена для производственных сред, требующих баланса между производительностью и эффективностью, что делает её подходящей для чат-приложений, помощников по программированию и агентских рабочих процессов, работающих в масштабе. GPT-5.4 mini обеспечивает надёжное следование инструкциям, уверенные многошаговые рассуждения и стабильные результаты в различных задачах при улучшенной экономической эффективности.

автор openai17 мар. 2026 г.92,83 ₽ / 1 млн входных556,99 ₽ / 1 млн выходных
OpenAI: GPT-5.4 Pro

openai/gpt-5.4-pro

GPT-5.4 Pro — самая современная модель OpenAI, основанная на единой архитектуре GPT-5.4 с улучшенными возможностями рассуждения для сложных задач с высокими ставками. Она имеет контекстное окно на 1M+ токенов (922K на вход, 128K на выход) с поддержкой текстовых и графических входных данных. Оптимизированная для пошаговых рассуждений, следования инструкциям и точности, GPT-5.4 Pro превосходно справляется с агентным программированием, длинными контекстными рабочими процессами и многошаговым решением задач.

автор openai5 мар. 2026 г.от 1 856,63 ₽ / 1 млн входныхот 11 139,80 ₽ / 1 млн выходных
OpenAI: GPT-5.4

openai/gpt-5.4

GPT-5.4 — новейшая фронтирная модель OpenAI, объединяющая линейки Codex и GPT в единую систему. Она поддерживает контекстное окно размером 1M+ токенов (922K на входе, 128K на выходе) с поддержкой текстовых и графических входных данных, что позволяет выполнять рассуждения с большим контекстом, программирование и мультимодальный анализ в рамках одного рабочего процесса. Модель обеспечивает улучшенную производительность в программировании, понимании документов, использовании инструментов и следовании инструкциям. Она разработана как надёжное решение по умолчанию как для задач общего назначения, так и для программной инженерии, способна генерировать производственный код, синтезировать информацию из множества источников и выполнять сложные многошаговые рабочие процессы с меньшим количеством итераций и большей эффективностью использования токенов.

автор openai5 мар. 2026 г.от 154,72 ₽ / 1 млн входныхот 928,32 ₽ / 1 млн выходных
OpenAI: GPT-5.3-Codex

openai/gpt-5.3-codex

GPT-5.3-Codex — это самая продвинутая агентная модель для написания кода от OpenAI, сочетающая передовую производительность в разработке программного обеспечения GPT-5.2-Codex с более широкими возможностями рассуждения и профессиональными знаниями GPT-5.2. Она достигает самых современных результатов на SWE-Bench Pro и высоких показателей в Terminal-Bench 2.0 и OSWorld-Verified, что отражает улучшенное многоязычное программирование, владение терминалом и навыки реального использования компьютера. Модель оптимизирована для длительных рабочих процессов с использованием инструментов и поддерживает интерактивное управление во время выполнения, что делает её подходящей для сложных задач разработки, отладки, развертывания и итеративной работы над продуктом. Помимо программирования, GPT-5.3-Codex показывает высокие результаты на бенчмарках структурированной работы со знаниями, таких как GDPval, поддерживая такие задачи, как составление документов, анализ электронных таблиц, создание слайдов и операционные исследования в различных областях. Она обучена с усиленным вниманием к кибербезопасности, включая возможности выявления уязвимостей, и развернута с дополнительными мерами защиты для случаев высокого риска. По сравнению с предыдущими моделями Codex, она более эффективно использует токены и примерно на 25% быстрее, ориентируясь на профессиональные сквозные рабочие процессы, охватывающие рассуждение, выполнение и взаимодействие с компьютером.

автор openai24 февр. 2026 г.216,61 ₽ / 1 млн входных1 732,86 ₽ / 1 млн выходных
Anthropic: Claude Sonnet 4.6

anthropic/claude-sonnet-4.6

Sonnet 4.6 — это самая производительная модель Sonnet-класса от Anthropic, обеспечивающая передовую производительность в программировании, работе с агентами и профессиональных задачах. Она превосходно подходит для итеративной разработки, навигации по сложным кодовым базам, сквозного управления проектами с памятью, создания качественных документов и уверенного использования компьютера для веб-QA и автоматизации рабочих процессов.

автор anthropic17 февр. 2026 г.371,33 ₽ / 1 млн входных1 856,63 ₽ / 1 млн выходных
Anthropic: Claude Opus 4.6

anthropic/claude-opus-4.6

Opus 4.6 — это самая мощная модель Anthropic для программирования и длительных профессиональных задач. Она создана для агентов, работающих в рамках целых рабочих процессов, а не отдельных запросов, что делает её особенно эффективной для больших кодовых баз, сложных рефакторингов и многоэтапной отладки, разворачивающейся во времени. Модель демонстрирует более глубокое понимание контекста, более сильную декомпозицию задач и большую надёжность при решении сложных инженерных задач по сравнению с предыдущими поколениями. Помимо программирования, Opus 4.6 превосходно справляется с длительной интеллектуальной работой. Она создаёт документы, планы и аналитические материалы, готовые к использованию, за один проход, и сохраняет связность в очень длинных выходных данных и продолжительных сессиях. Это делает её надёжным выбором по умолчанию для задач, требующих настойчивости, суждения и доведения до конца, таких как техническое проектирование, планирование миграции и сквозное выполнение проектов. Для пользователей, переходящих с более ранних версий Opus, см. официальное руководство по миграции здесь

автор anthropic4 февр. 2026 г.618,88 ₽ / 1 млн входных3 094,39 ₽ / 1 млн выходных
OpenAI: GPT-5.2-Codex

openai/gpt-5.2-codex

GPT-5.2-Codex — это обновлённая версия GPT-5.1-Codex, оптимизированная для разработки программного обеспечения и рабочих процессов написания кода. Она предназначена как для интерактивных сессий разработки, так и для длительного независимого выполнения сложных инженерных задач. Модель поддерживает создание проектов с нуля, разработку функций, отладку, масштабный рефакторинг и проверку кода. По сравнению с GPT-5.1-Codex, 5.2-Codex более управляема, точно следует инструкциям разработчика и выдаёт более чистый и качественный код. Уровень рассуждений можно настраивать с помощью параметра reasoning.effort. Читайте документацию здесь. Codex интегрируется в среды разработки, включая CLI, расширения IDE, GitHub и облачные задачи. Он динамически адаптирует уровень рассуждений — обеспечивает быстрые ответы для небольших задач и поддерживает длительные многочасовые сессии для крупных проектов. Модель обучена проводить структурированные проверки кода, выявляя критические ошибки за счёт анализа зависимостей и проверки поведения на тестах. Она также поддерживает мультимодальные входные данные, такие как изображения или скриншоты, для разработки UI, и интегрирует использование инструментов для поиска, установки зависимостей и настройки окружения. Codex предназначен специально для агентных задач написания кода.

автор openai14 янв. 2026 г.216,61 ₽ / 1 млн входных1 732,86 ₽ / 1 млн выходных
OpenAI: GPT-5.2 Chat

openai/gpt-5.2-chat

GPT-5.2 Chat (AKA Instant) — это быстрый и легковесный представитель семейства 5.2, оптимизированный для чатов с низкой задержкой и при этом сохраняющий высокий общий интеллект. Он использует адаптивные рассуждения, чтобы выборочно «размышлять» над сложными запросами, повышая точность в математике, программировании и многошаговых задачах, не замедляя при этом типичные разговоры. По умолчанию модель более тёплая и разговорчивая, лучше следует инструкциям и демонстрирует более стабильные краткие рассуждения. GPT-5.2 Chat предназначен для высоконагруженных интерактивных сценариев, где скорость отклика и согласованность важнее глубоких размышлений.

автор openai10 дек. 2025 г.216,61 ₽ / 1 млн входных1 732,86 ₽ / 1 млн выходных
OpenAI: GPT-5.2

openai/gpt-5.2

GPT-5.2 — это новейшая модель пограничного класса в серии GPT-5, обеспечивающая более высокую производительность в агентных сценариях и работе с длинным контекстом по сравнению с GPT-5.1. Она использует адаптивные рассуждения для динамического распределения вычислительных ресурсов, быстро отвечая на простые запросы и затрачивая больше глубины на сложные задачи. Созданная для широкого охвата задач, GPT-5.2 обеспечивает стабильный прирост в математике, программировании, научных и инструментальных рабочих нагрузках, предлагая более связные развёрнутые ответы и повышенную надёжность использования инструментов.

автор openai10 дек. 2025 г.216,61 ₽ / 1 млн входных1 732,86 ₽ / 1 млн выходных
OpenAI: GPT-5.1-Codex-Max

openai/gpt-5.1-codex-max

GPT-5.1-Codex-Max — это последняя агентная модель для написания кода от OpenAI, разработанная для длительных задач разработки программного обеспечения с большим контекстом. Она основана на обновлённой версии стека рассуждений 5.1 и обучена на агентных рабочих процессах, охватывающих разработку программного обеспечения, математику и исследования. GPT-5.1-Codex-Max обеспечивает более высокую производительность, улучшенные рассуждения и более высокую эффективность использования токенов на всём жизненном цикле разработки.

автор openai4 дек. 2025 г.154,72 ₽ / 1 млн входных1 237,76 ₽ / 1 млн выходных
Anthropic: Claude Opus 4.5

anthropic/claude-opus-4.5

Claude Opus 4.5 — это передовая модель рассуждений от Anthropic, оптимизированная для сложной разработки программного обеспечения, агентных рабочих процессов и длительного использования компьютера. Она обладает сильными мультимодальными возможностями, конкурентоспособной производительностью в реальных задачах кодирования и рассуждений, а также повышенной устойчивостью к инъекциям подсказок. Модель разработана для эффективной работы при различных уровнях усилий, позволяя разработчикам выбирать между скоростью, глубиной и использованием токенов в зависимости от требований задачи. Она поставляется с новым параметром для контроля эффективности токенов, который доступен через параметр OpenRouter Verbosity с уровнями low, medium или high. Opus 4.5 поддерживает расширенное использование инструментов, управление расширенным контекстом и скоординированные настройки мультиагентов, что делает её хорошо подходящей для автономных исследований, отладки, многошагового планирования и манипуляций с электронными таблицами/браузером. Она обеспечивает значительный прирост в структурированных рассуждениях, надежности выполнения и согласованности по сравнению с предыдущими поколениями Opus, при этом снижая накладные расходы на токены и улучшая производительность при длительных задачах.

автор anthropic24 нояб. 2025 г.618,88 ₽ / 1 млн входных3 094,39 ₽ / 1 млн выходных
OpenAI: GPT-5.1

openai/gpt-5.1

GPT-5.1 — это модель передового уровня в серии GPT-5, обладающая более сильными универсальными рассуждениями, улучшенным следованием инструкциям и более естественным стилем общения по сравнению с GPT-5. Она использует адаптивные рассуждения для динамического распределения вычислительных ресурсов, быстро отвечая на простые запросы и выделяя больше ресурсов GPU для сложных задач. Модель дает более четкие и понятные объяснения с меньшим количеством жаргона, что упрощает восприятие даже технических или многошаговых проблем. Благодаря широкой сфере применения, GPT-5.1 обеспечивает стабильные результаты в математике, программировании и задачах со структурированными данными, предлагая более связные развернутые ответы и повышенную надежность при использовании инструментов. Кроме того, она отличается более точным следованием указаниям, обеспечивая более естественное и комфортное взаимодействие без ущерба для точности. GPT-5.1 — это основная модель полного цикла, пришедшая на смену GPT-5.

автор openai13 нояб. 2025 г.154,72 ₽ / 1 млн входных1 237,76 ₽ / 1 млн выходных
OpenAI: GPT-5.1-Codex

openai/gpt-5.1-codex

GPT-5.1-Codex — это специализированная версия GPT-5.1, оптимизированная для разработки программного обеспечения и рабочих процессов написания кода. Она предназначена как для интерактивных сессий разработки, так и для длительного автономного выполнения сложных инженерных задач. Модель поддерживает создание проектов с нуля, разработку функций, отладку, масштабный рефакторинг и ревью кода. По сравнению с GPT-5.1, Codex более управляема, строго следует инструкциям разработчика и выдаёт более чистый и качественный код. Уровень усилий на рассуждение можно регулировать с помощью параметра reasoning.effort. Документация доступна здесь Codex интегрируется в среды разработки, включая CLI, расширения IDE, GitHub и облачные задачи. Она динамически адаптирует усилия на рассуждение: обеспечивает быстрые ответы для небольших задач и поддерживает длительные многочасовые сессии для крупных проектов. Модель обучена выполнять структурированные ревью кода, выявляя критические недостатки путём анализа зависимостей и проверки поведения на соответствие тестам. Она также поддерживает мультимодальные входные данные, такие как изображения или скриншоты, для разработки UI, и интегрирует использование инструментов для поиска, установки зависимостей и настройки окружения. Codex предназначена специально для агентных задач написания кода.

автор openai13 нояб. 2025 г.154,72 ₽ / 1 млн входных1 237,76 ₽ / 1 млн выходных
OpenAI: GPT-5.1-Codex-Mini

openai/gpt-5.1-codex-mini

GPT-5.1-Codex-Mini — это меньшая и более быстрая версия GPT-5. 1-Codex

автор openai13 нояб. 2025 г.30,94 ₽ / 1 млн входных247,55 ₽ / 1 млн выходных
OpenAI: Text Embedding 3 Large

openai/text-embedding-3-large

text-embedding-3-large — это самая производительная модель встраивания OpenAI как для англоязычных, так и для неанглоязычных задач. Embedding представляют собой числовое представление текста, которое можно использовать для измерения связанности между двумя фрагментами текста. Embedding полезны для поиска, кластеризации, рекомендаций, обнаружения аномалий и задач классификации.

автор openai30 окт. 2025 г.16,09 ₽ за 1 млн токенов
OpenAI: Text Embedding 3 Small

openai/text-embedding-3-small

text-embedding-3-small — это улучшенная, более производительная версия модели встраивания OpenAI. Embedding — это числовое представление текста, которое можно использовать для измерения схожести между двумя фрагментами текста. Embedding полезны для задач поиска, кластеризации, рекомендаций, обнаружения аномалий и классификации.

автор openai30 окт. 2025 г.2,48 ₽ за 1 млн токенов
Anthropic: Claude Haiku 4.5

anthropic/claude-haiku-4.5

Claude Haiku 4.5 — самая быстрая и эффективная модель Anthropic, обеспечивающая интеллект почти фронтирного уровня при доле стоимости и задержки по сравнению с более крупными моделями Claude. Сопоставимая с производительностью Claude Sonnet 4 в задачах рассуждения, написания кода и использования компьютера, Haiku 4.5 выводит возможности фронтирного уровня в реальное время и приложения с высокими объёмами нагрузки. Она представляет расширенное мышление для линейки Haiku, обеспечивая контроль глубины рассуждений, суммаризированный или чередующийся вывод мыслей и рабочие процессы с инструментальной поддержкой, включая полную поддержку программирования, bash, веб-поиска и инструментов использования компьютера. Набрав >73% баллов в SWE-bench Verified, Haiku 4.5 занимает место среди лучших мировых моделей кодирования, сохраняя исключительную отзывчивость для сабагентов, параллельного выполнения и масштабируемого развёртывания.

автор anthropic15 окт. 2025 г.123,78 ₽ / 1 млн входных618,88 ₽ / 1 млн выходных
Anthropic: Claude Sonnet 4.5

anthropic/claude-sonnet-4.5

Claude Sonnet 4.5 — это самая продвинутая модель Sonnet от Anthropic на сегодняшний день, оптимизированная для реальных агентов и рабочих процессов программирования. Она обеспечивает передовую производительность на бенчмарках кодинга, таких как SWE-bench Verified, с улучшениями в проектировании систем, безопасности кода и соблюдении спецификаций. Модель предназначена для длительной автономной работы, поддерживая непрерывность задач между сессиями и предоставляя отслеживание прогресса на основе фактов. Sonnet 4.5 также представляет более сильные агентные возможности, включая улучшенную оркестрацию инструментов, спекулятивное параллельное выполнение и более эффективное управление контекстом и памятью. Благодаря улучшенному отслеживанию контекста и контролю использования токенов при вызовах инструментов, она особенно хорошо подходит для многоконтекстных и длительных рабочих процессов. Варианты использования охватывают программную инженерию, кибербезопасность, финансовый анализ, исследовательских агентов и другие области, требующие устойчивого рассуждения и использования инструментов.

автор anthropic29 сент. 2025 г.от 371,33 ₽ / 1 млн входныхот 1 856,63 ₽ / 1 млн выходных
OpenAI: GPT-5

openai/gpt-5

GPT-5 — это самая продвинутая модель от OpenAI, предлагающая значительные улучшения в рассуждении, качестве кода и пользовательском опыте. Она оптимизирована для сложных задач, требующих пошагового мышления, следования инструкциям и точности в ответственных сценариях. Модель поддерживает функции маршрутизации на этапе тестирования и расширенное понимание намерений пользователя, включая такие запросы, как «обдумай это тщательно». Среди улучшений — снижение количества галлюцинаций и сикофантии, а также повышение производительности в задачах, связанных с программированием, письмом и медициной.

автор openai7 авг. 2025 г.154,72 ₽ / 1 млн входных1 237,76 ₽ / 1 млн выходных
OpenAI: GPT-5 Mini

openai/gpt-5-mini

GPT-5 Mini — это компактная версия GPT-5, предназначенная для решения менее ресурсоёмких задач рассуждения. Она обеспечивает те же преимущества следования инструкциям и безопасности тонкой настройки, что и GPT-5, но с меньшей задержкой и стоимостью. GPT-5 Mini — это преемник модели o4-mini от OpenAI.

автор openai7 авг. 2025 г.30,94 ₽ / 1 млн входных247,55 ₽ / 1 млн выходных
OpenAI: GPT-5 Nano

openai/gpt-5-nano

GPT-5-Nano — это самая компактная и быстрая вариация в системе GPT-5, оптимизированная для инструментов разработчика, быстрых взаимодействий и сред со сверхнизкой задержкой. Несмотря на ограниченную глубину рассуждений по сравнению с более крупными аналогами, она сохраняет ключевые функции следования инструкциям и безопасности. Она является преемницей GPT-4.1-nano и предлагает облегченный вариант для приложений с ограниченным бюджетом или работающих в реальном времени.

автор openai7 авг. 2025 г.6,19 ₽ / 1 млн входных49,51 ₽ / 1 млн выходных
OpenAI: GPT-4.1

openai/gpt-4.1

GPT-4.1 — это большая языковая модель, оптимизированная для продвинутого следования инструкциям, реальной разработки ПО и рассуждений с длинным контекстом. Она поддерживает контекстное окно в 1 миллионов токенов и превосходит GPT-4o и GPT-4.5 в бенчмарках по кодингу (54.6% SWE-bench Verified), соблюдению инструкций (87.4% IFEval) и мультимодальному пониманию. Она настроена для точных диффов кода, надежности агентов и высокой точности извлечения в больших документах, что делает ее идеальной для агентов, инструментов IDE и корпоративного поиска знаний.

автор openai14 апр. 2025 г.247,55 ₽ / 1 млн входных990,20 ₽ / 1 млн выходных
OpenAI: GPT-4.1 Mini

openai/gpt-4.1-mini

GPT-4.1 Mini представляет собой модель среднего размера, обеспечивающую производительность, сопоставимую с GPT-4o, при значительно меньшей задержке и стоимости. Она сохраняет контекстное окно в 1 миллионов токенов и набирает 45.1% на сложных инструкционных тестах, 35.8% на MultiChallenge и 84.1% на IFEval. Mini также демонстрирует высокие способности к программированию (например, 31.6% в бенчмарке Aider polyglot diff) и понимание изображений, что делает её подходящей для интерактивных приложений с жёсткими ограничениями по производительности.

автор openai14 апр. 2025 г.49,51 ₽ / 1 млн входных198,04 ₽ / 1 млн выходных
OpenAI: GPT-4.1 Nano

openai/gpt-4.1-nano

Для задач, требующих низкой задержки, GPT‑4.1 nano — самая быстрая и дешёвая модель в серии GPT-4.1. Она обеспечивает исключительную производительность при небольшом размере благодаря контекстному окну в 1 миллионов токенов и набирает 80.1% на MMLU, 50.3% на GPQA и 9.8% на Aider polyglot coding — даже выше, чем GPT‑4o mini. Она идеально подходит для таких задач, как классификация или автодополнение.

автор openai14 апр. 2025 г.12,38 ₽ / 1 млн входных49,51 ₽ / 1 млн выходных
OpenAI: GPT-4o (2024-08-06)

openai/gpt-4o-2024-08-06

Версия 2024-08-06 модели GPT-4o обеспечивает improved производительность в структурированных выходных данных, позволяя передавать схему JSON в respone_format. Подробнее здесь. GPT-4o ("o" от "omni") — последняя модель OpenAI линейки AI, поддерживающая как текстовые, так и графические входные данные с текстовыми выходными данными. Она сохраняет уровень интеллекта модели GPT-4 Turbo, будучи при этом вдвое быстрее и на 50% экономичнее. GPT-4o также обеспечивает improved производительность при обработке неанглийских языков и enhanced визуальные возможности. Для сравнения с другими моделями она на короткое время была названа "im-also-a-good-gpt2-chatbot"

автор openai6 авг. 2024 г.309,44 ₽ / 1 млн входных1 237,76 ₽ / 1 млн выходных
OpenAI: GPT-4o-mini

openai/gpt-4o-mini

GPT-4o mini — это новейшая модель OpenAI после GPT-4 Omni, поддерживающая как ввод изображений, так и текста с выводом текста. Будучи их самой продвинутой малой моделью, она во много раз доступнее других недавних моделей前沿 и более чем на 60% дешевле, чем GPT-3.5 Turbo. Она сохраняет интеллект SOTA, будучи при этом значительно более экономичной. GPT-4o mini достигает результата 82% по MMLU и в настоящее время занимает более высокое место, чем GPT-4, в чат-предпочтениях на общих рейтингах. Ознакомьтесь с анонсом запуска, чтобы узнать больше. мультимодальность

автор openai18 июл. 2024 г.18,57 ₽ / 1 млн входных74,27 ₽ / 1 млн выходных
OpenAI: GPT-4o

openai/gpt-4o

GPT-4o ("o" — от "omni") — последняя модель AI от OpenAI, принимающая на вход текст и изображения и выдающая текст. Она сохраняет уровень интеллекта GPT-4 Turbo, при этом работая вдвое быстрее и будучи на 50% экономичнее. GPT-4o также обеспечивает улучшенную производительность при обработке неанглийских языков и расширенные визуальные возможности. Для сравнения с другими моделями она кратко называлась "im-also-a-good-gpt2-chatbot" multimodal

автор openai13 мая 2024 г.309,44 ₽ / 1 млн входных1 237,76 ₽ / 1 млн выходных
OpenAI: GPT-4o (2024-05-13)

openai/gpt-4o-2024-05-13

GPT-4o (буква «o» означает «omni») — последняя модель OpenAI AI, поддерживающая ввод текста и изображений с выводом текста. Она сохраняет уровень интеллекта GPT-4 Turbo, будучи при этом вдвое быстрее и на 50% экономичнее. Кроме того, GPT-4o демонстрирует улучшенную производительность при обработке неанглийских языков и расширенные визуальные возможности. Для сравнения с другими моделями она кратко называлась "im-also-a-good-gpt2-chatbot" мультимодальность

автор openai13 мая 2024 г.618,88 ₽ / 1 млн входных1 856,63 ₽ / 1 млн выходных
OpenAI: GPT-3.5 Turbo (older v0613)

openai/gpt-3.5-turbo-0613

GPT-3.5 Turbo — самая быстрая модель OpenAI. Она может понимать и генерировать естественный язык или код, и оптимизирована для чата и традиционных задач завершения. Данные для обучения до сентября 2021.

автор openai25 янв. 2024 г.123,78 ₽ / 1 млн входных247,55 ₽ / 1 млн выходных
OpenAI: GPT-3.5 Turbo 16k

openai/gpt-3.5-turbo-16k

Эта модель предлагает четырехкратную длину контекста по сравнению с gpt-3.5-turbo, позволяя обрабатывать примерно 20 страниц текста в одном запросе при более высокой стоимости. Данные для обучения: до сентября 2021.

автор openai28 авг. 2023 г.371,33 ₽ / 1 млн входных495,10 ₽ / 1 млн выходных
OpenAI: GPT-4

openai/gpt-4

Флагманская модель OpenAI, GPT-4, — это крупномасштабная мультимодальная языковая модель, способная решать сложные задачи с большей точностью, чем предыдущие модели, благодаря более широким общим знаниям и расширенным возможностям рассуждения. Обучающие данные: до сентября 2021.

автор openai28 мая 2023 г.3 713,27 ₽ / 1 млн входных7 426,53 ₽ / 1 млн выходных
Провайдер Azure | GoRouter