Модели, созданные командой Google и доступные через единый API GoRouter.
39
моделей в каталоге
Модели автора
Хостинг-провайдеры и условия маршрутизации указаны на странице каждой модели.
google/gemini-3.8-flash
Gemini 3.8 Flash — это самая интеллектуальная модель Flash от Google со значительными улучшениями благодаря 3.7 Flash в разработке ПО, агентных задачах и многошаговых рассуждениях.
google/gemini-3.7-flash
Gemini 3.7 Flash — это мультимодальная модель от Google для быстрых агентных процессов, написания кода и сложных многошаговых рассуждений. Она предназначена для задач, требующих отзывчивой производительности и надёжного многошагового решения проблем.
google/gemini-3.6-flash
Gemini 3.6 Flash — это высокоэффективная модель от Google для программирования, агентных рабочих процессов, а также веб- и прикладной разработки. Она создана для получения аккуратных результатов с меньшим числом лишних правок и меньшей осторожностью в формулировках, при этом снижая расход токенов и количество обращений к модели, необходимых для выполнения задачи.
google/gemini-3.5-flash-lite
Gemini 3.5 Flash Lite — это высокоэффективная модель от Google с улучшенными агентными возможностями. Она подходит для субагентов, выполняющих сфокусированные задачи в сложных мультиагентных рабочих процессах.
google/gemini-3.1-flash-lite-image
Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image) — у Google это самая быстрая и экономичная Gemini модель генерации изображений, созданная для высокоскоростных конвейеров разработки и быстрых визуальных исследований. Она обеспечивает генерацию из текста в изображение примерно за 4 секунд — примерно в 2.7 раз быстрее, чем Gemini 3.1 Flash Image, — сохраняя при этом согласованность персонажей, точное редактирование и знания о реальном мире, характерные для семейства Nano Banana. Единый API, подключаемый без изменений, обрабатывает генерацию из текста в изображение, редактирование изображений и создание композиций из нескольких изображений. Будучи мультимодальной моделью, она также возвращает текст вместе с изображениями. Результаты генерируются в разрешении 1K при 14 соотношениях сторон и содержат невидимый водяной знак SynthID, позволяющий идентифицировать их как AI-generated. Позиционируясь как лучший баланс качества и скорости в линейке Nano Banana 2, она позволяет генерировать тысячи изображений по стоимости, составляющей лишь малую долю затрат на более тяжёлые производственные модели, — идеально для прототипирования, приложений реального времени и масштабных визуальных рабочих процессов.
google/gemini-3.1-flash-image
Gemini 3.1 Flash Image, также известная как «Nano Banana 2», — это новейшая модель генерации и редактирования изображений уровня Pro от Google, обеспечивающая визуальное качество уровня Pro на скорости Flash. Она сочетает расширенное понимание контекста с быстрым и экономически эффективным выводом, что делает сложную генерацию изображений и итеративное редактирование значительно более доступными. Соотношением сторон можно управлять с помощью параметра image_config API.
google/gemini-3-pro-image
Nano Banana Pro — самая передовая модель генерации и редактирования изображений от Google, построенная на базе Gemini 3 Pro. Она расширяет возможности оригинальной Nano Banana за счёт значительно улучшенного мультимодального рассуждения, привязки к реальному миру и высокоточной визуальной генерации. Модель создаёт насыщенные по контексту графические материалы — от инфографики и диаграмм до кинематографичных композиций — и может использовать информацию в реальном времени через привязку к поиску. Модель обеспечивает лучшую в отрасли передачу текста в изображениях (включая длинные фрагменты и многоязычные макеты), согласованное смешивание нескольких изображений и точное сохранение индивидуальности до пяти объектов. Nano Banana Pro добавляет тонкие творческие настройки, такие как локальные правки, регулировка освещения и фокуса, трансформации камеры, а также поддержку выходных форматов 2K/4K и гибких соотношений сторон. Она предназначена для профессионального дизайна, визуализации продуктов, раскадровки и сложных многоэлементных композиций, оставаясь при этом эффективной для обычных задач создания изображений.
google/gemini-embedding-2
Gemini Embedding 2 — это первая мультимодальная эмбеддинг-модель от Google. В настоящее время мы поддерживаем отображение текста и изображений в единое векторное пространство для семантического поиска и генерации с дополнением по извлечённым данным (RAG). Модель поддерживает входной контекст до 8,192 токенов и гибкие размерности выходных векторов от 128 до 3,072 (рекомендуемые: 768, 1536 или 3,072). Она разработана для кросс-модального сравнения — вы можете эмбеддить текстовый запрос и получать наиболее релевантные изображения, или наоборот, — что делает её хорошо подходящей для мультимодального поиска, рекомендаций и пайплайнов понимания документов.
google/gemini-3.5-flash
Gemini 3.5 Flash — это высокоэффективная мультимодальная модель от Google, обеспечивающая почти уровень Pro в написании кода и рассуждениях при затратах и скорости уровня Flash. Она оптимизирована для высокой компетентности в программировании и параллельных агентных циклах выполнения, поддерживая ввод текста, изображений, видео, аудио и PDF. По умолчанию используется средний уровень усилия мышления для более быстрых и экономичных ответов, с полной поддержкой уровней мышления (минимальный, низкий, средний, высокий) для тонкой настройки компромиссов между стоимостью и производительностью.
google/gemini-3.1-flash-lite
Gemini 3.1 Flash Lite — это GA высокоэффективная мультимодальная модель от Google, оптимизированная для низкой задержки и больших объёмов рабочих нагрузок. Она поддерживает ввод текста, изображений, видео, аудио и PDF и предназначена для лёгких агентных рабочих процессов, простого извлечения данных и приложений, где основными ограничениями являются отзывчивость и стоимость API. Поддерживает полные уровни мышления (минимальный, низкий, средний, высокий) для тонкой настройки компромиссов между стоимостью и производительностью. Цена составляет половину стоимости Gemini 3 Flash.
google/chirp-3
Chirp 3 — новейшая многоязычная модель распознавания речи от Google. Она обеспечивает повышенную точность транскрипции для 24 GA языков и 77+ языков в предварительном доступе, с поддержкой автоматического определения языка, автоматической пунктуации и встроенного шумоподавителя для более чистой обработки аудио.
~google/gemini-pro-latest
Эта модель всегда перенаправляет на последнюю модель в семействе Google Gemini Pro.
~google/gemini-flash-latest
Эта модель всегда перенаправляет на самую последнюю модель в семействе Google Gemini Flash.
google/gemini-3.1-flash-tts-preview
Gemini 3.1 Flash TTS Preview — это модель преобразования текста в речь от Google, и значительный шаг вперед по сравнению с Gemini 2.5 Flash TTS. Она принимает текстовый ввод и создает аудиовыход на 70+ языках — почти в 3× больше языков, чем у ее предшественницы. Главное дополнение — это система из 200+ встроенных аудиотегов (например, [whispers], [laughs], [excited]), которые позволяют разработчикам управлять подачей, эмоциями и темпом прямо в середине предложения, а также рабочий процесс «режиссерского кресла» в студии Google AI для определения аудиопрофилей для каждого персонажа и контекста сцены. Она поддерживает до двух говорящих с независимой настройкой голоса и стиля для каждого, выводит аудио PCM в формате 24 kHz / 16-бит моно и автоматически добавляет водяной знак SynthID ко всем выходам. Окно контекста — 32k токенов.
google/veo-3.1-fast
Модель генерации видео среднего уровня от Google, сочетающая скорость и качество. Veo 3.1 Fast генерирует высококачественное видео по текстовым или графическим запросам с синхронизированным звуком, обеспечивая более быструю выдачу результата, чем Veo 3.1, при более низкой стоимости. Поддерживает управление по первому и последнему кадру, несколько разрешений и соотношений сторон, а также нанесение водяных знаков SynthID.
google/veo-3.1-lite
Наиболее экономически эффективная модель генерации видео от Google, предназначенная для высоконагруженных приложений и быстрой итерации. Veo 3.1 Lite генерирует видео разрешением 720p и 1080p по текстовым или графическим промптам со встроенным синхронизированным звуком менее чем за 50% стоимости Veo 3.1 Fast. Поддерживает клипы длительностью 4–8 секунд в альбомном (16:9) и портретном (9:16) форматах, с водяным знаком SynthID. Идеально подходит для контентных платформ, создания коротких видео и автоматизированной генерации медиа.
google/gemini-embedding-2-preview
Gemini Embedding 2 Preview — первая мультимодальная модель встраивания от Google. В настоящее время мы поддерживаем сопоставление текста и изображений в едином векторном пространстве для семантического поиска и поисковой дополненной генерации (RAG). Она поддерживает входной контекст до 8,192 токенов и гибкие размеры выходных векторов от 128 до 3,072 (рекомендуется: 768, 1536 или 3,072). Разработана для кросс-модального сходства — вы можете встроить текстовый запрос и получить наиболее релевантные изображения или наоборот, — что делает её хорошо подходящей для мультимодального поиска, рекомендаций и конвейеров понимания документов.
google/gemma-4-26b-a4b-it
Gemma 4 26B A4B IT — это модель Mixture-of-Experts (MoE) с инструкционной настройкой от Google DeepMind. Несмотря на 25.2B общих параметров, во время инференса активируется только 3.8B на токен, что обеспечивает качество, близкое к -31B, при доле вычислительных затрат. Поддерживает мультимодальный ввод, включая текст, изображения и видео (до 60 секунд при 1fps). Имеет контекстное окно в 256K токенов, встроенный вызов функций, настраиваемый режим мышления/рассуждения и поддержку структурированного вывода. Выпущена под лицензией Apache 2.0.
google/gemma-4-31b-it
Gemma 4 31B Instruct — это 30.7B плотная мультимодальная модель Google DeepMind, поддерживающая ввод текста и изображений с выводом текста. Она имеет контекстное окно размером 256K токенов, настраиваемый режим мышления/рассуждений, встроенный вызов функций и многоязычную поддержку для 140+ языков. Сильна в задачах программирования, рассуждений и понимания документов. Лицензия Apache 2.0.
google/lyria-3-pro-preview
Полные песни оцениваются в $0.08 за песню. Lyria 3 — это семейство моделей генерации музыки от Google, доступное через Gemini API. С помощью Lyria 3 вы можете создавать высококачественное стереоаудио с частотой 48кГц на основе текстовых подсказок или изображений. Эти модели обеспечивают структурную целостность, включая вокал, синхронизированные по времени тексты песен и полные инструментальные аранжировки. Lyria 3 Pro могут генерировать полноформатные песни с куплетами, припевами и бриджами.
google/lyria-3-clip-preview
Клипы длительностью 30 секунд стоят $0.04 за клип. Lyria 3 — это семейство моделей генерации музыки от Google, доступное через Gemini API. С помощью Lyria 3 вы можете создавать высококачественное стереоаудио с частотой 48 кГц из текстовых подсказок или изображений. Эти модели обеспечивают структурную целостность, включая вокал, синхронизированные тексты песен и полные инструментальные аранжировки. Lyria 3 Clip могут генерировать короткие клипы, лупы, превью.
google/veo-3.1
Google — это передовая модель генерации видео, созданная для максимальной визуальной точности в финальных производственных версиях. Veo 3.1 генерирует высококачественное видео разрешением 1080p из текстовых или графических подсказок с нативным синхронизированным звуком — включая диалоги, эффекты окружения и фоновые звуки. Поддерживает расширение сцен (до 20 связанных клипов для повествований длительностью 140+ секунд), переходы между двумя изображениями, вертикальное видео для Shorts и апскейлинг 4K.
google/gemini-3.1-flash-lite-preview
Gemini 3.1 Flash Lite Preview — это высокоэффективная модель Google, оптимизированная для сценариев с большими объёмами использования. Она превосходит Gemini 2.5 Flash Lite по общему качеству и приближается к производительности Gemini 2.5 Flash по ключевым возможностям. Улучшения охватывают аудиовход/ASR, ранжирование фрагментов RAG, перевод, извлечение данных и завершение кода. Поддерживаются все уровни мышления (минимальный, низкий, средний, высокий) для точной настройки соотношения затрат и производительности. Цена составляет половину стоимости Gemini 3 Flash.
google/gemini-3.1-flash-image-preview
Gemini 3.1 Flash Image Preview, также известная как «Nano Banana 2», — это последняя модель генерации и редактирования изображений уровня state of the art от Google, обеспечивающая визуальное качество уровня Pro при скорости Flash. Она сочетает расширенное контекстное понимание с быстрым и экономичным инференсом, делая сложную генерацию изображений и итеративное редактирование значительно более доступными. Соотношение сторон можно контролировать с помощью параметра image_config API
google/gemini-3.1-pro-preview-customtools
Gemini 3.1 Pro Preview Custom Tools — это вариант Gemini 3.1 Pro, который улучшает поведение при выборе инструментов, предотвращая чрезмерное использование общего bash-инструмента, когда доступны более эффективные сторонние или пользовательские функции. Эта специализированная предварительная конечная точка значительно повышает надёжность вызова функций и гарантирует, что модель выбирает наиболее подходящий инструмент в программных агентах и сложных многоинструментальных рабочих процессах. Она сохраняет ключевые сильные стороны Gemini 3.1 Pro, включая мультимодальные рассуждения по тексту, изображениям, видео, аудио и коду, контекстное окно на 1M токенов и высокую производительность в разработке программного обеспечения.
google/gemini-3.1-pro-preview
Gemini 3.1 Pro Preview — это флагманская модель рассуждений от Google, обеспечивающая повышенную производительность в разработке ПО, улучшенную надежность агентов и более эффективное использование токенов в сложных рабочих процессах. Опираясь на мультимодальную основу серии Gemini 3, она сочетает высокоточные рассуждения по тексту, изображениям, видео, аудио и коду с контекстным окном на 1M токенов. Детали рассуждений сохраняются при использовании многошаговых вызовов инструментов, см. документацию: https://openrouter.ai/docs/use-cases/reasoning-tokens#preserving-reasoning. Обновление 3.1 обеспечивает измеримые улучшения в бенчмарках SWE и в реальных средах программирования, а также более сильное автономное выполнение задач в структурированных областях, таких как финансы и работа с электронными таблицами. Разработанная для продвинутых систем и агентных архитектур, Gemini 3.1 Pro Preview улучшает долгосрочную стабильность и оркестрацию инструментов, повышая при этом эффективность использования токенов. Она вводит новый средний уровень мышления для лучшего баланса между стоимостью, скоростью и производительностью. Модель отлично справляется с агентным программированием, структурированным планированием, мультимодальным анализом и автоматизацией рабочих процессов, что делает её идеальной для автономных агентов, финансового моделирования, работы с электронными таблицами и корпоративных задач с высоким контекстом.
google/gemini-3-flash-preview
Gemini 3 Flash Preview — это высокоскоростная и высокоценная модель мышления, разработанная для агентных рабочих процессов, многоходового чата и помощи в программировании. Она обеспечивает рассуждения и использование инструментов почти уровня Pro с существенно меньшей задержкой, чем более крупные варианты Gemini, что делает её хорошо подходящей для интерактивной разработки, длительных агентных циклов и задач совместного программирования. По сравнению с Gemini 2.5 Flash она обеспечивает широкие улучшения качества в рассуждениях, мультимодальном понимании и надёжности. Модель поддерживает окно контекста в 1M токенов и мультимодальные входные данные, включая текст, изображения, аудио, видео и PDFs, с выводом текста. Она включает настраиваемые рассуждения через уровни мышления (минимальный, низкий, средний, высокий), структурированный вывод, использование инструментов и автоматическое кэширование контекста. Gemini 3 Flash Preview оптимизирована для пользователей, которые хотят сильных рассуждений и агентного поведения без затрат или задержек полномасштабных передовых моделей.
google/gemini-3-pro-image-preview
Nano Banana Pro — это наиболее продвинутая модель генерации и редактирования изображений от Google, построенная на Gemini 3 Pro. Она расширяет возможности оригинальной модели Nano Banana за счет значительно улучшенного мультимодального рассуждения, привязки к реальному миру и высокоточной визуальной генерации. Модель создает контекстно-насыщенную графику — от инфографики и диаграмм до кинематографичных композиций — и может включать информацию в реальном времени через поисковую привязку. Она обеспечивает лидирующее в индустрии отображение текста в изображениях (включая длинные фрагменты и многоязычные макеты), согласованное смешивание нескольких изображений и точное сохранение идентичности до пяти объектов. Nano Banana Pro добавляет тонкие инструменты творческого контроля, такие как локальные правки, корректировка освещения и фокуса, трансформации камеры, а также поддержку выходных форматов 2K/4K и гибких соотношений сторон. Модель предназначена для профессионального дизайна, визуализации продуктов, раскадровки и сложных многоэлементных композиций, оставаясь при этом эффективной для стандартных рабочих процессов создания изображений.
google/gemini-embedding-001
gemini-embedding-001 обеспечивает унифицированный передовой опыт в различных областях, включая науку, право, финансы и программирование. Эта модель эмбеддингов стабильно занимает высокие позиции в многоязычном рейтинге Massive Text Embedding Benchmark (MTEB) с момента экспериментального запуска в марте.
google/gemini-2.5-flash-image
Gemini 2.5 Flash Image, также известная как "Nano Banana", теперь общедоступна. Это современная модель генерации изображений с контекстным пониманием. Она способна генерировать изображения, редактировать их и вести многоходовые диалоги. Соотношение сторон можно контролировать с помощью параметра image_config API.
google/gemini-2.5-flash-lite
Gemini 2.5 Flash-Lite — это легковесная модель рассуждений в семействе Gemini 2.5, оптимизированная для сверхнизкой задержки и экономической эффективности. Она обеспечивает улучшенную пропускную способность, более быструю генерацию токенов и лучшую производительность в общих бенчмарках по сравнению с более ранними моделями Flash. По умолчанию «мышление» (т.е. многопроходные рассуждения) отключено для приоритета скорости, но разработчики могут включить его через параметр Reasoning API, чтобы избирательно обменивать стоимость на интеллект.
google/gemini-2.5-flash
Gemini 2.5 Flash — это передовая основная модель Google, специально разработанная для сложных задач рассуждения, программирования, математики и науки. Она включает встроенные возможности «мышления», позволяющие давать ответы с большей точностью и тонкой обработкой контекста. Кроме того, Gemini 2.5 Flash настраивается через параметр "max tokens for reasoning", как описано в документации (https://openrouter.ai/docs/use-cases/reasoning-tokens#max-tokens-for-reasoning).
google/gemini-2.5-pro
Gemini 2.5 Pro — это передовая модель Google AI, предназначенная для решения сложных задач в области логики, программирования, математики и науки. Модель использует возможности «мышления», что позволяет ей рассуждать при формировании ответов с повышенной точностью и тонким пониманием контекста. Gemini 2.5 Pro достигает результатов высшего уровня на множестве бенчмарков, включая первое место в рейтинге LMArena, что отражает превосходное соответствие человеческим предпочтениям и способность решать сложные проблемы.
google/gemini-2.5-pro-preview
Gemini 2.5 Pro — это передовая модель AI от Google, предназначенная для решения сложных задач рассуждения, программирования, математики и научных задач. Она использует возможности «мышления», позволяющие ей обдумывать ответы с повышенной точностью и тонким пониманием контекста. Gemini 2.5 Pro достигает результатов высшего уровня на многих бенчмарках, включая первое место в рейтинге LMArena, что отражает превосходное соответствие человеческим предпочтениям и способность решать сложные задачи.
google/gemini-2.5-pro-preview-05-06
Gemini 2.5 Pro — это самая современная модель AI от Google, предназначенная для решения сложных задач в области рассуждений, программирования, математики и научных исследований. Она использует возможности «мышления», позволяющие ей логически выстраивать ответы с повышенной точностью и тонким пониманием контекста. Gemini 2.5 Pro показывает высочайшую производительность в многочисленных тестах, включая первое место в таблице лидеров LMArena, что отражает превосходное соответствие человеческим предпочтениям и способность решать сложные задачи.
google/gemma-3-4b-it
Gemma 3 вводит мультимодальность, поддерживая ввод вида «изображение-текст» и вывод текста. Он обрабатывает контекстные окна до 128k токенов, понимает более 140 языков и предлагает улучшенные возможности для математики, логических рассуждений и чата, включая структурированные выходные данные и вызов функций.
google/gemma-3-12b-it
Gemma 3 вводит мультимодальность, поддерживая ввод на основе зрения и языка и текстовый вывод. Он обрабатывает контекстные окна до 128k токенов, понимает более 140 языков и предлагает улучшенные возможности для математики, рассуждений и чата, включая структурированные выходные данные и вызовы функций. Gemma 3 12B является второй по величине моделью в семействе Gemma 3 после Gemma 3 27B
google/gemma-3-27b-it
Gemma 3 вводит мультимодальность, поддерживая визуально-языковой ввод и текстовые выводы. Он обрабатывает контекстные окна до 128k токенов, понимает более 140 языков и предлагает улучшенные возможности в области математики, рассуждений и чата, включая структурированные выводы и вызовы функций. Gemma 3 27B — это последняя модель с открытым исходным кодом от Google, преемница Gemma 2
google/gemma-2-27b-it
Gemma 2 27B от Google — это открытая модель, созданная на основе тех же исследований и технологий, что и модели Gemini. Модели Gemma хорошо подходят для множества задач генерации текста, включая ответы на вопросы, суммаризацию и рассуждение. Подробнее см. в объявлении о запуске. Использование Gemma регулируется условиями использования Gemma от Google.