Google · текст

Gemini 2.5 Flash API

Чат, написание текстов, анализ документов, код. Цена за миллион токенов.

распознавание изображенийтекстраспознавание изображений

Цены · в рублях

Вход47,145 ₽/1M токенов
Выход394,2825 ₽/1M токенов

Актуальный прайс всех моделей — на странице цен API.

Интеграция

Идентификатор для API

google/gemini-2.5-flash

Совместимо с OpenAI Python/JS SDK — поменяйте только base_url и подставьте этот идентификатор в model. Пошагово — в Quick start.

Через единый API

Переключение на другую модель — одна строка в коде.

Оплата за токены

Без подписок и минимального чека. Списания только по факту.

Рублёвый баланс

Прозрачные цены в рублях, без долларовых конвертаций.

Gemini 2.5 Flash — быстрая мультимодальная модель Google: текст и изображения на входе, огромный контекст и низкая себестоимость. Через Trackly AI она доступна по OpenAI-совместимому API: тот же /v1/chat/completions, оплата в рублях с российской карты, работает без VPN. Подходит для чат-ботов, суммаризации, разбора документов и других массовых задач.

Что умеет Gemini 2.5 Flash и для каких задач она подходит?

Flash — рабочая лошадка линейки Gemini: заметно быстрее и дешевле старшей Pro, при этом принимает на вход не только текст, но и изображения. Контекстное окно — миллион токенов: в один запрос помещается книга, пакет документации или длинная переписка целиком.

Типовые сценарии: чат-боты и ассистенты, суммаризация и перевод, разбор скриншотов и сканов (vision), извлечение структурированных данных, массовая генерация описаний. Русский язык модель держит уверенно. В пайплайнах Flash часто ставят на объёмные шаги — черновой анализ, разметку, фильтрацию, — а сложные случаи эскалируют старшей модели.

Чем Flash отличается от Gemini 2.5 Pro?

Gemini 2.5 FlashGemini 2.5 Pro
Класс задачмассовые и быстрые: боты, суммаризация, экстракциясложные: код, глубокий анализ, рассуждения
Вход через наш APIтекст и изображениятекст и изображения
Скорость ответавысокаяниже: модель «думает» перед ответом
Стоимостьв разы нижефлагманская

Правило простое: начинайте с Flash и переходите на Gemini 2.5 Pro только там, где не хватает глубины анализа. Точные ставки за вход и выход по обеим моделям — на странице цен, по Flash — в калькуляторе выше.

Как подключить Gemini 2.5 Flash через API?

Формат OpenAI-совместимый: берёте официальный SDK OpenAI, меняете base_url на https://api.trackly.one/v1, подставляете ключ из личного кабинета — и указываете модель:

resp = client.chat.completions.create(
    model="google/gemini-2.5-flash",
    messages=[{"role": "user", "content": "Суммаризируй документ: ..."}],
)

Стриминг через SSE, tools, response_format и картинки на входе работают как у OpenAI. Первый запрос за пять минут — в Quick start, детали контракта и vision-формат — в гайде по тексту и чату. Деньги списываются с баланса после успешного ответа по фактическому usage; если провайдер вернул ошибку — списания нет.

Что Gemini 2.5 Flash делает плохо?

  • На сложных многошаговых рассуждениях, архитектуре кода и тонком анализе уступает Pro — это плата за скорость и цену.
  • Генерирует только текст: картинки и озвучка — это отдельные модели каталога, а не режимы Flash.
  • Аудио и видео на вход через наш API не принимаются — только текст и изображения.
  • Ответы лаконичнее и проще стилистически, чем у Pro: для текстов «на публикацию» чаще нужна старшая модель.

Кому подойдёт Flash, а кому взять соседнюю модель?

Flash — выбор по умолчанию для продакшена с большим потоком запросов: боты, суммаризация, vision-разбор документов. Если нужен сильный код и глубокий анализ — берите Gemini 2.5 Pro. Хотите сравнить с конкурентом того же класса «быстро и дёшево» — посмотрите GPT-5 mini. Озвучить готовый текст можно TTS-моделью той же линейки. А попробовать Flash без кода — в чате на сайте.

Вопросы и ответы

Совместим ли Gemini 2.5 Flash с OpenAI SDK?+

Да. Модель доступна через OpenAI-совместимый эндпоинт chat/completions: подойдёт официальный SDK OpenAI для Python или JavaScript — достаточно поменять base_url на api.trackly.one/v1 и подставить ключ Trackly. Стриминг, tools и response_format работают в привычном формате, переписывать интеграцию не придётся.

Принимает ли Gemini 2.5 Flash картинки на входе?+

Да, модель мультимодальная: в сообщение можно вложить изображение вместе с текстом — по URL или в base64, в том же формате, что у OpenAI. Это удобно для разбора скриншотов, сканов и фото документов. На выходе модель всегда отдаёт текст.

Какой размер контекста у Gemini 2.5 Flash?+

Контекстное окно — около миллиона токенов. Этого хватает, чтобы отправить в один запрос целую книгу, большой пакет документации или длинную историю диалога без обрезки. Учтите, что оплата идёт по фактическому числу токенов, поэтому очень длинный контекст увеличивает стоимость каждого запроса.

Можно ли оплатить работу с моделью российской картой?+

Да. Баланс пополняется в рублях с российской карты, зарубежная оплата и VPN не нужны. Деньги списываются с баланса после успешного ответа модели по фактическому расходу; если запрос завершился ошибкой провайдера, списания не происходит.

Обновлено 13 июля 2026 г.

Попробуйте gemini-2.5-flash

Зарегистрируйтесь, пополните баланс и сделайте первый запрос за пять минут.