Компания Google официально выпустила стабильные версии своих моделей Gemini 2.5 Flash и Pro, отметив их готовность к использованию после успешного этапа предварительного тестирования. Обе модели уже показали высокие результаты в отраслевых тестах, и, согласно неофициальным данным, эти показатели сохраняются и при использовании в реальных условиях.
Теперь разработчики могут получить доступ к Flash-Lite в Google AI Studio и Vertex AI, а также к стабильным моделям Flash и Pro на этих платформах и в приложении Gemini. Новый вариант, Gemini 2.5 Flash-Lite, описывается как самая быстрая и экономичная модель в линейке Gemini 2.5. По данным Google, Flash-Lite превосходит своего предшественника (2.0 Flash-Lite) в тестах на программирование, математику, естественные науки и логическое мышление.
Flash-Lite предлагает низкие цены и быстрое время отклика, но модели Pro лидируют по сложности и точности. Например, среди тестов, на которых Flash-Lite показывает высокие результаты, можно выделить тесты GPQA, AIME и LiveCodeBench. Минимальная стоимость Flash-Lite составляет 0,10 доллара за миллион входных токенов и 0,40 доллара за миллион выходных токенов.
Все версии Gemini 2.5 теперь позволяют разработчикам настраивать ‘бюджет на вычисления’, что удобно для контроля расходов. Google недавно усилила свои позиции в области искусственного интеллекта с выпуском моделей Gemini 2.5, продемонстрировав заметный прогресс по сравнению с предыдущими версиями. Эти изменения делают компанию более конкурентоспособной по сравнению с OpenAI.
Gemini 2.5 Flash стала доступна после конференции Google I/O, а теперь запустили новую версию 04-17, в которой исправлены недочеты предыдущей сборки 2.5 Pro. Важно отметить, что Flash и Flash-Lite теперь будут использоваться в поисковой системе. Например, для сложных запросов будет задействована модель 2.5 Pro, а для простых — Flash или Flash-Lite. Это помогает Google подбирать модель для наилучшей обработки каждого конкретного запроса.
