
Google продолжает наращивать темпы в гонке ИИ, представив превью-версии обновленных моделей Gemini 2.5 Flash и Flash-Lite. Главный прорыв — производительность: по данным независимых тестов, Flash-Lite стала самой быстрой проприетарной моделью на рынке, демонстрируя впечатляющую пропускную способность около 887 токенов в секунду. Вторым ключевым улучшением стало значительное сокращение количества выходных токенов, что напрямую влияет на снижение затрат и времени отклика. Одновременно с этим Google представила новую концепцию версионирования — «плавающие» псевдонимы с суффиксом `-latest`, которые всегда указывают на самую свежую версию модели. Этот подход ставит разработчиков перед выбором: использовать удобные, но потенциально изменчивые псевдонимы для быстрого доступа к инновациям или же закреплять стабильные версии для производственных сред, где предсказуемость является критически важной. Глубокое погружение: чем отличается Gemini Flash от Flash-Lite? Независимый...








