Google обновила Android Bench: GPT-5.5 обошел Gemini в кодинге под Android

Google опубликовала обновленный бенчмарк Android Bench для оценки эффективности ИИ-моделей в мобильной разработке. Инструмент замеряет, насколько точно языковые модели работают с актуальным Android SDK, пишут на Kotlin и используют современные библиотеки.
Главный результат тестирования оказался неожиданным: собственная модель Google уступила лидерство. Первое место в рейтинге качества кода заняла GPT-5.5 от OpenAI, обойдя актуальные версии Gemini. Модели прогоняли через реальные сценарии: настройка фоновых задач, работа с базами данных и сборка интерфейсов на Jetpack Compose.
Публикация таких данных на официальном портале показывает переход компании к объективной оценке тулинга. На практике это значит, что для проектирования сложной архитектуры пока логичнее использовать сторонние LLM, оставляя рутинную генерацию UI и автодополнение встроенным в Android Studio ассистентам.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад